字节跳动联合港科大发布MMProLong:长文档LMM训练问答对效率远超OCR转录
5月24日,字节跳动Seed团队联合香港科技大学发布了一项针对多模态大语言模型(LMM)长文档训练的最新研究成果。研究人员基于阿里巴巴开源的Qwen2.5-VL构建了名为 MMProLong 的新模型,并在长文档处理效率上取得突破性进展。该研究不仅打破了多模态模型长文本训练的传统...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,408
正文图片
13,773
5月24日,字节跳动Seed团队联合香港科技大学发布了一项针对多模态大语言模型(LMM)长文档训练的最新研究成果。研究人员基于阿里巴巴开源的Qwen2.5-VL构建了名为 MMProLong 的新模型,并在长文档处理效率上取得突破性进展。该研究不仅打破了多模态模型长文本训练的传统...

每经记者:宋欣悦 每经编辑:高涵 《每日经济新闻》根据OpenRouter最新数据测算,上周(5月18日至5月24日)全球AI大模型总调用量为28.9万亿Token,较此前一周增长7.4%,连续五周上涨,大模型调用需求仍在持续释放。 其中,上榜的AI大模型中,中国AI大模型周调用...

近日,李飞飞团队发布的 ESI-Bench (Embodied Spatial Intelligence Benchmark)引起了广泛关注。该基准不仅被誉为具身智能界的“ImageNet”,更深刻揭示了当前顶尖大模型在处理物理空间交互时的致命短板。 ESI-Bench:为何它是...

近日,DeepSeek官方宣布,旗下DeepSeek-V4-Pro模型API在2026年5月31日结束限时优惠后将不再恢复原价,而是正式转为永久降价,直接调整为原定价的四分之一。此前,该模型于4月26日推出了全系API价格调整,将输入缓存命中价格降至首发价的十分之一,并叠加了限时...

5月22日,阿里千问官方公众号宣布,全新一代智能模型 Qwen3.7-Max 正式接入千问 App、PC 端和网页端。用户只需将千问 App 更新至6.9.7及以上版本,便可通过应用内的 “Qwen3.7-Max” 按钮或 PC 网页的模型选择栏进行切换,立即体验这一最新的智能助...

清华大学存储实验室与腾讯混元AI Infra团队近日联合宣布,在国际机器学习系统顶级会议MLSys2026举办的MoE模型推理优化挑战赛中荣获全球冠军。 面对万亿参数时代混合专家(MoE)架构在异构芯片(NPU)上的推理性能瓶颈,联合团队针对官方指定模型及NPU硬件设计了全链路优...

本文来自微信公众号: 叶小钗 ,作者:叶小钗,原文标题:《Agent Harness 可观测性:生产级 AI 项目必须补上的一课》 今年开始,Agent的基础执行环境从能力上已经OK,所以逐渐开始有很多产品真正的走向生产,这个时候如何让Agent长期稳定的运行,如何正确的执行长链...

【环球网财经综合报道】DeepSeek日前宣布,DeepSeek-V4-Pro API永久降价至原价的25%,创全球大模型价格新低。DeepSeek正在推进700亿元人民币融资,这比之前传出的500亿元规模更大,有望创下中国AI企业史上最大单笔融资纪录。 中信建投证券近日发文称,...
在最近的一季度,人工智能行业的融资热潮引发了广泛关注。根据统计,整个 AI 领域的融资事件接近 600 起,总金额超过 1100 亿元,这一数字相比去年同比激增了 185.4%。可以说,这波融资热潮正如一场狂欢派对,让众多创业公司和投资者都兴奋不已。 5 月份,一些国产大模型项目...

朋友老张做企业咨询,上周找我喝茶,满脸焦虑:“现在客户全跑去问AI了,问完直接下单,根本没我什么事儿。” 我笑着给他看手机—在Kimi里搜“上海最懂连锁加盟的咨询团队”,第一条推荐就是他公司的名字,附带业务亮点和客户评价。他眼睛都直了。 “这不是竞价,也不是运气,”我说,“是我用...

2026年5月23日,“2026广东智能算力与大模型应用安全大会”在广州市黄埔区隆平院士港隆重召开。大会由广东省计算机学会、广东省保密协会和广东省网络空间安全产学研联盟共同指导,广东省计算机学会网络空间安全专委会主办。 大会吸引了三六零数字安全科技集团有限公司、中国联通广东省分公...

本文来自微信公众号: 赛格大道 ,作者:刘溪禾 硅谷AI精英在公开场合的表态,与他们真实的判断和资源部署之间,存在系统性背离,他们之间存在一种压制中国AI的战略默契:表层威胁论扩大政策弹药(出口管制、打击蒸馏、限制云租赁),里层用代差武器锁定真实的断代领先。 面对硅谷释放的烟雾弹...

“星福匠”AI大模型项目路演推介。主办方供图 人民网深圳5月23日电 (记者王星)5月23日,第二十二届文博会期间,深圳市文体旅游招商推介暨“AI+文旅”资源对接会在深圳国际会展中心举办。全国首个玉石行业垂类AI大模型“星福匠”成为本次对接会重点推介项目之一。 “星福匠”由深圳市...

来源:市场资讯 (来源:机器之心Pro) 编辑|Sia 「妖股」的绝地反杀 想象这样一家公司:它 2021 年上市,市值一度接近 400 亿美元;一年后,股价暴跌 92%,市值跌破 40 亿美元。 然而,短短两年多后,它跑出了美股科技股里最疯狂的反弹之一。 2024 年,它的股价...

人工智能技术正以前所未有的速度融入现代社会,金融行业亦不例外。随着各大银行从“数字化”迈向“数智化”,市场对高端AI技术人才的需求愈发迫切。5月24日,北京商报记者梳理发现,近期交通银行、中国银行、广发银行等多家机构密集展开社会招聘,争抢AI领域高层次人才。而这些岗位的准入门槛堪...

大模型的尽头是什么,你不用告诉我。 我自己会去隆江猪脚饭看。 最近,世超在社交媒体刷到了不少 " 大模型算法面经 " 帖。 分享面试经验,这事儿自古有之。但要在麦当劳考察大模型优化点餐推荐策略,这。。。对吗? 来源:小红书 @他的南京吃喝指南 去雪王面试,要设计糖分注意力机制。被...

界面新闻记者 | 张熹珑 “嗨!我是灵犀,欢迎与我一起沉浸式感受上海。” 第二十二届中国(深圳)国际文化产业博览交易会的上海展区现场,智元灵犀X2人形机器人做出“请”的手势,引导观众走向身后的8K数字大屏。从豫园灯会的3D数字复刻版龙形灯组,到中共一大纪念馆的VR红色研学路线,从...

大模型的尽头是什么,你不用告诉我。 我自己会去隆江猪脚饭看。 最近,世超在社交媒体刷到了不少 “ 大模型算法面经 ” 帖。 分享面试经验,这事儿自古有之。但要在麦当劳考察大模型优化点餐推荐策略,这。。。对吗? 来源:小红书 @他的南京吃喝指南 去雪王面试,要设计糖分注意力机制。被...

新智元报道 【新智元导读】219个词喂给AI,12小时后,一份7nm芯片版图出来了,工程师全程没碰键盘。这条芯片行业几十年没有AI走完过的路,第一次走通了。 一套跑在云端的大模型Agent系统,收到了一段219个英文单词的需求描述。 12小时后,它输出了一颗CPU的GDSII版图...