
百度文心大模型5.1发布:登顶多个榜单,预训练成本仅为业界 6%
【TechWeb】5月9日消息,百度文心大模型5.1 正式发布,其继承文心5.0 知识,显著降低预训练成本,将总参数压缩至约1/3、激活参数压缩至约1/2,仅使用业界同规模模型约6% 的预训练成本,实现同级别模型基础效果领先。 登录文心一言官网即可与文心5.1模型对话体验最新能力...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,416
正文图片
13,821

【TechWeb】5月9日消息,百度文心大模型5.1 正式发布,其继承文心5.0 知识,显著降低预训练成本,将总参数压缩至约1/3、激活参数压缩至约1/2,仅使用业界同规模模型约6% 的预训练成本,实现同级别模型基础效果领先。 登录文心一言官网即可与文心5.1模型对话体验最新能力...

每经记者:宋欣悦 每经编辑:高涵 《每日经济新闻》根据 OpenRouter 最新数据测算,上周(5月4日至5月10日)全球AI大模型总调用量为25.7万亿 Token ,较此前一周增长7.5%,连续三周上涨。 其中,上榜的AI大模型中,中国AI大模型周调用量达7.941万亿To...

本报讯 (记者李万晨曦)5月9日,由湖北人形机器人创新中心(以下简称“人形机器人中心”)主办的动作大模型发布暨产品技术分享会在光谷成功举办。会上,北京大学武汉人工智能研究院联合北京虚拟动点科技发布人形机器人动作大模型,人形机器人中心作为核心平台载体与产业枢纽,全程支撑技术研发、场...

我才刚开始用Markdown不到一年,怎么现在Markdown就要被淘汰了? 事情经过是这样的, Claude Code 团队成员Thariq在X上发表了一篇文章,标题叫《Using Claude Code: The Unreasonable Effectiveness of H...

作者 | 王兆洋 邮箱 | wangzhaoyang@pingwest.com 三周之内,在公开报道里 DeepSeek 的估值四次改写: 4月初约100亿美元“启动融资”,4月22日的报道称其估值超过200亿美元,5月6日传出“ 大基金 ”洽谈领投,估值约450亿美元,而上周最...
一、凌晨两点的训练Run,和一个没人问的问题 凌晨两点,北京某多模态大模型实验室。大屏上,一个正在进行的预训练Run跑到了第47小时。技术负责人盯着Loss曲线抖了一下,然后把椅子转回来说了一句:“我们缺的不是卡,是干净、对齐、能被复用的多模态语料。” 这不是个例。2026年4月...

henry 发自 凹非寺 量子位 | 公众号 QbitAI VLA已死,世界动作模型当立。遥操已死,人类的传感器数据长存。 在今年的红杉AI Ascent 2026上,Jim Fan只用了20分钟,就给机器人行业连开了两场“葬礼”。 第一场,送别过去三年几乎统治具身智能的VLA;...

允中 发自 凹非寺 量子位 | 公众号 QbitAI 机器人拉个拉链,到底需不需要“脑子”? 过去几年,从OpenVLA到π0、π0.5,具身大模型已经能让机器人把指令和动作连得有模有样。 但一旦包的位置挪了几厘米,或者光照暗了一点,它们往往就会“大脑宕机”。 究其原因,是因为这...

品玩5月11日讯,北京智源人工智能研究院联合北大、北航等机构正式发布FlagSafe大模型安全体系。该体系聚焦红队演练、蓝队防御与白盒透视三大方向,旨在构建覆盖风险发现、治理与解释的完整闭环。 针对跨模态及具身智能带来的复合风险,FlagSafe确立五项安全红线,并建立全面评估基...

三周之内,在公开报道里DeepSeek的估值四次改写: 4月初约100亿美元“启动融资”,4月22日的报道称其估值超过200亿美元,5月6日传出“大基金”洽谈领投,估值约450亿美元,而上周最新传出的估值上限是超500亿美元——若成真,这会是中国AI公司有史以来最大的单轮融资。 ...

医疗数据知识浩如烟海,医疗保险业务规则纷繁庞杂。医保(社保中的医疗保险)、商保(商业医疗保险,如医疗险、重疾险等)均为国计民生高价值场景,关乎基金安全、公共利益与群众切身权益,对精准性、合规性、安全性、可追溯性提出极致要求。AI 如何真正读懂复杂病历、穿透海量单据、助力医保基金监...

传统数据中心过去主要用于数据的存储、检索与处理。但在生成式 AI 与代理式 AI 时代,这些设施已演变为 AI Token 工厂。随着 AI 推理成为其核心工作负载,它们的主要产出已转变为以 Token 形式制造的智能。 这一转变也需要对包括总体拥有成本(TCO)在内的 AI 基...

Jay 发自 凹非寺 量子位 | 公众号 QbitAI 中国AI研究员的性格、魅力和真诚……让人倍感亲切。 这是艾伦研究所(Ai2)的研究员 Nathan Lambert ,在最近结束中国之行后,发自内心的一番感慨。 在Nathan眼里, 国内的LLM圈子简直是天堂 ,大家彼此尊...

每经记者|李宇彤 每经编辑|余婷婷 豆包,终于向用户开出了第一份付费账单。 5月4日,当月活3.45亿、国内C端(消费者)用户规模第一的豆包,官宣68元/月至500元/月不等的分层订阅付费,国内大模型行业“免费为主、付费试水”的平衡被彻底打破。 图片来源:App Store截图 ...

每经记者|叶晓丹 每经编辑|廖丹 4月30日,《每日经济新闻》记者注意到,DeepSeek在Github上正式发布了多模态模型,公布了背后的技术报告。 图片来源:Github网站 DeepSeek在技术报告中提到,尽管多模态大语言模型(MLLMs)取得了显著进展,但主流的思维链(...

每经记者|宋欣悦 每经编辑|高涵 《每日经济新闻》根据OpenRouter最新数据测算,上周(4月27日至5月3日)全球AI大模型总调用量为23.9万亿Token,较此前一周增长8.6%,连续两周上涨。 其中,上榜的AI大模型中,中国AI大模型的周调用量上升至7.942万亿Tok...

每经记者|宋欣悦 特约记者 温沐夏 每经编辑|张益铭 这个“五一”假期,“让豆包、点点等大模型做份旅游攻略”成为大众出行前的主流操作。从目的地选择、行程规划到食宿推荐,AI(人工智能)彻底改变了传统旅游决策模式。 但你有没有想过,我们随手用大模型生成的旅行攻略,背后真正支撑的信源...

每经记者|宋欣悦 每经编辑|高涵 《每日经济新闻》记者根据OpenRouter最新数据测算,上周(4月20日至26日)全球AI大模型总调用量为21.9万亿Token,较此前一周增长6.3%,连续两周下滑后小幅回升。 其中,上榜的AI大模型中,中国AI大模型的周调用量下滑至4.37...

快科技5月12日消息, Zyphra近日正式联手AMD推出全新开源AI平台Zyphra Cloud,直接对标DeepSeek,通过纯AMD硬件生态挑战当前AI市场格局。 Zyphra Cloud针对DeepSeek V3.2、Kimi K2.6以及GLM 5.1等前沿长文本、开源...