
拒绝大力出奇迹,PRISM框架让dLLM也能高效Test-Time Scaling
近年来,大模型能力提升的焦点正在从「训练时扩展」转向「推理时扩展」。从 Best-of-N、Self-Consistency 到更复杂的搜索与验证框架,Test-Time Scaling 已经成为提升大模型复杂推理能力的重要范式。 然而,一个长期被忽视的问题是:这些方法大多默认模...
大模型 方向最近有哪些内容值得看
大模型 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
大模型资讯
3,406
正文图片
13,770

近年来,大模型能力提升的焦点正在从「训练时扩展」转向「推理时扩展」。从 Best-of-N、Self-Consistency 到更复杂的搜索与验证框架,Test-Time Scaling 已经成为提升大模型复杂推理能力的重要范式。 然而,一个长期被忽视的问题是:这些方法大多默认模...

AI技术正迎来行业化、场景化解决方案的蓬勃发展。基于平台大规模的智能服务实践,阿里将领先的智能技术与大模型算法应用于商家客服体系,正式升级全新AI店小蜜,让智能客服从“会话”走向“办事”,从“标准应答”变得“更懂用户”。 5月11日,阿里发布全新AI店小蜜。据发布会介绍,这是电商...

5月11日,火山引擎正式发布业界首个“Agent套餐包”——Agent Plan,标志着AI应用加速从单一的编程辅助向通用智能体(General Agent)跨越。该计划突破了传统模型订阅的单一维度,深度整合了字节跳动自研的Doubao-Seed、Doubao-Seedance、...

文 | 字母AI 我才刚开始用Markdown不到一年,怎么现在Markdown就要被淘汰了? 事情经过是这样的,Claude Code团队成员Thariq在X上发表了一篇文章,标题叫《Using Claude Code: The Unreasonable Effectivene...

每经记者|宋欣悦 每经编辑|高涵 《每日经济新闻》根据OpenRouter最新数据测算,上周(5月4日至5月10日)全球AI大模型总调用量为25.7万亿Token,较此前一周增长7.5%,连续三周上涨。 其中,上榜的AI大模型中,中国AI大模型周调用量达7.941万亿Token,...

文 | 字母AI 在agent时代最贵的是什么?是token。 一些重度agent使用者,一个月用掉几亿token,账单小几万块钱也是常有的事。 然而现在开始,有这么一个开发者他开源了一个本地方案,一台苹果笔记本就能部署,也就是说,你从此实现了"龙虾自由",跑再多任务,也不会再为...