
让大模型边想边说:这篇文章把「何时开口」变成可学习策略
导语:推理模型的「沉默税」该怎么解? 用过推理型大模型的人,大概率都熟悉这种体验:模型似乎在认真思考,但屏幕上长时间没有真正有用的内容;如果让它一开始就输出,又很容易出现仓促判断,后面的推理还要被早期错误牵着走。 这正是论文 When to Think, When to Spea...
学术研究 方向最近有哪些内容值得看
学术研究 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
学术研究资讯
1,575
正文图片
7,754

导语:推理模型的「沉默税」该怎么解? 用过推理型大模型的人,大概率都熟悉这种体验:模型似乎在认真思考,但屏幕上长时间没有真正有用的内容;如果让它一开始就输出,又很容易出现仓促判断,后面的推理还要被早期错误牵着走。 这正是论文 When to Think, When to Spea...
Thoth团队 投稿 量子位 | 公众号 QbitAI 人类研究员做实验,从来不是把几句步骤随手拼起来。 一份真正可复现的实验protocol,需要明确每一步做什么、对什么对象操作、用什么参数,以及步骤之间的先后依赖。 一旦顺序错了、剂量错了、对象错了,表面上看起来流畅的文本,也...

著名的开放学术预印本存储库arXiv近日出台严厉新规,宣布将对在科研论文中滥用人工智能(AI)的行为进行严厉打击。此举的核心目的并非禁止技术辅助,而是为了遏制部分学者因过度依赖AI生成内容且未仔细核查,导致论文可信度严重下滑的乱象。 目前,arXiv正从康奈尔大学运营的网站转型为...
这项由ServiceNow与加拿大Mila人工智能研究院联合开展的研究,于2026年5月以预印本形式公开发布,论文编号为arXiv:2605.12178。研究团队横跨两家机构,成员众多,覆盖了AI系统设计、企业自动化和强化学习等多个方向。感兴趣的读者可以通过上述编号在arXiv平...
这项由多所高校及研究机构联合开展的研究成果以预印本形式发布于2026年5月,论文编号为arXiv:2605.12119,感兴趣的读者可以通过该编号查询完整论文。 每一张照片或每一段视频,都只是从某一个固定的角度"看"到的世界。如果我们想换个角度再看看——比如绕到物体背后,或者从高...
这项由字节跳动Seed部门研发的研究成果以预印本形式于2026年5月12日发布,论文编号为arXiv:2605.12305,有兴趣深入了解的读者可通过该编号查询完整论文。 你有没有遇到过这样的情况:你想让AI帮你画一张图,图里要有你家的狗、你客厅的沙发、还有你上周买的那盏台灯,全...
这项由字节跳动与加州大学圣克鲁兹分校联合开展的研究,以预印本形式发布于2026年5月4日,论文编号为arXiv:2605.02364,感兴趣的读者可通过该编号在arXiv平台查阅完整原文。 训练一个大型语言模型,本质上和开一家高档餐厅没什么两样——食材的质量与搭配比例,直接决定了...

Springer Nature旗下新刊资讯,涵盖各学科研究,定期更新,欢迎阅读关注,不错过最新学术动态! 期刊介绍 Nature Portfolio旗下的新刊 npj Wireless Technology 已于2025年11月正式上线。本期推送中,我们为读者总结了npj Wir...

在大模型后训练中,数据不再只是 “越多越好”,而是要像人类学习一样,动态选择最合适难度的样本。华为提出的 EDCO 方法,将样本难度估计与动态课程编排引入领域大模型微调;数月后,由 Rutgers、Amazon、Google 等作者参与的 DARE 论文即引用 EDCO,并将其作...

1. OpenAI 的两大宿敌 Anthropic 和马斯克,放下心中成见之后终于在月初结盟了。 在此之前,Anthropic 和马斯克的关系并不融洽:今年 2 月,马斯克还在自己的 X 账号指责 A 社「woke」「邪恶」「反人类」(misanthropic),说这家公司「仇视...
I²B-LPO 是一个面向 RLVR 后训练的探索增强框架,通过改进 rollout 策略引导模型生成更多样化的推理轨迹,将探索行为从 “重复采样” 推进到 “在关键节点生成更具区分度的推理轨迹”,在多个数学基准上同时提升准确率与语义多样性,最高分别达 5.3% 和 7.4%。该...

作者 李航,张少华,林苑 我们每天都在使用大语言模型(Large Language Model,LLM)。一个明显的感受是,它们似乎真的能够理解我们的语言,虽然有时也会出现幻觉。另一方面,观察 LLM 输出的思维链,也就是其推理过程的语言表示,我们会感到它们好像真的能像人一样思考...
全行业都在押注多Agent。 Anthropic上周在开发者大会上发了Multi-Agent Orchestration ,TRAE做了多Agent并行调度,各家都在讲一个Agent干不动就上多Agent。 最近,滑铁卢大学在 arXiv 上放出一篇论文,给出了相悖结论—— 多 ...

本文来自微信公众号: 夕小瑶科技说 ,作者:丸美小沐,原文标题:《多Agent协作反而让模型变蠢,AI也有「旁观者效应」》 全行业都在押注多Agent。 Anthropic上周在开发者大会上发了Multi-Agent Orchestration,TRAE做了多Agent并行调度,...

品玩5月18日讯,arXiv宣布,将进一步收紧对AI生成内容的管控措施。这一举措旨在向学术界释放明确信号:即便在AI辅助科研的时代,内容质量与学术严谨性依然是不可逾越的底线。 随着AI写作工具的普及,大量质量参差不齐甚至存在事实错误的论文涌入arXiv,严重稀释了真正具有价值的科...

编者按:本文来自微信公众号 “量子位”,作者:关注前沿科技,创业邦经授权转载。 听雨 发自 凹非寺量子位 | 公众号 QbitAI 用Claude Code写论文的一整套流水线,有人打包开源出来了。 完全戳中了学生党的痛点,github星标直达6.4k。 academic-res...

专注AIGC技术的专业社区,关注大语言模型(LLM)的发展和应用落地,聚焦LLM及AI技术的市场研究和开发者生态,欢迎关注! Meta离职后的AI技术大牛田渊栋,去向一直备受关注。 刚刚,他亲自官宣了创业。 25名顶级研究人员和工程师,踏上了同一条船Recursive Super...

在科研领域,写论文一直是学术人员的一项重要任务,而如今,有了一个名为 “academic-research-skills”(ARS)的开源项目,这一过程变得更加简便和高效。这一工具包集成了 Claude Code 的能力,能够帮助研究者从选题到交稿完成整套流程,受到广泛关注,Gi...