
阿里RTPurboV2:原生Transformer再次崛起,百步训练实现10倍稀疏注意
机器之心发布 “Full Attention 正在被遗忘” 随着 Agent 的广泛应用带来的长序列需求,传统 GPT 架构的 Attention 部分,由于其 O (N^2) 的计算复杂度,正逐渐被视为性能瓶颈而遭到替换。而 Attention 机制的架构迭代,也正在以前所未有...
学术研究 方向最近有哪些内容值得看
学术研究 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
学术研究资讯
1,677
正文图片
8,361

机器之心发布 “Full Attention 正在被遗忘” 随着 Agent 的广泛应用带来的长序列需求,传统 GPT 架构的 Attention 部分,由于其 O (N^2) 的计算复杂度,正逐渐被视为性能瓶颈而遭到替换。而 Attention 机制的架构迭代,也正在以前所未有...

“递归式自我提升”既诱人又令人担忧 图片来源:Getty Images 2026年6月7日 人工智能实验室Anthropic将于今年晚些时候上市,届时很可能成为史上规模最大的首次公开募股之一。这是因为该公司开发的聊天机器人 Claude 深受程序员喜爱,他们愿意为此支付高额费用。...

专注AIGC技术的专业社区,关注大语言模型(LLM)的发展和应用落地,聚焦LLM及AI技术的市场研究和开发者生态,欢迎关注! AI 正在一步步造出下一代 AI,而且速度越来越快。 Anthropic 发了一篇长文,用一组从未公开的内部数据,证实了这件事。 Anthropic 在这...

IT之家 6 月 8 日消息,提起野生动物走私,我们或许会想到犀牛角、被当作宠物贩卖的红毛猩猩幼崽。但海洋生物走私这类鲜为人知的犯罪活动,同样会严重破坏海洋生态系统。令人担忧的是,鱼翅等常见走私海洋野生物品极易藏匿在行李或包裹中跨境运输,往往难以被查获。为解决这一难题,科研人员借...

本文来自微信公众号: 返朴 ,作者:返朴 2021年,美国疾控中心的一间实验室里。一个年轻人一动不动,数百只埃及伊蚊正围着他盘旋飞舞。它们一次次俯冲、靠近、折返,而他在实验中要一次性保持静止20分钟。 这一切都是为了解决研究人员心中的疑惑:蚊子究竟是怎么“找到人”的。他以身入局,...

腾讯前沿科技论文解读专栏,在代码与商业的交汇处,寻找AI的确定性。 文|博阳 编辑|徐青阳 Multi-Agent 的叙事,进入5月之后似乎就有点卡壳。 因为大家发现这个模式似乎并没有那么高效。虽然比单 Agent 更强,但是并不像想象中那样,1+1>2。 2026 年 5 月发...
中经记者 索寒雪 北京报道 近日,《中国经营报》记者从中国知网内部人士处获悉,知网将推出大模型产品。高校教师、科研人员及学生在梳理并输入核心想法后,该产品可基于知网高质量数据资源,辅助开展文献检索、选题分析和结论推断等工作。 当记者询问该服务未来定价时,上述人士表示:“新产品不代...

如果把一篇最新的 3D 几何视觉论文、一个挖空关键函数的代码模板,一起交给大模型,它能否像真正的研究者一样,把论文里的几何推导和算法逻辑准确写成可执行代码,并通过一套严格的单元测试? GeoCodeBench 给出的答案并不乐观。 图 1: 主流 LLM 在 GeoCodeBen...

本文来自微信公众号: 硅谷101 ,作者:硅谷101,原文标题:《“没水了,鱼需要进化”:再访田渊栋,46.5亿美金估值的RSI与AI自进化|Neolabs特辑》 近期,Anthropic公开呼吁全球暂停AI开发,原因是“AI正在以惊人速度加速AI自身的开发进程”。这样的进程被称...

一种由MIT设计的全新激光雷达芯片利用专门设计的天线来减少干扰并扩大传感器的视场。 从行驶在拥挤街道上的自动驾驶汽车到调查灾区的无人机,激光雷达已经成为帮助机器感知三维世界最重要的技术之一。通过发射快速的红外光脉冲并测量其反射,激光雷达系统可以实时构建其周围环境的高度详细地图。 ...

在智能手机能够手掌掌控不到二十年后的今天,人工智能已经可以在佩戴在我们手腕上的设备上运行。挑战在于,虽然设备在继续缩小,但它们必须处理的数据量和必须履行的功能数量却在呈指数级增长。浦项科技大学(POSTECH)的一个研究团队找到了一种有望解决这一矛盾的方法。 由POSTECH电子...

编辑|Sia 在具身智能最难的泛化问题上,他们连续拿出顶会级成果,并把它们沉淀进其创新 VLOA 大模型,推动机器人迈向广阔现实。 6 月 1 日至 5 日,机器人领域顶级会议 ICRA 2026 在奥地利维也纳举行。RoboScience 机器科学首席科学家、新加坡国立大学助理...

编辑|Panda 过去一年,AI 推理模型的使用成本让不少开发者叫苦。 「慢思考」模型在处理数学、代码、逻辑题时确实表现惊艳,但代价是每次调用都会生成几百乃至几千个「思考 token」。这些 token 现在答案之前,是模型一步步演算的草稿纸。这些草稿可见,但昂贵。一道复杂数学题...

本文来自微信公众号: 机器之心 ,编辑:Panda,作者:研究推理的 过去一年,AI推理模型的使用成本让不少开发者叫苦。 「慢思考」模型在处理数学、代码、逻辑题时确实表现惊艳,但代价是每次调用都会生成几百乃至几千个「思考token」。这些token现在答案之前,是模型一步步演算的...

作为一项重要的模型对齐技术,基于人类反馈的强化学习(RLHF)已经是大语言模型训练体系的核心组成部分。它最初建立在单轮任务和单轮偏好标注框架之上,由人类对模型生成的不同回答进行打分排序,以此引导模型输出更符合人类偏好、更安全且更有帮助的回答。 但现在,AI 正在走出对话框。Ant...

作为一项重要的模型对齐技术,基于人类反馈的强化学习(RLHF)已经是大语言模型训练体系的核心组成部分。它最初建立在单轮任务和单轮偏好标注框架之上,由人类对模型生成的不同回答进行打分排序,以此引导模型输出更符合人类偏好、更安全且更有帮助的回答。 但现在,AI 正在走出对话框。Ant...

Web3SkyCity.AI 对话“人工智能教父”杰夫·辛顿 在人工智能席卷全球的浪潮中,杰夫·辛顿的名字不仅代表了深度学习的基石,更象征着一种深刻的技术反思。 作为反向传播算法的共同发明者和诺贝尔物理学奖得主,辛顿在离开谷歌后,从技术的推动者转变为人类未来的警示者 。近日,他在...

本文来自微信公众号: 集智俱乐部 ,作者:郭瑞东 当大模型开始“玩游戏”,推理能力变强了? 传统的学习,有结构化的教材,明确的目标和任务。但更多的时候,我们进行的是非正式学习,即在日常互动中试错、反馈、模仿。最典型的例子是孩子在游戏中学会合作与一般环境下的推理。事实上,近年来已经...

新智元报道 【新智元导读】Anthropic自家工程师早已基本不写代码了,却280美元一个任务,花钱请约1000名外部工程师,手把手教Claude Code写出好代码。喂养前沿模型的,终究还是人。 最近,一篇报道把Claude Code的「进步秘笈」摆在了台面上。 Busines...
PhysX-Omni:统一刚体、可形变与关节物体的物理 3D 生成 该论文第一作者为曹子昂,研究方向主要聚焦于 3D AIGC、Physical AI 与具身智能。论文主要合作者包括来自南洋理工大学的李海天、姚润茂、洪方舟、陈昭熹,以及大晓机器人的刘英豪和潘亮。通讯作者为南洋理工...