
微软新研究:无需后训练,只加4个Token,滑动窗口注意力反超线性注意力
随着大语言模型(LLM)上下文长度不断增加,推理阶段的内存占用和能源消耗正逐渐成为实际部署中的关键瓶颈。 标准全注意力机制会为每个新 token 保留此前所有 token 的 Key 和 Value,KV Cache 随上下文持续增长,解码成本也随之攀升。 尽管 线性注意力方法 ...
学术研究 方向最近有哪些内容值得看
学术研究 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
学术研究资讯
1,602
正文图片
7,988

随着大语言模型(LLM)上下文长度不断增加,推理阶段的内存占用和能源消耗正逐渐成为实际部署中的关键瓶颈。 标准全注意力机制会为每个新 token 保留此前所有 token 的 Key 和 Value,KV Cache 随上下文持续增长,解码成本也随之攀升。 尽管 线性注意力方法 ...

状态校验、权限路由、异步调度,撑起一套可持续执行的运行时。 作者丨郑佳美 编辑丨岑 峰 刚刚,Anthropic 更新了 Claude 5.1,一口气推出 Fable 5.1 和 Mythos 5.1。 这两个名字看起来像两档模型,实际上底层用的是同一套模型。区别在于 Anthr...

本文来自微信公众号: Internet Law Review ,作者:张颖 2026年8月29日,欧盟委员会执行副主席维尔库宁(Virkkunen)证实,人工智能办公室已向来自不同地区的多家“最先进”的通用人工智能(GPAI)模型提供者正式发出信息请求函(RFI)。这是欧委会从8...
本文来自微信公众号: 心智观察所 ,作者:心智观察所 2026年9月1日,日本山形县天童市,TeV粒子天体物理学大会现场。LUX-ZEPLIN(LZ)实验团队的发言人走上讲台,在场的物理学家并不知道他们接下来会听到什么。他们只知道,这个世界上最大的暗物质探测器,似乎看到了什么不寻...

本文来自微信公众号: 第一新声 ,作者:第一新声,原文标题:《Gemini 3.8 Flash深夜突袭,六周三更,谷歌到底在急什么?》 今天凌晨,谷歌再度出手,Gemini 3.8 Flash毫无征兆地正式上线。 距离上一代3.7 Flash发布仅仅过去三周——这是谷歌在短短六周...

本文来自微信公众号: AI资本观 ,作者:邵神 2026年夏末,AI早已无处不在。 站在今天回头看,很多事情已经显得顺理成章。大模型当然要越做越大,公司当然要抢算力、做产品、争用户;模型越来越便宜以后,当然会有人做开放生态、做Agent,再把AI带进真正的工作。 可这些“当然”,...

学术数据和真实数据完全是两回事;可解释性成落地“生死线”。 作者丨幸丽娟 编辑丨岑 峰 三年前,正值大模型爆发之年,麦肯锡就曾对全球交通与工业领域的从业者做了一项调研,问题很朴素:距离真正的智能化,还有多远? 答案出乎意料地悲观:还要10到20年。 而把时间线拉到现在,模型越来越...

全球领先的通用人工智能代理平台 Manus 今日正式宣布恢复独立运营。在经历与 Meta 近八个月的收购与分拆波折后,这家总部位于新加坡的 AI 实验室以独立身份重新启航,继续致力于推动通用 AI 代理技术的边界拓展。 据官方声明,Manus 将作为一家独立的代理实验室运营,创始...

全球主流 AI API 集体翻车,隐藏推理被成功还原,谁在偷听 AI 的「心声」? 作者丨郑佳美 编辑丨岑 峰 昨天,X 用户 @kotekjedi_ml 公布了一组很反常的实验:Claude、GPT 和 Gemini API 里原本不向用户展示的隐藏 reasoning,被研究...

本文来自微信公众号: AIGC从0到1 ,作者:王零壹,原文标题:《当 Agent 越过沙箱,AI 竞赛还能只谈能力吗?》 8月26日,OpenAI发布了一份很不寻常的事故复盘。 事件发生在OpenAI的内部网络安全评测中:一些处于较弱防护环境的研究模型,绕过了原本用来隔离互联网...

编者按:本文来自微信公众号 “量子位”,作者:关注前沿科技,创业邦经授权转载。 Claude开始训练Claude了! 时薪4美元,干赢时薪150美元的人类研究员。 在Anthropic最新发布的研究中,Claude自己查论文、提方案、造数据、训练模型,一口气攻克了10类AI安全问...

代码仓库的主人,正在从人变成 Agent。 作者丨郑佳美 编辑丨岑 峰 8 月 17 日,GitHub 出现大范围服务异常。Web、API、Actions、Pull Requests、Git Operations、Webhooks 等核心链路陆续受到影响,部分时段 Web 与 A...

代码低熵、上下文污染、错误回灌正在同时压住 Claude。 作者丨郑佳美 编辑丨岑 峰 比模型跑分掉了更麻烦的,是模型还在升级,用户却开始觉得越来越不好用。 Anthropic 最近就有点这个味道。 这几天 X 上有一条帖子,把 Claude 这段时间几种很典型的不满放到了一起:...

MHS把一场新药研发实验速度提升3倍。 作者丨高允毅 编辑丨岑 峰 这是Anthropic第二次发布全行业统一协议。 第一次,它发布了 MCP ,它统一了 AI 代理调用外部工具、数据源与 API 的方式,如今满世界的 Agent 都靠它连数据库、接浏览器、调 API。这一次,它...

本文来自微信公众号: AIGC从0到1 ,作者:王零壹 今年8月,独立AI评测机构METR说,过去半年里,它获得了约7100万美元的资金承诺。 METR不训练基础模型,没有数据中心,也没有一款等待冲上应用榜的聊天产品。它做的是另一件听起来不那么热闹的事:让模型做一批尽量接近真实工...
本文来自微信公众号: AI时代仍不辍思考 ,作者:创业思考碎片 ——硅谷101对话前DeepMind科学家曹原,一份不加滤镜的现场纪要 8月,谷歌传奇工程师Jeff Dean带着Oriol Vinyals、Sanjay Ghemawat、Quoc Le离开谷歌,创办Discove...

Anthropic 的自动化对齐研究员实验,真正改变的也许不是谁比谁更聪明,而是谁在研究流程里拥有主动权。编译自:Automated Researchers Can Reliably Mitigate Alignment Failures|Anthropic Fellows Pr...

2026年8月18日-8月20日,由北京市人民政府、中央广播电视总台、世界机器人合作组织、亚太机器人世界杯国际理事会共同主办的「第二届世界人形机器人运动会-家庭场景赛」在北京栖息地体验中心(观湖国际店)开赛。这是世界机器人运动会首次设立家庭场景赛,38个机器人战队将在洗衣晾衣、收...