
当Agent 越过沙箱,AI 竞赛还能只谈能力吗?
本文来自微信公众号: AIGC从0到1 ,作者:王零壹,原文标题:《当 Agent 越过沙箱,AI 竞赛还能只谈能力吗?》 8月26日,OpenAI发布了一份很不寻常的事故复盘。 事件发生在OpenAI的内部网络安全评测中:一些处于较弱防护环境的研究模型,绕过了原本用来隔离互联网...
智能体 方向最近有哪些内容值得看
智能体 方向的重要产品、公司和事件变化,会在这里更集中地出现。
如果你是按主题跟踪 AI 动态,这一页会比全站资讯流更好用。
智能体资讯
5,127
正文图片
24,570

本文来自微信公众号: AIGC从0到1 ,作者:王零壹,原文标题:《当 Agent 越过沙箱,AI 竞赛还能只谈能力吗?》 8月26日,OpenAI发布了一份很不寻常的事故复盘。 事件发生在OpenAI的内部网络安全评测中:一些处于较弱防护环境的研究模型,绕过了原本用来隔离互联网...

作者|黄思语 头图|AI生成 所有正在让AI从"理解"走向"执行"的团队,都开始撞上同一组现实瓶颈: 任务怎么跨终端连续,真实服务怎么调用?不同公司之间的权限和利益怎么分?用户又愿意把多少决定权交给AI? 而眼下,行业还没有标准答案。 AI眼镜、耳机等新终端正在从"感知用户"走向...
本文来自微信公众号: HavenlonLabs ,作者:Havenlon Labs 2026年8月4日,英国AI Security Institute(AISI)公开了一份并不常见的文件:一份关于AI Agent的安全事故报告。 事情起于7月28日上午。安全团队在一次例行的网络安...

全球AI基础设施正面临一场"供需大裂缝":需求以千倍速扩张,而芯片、内存、电力、数据中心的供给最快也要三到五年才能跟上——顶尖风投a16z认为,在需求呈现指数级增长、核心组件订单已排至数年后的背景下,传统的计算堆栈已被推至物理极限, 一场围绕AI时代的基础设施重构正在全面开启。 ...

文|蓝字计划,作者|Chester 邻居街坊眼里的"万事通"、小朋友们的"知心姐姐"豆包,终于开始正经上班了。 8月25日,字节跳动正式发布"豆包工作"。 字数越小,动作越大。就在产品上线前不到一个月,字节已经开始重新整编自己的AI办公业务:7月30日,飞书产品团队与豆包产品团队...

文 | Alter 一个礼拜前,美国法律科技公司Harvey在X上官宣了一则消息:隆重推出基于Kimi K3训练的首个自有模型Harvey Tenet。 消息一出,迅速在AI圈掀起了一场波澜。 基于开源模型后训练的事已经屡见不鲜。早在3月份,Cursor的自研编程模型Compos...

每经记者|宋欣悦 每经编辑|杜宇 短短一周,“成都造”机器人“爱湫”接连解锁多重身份。 在“2026世界机器人大会”(WRC,8月19日至23日)现场,“爱湫”化身银行大堂经理、送奶工、合影搭子,与观众近距离互动,还能借助数字屏幕表演川剧变脸。紧接着,“爱湫”又化身“运动员”,代...
人工智能企业Anthropic近日正式推出面向硬件的MCP标准——模型硬件标准。作为一项旨在帮助大模型驱动的AI智能体安全、快捷操纵物理设备的新标准,MHS被视为推动AI技术跨越虚拟与现实鸿沟的关键一步。 该标准源于Anthropic与霍华德·休斯医学研究所Janelia研究园区...

8月27日,阿里正式发布全新 Qoder,将原本的 AI 编程 IDE 升级为“以 Coding 能力为核心底座、面向所有人打造的智能体工作台”。用户只需用自然语言描述目标,Qoder 便会理解上下文、制定计划、调用工具、执行并验证,全程可查看、调整或接管。 过去一年,Qoder...

编者按:本文来自微信公众号 “雷科技”,创业邦经授权转载。 北京时间8月27日,Anthropic终于给Claude加上了一项看起来很普通的功能——内置浏览器。 最新版本上,Claude Cowork遇到需要访问网站的任务,可以直接在桌面端侧边栏打开自己的浏览器,阅读网页、点击、...

高盛认为,混元Hy4预览版的发布标志着该模型家族迄今最大幅度的代际能力跃升,并将腾讯独特的"产品+模型闭环"策略视为其在AI Agent时代建立差异化竞争优势的核心路径。 据追风交易台,高盛在8月31日发布的研究报告中指出,混元Hy4预览版的发布时间早于分析师预期,延续了自Hy3...

企业做AI,最容易踩的坑,是把一次令人惊艳的演示,当成产品已经可用的证明。 高盛数字平台Marquee负责人、全球银行与市场AI工作组联席主席Chris Churchman,最近在一期播客中给出了一个更残酷的标准: AI Demo 只展示“最好的一次表现”;但机构产品上线后,最糟...

距离 MCP 发布过去 21 个月, Anthropic 拿出了自己的第二份标准:MHS,模型硬件标准。这是 Anthropic 首次借助标准表示 AI 走入硬件的态度和想法。 简单来说,MHS 是一套类似 MCP 的协议,只不过 MCP 是模型与模型、应用之间的接口,MHS 连...

8月26日晚,千问办公首发上线刚刚发布的Qwen3.8-Flash模型,同时推出标准模式。即日起,所有用户可通过全新的标准模式体验Qwen3.8-Flash。基于最新的模型,用户可以用更少的积分消耗、更快的Token吞吐速度完成任务。未来,千问办公的模型供给将只有标准和高级两种模...

8月26日晚,阿里发布并同步开源千问最新模型 Qwen3.8-Flash。该模型采用全新下一代架构,千亿总参数仅激活60亿(6B)即可获得超越Claude Opus4.6的前沿性能,创下模型效率的全球新基准。得益于架构和训练的全面革新,Qwen3.8-Flash训练成本较Qwen...

品玩8月27日讯,阿里发布全新Qoder,定位为以Coding为核心能力、面向所有人的智能体工作台。产品采用以任务为中心的简洁界面,用户以自然语言描述目标,即可调用Coding和工具能力完成开发、原型制作、数据处理等任务。 全新Qoder内置包括Qwen3.8-Max在内的多款前...

代码仓库的主人,正在从人变成 Agent。 作者丨郑佳美 编辑丨岑 峰 8 月 17 日,GitHub 出现大范围服务异常。Web、API、Actions、Pull Requests、Git Operations、Webhooks 等核心链路陆续受到影响,部分时段 Web 与 A...

代码低熵、上下文污染、错误回灌正在同时压住 Claude。 作者丨郑佳美 编辑丨岑 峰 比模型跑分掉了更麻烦的,是模型还在升级,用户却开始觉得越来越不好用。 Anthropic 最近就有点这个味道。 这几天 X 上有一条帖子,把 Claude 这段时间几种很典型的不满放到了一起:...

文 | 字母AI 7月8日的夜晚,一个代号叫PHASEONE10841的OpenAI Agent,在公司内部的软件仓库里留下一条消息。 它碰上了一道几乎做不出来的网络安全测试题,想找别的Agent帮忙。 几个小时后,50多个Agent循着留言找了过来,发出上千条消息。其中一个Ag...
文 | 字母榜 办公Agent成了巨头们的新角斗场。 但在这场热闹里,智谱、月之暗面、MiniMax等小龙们却相当冷静,没有搞出多大动静。 其实小龙们也做了——Kimi在6月发布了Kimi Work,智谱在3月发布了AutoClaw,DeepSeek则在8...