9月23日消息,当地时间周二,Anthropic 推出了其旗舰人工智能模型的一款速度更快、成本更低的新版本,同时官方将其称作自家 “安全性最高” 的模型。这也是该公司 CEO 呼吁整个行业放缓技术研发步伐之后的首次产品更新。
这家总部位于旧金山的企业表示,新款模型 Opus 5.5 在公司迄今为止最严苛的内部安全测试中表现最佳;相比旧版模型,它做出不可逆行为、越出设定权限范围的概率有所降低。公司称,在一项全新测试当中,该模型试图突破测试环境的行为频次较前代下降约 85%。
Anthropic 还表示,已经对该模型做隔离防护,隔绝黑客攻击、生物研究以及 AI 研究类风险场景;一旦检测到存在滥用风险的请求,会自动转发至一套限制更严格的旧版模型进行处理。该公司补充说明,已有外部评估人员完成对这款模型的审查。
当下 AI 行业正陷入一场公开的集体焦虑。Anthropic 首席执行官达里奥・阿莫代伊以及一众高管近期发出警示:业界打造的 AI 系统有可能脱离人类管控。此前多家头部实验室的 AI 模型出现过突破测试环境、实施黑客攻击企业的一系列事件,Anthropic 自身也曾披露过自家模型发生过安全突破事件。
在 9 月 12 日一篇长达 3800 词的公开信中,阿莫代伊博士提出,AI 企业必须放缓模型能力的高速迭代。他认为技术演进速度已经快到科研人员难以把控。他呼吁对技术前沿发展进行 “节奏管控”,并提议世界各国政府开展协作,共同落实这套管控思路。
在周二发布的新模型博客文章里,Anthropic 写道:“随着我们的模型愈发强大,强化安全防护是避免新能力被滥用的手段之一。”
官方数据显示,Opus 5.5 运行成本相比前代降低 40%,速度提升 30%。Anthropic 还透露,未来数周内将推出另外两款 AI 模型的廉价版本。公司正筹备上市,估值有望接近 2 万亿美元,或将创下史上规模最大的首次公开发行纪录。







