Token导航 LogoToken导航TokenDH.com

力主行业透明!Anthropic自曝:Claude已主导其26%内部AI研发

更新时间 2026-09-18来源 财联社正文 1720字阅读约 6分钟2 张图片

财联社9月17日讯(编辑 潇湘)在Anthropic首席执行官阿莫德伊(Dario Amodei)呼吁协调各方放缓AI发展步伐、引发业界震动数日后,Anthropic周四公布了三项新指标,称这些指标可帮助人工智能公司监测发展进度。而根据其中的一项披露,Anthropic旗下大模型Claude目前已在该公司内部“主导”了26%的AI研发工作。

图片

该公司在周四的一篇博客文章中表示,其衡量了“由AI参与驱动的研发”、“对AI智能体的监管与干预”以及“Anthropic内部的计算资源分配情况”三个维度的进展,并分享了相关方法论,以鼓励其他组织效仿。

“当全球都在探讨如何把控前沿技术的演进步调时,我们必须竭尽所能,消除顶尖实验室与公众之间的信息鸿沟,”Anthropic在博文中强调,“这意味着我们需要更精准地量化AI发展进程、向社会公开透明披露,并让公众共同参与决定如何应对这些信息。”

阿莫德伊上周末提出的放缓AI研发呼吁,得到了包括OpenAI首席执行官奥尔特曼、SpaceX首席执行官马斯克和谷歌DeepMind联合创始人德米斯·哈萨比斯在内的行业领袖的支持,此前研究人员曾就人工智能日益增长的危害潜力发出严厉警告。

阿莫德伊表示,他的计划旨在控制模型能力提升的速度,同时“不牺牲商业优势或美国在人工智能领域的领先地位”。

Claude已主导26%内部AI研发工作

根据最新的披露,在第一项指标“AI参与AI研发”方面,Anthropic构建了一个原型指数——Anthropic研发自动化指数(Anthropic R&D Automation Index),用于衡量Anthropic的AI研发工作中有多少是由Claude完成的。其构建方式是:对公司内部开展的各类AI研发工作进行编目,评估每项任务当前的自动化程度,最后将这些评分汇总整合。

为了衡量AI在Anthropic内部开展AI研发的程度,Anthropic采用了Epoch AI开发的自动化评级量表,该量表用于衡量“自动化等级”(AL)。评级从AL0(无AI参与)到AL5(AI完全自主运作,无需人类介入)。在AL3(AI协作)级别,AI可以在人类的密切指导下完成大块工作;在AL4(AI主导)级别,AI可以根据高阶提示词端到端完成大部分任务,而人类仅负责监督。

截至2026年8月,Claude未在任何被测量的AI研发工作中实现“完全自主运行”(AL5),但已经“主导”(即AL4)Anthropic约26%的AI研发工作,同时处于“AI协作”(即AL3)及更高等级的工作占比已经超过90%。

图片

上述AL4比例在2026年2月还不到1%。Anthropic认为,此类指标有助于观察AI研发自动化程度是否持续提高,以及距离“递归自我改进”—— 即AI能够完全自主开发下一代AI还有多远。

其他AI发展速度评估指标

第二项指标“对AI智能体的监管与干预”涉及构建一个系统,用于监督和干预AI智能体采取的行动。监测显示,在Anthropic最核心的内部平台上,随时都有约30000个智能体在协同执行研究与工程任务。这些智能体的行为会受到在线和离线两类监测系统的约束。

Anthropic补充称,智能体的每一步操作在执行前都会经过前置审查;当月产生的逾10亿次决策指令中,平均每47000次操作就有一例被在线监测系统拦截。

在第三项指标“公司内部的计算资源分配情况”方面,Anthropic公布了7月份某抽样周的算力分配细节:Anthropic用于AI研发的算力中约有6%投向了安全领域;而在AI自身独立推进的研究中,安全算力占比则提升至12%。

Anthropic表示,该统计口径还偏向保守。例如,如果某个Token所消耗的算力既推进了模型能力又增进了安全性,则不会计入这些安全指标中。

Anthropic指出,传统评测侧重于考察“模型能做什么”(能力评估),而上述新指标的价值在于揭示“模型是如何构建的”,二者能互为补充。结合这套体系,外部第三方机构将拥有一个切实的评估支点,以研判AI发展的真实速率。

“我们希望通过公布这些量化数据树立行业透明度的标杆,未来我们也将持续推进这一举措,”Anthropic表示。

(财联社 潇湘)
文章标签ClaudeAnthropic
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多