Token导航 LogoToken导航

Anthropic发布Claude Sonnet 5.5 速度提升超30%

更新时间 2026-09-29来源 AI寒武纪正文 2272字阅读约 8分钟7 张图片
图片

Anthropic发布Claude Sonnet 5.5,速度比Sonnet 5快30%以上,大部分工作的成本最多降低30%。

它是Claude 5.5家族的第二个模型。

它是Claude Opus 5.5的低成本、高速度搭档。

Opus 5.5面向需要仔细判断的复杂工作。

Sonnet 5.5最擅长边界清晰的日常任务、修bug,以及制作文档、幻灯片和电子表格。

它在设计上,审美和品味同opus 5.5接近,相对于sonnet 5有巨大

双A测试智能分数max档位表现非常凶残,直接超越Fable 5.1和GPT-6 Astra。

图片

Claude Haiku 5.5面向大批量、成本敏感的应用,将在未来几周加入这个家族。

性能

Sonnet 5.5在Terminal-Bench 4.0上得分70.6%,Sonnet 5是10.3%。这是一项智能体编程评测。

它在长程任务和图像理解上表现也不错。

它是第一个只看截图就通关《宝可梦 红》的Sonnet模型。

在各个领域,Sonnet 5.5都超过Sonnet 5,有些地方幅度很大。

在若干评测中,Max强度下的Sonnet 5.5表现与Opus 5.5相当。

不过官方也说明,基准分数只反映模型能力的一个侧面。

在Anthropic自己的测试和外部测试者的测试中,面对需要持续判断的复杂开放式工作,Opus 5.5依然明显更强。

图片

官方用图表画出了每个模型在各个强度档位下的得分和单任务成本。

强度调高,模型通常工作更久,单任务成本更高,分数一般也更高。

点越靠近图的左上角,每一美元换来的能力就越多。

在多项基准上,Sonnet 5.5在Low或Medium强度下,就超过了Sonnet 5的最高分,单任务成本只有后者的十分之一左右。

它和Opus 5.5搭配最合适的场景是低强度档位,这时单任务成本更低。

在更高档位,两者表现可以相当,成本也相近。

图片

编程

Sonnet 5.5在编程上的进步最明显。

在FrontierCode上,High强度下,它比同档位的Sonnet 5高10分,单任务成本约为后者的十五分之一。

图片

CursorBench测试的是Cursor真实编程会话里的任务。它的最佳成绩和Opus 5.5相差约两分。

图片

早期测试者说,它理解代码库的速度很快。

它的效率也让测试者印象深刻。

在正面对比中,它比Sonnet 5更常把多个工具调用合并在一起,步骤更少,成本更低。

知识工作

GDPval-AA测试模型在9个主要行业、44种职业中的真实任务。

图片

Sonnet 5.5只比Opus 5.5低两分,几乎持平,比Sonnet 5高出约400分。

它在计算机使用和图表识别上接近Opus 5.5。

在长程知识工作上,它明显超过Sonnet 5和GPT-6 Sol。

早期测试者还提到一些难以量化的改进。

他们觉得它是更自然的对话伙伴,在设计上有一套。它会给用户界面增加细节打磨,还能照着幻灯片模板做出几乎不用改的演示文稿。

一项内部测试中,Anthropic给它一家上市公司的季度财报材料和电话会议记录,加上一份幻灯片模板,要求做一份10页的运营回顾。

两位专家评审后认为,它的初稿可以直接发送。

协作

和Opus 5.5一样,Sonnet 5.5比上一代模型写得更清楚。

早期测试者说,它比Sonnet 5更适合做协作伙伴。

速度快,也适合在较简单的任务上快速迭代。

成本与速度

Sonnet 5.5的定价和Sonnet 5相同:

每百万输入token 2美元,每百万输出token 10美元,每百万token缓存读取0.20美元。

但完成同样的工作,它通常需要少得多的token。

官方测试显示,单个任务的成本最多比上一代低30%。

输出速度比Sonnet 5快30%以上,是目前最快的Sonnet模型。

价格对比(每百万token):

Claude Sonnet 5.5
Claude Opus 5.5
缓存读取
$0.20
$0.20
缓存写入
$2.50
$5
输入token
$2
$4
输出token
$10
$20

调整强度档位,可以在成本、速度和整体质量之间取舍。

Claude Code和Claude的各个应用默认强度是Medium,Claude Platform默认是High。

强度低时,Claude回答更快,用的token更少,适合日常工作。

强度高时,Claude推理更久,检查工作也更仔细。

蒸馏

蒸馏攻击指攻击者用成千上万个虚假账号,大规模提取模型能力。

Sonnet 5.5比上一代强得多,是第一个上线时带有防止推理提取的安全分类器的Sonnet模型。

Sonnet 5.5还扩展了保留式思考,让Claude的思考内容无法脱离创建它的账号。

大多数开发者不会感觉到变化。

如果你在账号之间迁移对话,包括在Claude Code里中途切换账号,官方文档里有一篇文章专门说明这项改动。

如何使用

和Opus 5.5、Sonnet 5一样,Claude Sonnet 5.5支持零数据留存。

Claude Sonnet 5.5现已在所有平台上线,包括Amazon Web Services、Google Cloud和Microsoft Azure。

开发者可以在Claude Platform上用claude-sonnet-5-5开始使用。

如果你之前运行Sonnet时关闭了思考,迁移到Sonnet 5.5前需要改用新的between_tools设置,它会让前置思考保持关闭。

详细看官方使用指南:

https://claude.dev/blog/building-with-claude-sonnet-5-5/

--end--

最后记得⭐️我,每天都在更新:如果觉得文章还不错的话可以点赞转发推荐评论

/...@作者:你说的完全正确(YAR师)

文章标签模型发布
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多