Claude Sonnet 5.5 正式发布:速度快三成、单任务成本最多降三成,价格不变
Anthropic 于 9 月 28 日正式发布 Claude Sonnet 5.5:输出速度比 Sonnet 5 快 30% 以上,因 token 与工具调用减少,单一任务总成本最多降 30%,API 定价维持不变,并同步上线 AWS、Google Cloud、Microsoft Azure。
Anthropic 于 2026 年 9 月 28 日正式发布 Claude Sonnet 5.5(model ID:claude-sonnet-5-5)。这款模型在 9 月 22 日 Opus 5.5 发布时已被预告,如今正式上市。官方重点有三项:输出速度比 Sonnet 5 快 30% 以上;完成同一任务所需的 token 与工具调用减少,单一任务总成本最多可降 30%;API 定价不变,仍是每百万 token 输入 2 美元、输出 10 美元(缓存读取 0.20 美元、缓存写入 2.50 美元)。
上线渠道方面,Sonnet 5.5 在 Claude 平台,以及 AWS、Google Cloud、Microsoft Azure 三大云同步开放,并支持零数据保留(Zero Data Retention)。
基准成绩:智能体式工作跳了一大级
官方公布的基准成绩如下:
- Terminal-Bench 4.0:70.6%(Sonnet 5 为 10.3%)
- FrontierCode 1.1:46.2%(Max effort 设置)
- CursorBench 4.0:55.5%
- GDPval-AA v2.1:1844 Elo
其中最醒目的是 Terminal-Bench。这项测试考的是模型能否在命令行环境自行下指令、读取结果、修正错误并完成任务,也就是“智能体式”工作能力。从 10.3% 到 70.6%,意味着 Sonnet 级别的模型在多步骤实际操作上的完成率大幅提升;不过仍有约三成任务未能完成,关键流程仍需人工把关。GDPval-AA 则评估文档、分析等知识工作产出,反映它在办公场景的实用度。
定位:把范围明确的日常工作做快、做省
官方描述 Sonnet 5.5 擅长范围明确的日常工作,例如修 bug、制作文档、演示文稿与电子表格。相较于 9 月 22 日发布的旗舰 Opus 5.5,Sonnet 5.5 可视为日常主力。
值得注意的是,这次的“省钱”并不是降价,而是效率提升。模型用更少的 token、更少的工具调用完成同样的工作,单价不变,总账单却可能变小。节省幅度“最多 30%”,实际多少取决于任务类型,需要用自家业务实测;但速度提升是同步发生的。
安全防护:高风险任务自动降级
Sonnet 5.5 内置网络安全防护。遇到风险较高的网络安全相关任务时,系统会退回由 Sonnet 5 处理。有正当需求的安全团队,例如渗透测试、漏洞研究,可以申请 Cyber Verification Program 放宽限制。
对管理者的意义
对管理者来说,这则新闻的重点不在分数,而在成本结构:同样的预算有机会跑更多自动化流程,响应也更快。已经用 Sonnet 5 处理报表整理、客服草稿或内部文档的团队,可以改用新 model ID,然后对比同一批任务的耗时与账单,用自己的数据判断省了多少。数据敏感的企业则可关注零数据保留与三大云上线,这会让采购与合规评估简单许多。