Claude Opus 5.5 正式发布:多数工作达 Fable 5.1 水平、成本比 Opus 5 低 40%
Anthropic 于 2026 年 9 月 22 日发布 Claude 5.5 家族首款模型 Opus 5.5:定价降至 $4/$20、缓存读取降至 $0.20、输出快 30% 且精简 40%,官方自述 Terminal-Bench 66.4% 超越 Fable 5.1;Claude Platform 与 AWS、Google Cloud、Azure 即日可用,Sonnet 5.5/Haiku 5.5 预告数周内跟进。
2026 年 9 月 22 日,Anthropic 正式发布 Claude Opus 5.5,这是 Claude 5.5 家族的第一款模型,model ID 为 claude-opus-5-5。官方主打两点:多数工作表现达到旗舰 Fable 5.1 的水平,而典型工作负载的成本较前代 Opus 5 低约 40%。定价为每百万 tokens 输入 4 美元、输出 20 美元(Opus 5 为 5/25 美元),缓存读取降至 0.20 美元(原 0.50 美元),另提供 2.5 倍速的 Fast mode,定价 8/40 美元。
规格方面,Opus 5.5 支持 100 万 token 上下文、最大输出 12.8 万 token,并常驻 adaptive thinking(自适应思考)。官方称输出速度较 Opus 5 快 30%、输出内容精简 40%。Claude Platform 与 AWS、Google Cloud、Azure 即日可用;Pro、Max、Team、Enterprise 套餐同步上线,并提高五小时用量上限。官方另预告 Sonnet 5.5 与 Haiku 5.5 将于数周内跟进,目前尚不可用。
官方基准:数字亮眼,但未经独立验证
Anthropic 公布的自述基准(官方自述、未经独立验证)包括:
- Terminal-Bench 4.0:66.4%(Fable 5.1 为 55.8%、Opus 5 为 52.3%)
- GDPval-AA v2.1:1846 分(Opus 5 为 1708)
- OSWorld 2.0:81.8%
- Humanity's Last Exam:67.7%
值得注意的是,Terminal-Bench 分数甚至高于定位更高端的 Fable 5.1,显示这一代在终端与智能体任务上的投入。客户引述也集中在效率:GitHub 表示终端任务所需步骤不到 Opus 5 的一半;Optiver 称以约一半的对话轮次即可达到 Opus 5 的质量。
与前代比较:便宜、快、话少
这次升级的核心不是单纯「更聪明」,而是「同样的事用更少的资源做完」。官方并未说明「成本低 40%」的计算方式;从已公开的信息推估,单价降 20%、缓存读取降 60%,再加上输出精简与步骤减少,可能是主要来源,但这属本文推测,非官方口径。对大量使用 API 的企业而言,若推估成立,节省会同时反映在账单与等待时间上。
安全:官方称迄今测过最强
Anthropic 表示,其自动行为审计显示 Opus 5.5 是「迄今测过最强」的一代,规避围堵边界的概率较 Opus 5 低 85%;发布前并由 Frontier Design 与 METR 进行外部测试。这些同样属官方自述,仍待第三方复验。
对管理者的意义
对在泰国经营的管理者来说,这则新闻的重点是:AI 智能体任务的「单位成本」正快速下探,过去因费用而搁置的自动化流程(客服回复、报表整理、跨语言文件处理),现在值得重新估算。建议先用同一组真实任务对比 Opus 5 与 Opus 5.5 的轮次与账单,用自己的数据而非官方数字做决策。