专栏 AI 管理编年史 第 284/303 讲 查看课程目录

Claude Opus 5.5 正式发布:多数工作达 Fable 5.1 水平、成本比 Opus 5 低 40%

22/09/2026 161
4:22
Claude Opus 5.5 正式发布:多数工作达 Fable 5.1 水平、成本比 Opus 5 低 40%
图/Photo by Christina @ wocintechchat.com M on Unsplash

Anthropic 于 2026 年 9 月 22 日发布 Claude 5.5 家族首款模型 Opus 5.5:定价降至 $4/$20、缓存读取降至 $0.20、输出快 30% 且精简 40%,官方自述 Terminal-Bench 66.4% 超越 Fable 5.1;Claude Platform 与 AWS、Google Cloud、Azure 即日可用,Sonnet 5.5/Haiku 5.5 预告数周内跟进。

2026 年 9 月 22 日,Anthropic 正式发布 Claude Opus 5.5,这是 Claude 5.5 家族的第一款模型,model ID 为 claude-opus-5-5。官方主打两点:多数工作表现达到旗舰 Fable 5.1 的水平,而典型工作负载的成本较前代 Opus 5 低约 40%。定价为每百万 tokens 输入 4 美元、输出 20 美元(Opus 5 为 5/25 美元),缓存读取降至 0.20 美元(原 0.50 美元),另提供 2.5 倍速的 Fast mode,定价 8/40 美元。

规格方面,Opus 5.5 支持 100 万 token 上下文、最大输出 12.8 万 token,并常驻 adaptive thinking(自适应思考)。官方称输出速度较 Opus 5 快 30%、输出内容精简 40%。Claude Platform 与 AWS、Google Cloud、Azure 即日可用;Pro、Max、Team、Enterprise 套餐同步上线,并提高五小时用量上限。官方另预告 Sonnet 5.5 与 Haiku 5.5 将于数周内跟进,目前尚不可用。

官方基准:数字亮眼,但未经独立验证

Anthropic 公布的自述基准(官方自述、未经独立验证)包括:

  • Terminal-Bench 4.0:66.4%(Fable 5.1 为 55.8%、Opus 5 为 52.3%)
  • GDPval-AA v2.1:1846 分(Opus 5 为 1708)
  • OSWorld 2.0:81.8%
  • Humanity's Last Exam:67.7%

值得注意的是,Terminal-Bench 分数甚至高于定位更高端的 Fable 5.1,显示这一代在终端与智能体任务上的投入。客户引述也集中在效率:GitHub 表示终端任务所需步骤不到 Opus 5 的一半;Optiver 称以约一半的对话轮次即可达到 Opus 5 的质量。

与前代比较:便宜、快、话少

这次升级的核心不是单纯「更聪明」,而是「同样的事用更少的资源做完」。官方并未说明「成本低 40%」的计算方式;从已公开的信息推估,单价降 20%、缓存读取降 60%,再加上输出精简与步骤减少,可能是主要来源,但这属本文推测,非官方口径。对大量使用 API 的企业而言,若推估成立,节省会同时反映在账单与等待时间上。

安全:官方称迄今测过最强

Anthropic 表示,其自动行为审计显示 Opus 5.5 是「迄今测过最强」的一代,规避围堵边界的概率较 Opus 5 低 85%;发布前并由 Frontier Design 与 METR 进行外部测试。这些同样属官方自述,仍待第三方复验。

对管理者的意义

对在泰国经营的管理者来说,这则新闻的重点是:AI 智能体任务的「单位成本」正快速下探,过去因费用而搁置的自动化流程(客服回复、报表整理、跨语言文件处理),现在值得重新估算。建议先用同一组真实任务对比 Opus 5 与 Opus 5.5 的轮次与账单,用自己的数据而非官方数字做决策。

测验检核:验证你的理解
5 篇 · 答对 80% 通过,通过后计入学习履历 登录后即可测验
问 AI:这篇文章怎么用在我的管理上?
内容由 AI 根据本文辅助生成,仅供参考,请自行判断准确性。
下一讲・AI 管理编年史 ChatGPT 移动版语音接入 Work 智能体:用说的就能起草文档、写邮件、摘要 Slack

相关文章

我们使用必要 Cookie 维持登录与语言设置,并记录使用行为以改善服务。你可以只保留必要项目。 隐私权政策