專欄 AI 管理編年史 第 284/303 講 查看課程目錄

Claude Opus 5.5 正式發布:多數工作達 Fable 5.1 水準、成本比 Opus 5 低 40%

22/09/2026 159
4:22
Claude Opus 5.5 正式發布:多數工作達 Fable 5.1 水準、成本比 Opus 5 低 40%
圖/Photo by Christina @ wocintechchat.com M on Unsplash

Anthropic 於 2026 年 9 月 22 日發布 Claude 5.5 家族首款模型 Opus 5.5:定價降至 $4/$20、快取讀取降至 $0.20、輸出快 30% 且精簡 40%,官方自陳 Terminal-Bench 66.4% 超越 Fable 5.1;Claude Platform 與 AWS、Google Cloud、Azure 即日可用,Sonnet 5.5/Haiku 5.5 預告數週內跟進。

2026 年 9 月 22 日,Anthropic 正式發布 Claude Opus 5.5,這是 Claude 5.5 家族的第一款模型,model ID 為 claude-opus-5-5。官方主打兩點:多數工作表現達到旗艦 Fable 5.1 的水準,而典型工作負載的成本較前代 Opus 5 低約 40%。定價為每百萬 tokens 輸入 4 美元、輸出 20 美元(Opus 5 為 5/25 美元),快取讀取降至 0.20 美元(原 0.50 美元),另提供 2.5 倍速的 Fast mode,定價 8/40 美元。

規格方面,Opus 5.5 支援 100 萬 token 上下文、最大輸出 12.8 萬 token,並常駐 adaptive thinking(自適應思考)。官方稱輸出速度較 Opus 5 快 30%、輸出內容精簡 40%。Claude Platform 與 AWS、Google Cloud、Azure 即日可用;Pro、Max、Team、Enterprise 方案同步上線,並提高五小時用量上限。官方另預告 Sonnet 5.5 與 Haiku 5.5 將於數週內跟進,目前尚未可用。

官方基準:數字亮眼,但未經獨立驗證

Anthropic 公布的自陳基準(官方自陳、未經獨立驗證)包括:

  • Terminal-Bench 4.0:66.4%(Fable 5.1 為 55.8%、Opus 5 為 52.3%)
  • GDPval-AA v2.1:1846 分(Opus 5 為 1708)
  • OSWorld 2.0:81.8%
  • Humanity's Last Exam:67.7%

值得注意的是,Terminal-Bench 分數甚至高於定位更高階的 Fable 5.1,顯示這一代在終端與代理任務上的投入。客戶引述也集中在效率:GitHub 表示終端任務所需步驟不到 Opus 5 的一半;Optiver 稱以約一半的對話輪次即可達到 Opus 5 的品質。

與前代比較:便宜、快、話少

這次升級的核心不是單純「更聰明」,而是「同樣的事用更少的資源做完」。官方並未說明「成本低 40%」的計算方式;從已公開的資訊推估,單價降 20%、快取讀取降 60%,再加上輸出精簡與步驟減少,可能是主要來源,但這屬本文推測,非官方口徑。對大量使用 API 的企業而言,若推估成立,節省會同時反映在帳單與等待時間上。

安全:官方稱迄今測過最強

Anthropic 表示,其自動行為稽核顯示 Opus 5.5 是「迄今測過最強」的一代,規避圍堵邊界的機率較 Opus 5 低 85%;發布前並由 Frontier Design 與 METR 進行外部測試。這些同樣屬官方自陳,仍待第三方複驗。

對管理者的意義

對在泰國經營的管理者來說,這則新聞的重點是:AI 代理任務的「單位成本」正快速下探,過去因費用而擱置的自動化流程(客服回覆、報表整理、跨語言文件處理),現在值得重新估算。建議先用同一組真實任務對比 Opus 5 與 Opus 5.5 的輪次與帳單,用自己的數據而非官方數字做決策。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 ChatGPT 行動版語音接上 Work 代理:用說的就能起草文件、寫郵件、摘要 Slack

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策