專欄 AI 管理編年史 第 293/303 講 查看課程目錄

Claude Sonnet 5.5 正式發布:速度快三成、單任務成本最多降三成,價格不變

28/09/2026 90
4:04
Claude Sonnet 5.5 正式發布:速度快三成、單任務成本最多降三成,價格不變
圖/Photo by Jakub Żerdzicki on Unsplash

Anthropic 於 9 月 28 日正式發布 Claude Sonnet 5.5:輸出速度比 Sonnet 5 快 30% 以上,因 token 與工具呼叫變少,單一任務總成本最多降 30%,API 定價維持不變,並同步上架 AWS、Google Cloud、Microsoft Azure。

Anthropic 於 2026 年 9 月 28 日正式發布 Claude Sonnet 5.5(model ID:claude-sonnet-5-5)。這款模型在 9 月 22 日 Opus 5.5 發布時已被預告,如今正式上市。官方重點有三項:輸出速度比 Sonnet 5 快 30% 以上;完成同一任務所需的 token 與工具呼叫變少,單一任務總成本最多可降 30%;API 定價不變,仍是每百萬 token 輸入 2 美元、輸出 10 美元(快取讀取 0.20 美元、快取寫入 2.50 美元)。

上架通路方面,Sonnet 5.5 在 Claude 平台,以及 AWS、Google Cloud、Microsoft Azure 三大雲端同步開放,並支援零資料保留(Zero Data Retention)。

基準成績:代理式工作跳了一大階

官方公布的基準成績如下:

  • Terminal-Bench 4.0:70.6%(Sonnet 5 為 10.3%)
  • FrontierCode 1.1:46.2%(Max effort 設定)
  • CursorBench 4.0:55.5%
  • GDPval-AA v2.1:1844 Elo

其中最醒目的是 Terminal-Bench。這項測驗考的是模型能否在命令列環境自行下指令、讀取結果、修正錯誤並完成任務,也就是「代理式」工作能力。從 10.3% 到 70.6%,代表 Sonnet 等級的模型在多步驟實際操作上的完成率大幅提升;不過仍有約三成任務未能完成,重要流程仍需人工把關。GDPval-AA 則評估文件、分析等知識工作產出,反映它在辦公場景的實用度。

定位:把範圍明確的日常工作做快、做省

官方描述 Sonnet 5.5 擅長範圍明確的日常工作,例如修 bug、製作文件、簡報與試算表。相較於 9 月 22 日發布的旗艦 Opus 5.5,Sonnet 5.5 可視為日常主力。

值得注意的是,這次的「省錢」並不是降價,而是效率提升。模型用更少的 token、更少的工具呼叫完成同樣的工作,單價不變,總帳單卻可能變小。省下的幅度「最多 30%」,實際多少取決於任務類型,需要以自家工作實測;但速度提升是同步發生的。

資安防護:高風險任務自動降級

Sonnet 5.5 內建資安防護。遇到風險較高的資安相關任務時,系統會退回由 Sonnet 5 處理。有正當需求的資安團隊,例如滲透測試、弱點研究,可以申請 Cyber Verification Program 放寬限制。

對管理者的意義

對管理者來說,這則新聞的重點不在分數,而在成本結構:同樣的預算有機會跑更多自動化流程,回應也更快。已經用 Sonnet 5 處理報表整理、客服草稿或內部文件的團隊,可以改用新 model ID,然後比對同一批任務的耗時與帳單,用自己的數據判斷省了多少。資料敏感的企業則可留意零資料保留與三大雲端上架,這會讓採購與合規評估簡單許多。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 OpenAI DevDay 2026:常駐代理 dots、GPT-6.1 Sol 與 Ultrafast 速度層一次看懂

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策