Claude Sonnet 5.5 正式發布:速度快三成、單任務成本最多降三成,價格不變
Anthropic 於 9 月 28 日正式發布 Claude Sonnet 5.5:輸出速度比 Sonnet 5 快 30% 以上,因 token 與工具呼叫變少,單一任務總成本最多降 30%,API 定價維持不變,並同步上架 AWS、Google Cloud、Microsoft Azure。
Anthropic 於 2026 年 9 月 28 日正式發布 Claude Sonnet 5.5(model ID:claude-sonnet-5-5)。這款模型在 9 月 22 日 Opus 5.5 發布時已被預告,如今正式上市。官方重點有三項:輸出速度比 Sonnet 5 快 30% 以上;完成同一任務所需的 token 與工具呼叫變少,單一任務總成本最多可降 30%;API 定價不變,仍是每百萬 token 輸入 2 美元、輸出 10 美元(快取讀取 0.20 美元、快取寫入 2.50 美元)。
上架通路方面,Sonnet 5.5 在 Claude 平台,以及 AWS、Google Cloud、Microsoft Azure 三大雲端同步開放,並支援零資料保留(Zero Data Retention)。
基準成績:代理式工作跳了一大階
官方公布的基準成績如下:
- Terminal-Bench 4.0:70.6%(Sonnet 5 為 10.3%)
- FrontierCode 1.1:46.2%(Max effort 設定)
- CursorBench 4.0:55.5%
- GDPval-AA v2.1:1844 Elo
其中最醒目的是 Terminal-Bench。這項測驗考的是模型能否在命令列環境自行下指令、讀取結果、修正錯誤並完成任務,也就是「代理式」工作能力。從 10.3% 到 70.6%,代表 Sonnet 等級的模型在多步驟實際操作上的完成率大幅提升;不過仍有約三成任務未能完成,重要流程仍需人工把關。GDPval-AA 則評估文件、分析等知識工作產出,反映它在辦公場景的實用度。
定位:把範圍明確的日常工作做快、做省
官方描述 Sonnet 5.5 擅長範圍明確的日常工作,例如修 bug、製作文件、簡報與試算表。相較於 9 月 22 日發布的旗艦 Opus 5.5,Sonnet 5.5 可視為日常主力。
值得注意的是,這次的「省錢」並不是降價,而是效率提升。模型用更少的 token、更少的工具呼叫完成同樣的工作,單價不變,總帳單卻可能變小。省下的幅度「最多 30%」,實際多少取決於任務類型,需要以自家工作實測;但速度提升是同步發生的。
資安防護:高風險任務自動降級
Sonnet 5.5 內建資安防護。遇到風險較高的資安相關任務時,系統會退回由 Sonnet 5 處理。有正當需求的資安團隊,例如滲透測試、弱點研究,可以申請 Cyber Verification Program 放寬限制。
對管理者的意義
對管理者來說,這則新聞的重點不在分數,而在成本結構:同樣的預算有機會跑更多自動化流程,回應也更快。已經用 Sonnet 5 處理報表整理、客服草稿或內部文件的團隊,可以改用新 model ID,然後比對同一批任務的耗時與帳單,用自己的數據判斷省了多少。資料敏感的企業則可留意零資料保留與三大雲端上架,這會讓採購與合規評估簡單許多。