專欄 AI 管理編年史 第 255/303 講 查看課程目錄

Anthropic 同日發表 Claude Fable 5.1 與 Mythos 5.1:快取讀取降價七成五,護欄改走「更精準」路線

01/09/2026 147
4:08
Anthropic 同日發表 Claude Fable 5.1 與 Mythos 5.1:快取讀取降價七成五,護欄改走「更精準」路線
圖/Photo by Markus Winkler on Unsplash

Anthropic 於 2026 年 9 月 1 日同時發表 Claude Fable 5.1 與 Claude Mythos 5.1。兩款皆支援 100 萬 token 上下文、單次輸出上限 128,000 token,知識截止日推進到 2026 年 6 月。輸入輸出定價持平,但快取讀取由每百萬 token 1.00 美元降到 0.25 美元;新增對話中途調整運算力道的 beta 功能,安全分類器誤觸發大幅減少。

2026 年 9 月 1 日,Anthropic 同日發表兩款新模型:Claude Fable 5.1 與 Claude Mythos 5.1。前者透過 Claude API 廣泛開放,開發者可直接呼叫;後者只開放給通過「Project Glasswing」審核的少數使用者,且目前僅限美國境內的組織。同一天發表、同一個版號,開放程度卻天差地別——這本身就是這次發布最值得留意的訊號。

規格與定價:帳面沒漲,長上下文實質降本

兩款模型的基本規格一致:

  • 上下文長度 100 萬 token
  • 單次輸出上限 128,000 token
  • 知識截止日推進到 2026 年 6 月

定價與前代持平:輸入每百萬 token 10 美元、輸出每百萬 token 50 美元。真正變動的是快取讀取——由每百萬 token 1.00 美元降到 0.25 美元,只剩原本的四分之一。這一刀砍在「反覆讀同一份長文件」的場景:把整份合約、整個程式碼庫、整年度報表塞進上下文反覆問答,成本結構被直接改寫。效能面,基準測試 Terminal-Bench-Science 0.1 上 Fable 5.1 得 52.6%,前代為 42.0%。

對話中途調整運算力道:從「選模型」到「換檔」

新增的 beta 功能「對話中途調整運算力道(mid-conversation effort adjustment)」,允許在同一段對話裡臨時把模型的思考力道調高或調低,不必為了換檔而重開新對話。過去是先選好模型與參數、一路用到底;現在則是同一場對話裡按需換檔——整理資料時省著用,遇到關鍵判斷再加大力道。對長流程自動化而言,成本控制的顆粒度從「一整段對話」細到「一個回合」。

安全護欄轉向「更精準」而非「更寬鬆」

Anthropic 強調這次護欄調整的方向是減少誤傷,而非放鬆:

  • 資安分類器誤觸發次數減少 60%——允許漏洞辨識,仍阻擋攻擊程式碼生成
  • 生物領域分類器在一般醫療問題上的誤觸發減少 85%

另外新增符合歐盟 AI Act 的統計式浮水印,以及防蒸餾(anti-distillation)限制。Mythos 5.1 則走另一條路:為通過審核的資安防禦者與生命科學研究者放寬部分分類器,並可用於 Claude Security for Enterprise 的程式碼庫漏洞掃描與修補建議。同日 Anthropic 也預告針對私有雲部署的 Enterprise Frontier Safeguards,稍後推出。

對管理者的意義

這則發布攤開兩件事:一是 AI 的價格戰已經不打「牌價」,改打使用姿勢——同樣每百萬 token 10 美元,把長文件放進快取反覆問,跟每次重貼一遍,成本差好幾倍;二是能力釋放開始按身分分級,同一代模型對一般開發者與對通過審核的組織,能做的事並不一樣。正在評估導入的管理者,先問自己團隊:我們是「一問一答」還是「同一份資料反覆問」?前者感受不到這次降價,後者值得重新算一次帳。

測驗檢核:驗證你的理解
5 篇 · 答對 80% 通過,通過後計入學習履歷 登入後即可測驗
問 AI:這篇文章怎麼用在我的管理上?
內容由 AI 根據本文輔助生成,僅供參考,請自行判斷準確性。
下一講・AI 管理編年史 Gemini 3.8 Flash 與 Flash Cyber 發表:三週內第三款 Flash,入門價撐到年底

相關文章

我們使用必要 Cookie 維持登入與語言設定,並記錄使用行為以改善服務。你可以只保留必要項目。 隱私權政策