Claude Code 自動模式將於 8/14 起成為預設:AI 代理的把關者從人換成分類器
Anthropic 於 2026-08-07 預告,Claude Code 自動模式將自 8/14 起成為 Pro/Max/Team 的預設值,改以分類器攔截不可逆與破壞性動作。對照研究顯示人工核准僅攔下 13.6% 危險指令,自動模式為 89%。
Anthropic 於 2026 年 8 月 7 日發布公告〈Auto mode is now the default in Claude Code for Pro, Max, and Team plans〉,宣布 Claude Code 的「自動模式」(auto mode)將成為預設運作方式,並同步提供〈Running auto mode in production〉實務指南。必須先說清楚:這是一則預告。公告日為 8 月 7 日,生效日為 8 月 14 日,在此之前並未上路,讀者請勿理解為「現在已經可以這樣用」。
機制:從「每步問人」翻成「分類器把關」
先釐清一個容易誤讀之處:自動模式並非本次才問世。它在 2026 年稍早已以 opt-in 形式開放,Adobe、Nuro、Gusto、Garner Health 等團隊早已把它設為 production 的預設用法。本次新聞的重點不是「推出新功能」,而是預設值的翻轉——從「人逐步核准」翻成「自動模式先行」。
在此之前,Claude Code 的安全設計是在敏感操作前跳出核准提示,由使用者逐次按下同意。8 月 14 日之後的預設值改為:每一次工具呼叫都先送過一個分類器,專門攔截三類動作——不可逆的、具破壞性的、以及指向使用者環境以外的。被攔下時,Claude 通常會改走比較安全的替代路徑,或退一步轉為請求人工核准。
為了避免模型在被擋之後反覆硬闖,官方同時設了回退規則:
- 連續 3 次被分類器攔下,自動回退為人工核准模式。
- 單一 session 累計被攔 20 次,同樣自動回退為人工核准模式。
數據:人一直點「同意」,其實攔不住
Anthropic 公布了一組反直覺的實測。在 1,053 名付費測試者參與的對照研究中:
- 人工核准模式僅攔下 13.6% 的危險指令;自動模式為 89%。
- 另據真實 session 分析,人工核准組出現非預期損害(production 等級嚴重度)的比例為 6.3%,自動模式組為 2.4%。
- 更直觀的是使用行為:97% 的核准提示最後被使用者按下同意,62% 的使用者用過 bypassPermissions 或「不再詢問」。
這組數字指向的不是「AI 比人聰明」,而是核准疲勞:當提示每分鐘跳出數次,人的判斷會退化成反射性點擊,關卡形同虛設。機器把關之所以較嚴,是因為它不會累、不會為了趕工放行。
適用範圍、控制權與費用
8 月 14 日改為預設的只有 Pro、Max、Team 三種方案。Enterprise、Claude API 以及雲端夥伴部署暫時維持 opt-in(需自行開啟),官方表示會在未來一個月內跟進。
控制權仍在使用者與管理員手上:個人可在 CLI 按 Shift+Tab、或用下拉選單隨時切換模式;企業管理員可透過受管設定的 defaultMode 為全組織釘選預設值,或以 disableAutoMode 整個關閉。費用方面,自公告日起,Anthropic 停止向 Pro/Max/Team 收取分類器所耗的少量額外 token 費用。
對管理者的意義
這是 AI 代理治理的一道分水嶺:預設值從「人每步核准」翻成「機器把關、人設界線」。管理者真正該處理的不是選邊站,而是三個決定:
- 自家組織的
defaultMode要釘在哪一檔。 - 哪些高風險團隊應該直接關閉自動模式。
- 既有的核准流程要不要跟著重設界線。
還有更根本的一題:公司內部既有的「人工核准」流程,是真的在把關,還是早已是核准疲勞下的橡皮圖章?這則新聞值得拿去照一照的,不只是 AI 工具,還有你簽了十年的那些簽核單。