Anthropic 將 Claude Code auto mode 預設給 Pro、Max、Team

Anthropic 表示,Claude Code 新 session 將逐步為 Pro、Max 和 Team 預設開啟 auto mode;classifier 會先判斷工具操作風險,但高風險 production 工作仍需要人工審查。

Anthropic 在 2026 年 8 月 7 日表示,Claude Code 的 auto mode 將由 Pro、Max 和 Team plans 的可選功能,逐步變成新 session 的預設模式。這項改動會在 8 月 14 日開始生效;如果使用者或團隊已經固定使用 auto mode,行為則不會改變。Anthropic 亦表示,由 8 月 7 日起,auto mode 的 classifier overhead 不再計入使用者的費用。

Auto mode 的重點不是讓模型獲得無限制的 shell 權限,而是把工具呼叫先交給一個 classifier 判斷。Anthropic 表示,classifier 會嘗試阻擋不可逆或具破壞性的操作,以及超出設定工作環境範圍的操作。這讓 Claude Code 可以在低風險工作中減少逐步確認,同時對高風險行動保留一層防線。

這層防線仍然有明確的退回規則。若 auto mode 連續被擋三次,或者累計被擋 20 次,Claude Code 會回到 manual approval,要求使用者逐個批准工具操作。Anthropic 也說明,Enterprise、API、AWS Bedrock、Google Agent Platform 和 Microsoft Foundry 目前仍要由管理者或使用者 opt in,並計劃在之後一個月逐步擴大預設範圍。

Anthropic 把這次預設改動建立在內部及第三方 red teaming、prompt-injection evaluations 和 production analysis 上。這些資料說明公司如何測試 auto mode,但並不等於外界已經有一套獨立、可重現的安全證據。對需要接觸 production infrastructure 的團隊,auto mode 的預設開啟仍應視為權限和審批設計的一部分。

公告中的一項研究由 Anthropic 組織,涉及 1,053 名 paid testers。公司表示,在受控測試中,只有 13.6% 的 human approval testers 發現危險指令,auto mode 則擋下了 89%(937/1,053)的測試;在另一個比較中,auto mode 擋下 800 個 human-approved actions,而 human reviewers 擋下 6 個 auto-allowed actions。這是供應商自己的研究結果,測試環境和選樣方式都會影響數字,不能直接當成所有真實工作流程的安全率。

Anthropic 亦表示,Teams 和 Enterprise 的 auto mode adopters 平均建立的 pull requests 多 25%。這個數字反映公司觀察到的使用模式,而不是獨立生產力研究;它也沒有回答更多 pull requests 是否代表更高品質,或是否需要更多人手 review。

實際使用時,auto mode 適合處理有清楚目錄邊界、最小權限工具和可回復變更的 coding workflow。涉及 production deployment、database migration、credential、付款或刪除資料的工作,仍應保留人工批准、隔離環境和 audit log。Classifier 能減少摩擦,不能取代使用者對目標和後果的判斷。

這次更新的意義,是 coding agent 的安全控制開始由「每次工具呼叫都問人」轉向「先做風險分類,再按規則升級」。這種模式可以令日常工作更流暢,但安全邊界會更加依賴 classifier、權限模型、回退條件和監測品質。Anthropic 自己也提醒,auto mode 不會消除風險,高風險 production infrastructure 仍應保持人工 review。

MODULE.002 //

更多 Insights

分享網站、AI automation、數碼營銷、AI news 和 VMTS 公司新聞。