Claude Code 即將預設啟用自動模式,僅企業客戶仍需手動選擇加入。這項變革意味著 AI 將在開發過程中自主處理更多環節。
自動模式讓 AI 程式碼工具能夠獨立運作,無需在每個步驟等待人工批准。一個分類器會檢查操作是否危險或不可逆,僅在這些情況下才會要求確認。
Anthropic 在部落格文章中宣布,從 8 月 14 日起,Claude Code 將為 Pro、Max 和 Team 方案預設啟用自動模式。在對 1,053 名付費測試者進行的測試和內部紅隊演練中,自動模式的安全表現至少與人工審核相當,甚至更好。
採用自動模式的團隊也增加了約 25% 的拉取請求(pull requests),這表示他們完成了更多工作。在一項針對 1,053 名付費測試者的受控研究中,人工審核者僅發現了 13.6% 的危險指令,而自動模式則成功攔截了 89%。
Anthropic 也表示,自動模式增加了一層防護,可抵禦提示詞注入攻擊,這類攻擊試圖劫持代理程式,使其偏離使用者的指令。Trajectory Labs 進行的獨立稽核測試了 72 種攻擊情境,每種情境重複十次。
在自動模式下,針對 Claude 目前的模型 Fable 5、Opus 5 和 Sonnet 5,720 次嘗試中沒有一次成功。相較之下,OpenAI 的 GPT-5.6 Sol 在 Codex 自動審核模式下,有 5.83% 的攻擊成功突破。
Anthropic 內部,自動模式曾阻止 Claude 將機密資料上傳到公開頁面。該公司表示,在一次長時間的會話中,它還終止了大約 2,000 個可能干擾正在進行的 GPU 訓練任務的程序。
Anthropic 不會對分類器本身消耗的 token 收費。然而,將自動模式設為預設對公司來說可能仍然是一筆划算的交易。當 Claude 工作時間更長、完成更多任務時,總 token 使用量會增加,收入也會隨之提高,即使這並非 Anthropic 改變的主要動機。
Claude Code 目前是使用最廣泛的 AI 程式碼工具,將自動模式設為預設,將進一步推動開發者的角色從主動編寫程式碼轉向審查 AI 生成的輸出。Anthropic 本身也敦促使用者保持謹慎。
該分類器能降低風險,但無法完全消除風險。該公司寫道:「對於生產基礎設施的關鍵變更,我們仍然建議您自行審查 Claude 的操作。」
這項建議產生了一個矛盾。開發者介入的頻率越低,他們的監督就越重要。然而,要深入理解主要由自動模式在很少人工參與下建構的專案,將變得更加困難。而且,網路安全發展速度越來越快,複雜性也日益增加,任何人類都難以實際跟上。



