AI News

Anthropic 正在改變大多數付費客戶使用 Claude Code 的方式,並將自 8 月 14 日起把 Auto Mode 設為 Pro、Max 與 Team 帳戶的預設。這項設定允許這個程式碼代理在不必為每個動作都請求核准的情況下繼續工作,同時在某項操作看起來不可逆、具破壞性或超出使用者環境時,由安全分類器介入。

這項變動減少了開發者看到的例行權限提示數量,並讓 Claude Code 有更多自由去編輯檔案、執行命令,以及繼續多步驟任務。根據 The Decoder,企業客戶仍然需要自行選擇啟用。對工程團隊來說,這項改變與其說是新的程式設計功能,不如說是責任落在哪裡:開發者將越來越多地監督代理的工作,而不是逐一核准每一項操作。

Auto Mode 如何改變 Claude Code

Anthropic 先前於 3 月將 Auto Mode 作為測試推出,並將其定位為自動執行與手動控制之間的折衷方案。在早先的核准式工作流程中,Claude Code 會頻繁暫停,要求使用者授權建議的動作。相較之下,Auto Mode 會預設允許動作,除非系統分類器辨識出具重大風險的情況。

根據 TechCrunch 的報導,Anthropic 將受保護的類別描述為「不可逆、具破壞性,或是針對你的環境之外」的動作。確切界線將取決於分類器的判斷與專案設定,因此 Auto Mode 並不代表開發者不需要了解代理能存取哪些內容。

Anthropic 也表示已新增 prompt injection 檢查,以及可自訂的 hard deny 規則。這些控制措施旨在阻止嵌入於程式碼、文件或其他專案內容中的惡意指令,把代理導向像是資料外洩這類行為。

公司內部的 Claude Code 負責人 Boris Cherny 在 X 上表示,他和團隊已經連續數月只使用 Auto Mode,並不想回到權限提示。這是高層背書,但並不是證明此設定適用於每一種開發環境的獨立證據。

Anthropic 的測試顯示了什麼

Anthropic 表示,在一項涉及 1,053 名付費測試者的研究中,Auto Mode 的表現優於手動核准。公司報告指出,自動化系統辨識出 89% 的有害動作,相較之下,人類審查只攔截到 13.6%。Anthropic 也表示,使用者會核准 97% 的 Claude Code 權限提示,這顯示反覆核准可能會變成習慣,而不是經過仔細評估的決定。

這些數字是由供應商所回報的結果。現有報導並未提供完整的測試方法、有害動作的定義,或足以判斷該研究與真實生產軟體團隊有多接近的細節。因此,這些結果支持 Anthropic 調整預設值的論點,但並不能普遍證明自動核准在每個儲存庫或部署流程中都更安全。

The Decoder 也報導了 Anthropic 的一項說法:使用 Auto Mode 的團隊大約多產生了 25% 的 pull request。這或許代表吞吐量更高,但 pull request 數量不等於有用、安全或可維護的軟體。更自主的執行可能提升產出,但若產生的變更難以理解,也可能增加審查負擔。

The Decoder 另外引用了 Trajectory Labs 對 72 個 prompt injection 情境的獨立稽核,每個情境都測試了 10 次。報導指出,在 Auto Mode 下測試的 Claude 模型中,720 次嘗試沒有一次成功;而 OpenAI 的 Codex Auto-Review mode 則有部分嘗試成功。由於證據是透過媒體報導呈現,而不是提供的稽核報告,讀者應將此比較視為一項被報導的測試結果,而不是對程式碼代理安全性的最終排名。

Anthropic 描述了內部事件:Auto Mode 曾阻止 Claude 將機密資料上傳到公開頁面,並終止了約 2,000 個可能干擾 GPU 訓練工作的程序。這些是公司提出的分類器價值案例,並非經獨立驗證的可靠性測量。

為什麼預設值對工程團隊很重要

對 Pro、Max 與 Team 客戶來說,直接影響是行為上的。未更改設定的開發者,在 8 月 14 日之後會得到更自主的 Claude Code 體驗。團隊必須先決定代理可以使用哪些儲存庫、憑證、shell 命令與網路路徑,才能把新的預設值視為日常的生產力升級。

對產品團隊與新創公司來說,Auto Mode 可能讓長時間任務更容易委派。代理可以連續執行一連串編輯與測試,而不必等待人類逐步核准每一個低風險步驟。這對需要反覆重構、建立測試、修改文件,以及其他範圍明確工作的團隊可能有所幫助。

但代價是,執行越快,失敗也可能擴散得越快。Anthropic 仍然建議在高風險的正式環境基礎設施上檢查 Claude 的動作。這項警告很重要:分類器也許能阻擋明顯具破壞性的行為,卻未必理解一個有效命令的商業影響、細微的安全性回歸,或是技術上可回復但營運成本高昂的變更。

企業與非企業帳戶之間的差異也很重要。企業買家通常需要更嚴格的控制、可稽核性、身分整合,以及跨多個儲存庫的可預測政策。讓 Auto Mode 對這些客戶維持 opt-in,顯示 Anthropic 認知到,在受規範或對生產關鍵的環境中,自主預設值面臨更高門檻。

這項改變也加劇了 AI 程式設計工具 之間的競爭。如果 Claude Code 使用者習慣於監督代理,而不是逐一核准個別命令,競爭產品的評價將不再只看自動完成品質,而會更看重安全分類器、政策控制、可追蹤性,以及從錯誤中復原的能力。這會把市場推向把代理治理視為核心產品能力。

接下來該觀察什麼

第一個訊號會是,在預設值改變後,有多少客戶仍然保留 Auto Mode 開啟。Anthropic 尚未提供獨立的採用數據,因此未來的使用數字應與公司所聲稱的生產力成果分開看待。

開發者也應留意涉及 prompt injection、意外資料外洩、具破壞性的命令,或生產基礎設施變更的事故報告。真正的考驗在於分類器是否能捕捉到細微的失敗,而不只是明顯危險的 shell 操作。

其他重要訊號包括 Anthropic 是否會將 Auto Mode 擴展到 Enterprise 帳戶、是否會公布更多測試方法細節,以及是否會為管理員提供更好的儲存庫、工具、憑證與網路存取控制。評估此功能的團隊,應該將審查時間、回滾頻率、缺陷率與安全發現,與 pull request 數量一併衡量。

Creati.ai 觀點

Anthropic 的決定讓自主性成為大多數付費用戶的 Claude Code 預設工作流程,但並沒有讓監督變成可有可無。它把監督從一連串微小核准,轉變為更廣泛的責任:設定權限、審查 diff,以及驗證結果。

當重複提示會促使人們自動核准時,這是一個合理的方向,但生產力提升是否真實,取決於安全層的品質。建構者應把 Auto Mode 視為受控的部署設定,而不是全面信任的決定:從範圍有限的儲存庫開始、落實 hard deny 規則、限制對敏感系統的存取,並在正式環境變更上保留人工審查。

精選

Anthropic 將把 Claude Code 的 Auto Mode 設為大多數付費用戶的預設

Anthropic 將於 8 月 14 日把 Claude Code 的 Auto Mode 設為 Pro、Max 與 Team 用戶的預設,將程式碼監督轉向由 AI 管理的核准。