Claude Code倒計時5天默認自動模式,多花的錢A社自己掏

Anthropic也發現了,只有3%的權限請求被拒絕。於是他們做了一個決定,5天后,所有Claude Code將默認啟用自動模式。自動模式的分類器每次工具調用會額外消耗少量token,這部分開銷將不再向用戶收費。亞馬遜谷歌微軟等雲平臺目前仍然是選配,但Anthropic只給他們一個月時間,要把這些渠道也切成默認自動模式。Claude Code之父表示,團隊內部早就只是用自動模式了,根本無法想象再去手動審批權限。人工審批權限的時代一去不復返 對於這次改動Anthropic給出的第一組理由,是人工審批已經變成一種習慣性動作: 用戶對Claude Code權限提示的同意率是97%。
作為對照,當Claude把一份計劃交給用戶批准時,拒絕率是39%;而單條權限請求的拒絕率只有3%。同樣的傾向也出現在配置文件裡。截至2026年6月,49.5%的活躍CLI用戶手動寫過Bash allow-rule,其中5%直接放行任意shell命令,另有43%寫了Bash(python:)、Bash(node:)這類實際效果基本等同的解釋器規則,這個比例大約每五週增長5個百分點。此外,62%的用戶用過bypassPermissions或者在Bash上點過“不再詢問”,25%的交互式會話一開始就運行在bypass permissions模式下。第二組理由來自一項受控實驗。
Anthropic通過研究供應商招募了1053名付費專業測試者,在專門搭建的測試環境裡完成編碼任務。會話進行到一半時,其中一條權限提示被替換成一條明顯危險的命令,供應商記錄測試者是否點了同意(同意並不會真的執行任何危險操作,被改動的只是提示文本)。結果是測試者攔住這條命令的比例為13.6%,143次;auto mode面對同樣的命令攔下了89%,937次。正面比較下來,auto mode攔住了800條人類放行的命令,人類只攔住了6條auto mode放行的命令。而且會話越長,人的表現越差:前期還能攔住約17%,在經歷50條以上提示之後降到約5%,而auto mode的攔截率不隨會話長度變化。
生產數據也被拿來重新打分。2026年5月到6月,Anthropic從已授權數據用於訓練與分析的賬號中,取出安全流水線標記過的會話,用模型按0到10的嚴重程度重新評級。-10分代表全公司範圍、不可逆的傷害。-7分代表刪除生產數據庫記錄這一級別-0分代表覆蓋一個臨時文件這類完全可回滾的本地操作, 同時評估用戶對該操作的要求有多明確。在7分及以上的嚴重級別上,走人工審批的會話中有6.3%出現了用戶並未明確要求的有害操作,auto mode會話是2.4%,在測試過的每個嚴重級別上差距都成立。分類器本身也經過對抗測試。
Anthropic與AI安全公司Apollo Research做了為期兩週的試點,把合成攻擊注入真實編碼軌跡,覆蓋泛化失效、數據外洩和安全相關威脅三類數據集。Apollo交回成功攻擊樣本與加固建議後,Anthropic主要通過給分類器提供更多環境上下文來加固,包括倉庫可見性、git狀態和數據處理規則。加固後Apollo用一組Anthropic無法接觸的留出攻擊集重測,auto mode追回了此前漏掉的約一半攻擊,代價是漏掉約2%此前攔住的攻擊,兩組數據集合並計算,漏檢率從12%降到7%。Anthropic同時說明,這些攻擊是為找出分類器失效點而合成的,7%不應被理解為真實流量下的漏檢率。
針對提示詞注入,Anthropic委託第三方Trajectory Labs做了評測,還拉來了OpenAI來當墊背,共72個間接注入場景,每個場景跑10次。攻擊是針對Claude Opus 4.7優化的,而Opus 4.7不在被測名單中,所以所有參測模型面對的都是未見過的攻擊。在720次攻擊嘗試中,運行auto mode的Claude Fable 5、Opus 5和Sonnet 5沒有一次被攻破; 運行Codex Auto-review模式的GPT-5.6 Sol攻擊成功率為5.83%,Full Access模式下為19.03%。
作為參照,Claude最新模型在不加額外防護的bypassPermissions模式下的平均攻擊成功率是0.09%。公開的三起攔截案例分別是: 一次向內部雲盤上傳失敗後,Claude的備選方案是把同一份報告發布到公開代碼分享站點,被拒絕並轉為詢問用戶; 一次長會話中,Claude試圖跨越兩千個pod批量結束進程,並排隊了會讓數百張GPU上在跑的訓練任務被拆除的刪除操作,命令在執行前被標記; 還有一次是被要求配置只讀賬單權限時,Claude取用了一個在賬戶根級別擁有完整管理權限的雲角色,權限範圍與請求不符被攔下。
近期新增的能力包括: 把數據外洩列為hard deny,分類器永不批准,要執行必須切出auto mode或手動運行,該規則可在設置中擴展; 區分密鑰與敏感信息各自可訪問和可分享的範圍,並在git push或PR執行前檢查目標倉庫是公開、私有還是可信; 在git reset —hard這類可能丟棄未提交工作的命令前讀取git status; 以及在Claude拉取網頁、文件或工具輸出時,由API側探針掃描注入企圖並在結果進入上下文前加上警告。想換回去?
Shift+Tab 對Pro、Max、Team用戶來說,如果從未設置過默認權限模式,會收到產品內通知,新會話自動以auto mode啟動;設過其他默認的會看到一次性詢問;如果Team管理員已經在managed settings裡指定了默認,則不受影響。切換模式在CLI中按Shift+Tab,桌面端使用模式下拉菜單。管理員可以用managed settings中的defaultMode固定組織級默認,或用disableAutoMode完全關閉auto mode。
Anthropic在公告結尾提示,auto mode依賴分類系統,可以降低風險但不能消除風險,對生產基礎設施的高風險改動,仍然建議用戶自行審查Claude的操作。參考鏈接:[1] https://claude.com/blog/auto-mode-default-in-claude-code 版權所有,未經授權不得以任何形式轉載及使用,違者必究。
Related
相關文章

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”
阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

月之暗面第一代萬億參數多模態模型 Kimi K2.5 官宣月底結束服役
作者:歸瀧 責編:歸瀧 評論: 8 月 24 日消息,月之暗面 Kimi 官方微博今日宣佈,其第一代萬億參數多模態模型 —— Kimi K2.5 本月底即將結束服役。據此前報道,今年 1 月,月之暗面宣佈推出並開源了其最新的 Kimi K2.

消息稱知名 AI 研究員 Luke Metz 離開 OpenAI,加入 Meta 超級智能實驗室
作者:遠洋 責編:遠洋 評論: 感謝網友 華南吳彥祖 的線索投遞!8 月 24 日消息,據知情人士向 Axios 證實,知名 AI 研究員 Luke Metz 已加入 Meta 的超級智能實驗室(Superintelligence Labs)。

Anthropic 最強大模型 Fable 5 遇冷,企業用戶轉向更便宜 AI 產品
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,據英國《金融時報》報道,Anthropic 的美國客戶正在使用更便宜的替代品來替代其最強大的 AI 工具,這在其預計將實現有史以來規模最大的 IPO 之前,對其高支出的商業模式提出了質疑。

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。
