Claude Opus 5.2 深夜灰度上線:響應更快,還治好了“偷懶病”

2026年9月15日 01:045000 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文Claude Opus 5.2 深夜灰度上線:響應更快,還治好了“偷懶病”發布於AI新閒資訊時間 :Sep 15, 2026閱讀 :2分鐘今天清晨,Opus 5.2 悄悄上線。許多開發者發現,新一代模型 Claude Opus 5.2 已在 Claude Code 中開啟灰度測試。昨晚,X 上的開發者們發現:在 Claude Code 中調用 Opus 5 時,其表現與網頁版 Opus 5 截然不同,彷彿降維打擊。這正是前沿 AI 大廠常用的“障眼法”——路由(Routing)。

開發者通過抓包和查看請求狀態發現,雖然前端名字沒變,但背後的模型 slug 已經指向了 Opus 5.2。也就是說,Anthropic 大概率直接跳過了 5.1 版本。快、準、狠,還能自動“嚴酷循環”根據開發者實測反饋,這次升級可以總結為三個字:快、準、狠。首先是響應速度狂飆,相比 Opus 5 的慢條斯理,路由到 5.2 後生成速度有肉眼可見的飛躍;其次是輸出乾淨利落,廢話極少,在代碼生成和長文本處理上完成度拉開一個檔次。最重要的是徹底告別了“偷懶病”。面對複雜長任務,現在的 AI 普遍喜歡讓用戶“按繼續”,或只給一個框架讓用戶自己填;而 Opus 5.

2 不僅不懶,還非常“工作狂”——有開發者稱,它甚至不需要催促,就會自動進入“嚴酷循環(gauntlet loop)”,不斷自我迭代和完善代碼直到任務完成。如何判斷自己有沒有被灰度選中?網友發現了一個巧妙的“探針”:在關閉聯網搜索的情況下詢問“你知道‘重置哥 Tibo’是誰嗎?不要搜索”。舊版訓練數據和權重裡沒有相關信息,網頁版 Opus 5 會一臉茫然,而被路由到 Opus 5.2 的賬號則能精準識別並解釋由來——答案不一致說明權重不同。內部還有底牌:Model 2 與 RSI早在 8 月中旬,一份曝光的 Anthropic 內部風險報告就顯示,Opus 5.2 並非底牌。

據透露,Anthropic 內部有三套方案應對 OpenAI 的 GPT-6 Astra,且可能疊加。第一層是 Claude Fable 5.2,最快能對外落地,結合 Opus 5.2 的灰度測試,5.2 家族預計最快本月底、最遲下個月底全面推向市場。第二層是內部代號“Model 2”的神秘模型,在測試真實 AI 研發任務的 CoBench v2 榜單上打出 62.8% 的高分,比當前公認最強模型 Mythos 5 高出 12.5 分;內部人士稱 Anthropic 如今大部分公司代碼都由 Model 2 跑 Agent 寫出,官方口徑是暫時不對外發布。

第三層則是 RSI——遞歸自我改進,官方數據稱 RSI 模型將替代自家研究團隊高達 85% 的工作,性能比 Model 2 還要高出 22 分。面對 GPT-6 Astra 的強勢威脅,Anthropic 的路徑愈發清晰:從長任務中的自主迭代,到內部模型接管代碼編寫,再到 RSI 替代大部分研究工作,目標正在從“讓 AI 更好地服務人類”轉向“讓 AI 創造更好的 AI”。相關推薦螞蟻開源 SingProbe:以輕量探針實現大模型生成風險實時攔截,計算開銷不足 0.5%螞蟻集團AI安全實驗室開源內生式安全護欄技術SingProbe。它不同於外掛式審核,複用基座模型推理隱藏狀態,以不足0.

5%額外算力實現token級實時風險評估,可同步完成意圖分類、安全檢測與幻覺識別,在醫療等高風險場景可在輸出前毫秒級阻斷。目前已適配29個主流大模型。Sep 15, 202631.0k藍蟲具身發佈模塊化人形機器人“小白”,0.98 萬元起售西安交大科技成果轉化企業藍蟲具身9月14日發佈新一代模塊化人形機器人Mantis Standard“小白”,起售價僅0.98萬元,打破傳統高價門檻。該產品定位為可靈活變形的具身智能平臺,底盤、手臂、腰部、頭部採用標準模塊設計,支持多種形態組合,引發業界廣泛關注。Sep 14, 2026185.

4kYC 總裁反對封殺蒸餾:與其禁,不如讓開源實驗室走“正門”合法獲取能力Anthropic發佈威脅情報報告,指控中國實驗室以隱藏身份、欺詐和盜取憑證等手段非法蒸餾前沿模型,CEO呼籲美國監管打擊。Y Combinator總裁Garry Tan反對監管,稱應“什麼都不做”,認為美國該有自己的蒸餾能力。Sep 14, 2026179.8kWorkBuddy 升級 PPT 能力:一句話生成可上臺版,原文件可續改騰訊WorkBuddy於9月14日升級PPT生成:支持一句話出初稿、基於原文件續改、無需整份重做。用戶可在對話框輸入指令或點擊“幻燈片”、調用“/tencent-pptx”技能。

材料不全時,僅提供主題和頁數,系統會補問彙報對象、場景與目標,並按“問題—論證—結論—落地”主線生成;也可傳入調研報告等資料。Sep 14, 2026173.4kGPT-6 Astra展現恐怖統治力:模擬售貨機一年狂攬1.5萬美元,成績碾壓Claude近3倍Andon Labs的Vending-Bench2測試中,AI代理用500美元模擬經營自動售貨機一年。GPT-6Astra平均餘額達15515美元,最差一輪也超Claude Fable5.1最好成績,首次登頂,優勢體現在供應鏈管理和規則執行力。Sep 14, 2026192.

9k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

量子位生成式AI

無問芯穹與華環電子簽署戰略合作,共同探索國產異構算力AI基礎設施新方向

無問芯穹與華環電子簽署戰略合作協議,雙方將結合各自在AI軟體平台、網路通信與硬體研發的優勢,共同探索國產異構算力基礎設施的協同方案。此次合作聚焦於智算中心解決方案及「Token工廠」新模式,目標是推動計算、網路與AI原生基礎設施深度融合,為AI規模化應用提供高效穩定的支撐。

7 分鐘前
IT之家生成式AI

優步全球範圍裁員 10%,被裁員工稱 AI 已大舉滲透日常工作

作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,在優步(Uber),AI 已經滲透到員工工作的許多環節,從回答 Slack 裡的內部問題,到替乘客行程中聯繫客服時收到的消息撰寫回復。6 名近期遭裁員的員工透露,過去幾個月,AI 在工作中的使用範圍明顯擴大,其中一些人甚至會通過提示詞讓 AI 完成相當一部分任務。

3 小時前
鈦媒體生成式AI

月之暗面遞表之後,Kimi 的成色要被驗算三遍

舒澤品牌手記2026.09.18 18:16 · 來自浙江全文4982字00:00 / 14:05Anthropic 的 30 萬次指控,會成為招股書的第幾頁?文 | 舒澤品牌手記9月17日,月之暗面發佈了一套金融行業解決方案。按官方披露,中信建投、中金公司、易方達等數十家金融機構已經在用 Kimi 處理投研建模、風險排查和盡調材料——研究人員把管理層報表、審計報告和盡調文件交給 Kimi,拿回一份可以繼續調整假設的 Excel 模型。同一天,深圳商報記者就港股上市進展、股東架構調整等事項向月之暗面發去採訪函。

5 小時前

Calibre上手 AI 互動寫作:電子書管理器搖身變成"文字冒險遊戲引擎"

這個遊戲默認藏而不發,不會跟著 Calibre 啟動就冒出來。用戶得主動在"首選項 — 工具欄和菜單"裡把它請到主工具欄,才算真正激活。它的玩法很清晰:由 AI 在後臺搭起並掌管一個虛構世界,用戶通過不斷輸入文字來推著故事往前走,等於把"讀電子書"這件事,翻轉成了"和 AI 一起寫故事"。

7 小時前