阿莫迪口嗨AI減速,這邊Opus 5.2疑似已灰測

字母AI2026.09.15 12:00 · 來自北京全文5569字00:00 / 14:42倡議歸倡議,競爭不能停。文 | 字母AI阿莫迪剛剛還在發文倡導AI減速,第二天特朗普就表示:想都別想。“我希望繼續保持領先,因為誰贏得AI,誰就贏。”9月13日播出的CBS採訪裡,就連剛提出給前沿AI限速的阿莫迪自己,也承認了這套方案很難實現。“坦率地說,我不知道這是否可能。”與此同時,Anthropic仍在籌備最高融資1000億美元、估值約2萬億美元的超級IPO,目標是在11月美國中期選舉前上市。嘴上剎車,腳下猛踩油門,巨頭不只是光說不練,谷歌和Anthropic都傳出了新模型進展。
前沿實驗室說著要控制速度,但從政府競爭、監管機制到公司自身利益,沒有一層真正允許它們輕易慢下來。贏得AI,贏得一切在上一篇裡我們提到,阿莫迪、奧特曼、馬斯克和哈薩比斯罕見地達成了共識,認為前沿AI可能跑得太快了,需要加以控制。扎克伯格則站在“控制速度”的反方,認為任何讓美國模型發佈速度變慢的政策,都可能把優勢拱手讓人。現在看來,白宮和Meta持相同態度。美國時間9月13日,在愛爾蘭多恩貝格的自家高爾夫球場,特朗普被記者直接問到,AI行業是否應該放慢速度,或者接受更多監管?特朗普的觀點非常明確:安全護欄可以有,但不能因此拖慢美國。
他說美國目前在AI上領先,而他希望保持這種領先,因為“誰贏得AI,誰就贏”。他還把部分AI風險警告稱為“非常負面的力量”,認為有人正在渲染一些根本不會發生的事情。第二天,事件繼續加碼,黃仁勳正在洛杉磯All-In Summit臺上討論這輪AI“減速”爭議,特朗普突然打來電話。特朗普說,推動AI放慢的人“中了那些不想看到AI發展的人的下懷”。“我們不會讓這種事發生,這是個騙局。”黃仁勳接了一句:“你說得對。我們不會讓這種事發生,先生。”AI限速最現實的問題之一就是,一家公司的安全部門可以接受慢一點,但國家競爭很難允許。阿莫迪自己也知道這一點。
在9月13日播出的CBS採訪裡,他把大國競爭稱為建立AI限速機制時最棘手的困境,任何一方都會擔心另一方表面減速,私下繼續加速。某種意義上,他們提出的倡議可能是認真的,但在提出倡議的時候,他們大概也知道這個倡議未必真的可行。“減速”的提議多少有點像某種事先擬好的免責聲明,至少表現出發點是好的,他們已經提醒過風險了。但這一腳剎車究竟能否踩下,可就不是AI公司能自主決定的事情了。說來有趣,Anthropic和特朗普政府此前並非沒有在AI安全上找到共同語言,幾個月前,雙方剛剛結束一場激烈的衝突。
Anthropic同意和政府共同制定模型安全和發佈標準,商務部長Lutnick甚至在9月初公開表示“我們現在信任Anthropic”。之前白宮還嫌Anthropic的安全邊界太多、和它狠狠幹了一架;好不容易才重新建立一點互信,現在Anthropic想把“安全”再往前推一步,推到模型減速,特朗普反而不買賬了。減速可以,競爭不能停值得注意的是,提出減速的公司,自己並沒有表現出要慢下來的意思。阿莫迪雖然寫下了“我們必須放慢提升AI模型能力的速度”,但這話主要是說給整個AI行業聽的,至於Anthropic自己能控制的那些事,他的動作倒是毫不含糊。訓練沒停,研發沒慢,IPO也在繼續推進。
站在全力奔向資本市場的關鍵階段,Anthropic要講的當然不可能是一個“慢慢來”的故事。據《金融時報》最新披露,Anthropic已經開始拿著一組相當漂亮的數字去見潛在的IPO投資者:公司Q2已經賺到了調整後的經營利潤,Q3預計還能繼續賺錢,毛利率超過80%。截至7月,公司年化收入已經衝到了650億美元,而去年底還只有90億美元。阿莫迪一邊告訴整個AI行業,AI的能力增長得太快了,他們必須加以控制;另一邊,Anthropic自己還要向投資者證明,他們的收入、利潤和商業化還可以繼續加速。與此同時,美國時間9月14日,阿莫迪發出減速倡議的兩天後,新模型Opus 5.
2疑似已經進入Claude Code灰度測試。雖然Claude Code前端仍然顯示“Opus 5”,但通過查看運行狀態以及請求路由,有用戶稱後臺模型slug已經出現Opus 5.2。社區隨後又通過同一提示詞、知識截止日期和Agent行為進行了交叉測試,發現Claude Code裡的Opus與公開API上的Opus 5出現明顯差異。阿莫迪嘴上說著給前沿踩剎車,手裡的下一代模型倒是一點沒耽誤。同樣具有反差的還有谷歌。哈薩比斯公開轉發了阿莫迪的文章,稱他“指出了正確的未來方向”,但他把這種認可直接落到了谷歌此前提出的“前沿AI標準機構”上,而不是承諾谷歌自己要放慢模型研發。
況且就算哈薩比斯有意想要放緩模型研發、加強監管,他也很難左右谷歌的節奏。如今他已經卸任Google DeepMind的CEO,轉任主席和Alphabet首席科學家,谷歌日常AI業務和Gemini的推進,現在更多掌握在新的管理層手裡。至少從谷歌實際發佈模型的節奏來看,很難看出公司有試圖減速的跡象。7月21日,谷歌發佈Gemini 3.6 Flash;僅僅3周以後,8月13日,3.7 Flash上線;又過了不到三週,9月2日,3.8 Flash也來了。谷歌自己甚至把速度寫進了標題下面的介紹:6周時間,連續發佈三代Flash模型。
阿莫迪這次把RSI(遞歸自我改進)視為必須減速的重要原因之一,而谷歌恰恰正在加碼這個方向。路透社8月披露谷歌內部調整時提到,聯合創始人謝爾蓋·布林一直在推動Gemini加速,並特別要求團隊更加關注RSI。最近AI社區甚至流出了一張谷歌API的返回截圖,其中一個名為rsi-model-level-le的模型引發了谷歌已經在內部測試RSI的猜測。不過這條消息目前沒有得到谷歌的確認。所謂API密鑰被收回、內部可能存在多個訓練槽位等說法,主要來自於爆料者本人。另外,谷歌本身還處在追趕頂尖模型的位置——說得損一點,它現在甚至沒什麼減速的空間。
它尚未公開過OpenAI、Anthropic那種“模型真的跑出去”的事故;按Google自己的安全標準,Gemini甚至還沒跨過那道真正需要拉響最高警報的能力門檻。所以,哈薩比斯支持阿莫迪的方向,對谷歌自己的模型研發本來也沒什麼影響。相比起Anthropic和谷歌,OpenAI的情況則要更加微妙——它倒是真的慢過。Hugging Face事故之後,OpenAI暫停了一批可能執行代碼、調用工具或訪問互聯網的前沿模型任務,隨後又把準備部署的新模型強化學習訓練暫停了兩週,GPT-6 Astra的部分訓練和評測也因此受到影響。
在“AI減速”成為這幾天的行業口號以前,OpenAI真的為安全犧牲過研發進度。但問題在於,OpenAI恰好也有很多別的理由需要“慢一點”。幾個月前奧特曼還不是現在的態度。據The Information報道,他私下希望OpenAI最早在今年第四季度上市,而且明確希望搶在Anthropic之前完成IPO,甚至因此和CFO莎拉·弗里亞產生了分歧。今時不同往日,Anthropic現在真的已經走到了IPO門口,而且資本市場的注意力明顯正在向它傾斜。
《財富》9月3日報道,在尚未上市的二級市場裡,Anthropic股份已經熱到2500萬美元以下的單子都很難進場,5000萬美元甚至上億美元的買家仍然可能搶不到;市場人士估算,其股份需求可能是供給的3到5倍。OpenAI則完全不同,50萬到100萬美元左右就可能買到股份。這個時候,OpenAI去搶這個窗口,結果不會太好看——真要同期走進資本市場,兩家公司自然會被華爾街從收入、燒錢速度、算力投入到盈利時間表一項項擺在一起比較。晚一點,對OpenAI並不是什麼壞事。然後,“AI安全”恰好給了OpenAI一個非常舒服的臺階。奧特曼在《財富》採訪裡明確表示,OpenAI不會在2026年IPO。
他認為當前這個節點上市是一個“不明智的時刻”,公司還有很多事情需要處理。今天,奧特曼又在X上連續發了兩篇長帖,專門解釋OpenAI所謂的“減速”到底是什麼意思。(他的用詞是“pacing”,但也提到了“slower”)他強調,“減速”並不意味著“停止”。AI仍然會快速進步,只是應該比原本能夠達到的速度更慢一些。前沿實驗室也不需要等國會立法或者政府提供反壟斷豁免,可以先自己做起來。OpenAI現在已經開始在那些可能顯著提升模型能力的前沿強化學習訓練之前,提前建立明確的安全論證(safety case),同時增加監控和評估。
奧特曼甚至寫道,美國面臨再大的競爭壓力,也不能成為魯莽推進、讓模型能力跑到對齊和監控前面的理由。簡單來說,OpenAI所謂的“減速”,本來就只發生在局部——某些訓練可以晚一點、某些安全檢查可以多做一點、IPO也可以往後放——但整體競爭照常繼續。甚至再反過來看OpenAI之前的“暫停訓練”,也並不是個純粹的道德選擇。在那段“踩下剎車”的事件裡,OpenAI也在重做訓練環境、監控體系和研發流程。換個角度來理解,其實也是原有基礎設施和安全標準跟不上模型能力的發展,因此不得不被動整改。等新的安全要求滿足之後,OpenAI在8月28日就重新啟動了此前暫停的大型前沿RL訓練。
現在奧特曼把這種狀態解釋成“在必要的時候讓安全先追上來”,確實是個很體面的敘事。標準由誰制定?在奧特曼、馬斯克和哈薩比斯之後,微軟CEO薩蒂亞·納德拉也加入進來,公開贊同“有意識地放慢節奏”,以及把第三方評測者直接嵌入實驗室的做法。但納德拉緊接著又補了一句:AI治理不能掌握在少數幾家公司手裡。他認為,未來的治理機制必須讓更多公司、國家、學術界共同參與,而且既要有閉源模型、也要有開源模型。
白宮AI顧問大衛·薩克斯則毫不客氣,他接連用了好多個“別再假裝”:別假裝你們需要別人許可,別假裝必須暫停反壟斷法才能組成一個“卡特爾”(壟斷聯盟),別假裝METR真的是完全獨立的第三方,也別讓同一批評測機構去監管那些甚至還沒跑到前沿的競爭對手。在薩克斯看來,Anthropic和OpenAI本來就是今天的前沿。如果兩家公司看到的未發佈模型真的已經危險到需要減速,那就自己慢下來,沒人攔著。他的懷疑並非憑空出現。
據The Information報道,Anthropic、OpenAI和谷歌其實從今年7月開始,就已經派代表定期開會,討論建立一個由行業主導的AI標準機構,制定安全基準、測試和審計規則,最近一次會議就在上週。但如果因此就把阿莫迪的方案簡單理解成“巨頭借安全搞壟斷”,其實也不太公平。一方面,這事兒談了幾個月,但一直都沒形成什麼統一標準,就連阿莫迪自己的倡議,也不過是提出了一個大致的方向而已。另一方面,阿莫迪提出的“狹義的反壟斷豁免”,其實只是想讓幾家直接競爭的前沿實驗室能夠合法坐下來談安全標準,別最後變成誰更自律,誰先吃虧。
他也不是讓所有模型現在全部放慢,只是劃出幾條統一的檢查線(X)——沒跑到那條危險能力線的繼續加速,跨過了這條線的模型則要統一接受檢查(Y和Z)。比如,當一個模型已經能夠逃出或擊敗大多數常見沙箱,開發者就需要證明,它基本不會主動突破環境、接管大量計算機。對METR的“指控”同樣很難成立,雖然METR長期參與Anthropic的模型安全評測、Anthropic又恰巧有員工轉投METR,但METR本身就是前沿AI安全領域最成熟的第三方評測機構之一。前沿AI是一個非常專業的領域,真正有能力監督這些公司的第三方,本來就很難離這些公司太遠。
不過,一旦涉及到“劃線”和“反壟斷”,就存在一個很難繞過的問題:這條線到底由誰來劃?正如納德拉所說,AI治理不能成為少數公司的一言堂,“劃與權”不能只掌握在幾個本身就身處競爭中的實體手裡。要是最大的幾家AI公司借安全之名建立一套所有人都得遵守的規則,那些小公司可能暫時看起來沒什麼損失,但長期看,評測、審計、合規和安全團隊本身都會變成一筆越來越高的固定成本。等到小公司真跑到前沿時,先撞上的可能不是技術天花板,是一整套只有大公司負擔得起的安全成本。
Related
相關文章

美國 AI 巨頭提議開發減速,歐洲同行和政界並不認同
作者:清源 責編:清源 評論: 9 月 18 日消息,據路透社今天(18 日)報道,此前,阿莫迪、奧爾特曼和馬斯克先後發出警告,能力不斷增強的 AI 系統可能帶來風險,故有必要控制其發展節奏,但歐洲企業和官員對此表現出明顯懷疑。法國初創企業 Mistral 在聲明中指出,這些風險早在幾個月前就已十分明確了。

MiniMax Code CLI 正式開源,在評測中取得 76.7% 的任務通過率
作者:沁滄(實習) 責編:沁滄 評論: 感謝網友 Domado 的線索投遞!9 月 18 日消息,MiniMax 今晚宣佈,MiniMax Code CLI 的 v0.4.12 版本面向全球開發者正式開放,並且以 MIT 協議正式開放源代碼。

北京發佈“詞元經濟十條”:高標準建設詞元工廠,推動關鍵核心技術攻關
作者:浩渺 責編:浩渺 評論: 感謝網友 蛋殼兒 的線索投遞!9 月 18 日消息,北京市經濟和信息化局今日宣佈,北京市“詞元經濟十條”正式發佈。為貫徹落實《國務院關於深入實施“人工智能+”行動的意見》(國發〔2025〕11 號),率先培育智能經濟新形態,以詞元(Token)為抓手,發展詞元經濟新增量,制定《北京市加快詞元經濟發展的行動方案(2026—2028 年)》(注:以下簡稱《行動方案》)。
PrismML Releases Ternary Bonsai 2 27B: A 5.9 GB Apache 2.0 Model Retaining 98.2% of Qwen3.8 27B Performance
PrismML has released Ternary Bonsai 2 27B, a ternary-weight version of Qwen3.8 27B. The language model occupies 5.93 GB, against 53.80 GB in FP16. PrismML reports that it keeps 98.2% of the parent model’s average across 20 benchmarks.

OpenAI剛曝光循環架構,這家公司更早將其用於世界模型
鍵詞只有一個:循環。 Astra採用了一種被稱為“循環深度”(Recurrent Depth)的架構,本質是讓同一組Transformer層被反覆複用,用更少的參數實現更深的計算。 這被外界視為OpenAI對傳統“堆參數、堆算力”路線的一次重大修正——不再只是把模型做大,而是讓模型學會“反覆思考”。 消息一齣,整個AI社區迅速升溫。

千問辦公接入高德門店經營專家套件 提升實體店選址與經營效率
此項新功能自9月18日起正式上線,用戶只需在千問辦公添加相應套件並完成高德賬號授權,即可實現從門店選址到日常經營分析的全鏈路工作。隨著實體商業的不斷發展,傳統的人工選址和經營分析方式顯得效率低下且容易出錯。個體創業者在開新店時,往往需要花費大量時間進行實地勘察,整體耗時可達一週,而商家在監測門店熱度變化及競爭對手動態時,也面臨數據整理繁瑣、分析結果不準確的問題。