英偉達開源 IMO 金牌配方:不僅是「人海戰術」,1.5TB 顯存做實 AI「 推恩令」?

2026年9月15日 17:38
英偉達開源 IMO 金牌配方:不僅是「人海戰術」,1.5TB 顯存做實 AI「 推恩令」?
站內 AI 整理稿

英偉達近日開源了一套號稱「IMO 金牌配方」的技術方案,迅速在學術界與業界掀起熱議。這套方案並非單純的演算法突破,而是透過三組不同階段的檢查點,結合多輪證明搜索機制,讓人工智慧在數學推理任務上達到近乎國際數學奧林匹亞競賽金牌選手的表現水準。英偉達特別強調過程透明度,將整個搜索邏輯與中間結果全部公開,試圖以此回應學術圈長期以來對「黑箱模型」的不滿與質疑。根據英偉達公布的技術文件,這套「金牌配方」的核心在於多階段的檢查點設計。系統會在不同推理階段保存中間狀態,並利用這些檢查點進行多輪搜索,反覆驗證數學證明的正確性與完整性。

這樣的設計讓模型能夠像人類選手一樣,在解題過程中不斷回頭檢視與修正,最終產出接近完美解答的結果。英偉達宣稱,該方法在多個數學推理基準測試上,已經能與人類頂尖選手匹敵,甚至在某些項目上表現更為穩定。除了演算法架構之外,英偉達此次開源行動的另一個重點是「透明化」。過去幾年,以大型語言模型為代表的 AI 系統,經常因為決策過程難以解釋而飽受批評。學術界多次呼籲,若無法理解模型如何推論,就無法真正信任其產出結果。英偉達這次刻意將證明搜索的每一步邏輯、每個檢查點的狀態、以及最終如何收斂到正確解答的過程,全部寫入公開文檔與程式碼,意在證明「這不是一個黑箱子」。

然而,當外界仔細檢視這套方案的技術規格時,一個驚人的門檻隨即浮現——要完整運行這套「IMO 金牌配方」,至少需要 1.5TB 的顯示記憶體。如此龐大的記憶體需求,等同於將絕大多數大學實驗室、中小型新創團隊,甚至部分大型企業的研究單位,都擋在門外。業界人士分析,這個規格幾乎只有英偉達最新一代的專業級 GPU 叢集才能滿足,例如搭載多張 H100 或即將推出的 B200 加速卡,才能湊足這般記憶體容量。正因硬體要求如此苛刻,這套開源方案在社群中引發了兩極評價。

支持者認為,英偉達至少願意公開程式碼與邏輯,讓資源充足的機構能複現結果,進一步推動數學推理 AI 的發展;反對者則直言,這不過是另一場精心設計的「算力門檻秀」。一位不具名的業內研究員指出:「如果連複現實驗都要 1.5TB 顯存,那後續進一步改進與微調的成本只會更高。英偉達表面上送給你程式碼,實際上是在告訴大家——沒有我的硬體,你連門都進不去。」 這種說法並非空穴來風。英偉達在全球 GPU 市場的壟斷地位早已不是新聞,從消費級顯示卡到資料中心專用加速器,幾乎所有高性能 AI 運算都離不開其產品。

這次「IMO 金牌配方」的開源,在外界看來猶如現代版的「推恩令」:名義上分封天下,讓所有人都可以存取這套技術,實際上卻是用極高的顯存規格將自主研發的空間壓縮到極限。當所有研究者都必須依賴英偉達的高階 GPU 叢集才能重現實驗結果時,這場開源行動的本質,便從技術分享轉為算力壟斷的又一次鞏固。值得注意的是,這並非英偉達第一次利用硬體規格來主導技術生態。過去在深度學習框架、模型最佳化工具以及運算函式庫的布局中,英偉達往往透過推出專屬的 CUDA 生態系統,讓開發者習慣了其平台後,再逐步提高硬體需求門檻。這次的 1.5TB 顯存要求,只不過是這條策略的延伸。

相比之下,AMD 與 Intel 雖然也在積極發展 GPU 計算與 AI 加速方案,但從軟體生態到硬體記憶體頻寬與容量,短期內仍難以撼動英偉達的主導地位。學術界對此態度更為複雜。一方面,許多數學家與 AI 研究者確實渴望能夠獲得一個透明、可驗證的數學推理模型,以便進一步研究機器人如何理解邏輯與證明。英偉達的開源方案在一定程度滿足了這股需求。另一方面,高達 1.5TB 的顯存意味著只有極少數頂尖學府或大型企業實驗室有能力投入資源,多數學校與開發者只能旁觀。這種資源上的不對等,長遠來看可能加深 AI 領域的「貧富差距」,讓強者愈強、弱者更難翻身。

有分析師指出,英偉達此舉也有可能是為了搶佔 AI 在科學研究領域的話語權。數學推理被視為 AI 往通用人工智慧邁進的關鍵能力之一,若英偉達能將「金牌等級的數學推理」與「自家硬體」綁定,那麼後續無論是學術論文的引用、標準的制定,還是商業授權的談判,英偉達都能立於不敗之地。開源程式碼只是前菜,真正的主菜是那個必須用英偉達 GPU 才能填滿的顯存池。不過,業內也有人持較樂觀的看法。他們認為,隨著運算硬體的進步,1.5TB 顯存在未來的三到五年內可能不再是天文數字。屆時,這套「IMO 金牌配方」的真正價值才會被廣泛發揮。

英偉達此刻搶先開源,等於提早為下一代硬體鋪路,同時也為學術界提供了一個明確的技術目標。只是對於此刻的大多數團隊來說,這個目標確實高得有些遙不可及。總而言之,英偉達這次開源行動的背後,既有促進數學推理 AI 發展的善意,也有鞏固算力霸權的現實算計。當「代碼平權」碰上「硬體高牆」,開源的本質就成了一場精心設計的入場券遊戲。未來,若英偉達持續以這種「高顯存、高門檻」的模式主導開源生態,學術界與業界恐怕需要更積極地尋求替代方案,否則這場 AI 的「推恩令」只會讓中央集權的態勢更加穩固。

Related

相關文章

消息稱 Anthropic 低調建立生物實驗室,借 AI 推進藥學研究

作者:清源 責編:清源 評論: 9 月 18 日消息,路透社今天(18 日)晚間援引知情人士消息稱,Anthropic 在舊金山灣區低調建立了一座溼實驗室,把 AI 業務進一步延伸到需要實際動手操作的生物學研究和藥物科學領域。知情人士透露,在公眾對 AI 風險愈發擔憂之際,Anthropic 開始在溼實驗室進行實體實驗。Anthropic 此前提出,希望藉助 AI 推動罕見病治療方法的發展,公司的生物學研究也從“計算機模擬”和計算機評估進一步走向真實實驗。注:溼實驗室是一個科學概念,與“幹實驗室”相對。相比干實驗室,溼實驗室在實驗中需要用到較多的化學試劑。相比之下,幹實驗室則注重通過各種儀器進行計算,以歸納出實驗材料的物理模型。Anthropic 生命科學負責人埃裡克 · 考德勒-艾布拉姆斯證實了溼實驗室的存在。“我們認為,生物學研究最終還是要接受真實實驗室工作的檢驗,而且未來一段時間都會如此。我們現在確實在做這些工作。整體模式和大多數生物科技公司類似,一部分在自己的設施裡完成,另一部分則與外部合作伙伴共同開展。”Anthropic 發言人又進一步補充,這座實驗室並非專門用於藥物發現,並拒絕進一步說明具體用途。知情人士稱,建立溼實驗室只是 Anthropic 邁向更大目標的一小步。Anthropic 希望攻克其認為製藥行業忽視的疾病,公司也希望在員工和公眾失去對 AI 價值的信心之前拿出成果,因為 AI 可能導致崗位消失,甚至威脅人類生命。不過,任何藥物研發項目都無法保證成功,大多數候選藥物最終都無法通過臨床安全性和有效性試驗。這項工作對 Anthropic CEO 達裡奧 · 阿莫迪還有一層個人意義。

6 小時前

AGI最難一戰,竟在醫院!中國AI登上Science,醫生不怕失業還催著上線

。 2016年,Hinton老爺子就預言:“人們現在就應該停止培養放射科醫生。”他甚至認為,五年內,AI就會在醫療影像識別上超過放射科醫生。 老爺子一生謹慎,但歷史和他開了個玩笑。十年過去了,人們離AGI已經越來越近,但在醫療場景裡,即使圖像識別這樣的AI新手村任務,依然是hard模式。 如果從IBM的Watson算起,在醫療上遭遇滑鐵盧的AI專家數不勝數。

10 小時前

AGI最難一戰,竟在醫院,中國AI登上Science,醫生不怕失業還催著上線

我没办法凭这条标题写出符合要求的完整新闻稿,原因很直接: 现有"可用资料"其实只有一行标题,正文是空的。后面的内容全是的侧边栏推荐和网站导航(Anthropic华人、Manus估值、腾讯投资药企等),跟这条新闻没有关系。 如果硬写 900–1600 字,我就得自己编造这些关键事实: 是哪个团队、哪家医院、哪篇 Science 论文 论文的具体方法和结果数据 医生"催着上线"的具体场景和原话 这些一旦写出来就是假新闻,我不做这个。

12 小時前

AI製藥獨角獸Anew單飛,字節推了一把“最燒錢的慢生意”

Reuters:Anew Labs完成首輪外部融資2.9億美元、投後估值15億美元,HSG、IDG Capital、GL Ventures、五源資本等機構入股,字節跳動融資後持股56%。2. IQVIA 2026年分析:經確認有AI參與的新興生物科技項目I期、II期臨床成功率比較,及樣本有限的說明。3. 《Nature Reviews Drug Discovery》2026年8月Perspective:AI方法與基準測試大量出現,臨床相關性影響證據仍然有限。4. Deloitte全球大型生物製藥公司晚期研發管線年度研究:2025年平均藥物開發成本約26.7億美元,計算含研發失敗成本。

13 小時前