CUDA 20年護城河一個週末崩了,Claude獨自跑通AMD新GPU

重點摘要
英偉達CUDA歷經20年打造的軟體生態,竟在一個週末之內被AI跨越。Anthropic旗下模型Claude在完全無人干預的情況下,自行完成對AMD最新GPU MI355X的適配與性能調校,整個過程僅由一名工程師下達指令,人類團隊全程未修改任何一行程式碼。 故事始於AMD向Anthropic提供一台搭載MI355X的測試機架。團隊原本預期需要投入大量人力進行新平台與新軟體堆疊的適配工作,但他們決定讓Claude嘗試直接接手。一名工程師將Claude連接至機器,簡單指示「去把這台機器跑起來」,便結束工作。
英偉達CUDA歷經20年打造的軟體生態,竟在一個週末之內被AI跨越。Anthropic旗下模型Claude在完全無人干預的情況下,自行完成對AMD最新GPU MI355X的適配與性能調校,整個過程僅由一名工程師下達指令,人類團隊全程未修改任何一行程式碼。 故事始於AMD向Anthropic提供一台搭載MI355X的測試機架。團隊原本預期需要投入大量人力進行新平台與新軟體堆疊的適配工作,但他們決定讓Claude嘗試直接接手。一名工程師將Claude連接至機器,簡單指示「去把這台機器跑起來」,便結束工作。週末過後,螢幕上出現一條持續上升的性能曲線,Claude不僅成功啟動系統,還自動反覆迭代優化,性能不斷提升。 Anthropic聯合創辦人兼首席計算官Tom Brown在公開場合分享此事後,AMD董事長暨執行長蘇姿豐隨即回應。她表示,得知Anthropic僅派一名工程師處理MI355X時,第一反應是讓AMD團隊前往支援,但對方回覆說不需要,已經全部完成。這項週末實驗很快轉為正式部署計畫,Anthropic近日宣布將在AMD Helios系統中部署最高2GW的Instinct GPU,首批1GW預計於2027年上半年啟動,雙方還將直接使用Claude優化AMD工作負載,加速ROCm軟體開發。 Claude之所以能對CUDA生態形成「降維打擊」,關鍵在於AMD直接為AI開發了一套可自主操作GPU的工具。在AMD Advancing AI 2026大會上發表的ROCm.AI,正是為Claude、Codex、Cursor等AI代理準備的完整GPU工具箱。入口名為AMD Skills,內含經過驗證的ROCm知識,代理取得這些知識後,能自行安裝環境、部署模型、讀取日誌、排查故障,並透過ROCm CLI調用真實機器。開發者只需說出目標,後續路徑由AI自主尋找。 AMD甚至改變了晶片說明書的寫法。該公司AI軟體與解決方案副總裁Anush Elangovan透露,每一代AMD GPU都會公開指令集,並提供AI可讀的ISA。代理在讀懂手冊後,便能直接著手調校性能。這部分工作交由Hyperloom工具執行,它會拉起推理服務,先跑出基線,再逐一找出CPU與GPU瓶頸,測試不同配置,生成客製化內核,最後將新方案重新執行。現場演示中,Hyperloom讓MiniMax M3的輸出速度提升38%,AMD還讓它一次跑完1.4萬個模型,將測試結果沉澱為可重複使用的經驗。 AMD正與前沿模型公司合作訓練這種能力,目標是讓前沿模型「天生就會說AMD程式語言」。未來評估一顆晶片時,除了峰值算力與記憶體頻寬,AI能否讀懂、調用、並將性能調校出來,也將成為同等重要的規格。晶片公司要爭取的開發者,從此多了一類:AI代理。 CUDA從2006年發展至今,靠的是無數工程師一行行程式碼堆疊出的生態系統,包含編譯器、數學庫、調試器、性能分析工具、開發文檔,應有盡有。更難複製的是工程師們長年累積的實戰手感:算子如何調整、通訊如何加速、記憶體如何分配、分散式部署最容易出錯的地方在哪裡,這些經驗全鎖在少數專家腦中。後來者即使造出性能接近的硬體,也得從頭走完整條軟體長路;晶片流片可以按季度推進,生態積累卻只能以年為單位煎熬。 AI代理補足的正是這一段。它會讀取平台文檔、調用性能分析工具、找出速度瓶頸,再修改程式碼、編譯、測試。方案無效就換下一種;跑分變好就沿此方向繼續優化。人類培養一名頂級GPU工程師需要按年計算,而多啟動一個代理只需再開一個任務。一名工程師派出多個代理,就能並行排查報錯、定位性能瓶頸;一次跑通的配置、寫好的內核與踩過的坑,也能立即成為下一批代理的起點。 將按年計算的追趕壓縮成按任務計算,正是AI最核心的價值所在,也是ASI層級能力對CUDA生態的降維打擊。目前中國工程師已站在這場AI改造GPU軟體棧的最前線,他們沉澱下來的底層經驗,正被整理成更多代理可調用的能力。追趕CUDA的新起點已經出現:把硬體介面與軟體工具交給AI,讓代理直接開工。20年的生態差距,第一次可以交給一群代理晝夜不停地往回追趕。
Related
相關文章

Adaptavist 調查:近三分之二白領懷念“前 AI 時代”的工作方式
根據Adaptavist調查,約65%的白領經常懷念AI出現前的工作方式,主要理由是AI可能削弱創造力,且近半數人為核實AI生成內容而花費更多時間。此外,研究指出AI雖提升創意質量,卻導致創意趨同,而企業反覆調整AI政策也讓員工感到困擾。

菲爾茲獎得主預警:AI可能殺死數學
今年的菲爾茲獎頒獎典禮剛剛落幕,數學界卻迎來了一記震撼彈。與王虹、鄧煜共同獲獎的多倫多大學教授Jacob Tsimerman,在獲獎後隨即宣布加入OpenAI,轉而投入人工智慧安全研究。他給出的理由令人震驚:兩年之內,AI將在所有數學證明領域徹底超越人類。隔天,在費城舉行的ICM 2026大會現場,另一位菲爾茲獎得主陶哲軒也以憂心忡忡的口吻表示,數學正進入一個價值觀與實踐基礎同時遭遇危機的動盪時期。

微軟 CEO 納德拉:依賴單一 AI 滿足所有需求的公司恐將無法生存
首頁 > 智能時代>人工智能 微軟 CEO 納德拉:依賴單一 AI 滿足所有需求的公司恐將無法生存 2026/7/28 7:24:42 來源:IT之家 作者:清源 責編:清源 評論: IT之家 7 月 28 日消息,微軟 CEO 薩提亞 · 納德拉再次向企業發出警告:如果把 AI 能力完全交給 AI 模型開發商,最終可能失去競爭力,甚至無法繼續生存。
Anthropic Claude共享聊天功能曝隱私風險,大量對話被谷歌收錄
Anthropic旗下AI Claude曝隱私漏洞:用戶共享聊天記錄被谷歌等搜索引擎意外收錄,洩露健康、企業及兒童隱私數據。事件源於公開分享鏈接未屏蔽搜索引擎爬蟲,通過特定搜索語法即可檢索,引發對AI產品數據安全與隱私保護的廣泛擔憂。
微軟發佈首款網絡安全AI模型MAI-Cyber-1-Flash,推出Perception安全平臺
AI資訊AI新閒資訊正文微軟發佈首款網絡安全AI模型MAI-Cyber-1-Flash,推出Perception安全平臺發布於AI新閒資訊時間 :Jul 28, 2026閱讀 :1分鐘微軟近日在舊金山舉行的活動中正式推出首款網絡安全專業模型MAI-Cyber-1-Flash,以及全新的AI網絡安全平臺Perception,進一步加碼人工智能安全防禦領域,並與Anthropic、谷歌、OpenAI等企業展開競爭。微軟表示,MAI-Cyber-1-Flash是一款專為網絡安全場景打造的模型,目標是在複雜代碼庫中發現高難度漏洞,併為微軟漏洞識別與修復工具MDASH提供核心能力支持。該模型結合Perception平臺,可幫助企業自動化執行漏洞發現、分析和修復等安全流程。微軟AI CEO Mustafa Suleyman表示,公司已將MAI-1Cyber Flash與MDASH框架中的GPT5.4結合,並在Cyber Gym網絡安全基準測試中超過Gemini、GPT5.5Cyber、GPT5.6Sol以及Mythos5等競爭模型。微軟稱,該模型在性能和成本效率方面均具備優勢,並計劃立即投入生產環境。與此同時,微軟推出的Perception平臺採用多智能體協作架構,由紅隊、藍隊和綠隊三類AI智能體組成。其中,紅隊智能體負責模擬潛在攻擊行為,分析威脅路徑;藍隊智能體用於檢測和分類漏洞;綠隊智能體則執行漏洞修復和安全優化操作。微軟安全副總裁Hayete Gallot表示,隨著黑客越來越多利用AI發動攻擊,企業需要藉助AI提升防禦效率。Perception旨在幫助安全團隊以接近攻擊者的速度和規模利用AI進行防護。Perception首席工程師Dave Weston稱,過去安全團隊需要多名專業人員耗費數小時完成漏洞排查和修復,而藉助AI智能體協作,企業可以在幾分鐘內完成漏洞發現、優先級排序、安
美團否認 LongCat 核心負責人離職
AI資訊AI新閒資訊正文美團否認 LongCat 核心負責人離職發布於AI新閒資訊時間 :Jul 28, 2026閱讀 :1分鐘一則關於核心人物出走的傳言,在美團大模型團隊頭頂盤旋了不到一天就被按下。美團官方否認了 LongCat 團隊基礎模型負責人裴鵬即將離職的說法,稱消息不屬實。裴鵬與 LongCat 的關聯並不淺。他於 2023 年加入美團,挑起大語言模型等方向的研發重擔,並主導了業界首個全流程依賴國產算力的萬億參數大模型 LongCat-2.0 的研發落地。這款模型發佈至今尚不滿一個月,正處於外界目光最密集的窗口期,此時傳出負責人離任,難免牽動市場對團隊穩定性的神經。美團此次迴應乾脆,直接把"即將離職"定性為不實信息。在國產大模型競速、且越來越強調算力自主的當下,一款剛亮相的萬億參數模型與其主帥的去留,早已不只是內部人事問題,更被外界拿來丈量這家公司押注底層模型的決心。相關推薦Kimi K3 權重正式落地:全球首個 3 萬億開源模型,顛覆的不只是技術排位月之暗面將Kimi K3完整模型權重上傳至Hugging Face,技術報告同步公開。該模型總參數2.8萬億、激活1040億,支持100萬token上下文,成為全球首個3萬億參數級開放權重模型。自7月16日API首發後僅11天,K3在Artificial Analysis智能指數中以57分位列全球第三,僅次於Claude Fable5和GPT-5.6 Sol。Jul 28, 202667.4k小度 AI 手錶 Fit 開售:文心大模型塞進 159.8 元的腕上空間小度AI智能手錶Fit於7月27日開售,定價198元,國家補貼後僅159.8元,將百度文心大模型首次帶入百元檔。輕觸錶盤即可語音提問,能即時迴應天氣、穿搭、健康飲食等日常諮詢,在腕上實現AI實時對話,把智能助手變得輕巧又實惠。Jul 28, 202672.