擴大 XPU 互連域:消息稱 FuriosaAI 探索 16 卡服務器託盤設計

重點摘要
韓國 AI 晶片新創 FuriosaAI 正朝向擴大 XPU 互連域的目標邁進,近期傳出正在探索可容納 16 張加速卡的伺服器托盤設計。根據曝光的資料,這款伺服器採用雙層主板的「三明治」結構,每層主板各自配置 8 條 PCIe 插槽,總計可插入 16 張卡,且兩塊主板共享同一組散熱器。
韓國AI晶片新創公司FuriosaAI近期在業界傳出正在探索一款全新設計的伺服器托盤,目標是容納多達16張加速卡,藉此大幅擴展XPU互連域的規模。根據曝光的技術資料,這款托盤採用雙層主機板的「三明治」結構,每一層主機板各自配置8條PCIe插槽,總計可插入16張加速卡。兩塊主機板不僅共享同一組散熱器,還透過高密度的卡間互連設計,在單一托盤內形成一個強大且統一的XPU互連域,以滿足大型人工智慧模型在訓練與推理階段對於運算效能與頻寬的嚴苛需求。 FuriosaAI成立於韓國,專注於開發高效能AI加速晶片,過去已推出基於自家架構的產品,並逐步在市場上建立聲譽。此次流出的16卡托盤設計,顯示該公司正從單一晶片方案跨入系統級整合領域,企圖透過硬體架構的創新來提升整體運算密度。傳統AI伺服器通常僅支援4至8張加速卡,而16卡托盤的出現,意味著可以在同一機箱內塞入更多運算單元,減少跨節點通訊的延遲,從而加速模型訓練與推論速度。 這款托盤的雙層主機板結構是設計上的最大亮點。兩層主板各自獨立運作,但透過共享的散熱器與統一的互連匯流排,讓所有16張卡能夠協同工作。共享散熱器不僅有助於節省空間,還能簡化氣流設計,降低因多卡並排運作產生的熱量堆積問題。不過,要同時驅動16張高功耗的加速卡,供電與散熱系統的挑戰不容小覷,FuriosaAI如何解決這些工程難題,將是該設計能否從概念走向量產的關鍵。 從技術層面來看,XPU互連域的概念在近年AI基礎設施中越來越受到重視。所謂XPU,泛指不同類型的處理單元,包括GPU、NPU、FPGA等。FuriosaAI的加速卡屬於NPU(神經網路處理器),專為AI運算最佳化。透過高密度的卡間互連,單一托盤內的所有NPU可以共享記憶體與運算資源,形成統一的運算池,從而提升大型模型參數更新的效率。這種架構特別適合需要大量平行運算的Transformer類模型,例如GPT、BERT等。 目前FuriosaAI尚未公布這款16卡托盤設計的量產時程,也未透露是否已有客戶進行測試。但從該公司積極探索高密度AI基礎設施解決方案的動作來看,顯然希望在NVIDIA、AMD等巨頭主導的市場中,找到差異化的切入點。NVIDIA長期以來憑藉NVLink與HGX平台,建立起強大的多卡互連生態;而FuriosaAI若能在標準PCIe架構上實現類似的密度與效能,就有可能提供更具成本效益的替代方案。 值得注意的是,這款托盤設計並非僅是硬體規格的堆疊,更反映了AI晶片新創在系統層面的思維轉變。過去許多新創公司只專注於晶片本身,但隨著AI應用規模快速膨脹,客戶越來越需要完整的硬體方案,包括伺服器主機板、機箱、散熱、電源管理,以及與軟體框架的整合。FuriosaAI的16卡托盤探索,正是因應這股「從晶片到系統」的趨勢,試圖提供從底層到上層的整體解決方案。 在市場競爭方面,FuriosaAI並非唯一瞄準高密度多卡伺服器的廠商。包括中國的壁仞科技、寒武紀,以及美國的Cerebras、SambaNova等AI晶片新創,都曾推出類似的大規模互連設計。然而,FuriosaAI選擇的雙層主板「三明治」結構,在空間利用與散熱效率上具有獨特優勢,可能成為其差異化競爭的武器。此外,韓國政府近年積極扶植半導體產業,FuriosaAI也有機會獲得國內供應鏈的支持,加速產品落地。 對於大型AI模型的訓練者而言,單一托盤內支援16張卡,意味著可以減少跨伺服器節點的資料傳輸,降低網路頻寬瓶頸。例如,訓練一個擁有數千億參數的語言模型,通常需要上百張GPU協同運算;若採用FuriosaAI的16卡托盤,每個托盤就能提供相當於以往兩倍以上的運算密度,有助於簡化叢集架構,並縮短模型訓練時間。這對於雲端服務提供商、大型科技公司以及學術研究機構來說,都具有顯著吸引力。 不過,這項設計若要真正商品化,還有許多細節需要克服。除了散熱與供電,PCIe插槽的頻寬分配、卡間通訊延遲、軟體驅動程式的優化,都是影響最終效能的關鍵因素。FuriosaAI雖然在晶片架構上已有一定經驗,但系統級整合能力仍需要時間驗證。業界普遍預期,該公司可能會先與特定合作夥伴進行概念驗證,再逐步開放給更多客戶。 總體而言,FuriosaAI的16卡伺服器托盤設計,展現出韓國AI晶片新創在硬體創新上的企圖心。儘管距離量產可能還有一段距離,但這項探索已經為高密度AI運算基礎設施提供了一個新的思考方向。隨著全球AI算力需求持續攀升,類似的高密度互連方案將成為各大廠商競逐的重點,而FuriosaAI能否在競爭中脫穎而出,值得持續關注。
Related
相關文章

一句話讓 AI 造出快 6.3 倍的推理引擎,賈揚清離職英偉達官宣二度創業:AI Infra 正從“管算力”走向“造系統”
AI 領域迎來重磅消息:賈揚清正式從英偉達離職,並官宣二度創業。最引人注目的是,他僅憑一句提示,便讓 AI 自主設計出推理速度提升 6.3 倍的引擎,這項成果直指當前 AI 基礎設施(Infra)的轉型核心。業界普遍認為,這不僅是技術突破,更標誌著 AI Infra 的底層命題已發生根本轉變。
寒武紀擬用500萬股限制性股票激勵945名職工 每股750元
寒武紀公司回購專用證券賬戶目前持有36,600股,回購均價548.13元/股。寒武紀公司表示,半導體芯片行業對研發人才依賴度高,該定價綜合考慮了激勵計劃的有效性和股份支付費用影響,有利於穩定和激勵核心團隊。寒武紀公司採用Black-Scholes模型對首次授予的400萬股進行預測算,股份支付總費用約191,383.62萬元,2026年至2029年分攤金額分別為31,848.40萬元、80,609.73萬元、59,206.17萬元和19,719.32萬元。根據公告,寒武紀2025年實現營業收入64.97億元,實現全年利潤扭虧為盈。

黃仁勳為何力挺梁文鋒、楊植麟?
黃仁勳近期公開表態力挺梁文鋒與楊植麟,背後關鍵在於兩人主導的國產大模型團隊成功重構Transformer架構,直接改寫了全球算力與存儲的供需格局。這項技術突破不僅讓大模型訓練效率大幅提升,也降低了對高階GPU的極端依賴,從根本上改變了AI基礎設施的成本結構。

老黃人生第二條推文,只有Anthropic還在死扛
NVIDIA創辦人黃仁勳發布了人生第二條推文,引發業界關注。在多家AI公司調整方向之際,Anthropic仍堅持原有路線,凸顯當前AI競爭的策略分歧與市場張力。

英偉達出手,AI視頻分析工具實測:普遍很弱,但總比沒有強
英偉達近日正式進軍AI視頻分析領域,推出相關工具套件,引發業界關注。然而根據36氪的實際測試,這款被寄予厚望的工具在實戰中的表現並未達到預期水準。從識別精準度到反應速度,多個維度的結果都顯示其能力「普遍很弱」,尤其在複雜動態場景中,誤判與漏判情況並不罕見,與英偉達在運算硬體領域的強勢形象形成鮮明對比。 儘管如此,這套工具的出現仍具有其階段性意義。

維諦技術田軍:電鏈與冷鏈將重構AI算力基礎設施
維諦技術田軍:電鏈與冷鏈將重構AI算力基礎設施飛向TAI空2026.07.27 18:19 · 來自北京全文3456字00:00 / 09:37AI數據中心建設熱潮引發了供電架構和製冷方案的快速迭代,目前來看,800 VDC和液冷是大勢所趨。AI算力的持續爆發,正在推動一場基礎設施領域的歷史級變革。