國產算力破局,超節點才是勝負手

2026年8月3日 20:36
國產算力破局,超節點才是勝負手

重點摘要

國產大模型因算力需求激增,導致算力緊張問題再度浮現,單靠算法優化無法完全解決,智能算力規模已爆發式增長。國產AI晶片崛起,超節點成為提升算力效率與降低成本的最佳方案,業界正探索大小節點的不同技術路線。

站內 AI 整理稿

國產大模型近期接連推出新版本,GLM 5.2、Kimi K3.0 相繼上線,再加上 DeepSeek 投資人會議紀要外洩,讓算力供給緊張的現實再度浮上檯面。業界普遍認為,國產大模型想要再往上突破,算力這道門檻非跨不可。曾幾何時,「堆算力」被視為「力大飛磚」的捷徑,但在國內受限於種種因素,算力不足一直是發展瓶頸。直到 DeepSeek 透過算法優化降低了對算力的依賴,市場才開始轉向精打細算的路線。MoE 架構的參數靈活調度、注意力機制的改良、以及借助開源模型打造垂直應用,都讓「花小錢辦大事」成為可能,算力溢價的討論也逐漸淡化。然而,國產大模型迅速躋身國際第一梯隊後,需求端卻出現意料之外的變化。

以 Kimi K3 為例,其模型參數高達 2.8T,但單次推理只激活 104B 參數,原本效率極高;然而出圈後 Token 消耗激增,總吞吐量跟著水漲船高,最終拉高了整體算力需求。正如「伯虎財經」所分析,Kimi K3 主打長程編程與 Agent 任務,一次任務可能包含數十次推理,用戶看到的只是一個請求,後台卻跑了幾十輪計算。這個現象恰好呼應了經濟學中的傑文斯悖論:當技術進步提高資源使用效率,反而可能導致資源總消耗量增加,而非減少。大模型推理成本下降,能力卻持續增強,吸引更多用戶與更複雜場景,算力擴容成為必然之路。事實上,算力基礎建設從未鬆懈。

根據公開資料,2025 年國內智能算力規模為 1590 ExaFLOPS,到了 2026 年上半年已成長至 2185 EFLOPS,年增率高達 177%,呈現爆發式增長。而這波擴張背後,國產 AI 晶片正逐步站上舞台中央。崑崙芯推出第四代 AI 晶片 M100,專為大規模推理場景(尤其是 MOE 模型)優化,以全國產方案對標 NVIDIA H20,主打高性價比推理應用。摩根大通數據顯示,百度崑崙晶片收入預計從 2025 年的約 13 億元飆升至 2026 年的 83 億元,年增超過 6 倍。

另一家代表平頭哥則發布新一代 AI 晶片真武 M890,性能較上一代提升 3 倍,能滿足更大規模的訓練與推理需求。官方數據指出,真武 AI 晶片累計出貨 56 萬片,服務超過 400 家客戶,其中在智慧駕駛領域已部署超過 13 萬卡,客戶涵蓋小鵬、理想、蔚來等頭部造車新勢力。國產 AI 晶片的崛起為算力自主提供了「定心丸」,但真正的關鍵卻在於超節點架構的出現。所謂超節點,是將數張、數十張甚至數百張 AI 晶片整合為一體,形成具備單一電腦特徵的超級計算系統,藉此大幅提升性能,縮小與國外高端晶片的差距,並顯著降低 Token 成本。

沐曦股份研發副總裁黃向軍指出,隨著模型規模邁向萬億參數,尤其是 MoE 架構中專家間的通訊,無論訓練或推理都要求極低延遲,超節點架構比普通伺服器更能滿足需求。需要注意的是,超節點並非簡單的晶片堆疊,其核心競爭力在於透過超大頻寬、超低延遲與軟硬協同,將字面算力轉化為可用算力。CHIP 實驗室主任羅國昭解釋,一個 2 萬億參數的 MoE 模型,每完成一步推理就需要不同 GPU 之間頻繁交換數據;若互聯頻寬不足,大量 GPU 只能停下來等待,實際效能大打折扣。這正是業界常說的「GPU 不是在計算,而是在等待」。

超節點雖被視為解決算力緊張的最優解,但作為新物種,技術路線仍存在分歧,首要問題就是規模多大才合適。一種觀點認為節點越大越好,因為大模型進入萬億參數時代,上下文長度突破千萬,併發推理持續增長,百卡、千卡甚至萬卡超節點是必然走向。昇騰正是這條路線的代表,其推出的 384 卡超節點已銷售超過 750 套,目前迭代至 1024 卡超節點,實現了業界最大的 256TB 跨物理節點記憶體統一編址空間,並計畫推出 8192 卡超節點,持續探索技術上限。另一種觀點則強調節點越經濟越好,在追求高效能的同時,也需兼顧成本與穩定性,避免算力浪費,尤其適合中小企業的實際需求。

浪潮信息是這條路線的代表,先推出 64 卡超節點,最新產品則降為 32 卡。浪潮信息副總裁趙帥表示,內部使用萬億大模型進行 AI Coding 時,效率明顯優於千億模型,因此再次推出 32 卡產品,讓更多企業真正用得起。超節點最初並未受到太多重視,但隨著交付能力提升與算力緊張日益明顯,它已一躍成為大模型的最佳搭檔。百度、阿里巴巴、浪潮信息、沐曦科技、摩爾線程等大大小小的業者相繼投入,為 AI 基礎設施生態注入全新動力。從算法優化到晶片自研,再到超節點架構的落地,國產算力正在多路徑並進,破局之時已然到來。

Related

相關文章

MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

30 分鐘前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

2 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

3 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

3 小時前