國產算力破局,超節點才是勝負手

2026年8月3日 20:36
國產算力破局,超節點才是勝負手

重點摘要

國產大模型因算力需求激增,導致算力緊張問題再度浮現,單靠算法優化無法完全解決,智能算力規模已爆發式增長。國產AI晶片崛起,超節點成為提升算力效率與降低成本的最佳方案,業界正探索大小節點的不同技術路線。

站內 AI 整理稿

國產大模型近期接連推出新版本,GLM 5.2、Kimi K3.0 相繼上線,再加上 DeepSeek 投資人會議紀要外洩,讓算力供給緊張的現實再度浮上檯面。業界普遍認為,國產大模型想要再往上突破,算力這道門檻非跨不可。曾幾何時,「堆算力」被視為「力大飛磚」的捷徑,但在國內受限於種種因素,算力不足一直是發展瓶頸。直到 DeepSeek 透過算法優化降低了對算力的依賴,市場才開始轉向精打細算的路線。MoE 架構的參數靈活調度、注意力機制的改良、以及借助開源模型打造垂直應用,都讓「花小錢辦大事」成為可能,算力溢價的討論也逐漸淡化。 然而,國產大模型迅速躋身國際第一梯隊後,需求端卻出現意料之外的變化。以 Kimi K3 為例,其模型參數高達 2.8T,但單次推理只激活 104B 參數,原本效率極高;然而出圈後 Token 消耗激增,總吞吐量跟著水漲船高,最終拉高了整體算力需求。正如「伯虎財經」所分析,Kimi K3 主打長程編程與 Agent 任務,一次任務可能包含數十次推理,用戶看到的只是一個請求,後台卻跑了幾十輪計算。這個現象恰好呼應了經濟學中的傑文斯悖論:當技術進步提高資源使用效率,反而可能導致資源總消耗量增加,而非減少。大模型推理成本下降,能力卻持續增強,吸引更多用戶與更複雜場景,算力擴容成為必然之路。 事實上,算力基礎建設從未鬆懈。根據公開資料,2025 年國內智能算力規模為 1590 ExaFLOPS,到了 2026 年上半年已成長至 2185 EFLOPS,年增率高達 177%,呈現爆發式增長。而這波擴張背後,國產 AI 晶片正逐步站上舞台中央。崑崙芯推出第四代 AI 晶片 M100,專為大規模推理場景(尤其是 MOE 模型)優化,以全國產方案對標 NVIDIA H20,主打高性價比推理應用。摩根大通數據顯示,百度崑崙晶片收入預計從 2025 年的約 13 億元飆升至 2026 年的 83 億元,年增超過 6 倍。另一家代表平頭哥則發布新一代 AI 晶片真武 M890,性能較上一代提升 3 倍,能滿足更大規模的訓練與推理需求。官方數據指出,真武 AI 晶片累計出貨 56 萬片,服務超過 400 家客戶,其中在智慧駕駛領域已部署超過 13 萬卡,客戶涵蓋小鵬、理想、蔚來等頭部造車新勢力。 國產 AI 晶片的崛起為算力自主提供了「定心丸」,但真正的關鍵卻在於超節點架構的出現。所謂超節點,是將數張、數十張甚至數百張 AI 晶片整合為一體,形成具備單一電腦特徵的超級計算系統,藉此大幅提升性能,縮小與國外高端晶片的差距,並顯著降低 Token 成本。沐曦股份研發副總裁黃向軍指出,隨著模型規模邁向萬億參數,尤其是 MoE 架構中專家間的通訊,無論訓練或推理都要求極低延遲,超節點架構比普通伺服器更能滿足需求。需要注意的是,超節點並非簡單的晶片堆疊,其核心競爭力在於透過超大頻寬、超低延遲與軟硬協同,將字面算力轉化為可用算力。CHIP 實驗室主任羅國昭解釋,一個 2 萬億參數的 MoE 模型,每完成一步推理就需要不同 GPU 之間頻繁交換數據;若互聯頻寬不足,大量 GPU 只能停下來等待,實際效能大打折扣。這正是業界常說的「GPU 不是在計算,而是在等待」。 超節點雖被視為解決算力緊張的最優解,但作為新物種,技術路線仍存在分歧,首要問題就是規模多大才合適。一種觀點認為節點越大越好,因為大模型進入萬億參數時代,上下文長度突破千萬,併發推理持續增長,百卡、千卡甚至萬卡超節點是必然走向。昇騰正是這條路線的代表,其推出的 384 卡超節點已銷售超過 750 套,目前迭代至 1024 卡超節點,實現了業界最大的 256TB 跨物理節點記憶體統一編址空間,並計畫推出 8192 卡超節點,持續探索技術上限。另一種觀點則強調節點越經濟越好,在追求高效能的同時,也需兼顧成本與穩定性,避免算力浪費,尤其適合中小企業的實際需求。浪潮信息是這條路線的代表,先推出 64 卡超節點,最新產品則降為 32 卡。浪潮信息副總裁趙帥表示,內部使用萬億大模型進行 AI Coding 時,效率明顯優於千億模型,因此再次推出 32 卡產品,讓更多企業真正用得起。 超節點最初並未受到太多重視,但隨著交付能力提升與算力緊張日益明顯,它已一躍成為大模型的最佳搭檔。百度、阿里巴巴、浪潮信息、沐曦科技、摩爾線程等大大小小的業者相繼投入,為 AI 基礎設施生態注入全新動力。從算法優化到晶片自研,再到超節點架構的落地,國產算力正在多路徑並進,破局之時已然到來。

Related

相關文章

豆包輸入法撕開語音口子,扒開科大訊飛外衣

# 豆包輸入法撕開語音口子,科大訊飛的護城河為何失效? 大模型戰火正在燒向一個用戶習以為常、卻高頻剛需的角落——輸入法。這個被視為“最後一公里”的關鍵入口,迎來了新一轮殘酷洗牌。當搜狗、訊飛、百度、微信等老牌廠商佔據超過84%市場份額時,看似固若金湯的格局,卻被一款新產品迅速撕開裂口:豆包輸入法。 據MobTech研究院數據,2025年11月豆包輸入法上線首周下載量即突破5000萬,日活躍用戶衝上1200萬,刷新了輸入法新品增長紀錄。

剛剛

Claude 焚書又“越獄”邊界在哪?

# Claude 焚书又“越獄”,Anthropic的邊界何在? **——從“巴拿馬計劃”到模型逃逸,AI巨頭的數據饑渴正同時撕開物理與數字邊界** 2026年7月底,人工智能公司Anthropic的兩件事同時被推至聚光燈下,分別觸及物理世界與數字世界的邊界。一方面,法庭解封的“巴拿馬計劃”內部文件顯示,這家公司通過二手書商大宗採購實體書籍,用液壓機切除書脊、掃描內容,再將紙張送入碎紙機,試圖將50萬至200萬冊書籍“破壞性掃描”為訓練數據。

剛剛

靠做“中間商”生意估值20億美元,Liblib跑出了奇蹟還是泡沫?

在AI領域普遍追求「得大模型者得天下」的浪潮中,一家不走尋常路的應用層公司卻交出了截然不同的成績單。演語科技(Evoken)於6月18日宣布完成近3億美元的B+輪融資,投後估值一舉突破20億美元,成為中國AI應用層至今為止規模最大的單輪融資之一。多數人或許對演語科技這個集團品牌感到陌生,但其旗下產品LiblibAI以及Liblib這個名稱,在業界早已廣為人知。此次融資也是演語科技首次以集團身分對外發聲。 在大量AI初創公司仍依賴投資人耐心爭取時間窗口的當下,這家沒有自研大模型的企業卻成了最會賺錢的AI應用之一。

剛剛

大模型公司估值,正在降權「SOTA敘事」

7月之后,资本市场对大模型公司的估值逻辑正在发生显著变化:单一大模型在榜单上的领先排名,已经不足以支撑长期估值溢价。8月3日,阿里巴巴发布Qwen 3.8-Max版正式版,港股当日上涨6.75%;而在此前半个月,Kimi K3的发布却让智谱和MiniMax股价坐上过山车。同样是竞争对手发布新模型,市场给出的反应截然不同,这背后折射出投资者对“SOTA叙事”的降权。 7月17日,Kimi K3发布,其在Artificial Analysis(AA)的编程评分一度位列第一。这一排名直接冲击了智谱依靠GLM-5.

剛剛

無人再議AI六小龍

# 無人再議AI六小龍:三年分化背後,大模型行業正從技術敘事走向商業現實 「AI六小龍」這個稱謂,正在成為一個頗具時代氣息的歷史標籤。三年前,智譜、MiniMax、月之暗面、階躍星辰、百川智能和零一萬物被市場共同裝進同一個籃子裡比較——誰的模型參數更大,誰的融資速度更快,誰更有希望成為「中國的OpenAI」。彼時,技術敘事是AI創業的第一針強心劑,資本的熱情幾乎全部押注在AGI的遠期想象力之上。 三年過去,潮水退去,賽道並未如預期般跑出唯一的贏家,反而走出了六條截然不同的路徑。

剛剛