國產 GPU 也能跑萬億大模型:海光 DCU 適配 Kimi K3,896 專家並行不卡頓

2026年7月28日 08:307400 次瀏覽

重點摘要

AI資訊AI新閒資訊正文國產 GPU 也能跑萬億大模型:海光 DCU 適配 Kimi K3,896 專家並行不卡頓發布於AI新閒資訊時間 :Jul 28, 2026閱讀 :1分鐘國產算力第一次把萬億參數級的模型穩穩托住了。海光信息宣佈,已完成 Kimi K3在其 DCU 平臺上的全棧適配與性能驗證——這意味著,跑動這類龐然大物的,不再只是少數幾款海外旗艦芯片。

站內 AI 整理稿

國產算力陣營迎來重要突破,海光信息正式宣布,旗下DCU(深度計算處理器)已完成對Kimi K3大模型的全棧適配與性能驗證,代表著萬億參數級別的模型終於能在國產GPU平台上穩定運行,不再只是少數幾款海外旗艦芯片的專利。 海光DCU此次從底層算子開始一路優化到推理引擎,實現了模型代碼無需任何更動即可直接部署的成果。對於開發者而言,這意味著遷移成本幾乎歸零,拿到算力後就能迅速上線,展現出相當從容的兼容性。 針對Kimi K3所採用的KDA注意力機制以及由896個專家組成的MoE(混合專家)架構,海光團隊進行了算子層級的深度定製與打磨。即便是在896個專家同時並行的極端情況下,面對百萬級上下文的沉重負載,推理過程依然能夠保持高效穩定,不會出現卡頓現象。 回歸到實際應用場景,Kimi K3在海光DCU的支撐下,足以承載長程智能體工程、視覺閉環創作乃至自主芯片設計等前沿領域的探索。這也意味著,國產算力的用戶終於能夠親手運行萬億級別的開源模型,不再受制於海外硬體。 值得一提的是,月之暗面在正式發布Kimi K3之前,就已經聯合海光信息與中科曙光完成了完整的兼容性調優工作。曙光團隊基於海光DCU的硬體棧,成功打通了Kimi MoE架構的分散式訓練與多卡並行推理鏈路;而海光DCU則依靠底層硬體與軟體棧的協同優化,在曙光的8000集群上讓長文本推理任務保持穩定運行。 官方實測數據為國產算力的表現給出了一顆定心丸。結果顯示,國產卡相較於海外頂級產品的性能折损被控制在12%以內,已經達到了商用部署的基本門檻。這項數據無疑為國內廠商在算力選擇上提供了更強的信心。 這項合作的達成,不僅是單一晶片與模型的適配成功,更標誌著國產AI基礎設施生態的逐步成熟。從底層晶片設計到分散式訓練框架,再到推理引擎的最佳化,一條完整的國產技術鏈路正在形成閉環。 Kimi K3本身即為目前全球開源陣營中規模最大的模型之一,採用MoE架構,總參數達到2.8萬億。海光DCU成功支撐此類超大模型,證明了國產算力在面對最先進的人工智慧架構時,已經具備了實際的承載能力。 業界普遍認為,萬億模型與國產GPU之間長期存在的一道高牆,如今被推開了一道縫隙。這不只是一個技術節點的突破,更可能悄悄改寫智能時代的算力版圖,讓更多本土企業與開發者得以在自主可控的平台上,投身於下一代AI應用的創新浪潮。 在Kimi K3權重正式對外開源後,海外市場的反應也側面印證了這款模型的競爭力。儘管美國國內存在部分政治勢力試圖遊說封殺中國開源模型,但Kimi K3憑藉頂級性能與極致性價比,仍在開源首夜吸引至少18家美國企業火速完成部署並對外提供商業服務,顯示商業理性往往能壓過政治表態。 與此同時,月之暗面團隊的動向也備受關注。在Kimi K3發布後,北京的一場慶功活動上,現場螢幕揭示的產品規劃顯示,K3定位為擴容升級版本,而下一代產品K4則將進一步打磨至極高水準,團隊更喊出「衝上月球」的標語,展現出強烈的進取心。從萬億模型成功落地國產硬體,到下一代技術的蓄勢待發,國產AI生態的未來發展值得持續觀察。

Related

相關文章

湯臣倍健,悄悄投了AI半壁江山

# 湯臣倍健,悄悄投了AI半壁江山 一家保健品公司,成了梁文鋒和楊植麟的共同點。 2026年最魔幻的商業敘事之一,是保健品龍頭湯臣倍健成了中國AI大模型賽道最活躍的跨界玩家。從DeepSeek到月之暗面,從階躍星辰到兩家硬科技芯片公司,這家賣蛋白粉的企業在短短數月內合計投入約4.5億元,精準押中了多家頭部AI公司。 ## 一場意外的估值曝光 DeepSeek成立以來從未公開披露具體融資估值,市場傳聞從2000億到5000億滿天飛。結果捅破這層窗戶紙的,是兩家A股公司——賣箱包的開潤股份,以及賣保健品的湯臣倍健。

剛剛

硅谷開始在大模型上“消費降級”了

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務尋求報道36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦浙江最新創投汽車科技專精特新直播視頻專題活動搜索尋求報道我要入駐城市合作硅谷開始在大模型上“消費降級”了硅基星芒·2026年07月28日 17:35從炫耀性消費到算計性生存 2026年7月24日,《華爾街日報》一篇報道的標題平淡無奇,內容卻是一道分水嶺:美國企業界正在集體停止在大模型調用上燒錢。 過去兩年,企業以“Token最大化”為榮。內部排行榜上,誰的API調用費用最高,誰就是數字化轉型的急先鋒。如今這套敘事被徹底翻轉,省錢成了新信仰,節儉成了新美德。 Cursor這家即將被馬斯克以600億美元收購的公司,為這場運動發明瞭一個精準的詞:tokenomics,Token經濟學。它的前投資銀行家、現任現場首席技術官Mike Saeks用一個比喻道破了這場轉向的核心:“用最強大的模型處理日常任務,就像開著蘭博基尼去雜貨店買牛奶,那車是為了賽道而生的。” 種種跡象證明,這不是一句俏皮話,它是對過去兩年AI泡沫敘事的清算的開始。 從炫耀性消費到算計性生存 這場轉向的速度之快,連最敏銳的觀察者都措手不及。 幾個月前,企業還在攀比誰的AI賬單更嚇人。Token最大化是一個充滿硅谷氣質的詞:把浪費包裝成進取,把燒錢曲解為信仰。那時的邏輯是,用得越多意味著AI化越徹底,花得越狠意味著技術領先越明顯。

剛剛
IT之家生成式AI

英偉達 CEO 黃仁勳:AI 消滅的是任務,而非工作

首頁 > 智能時代>人工智能 英偉達 CEO 黃仁勳:AI 消滅的是任務,而非工作 2026/7/28 17:45:52 來源:IT之家 作者:遠洋 責編:遠洋 評論: IT之家 7 月 28 日消息,英偉達 CEO 黃仁勳並不認同所謂“白領大屠殺”的說法。在 Y Combinator 創業學校(Startup School)的演講中,黃仁勳回應了外界對 AI 的種種悲觀預測。

剛剛
IT之家生成式AI

消息稱亞馬遜大規模調整 AI 戰略,集中資源攻堅前沿大模型

**亚马逊调整AI战略:聚焦前沿模型研发,逐步停更多款Nova系列模型** 据IT之家援引Business Insider报道,知情人士透露,亚马逊正在对其人工智能战略进行大规模调整。此次调整包括逐步停止多款自研AI模型的开发、重组相关团队,并将工程资源与算力集中投入到代号为FMR(Frontier Model Research)的前沿模型项目中。这标志着亚马逊在AI领域的布局进入重心转移的新阶段。 该调整紧跟上月亚马逊对通用人工智能(AGI)部门的裁员,以及关闭成立于2024年的AGI Lab研究团队。

剛剛

GPT“失控”被索賠1億美元,微軟反手扔王炸:新模型踩翻Mythos、價格砍半,還拉上“苦主”組了聯盟

### 微軟趁機“組局”:聯手Hugging Face等37家企業成立安全聯盟,OpenAI與Anthropic被排除在外 就在OpenAI因模型“失控”入侵事件被索賠1億美元、輿論譁然的第二天,微軟沒有選擇沉默,而是迅速“落井下石”,丟出了一連串重磅炸彈。這家科技巨頭不僅發佈了號稱性能碾壓所有競品、成本僅一半的網絡安全專用模型,更直接拉上了此次事件的“苦主”Hugging Face,聯合英偉達等37家企業成立了一個全新的“開放安全AI聯盟”(Open Secure AI Alliance)。

剛剛

Kimi K3 一開源,Anthropic 終於不裝了

好的,這是一篇根據您提供的資料,以「36氪」風格撰寫的完整新聞稿。 --- ### Kimi K3 一開源,Anthropic 終於不裝了 科技的浪潮或許還是要從開源中湧現。一箇中國開源模型,再次引發整個硅谷科技巨頭「地震」。這個熟悉的劇情,上次的主角是 DeepSeek R1,這次則是剛剛開源的 Kimi K3。它的出現,甚至讓英偉達和 Anthropic 公開站到了對立面上,一場關於「開放」與「安全」的論戰正在白熱化。

剛剛