沐曦曦雲 C 系列 GPU 實現 Day 0 適配 MiniMax H3 多模態生成模型

重點摘要
沐曦股份宣布旗下曦雲 C 系列 GPU 完成對稀宇 MiniMax H3 多模態生成模型的 Day 0 適配,可快速部署並運用其多模態創作能力。此系列 GPU 採用自研架構,透過全棧自研 MXMACA 軟體棧,原生相容 PyTorch、TensorFlow 等 40 餘種主流 AI 框架,並支援超過 500 個 AI 模型穩定運行。
沐曦股份(MetaX)今日正式宣布,旗下曦雲 C 系列 GPU 已率先完成對稀宇科技(MiniMax)H3 多模態生成模型的 Day 0 適配,代表用戶在第一時間就能在沐曦的國產 GPU 平台上啟用這款最新的多模態模型。這項合作由沐曦全自研的 MXMACA 軟體棧提供技術支撐,讓用戶可以快速部署 MiniMax H3,並直接運用該模型所具備的多模態內容生成能力。所謂 Day 0 適配,指的是在模型正式發布或開源的當下,GPU 平台就已同步完成相容性與效能調校,無需等待後續更新。
對企業或開發者而言,這意味著時間成本大幅降低,從硬體到軟體再到模型應用的環節可以無縫銜接,也讓國產 GPU 在 AI 生態中的即戰力獲得進一步提升。沐曦選擇在 MiniMax H3 推出之際就完成適配,顯示雙方在產品規劃與技術合作上已有相當程度的默契。沐曦曦雲 C 系列 GPU 是此次適配工作的硬體基礎,這一系列產品採用沐曦自主研發的核心 GPU IP,強調高能效比與高通用性的雙重特性。在面對當前大規模語言模型與多模態模型時,曦雲 C 系列特別針對超大規模參數的處理需求,以及長上下文推理的場景進行最佳化,讓模型在實際運行時能夠獲得更穩定的效能表現。
這類需求正是 MiniMax H3 此種多模態模型在落地應用時最關鍵的瓶頸所在。除了硬體架構的支撐,真正扮演核心角色的還有 MXMACA 軟體棧。沐曦在過去幾年的發展中,始終將軟體生態視為 GPU 產品能否從「可用」走向「好用、易用」的關鍵環節,而 MXMACA 正是承擔這項任務的主要平台。它一方面對接底層硬體,另一方面也承接上層的應用與框架,是連接算力與實際工作負載之間的重要橋梁。從技術層面來看,MXMACA 軟體棧的覆蓋範圍相當完整,包括底層驅動程式、使用者態介面、MXCC 編譯器,以及針對各類 AI 運算的算子深度適配。
同時,它也與目前主流的訓練與推論框架完成對接,原生相容國際主流生態系統。這意味著開發者不需要為了使用沐曦 GPU 而大幅改寫既有程式碼,而是可以沿用熟悉的開發工具與流程,大幅降低遷移門檻。在生態相容性方面,MXMACA 目前已經可以適配 PyTorch、TensorFlow、vLLM 與 SGLang 等在內超過 40 種主流 AI 框架,並支援超過 500 個 AI 模型穩定運行。透過這套軟體棧,沐曦將傳統上需要耗費大量時間進行的模型移植與調校工作,壓縮到極短的週期之內,使得 Day 0 適配成為可能。此次 MiniMax H3 的快速上線,也正是這套軟體棧在實際案例中的具體展現。
回顧 MiniMax H3 這款模型本身的定位,它屬於通用型多模態生成模型,可以同時處理與生成多種形式的內容,並且支援多模態上下文的理解。根據目前公開的資訊,MiniMax H3 最高可支援 15 秒、2K 解析度的影片生成,並且在超解析度方案上有新的技術突破。這類高解析度、長時間的生成任務,對 GPU 的記憶體頻寬、算力調度以及推論效率都構成嚴峻考驗,也因此更需要底層硬體與軟體棧的高度協同。從產業角度來看,沐曦與 MiniMax 的合作並非孤立事件。
近期國內 GPU 廠商與大模型團隊之間的 Day 0 適配案例逐漸增多,包括摩爾線程在內的多家 GPU 業者,也相繼宣布完成對 MiniMax H3 的適配工作。這股趨勢反映出國產 AI 晶片與本土大模型之間的協作正變得更加緊密,也顯示軟體生態的成熟度已經逐步跟上硬體發展的腳步。對於沐曦而言,此次適配不僅是一次技術上的驗證,更是生態布局的延伸。沐曦先前也發表了 AI 超級節點新品曦景 S600,支援單機櫃 64 卡高密度部署,並可靈活擴展至萬卡等級,這些高效能運算基礎設施搭配曦雲 C 系列 GPU,形成從單卡到叢集的完整產品線。
在此之上,透過 MXMACA 軟體棧與 MiniMax 等模型廠商的深度對接,沐曦正在逐步建構一個從底層晶片到頂層應用的完整 AI 運算生態。整體來看,曦雲 C 系列 GPU 完成 MiniMax H3 的 Day 0 適配,代表國產 GPU 在軟體生態與模型支援速度上已經邁入新的階段。對終端用戶而言,這意味著在模型發布當下就能以國產硬體進行部署與測試,不必受制於國際 GPU 的供應與相容性限制,也為企業在選擇 AI 基礎設施時提供了更多元、更具自主性的選項。
未來隨著 MXMACA 軟體棧持續擴充支援範圍,沐曦在 AI 運算市場中的角色將更加關鍵,也為台灣與全球開發者在使用國產 GPU 運行先進模型時,創造更為順暢的體驗。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。