IT之家生成式AI

沐曦曦雲 C 系列 GPU 實現 Day 0 適配 MiniMax H3 多模態生成模型

2026年8月3日 14:35
沐曦曦雲 C 系列 GPU 實現 Day 0 適配 MiniMax H3 多模態生成模型

重點摘要

沐曦股份宣布旗下曦雲 C 系列 GPU 完成對稀宇 MiniMax H3 多模態生成模型的 Day 0 適配,可快速部署並運用其多模態創作能力。此系列 GPU 採用自研架構,透過全棧自研 MXMACA 軟體棧,原生相容 PyTorch、TensorFlow 等 40 餘種主流 AI 框架,並支援超過 500 個 AI 模型穩定運行。

站內 AI 整理稿

沐曦股份(MetaX)今日正式宣布,旗下曦雲 C 系列 GPU 已率先完成對稀宇科技(MiniMax)H3 多模態生成模型的 Day 0 適配,代表用戶在第一時間就能在沐曦的國產 GPU 平台上啟用這款最新的多模態模型。這項合作由沐曦全自研的 MXMACA 軟體棧提供技術支撐,讓用戶可以快速部署 MiniMax H3,並直接運用該模型所具備的多模態內容生成能力。所謂 Day 0 適配,指的是在模型正式發布或開源的當下,GPU 平台就已同步完成相容性與效能調校,無需等待後續更新。

對企業或開發者而言,這意味著時間成本大幅降低,從硬體到軟體再到模型應用的環節可以無縫銜接,也讓國產 GPU 在 AI 生態中的即戰力獲得進一步提升。沐曦選擇在 MiniMax H3 推出之際就完成適配,顯示雙方在產品規劃與技術合作上已有相當程度的默契。沐曦曦雲 C 系列 GPU 是此次適配工作的硬體基礎,這一系列產品採用沐曦自主研發的核心 GPU IP,強調高能效比與高通用性的雙重特性。在面對當前大規模語言模型與多模態模型時,曦雲 C 系列特別針對超大規模參數的處理需求,以及長上下文推理的場景進行最佳化,讓模型在實際運行時能夠獲得更穩定的效能表現。

這類需求正是 MiniMax H3 此種多模態模型在落地應用時最關鍵的瓶頸所在。除了硬體架構的支撐,真正扮演核心角色的還有 MXMACA 軟體棧。沐曦在過去幾年的發展中,始終將軟體生態視為 GPU 產品能否從「可用」走向「好用、易用」的關鍵環節,而 MXMACA 正是承擔這項任務的主要平台。它一方面對接底層硬體,另一方面也承接上層的應用與框架,是連接算力與實際工作負載之間的重要橋梁。從技術層面來看,MXMACA 軟體棧的覆蓋範圍相當完整,包括底層驅動程式、使用者態介面、MXCC 編譯器,以及針對各類 AI 運算的算子深度適配。

同時,它也與目前主流的訓練與推論框架完成對接,原生相容國際主流生態系統。這意味著開發者不需要為了使用沐曦 GPU 而大幅改寫既有程式碼,而是可以沿用熟悉的開發工具與流程,大幅降低遷移門檻。在生態相容性方面,MXMACA 目前已經可以適配 PyTorch、TensorFlow、vLLM 與 SGLang 等在內超過 40 種主流 AI 框架,並支援超過 500 個 AI 模型穩定運行。透過這套軟體棧,沐曦將傳統上需要耗費大量時間進行的模型移植與調校工作,壓縮到極短的週期之內,使得 Day 0 適配成為可能。此次 MiniMax H3 的快速上線,也正是這套軟體棧在實際案例中的具體展現。

回顧 MiniMax H3 這款模型本身的定位,它屬於通用型多模態生成模型,可以同時處理與生成多種形式的內容,並且支援多模態上下文的理解。根據目前公開的資訊,MiniMax H3 最高可支援 15 秒、2K 解析度的影片生成,並且在超解析度方案上有新的技術突破。這類高解析度、長時間的生成任務,對 GPU 的記憶體頻寬、算力調度以及推論效率都構成嚴峻考驗,也因此更需要底層硬體與軟體棧的高度協同。從產業角度來看,沐曦與 MiniMax 的合作並非孤立事件。

近期國內 GPU 廠商與大模型團隊之間的 Day 0 適配案例逐漸增多,包括摩爾線程在內的多家 GPU 業者,也相繼宣布完成對 MiniMax H3 的適配工作。這股趨勢反映出國產 AI 晶片與本土大模型之間的協作正變得更加緊密,也顯示軟體生態的成熟度已經逐步跟上硬體發展的腳步。對於沐曦而言,此次適配不僅是一次技術上的驗證,更是生態布局的延伸。沐曦先前也發表了 AI 超級節點新品曦景 S600,支援單機櫃 64 卡高密度部署,並可靈活擴展至萬卡等級,這些高效能運算基礎設施搭配曦雲 C 系列 GPU,形成從單卡到叢集的完整產品線。

在此之上,透過 MXMACA 軟體棧與 MiniMax 等模型廠商的深度對接,沐曦正在逐步建構一個從底層晶片到頂層應用的完整 AI 運算生態。整體來看,曦雲 C 系列 GPU 完成 MiniMax H3 的 Day 0 適配,代表國產 GPU 在軟體生態與模型支援速度上已經邁入新的階段。對終端用戶而言,這意味著在模型發布當下就能以國產硬體進行部署與測試,不必受制於國際 GPU 的供應與相容性限制,也為企業在選擇 AI 基礎設施時提供了更多元、更具自主性的選項。

未來隨著 MXMACA 軟體棧持續擴充支援範圍,沐曦在 AI 運算市場中的角色將更加關鍵,也為台灣與全球開發者在使用國產 GPU 運行先進模型時,創造更為順暢的體驗。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

42 分鐘前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

4 小時前