沐曦曦雲 C 系列 GPU 實現 Day 0 適配 MiniMax H3 多模態生成模型

重點摘要
沐曦股份宣布旗下曦雲 C 系列 GPU 完成對稀宇 MiniMax H3 多模態生成模型的 Day 0 適配,可快速部署並運用其多模態創作能力。此系列 GPU 採用自研架構,透過全棧自研 MXMACA 軟體棧,原生相容 PyTorch、TensorFlow 等 40 餘種主流 AI 框架,並支援超過 500 個 AI 模型穩定運行。
沐曦股份(MetaX)今日正式宣布,旗下曦雲 C 系列 GPU 已率先完成對稀宇科技(MiniMax)H3 多模態生成模型的 Day 0 適配,代表用戶在第一時間就能在沐曦的國產 GPU 平台上啟用這款最新的多模態模型。這項合作由沐曦全自研的 MXMACA 軟體棧提供技術支撐,讓用戶可以快速部署 MiniMax H3,並直接運用該模型所具備的多模態內容生成能力。 所謂 Day 0 適配,指的是在模型正式發布或開源的當下,GPU 平台就已同步完成相容性與效能調校,無需等待後續更新。對企業或開發者而言,這意味著時間成本大幅降低,從硬體到軟體再到模型應用的環節可以無縫銜接,也讓國產 GPU 在 AI 生態中的即戰力獲得進一步提升。沐曦選擇在 MiniMax H3 推出之際就完成適配,顯示雙方在產品規劃與技術合作上已有相當程度的默契。 沐曦曦雲 C 系列 GPU 是此次適配工作的硬體基礎,這一系列產品採用沐曦自主研發的核心 GPU IP,強調高能效比與高通用性的雙重特性。在面對當前大規模語言模型與多模態模型時,曦雲 C 系列特別針對超大規模參數的處理需求,以及長上下文推理的場景進行最佳化,讓模型在實際運行時能夠獲得更穩定的效能表現。這類需求正是 MiniMax H3 此種多模態模型在落地應用時最關鍵的瓶頸所在。 除了硬體架構的支撐,真正扮演核心角色的還有 MXMACA 軟體棧。沐曦在過去幾年的發展中,始終將軟體生態視為 GPU 產品能否從「可用」走向「好用、易用」的關鍵環節,而 MXMACA 正是承擔這項任務的主要平台。它一方面對接底層硬體,另一方面也承接上層的應用與框架,是連接算力與實際工作負載之間的重要橋梁。 從技術層面來看,MXMACA 軟體棧的覆蓋範圍相當完整,包括底層驅動程式、使用者態介面、MXCC 編譯器,以及針對各類 AI 運算的算子深度適配。同時,它也與目前主流的訓練與推論框架完成對接,原生相容國際主流生態系統。這意味著開發者不需要為了使用沐曦 GPU 而大幅改寫既有程式碼,而是可以沿用熟悉的開發工具與流程,大幅降低遷移門檻。 在生態相容性方面,MXMACA 目前已經可以適配 PyTorch、TensorFlow、vLLM 與 SGLang 等在內超過 40 種主流 AI 框架,並支援超過 500 個 AI 模型穩定運行。透過這套軟體棧,沐曦將傳統上需要耗費大量時間進行的模型移植與調校工作,壓縮到極短的週期之內,使得 Day 0 適配成為可能。此次 MiniMax H3 的快速上線,也正是這套軟體棧在實際案例中的具體展現。 回顧 MiniMax H3 這款模型本身的定位,它屬於通用型多模態生成模型,可以同時處理與生成多種形式的內容,並且支援多模態上下文的理解。根據目前公開的資訊,MiniMax H3 最高可支援 15 秒、2K 解析度的影片生成,並且在超解析度方案上有新的技術突破。這類高解析度、長時間的生成任務,對 GPU 的記憶體頻寬、算力調度以及推論效率都構成嚴峻考驗,也因此更需要底層硬體與軟體棧的高度協同。 從產業角度來看,沐曦與 MiniMax 的合作並非孤立事件。近期國內 GPU 廠商與大模型團隊之間的 Day 0 適配案例逐漸增多,包括摩爾線程在內的多家 GPU 業者,也相繼宣布完成對 MiniMax H3 的適配工作。這股趨勢反映出國產 AI 晶片與本土大模型之間的協作正變得更加緊密,也顯示軟體生態的成熟度已經逐步跟上硬體發展的腳步。 對於沐曦而言,此次適配不僅是一次技術上的驗證,更是生態布局的延伸。沐曦先前也發表了 AI 超級節點新品曦景 S600,支援單機櫃 64 卡高密度部署,並可靈活擴展至萬卡等級,這些高效能運算基礎設施搭配曦雲 C 系列 GPU,形成從單卡到叢集的完整產品線。在此之上,透過 MXMACA 軟體棧與 MiniMax 等模型廠商的深度對接,沐曦正在逐步建構一個從底層晶片到頂層應用的完整 AI 運算生態。 整體來看,曦雲 C 系列 GPU 完成 MiniMax H3 的 Day 0 適配,代表國產 GPU 在軟體生態與模型支援速度上已經邁入新的階段。對終端用戶而言,這意味著在模型發布當下就能以國產硬體進行部署與測試,不必受制於國際 GPU 的供應與相容性限制,也為企業在選擇 AI 基礎設施時提供了更多元、更具自主性的選項。未來隨著 MXMACA 軟體棧持續擴充支援範圍,沐曦在 AI 運算市場中的角色將更加關鍵,也為台灣與全球開發者在使用國產 GPU 運行先進模型時,創造更為順暢的體驗。
Related
相關文章

原生支持 4K 圖像生成,商湯科技開源多模態模型 SenseNova U1.5-Lite-Preview 預覽版本
首頁 > 智能時代>人工智能 原生支持 4K 圖像生成,商湯科技開源多模態模型 SenseNova U1.5-Lite-Preview 預覽版本 2026/8/3 15:34:55 來源:IT之家 作者:沁滄(實習) 責編:沁滄 評論: IT之家 8 月 3 日消息,商湯科技今日宣佈,面向社區開源輕量級統一多模態模型的預覽版本 SenseNova U1.5-Lite-Preview。▲ SenseNova U1.5-Lite-Preview 生成據介紹,得益於多項能力強化,U1.5-Lite-Preview 在多項主流生成 / 編輯質量評測基準上顯著超越 U1,並以僅 8B-MoT 的輕量級規模,實現了可比肩商用閉源模型的圖像生成能力與編輯效果。官方表示,相比 U1,U1.5-Lite-Preview 在以下方向上帶來了顯著提升:原生支持 4K 圖像生成;更精細的局部紋理、細節與真實世界質感;更準確的中英文文字生成與複雜版式組織;更穩定的圖像編輯和視覺指令遵循。IT之家附開源鏈接:GitHub:https://github.com/OpenSenseNova/SenseNova-U1/blob/main/docs/u1.5_preview.mdHugging Face:https://huggingface.co/sensenova/SenseNova-U1.5-8B-MoT-Preview魔搭社區:https://modelscope.cn/models/SenseNova/SenseNova-U1.5-8B-MoT-Preview廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之家所有文章均包含本聲明。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:商湯科技,開源,多

英特爾:為開源多模態視頻模型 MiniMax H3 提供 Day 0 支持,實現基於多卡 GPU 的部署方案
首頁 > 智能時代>人工智能 英特爾:為開源多模態視頻模型 MiniMax H3 提供 Day 0 支持,實現基於多卡 GPU 的部署方案 2026/8/3 15:25:14 來源:IT之家 作者:沁滄(實習) 責編:沁滄 評論: IT之家 8 月 3 日消息,英特爾今日宣佈,為新一代開源多模態視頻模型 MiniMax H3 提供 Day 0 首發支持。據介紹,英特爾銳炫 Pro B70 第一時間完成對 MiniMax H3 的適配,英特爾團隊實現了一種基於多卡 GPU 的部署方案。該方案採用 Encoder 8 卡張量並行(8TP)、DiT 8 卡 USP(Ulysses Sequence Parallel,並結合 Layer-wise Offloading),以及 VAE 部署於 B70 GPU 的整體架構,實現了視頻生成全流程的 GPU 加速。其中,Encoder 採用 8 卡張量並行完成文本編碼;作為推理過程中計算量最大的模塊,DiT 採用 8 卡 USP 並結合 Layer-wise Offloading 技術,使模型參數按層動態加載到 GPU,在突破單卡顯存限制、降低模型常駐顯存需求的同時,支持更大規模 DiT 模型的部署;VAE 則部署於 B70 GPU 上完成最終的視頻解碼。該方案兼顧了模型容量與計算效率,為大規模視頻生成模型提供了更具擴展性的部署方式。在此基礎上,團隊進一步結合張量並行(Tensor Parallel,TP)與 USP 的優勢,開發了 2TP×4USP 的混合並行方案。相較於純 8 卡 USP,該方案將 USP 並行度由 8 降至 4,並引入 2 路張量並行對計算進行協同加速,在保持模型擴展能力的同時,減少 USP 帶來的通信開銷,實現計算負載與通信開銷之間更優的平衡,從而進一步提升整體推理性能。IT之家獲悉,團隊還結合 llm-scale

當品牌開始爭奪AI的答案:翰智GEO入場
AI已取代搜尋引擎成為用戶獲取資訊的主要管道,品牌在AI問答中的形象變得更重要,GEO(生成式引擎優化)因而興起。央視「3·15」晚會揭露黑帽GEO亂象後,中國信通院發布行業標準,中央網信辦也啟動專項整治,合規與可信成為GEO入場門檻。企業級服務商翰智推出智慧版GEO業務,以可量化、可溯源、可驗收的工程化打法,搶進這條新賽道。

數億元!螞蟻AGI研究中心主任大模型創業,拿下新融資
杭州大模型公司西湖心辰宣布完成數億元人民幣B+輪融資,由廣發信德領投,螞蟻集團等老股東支持,資金將投入擴散語言模型研發、多模態實時互動產品迭代及海外市場拓展。該公司由現任螞蟻集團通用人工智能研究中心主任藍振忠創立,專注擴散範式大模型,並已在全球市場建立商業化閉環。

剛剛,阿里Qwen3.8-Max來了!衝進全球第一梯隊,模型表現直逼Claude
阿里巴巴突襲發表新一代基座大模型Qwen3.8-Max,總參數量達2.4兆,在編程、專業工作、長程任務與多模態分析等場景表現亮眼,於Arena榜單衝進全球第一梯隊,直逼Anthropic的Claude系列,部分程式能力甚至超過Claude Opus 5。官方並以低於國際大模型的價格策略(輸入每百萬Tokens人民幣12元等)吸引用戶,多位搶先體驗的網友也稱讚其性價比高、能自主完成從需求到交付的完整專案。

Day-0 支持,摩爾線程完成 MiniMax H3 多模態生成模型適配
首頁 > 智能時代>人工智能 Day-0 支持,摩爾線程完成 MiniMax H3 多模態生成模型適配 2026/8/3 13:19:15 來源:IT之家 作者:浩渺 責編:浩渺 評論: 感謝IT之家網友 華南吳彥祖 的線索投遞! IT之家 8 月 3 日消息,今日,MiniMax 正式開源多模態生成模型 MiniMax H3。