天數智芯發佈新一代通用 GPU 旗艦產品天垓 300,具備規模化應用條件

重點摘要
天數智芯在2026世界人工智能大會上發表新一代通用GPU旗艦產品天垓300,基於SIMT架構並針對Attention、MoE等技術進行優化,效能優於Hopper方案。該產品已具備規模化應用條件,並與國內雲廠商、伺服器廠商等完成深度適配,可支援單機到集群部署。
2026 年世界人工智能大會(WAIC)正如火如荼進行中,國內 GPU 大廠天數智芯選在此時正式對外發表新一代通用 GPU 旗艦產品「天垓 300」。這款晶片不僅延續了天數智芯在通用計算領域的技術路線,更在多項關鍵指標上展現出與國際主流架構競爭的實力,官方更直接宣稱該產品目前已具備規模化部署與應用的條件。天垓 300 採用的是 SIMT(單指令多執行緒)通用計算架構,這項設計讓它能夠同時支援標量、向量與張量等多種不同類型的計算負載。無論是傳統的科學運算、深度學習訓練,還是需要大量矩陣運算的推論場景,這款 GPU 都能透過統一的架構來應對,降低開發者針對不同硬體進行程式碼移植的門檻。
在 AI 大模型快速演進的時代,天垓 300 特別針對幾個核心技術環節進行了深度優化。首先是 Attention 機制,這是當前 Transformer 架構模型的運算重心。根據天數智芯提供的數據,天垓 300 的 Attention 效率已超過 90%,尤其在處理 64k 長度上下文時,其效能表現比 NVIDIA 的 Hopper 架構方案還要高出 10%。這意味著在處理長文本、長序列的訓練與推論任務時,天垓 300 能夠更有效地利用計算資源,縮短處理時間。另一個關鍵優化落在 MoE(混合專家模型)架構上。MoE 模型因能動態啟用不同的專家網路,成為近年來超大規模模型的主流選擇。
天數智芯指出,天垓 300 在 MoE 場景下的平均效能同樣比 Hopper 架構方案高出 10%,這代表在相同算力投入下,用戶可以完成更多推論任務,從而降低整體營運成本。除了計算效率,模型的響應速度也是實際應用中的重要指標。天垓 300 在首字延遲(即使用者輸入後第一個 token 生成的時間)上,相較於 Hopper 架構方案降低了約 20%。同時,由於大模型推論往往需要跨多張 GPU 進行頻繁的通訊,天數智芯也針對這個瓶頸進行了調校,使平均通信延遲降低約 13%。
官方特別強調,這些改善主要來自於針對 Decode 階段高頻率、多卡、小數據量通訊特性的優化,包括降低協議開銷、重新設計鏈路路徑以及數據流轉機制,最終讓 Decode 階段的整體效能較 Hopper 方案提升了 10%。值得注意的是,天數智芯並非只停留在晶片層面的技術突破,而是同步推動了生態環境的建設。天垓 300 目前已經與國內多家主流雲端服務商、伺服器硬體廠商、互聯生態系統以及超節點系統完成了深度適配。這意味著從單機運算節點到大規模訓練集群,天垓 300 都能夠順利部署,用戶不需要為了相容性問題而耗費大量時間進行底層調整。
隨著中國 AI 產業持續追求自主可控的算力基礎設施,天數智芯這款旗艦 GPU 的問世,無疑為市場提供了另一個具備國際競爭力的選項。從 Attention 效率、MoE 效能到延遲控制,天垓 300 在許多關鍵技術指標上都拿出了與國際大廠相抗衡的成績單。而官方強調的「已具備規模化應用條件」,更代表這款晶片已經從實驗室走向實際商業部署,下一步能否在真實的雲端與企業場景中獲得廣泛採用,將是業界持續關注的焦點。
Related
相關文章

Meta 旗下 AI 模型測試時意外入侵第三方企業系統
Meta 在進行AI模型安全測試時,因第三方公司Irregular配置錯誤,導致模型意外入侵另一企業系統。涉事模型為Muse Spark 1.1,事件引發對AI模型可能衝出邊界、發動網絡攻擊的擔憂。

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?
字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

千人聯機世界模型“RhOS-World: Khora”正式發佈
RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。
TutorMoments:AI 家教何時該出手,何時該放手?
今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

告別反覆操作 OSD,華碩顯示器管理軟件 DisplayWidget Center 接入 AI 智能體
華碩顯示器管理軟體 DisplayWidget Center 推出重大更新,加入 AI 智能體功能,用戶可透過自然語言調整亮度、色溫等參數,無需操作 OSD。該功能支援 CLI 與 Agent Skill,可根據使用習慣自動切換模式,並適用於企業環境的統一部署。

千問App部分功能探索收費,想學豆包能跑通嗎?
千問App於8月7日更新,新增辦公助理等付費功能,基礎功能仍免費,但辦公場景使用額度需付費取得。此舉仿效豆包專業版等產品的訂閱模式,反映AI行業正集體轉向辦公場景收費,以尋求變現機會。