雷峰網生成式AI

AI算力進入“多元協同”時代,中昊芯英攜手OpenCSG加速企業級大模型落地

2026年7月22日 01:59

重點摘要

近日,中昊芯英TPU算力正式完成與 OpenCSGCSGHub 平臺的適配接入。雙方充分發揮國產AI專用算力與開源AI基礎設施的協同優勢,為大模型開發、模型服務部署及企業級AI應用落地提供更加開放、靈活的底層算力支撐。當前,大模型與智能體應用正加速邁向產業落地階段。

站內 AI 整理稿

**新聞稿**

**AI算力進入“多元協同”時代 中昊芯英攜手OpenCSG加速企業級大模型落地**

隨著大模型技術從研發走向產業化落地,企業對底層算力的需求正經歷結構性轉變。近日,國產AI專用算力提供商中昊芯英宣佈,旗下自主架構TPU算力已完成與開放AI基礎設施平臺OpenCSG旗下CSGHub的適配接入。雙方將整合專用芯片算力與開源基礎設施的雙重優勢,為企業大模型開發、部署與智能體應用提供更低成本、更高效率的底層支撐。 業界分析指出,當前大模型與智能體應用正加速進入實際業務場景,企業的關注點已從單一的模型訓練效果,轉向模型在生產環境中的管理、部署、運行與持續迭代能力。這一轉變對算力基礎設施的靈活性與開放性提出了更高要求。與此同時,AI算力格局正從過往GPU一家獨大,逐步演變為TPU、NPU、DCU等多種專用架構協同共生。 TPU(張量處理單元)作為專為深度學習與張量計算優化的芯片架構,透過重新設計計算單元與數據流路徑,在典型AI場景中實現了遠高於傳統通用架構的能效比與計算密度。這使其成為降低AI算力單位成本、加速模型迭代與智能體部署的關鍵技術路徑之一,並被視為國產AI算力生態中極具戰略價值的方向。 基於這一技術共識,中昊芯英與OpenCSG展開了深度技術合作。中昊芯英將其TPU適配代碼貢獻至OpenCSG開源社區,並合入CSGHub主倉庫。目前CSGHub平臺已成功實現對中昊芯英TPU算力資源的完整識別與調度,在硬件資源模型、資源類型校驗、部署調度、運行時資源請求生成、集群節點標籤識別等關鍵鏈路中,均新增TPU支持。此舉進一步豐富了國產AI算力生態的選項。 中昊芯英長期聚焦於高性能TPU芯片、AI計算集群及算力平臺的自主研發,是國內最早實現全自研高性能TPU架構芯片流片並量產的企業。其代表性產品“剎那®”與“須臾®”搭載100%自研的IP核、指令集與計算平臺,在AI算力性能上較同期國外主流GPU產品提升近1.5倍,同時能耗降低30%,單位計算成本下降約50%。這些芯片能夠支撐萬億參數級大模型的分布式訓練、多智能體協同運算以及海量Token的併發推理等高強度負載。 而OpenCSG則專注於構建開放、統一的AI基礎設施體系。其旗下CSGHub與AgenticHub等產品,為模型、數據集、應用、智能體及算力資源提供一致的管理、部署與運營能力。企業、園區乃至城市級客戶均可利用OpenCSG平臺快速建立可管理、可部署、可持續運營的AI能力底座。平台以開放架構連接模型生態、開發者生態與算力生態,降低了AI技術落地的門檻。 據了解,雙方技術團隊已完成全流程聯合適配測試,涵蓋模型上傳與部署、單機與多卡推理、大模型微調、算子調度、穩定性連續負載以及量化加速等核心場景。測試結果顯示,中昊芯英TPU算力芯片能夠原生兼容CSGHub平臺的全部核心功能,在軟硬件協同、穩定運行及性能表現上均滿足商用部署及開源生態接入的標準。 在此基礎上,CSGHub平臺即將正式上線中昊芯英TPU算力租賃服務,提供從單卡128GB到八卡1024GB共八檔配置。此舉意味著開發者與企業用戶無需再關心底層硬件適配與集群管理細節,便可在平臺上直接選擇並調度TPU算力,從模型開發、微調訓練到推理部署的全流程工作均可一鍵完成。 業內人士認為,此次合作對雙方均具有顯著戰略價值。對中昊芯英而言,其高能效、低成本的TPU算力經由開放平臺觸達更廣泛的開發者與企業用戶,得以從實驗室性能驗證走向規模化商業應用;對OpenCSG而言,新增TPU算力支持進一步補齊了平臺對國產異構算力的連接能力,強化了其開放AI基礎設施中的生態樞紐地位。 從更宏觀的角度看,伴隨國產大模型、芯片及企業級AI應用的快速演進,一個開放、兼容、可持續演進的基礎設施平臺正成為銜接上層應用與底層算力的關鍵節點。而以TPU為代表的創新專用芯片架構,正憑藉在計算密度與能效上的突破,逐步成為這一生態中不可或缺的算力基石。 中昊芯英與OpenCSG均表示,未來將持續深化合作,推動更多形式的專用算力資源納入統一、開放、可運營的AI基礎設施體系。通過標準化接納與平臺化調度,雙方希望為企業AI轉型與產業智能化升級提供更加堅實、普惠的底層支撐,助力國產AI生態從單點技術突破走向系統性規模協同。

Related

相關文章

IT之家生成式AI

DeepSeek-v3 671B 測試:英偉達 Blackwell GB300 刷新 MoE 預訓練世界紀錄,每 GPU 算力 1648 TFLOPs

首頁 > 智能時代>人工智能 DeepSeek-v3 671B 測試:英偉達 Blackwell GB300 刷新 MoE 預訓練世界紀錄,每 GPU 算力 1648 TFLOPs 2026/7/22 14:20:55 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 7 月 22 日消息,英偉達昨日(7 月 21 日)發佈博文,宣佈其 Blackwell GB300 刷新 MoE 預訓練的世界紀錄,每 GPU 算力達 1648 TFLOPs(每秒萬億次浮點運算)。IT之家注:MoE(混合專家模型)是一種機器學習模型架構。它將大型模型分割為多個更小的“專家”子網絡,每次推理或訓練時僅激活其中一部分。該架構旨在以更低的計算成本實現更大規模的模型容量,常用於大語言模型以提升效率。模型預訓練是指在大規模無標註數據集上,利用自監督學習方法讓模型初步掌握通用的語言規律、視覺特徵或常識。在最新博文中,英偉達表示:使用 256 塊 GPU 預訓練 DeepSeek-v3 671B 模型,GB300 NVL72 實現了每 GPU 吞吐 1648 TFLOPs 的全新世界紀錄。在相同訓練任務上,GB300 NVL72 用更少的 GPU 硬件,達到了相同的性能。英偉達表示在過去 6 個多月時間裡,通過模擬超過 25 萬種不同配置,為 Blackwell 摸索發現了 38 項重大優化方案,累計進行了 140 萬小時的 GPU 優化測試。相比較 2025 年 11 月的預訓練測試(1088 TFLOPs)結果,GB300 NVL72 系統性能優化提升 50%。與上一代 GB200 每 GPU 606 TFLOPs 的成績相比,GB300 實現了約 3 倍的性能躍升。廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,IT之

剛剛
IT之家生成式AI

Claude Cowork 新增錄屏教學:用戶演示一遍即可教會 AI

首頁 > 智能時代>人工智能 Claude Cowork 新增錄屏教學:用戶演示一遍即可教會 AI 2026/7/22 13:48:04 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 7 月 22 日消息,@claudeai 官方賬號昨日(7 月 21 日)在 X 平臺發佈推文,邀請 Pro、Max 以及 Teams 訂閱用戶,體驗 Claude Cowork 中的“錄製技能”(Record a skill)功能。

剛剛
鈦媒體生成式AI

安謀科技公開新一代NPU架構 並牽頭髮起開源AI操作系統聯盟

安謀科技在2026世界人工智能大會上首次公開新一代NPU架構「周易」X3-Pro,並牽頭髮起開源AI操作系統聯盟AIOS,展現從IP授權公司轉向平台型生態的意圖。該公司提出三條技術路徑因應端側AI資源受限問題,並推出星辰300異構計算平台,同時聯合多家晶片與模型廠商成立AIOS聯盟,以擴大在終端產品端的影響力。

剛剛
量子位生成式AI

天立啟鳴發佈教育AGI白皮書:破解教育“不可能三角”

天立啟鳴於WAIC 2026發布《世界模型驅動的教育AGI白皮書》,提出以認知世界模型為核心的技術架構,試圖破解教育質量、成本、規模難以兼顧的「不可能三角」。該白皮書已落地107所學校、服務超過25萬師生,並在2026年高考中獲得86.22%的漲分率驗證。

剛剛
鈦媒體生成式AI

大廠AI入口大戰升級,誰是最能幹活的桌面Agent?

大廠AI入口大戰升級,誰是最能幹活的桌面Agent?劃重點KeyPoints2026.07.22 11:57 · 來自浙江全文4694字00:00 / 13:42實測騰訊WorkBuddy、字節豆包專業版、百度搭子、阿里QoderWork文 | 劃重點KeyPoints,作者|心怡,編輯|重點君互聯網大廠間的AI入口大戰打到了桌面端。先說一條剛出爐的消息。

剛剛
鈦媒體生成式AI

Kimi K3其實“賤賣”了

Kimi K3其實“賤賣”了超聚焦2026.07.22 10:50 · 來自湖北全文4824字00:00 / 13:57別拿DeepSeek攬Kimi的活。文 | 超聚焦Kimi K3,可能是月之暗面成立以來最接近“封神”的一次。在7月17日公佈的Artificial Analysis獨立測試中,K3以57分登上綜合智能指數全球第三,超過Claude Opus 4.

剛剛