智東西生成式AI

日均10萬億!商湯Token工廠“大暴走”,還要挺進太空

2026年7月23日 06:57

重點摘要

商湯大裝置宣布其日均Token服務量預計年底達10萬億,並已實現國產算力規模化盈利。該公司透過異構混合推理與算電協同Agent等技術,提升推理性價比與能效,同時布局太空計算、光計算、量子計算等前沿領域,並與多家生態夥伴共建國產AI基礎設施生態。

站內 AI 整理稿

商湯科技在2026年世界人工智能大會(WAIC)期間交出亮眼成績單:當前日均Token服務量已達2.42萬億,預計今年年底將進一步攀升至10萬億規模,全年實現25倍高速增長。這家以視覺起家的AI公司,如今正透過其「大裝置」事業群,將自身定位為「最懂大模型的AI基礎設施服務商」,並正式宣告國產算力已進入規模化盈利階段。商湯科技聯合創始人、大裝置事業群總裁楊帆指出,過去算力基礎設施的價值主要看單卡算力與堆卡規模,但進入Token時代,衡量標準已全面轉向「一度電能產出多少Token」「一個Token能否穩定交付」「一次模型調用能否轉化為產業收入」。

他比喻,上一階段的國產AI基礎設施是在「修路」,現在則是在「運營高速公路」——路修得再寬,如果收費站堵住、服務區沒水,依然是一條低效的路。商湯大裝置的核心策略,就是把AI雲打造成面向大模型生產的原生系統,實現異構算力統一納管、訓練與推理一體化調度,並提供從模型開發到商業運營的全鏈路能力。在技術層面,商湯大裝置揭露了三項關鍵突破,正好對應國產AI算力基礎設施必須跨越的三大門檻:性價比、適配性與能效比。首先,透過異構混合推理集群,商湯將主流國產芯片的模型算力利用率(MFU)提升85%至152%,整體推理性價比已達到英偉達H系列的1.25倍,同成本下Token產出規模擴大2.

5倍,成功實現國產算力的規模化可盈利。楊帆透露,目前商湯的混推集群在國產卡上已能跑出不錯的正毛利率,遠超最初設想,他判斷國產AI芯片商業化的真正市場成熟期可能在未來兩年內到來。其次,為了降低國產算力的應用門檻,商湯大裝置打造了覆蓋模型、框架、算子、工具鏈到硬體的全棧適配體系。在AIGC視頻生成場景中,國產芯片運行DiT模型時多卡並行加速比達93%,效果對齊N卡;在AI4S長序列蛋白質預測任務中,經過融合算子優化後端到端性能提升3.3倍;大型異構混推與自適應彈性集群則能將綜合成本降低60%。

第三項突破是正式發佈「算電協同Agent」,將效能標尺從傳統的PUE轉向TPW——即每度電產生多少Token。透過算力移峰調度、儲能協同與能耗動態優化,單位電力成本的Token產出提升80%,平均電費單價比同地區IDC降低10%,算力負荷預測準確率達96%,全年預估可實現碳減排24000噸/每萬P。生態合作方面,商湯大裝置聯合寒武紀、沐曦股份、中科海光、華為昇騰、摩爾線程、曦望Sunrise、壁仞科技等近20家頭部國產芯片夥伴,以及曦智科技等核心零部件廠商和多家AI Infra新創公司,共同發起國產AI基礎設施生態共建計劃。

未來計劃共建1個Token工廠、5個萬卡級國產智算集群,圍繞10個核心技術方向開展聯合創新,並賦能200家AI初創組織。同時,商湯大裝置也與晶科科技、中國聯通上海市分公司、華能上海、寧德時代浦泉資本、協鑫能科、達卯科技等合作夥伴簽署戰略協議,共建面向源網荷儲一體化的算電協同生態。在智算中心布局上,商湯大裝置正從區域走向出海。江蘇鹽城智算中心已落地,首期投資建設3000P算力規模,並計劃落成首個算電協同區域試點與異構Token工廠;香港則正在建設全港最大國產智算中心,目標在2030年前達到40000P算力規模;沙特據點成為中國首個出海國產算力集群,將中國的AI基礎設施建設與運營經驗複製到海外。

此外,商湯大裝置與國信數算達成戰略合作,將圍繞全國一體化算力網試驗場建設,依託臨港AIDC打造長三角核心節點,推動算力資源跨區域協同與調度。更長遠的布局則瞄準下一代計算範式。

商湯大裝置已前瞻投入三大新型計算:光計算方面,透過光電互聯技術可將芯片IO功耗降低75%至90%,數據中心整體能耗下降20%至30%,光子計算則能在同等芯片面積下實現算力密度提升30至200倍,楊帆預計光計算將在3到5年內進入商業期;量子計算方面,透過AI優化求解可將大模型高維問題運算提速3至6個數量級,分子與新材料模擬效率提升4至6個數量級;太空計算方面,商湯與國星宇航達成戰略合作,共建「商湯太空算力星座」,預計2026年完成首發並組網,到2030年建成千顆級算力衛星、總算力超過萬P,使國產AI出海服務有效覆蓋率從62%提升至99%。

在產業應用層面,商湯大裝置將端到端多模態解決方案作為基礎設施商業化的落腳點。量子城市項目已覆蓋超過40個高價值場景,沉澱150多個智能體成果,並在上海先進製造領域服務5家大型國企,落地數十個場景。關鍵在於商湯組建的FDE行業駐場工程師團隊,深入客戶業務現場,與企業共建場景、共創模型,將複雜的大模型項目沉澱為可複製的方法論,實現「AI123」交付法則——1天澄清需求價值,2天產出驗證Demo,30天實現穩定版本上線。在上海電氣、上港集團、華建集團、申通地鐵等國資企業的實踐中,該模式已獲得成效。

科研方面,商湯大裝置聯合上海人工智能實驗室、北京中關村學院、深圳河套學院、上海算法創新研究院、上海交通大學人工智能學院等機構,共同啟動科學發現平臺戰略合作,建立覆蓋「算力基礎-平台工具-模型能力-科研創新」的一體化服務體系。同時也與上海交大工業技術創新研究院、復興島創客學院、璞躍中國、模力營AI生態社區、開源中國、香港科技園等平台發起AI科創加速計劃,為AI初創企業提供技術研發、算力支持、市場拓展與商業落地的全週期賦能。

從日均Token服務量暴增到技術突破、生態共榮、海外布局與前瞻範式探索,商湯大裝置正試圖將電力、算力、模型、產業場景與上下游資源全面調動,加速底層算力轉化為穩定、可衡量、可交付的Token服務。這條從「有算力」到「算力創造價值」的道路雖長,但商湯正以技術與生態的雙輪驅動,為國產AI基礎設施的規模化商用寫下新的註腳。

Related

相關文章

MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

33 分鐘前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

2 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

3 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

3 小時前