鈦媒體模型更新

算力定價權的轉移——從"你有多少張卡"到"Token成本多少"

2026年7月18日 15:34
算力定價權的轉移——從"你有多少張卡"到"Token成本多少"

重點摘要

WAIC 2026展會上,客戶提問從「有多少張卡」轉變為「Token成本和時延」,反映算力正從固定資產轉向運營支出,需求從訓練轉向推理,競爭從產能規模轉向成本效率。這預示產業鏈估值座標將從芯片數量向單位Token經濟性遷移,算力公司的商業模式與定價邏輯正結構性調整。

站內 AI 整理稿

上海世界人工智慧大會(WAIC 2026)今年最受矚目的展品,無疑是各家廠商推出的超節點運算系統。華為昇騰950超節點首次公開展出真機,單櫃整合64張計算卡,最高可擴展至1024卡互聯,FP8總算力達1 EFLOPS,並配備256TB統一記憶體,最終拿下大會最高榮譽SAIL獎。沐曦股份則以「零線纜」設計作為產品差異化亮點,崑崙芯強調其32卡與64卡超節點已進入量產交付階段,曦智科技則憑藉光電混合技術路線,實現2000卡規模的落地應用。

從技術參數來看,國產算力在超節點產品上已形成涵蓋純電、風冷、光電混合等多元技術路徑的初步矩陣,各家都在朝同一個方向努力:把更多晶片高效串接,使其如單一整體般協同運算。然而,真正反映產業結構變遷的信號,並不在展臺上那些炫目的規格數字裡,而在展場下交易雙方的對話中。一位算力服務商在會場間隙的一句話,點出了今年WAIC最具指標意義的變化:「過去客戶會問『你們有多少張卡』,現在改問『Token成本多少?響應延遲多長?』」

從「你有多少張卡」到「Token成本多少」,這個提問方式的轉變,背後隱含算力產業鏈三個層次的結構性移動。首先,算力的經濟屬性正在改寫。當客戶著眼於「有多少張卡」時,算力被視為固定資產,一次性採購入帳,按折舊週期攤銷,投資回報衡量的是產能利用率與規模增速。但當提問轉向「Token成本」時,算力就變成了營運支出,按使用量付費、依推理次數結算,投資回報的關鍵變成單位成本與毛利率。固定資產與營運支出兩種截然不同的財務模型,將徹底改變企業的估值邏輯與損益結構。其次,算力的需求結構已出現質變。

據統計,中國境內每日Token調用量已突破140萬億次,短短兩年內暴增超過一千倍,其中推理場景對總算力的消耗占比已達約85%。訓練需求雖然仍在成長,但增量的大頭已經明確轉向推理。訓練與推理對算力的要求截然不同:訓練看重峰值算力,可以容忍數小時的等待時間;推理則要求持續的吞吐能力與毫秒級的即時回應。這意味著算力基礎設施必須從「為訓練優化」轉向「為推理優化」,晶片與系統的設計邏輯也隨之翻轉。第三,算力市場的競爭維度正在位移。全球大型語言模型的推理成本在三年內驟降約一千倍,從每百萬Token約20美元跌至約0.40美元。

成本急遽壓縮的結果,使得算力公司的競爭壁壘不再僅是「產能規模」,而是「成本效率」。誰能讓單位Token產出的功耗更低、延遲更短、吞吐更高,誰就能掌握定價權。晶片的絕對算力不再是唯一指標,系統層級的成本優化能力躍升為新的核心競爭力。這種轉變也將重塑整個算力產業鏈的估值座標系。在晶片設計端,價值重心將從「峰值算力競賽」轉向「每瓦性能競賽」,同等製程下功耗更低的推理晶片將擁有更高的議價能力。在系統整合端,關注點將從「能連多少張卡」轉向「互聯效率對整體成本的影響」,超節點架構的競爭力不只取決於規模,更在於規模擴張時效率損失的控制。

至於算力營運端,商業模式將逐漸從「賣卡」轉向「賣服務」,毛利率的穩定性將比營收增速更受市場重視。當然,這場轉移不會在一夜之間完成。當前市場對多數算力公司的定價仍多沿用傳統硬體公司的估值框架。但客戶提問方式的轉變,往往是產業定價邏輯遷移的先行指標。當越來越多大型客戶開始按Token詢價、而非按伺服器詢價時,算力公司的商業模式與估值模型遲早必須回應這個趨勢。後續值得關注的動向包括:頭部算力廠商是否開始主動揭露單位Token成本或推理效率數據;算力營運商的收入結構是否出現從硬體銷售向服務收費的拐點;以及推理成本下降曲線在超節點架構普及後是否會進一步加速。

這些訊號,都將決定下一階段算力產業的贏家與輸家。

Related

相關文章

鈦媒體模型更新

【數智周報】張一鳴:字節跳動“拒絕蒸餾”,不用別人輸出換榜單排名;三星發佈下一代AI存儲路線圖,展示zHBM和400層以上V10 NAND技術;閃迪第四財季營收超預期增長372%,數據中心收入增近13倍,擬豪擲140億回購

字節跳動創辦人張一鳴在內部會議強調公司堅持長期主義,拒絕蒸餾他人模型以換取榜單排名。三星發佈下一代AI存儲路線圖,展示zHBM與400層以上V10 NAND技術。閃迪第四財季營收年增372%,數據中心收入成長近13倍,並計劃回購140億美元股票。

1 小時前
MarkTechPost AI模型更新

Pokee AI 推出 Pokee-Isaac 28B:百萬 Token 上下文長度的代理模型,專為客戶內部部署設計

長時程代理在累積上下文的速度上,遠快於解決任務的效率。每項工具輸出、觀察結果及中間推理步驟都會保留在上下文視窗中,而兩個關鍵能力——保留上下文並在其中保持連貫——目前幾乎僅能透過雲端端點實現。這排除了受監管行業、公共部門機構及裝置端應用,因為這些場景的資料完全不允許離開內部邊界。Pokee AI 發布了 Pokee-Isaac 28B,這是一款擁有 280 億參數、僅支援文字的基礎模型,具備 1000 萬 Token 的上下文長度,專為在客戶內部邊界內運行而設計。Pokee 研究團隊聲稱,在 RULER 基準測試中,該模型在 1000 萬 Token 長度下達到 93.3% 的準確率,與代理基準測試中最具成本效益的雲端基準模型表現持平,且可單靠一張 GPU 完成部署。

2 小時前
IT之家模型更新

微軟預告 Win10/Win11 經典版 Outlook 更新:基於上下文 AI 解釋用戶選中文本

首頁 > 智能時代>人工智能 微軟預告 Win10/Win11 經典版 Outlook 更新:基於上下文 AI 解釋用戶選中文本 2026/8/8 11:39:29 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 8 月 8 日消息,科技媒體 Windows Latest 昨日(8 月 7 日)發佈博文,報道稱面向 Windows 10、Windows 11 經典版 Outlook 應用,微軟開始推送名為 Explain This 的 Copilot AI 功能。功能方面,用戶打開郵件後,只需選中任意文本,Copilot 就會結合整封郵件的內容,給出貼切的上下文解釋。微軟在更新說明裡寫道,這項改進讓用戶對 Copilot 有更高的控制權,可以決定其在何時、如何協助完成任務,從而在工作流中整合生產力、清晰度和決策能力。時間表方面,微軟預計經典版 Outlook 的 Explain This 功能會在 9 月底前完成推送,大多數用戶會在 9 月初看到它。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:Outlook,AI,微軟微軟 Win10/Win11 新版 Outlook 收件箱塞入 Copilot,AI 摘要過去 8 小時郵件Win10/Win11 新版 Outlook 本月將集成 Planner 任務管理,微軟希望藉此推動經典版用戶遷移微軟承認 Outlook 存在嚴重 Bug,郵件中的圖片無法正常顯示微軟修復 Outlook 奇怪 Bug:打開 Office 文檔顯示空白或“已損壞”微軟增強 Outlook AI 功能:自主梳理收件箱、調整日程安排等部分微軟 Outlook 365 用戶反饋安裝 2603 更新後出現“幽靈滾動”

8 小時前