萬億Token調用量驗證,PPIO如何打造新一代智能Token工廠?

重點摘要
中國日均Token調用量已突破140萬億,PPIO宣稱在獨立AI雲端服務商中排名第一,其平台日均Token消耗達1.2萬億次。該公司提出「智能Token工廠」概念,透過智能模型網關等技術優化Token生產效率,並發布Agentic Cloud戰略,因應AI Agent成為雲端主要用戶的趨勢。
在AI產業從訓練加速轉向推理應用的關鍵轉折期,Token已不再只是技術文檔中的計量單位,而是成為AI時代最基礎的交易資源。根據國家數據局今年3月公布的數據,截至2026年3月,中國境內每日Token調用量已突破140萬億,相較於2024年初的1000億,成長超過一千倍。IDC更預測,全球年度Token消耗量將從2025年的0.0005 Peta Token躍升至2030年的15萬Peta Token,年複合成長率高達3418%,到2031年全球活躍智能體數量將達3.5億個。在這波爆炸性成長背後,來自上海的PPIO正憑藉其「智能Token工廠」的概念,穩居中國獨立AI雲端運算服務提供者首位。
傳統雲端運算的設計初衷是服務人類使用者,VM開啟後往往持續數天甚至數月,但AI Agent的運作模式截然不同。PPIO聯合創始人兼CEO姚欣指出,Agent的任務調用是碎片化、高頻化的,人用雲有波峰波谷,但Agent是7×24小時不間斷運作。此外,人類對延遲的容忍度在秒級,但Agent在執行複雜任務時,每一次調用若延遲數百毫秒,經過幾十次循環後,整體效率將難以接受。這些根本差異,讓傳統雲端架構無法直接支撐Agent時代的需求,也催生了專門為Token生產與交付最佳化的新基礎設施。
灼識諮詢的數據顯示,以2025年及2026年第一季平均每日Token消耗量計算,PPIO在中國獨立AI雲端運算服務商中排名第一。2026年4月,其平台日均Token消耗量已達1.03萬億次,到6月更突破1.2萬億次,較2025年同期成長超過八倍。營收方面,PPIO的AI雲端運算收入從2024年的1038.7萬元躍升至2025年的1.192億元,年增超過10倍;全球註冊開發者則從2024年底的12.5萬人增至2026年6月的超過66.6萬人。PPIO將「智能Token工廠」定義為一套圍繞Token全生命週期進行最佳化的大規模生產與交付體系。
姚欣強調,單純購買算力、部署模型就能生產Token的時代已經過去,真正的關鍵在於如何高品質、高效率地產出更智慧的Token。他提出一個核心公式:Agent生產力等於Token智慧密度乘以Agent Loop時長。前者決定Agent每一步決策的品質上限,後者決定Agent能持續運行多久、完成多複雜的任務。為了實踐這個公式,PPIO推出智慧模型閘道,作為AI Agent的智慧調度中心。該系統能將關鍵決策交由混合模型把關,以提升品質,同時將簡單任務自動分流至輕量模型,確保Agent以最低Token成本達到最高智慧性能。
姚欣透露,PPIO正在測試將兩到三款不同模型組合使用,讓它們互相PK與討論,內部測試中,這種方式已經能在某些任務執行上超越GPT-5.6。這意味著模型的智慧上限不僅存在於參數內部,也可以透過工程化手段從外部突破。在產品實作上,PPIO的差異化主要體現在幾個面向。首先,平台保持中立,不受任何模型生態綁定,支援200餘款開源模型統一接入,開發者切換模型僅需修改一行程式碼。姚欣指出,一個應用開發者平均需要調用10到15款不同類型的模型,且每三個月就要根據模型迭代切換一次,中立定位成為吸引開發者的重要策略。
其次,PPIO針對Agent調用模式深度最佳化,自研推理加速引擎,將行業平均40%到50%的GPU使用率長期維持在75%以上。這項成就仰賴其遍布全球六大洲、超過5000個算力節點的分佈式調度能力,透過東西半球時區錯峰調度,將不同時間與空間的負載融合,使後端使用率曲線接近直線。隨著推理成本每年下降十倍,單純提供算力資源的商業模式正在快速失去溢價空間。PPIO的「Agentic Cloud」定位,正是回應這項趨勢。2026年,全球雲端巨頭不約而同發布Agentic Cloud戰略,包括Google、阿里雲、亞馬遜與微軟,目標都是讓AI Agent成為雲端的第一客戶。
PPIO在WAIC 2026上正式提出此戰略,將其產品架構分為基礎設施層、模型服務層與Agent Harness平台層。Harnes是一個專門用於約束、引導、驗證與糾錯Agent執行的工程框架,涵蓋上下文建構、工具編排、驗證循環、成本控制與可觀測性。其中,沙箱是核心組件之一,PPIO去年推出國內首款相容E2B介面的Agent沙箱,冷啟動延遲低於200毫秒,每個Agent任務運行在獨立虛擬機器環境中,系統級安全隔離,支援上萬個沙箱同時建立,閒置時自動暫停計費,綜合使用成本較同類產品降低90%以上。PPIO沙箱上線一年,業務規模已成長超過120倍。
姚欣進一步分析,全球80億人口中,可能只有20%用上了AI,真正付費的約5%,人用AI仍有巨大成長空間。但與此同時,智能體的調用量正在指數級成長。以PPIO自身為例,300多名員工,後台Agent已接近千個,開發、運維、客服等工作都在Agent化。一個人可以擁有10個、100個Agent,每個Agent都在7×24小時消耗Token。從Token定價的排序來看,目前最貴的是程式設計Token,其次是智能體Token,最便宜的是提供單純對話服務的Token。這個排序本身就反映出未來Token消耗的主要方向。姚欣認為,PPIO服務的對象正在從人轉向Agent,甚至未來的機器人。
這個轉變正在重塑雲端運算的商業模式,從過去比拚功能數量與生態封閉,轉向比拚誰能讓AI Agent跑得更快、更便宜、更穩定。PPIO的選擇是不做封閉花園,擁抱開源,不做全棧替代,而是做AI時代的互補者。Token經濟重新定義了算力的價值尺度,在這場重構中,效率最高的玩家,才能拿到最後的船票。
Related
相關文章

Meta 旗下 AI 模型測試時意外入侵第三方企業系統
Meta 在進行AI模型安全測試時,因第三方公司Irregular配置錯誤,導致模型意外入侵另一企業系統。涉事模型為Muse Spark 1.1,事件引發對AI模型可能衝出邊界、發動網絡攻擊的擔憂。

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?
字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

千人聯機世界模型“RhOS-World: Khora”正式發佈
RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。
TutorMoments:AI 家教何時該出手,何時該放手?
今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

告別反覆操作 OSD,華碩顯示器管理軟件 DisplayWidget Center 接入 AI 智能體
華碩顯示器管理軟體 DisplayWidget Center 推出重大更新,加入 AI 智能體功能,用戶可透過自然語言調整亮度、色溫等參數,無需操作 OSD。該功能支援 CLI 與 Agent Skill,可根據使用習慣自動切換模式,並適用於企業環境的統一部署。

千問App部分功能探索收費,想學豆包能跑通嗎?
千問App於8月7日更新,新增辦公助理等付費功能,基礎功能仍免費,但辦公場景使用額度需付費取得。此舉仿效豆包專業版等產品的訂閱模式,反映AI行業正集體轉向辦公場景收費,以尋求變現機會。