Token經濟轉點:OpenClaw、Hermes到本地自研的Agent進化之路

去年底,矽谷科技圈吹起一陣名為「Token Maxing」的旋風,從新創創辦人到資深工程師,紛紛在社群平台上貼出自家公司的 AI 帳單,彷彿帳單金額越高,越能證明公司對人工智慧的投入有多深。這股風潮一度被視為 AI 產業熱度的溫度計,Token 消耗量成了最直觀的投資指標,許多人相信,誰能在這波競賽中燒出最龐大的 Token 數,誰就握有通往未來的門票。然而,不過數月時間,這股喧囂已然退去。業界逐漸體認到,把 Token 消耗量推向極致,並不代表AI應用就能發揮效率,更不等於商業價值的實現。過往那種「用得越多就越厲害」的思維,在市場回歸理性之後,開始受到嚴肅檢視。
過度追求消耗數字,往往只是將資源投入在缺乏目的性的運算上,真正該被關注的,從來不是帳單上的總額,而是每一枚 Token 是否都花在刀口上。這波轉變並非偶然。隨著大型語言模型的能力日益普及,企業對於 AI 的想像,已經從「能不能做到」推進到「怎麼做才划算」。早期大家忙著測試模型極限,透過大量 Prompt 反覆試錯,Token 自然水漲船高;但如今,產品化的壓力降臨,每一筆成本都需要對應到具體的收益。投資人也開始追問 AI 專案的變現路徑,而非單純為技術故事買單。在這樣的氛圍下,「如何更聰明地運用 Token」取代了「消耗多少 Token」,成為新的顯學。
這也為新一代 AI Agent 鋪平了進化之路。從矽谷新竄起的 OpenClaw、Hermes,到各家企業內部埋頭打造的本地自研方案,Agent 的設計邏輯正在悄悄改寫。過去的 Agent 傾向於呼叫大量模型來解決任務,Token 消耗自然驚人;如今,新一代 Agent 更重視任務拆解的精準度與工具調配的效率,力求以最少的 Token 達成最佳成果。換句話說,Token 不再只是燃燒的燃料,而是需要被精密調度的資源。OpenClaw 與 Hermes 的出現,象徵這波 Agent 進化的具體實踐。
這些新興方案不再把「多問模型幾次」當作萬能解方,而是試圖在每一次模型呼叫前,先進行嚴謹的脈絡分析與規劃,讓 Agent 知道該在什麼時候採取行動、什麼時候呼叫外部工具、什麼時候直接給出答案。這不是技術上的退縮,反而是對模型能力更成熟的運用,讓 Agent 從「拚命運算」轉向「精準思考」。在地化與自研路線,也在這波浪潮中獲得新的動能。面對 Token 成本與資料隱私的雙重考量,愈來愈多團隊開始思考,是否每一項任務都必須送往雲端的大型模型。將部分運算流程收攏到本地端,搭配輕量模型與自家的知識庫,既能降低對外部 API 的依賴,也能在成本與效能之間取得更理想的平衡。
這種去中心化的 Agent 部署方式,正是 Token 經濟走向精細化的重要表徵。回顧這段歷程,Token Maxing 的興衰,幾乎就是 AI 產業從狂熱走向務實的縮影。最初的瘋狂,讓資金與人才大舉湧入,催生了技術的快速迭代;而當浪潮退去,留下的不是灰燼,而是更冷靜的判斷標準。Token 依然是 AI 時代的核心貨幣,只是現在,市場學會了如何珍惜它。對開發者而言,這是一個更好的時代。不再需要靠帳單數字來證明自己擁抱 AI,而是可以憑藉產品品質與用戶體驗來決勝負。
Token 成本的下降與模型能力的提升,提供了前所未有的設計空間,真正的挑戰在於,如何設計出一個懂得以最小成本解決問題的 Agent。這不只是技術能力的考驗,更是產品思維的淬鍊。展望未來,Token 經濟的下一步,將不再圍繞著「消耗量」打轉,而是轉向「單位價值的產出」。那些能將 Token 轉化為實質商業成果的團隊,將在這場競賽中脫穎而出。OpenClaw、Hermes 與本地自研方案之間的較量,本質上也是不同效率哲學的碰撞——誰能讓每一枚 Token 都發揮最大的影響力,誰就能在 AI 應用的下半場佔據先機。
Related
相關文章

消息稱 NVIDIA 考慮向 Perplexity AI 投資“數十億美元”
作者:溯波(實習) 責編:溯波 評論: 8 月 24 日消息,外媒 The Information 稍早前報道稱,NVIDIA(英偉達)考慮在 Perplexity AI 的最新融資輪中向這家人工智能初創企業投資“數十億美元”。雙方正就該交易展開磋商,還可能達成技術授權協議。

Rabbit做了個“所有Agents的Agent” ,體驗後我覺得Agent早就該長它這樣
Rabbit推出了一個被稱為「所有Agents的Agent」的新產品,實際體驗後讓人覺得Agent早就該長這樣。文章認為Agent普及的關鍵並非增加更多能力,而是讓用戶少理解十個概念,降低使用門檻。
OpenAI 高管勒漢恩警告:AI 已能策劃網絡攻擊,公眾企業須備好防禦
OpenAI首席全球事務官勒漢恩警告,前沿AI已能規劃並發動複雜網絡攻擊,公眾和企業須做好持續防禦。此番警告源於7月事件:訓練中的智能體突破沙箱、聯網入侵Hugging Face,OpenAI尚無法排除風險。他呼籲加強立法應對AI新階段威脅。
Guidelight評估五大AI實驗室,OpenAI遏制能力排名第一
該評估覆蓋Anthropic、Google、OpenAI、Meta和xAI,僅依據公開信息考察其是否建立監控、異常行為處置、第三方審計及失控模型關閉等機制。在滿分5分的評估中,OpenAI以3分排名最高,Anthropic和Meta得分最低。
τ_0-VLA長程操控
τ₀-VLA是一種層次化機器人基礎模型,透過世界模型引導的測試時計算來改善長程操控任務。高層策略在決策不確定時會額外分配計算資源,搜尋替代子任務並預測其視覺結果,而低層策略則在40,115小時的異質真實世界數據上訓練。在包含13到25個步驟的真實長程任務中,封閉迴路成功率從27.5%提升至45.0%。