微軟叫停Tokenmaxxing,預算卡死,超限自負

2026年8月5日 15:39
微軟叫停Tokenmaxxing,預算卡死,超限自負

重點摘要

微軟內部叫停「Tokenmaxxing」機制,未來超出額度的token用量需由相關團隊自行吸收成本,不再由中央預算兜底。此舉反映出微軟在AI基礎設施支出上開始採取更嚴格的財務紀律,並要求內部更精準規劃token用量。

站內 AI 整理稿

微軟近日在內部正式終止一項名為「Tokenmaxxing」的機制,此舉被視為該公司AI基礎設施支出策略轉向嚴謹財務紀律的重要訊號。據了解,過去微軟內部開發者與研究人員透過Tokenmaxxing,可以在專案需求超出原先核定額度時,向中央預算申請追加支援,不需要由團隊自行承擔超額成本。但隨著這項機制被取消,任何超出核定額度的token用量,相關團隊都必須自行吸收費用,不再有中央預算兜底。 這項決策直接影響微軟內部員工運用生成式AI服務的習慣,尤其是那些高度依賴大型語言模型進行實驗與產品開發的團隊。過去,Tokenmaxxing的設計本意是為了鼓勵內部創新,讓開發者不必過度擔心調用模型時的token消耗,可以更專注於功能測試與效能調校。然而,隨著AI服務的使用量急速膨脹,微軟高層開始意識到,若不加控管,相關支出將快速侵蝕利潤空間。 根據內部消息,微軟目前預設使用的AI模型版本為GPT-5.6,這款模型在效能與成本之間取得特定平衡,能夠滿足多數內部應用場景,但同時也代表每一次API呼叫的token消耗都必須被精確計算。Tokenmaxxing的取消,意味著團隊需要更嚴謹地規劃每次呼叫的token用量,避免因超額而影響專案進度或預算配置。對於習慣「先叫再說」的開發者而言,這無疑是一項重大轉變。 微軟至今尚未對外公開說明這項調整的具體生效時間,也未公布後續的配套措施,例如是否會提供新的預算工具或監控機制來協助團隊控管用量。但業界普遍認為,微軟此舉的核心目的在於避免資源濫用,並引導內部人員更有效率地運用生成式AI工具。隨著AI模型訓練與推理的成本持續高漲,即使是科技巨頭也必須在創新與成本之間找到更精準的平衡點。 值得注意的是,這項內部政策調整並非孤立事件。過去幾個月,微軟已在多個面向收緊AI相關支出,包括減少非關鍵專案的GPU配額、重新評估與供應商的合約條款,以及要求各部門提交更詳細的AI使用報告。Tokenmaxxing的終止,正是這一系列預算控管行動中的一環,顯示微軟對AI基礎設施的投入正從「衝刺擴張」轉向「精細化管理」。 對於內部開發者與研究人員而言,這項變化意味著他們必須重新思考如何設計與部署AI應用。例如,在進行模型測試時,可能需要優先選用較小或較便宜的模型版本,只有在必要時才調用GPT-5.6;或者在開發過程中加入更嚴格的token上限檢查,避免因程式錯誤導致大量浪費。長遠來看,這可能促使微軟內部出現更多專注於token效率優化的工具與流程。 業界分析人士指出,微軟的決定也反映出整體科技產業對AI成本結構的重新評估。過去兩年,各大雲端與AI公司在基礎設施上投入巨額資金,但隨著生成式AI商業化落地,營收成長速度並未完全跟上資本支出,導致財務壓力逐漸浮現。微軟作為這波AI浪潮的領頭羊之一,率先在內部導入更嚴格的成本控管,很可能會成為其他企業跟進的參考範例。 此外,Tokenmaxxing的取消也可能對第三方開發者與合作夥伴產生間接影響。微軟內部團隊在開發AI產品時,若因token成本限制而調整設計方向,最終推出的服務或API定價策略也可能隨之改變。外界預期,微軟將在未來幾個月內發布更明確的內部AI使用規範,進一步釐清各團隊在預算與資源分配上的權利義務。 目前,微軟發言人尚未針對此消息發表正式評論。但從內部員工的反饋來看,部分團隊已開始重新檢視現有的AI工作流程,並尋求更節約的替代方案。例如,有些團隊嘗試將長時間運行的批次任務拆分為較小的單元,以便在token用量達到上限前暫停或排程;也有人開始研究提示詞壓縮技術,設法以更少的token達到相同效果。 總體而言,微軟叫停Tokenmaxxing,不僅是該公司內部預算管理的一次調整,更象徵著整個AI產業從「不惜代價追求能力」過渡到「務實追求效率」的轉折點。對於開發者與研究人員來說,未來在享受AI帶來的便利時,也必須同時承擔起成本控管的責任,這將是生成式AI時代的新常態。

Related

相關文章

還沒把英偉達送上天,SpaceX股價先跌入地了

還沒把英偉達送上天,SpaceX股價先跌入地了字母AI2026.08.05 16:35 · 來自北京全文4200字00:00 / 12:40營收大漲92%,但SpaceX正進入新一輪燒錢週期。文 | 字母AISpaceX上市後的第一份財報,揭開了馬斯克為下一場競爭付出的成本。當地時間8月4日,SpaceX公佈2026年第二季度財報,也是SpaceX上市以來首份財報。公司季度營收達到78億美元,同比增長92%,淨虧損收窄至5.41億美元。然而,受AI基礎設施和星艦項目投入推動,公司季度資本開支飆升至184億美元。財報公佈後,SpaceX盤後股價一度下跌超過8%,市場開始重新審視這家太空公司的鉅額投入。幾乎是同一時間,SpaceX又宣佈將與英偉達合作,共同設計Starmind AI1衛星的計算系統。該衛星將搭載英偉達Rubin GPU和Vera CPU,使其具備數據中心級別的太空計算能力。一邊是季度接近184億美元的資本投入,另一邊是把AI計算能力部署到太空。財報中的鉅額開支,開始對應到SpaceX正在建設的新基礎設施。SpaceX的高估值正在接受檢驗SpaceX上市後的第一份財報,並沒有像上市初期那樣繼續獲得市場追捧。財報公佈後,公司股價盤後一度下跌超過8%,最低一度接近118美元附近,相比上市後的高點225.64美元,SpaceX股價一度回落近50%。按當時估值計算,公司市值一度縮水約1.4萬億美元——相當於半個微軟的市值。但從經營數據來看,SpaceX交出了一份強勁的成績單,公司公佈的第二季度業績整體超過預期。財報顯示,公司季度營收達到78億美元,同比增長92%;調整後EBITDA達到35億美元,淨虧損收窄至5.41億美元。在財報中,SpaceX強調,公司依靠覆蓋航天(Space)、連接(Connectivity)和AI三大領域的垂直整合能力,實現了高速增長。其中,Sta

剛剛

Transformer開始構建三維世界:開源模型幾張圖片秒級生成可探索3D場景

賬號設置我的關注我的收藏申請的項目退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

剛剛

世界銀行:新興經濟體應儘快擁抱 AI,但沒必要與富裕國家比拼數據中心、大模型

世界銀行報告建議新興經濟體無須追趕富裕國家在大型數據中心與大語言模型上的巨額投資,應優先發展經本地化調整的小型低成本AI工具,以提升醫療與教育服務。報告強調,這類輕量級應用能更快讓民眾有感,同時各國政府需建立配套數據治理框架,確保隱私與公平性。

剛剛

AI 監考效果不佳,導致約 5.8 萬名墨西哥國立自治大學考生需重考

首頁 > 智能時代>人工智能 AI 監考效果不佳,導致約 5.8 萬名墨西哥國立自治大學考生需重考 2026/8/5 14:14:46 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 8 月 5 日消息,科技媒體 Ars Technica 昨日(8 月 4 日)發佈博文,墨西哥國立自治大學(UNAM)首次採用遠程考試與人工智能監考系統後,發現最終運行效果是“災難級”,並導致約 5.8 萬名考生重新考試。

剛剛

震撼,馬斯克聯手老黃扔出星際大腦!AI算力中心射上天

SpaceX近日交出首份公開財報,營收表現亮眼,但真正震撼業界的,是馬斯克在財報中正式宣佈與英偉達聯手,推出名為Starmind(星際大腦)的軌道AI計算網絡。這項計畫打算將AI的算力底座從地表搬到大氣層之外,透過鋪天蓋地的衛星矩陣,打造一個具備無限擴展潛力、可持續獲取太陽能、並能利用真空環境散熱的太空AI運算中心。馬斯克此舉被視為要徹底解決當前AI發展所面臨的耗電與散熱焦慮,也讓外界驚嘆,在通往火星的路上,他正順手重塑整個人類AI算力的版圖。

剛剛