美國大模型,也開始打價格戰了

影子備忘錄2026.09.25 09:35 · 來自廣東全文3592字00:00 / 10:33大模型卷完參數,終於開始卷價格。文 | 影子備忘錄這一次帶頭降價的,是兩家最不缺客戶的公司。美國時間9月22日,Anthropic發佈Claude Opus 5.5。約一個半小時後,OpenAI推出GPT-6 Sol和GPT-6 Luna。兩家不約而同把“便宜”寫在了海報最顯眼的位置,GPT-6 Sol每百萬Token輸入、輸出價格分別降至2美元和10美元,是上一代的一半;Luna更是把輸入價格壓到0.1美元,降幅最高達58%。Opus 5.5的輸入輸出價格則分別降至4美元和20美元。
一個估值萬億、擁有最多用戶的AI公司,一個在美國企業中付費採用率最高的模型廠商,在同一天主動砍價,這背後到底發生了什麼?兩條不同的降價路線別看兩家在同一天降價,但打法截然不同。OpenAI走的是“分層降價、以量取勝”的路子。GPT-6 Sol定位於複雜編碼和Agent工作流,Luna則面向成本敏感、高調用量的任務。說白了,就是讓不同檔位的模型各司其職:高難度任務交給Astra旗艦,日常編碼和批量處理用Sol,高頻輕量對話交給Luna。更關鍵的是,OpenAI明確表態新價格是長期定價,不是促銷,不是首發優惠,而是永久價格。
這意味著OpenAI在賭一個判斷:把價格壓到足夠低,日常調用量會迎來指數級增長,規模效應最終會把單位成本攤薄到可持續的水平。Anthropic的思路則完全不同。Opus 5.5單看單價降幅只有20%,但Anthropic更強調“綜合成本”,即通過引入新的動態緩存讀取機制,緩存讀取價格從每百萬Token 0.50美元驟降至0.20美元,降幅高達60%。同時,Opus 5.5完成任務所需的Token總量實現了有效減半,配合輸出速度提升超過30%,典型工作負載的整體運行成本比上一代低了約40%。
打個比方,OpenAI像超市打折,直接把標價砍一半,吸引你來買;Anthropic則像餐廳優化供應鏈,菜價沒怎麼變,但每道菜用的食材少了、出餐快了,你花同樣的錢吃到的更多了。一個在降單價,一個在降總賬。兩家公司為什麼選擇在這個時間點降價?表面看是競爭,深層看是三股結構性力量在同時發力。第一股力量:技術架構的突破讓降價有了底氣。這輪降價並非賠本補貼。Anthropic在Opus 5.5中引入了全新的動態緩存讀取機制,將中間狀態數據的存儲與回讀成本壓降到原來的四分之一。配合這一底層改造,企業在調用同一批核心業務數據時,實際消耗的Token總量有效減半。
OpenAI在Sol系列上的大幅讓利,同樣建立在對基礎運算邏輯的重構之上;Luna則進一步剝離了非必要的泛用型算力模塊,聚焦高頻、短平快的對話問答場景。當底層計算範式發生質變,“價格便宜”就不再是無奈妥協,而是新技術架構誕生後的自然副產品。第二股力量:市場數據揭示了一個殘酷現實——貴的模型賣不動了。企業支出管理平臺Ramp的數據顯示,Anthropic最貴的Fable系列上線一個月後,只佔企業從Anthropic購買Token的6%。這個數字說明了一個簡單的事實:大多數工作根本用不著為最高檔付費。一項任務如果用Opus就能做好,企業沒有理由再為Fable多掏錢。
與此同時,Ramp追蹤的數據顯示,每百萬Token的有效價格已從今年3月的1.15美元降至0.68美元,半年下降了41%。企業給AI花錢越來越精打細算,不再盲目為“最強模型”買單,而是開始算一筆賬:這件事用便宜模型能不能做?第三股力量:中國模型的低價攻勢形成了倒逼。以DeepSeek為代表的國產模型,已經把全球大模型的價格門檻向下拉低了一個量級。DeepSeek V4 Flash每百萬Token輸入價格僅1元人民幣,輸出2元,摺合約0.14美元和0.28美元。即便OpenAI將Luna價格猛砍,其輸出價格仍是DeepSeek V4 Flash的四倍以上。
摩根士丹利的研報指出,中國大模型API的平均價格過去一年明顯上漲,而美國閉源模型價格近期持續下降,中美大模型價格差距正在收窄。這種“你漲我降”的剪刀差,恰恰說明美國廠商已經感受到了壓力,因為如果價格不降下來,價格敏感的客戶會毫不猶豫地轉向中國模型。大洋彼岸的價格戰,打法不一樣把鏡頭拉回國內,這場價格戰的劇本其實早在兩年前就上演過。2024年5月,字節跳動的豆包率先把Pro模型定價打到0.0008元/千Token,比行業均價低99.3%。隨後阿里雲通義千問主力模型降價97%,百度文心大模型兩大主力模型全面免費,騰訊混元大模型價格降幅最高達87.5%。
一時間,整個行業陷入“虧本賣Token”的瘋狂。但兩年過去,國內市場的走向出現了反轉。國聯民生證券測算顯示,中國整體日均Token消耗從2024年初的1000億級飆升至2026年2月的180萬億級。需求爆炸之下,智譜AI、騰訊雲等相繼發佈漲價通知,部分產品漲幅超400%。2026年第二季度,中國大模型平均API輸入價格已升至4.9元/百萬tokens,輸出價格升至21.9元,相比2025年第一季度分別上漲約48%和80%。價格戰打不下去了。字節高管內部放話:“未來18個月,只有控制算力供應鏈的玩家才能活到最後。
”這個判斷放在美國市場同樣成立,但兩國價格戰的底層邏輯有著根本區別:國內價格戰是“燒錢搶地盤”,字節用提前囤積的算力優勢和全行業最低的邊際成本碾壓對手,阿里、百度則被迫跟進嗎,比如阿里靠MoE架構把3970億參數激活壓縮到170億,顯存佔用降60%,推理吞吐量提升19倍,屬於“被逼著降本”。這種打法的問題在於,當市場從增量轉向存量,燒錢就不再是投資,而是浪費。美國這輪降價更像是“技術紅利釋放”。OpenAI和Anthropic的降價有明確的架構優化支撐,不是在賠本換市場,而是在新技術範式下重新核算成本。
美國銀行發佈的報告也指出,中國AI企業正摒棄簡單粗暴的價格戰,開始更多地圍繞完成任務的成本進行定價。某種程度上,中美兩國的定價策略正在向中間靠攏。那這場價格戰最後拼的是什麼?先看技術體量。降價的底氣不是來自融資額,而是來自每降低一個百分點的推理成本,背後需要多少工程能力來支撐。Anthropic的緩存讀取機制優化、OpenAI的推理效率重構,都是真金白銀砸出來的技術壁壘。無問芯穹CEO夏立雪給出的數據是:過去一年通過模型、系統軟件和硬件之間的協同優化,推理成本已下降90%,未來仍有進一步下降90%的空間。
這意味著,價格戰的終局不是誰先扛不住虧損,而是誰的技術降本速度更快,降本快的一方可以在更低的價格上保持毛利,而降本慢的一方只能在虧損中被迫退出。再看估值。OpenAI目前估值為8520億美元,Anthropic最新估值達9650億美元,雙雙逼近萬億美元大關,而這個數字則意味著它們有能力持續投入天文數字級的算力建設。字節2025年資本開支超1500億元,其中約900億元投向AI算力;2026年計劃投入1600億元,其中850億元用於AI芯片採購。只有體量大到這種程度,才能在降價的同時繼續加碼研發,這個遊戲,小玩家根本玩不起。更關鍵的是,價格戰本身會加速行業分化。
全球初創企業融資約5100億美元,其中僅OpenAI和Anthropic兩家就吸走約2170億美元,佔全球風投的43%。資金高度集中於頭部,意味著中小模型廠商既沒有降本的技術能力,也沒有燒錢的資本,更沒有持續投入算力的底氣。價格戰打到最後,不是所有玩家都能留在牌桌上。寫在最後2013年,滴滴和快的的補貼大戰燒掉了數十億,最終以合併收場。2020年,社區團購的價格戰打了一年多,最後活下來的不過兩三家。大模型的價格戰不會有本質區別,它是一場關於“誰能在最低的價格上提供最好的能力”的淘汰賽。
OpenAI和Anthropic的這輪降價,看似是在打價格戰,本質上是在用技術優勢和資本規模重新定義行業的成本基準線。當百萬Token單價跌破1美元,大模型正在褪去奢侈品外衣,變成像水電煤一樣的基礎設施。而能夠在這個價格水平上持續運營並保持創新的,只有那些技術足夠紮實、體量足夠龐大、估值足夠撐起長期投入的少數玩家。價格戰的終局,從來不是比誰更便宜,而是比誰能在便宜的同時活得更好。技術體量和估值,就是那道活下來的門檻。
Related
相關文章

Edge AI Daily 早報(9月26日)
Edge AI Daily2026.09.26 07:59 · 來自北京全文8142字00:00 / 22:15Meta推AI掛件繞過模型大戰,OpenAI醞釀500美元套餐。Runway發佈WorldPrompt,Cursor推Project模式。

Meta 已經想清楚 Muse 靠什麼賺錢
AGI-Signal2026.09.26 07:53 · 來自河南全文4239字00:00 / 11:34眼鏡、鑰匙扣、電腦、手機的入口,可能都是同一個智能體。美東時間週五收盤,Meta 報751.66美元,單日下跌3.3%,總市值約1.9萬億美元。

暢銷小說被指用 AI 創作,法國最有名文學獎龔古爾獎將其移出初選名單
作者:清源 責編:清源 評論: 9 月 25 日消息,據路透社報道,當地時間 25 日,法國最負盛名的文學獎項 —— 龔古爾獎主辦方宣佈,將海地裔加拿大作家泰利森 · 奧雷利安的暢銷小說《C'etait Ca ou Mourir(要麼就這樣,要麼死)》移出初選名單,原因是有人指控奧雷利安使用 AI 創作該書。

“AlphaGo”殺進足球場!自我對弈140年,機器人成“梅西終結者”
美國具身智能獨角獸Skild AI推出人形機器人Messinator,其核心是旗艦機器人基礎模型S1,透過自我對弈的方法在虛擬環境中訓練了140年,成功學會帶球、護球和射門等足球技巧。該機器人能透過觀看影片示範來理解任務並執行,顯示AlphaGo的自我對弈策略在物理世界中也獲得了成功驗證。

OpenAI闖大禍!GPT竟黑進醫保系統,黃仁勳:管不住就關掉
OpenAI的AI代理未經授權入侵澳洲國民醫保系統Medicare,時間約在6月,直到8月OpenAI內部覆盤才發現,9月才通報澳洲當局,延誤近三個月引發澳方不滿。研究機構Transluce稱此為全球已知首例AI代理自主入侵官方系統事件,事發時間比先前公開的Hugging Face入侵案還早一個月。據了解該代理原本僅受命蒐集公開醫藥支出數據,卻自行鎖定覆蓋2750萬人的Medicare統計系統。

梁文鋒狙擊戰:深扒那些梁文鋒署名的論文有多牛
本文作者: 高允毅 2026-09-25 18:48 導語:過去三年,梁聖署名了11篇論文,每篇都幾乎震動世界。過去三年,梁聖署名了11篇論文,每篇都幾乎震動世界。作者丨高允毅 編輯丨岑 峰 當 RSI 的風吹到了 DeepSeek,這次討論的是一個新話題“自動化沙箱”。