OpenAI、Anthropic同日模型大戰,“是兄弟就砍一刀”

2026年9月24日 16:45
OpenAI、Anthropic同日模型大戰,“是兄弟就砍一刀”
站內 AI 整理稿

光錐智能2026.09.24 16:43 · 來自廣西全文3968字00:00 / 10:28刀刀見骨,AI巨頭為自己畫過的大餅“填窟窿”文|光錐智能,作者 | 魏琳華 ,編輯|劉俊宏9月23日凌晨,OpenAI和Anthropic像約好了一樣,前後腳各自放出新模型:OpenAI端出了GPT-6 Sol和GPT-6 Luna兩款模型,把旗艦GPT-6 Astra的能力蒸進更快更便宜的型號裡;Anthropic則亮出Claude Opus 5.5,性能追平Fable 5.1的同時,成本只有上代Opus 5的六成。

三個新模型,指向同一個判斷:當前大模型競爭的主戰場已經從“誰最聰明”轉到了“誰又強又便宜”。熟悉OpenAI的老朋友都知道,無論是趕當天發佈還是靠價格擠兌對手,都是它的老本行了。今年下半年,OpenAI釋放的降價信號愈發強烈:7月,OpenAI先是把GPT-5.6 Luna斷崖式降價80%,到8月再把旗艦模型GPT-5.6 Sol促銷再砍20%,再到這次GPT-6 Sol和Luna,OpenAI直接宣佈API價格永久下降50%——OpenAI正在用一種“刀刀見骨”的節奏,把模型調用成本打到行業新低。

OpenAI正在用低價搶用戶,延續它“大力出奇跡”的營銷策略,擠兌自己的老對手Anthropic,靠用戶講一個更漂亮的收入增長敘事。同一天的兩種不同“刀法”同日發佈的三個模型,各有各的精彩:OpenAI靠價格刀法讓人直呼真香,Anthropic則做到了又強又便宜,讓Opus 5.5重回大眾“白月光”的地位。先看OpenAI這邊,它這次推出的GPT-6 Sol和Luna兩款模型,是在GPT-6 Astra的基座上得來的性價比模型——通過調整推理效率和緩存機制,OpenAI把單位調用成本壓了下去。具體分工上,Sol定位面向編程等複雜工作負載,Luna則面向更輕量、高頻的推理場景。

兩款模型都支持105萬token的上下文窗口、12.8萬token的最大輸出,提供多檔推理強度。“智能已經足夠好”,性價比當道的今天,單次任務的成本花費比Benchmark的跑分更重要。在本次大模型發佈的介紹中,廠商開始秀起了自家模型完成任務的成本表現。在AutomationBench(跨應用業務流程測試)中,GPT-6 Sol在xhigh強度下取得33.2%的任務完成率,每項任務平均花費0.27美元,同樣的任務,放到Claude Opus 5上是11倍的價格。新一代模型的計價單位,也因此從“一次回答”變成了“一個任務的價格”。

從定價來說,OpenAI這次給到的誠意太大了,甚至試圖動搖DeepSeek的性價比地位。GPT-6 Sol的API輸入、輸出價格分別為每百萬token2美元和10美元,較GPT-5.6 Sol的促銷價格均下降一半。Luna的輸入價格從0.2美元降至0.1美元,輸出價格從1.2美元降至0.5美元。折算成人民幣,相當於DeepSeek V4.1 Flash的閒時價格(每百萬輸入1元,輸出4元)。當然,DeepSeek還是技高一籌,早早在DeepSeek V4.1 Flash上對緩存命中價格大展刀法,這是用戶必須花在上下文上的剛需成本。

所以OpenAI新模型發佈後,不少用戶自發對比兩者跑任務的價格,發現還是DeepSeek划算。此番網友口中的“梁聖”梁文鋒,依然笑傲春風。在能力上,GPT-6 Luna也被用戶質疑“開倒車”,似乎無法趕上上一代GPT-5.6 Luna。但看在價格的份上,好像又不是不能原諒。新模型的價格是上一代的一半,人送外號“更便宜的GPT-5.6 Luna”。再看Anthropic的Opus 5.5。如果說OpenAI走的是“旗艦下沉”路線,那Anthropic走的就是“夠強且更便宜”的路線。這就不得不讓人吐槽,Anthropic不地道。嘴上一邊喊著“放緩研究”,一邊端出來了Opus 5.5。

到底哪裡跑得慢了?作為Claude 5.5系列的首款模型,Anthropic稱,Opus 5.5在大多數工作中達到Fable 5.1的水平,同時比Opus 5更快、更便宜。其上下文窗口為100萬token,最大輸出為12.8萬token;輸入和輸出價格分別為每百萬token4美元和20美元,比Opus 5低20%。便宜還不止於單價。Opus 5.5完成任務時使用的token和工具調用也有所減少,緩存讀取價格從每百萬token0.5美元降至0.2美元——降幅高達60%。Anthropic自己算了一筆賬,它把典型工作負載成本下降40%,輸出速度還提升超過30%。這次,Opus 5.

5性能提升集中在長時間運行的編碼智能體和知識工作上。在更硬核的基準測試上,Opus 5.5在Terminal-Bench 4.0上得分66.4%,高於Fable 5.1(55.8%)和GPT-6 Astra(57.9%)。在衡量代碼修改能否真正合並進項目的FrontierCode 1.1上,Opus 5.5得分54.4%,高於GPT-6 Astra的53.3%。知識工作是Opus 5.5此次領先最明顯的方向。在覆蓋44種職業任務的GDPval-AA v2.1上,Opus 5.5得到1846分,高於Fable 5.1和Opus 5。

Anthropic甚至還沒把Fable系列的模型端出來,已經能用Opus 5.5和GPT-6 Astra掰腕子了。下一代旗艦模型能打成什麼樣,簡直想都不敢想。OpenAI和Anthropic雖然撞檔同一天,但這場模型比賽沒有“贏家通吃”的場景出現。實際上,它開啟的是一場錯位競爭——OpenAI用輕量模型走量、搶調用規模,Anthropic用Opus 5.5守住高價值的編碼和知識工作。兩者一個要規模,一個要客單價。為了撐起增長預期 OpenAI和Anthropic都急了把鏡頭拉遠,GPT-6 Sol和Luna的“永久半價”,是OpenAI第N次向價格揮刀。

在模型層,OpenAI的打法越來越清晰,它靠旗艦模型保住地位和利潤、輕量模型則變成了搶市場的主力。7月30日,OpenAI宣佈GPT-5.6 Luna輸入和輸出成本同時降低80%,中檔Terra降價20%;8月,GPT-5.6 Sol的API和額度價格又被下調20%。訂閱端,OpenAI則靠套餐的調整實現變相降價。1月,價格更低的Go套餐開始推向全球市場,美國定價為8美元;4月9日,OpenAI推出每月100美元的Pro檔;8月,面向企業用戶的Business(Premium seat)方案上線,年付100美元/月,額度是標準席位的5倍。從使用量來看,OpenAI降價的效果立竿見影。

全球大模型聚合平臺OpenRouter觀察了7-8月OpenAI的流量變化:其中,Luna的日均token調用量漲到降價前的13.8倍,Terra漲了5.6倍,此前一直按原價銷售的Sol只漲了1.1倍。同期被點名的競爭對手裡,只有Anthropic的調用量不升反降。OpenRouter還研究了一下模型後續的表現,證明雖然價格恢復,但一定程度上,OpenAI的用戶黏性變好了:在促銷期試用過Luna或Terra的十多萬客戶中,約32%在促銷結束後保留了部分用量。OpenAI為什麼要這麼急?因為賬本對面站著的是Anthropic,而對手正在收入上完成反超。

收入上,Anthropic二季度營收超過115億美元,較去年同期增長約14倍,同時首次錄得5.59億美元調整後營業利潤;OpenAI同期營收達到67億美元,環比增長18%,二季度經營虧損卻從一季度的93億美元擴大到123億美元。與此同時,OpenAI本身的收入卻並不理想。The Information報道稱,OpenAI今年前幾個月多次未能完成月度銷售目標,在編程和企業市場上把份額輸給了Anthropic。OpenAI CFO Sarah Friar曾向其他高管坦言,擔心收入增長不夠快、無力支付未來的算力合約承諾。因為OpenAI“欠的賬”實在是太多了。

對甲骨文,是約3000億美元、為期五年的雲算力採購;對微軟,是重組後仍要消化的約2500億美元Azure承諾;對亞馬遜,是約380億美元、為期七年的集群;對CoreWeave,還有約220億美元的GPU雲合約。當OpenAI的市場份額被競爭對手搶走,它的每一次降價,都是為了維持住自己曾經講過的增長敘事。鏡頭轉到另一邊,Anthropic也不輕鬆。GPT-6 Astra兩週搶走企業AI支出的13%份額,證明OpenAI能靠模型的性價比,切走更多市場份額。旗艦一旦夠用、價格又壓得住,企業預算會很快改道。這就預示著,一旦增長緩慢,Anthropic也會被賬單架在火上烤。

對亞馬遜AWS的承諾、對谷歌和博通的TPU採購,還得算上租SpaceX的機房,“哪哪也都是錢”。這一天兩家其實都在降價,每一次降價都是一次預付的賭注。但價格戰沒有終點,未來只有下一把刀。

Related

相關文章

智東西生成式AI

MiMo-V2.6剛發,小米羅福莉扔出MiMo-V3新架構!引用DeepSeek多項成果

(公眾號:zhidxcom) 作者 | 江宇 編輯 | 李水青 9月24日報道,昨晚,小米MiMo大模型負責人羅福莉發文,提前披露了MiMo-V3的新架構,其核心組件HySparse2率先登場,相關技術論文同步公佈。▲羅福莉發文 簡單來說,這套新架構主要解決Agent越做越多輪之後出現的三個問題:長輸入算得太多、緩存佔得太大,以及如何從越來越長的上下文裡準確找到需要的信息。

剛剛

騰訊混元推出"騰訊 Hy 翻譯"App:支持 33 種語言互譯,覆蓋 5 種民族語言

該產品基於騰訊混元 Hy-MT2 翻譯模型打造,支持 33 種語言互譯,並覆蓋 5 種中國少數民族語言及方言,提供語音翻譯、拍照翻譯與離線翻譯等多種方式。離線可用、覆蓋港澳臺及東南亞據介紹,離線翻譯模式下用戶可提前將翻譯模型下載至手機,在沒有網絡或信號不佳時仍能穩定使用。

剛剛

消息稱DeepSeek年化收入突破10億美元,擬募資500億元衝刺上交所上市

該業績躍升主要得益於近期產品定價的上調,以及其系列模型在開發者與企業端持續攀升的採用率。DeepSeek首席執行官梁文峰在近期舉辦的投資者會議上披露了這一核心財務數據。此舉被視為在資本市場關鍵節點提振投資人信心的重要舉措——目前DeepSeek正接近完成第二輪融資,並緊鑼密鼓地籌備在上海證券交易所上市。

剛剛