0.1 分性能差,60倍價格差:不甘“平替”,DeepSeek雙殺硅谷

財經故事薈2026.08.13 15:30 · 來自北京全文2631字00:00 / 06:52不甘當平替,DeepSeek價格戰價值戰都要打。文 | 財經故事薈018月12日深夜,DeepSeek官網API文檔悄然換版——V4 Pro預覽版切換為正式版。作為性價比之王,DeepSeek這次也摸到了全球大模型的性能天花板。Terminal Bench 2.1(衡量AI智能體在真實終端環境完成任務的能力):V4 Pro 87.9分,全球第一的Anthropic Fable 5是88.0分,差距只剩0.1。三個月前,V4 Pro預覽版這個成績還是72.1分。三個月,躍升15.8分。
更狠的是兩項反超。AI安全智能體測試Cybergym上,V4 Pro 83.3分,壓過Fable 5的83.1;工作流智能體測試AutomationBench上,31.8對29.1,V4 Pro直接贏。衡量軟件工程能力的DeepSWE,從12.8分飆到62.7分,近五倍躍升,超過了Anthropic上一代旗艦Opus 4.8的58.0分。這不是紙面題庫的分數內卷。Terminal Bench、DeepSWE 這類評測,考察的是 AI 能不能真正 “幹活”—— 自主進入終端裝環境、敲命令、排查報錯,讀懂完整代碼倉庫、處理複雜工程問題、調用多步工具完成長鏈條任務。
這些能力,正是大模型從聊天玩具走向生產工具的核心門檻。換句話說,DeepSeek 這次補上的不是 “考試分數”,是真實場景的戰鬥力。當然客觀來看,在純知識推理、超複雜全棧軟件工程等場景,V4 Pro 和全球最頂尖模型仍有細微差距,多模態能力也尚未補齊。梁文鋒此前在和投資人的對談中也承認,“我們跟美國的差距可能是落後美國 12 個月,在總體算力還是有數量級差距的情況下,全面超越是不現實的。”但差距正在持續縮小,回看DeepSeek今年的軌跡:4月V4發佈,API以2.
5折優惠上線;5月優惠結束後直接永久降至原價四分之一,降幅75%;V4 Flash單週調用量突破 7 萬億 Token 登頂全球第一。長期以來,"價格屠夫"是它最鮮明的標籤——性能不差,但和頂尖模型之間,還隔著一段可以感知的性能距離。這段差距,在8月12日深夜被壓縮到了0.1分。02性能逼近,價格碾壓。Fable 5每百萬輸出Token定價50美元,GPT-5.6 Sol Max 30美元,Grok 4.6 6美元,DeepSeek V4 Pro僅0.87美元——約為Fable 5的五十七分之一。緩存命中輸入更是低到0.0036美元,比Fable 5便宜數百倍。0.
1分的跑分差距,60倍的價格鴻溝。這個等式,足以讓開發者重新審視自己的技術選型——過去用 DeepSeek,是 “簡單任務省成本”;現在用 DeepSeek,是 “性能摸到第一梯隊,還能省一大筆錢”。過去,DeepSeek的故事是”便宜夠用"。現在,故事變成了"又強又便宜"。就在V4 Pro上線前幾個小時,馬斯克的xAI發佈了Grok 4.6,在GDPVal-AA v2評估中以1753 Elo登頂,超過Fable 5的1741和GPT-5.6 Sol Max的1728。兩款主打高性價比的模型同夜撞車,改寫全球大模型定價規則,真正感到有壓力的,恐怕是OpenAI與Anthropic。
V4 Pro的強大性能,也給了DeepSeek漲價的底氣。就在上線六天前的8月6日,DeepSeek剛掛出一紙漲價預告:“計劃近期整體上調API服務定價,預計漲幅較大。”剛敲定融資卻選擇漲價,這更像是主動的定價策略切換,而非被動的成本轉嫁。摩根士丹利8月9日的研報說得很直白:模型智能,而非價格,才是大模型競爭的終極壁壘。當V4 Pro距Fable 5僅差0.1分時,DeepSeek已經有資格為這份”足夠接近"收取溢價。當然,漲價完畢之後,DeepSeek依然有數量級的成本優勢。整個行業也在同步轉向。中國大模型平均API輸出價格已從2025年一季度的12.
2元/百萬Token回升至2026年二季度的21.9元。智譜漲價83%調用量反而增長400%;月之暗面K3發佈後請求量逼近集群極限暫停新用戶訂閱;騰訊兩輪上調API價格部分漲幅達463%。價格戰的終局信號已經出現。03比漲價更值得關注的,是一個更宏觀的趨勢:中國大模型正在拿下全球定價權。過去,大模型的定價權牢牢握在硅谷手裡。OpenAI定一個價,全行業跟;Anthropic出一個檔位,開發者照著算成本。中國廠商的定價策略本質上是”跟隨者”——別人定多少,我打個折,性能比不了,就拼性價比。現在,定價權正在易主。DeepSeek V4 Pro以0.
87美元的輸出定價,直接把"準Fable級Agent能力"的價格錨定在了硅谷旗艦的60分之一。這個價格錨點不是跟隨出來的,是中國廠商主動定義的。當全球開發者在選型時開始以DeepSeek的價格為參照系——"這個能力值不值這個價"——定價權就已經不在硅谷手裡了。不止DeepSeek。
截至 8 月 3 日 - 9 日當週,中國大模型在 OpenRouter 平臺已連續 15 周調用量超過美國,穩居首位;美國企業調用中國AI模型的Token佔比每週穩定在30%以上,峰值達46%;近200家硅谷初創企業聯名致信美國政府,反對限制使用中國開源模型——他們不是在頭腦發熱,表達政治立場,是在用腳投票保護自己的成本結構。性能逼近,價格碾壓,全球開發者用腳投票——中國大模型正在完成從”跟隨者”到”定價者"的角色轉換。當最擅長打價格戰的玩家開始收槍,當0.
1分的性能差距配上60倍的價格優勢,中國大模型行業的競爭邏輯,已經翻過了一頁——過去DeepSeek靠成本優勢橫掃市場,現在性能優勢也逼近了。對於硅谷來說,一個又強又便宜的對手,比一個只是便宜的對手可怕得多。
Related
相關文章

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”
阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

月之暗面第一代萬億參數多模態模型 Kimi K2.5 官宣月底結束服役
作者:歸瀧 責編:歸瀧 評論: 8 月 24 日消息,月之暗面 Kimi 官方微博今日宣佈,其第一代萬億參數多模態模型 —— Kimi K2.5 本月底即將結束服役。據此前報道,今年 1 月,月之暗面宣佈推出並開源了其最新的 Kimi K2.

消息稱知名 AI 研究員 Luke Metz 離開 OpenAI,加入 Meta 超級智能實驗室
作者:遠洋 責編:遠洋 評論: 感謝網友 華南吳彥祖 的線索投遞!8 月 24 日消息,據知情人士向 Axios 證實,知名 AI 研究員 Luke Metz 已加入 Meta 的超級智能實驗室(Superintelligence Labs)。

Anthropic 最強大模型 Fable 5 遇冷,企業用戶轉向更便宜 AI 產品
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,據英國《金融時報》報道,Anthropic 的美國客戶正在使用更便宜的替代品來替代其最強大的 AI 工具,這在其預計將實現有史以來規模最大的 IPO 之前,對其高支出的商業模式提出了質疑。

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。
