左手推Harness,右手漲價:DeepSeek為何把開發者往外推?

大模型之家2026.08.17 19:04 · 來自北京全文3038字00:00 / 08:30絕對的低價終究只是梁文峰刺破商業壁壘的一柄短刃,而非能夠長期持有的壁壘。文|大模型之家8月17日零點,DeepSeek新一版峰谷價格體系正式生效,平均漲幅大約為3.5倍,最高可達12倍。這標誌著這家曾以極致性價比席捲國內大模型市場的企業,正式按下了全面漲價的按鈕。然而,就在83天前的5月22日,DeepSeek才剛剛高調宣佈將其V4-Pro預覽版模型限時折扣轉為“永久價格”,降幅高達75%。
在這短短不到三個月的時間裡,這張曾被全行業奉為價格底線的價目表被徹底改寫,“永久”二字在此刻充滿了一種反常識的戲劇性反諷。價格底線崩塌:12倍漲幅背後的算力賬這次漲價的幅度,不僅打破了既有的市場預期,更像是一次對全行業API分發體系的強行重置。根據8月17日生效的最新規則,在每天的業務高峰時段(北京時間9:00-12:00、14:00-18:00),DeepSeek V4 Pro模型的緩存命中輸入價格從0.025元/百萬Token飆升至0.3元,漲幅達到原來的12倍。其緩存未命中輸入價格也同步上漲200%至9元,而最核心的輸出價格則從6元暴漲350%至27元。
即便是同步調整的V4 Flash模型,其輸出價格同樣經歷了350%的躍升,達到了9元/百萬Token。即使在半價的閒時,其調用成本也遠超此前宣稱的底價。價格權力的傳導鏈條展現出了極強的同步性。作為DeepSeek的重要合作方,騰訊雲CloudBase幾乎在同一時間官宣,完全跟隨官方同步調整定價並引入相同的峰谷機制,價格做到分毫不差。與此同時,阿里雲百鍊以及硅基流動等處於同一價格傳導鏈條上的託管方,也必然面臨著成本的重新核算與對沖壓力。
Agent時代的“產能反噬”對於這輪劇烈的價格上漲,DeepSeep官方只是輕描淡寫地表示是為了“更合理地分配資源、提升服務穩定性”,試圖用峰谷錯峰的邏輯來平息開發者的算力焦慮。但撕開這層表象,真正扼住大模型咽喉的,是算力產能面對指數級需求時的斷崖式枯竭。相關數據展現出的消耗速度極為驚人。在8月3日至8月9日當週,V4-Flash的單週調用量已突破8.83萬億Token,環比暴增570%,位居全球第一。在OpenCode平臺上,僅8月1日單日就處理了8萬億Token,其中有高達5萬億來自免費額度的消耗。這種物理極限的背後,是Agent時代的結構性反噬。
在單純的對話交互時代,單次任務的上下文往往不足兩千,但在Agent編排與多步推理工作流爆發的當下,單次任務消耗50萬甚至100萬Token已經成為常態。可見,DeepSeek此時的調價更像是產能已經根本無法支撐如此龐大的吞吐量,服務頻繁出現“繁忙”與“超時”,漲價是硬件物理極限的必然反撲。在物理極限之外,漲價亦是一場精準的商業收割。創始人梁文鋒在流出的投資人閉門交流中曾坦露過其硬核的定價哲學:以購買服務器“10個月收回成本”作為倒推基準,只賺取約6倍的合理利潤。
在極低的價格區間內,開發者對價格的敏感度極低,屬於典型的無彈性需求;此時將價格翻倍,Token的消耗總量並不會發生數量級的衰減,而總營收卻能實現近乎翻倍的飆升。有專業人士測算指出,調價後的V4 Pro真實毛利率可能回升至72%到81%之間。這表明,漲價並非單純為了覆蓋初期的虧損,而是為了匹配未來龐大的資本開支,回應資本市場對商業可持續性的嚴厲關切,尤其是在公司籌備境內IPO的傳聞愈演愈烈的背景下。開源外衣與昂貴詞元:生態構建的內在悖論在發佈漲價公告的8月13日同一晚,DeepSeek打出了一套極具迷惑性的組合拳:它將自家的Agent運行時框架Harness以MIT協議全面開源。
這款被定位為“一切皆插件”的執行層框架,直接對標OpenAI的Codex與Anthropic的Claude Code,支持多Agent編排、上下文管理與沙箱調度,試圖用絕對的開放性將開發者鎖死在自家的生態中。短短24小時內,該項目在GitHub上狂攬超9.6萬顆Star,展現出強大的社區號召力。與此同時,V4-Pro的權重也同步MIT開源,進一步降低了私有化部署的門檻。然而,DeepSeek一邊用免費的頂級框架招徠開發者,另一邊卻在同一天大幅抬高了餵給這個框架的算力成本,想要培養繁榮的開發者生態,卻又親手推高了開發者的調用門檻。
首當其衝的,恰恰是那些通過API將模型深度接入企業級產品、構建複雜業務流的中小開發者,而這群人,正是Harness最迫切渴望吸引的核心受眾。一邊推出Harness,一邊token漲價,DeepSeek意欲何為?在大模型之家看來,從商業自洽的角度來看,開源框架與權重是為了搶佔開發者的心智與基礎設施話語權,而API漲價則是為了在雲端服務上賺取利潤,兩者邏輯並行不悖。但從開發者的體感來看,“大門敞開,但電費暴漲”的落差是真實存在的。長期來看,這種策略有可能會將部分輕量級創新者推向價格更低廉的第三方託管平臺。那個“便宜到完全沒有對手”的價格戰,已經徹底終結。
定價全面上移:大模型告別“低價時代”拉長視線來看,DeepSeek的漲價並非孤例,它實質上引爆了全行業定價中樞上移的強烈外溢效應。進入2026年以來,行業的漲價潮已經全面鋪開:智譜AI年內三次提價,一季度提價約83%後,調用量依然實現了400%的逆勢增長,驗證了優質模型具備量價齊升的基礎。月之暗面Kimi K3將輸出價格拔高至百元級別,較前代漲超3.5倍。阿里雲、百度智能雲等底層雲廠商,也悄然將算力產品價格上調了5%到34%。在大洋彼岸,OpenAI同樣在進行精密的分層洗牌,將入門級Luna模型降價80%以瘋狂引流,卻為旗艦級Sol模型推出定價翻倍的Fast模式,變相推高了高端生產力的門檻。
長期以來,DeepSeek扮演著國內大模型市場的“絕對價格錨”。如今,這個錨點的鬆動,實質上為整個行業釋放了壓抑已久的定價空間,全行業走向分層定價、按價值收費的格局已初步確立。OpenRouter的數據顯示,截至6月初,中國模型的Token處理份額已經超越美國,成為全球AI基礎設施不可忽視的底座。然而,開放權重的模型處理了全平臺29%的Token,卻僅僅分享了不到4%的支出規模。中國模型在國際市場上長期扮演著“廉價”的角色,海量的使用量並未等比例轉化為迴流原廠的實際收入。從這個意義上說,DeepSeek的本輪漲價,是中國模型試圖將“全球技術影響力”翻譯成真實“商業賬本”的第一次實質性衝鋒。
大模型市場的價格戰,正在從“誰的底線更低”的初級戰場,升級到了“誰的模型更聰明、服務更穩定、能更深地嵌進企業工作流”的價值深水區。基礎的閒聊交互將逐漸失去溢價能力,而真正具備編程與Agent調度能力的生產力工具,必將賣出與其價值相符的昂貴价格。DeepSeek在83天后的這一腳急剎車,宣告了整個狂熱的人工智能行業,開始對殘酷的商業規律產生真正的敬畏。
Related
相關文章

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”
阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

月之暗面第一代萬億參數多模態模型 Kimi K2.5 官宣月底結束服役
作者:歸瀧 責編:歸瀧 評論: 8 月 24 日消息,月之暗面 Kimi 官方微博今日宣佈,其第一代萬億參數多模態模型 —— Kimi K2.5 本月底即將結束服役。據此前報道,今年 1 月,月之暗面宣佈推出並開源了其最新的 Kimi K2.

消息稱知名 AI 研究員 Luke Metz 離開 OpenAI,加入 Meta 超級智能實驗室
作者:遠洋 責編:遠洋 評論: 感謝網友 華南吳彥祖 的線索投遞!8 月 24 日消息,據知情人士向 Axios 證實,知名 AI 研究員 Luke Metz 已加入 Meta 的超級智能實驗室(Superintelligence Labs)。

Anthropic 最強大模型 Fable 5 遇冷,企業用戶轉向更便宜 AI 產品
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,據英國《金融時報》報道,Anthropic 的美國客戶正在使用更便宜的替代品來替代其最強大的 AI 工具,這在其預計將實現有史以來規模最大的 IPO 之前,對其高支出的商業模式提出了質疑。

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

企業AI最後一公里:三路人馬在此交鋒
鄭敏芳 發表於 2026年08月24日 03:09 摘要:尋找自己的位置 2026年世界機器人大會現場,談到這一輪突然走紅的FDE(前線部署工程師),明略科技CEO吳明輝先把時間往回撥了十多年。“12年前我們就在非常認真地研究。”當華爾街見聞·問及FDE與傳統軟件部署有什麼區別時,吳明輝說,兩者都會進入客戶現場,但今天的FDE需要做得更深:一邊把Agent接進真實業務,一邊把現場形成的能力繼續沉澱回後臺。