大模型價格戰下半場:將推理價格打下去

重點摘要
DeepSeek創始人梁文峰在投資會上表示,芯片價格過高影響低成本目標,公司已秘密啟動自研推理芯片一年。隨著AI大模型商業落地,推理芯片成本成為主要支出,DeepSeek等廠商透過降價策略競爭,包括永久折扣和峰谷定價機制。
大模型價格戰下半場:將推理價格打下去司庫商業·2026年07月24日 21:03推理才是難題 “買一批設備回來,10個月收回成本就夠了,希望能以合理價格買到芯片,這樣就不用自己做芯片了”,近日在投資會上,DeepSeek 創始人梁文峰道出了自己的苦惱,現在的芯片價格太貴了,無法滿足DeepSeek對於大模型低成本的需求。值得注意的是,在本次投資會之前,就有媒體爆料稱:DeepSeek開始自研定製的推理芯片,已經秘密啟動一年時間,並與芯片設計公司、晶圓代工廠及存儲廠商展開多輪接洽。
從中我們不難看出,主打低價格的DeepSeek正在遭遇芯片的成本危機,隨著AI大模型的商業落地和Token的大規模調用,曾經被邊緣化的推理芯片正在取代訓練芯片,成為AI大模型廠商的主要成本支出。那麼對於以DeepSeek為代表的主打低價格的大模型廠商來說,如何進一步降低推理芯片的價格,將成為大模型企業的核心競爭力。【1】DeepSeek帶動行業降價 2026年,對於國內大模型產業來說,是集體降價衝刺的一年: 5月23日,DeepSeek宣佈將V4-Pro模型的“折扣優惠”正式變成了永久性的“降價通知”,原先2.5折的專業版模型API調用價格,變成了“永久2.
5折”;此後更是推出類似電價的峰谷定價機制,根據不同時間段動態調整API價格; 5月28日,小米旗下MiMo-V2.5全系列API接口永久下調資費,部分細分調用場景降價比例逼近99%,並宣佈不再區分上下文窗口長度,統一按低價計費,解決開發者長文本處理的成本焦慮。6月底,騰訊雲平臺內上線的DeepSeek-V4全系列模型同步下調調用價格,最高降幅達到97.
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。