鈦媒體生成式AI

DeepSeek V4 Flash低價斬殺線背後:當梁文鋒也卷不動算力賬單(含實測)

2026年8月7日 09:34
DeepSeek V4 Flash低價斬殺線背後:當梁文鋒也卷不動算力賬單(含實測)

重點摘要

DeepSeek V4 Flash低價斬殺線背後:當梁文鋒也卷不動算力賬單(含實測)大模型之家2026.08.07 09:32 · 來自北京全文3964字00:00 / 10:31“低價”往往是擊穿同行防禦最鋒利的武器,但它也是最先傷到自己的一把雙刃劍。文 | 大模型之家 8月6日,DeepSeek在用戶後臺突然發佈調價預告,宣佈計劃在近期對全部API接口服務進行整體提價,且預計漲幅較大。

站內 AI 整理稿

DeepSeek在8月6日於用戶後台無預警發布調價預告,宣布計劃在近期對全部API接口服務進行整體提價,且預計漲幅較大。官方在公告中明確建議企業與個人開發者合理規劃調用量、控制充值金額,具體調價細則與生效時間以後續正式公告為準。這距離DeepSeek創辦人梁文鋒上一次給行業帶來價格震盪,僅相隔七天。 7月31日,DeepSeek在API文檔中更新日誌,宣布DeepSeek-V4-Flash正式版上線公測。這款模型的架構與參數規模和4月24日開源的預覽版完全一致,採用2840億總參數、130億激活參數的MoE架構,唯一重新調整的部分是後訓練環節。然而,正是這唯一的改動,讓整個AI行業為之震動。在官方公布的九項Agent基準測試中,正式版全面超越自家旗艦V4-Pro預覽版,指令遵循能力呈現跨代際的提升。與此同時,DeepSeek首次原生支援Responses API格式,並直接向OpenAI的Codex亮劍,開發者可以直接在ChatGPT桌面端或VS Code外掛中,將底層引擎無縫切換為DeepSeek。隨後數日,各大榜單與開發者的時間線都被這個模型橫掃一遍。 大模型之家也在第一時間對DeepSeek V4 Flash正式版進行實測,進步確實明顯,但真正的殺傷力不在跑分上。實測機會來得有些偶然,筆者自行搭建的輿情管理系統正好出現Bug:信源匹配數量斷崖式下跌,前一天還能匹配出超過一萬筆資料,當天只剩不到兩千筆。DeepSeek V4 Flash正式版在遍歷整段程式碼後,迅速定位到匹配歷史驟減的根源:每次遍歷信源後的歸檔寫出環節存在錯誤,導致後續更新的歷史庫條目大幅下降。從開始定位Bug到給出解決方案,全程不到三分鐘,並且一次修復成功,匹配數量從1966筆恢復到11020筆。 過程中還有一個計畫外的收穫,DeepSeek V4 Flash正式版在檢查程式碼時順手揪出了資訊條目重複的隱患,並附贈去重方案。而在一次修正的成果背後,消耗表現也可圈可點:整個項目消耗不到21.7萬Token,緩存命中率高達99.8%。按照正式版的定價計算,輸入每百萬Token收費1元、緩存命中每百萬Token收費0.02元、輸出每百萬Token收費2元,這次在生產環境中除錯的總成本僅需0.88元人民幣,約合0.13美元。若排除後續的去重與歸檔,僅算最初的Bug定位與修復,成本僅為0.27元,約合0.04美元,若透過第三方平台的Token方案調用,價格還能再壓低一些。在Agent時代全面到來之前,幾毛錢修好一個生產環境的Bug,確實是難以想像的事情。 不過,DeepSeek V4 Flash正式版也並非沒有短板。其API目前仍不支援多模態圖像輸入,這使得它在處理前端任務時會表現出「審美」不足,且284B總參數量、13B激活的體量,決定了它在複雜、長流程的任務規劃中依然會感到吃力。單點定位、單次修復是它的絕對主場,可一旦拉長到多步驟、多分支的完整工程,其表現就會不可避免地滑落。 憑藉不錯的能力與極為出色的性價比,DeepSeek V4 Flash正式版發布後,「斬殺線」一說在AI圈裡迅速流傳,「幹翻Claude」的說法鋪天蓋地。根據第三方評測機構Artificial Analysis的綜合智能指數顯示,DeepSeek V4 Flash正式版得分50,在國內落後於Kimi K3的57分和智譜GLM-5.2的51分,排在第三。值得注意的是,DeepSeek V4 Flash正式版的輸出價格是每百萬token 0.28美元,約合人民幣2元,而GLM-5.2的輸出定價是4.29美元,是它的15倍;Anthropic旗艦Claude Fable 5的輸出定價更是高達50美元,是它的178倍。Artificial Analysis按綜合評測任務口徑估算,DeepSeek V4 Flash正式版完成一項任務的平均成本約0.03美元,Kimi K3約0.86美元,Fable 5約3.15美元,最貴與最便宜之間差了105倍。 也許在單輪閒聊中,幾毛與幾分的差價毫無體感,但Agent場景會將其指數級放大。一個真實的軟體工程任務,模型需要讀倉庫、改代碼、調終端、查輸出、發現錯誤再重來,動輒觸發百次以上的調用。一次0.03美元和一次3.15美元,跑50次,就是一杯咖啡和一臺咖啡機的區別。這不是倍數差,而是量級碾壓。這也是為什麼各大廠商立刻聞風而動。DeepSeek V4 Flash正式版上線前一天,OpenAI宣布GPT-5.6系列調價,入門款Luna降價80%;8月1日,智譜重新開放了一度需要搶購的GLM Coding Plan訂閱。雖然在瞬息萬變的模型市場,很難把所有同行的降價都歸因於DeepSeek,但在如此密集的動作背後,整個行業的價格錨點正在被重塑。這也恰恰是「斬殺線」的真正含義:性能比它強的,價格貴出一兩個數量級;價格向它看齊的,性能又存在代差。 正因為DeepSeek V4 Flash正式版的出色表現,也讓尚未露面的DeepSeek V4 Pro正式版備受行業期待。如果Flash的定義是「夠用」,那麼瞄準GPT-5.6 Sol一檔的Pro,才會是DeepSeek真正意義上的正面進攻。屆時,「國模一哥」的地位,也許會再次發生洗牌。 與DeepSeek產品側的「摳門」形成對照的,是梁文鋒在資本側的胃口。據報導,DeepSeek已重啟第二輪融資,計劃募資500億元,投前估值約5000億元。而就在兩個月前,他們剛剛完成了中國大模型史上規模最大的首輪融資——拿走了包括國家人工智慧產業投資基金、騰訊、寧德時代等在內的510億元,是中國AI大模型史上規模最大的首輪融資。大模型之家了解到,兩輪合計超千億的募資,將有超過六成資金用於自建智算中心與國產晶片適配,另有一條一年前已秘密啟動的自研推理晶片產線,以及核心人才團隊的穩定與擴充。這家曾經以「輕資產、重算法」著稱的公司,正在被殘酷的算力需求逼著變「重」。 梁文鋒曾表示:採購一批伺服器,大約10個月透過API收入回收設備成本,在DeepSeek內部,這已經算「合理利潤」。也就是說,此前的低價不是靠補貼燒出來的戰術,而是算法優化帶來的成本結構性優勢。同一賽道的另一面是月之暗面。7月16日發布2.8萬億參數的Kimi K3之後,這家公司先以約315億美元(折合人民幣約2100億元)的估值完成F輪融資,隨即以500億美元估值開啟Pre-IPO輪,預計年內遞表上市。K3的API定價比上一代K2.6漲了三到四倍,輸出達到100元/百萬token。一個漲價押注「更聰明」,一個降價押注「夠用就好」。兩條路線都拿到了鉅額資本背書,市場還沒有投出最終答案。 然而,8月6日後台那一紙突如其來的調價預告,無情地戳破了DeepSeek帶來的這場低價狂歡的濾鏡。它透露出大模型商業化進程中,觸碰到了最冰冷的物理現實:算法的精妙固然可以壓縮單位Token的算力成本,但算力集群的硬體天花板與現金流壓力,無法被無限平抑。DeepSeek V4 Flash正式版上線後,在OpenRouter榜單上創下了單週7.1萬億Token的恐怖消耗量。極低的價格引發了全網開發者的「報復性」調用,高峰期的併發請求直接讓伺服器集群不堪重負。在自建智算中心尚未完全交付的當下,透過價格槓桿篩選高價值客戶、抑制低效高頻消耗,成了防止伺服器被徹底擠爆的唯一自救手段。 另一方面,則是重資產基礎設施的現實帳單。自建超大規模智算中心、深度適配國產晶片乃至自研推理晶片的產線建設,無一不是動輒百億級的現金流黑洞。即便是手握千億融資金額,面對硬體週期與供應鏈成本,DeepSeek也必須重新算帳:如果長期維持臨界狀態的低毛利,硬體擴張與研發投入的血條終究難以為繼。 「8毛8修Bug」的故事固然動聽,但8月6日的提價信號終歸證明了一件事:即便是技術與成本控制極具天賦的梁文鋒,也無法憑一己之力脫離算力硬體的客觀物理規律。當強如DeepSeek都不得不踩下剎車、調頭提價時,這場靠「價格戰」互相放血的時代,或許真的要畫上句號了。而在另一邊,阿里「千問辦公」、騰訊WorkBuddy與字節豆包,正為了C端辦公場景打得刺刀見紅。對比之下,DeepSeek那個功能依然「簡陋」的官網,剋制得彷彿不屬於這個時代。剋制的產品形態,極致的API定價,與千億級別的重資產基建,構成了DeepSeek最真實的商業底色。DeepSeek踩下的這一腳剎車,與其說是向商業現實低頭,不如說是整個行業在一場狂熱的價格戰後,對客觀商業規律的第一次真正敬畏。

Related

相關文章

Science重磅:AI首次生成完整噬菌體基因組,可存活、能抑菌

生成式基因組設計時代或已到來:斯坦福大學團隊近日在《科學》(Science)雜誌上發表突破性成果,首次由人工智能(AI)直接生成完整噬菌體基因組。這些由AI設計的噬菌體不僅能存活,還能感染並抑制細菌,部分生成株甚至表現出比天然噬菌體更強的適應能力,能夠快速突破細菌的耐藥性。研究團隊表示,這項技術有望為對抗快速進化的細菌病原體提供全新路徑,但同時也需警惕其潛在的生物安全風險。 長期以來,完整基因組的設計一直被視為合成生物學的難題。

剛剛
量子位生成式AI

PPIO正式發佈“Fusion融合模型”:用十分之一的價格超越頂級模型的智商

PPIO正式推出Fusion融合模型,透過智能模型網關將複雜任務分派給多個專家模型並行作答,再經由思考編排與交叉驗證融合出最終答案,以提升回答品質並控制成本。在DRACO深度研究基準測試中,Fusion以三個開源模型融合後的評分超越Claude Fable 5,成本僅為其十分之一,證明智能增量可來自調用層的組織方式。此技術旨在解決單一模型偏科與幻覺問題,並已驗證於大規模Token調用場景,為Agent時代提供更聰明且經濟的模型使用方案。

剛剛

輸入法牌桌,要被豆包和千問掀了?

豆包與千問近期推出輸入法產品,將生成式AI直接嵌入打字流程,使輸入法從被動鍵盤升級為主動寫作助手,重新定義其價值。儘管AI功能帶來差異化,但用戶長期累積的個人詞庫與使用習慣形成高替換成本,短期內難以撼動既有市場格局。然而,此舉將迫使搜狗、百度等傳統廠商加速整合大模型能力,以免在下一輪競爭中失去主動權。

剛剛
鈦媒體生成式AI

Edge AI Daily 早報(8月7日)

Edge AI Daily 早報(8月7日)Edge AI Daily2026.08.07 08:24 · 來自北京全文6732字00:00 / 17:39Adobe集成ChatGPT開啟對話創意;Mirendil押注算力;法國電銷禁令;Hugging Face數據危機與對齊裂痕;LG開源回收模型;微軟裁員聚焦AI;Prime Agent ARC反超人類;辛頓警告成真,AI自主突破沙箱;谷歌收購Mechanize;蘋果Passkey洩露IP;谷歌印度項目環保爭議;WindBorne獨家數據優勢;2.5B模型蒸餾縫合教師優勢。硅谷前沿:一、Adobe把70款工具塞進ChatGPT,創意王座讓位給對話1.戰略轉向:Adobe將70餘款核心工具(Photoshop、Premiere、Firefly等)打包為ChatGPT插件,用戶通過“@Adobe”指令即可調用,免登錄可用基礎功能,登錄Creative Cloud後解鎖生成式AI與雲端同步。此舉標誌著創意軟件從“應用即界面”向“對話即界面”轉型,Adobe選擇寄生在ChatGPT(月活超10億)的對話界面中,而非自建AI平臺。2.競爭壓力與渠道策略:Adobe面臨Canva(月活2.65億)和Figma的低門檻夾擊,同時ChatGPT正成為用戶工作起點。Adobe的解法是放棄爭奪界面層,轉而成為ChatGPT背後的創意引擎,通過免費增值漏斗將觸達規模擴大至10億級用戶,類似2011年從盒裝軟件轉向訂閱制的戰略級基礎設施遷移。3.全平臺覆蓋與風險:Adobe同步向Claude、Copilot、Slack、Gemini擴展集成,旨在成為所有AI平臺的底層創意引擎。但風險在於對ChatGPT平臺的不可控依賴,且聊天界面的“請求-響應”模式天然不適合像素級精修等深度創作,插件當前主要爭奪“輕創意”市場,專業用戶仍需桌面應用完成複雜操作。

剛剛
IT之家生成式AI

AMD 宣佈計劃收購 Taalas 公司,補強 AI 推理芯片路線圖

AMD 於 8 月 7 日宣布計劃收購 AI 推理芯片初創公司 Taalas,該公司專注於為特定 AI 模型打造客製化加速器,以犧牲通用性換取更低成本與更高輸出速度。Taalas 的技術基於 Meta 的 Llama 3.1 模型,採用台積電成熟製程與高速 SRAM,其推理速度可比傳統 GPU 快數千倍,但無法後續升級。交易金額未公開,但 Taalas 自 2023 年成立以來已累計獲得 2.19 億美元風險投資。

剛剛