DeepSeek-V4-Flash正式版上線,130億激活參數撬動Agent戰場

2026年7月31日 07:30

重點摘要

DeepSeek-V4-Flash正式版API上線,以130億激活參數在多項Agent基準測試中接近三個月前的V4-Pro預覽版,並推出自研Agent框架DeepSeek Harness。該模型支援OpenAI的Responses API,旨在以高性價比輕量模型搶攻Agent應用市場,顯示公司正加速商業化進程。

站內 AI 整理稿

DeepSeek 於7月31日低調推出 V4-Flash 正式版 API,並開放公測。這款模型被視為該公司在 Agent 領域的重要佈局,也打破了過去「Pro 版強、Flash 版弱」的產品分層邏輯。根據官方釋出的數據,V4-Flash 正式版在多項 Agent 基準測試中的表現,已經逼近甚至超越三個月前推出的 V4-Pro 預覽版,顯示出輕量級模型在特定任務上的潛力。 具體而言,V4-Flash 正式版在 Terminal Bench 2.1 測試中獲得 82.7 分,在 Cybergym 測試中取得 76.7 分,在 Toolathlon verified 測試中則為 70.3 分。這些成績與過去 Pro 版本主導的格局形成對比,也讓外界關注到 DeepSeek 如何透過訓練方法與數據質量的優化來縮小模型之間的差距。 值得注意的是,V4-Flash 正式版的總參數量高達 2840 億,但每次推理時實際激活的參數僅有 130 億。相比之下,V4-Pro 的激活參數為 490 億,兩者相差將近一個數量級。DeepSeek 特別強調,此次更新「僅重新進行了後訓練」,模型結構完全沒有改變。這意味著,透過更有效的訓練策略與更高品質的數據,輕量模型在特定任務上已能與旗艦模型一較高下。 除了模型本身,DeepSeek 也在這次更新中首次正式公開其自研的 Agent 框架,命名為 DeepSeek Harness。該框架的出現,進一步強化了公司在 Agent 應用生態中的技術底座。同時,V4-Flash 正式版原生支援 OpenAI 力推的 Responses API 格式,並針對 Codex 進行了適配。開發者可以低成本地將原本建立在 OpenAI 生態上的 Agent 應用遷移至 DeepSeek 平台,這無疑降低了轉換門檻,也為 DeepSeek 爭取更多開發者用戶鋪路。 從戰略角度來看,DeepSeek 的目標相當明確:用高性價比的輕量模型切入 Agent 應用市場。Agent 場景對推理速度與成本極為敏感,尤其是在需要反覆調用工具的多輪任務中,Flash 系列的低價優勢將形成顯著競爭力。相較於旗艦模型的高昂成本,輕量模型更適合大規模部署與商業應用,這也解釋了為何 DeepSeek 選擇在此時強化 Flash 版本的表現。 這一系列動作背後,還有資本市場的支撐。此次 V4-Flash 正式版的發布,距離 DeepSeek 完成超過 500 億元人民幣的首輪融資還不到兩個月。當時公司估值已攀升至約 710 億美元,顯示市場對這家國產大模型公司的信心。在資金加持下,DeepSeek 正加速從過去「不融資、不上市」的保守姿態,轉向積極的商業化衝刺。 隨著 V4-Pro 正式版即將到來,DeepSeek 在 Agent 領域的戰爭已經正式拉開序幕。Flash 版本的推出不僅是產品線的補強,更是對整個 AI 應用生態的一次策略性試探。未來,當更多開發者開始將 Agent 應用部署在低成本、高效率的模型上時,DeepSeek 能否憑藉這套組合拳站穩腳跟,將是業界關注的焦點。

Related

相關文章

AI日報:MiniMax發佈全模態模型H3;Seedance 2.5發佈,30秒一鏡到底;DeepSeek-V4-Flash正式版上線

AI資訊最新AI日報正文AI日報:MiniMax發佈全模態模型H3;Seedance 2.5發佈,30秒一鏡到底;DeepSeek-V4-Flash正式版上線發布於最新AI日報時間 :Jul 31, 2026閱讀 :2分鐘歡迎來到【AI日報】欄目!這裡是你每天探索人工智能世界的指南,每天我們為你呈現AI領域的熱點內容,聚焦開發者,助你洞悉技術趨勢、瞭解創新AI產品應用。

25 分鐘前

韓國最大 AI 模型問世:LG 發佈 7500 億參數 K-EXAONE 2.0,Apache 開源直面中國模型

LG AI研究院發布韓國最大AI基礎模型K-EXAONE 2.0,總參數達7500億,採用混合注意力MoE架構,並以Apache 2.0許可證完全開源。該模型在多項基準測試中表現優於初代,同時在長上下文理解與智能體工具使用等能力上直接對標智譜GLM-5.1、Qwen3.5等中國開源模型,顯示東亞開源AI競爭加劇。

26 分鐘前5500

顛覆影視創作!字節跳動王牌模型Seedance 2. 5 正式發佈, 30 秒一鏡成片時代來了

字節跳動Seed團隊正式推出新一代音視頻聯合生成模型Seedance2.5,主打「一鏡成片」,單次生成時長由15秒提升至30秒,並支援多輪無縫延長。模型強化長敘事、多模態參考與後期編輯能力,並優化材質、光影與膚質,呈現更接近實拍的影視級質感。目前Seedance2.5正陸續登陸即夢AI、豆包專業版,API則將於近期上線火山方舟。

26 分鐘前6700

特斯拉中國車機正式接入豆包大模型

特斯拉中國自7月31日起分批次推送2026.14.13版車機軟體更新,涵蓋Model 3、Model Y、Model S與Model X等車型,核心升級是正式導入豆包大模型。該模型可提供即時資訊查詢與自然流暢的語音對話,提升車內智慧互動體驗,但需開通高級車載娛樂服務才能使用。

26 分鐘前6600

DeepSeek-V4-Flash API公測上線 Agent能力全面爆發

AI資訊AI新閒資訊正文DeepSeek-V4-Flash API公測上線 Agent能力全面爆發發布於AI新閒資訊時間 :Jul 31, 2026閱讀 :1分鐘科技圈迎來新一輪效率革命。字節跳動旗下 Seed 團隊正式推出了Seedance2.5音視頻聯合生成模型,主打“一鏡成片”能力,全面賦能多個產業場景。在敘事表現上,Seedance2.

26 分鐘前8100