DeepSeek V4“滿血版”曝光了,最快明天發佈

2026年7月19日 13:27
DeepSeek V4“滿血版”曝光了,最快明天發佈

重點摘要

DeepSeek V4正式版最快明天發佈,分為Flash與Pro兩個版本,性能接近Opus級別,編碼能力直追GPT-5.6 Sol。該版本首次引入「峰谷計費」機制,價格極具競爭力,可能再次創造「DeepSeek時刻」。

站內 AI 整理稿

DeepSeek V4 正式版終於要來了。根據最新消息,這款備受期待的「滿血版」模型最快可能在明天(7月20日)正式發布,最晚也不會超過這幾天。距離上一版預覽版推出後,外界已經等了將近三個月。目前,已經有一部分用戶提前拿到了 DeepSeek V4 正式版的灰度測試權限。這次一共推出兩個版本,分別是 DeepSeek V4 Flash 和 DeepSeek V4 Pro。對於許多關注的使用者來說,最想知道的就是自己到底有沒有被選入灰度測試名單。有網友分享了一個簡單的辨別方法:觀察模型思考過程的第一人稱用詞。

如果模型的思考過程開頭是「I'm」或「I'll」,而不是舊版的「Let me」,那就代表你很可能已經用上了 V4 正式版。在當前 Fable 5 與 GPT-5.6 Sol 持續競爭的背景下,外界對於開源 AI 模型的期待值相當高。一位名為 Pankaj Kumar 的開發者在體驗過後,對 V4 的表現給出了中肯的評價。他認為整體表現已經接近 Opus 4.8 的水準,編碼能力更是直追 GPT-5.6 Sol;在代理(Agent)能力方面有顯著提升,3D 和 SVG 生成的品質也變得更好。不過,他也觀察到,在執行同樣的任務時,V4 所需的迭代輪數比 Fable 5 還要多。

從目前的生態位來看,他認為 V4 可能還打不過剛推出的 Kimi K3,但價格肯定會低很多。如果這樣的性能配上這樣的價格,或許會再次重現所謂的「DeepSeek 時刻」。關於 V4 的首輪測試成果也已經開始在網路上流傳。外界對於這款新模型的看法呈現兩極化:有人認為它已經能夠與 Claude 5 平起平坐,但也有開發者指出,Pro 版本並未比 Flash 版本領先太多。從流出的 demo 來看,V4 Pro 能夠生成 3D 模擬射擊遊戲,核心玩法是操控攻城弩車進行打靶訓練,基礎的 UI 功能也相當完備。

此外,它還能打造出結合《我的世界》與《無人深空》風格的混合遊戲 HTML,以及經典的「割繩子」遊戲,整體可玩度相當高。其他像是 Xbox 手把的 SVG 測試和遊戲生成,也都能一次完成。在價格方面,DeepSeek 這次首次引入了「峰谷計費」模式,這也成為外界關注的焦點。所有跡象都顯示,雖然性能可能不是第一,但價格絕對會比競爭對手低很多。上個月底,DeepSeek 已經向所有 API 用戶發送郵件,預告將在 7 月中旬上線 V4 正式版,並同步調整 API 定價,導入尖峰與離峰時段的計費機制。具體來說,DeepSeek V4 Pro 的百萬輸出 tokens 在離峰時段為 0.

87 美元,尖峰時段則為 1.74 美元;緩存未命中的輸入 tokens 在離峰時段為 0.435 美元。而 DeepSeek V4 Flash 的價格更是驚人,百萬輸出 tokens 僅需 0.28 美元,尖峰時段為 0.56 美元,緩存命中的輸入 tokens 更是低至 0.0028 美元。這意味著,過去那個從不漲價的「價格屠夫」,現在也開始為自己的算力資源裝上了計價器。對於個人用戶來說,這樣的價格調整影響不大,但對於那些需要長時間運行代理(Agent)的團隊來說,這筆帳就得重新算了。

好消息是,緩存命中的價格依然極低,只要把批量任務、評測跑分或數據生成等工作移到離峰時段進行,成本還是可以壓得下來。相較於 Fable 5 百萬輸出定價 50 美元,V4 在性價比上依然極具優勢,畢竟性能也達到了 Opus 等級。回顧 V4 預覽版發布時,官方在 SWE-bench Verified 的測試中,DeepSeek V4 Pro Max 的表現距離 Claude Opus 4.6 Max 僅差 0.2 個百分點,但價格卻只有對方的七分之一。不過,在長上下文檢索、專業軟體工程以及部分知識推理評測中,Opus 仍然保持領先。

另外,舊版的 deepseek-chat 和 deepseek-reasoner 兩個模型也將在 7 月 24 日正式下線。整體來看,外界苦等三個月的 DeepSeek V4 正式版,總算要揭曉了。從目前流出的資訊判斷,V4 或許不會是那個「全項第一」的模型,畢竟 Fable 5 和 GPT-5.6 Sol 在前,Kimi K3 也在側,要單靠性能掀起波瀾並不容易。但 DeepSeek 的強項向來不是純性能競爭,而是那條被反覆驗證的老路:把 Opus 等級的能力,價格壓到七分之一。即便現在裝上了峰谷計價器,在動輒百萬 Token 幾十美元的巨頭面前,V4 依然是那個大殺四方的「價格屠夫」。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

41 分鐘前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

4 小時前