DeepSeek V4「滿血版」曝光了,最快明天發佈

重點摘要
DeepSeek V4 正式版最快明日發布,分為 Flash 與 Pro 兩個版本,性能接近 Opus 級別但價格更具競爭力。此次更新首次引入「峰谷計費」機制,API 定價在離峰時段更為優惠,整體性價比依舊突出。
睽違近三個月,DeepSeek 新一代旗艦模型 V4 正式版(GA)終於傳出即將發布的消息。外界預期這款被稱為「滿血版」的模型最快將在明(21)日上線,最晚也不會拖延太久。消息指出,部分開發者已經搶先取得灰度測試的權限,率先體驗到 DeepSeek V4 Flash 與 DeepSeek V4 Pro 兩個版本,而一般使用者是否也中選,則可以透過一個簡單的「民間口訣」來驗證。 判別自己是否被納入灰度測試的方法,目前流傳最快的方式是觀察模型思考鏈(Chain of Thought)的第一人稱用詞。如果模型開始思考時的口吻是「I'm」或「I'll」,而不是先前熟悉的「Let me」,那麼就代表你很可能已經用上了 V4 正式版。這個由社群歸納出來的辨識技巧,從側面反映出 V4 在內部推理機制上已經做了明顯調整。 目前已有開發者搶先釋出使用心得。開發者 Pankaj Kumar 在試用後給出初步結論:V4 整體表現已逼近 Opus 4.8 的水準,編碼能力更是直接向 GPT-5.6 Sol 看齊;Agent 任務處理能力大幅增強,3D 場景與 SVG 等視覺內容生成也較前一版進步不少。不過他也指出,執行相同任務時,V4 所需的迭代輪數仍比 Fable 5 多一些。從目前的生態位來看,V4 在基準測試上可能還是不及才剛登場的 Kimi K3,但關鍵優勢在於價格將會顯著更低。若性能真能搭配極具競爭力的定價,業內認為這很可能再次上演一場「DeepSeek 時刻」。 動態展示成果也陸續在社群流傳。像是 V4 Pro 版本生成的一款 3D 模擬射擊遊戲,核心玩法操控攻城弩車進行打靶訓練,基本的 UI 介面與互動功能一應俱全;另一款融合《我的世界》與《無人深空》風格的網頁遊戲 HTML 檔,也被認為可玩性相當高。知名益智遊戲《割繩子》的單次生成版本同樣獲得關注,此外還有 Xbox 手把 SVG 繪圖等多種創作範例,讓外界一窺 V4 在獨立生成完整應用上的潛力。 最令市場關注的變數,仍是 DeepSeek 慣有的定價策略。目前所有消息源都指向同一個方向:V4 的性能或許不是同代中最強,但價格絕對會維持顯著優勢。上個月月底,DeepSeek 已向所有 API 用戶發出郵件預告,表示將在 7 月中旬正式推出 V4,並且會調整 API 計費模式,首次導入「峰谷計費」機制。 根據流出的新定價方案,DeepSeek-V4-Pro 百萬輸出 tokens 平常時段收費 0.87 美元,高峰時段為 1.74 美元;緩存未命中的輸入 tokens 平常為 0.435 美元。更為輕量的 DeepSeek-V4-Flash 百萬輸出則僅需 0.28 美元,高峰 0.56 美元,而緩存命中時的輸入 tokens 更只有 0.0028 美元。換句話說,一向被稱為「價格屠夫」的 DeepSeek,第一次在算力使用上也加入了分時計價的概念。 對個人開發者而言,這樣的調整影響有限;但對於那些把 Agent 服務放在工作時間內長時間執行的團隊來說,這一筆成本確實需要重新估算。值得注意的是,緩存命中的計費仍然極低,因此若能將批量任務、評測跑分或資料生成等工作移到離峰時段進行,整體費用還是可以壓在可控範圍內。相較之下,同樣定位為頂級競品的 Fable 5,百萬輸出定價高達 50 美元,V4 在性價比上的優勢依然非常突出。 效能方面,DeepSeek 在 V4 預覽版階段就曾揭露內部評測數據。在 SWE-bench Verified 測試中,DeepSeek-V4-Pro-Max 與 Claude Opus 4.6 Max 的差距僅落在 0.2 個百分點,但價格卻只有對方的七分之一。而在長上下文檢索、專業軟體工程以及部分知識推理項目中,Opus 仍然保持一定領先。此外,官方也提醒,舊版模型名稱 deepseek-chat 與 deepseek-reasoner 將於 7 月 24 日正式下線,使用者必須留意更換。 這三個月來,外界對於 DeepSeek V4 的期待不斷升溫。如今隨著發布日期逼近,可以確認的是,V4 很可能不會在每項指標上都拿下第一。前方有 Fable 5 與 GPT-5.6 Sol 領跑,側翼又面臨 Kimi K3 的競爭,V4 若只靠純粹的算力競賽來翻轉局面的確難度不小。但從歷史脈絡來看,DeepSeek 從來沒有打算打最強參數這張牌;真正的致勝棋路始終是那條不斷被驗證的老路徑:把 Opus 級以上的模型能力,用七分之一甚至更低的價格提供給市場。 即便現在裝上了「峰谷計價器」,在巨頭們動輒百萬 tokens 數十美元收費的環境下,V4 依然有機會展現價格屠夫的實力。這隻懸了三個月的靴子即將落地,無論性能排序最終如何,一個讓更多開發者「用得起」的頂尖模型,其影響力恐怕遠不止於跑分榜的高低。
Related
相關文章

阿里甩出“配音”神器:能調整情緒,還會說方言
阿里旗下的千問大模型推出語音合成工具Qwen-Audio-3.0-TTS,支援情緒調整、方言及多語種,並可透過自然語言指令控制語氣與場景。該模型在第三方評測中獲得語音合成榜單第一,具備高品質的聲音復刻與抗噪能力。

手機、座艙、具身,中國最大端側獨角獸低調交出高分卷
面壁智能作為中國最大端側獨角獸,於WAIC展示手機、汽車、機器人等端側AI落地成果,並與三星、吉利等企業合作。該公司強調端側AI產業化需超越模型本身,建立跨終端適配、生態與標準,正逐步成為端側智能產業定義者。

關於面壁智能,聊聊我的一些新思考
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

Token收費,不再“天經地義”?
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

AI眼鏡繼續進化:不只看見,還要辦事
過去兩年,大模型技術加速導入智慧眼鏡,翻譯、拍攝等應用功能密集問世,成為市場主流。然而,隨著這些能力逐漸成為標配,AI眼鏡所面臨的新課題也隨之浮現——業界開始思考,如何讓眼鏡從「看見」進化到「辦事」,真正成為能主動協助用戶完成任務的隨身裝置。

16萬Star的OpenCode徹底重寫:API全部重做、Bun換Node、桌面端遷移Electron
擁有超過 16 萬顆 GitHub 星星、每月活躍開發者高達 750 萬人的開源專案 OpenCode,在 2026 年 7 月正式推出了 2.0 版本。這不僅是一次例行更新,而是從底層架構到使用者體驗的全面翻新。聯合創始人 Dax Raad 在近期受訪時坦言,這是他職業生涯中「第三次才做對」的產品:0 是原型試水,1.x 是市場驗證,而 2.0 則是在徹底理解整個領域後,從零開始的推倒重來。 這次重寫的核心變革之一,就是完全重構了應用程式介面(API)。