DeepSeek V4-Flash API開啟公測 速度與性價比全面碾壓GPT
重點摘要
AI資訊AI新閒資訊正文DeepSeek V4-Flash API開啟公測 速度與性價比全面碾壓GPT發布於AI新閒資訊時間 :Aug 3, 2026閱讀 :1分鐘近日,DeepSeek正式官宣旗下最新版本API開啟公測。作為一款備受矚目的AI產品,新版本在代理能力上實現了顛覆性升級,其基準測試成績甚至超越了以往的預覽版本,展現出極其強勁的綜合實力。
DeepSeek 近日正式宣布旗下最新版本 V4-Flash API 進入公開測試階段,引發業界關注。作為一款備受期待的 AI 模型,本次升級在代理能力上實現了大幅躍進,基準測試成績甚至超越先前推出的預覽版本,展現出強勁的綜合實力。消息一出,許多開發者與企業用戶隨即展開實測,試圖驗證這款新模型的實際表現。在實際應用測試中,有 AI 深度開發者將新版本 API 接入自己的系統進行比對。結果顯示,面對相同的高難度複雜任務與提示詞時,DeepSeek V4-Flash 僅耗費約 40 秒便完成執行,而海外同類頂尖大模型則需要 1 分 47 秒。
雖然在部分精細化輸出品質上,海外模型仍略佔上風,但 V4-Flash 的交付速度與可用性已達到業界高標準水準,對於追求即時回應的應用場景來說,無疑是一大突破。除了驚人的處理速度,價格與成本同樣成為本次升級的核心亮點。根據官方最新公布的定價機制,部分版本的輸入成本出現大幅下降,整體降幅相當顯著。不過,不同版本之間的策略各有側重,部分高效能或特定時段的 API 成本有所調整。整體而言,與海外主流官方大模型相比,國產 AI 在 API 定價上依然保持極具競爭力的優勢,成本差距普遍落在數十倍到上百倍之間。這意味著開發者能以更低的預算獲得高效的 AI 算力支援。
業內人士分析指出,隨著國產大模型在性能、速度與成本控制上的持續突破,AI 技術的商業化落地門檻正在進一步降低。未來,更多開發者與企業將有機會以極低的成本享受到高效的 AI 算力支援,進而帶動更多創新應用出現。整個行業生態可望迎來新一輪的格局重塑,而 DeepSeek V4-Flash 的登場正是這一趨勢的重要指標。值得注意的是,DeepSeek V4 正式版的發布時間先前一度傳出跳票消息。自 7 月中旬灰度測試後,官方始終未公布確切上線日期。然而,近期硅基流動平台發出通知,自 8 月 3 日起將 DeepSeek V4 Pro 的緩存命中價格從每百萬 Token 0.1 元大幅上調至 1.
0 元。這項突兀的漲價動作被外界視為 DeepSeek V4 正式版即將上線的重要信號,8 月 3 日被普遍認為是發布節點。如今 V4-Flash API 正是在這一天開啟公測,更讓外界對正式版的推出充滿期待。從整體產業角度來看,國產大模型的發展已進入全產業鏈突破階段。根據官方統計,國產大模型全球下載量已突破 100 億次,萬億級開源模型頻繁問世,人工智慧產業鏈正加速整合。國家發改委日前表示,上半年我國 AI 自主創新顯著加速,深度求索、月之暗面等公司陸續發布萬億參數開源大模型,下一步將統籌高品質發展與高水平安全,並加快《人工智慧法》立法進程。
這些政策與技術進展,為 DeepSeek 等新興模型提供了良好的發展環境。對開發者而言,DeepSeek V4-Flash API 的開放測試意味著可以立即體驗最新技術。由於其速度與成本優勢突出,尤其在需要大量 API 呼叫的場景中,能顯著降低營運成本。同時,模型在代理能力上的升級,讓開發者能夠更靈活地設計複雜的工作流程,例如自動化任務排程、多步驟推理等應用。未來隨著正式版推出,預期將有更多企業採用這套解決方案。另一方面,市場競爭也持續升溫。韓國 LG 旗下 AI 研究院於 7 月 31 日發布 K-EXAONE 2.
0 模型,總參數達 7500 億、激活參數 370 億,是初代規模的 3 倍以上,並以 Apache 2.0 完全開源,成為韓國最大 AI 基礎模型。這顯示全球 AI 大模型競賽已進入白熱化階段,不僅美國與中國持續投入,其他國家也積極推出主權級 AI 模型。DeepSeek V4-Flash 能否在國際市場中脫穎而出,仍有待觀察。綜觀整體,DeepSeek V4-Flash API 的公開測試不僅是技術層面的升級,更代表著國產 AI 在速度、成本與可用性上已達到足以與國際頂尖模型抗衡的水準。隨著公測期間的用戶反饋持續累積,官方預期將進一步優化模型表現,並為正式版的推出鋪路。
對於關注 AI 技術發展的開發者與企業而言,現在正是測試與評估這款新模型的最佳時機。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。