DeepSeek V4-Flash API開啟公測 速度與性價比全面碾壓GPT

2026年8月3日 01:315300 次瀏覽

重點摘要

AI資訊AI新閒資訊正文DeepSeek V4-Flash API開啟公測 速度與性價比全面碾壓GPT發布於AI新閒資訊時間 :Aug 3, 2026閱讀 :1分鐘近日,DeepSeek正式官宣旗下最新版本API開啟公測。作為一款備受矚目的AI產品,新版本在代理能力上實現了顛覆性升級,其基準測試成績甚至超越了以往的預覽版本,展現出極其強勁的綜合實力。

站內 AI 整理稿

DeepSeek 近日正式宣布旗下最新版本 V4-Flash API 進入公開測試階段,引發業界關注。作為一款備受期待的 AI 模型,本次升級在代理能力上實現了大幅躍進,基準測試成績甚至超越先前推出的預覽版本,展現出強勁的綜合實力。消息一出,許多開發者與企業用戶隨即展開實測,試圖驗證這款新模型的實際表現。在實際應用測試中,有 AI 深度開發者將新版本 API 接入自己的系統進行比對。結果顯示,面對相同的高難度複雜任務與提示詞時,DeepSeek V4-Flash 僅耗費約 40 秒便完成執行,而海外同類頂尖大模型則需要 1 分 47 秒。

雖然在部分精細化輸出品質上,海外模型仍略佔上風,但 V4-Flash 的交付速度與可用性已達到業界高標準水準,對於追求即時回應的應用場景來說,無疑是一大突破。除了驚人的處理速度,價格與成本同樣成為本次升級的核心亮點。根據官方最新公布的定價機制,部分版本的輸入成本出現大幅下降,整體降幅相當顯著。不過,不同版本之間的策略各有側重,部分高效能或特定時段的 API 成本有所調整。整體而言,與海外主流官方大模型相比,國產 AI 在 API 定價上依然保持極具競爭力的優勢,成本差距普遍落在數十倍到上百倍之間。這意味著開發者能以更低的預算獲得高效的 AI 算力支援。

業內人士分析指出,隨著國產大模型在性能、速度與成本控制上的持續突破,AI 技術的商業化落地門檻正在進一步降低。未來,更多開發者與企業將有機會以極低的成本享受到高效的 AI 算力支援,進而帶動更多創新應用出現。整個行業生態可望迎來新一輪的格局重塑,而 DeepSeek V4-Flash 的登場正是這一趨勢的重要指標。值得注意的是,DeepSeek V4 正式版的發布時間先前一度傳出跳票消息。自 7 月中旬灰度測試後,官方始終未公布確切上線日期。然而,近期硅基流動平台發出通知,自 8 月 3 日起將 DeepSeek V4 Pro 的緩存命中價格從每百萬 Token 0.1 元大幅上調至 1.

0 元。這項突兀的漲價動作被外界視為 DeepSeek V4 正式版即將上線的重要信號,8 月 3 日被普遍認為是發布節點。如今 V4-Flash API 正是在這一天開啟公測,更讓外界對正式版的推出充滿期待。從整體產業角度來看,國產大模型的發展已進入全產業鏈突破階段。根據官方統計,國產大模型全球下載量已突破 100 億次,萬億級開源模型頻繁問世,人工智慧產業鏈正加速整合。國家發改委日前表示,上半年我國 AI 自主創新顯著加速,深度求索、月之暗面等公司陸續發布萬億參數開源大模型,下一步將統籌高品質發展與高水平安全,並加快《人工智慧法》立法進程。

這些政策與技術進展,為 DeepSeek 等新興模型提供了良好的發展環境。對開發者而言,DeepSeek V4-Flash API 的開放測試意味著可以立即體驗最新技術。由於其速度與成本優勢突出,尤其在需要大量 API 呼叫的場景中,能顯著降低營運成本。同時,模型在代理能力上的升級,讓開發者能夠更靈活地設計複雜的工作流程,例如自動化任務排程、多步驟推理等應用。未來隨著正式版推出,預期將有更多企業採用這套解決方案。另一方面,市場競爭也持續升溫。韓國 LG 旗下 AI 研究院於 7 月 31 日發布 K-EXAONE 2.

0 模型,總參數達 7500 億、激活參數 370 億,是初代規模的 3 倍以上,並以 Apache 2.0 完全開源,成為韓國最大 AI 基礎模型。這顯示全球 AI 大模型競賽已進入白熱化階段,不僅美國與中國持續投入,其他國家也積極推出主權級 AI 模型。DeepSeek V4-Flash 能否在國際市場中脫穎而出,仍有待觀察。綜觀整體,DeepSeek V4-Flash API 的公開測試不僅是技術層面的升級,更代表著國產 AI 在速度、成本與可用性上已達到足以與國際頂尖模型抗衡的水準。隨著公測期間的用戶反饋持續累積,官方預期將進一步優化模型表現,並為正式版的推出鋪路。

對於關注 AI 技術發展的開發者與企業而言,現在正是測試與評估這款新模型的最佳時機。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

40 分鐘前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

4 小時前