超7萬億,DeepSeek V4 Flash單週調用量登頂全球第一

2026年8月5日 15:51
超7萬億,DeepSeek V4 Flash單週調用量登頂全球第一

重點摘要

DeepSeek V4 Flash 在 OpenRouter 全球 AI 大模型調用量週榜單中以超過 7 萬億 Token 登頂第一,其中 8 月 1 日單日處理量達 8 萬億 Token。中國 AI 大模型週調用量已連續十四週超越美國,穩居全球首位。

站內 AI 整理稿

根據多模型聚合平台OpenRouter發布的最新全球AI大模型調用量周榜單(7月27日至8月2日),中國AI公司DeepSeek推出的V4 Flash模型以超過7萬億Token的單週調用量,一舉奪下全球冠軍寶座。這一數據不僅刷新了該模型自身的歷史紀錄,也再次凸顯中國AI大模型在全球市場上的強勁需求與競爭力。OpenRouter的統計顯示,在該週期內,DeepSeek V4 Flash的調用量達到7.2萬億Token,遙遙領先其他競爭對手。

值得注意的是,僅8月1日一天,該模型便處理了高達8萬億Token的請求量,其中5萬億來自免費試用額度,另外3萬億則是開發者透過開源項目平台OpenCode付費使用。這項驚人的單日表現,進一步驗證了DeepSeek V4 Flash在開發者社群中的高度關注與實際應用規模。根據OpenRouter的數據,上週全球AI大模型總調用量為56.8萬億Token,而中國AI大模型在該週期的總調用量達到28.4萬億Token,佔據全球近半數的份額。更值得關注的是,中國大模型的週調用量已連續十四週超越美國,穩居全球首位,顯示中國在AI大模型領域的技術落地與商業化進程正持續加速。

DeepSeek V4 Flash最早於今年4月正式推出,其設計初衷是為了在推理速度、長上下文處理能力與調用成本之間取得最佳平衡。該模型特別針對開發者與商用企業提供高吞吐量的推理服務,能夠有效應對大規模、高頻次的API請求場景。此次調用量登頂,也反映出市場對這類高效能、低成本模型的高度青睞。OpenCode平台上的數據同樣印證了這一趨勢。該開源項目團隊發文指出,DeepSeek V4 Flash在平台上的調用量近期大幅飆升,尤其是8月1日當天,開發者透過OpenCode付費使用的Token數量達到3萬億,顯示出企業級用戶對該模型的付費意願與實際採用率正在快速攀升。

截至8月5日,界面新聞查詢OpenRouter本週即時榜單時發現,DeepSeek V4 Flash 0423版本仍穩居首位,目前調用量已達6.8萬億Token,持續領先其他模型。這表明該模型的熱度並未隨著新一週的到來而消退,反而呈現出穩定的成長動能。業內分析認為,DeepSeek V4 Flash的成功不僅來自於技術上的突破,更得益於其精準的市場定位。在當前AI大模型競爭日益激烈的環境下,開發者與企業對於模型成本與效率的敏感度越來越高,而DeepSeek V4 Flash正好填補了這一需求缺口。其強大的長上下文處理能力與合理的定價策略,使其成為許多中小型開發團隊與大型企業的首選方案。

此外,中國AI大模型整體調用量的持續領先,也反映出國內AI生態系統的成熟度正在提升。從模型訓練、部署到商業化應用,中國企業已逐漸建立起完整的產業鏈條,並在全球市場中佔據越來越重要的位置。DeepSeek V4 Flash的表現,無疑是這一趨勢的最佳縮影。隨著AI技術的快速演進,未來大模型之間的競爭將不僅限於參數規模或訓練數據量,更多將聚焦於實際應用場景中的效率、成本與可擴展性。DeepSeek V4 Flash的崛起,或許正預示著一個以「實用性」為核心的新競爭時代的到來。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

42 分鐘前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

4 小時前