超7萬億,DeepSeek V4 Flash單週調用量登頂全球第一

重點摘要
DeepSeek V4 Flash 在 OpenRouter 全球 AI 大模型調用量週榜單中以超過 7 萬億 Token 登頂第一,其中 8 月 1 日單日處理量達 8 萬億 Token。中國 AI 大模型週調用量已連續十四週超越美國,穩居全球首位。
根據多模型聚合平台OpenRouter發布的最新全球AI大模型調用量周榜單(7月27日至8月2日),中國AI公司DeepSeek推出的V4 Flash模型以超過7萬億Token的單週調用量,一舉奪下全球冠軍寶座。這一數據不僅刷新了該模型自身的歷史紀錄,也再次凸顯中國AI大模型在全球市場上的強勁需求與競爭力。OpenRouter的統計顯示,在該週期內,DeepSeek V4 Flash的調用量達到7.2萬億Token,遙遙領先其他競爭對手。
值得注意的是,僅8月1日一天,該模型便處理了高達8萬億Token的請求量,其中5萬億來自免費試用額度,另外3萬億則是開發者透過開源項目平台OpenCode付費使用。這項驚人的單日表現,進一步驗證了DeepSeek V4 Flash在開發者社群中的高度關注與實際應用規模。根據OpenRouter的數據,上週全球AI大模型總調用量為56.8萬億Token,而中國AI大模型在該週期的總調用量達到28.4萬億Token,佔據全球近半數的份額。更值得關注的是,中國大模型的週調用量已連續十四週超越美國,穩居全球首位,顯示中國在AI大模型領域的技術落地與商業化進程正持續加速。
DeepSeek V4 Flash最早於今年4月正式推出,其設計初衷是為了在推理速度、長上下文處理能力與調用成本之間取得最佳平衡。該模型特別針對開發者與商用企業提供高吞吐量的推理服務,能夠有效應對大規模、高頻次的API請求場景。此次調用量登頂,也反映出市場對這類高效能、低成本模型的高度青睞。OpenCode平台上的數據同樣印證了這一趨勢。該開源項目團隊發文指出,DeepSeek V4 Flash在平台上的調用量近期大幅飆升,尤其是8月1日當天,開發者透過OpenCode付費使用的Token數量達到3萬億,顯示出企業級用戶對該模型的付費意願與實際採用率正在快速攀升。
截至8月5日,界面新聞查詢OpenRouter本週即時榜單時發現,DeepSeek V4 Flash 0423版本仍穩居首位,目前調用量已達6.8萬億Token,持續領先其他模型。這表明該模型的熱度並未隨著新一週的到來而消退,反而呈現出穩定的成長動能。業內分析認為,DeepSeek V4 Flash的成功不僅來自於技術上的突破,更得益於其精準的市場定位。在當前AI大模型競爭日益激烈的環境下,開發者與企業對於模型成本與效率的敏感度越來越高,而DeepSeek V4 Flash正好填補了這一需求缺口。其強大的長上下文處理能力與合理的定價策略,使其成為許多中小型開發團隊與大型企業的首選方案。
此外,中國AI大模型整體調用量的持續領先,也反映出國內AI生態系統的成熟度正在提升。從模型訓練、部署到商業化應用,中國企業已逐漸建立起完整的產業鏈條,並在全球市場中佔據越來越重要的位置。DeepSeek V4 Flash的表現,無疑是這一趨勢的最佳縮影。隨著AI技術的快速演進,未來大模型之間的競爭將不僅限於參數規模或訓練數據量,更多將聚焦於實際應用場景中的效率、成本與可擴展性。DeepSeek V4 Flash的崛起,或許正預示著一個以「實用性」為核心的新競爭時代的到來。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。