DeepSeek V4 Pro 編程測評奪亞:分數僅輸 Kimi K3,成本卻只有對手十四分之一
AI資訊AI新閒資訊正文DeepSeek V4 Pro 編程測評奪亞:分數僅輸 Kimi K3,成本卻只有對手十四分之一發布於AI新閒資訊時間 :Aug 14, 2026閱讀 :1分鐘CLUE 團隊最新發佈的 SuperCLUE-Terminal 中文智能體終端編程測評榜單顯示,DeepSeek-V4-Pro-0813 拿下 51.52 分,在所有參測模型中位列第二,僅落後於登頂的 Kimi K3。更值得注意的是,它在取得這一成績的同時保持著極低的調用成本,性價比優勢在一眾高分模型中格外突出。
該榜單專門面向國內開發者設計,全部採用本土真實編程任務,並統一以 Claude Code 作為運行框架,公平對比各大模型理解中文需求、規劃任務、調用工具及排錯改代碼的完整能力。評測的真實感來自其任務設定:每道考題需要模型完成 50 至 110 輪交互,單題完整運行耗時半小時到一小時半,能高度還原日常開發中的複雜工作流。本輪榜單中 Kimi K3 以 60.61 分排名第一,DeepSeek-V4-Pro-0813 緊隨其後,分數高於 GLM-5.2 的 48.48 分和老版 DeepSeek-V4-Flash 的 46.46 分,穩居第一梯隊。1.
42 元單題成本,硬剛頂級算力最亮眼的是 DeepSeek-V4-Pro-0813 的成本控制:單題調用成本僅約 1.42 元,大約是 Kimi K3 的十四分之一、GLM-5.2 的十六分之一。在頭部模型比拼分數往往只差幾分的當下,這種數量級的成本差距,意味著中小團隊用得起"接近頂級"的代碼能力,而不必為每一次交互支付高昂算力費。從實測場景看,該模型覆蓋了前端頁面、3D 遊戲和工程腳本修改等真實需求,能完整閉環遊戲開發邏輯,碰撞、計分、結算功能均運轉正常,頁面配色與交互反饋也擺脫了模板化的 AI 風格。少數創意繪圖類題目會出現結構小瑕疵,但整體完成度仍處於領先水平。
對預算敏感的中小企業和獨立開發者而言,DeepSeek-V4-Pro-0813 用"第二名的分數、十四分之一的價格"重新定義了編程模型的性價比基準——當頂級能力不再意味著頂級開銷,AI 編程的普及門檻正在被真正拉低。相關推薦深夜震撼發佈:DeepSeek V4 Pro正式版亮相,比肩頂尖Fable大模型8月13日AI產品密集發佈,馬斯克推出Grok4.6、千問開源Qwen3.8Max。DeepSeek同步低調上線V4Pro正式版DeepSeek-V4-Pro-0813,API與Chat端均已更新,用戶按原方式指定名稱即可接入。官方跑分顯示其核心指標表現優異。Aug 13, 2026279.
1k從萬億開源到國產算力協同:Kimi K3 與摩爾線程智算卡完成全棧適配月之暗面於7月28日開源2.8萬億參數大模型Kimi K3,支持100萬token上下文與視覺理解,採用KDA混合注意力機制。同日,摩爾線程宣佈基於MTT S5000智算卡完成對其的快速適配與穩定運行,實現國產算力與開源大模型的協同突破。Jul 29, 2026229.4k國產 GPU 再添一員猛將:摩爾線程拉起 2.8 萬億參數 Kimi K3,MUSA 棧跑通開源巨模型摩爾線程宣佈已為月之暗面開源的2.
8萬億參數Kimi K3模型完成適配,基於自研MTT S5000訓推一體卡與MUSA軟件棧,實現極速穩定運行,為國產算力支撐萬億大模型再添底氣。Jul 29, 2026191.1k國產 GPU 也能跑萬億大模型:海光 DCU 適配 Kimi K3,896 專家並行不卡頓海光DCU完成萬億參數大模型Kimi K3全棧適配與驗證,標誌著國產算力首次穩穩支撐此類超大模型。通過底層算子到推理引擎的深度優化,模型無需任何代碼改動,遷移成本近乎零,開發者拿到算力即可部署。同時針對KDA注意力與896專家MoE架構實現從容兼容,打破海外旗艦芯片壟斷,提供開箱即用的國產方案。Jul 28, 2026221.
9kKimi K3 開源首夜至少 18 家美國企業火速部署Kimi K3權重昨夜在Hugging Face開源後,諷刺一幕立即上演:儘管美國政府與Anthropic等斥巨資遊說封殺中國開源模型,至少18家美國企業仍第一時間完成部署並對外提供商業服務。網友Ding彙總的名單,將華盛頓的政治敘事與硅谷的務實理性之間的裂痕暴露無遺,頂級性能與極致性價比讓商業理性壓倒政治表態。Jul 28, 2026239.9k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”
阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

月之暗面第一代萬億參數多模態模型 Kimi K2.5 官宣月底結束服役
作者:歸瀧 責編:歸瀧 評論: 8 月 24 日消息,月之暗面 Kimi 官方微博今日宣佈,其第一代萬億參數多模態模型 —— Kimi K2.5 本月底即將結束服役。據此前報道,今年 1 月,月之暗面宣佈推出並開源了其最新的 Kimi K2.

消息稱知名 AI 研究員 Luke Metz 離開 OpenAI,加入 Meta 超級智能實驗室
作者:遠洋 責編:遠洋 評論: 感謝網友 華南吳彥祖 的線索投遞!8 月 24 日消息,據知情人士向 Axios 證實,知名 AI 研究員 Luke Metz 已加入 Meta 的超級智能實驗室(Superintelligence Labs)。

Anthropic 最強大模型 Fable 5 遇冷,企業用戶轉向更便宜 AI 產品
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,據英國《金融時報》報道,Anthropic 的美國客戶正在使用更便宜的替代品來替代其最強大的 AI 工具,這在其預計將實現有史以來規模最大的 IPO 之前,對其高支出的商業模式提出了質疑。

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。
