騰訊CodeBuddy全面支持DeepSeek-V4-Flash正式版,Agent能力大幅提升
重點摘要
騰訊CodeBuddy宣布全面支援DeepSeek-V4-Flash正式版,旗下WorkBuddy、CodeBuddy IDE、插件及CLI全系列產品皆已完成適配。新模型在AI Agent能力上有顯著提升,於相關基準測試中大幅領先前一版本,為開發者提供更高效的智慧編程體驗。
騰訊旗下開發工具CodeBuddy近日宣布全面支援最新一代大語言模型DeepSeek-V4-Flash正式版,旗下WorkBuddy、CodeBuddy IDE、各類插件以及命令列工具(CLI)全系列產品均已同步完成適配。這項更新代表開發者將能在統一的開發環境中直接調用最新模型,獲得更順暢、更高效的智能編寫體驗。據官方介紹,DeepSeek-V4-Flash正式版在AI Agent能力上實現了顯著躍升。在相關基準測試中,該模型的表現大幅領先於先前推出的DeepSeek-V4-Pro-Preview版本,印證了其在任務理解與自動執行方面的突破。
這項進步主要源自針對程式碼生成、任務執行以及複雜開發流程的深度優化,讓模型能夠更精準地掌握開發者的意圖,並自動完成多步驟操作。具體而言,DeepSeek-V4-Flash正式版在程式碼補全、錯誤偵測、重構建議等常見場景中展現出更優異的表現。更重要的是,其增強的Agent能力使模型不再只是被動回應用戶提問,而是能夠主動拆解任務、調用外部工具、執行運算,並根據結果動態調整下一步動作。這種從「代碼補全」到「完整任務執行」的進化,正是當前智能編程工具競爭的核心方向。CodeBuddy作為騰訊推出的開發輔助平台,一直致力於將大語言模型能力與實際開發流程深度融合。
此次全面支援DeepSeek-V4-Flash,開發者無論是在IDE中編寫程式碼,還是透過插件在VS Code、JetBrains等主流編輯器中使用,甚至是通過命令列執行自動化腳本,都能享受到模型帶來的效率提升。WorkBuddy則進一步將AI能力延伸至項目管理與團隊協作場景,讓整個開發團隊可以基於統一的模型底座進行協作。業界觀察指出,隨著AI Agent能力走向成熟,開發工具正面臨新一輪的典範轉移。傳統的補全式輔助正在被端到端的任務自動化所取代。
模型需要具備更強的推理能力,才能在複雜的程式碼庫中準確定位問題;需要更優的工具調用能力,才能操作資料庫、API、版本控制系統等外部資源;需要更完善的項目處理能力,才能管理大型軟體工程的依賴關係與構建流程。DeepSeek-V4-Flash在這些面向的提升,使其成為當前市場上極具競爭力的選擇。此次接入也進一步擴大了國產大模型在開發工具生態中的應用範圍。過去,開發者主要依賴國外閉源模型,如今以DeepSeek為代表的國產開源模型正在快速縮小差距。CodeBuddy率先完成適配,不僅為國產模型提供了實際落地的應用場景,也為開發者提供了更多元化的選擇。
用戶無需自行配置模型環境,即可在熟悉的開發工具中一鍵啟用最新能力,大幅降低了使用門檻。目前,開發者已可通過WorkBuddy及CodeBuddy系列產品,直接體驗基於DeepSeek-V4-Flash正式版的AI開發功能。無論是個人開發者還是企業團隊,都能藉此提升程式碼編寫、除錯、審查及項目管理的自動化水平。隨著模型持續迭代,未來CodeBuddy還將進一步挖掘Agent能力的潛力,為軟體開發全流程帶來更多智能化可能,協助開發者將精力聚焦在更具創造性的工作之上。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。