Meta首款編程Agent來了,背後模型能力直追Opus 5

2026年8月6日 15:14
Meta首款編程Agent來了,背後模型能力直追Opus 5

重點摘要

Meta 正式推出首款 AI 編碼 Agent「Muse Code」測試版,由最新的 Muse Spark 1 模型驅動,能在大型代碼倉庫中完成複雜軟體工程任務。執行長扎克伯格暗示未來可能開源,目前支援 macOS 與 Linux 系統。

站內 AI 整理稿

Meta正式進軍AI編碼代理領域,今日推出旗下首款終端型編程Agent「Muse Code」測試版,背後由全新模型Muse Spark 1驅動,標誌著這家社群媒體巨頭正式與OpenAI、Anthropic在軟體開發自動化賽道正面交鋒。Muse Code是一款運行在終端機中的AI編碼助手,專為處理大型程式碼倉庫中的複雜軟體工程任務而設計。Meta創辦人馬克·祖克柏在社群平台上發文表示,這款工具能夠分析專案、規劃修改、編寫程式碼、執行工具,並驗證最終結果,涵蓋從規劃到交付的完整開發流程。

祖克柏強調,Muse Code的核心能力在於處理大型程式碼庫中的多步驟任務,而非僅限於簡單的程式碼補全或片段生成。這使得它與市面上其他編碼代理產品形成區隔,特別是針對企業級開發團隊在維護龐大遺留系統時的需求。值得注意的是,Muse Code背後的模型Muse Spark 1在基準測試中表現出色,其能力被認為直追Anthropic的Claude Opus 5。這項比較引發業界關注,因為Claude Opus系列向來被視為頂尖的程式碼理解與生成模型,Meta能在短時間內追趕上此一水準,顯示其在AI基礎模型研發上的投入已見成效。

目前Muse Code支援macOS與Linux作業系統,使用者只需透過一條終端指令即可完成安裝,大幅降低採用門檻。Meta此舉顯然希望吸引開發者快速試用,並在實際專案中驗證其效能。在祖克柏宣布消息後,社群平台上隨即湧入大量討論,其中開源與否成為最熱門的話題。有網友直接提問Muse Code是否會採取開源方式釋出,祖克柏立即回應:「很快將會有更多關於這一話題的內容要分享。」這番話暗示Meta可能正在評估開源策略,未來不排除仿效Llama系列模型的做法,將Muse Code的部分元件開放給社群。

Meta過去在AI領域的開源策略相當積極,包括Llama大型語言模型系列均以開放權重方式釋出,獲得開發者社群廣泛好評。若Muse Code也跟進開源,將可能對OpenAI的Codex、Anthropic的Claude Code等競爭產品形成壓力,因為開源版本通常能吸引更多第三方貢獻與生態系統發展。從市場格局來看,AI編碼代理已成為各大科技巨頭兵家必爭之地。OpenAI早在2021年就推出GitHub Copilot,隨後Anthropic也在2025年發表Claude Code,兩者皆已累積大量企業用戶。

Meta此時切入,雖然時間點稍晚,但憑藉其在開源社群的信譽與Muse Spark 1的強勁性能,仍有機會後來居上。業界分析認為,Muse Code的推出不僅是Meta產品線的擴充,更反映該公司對開發者工具市場的戰略重視。過去Meta主要聚焦社群平台與元宇宙,如今透過AI編碼代理切入開發者生態,有助於建立更完整的技術護城河。在功能細節方面,Muse Code被設計為能夠理解整個專案的上下文,而非僅限於當前編輯的檔案。這意味著當開發者要求修改某個功能時,Agent會自動掃描相關模組、分析依賴關係,並提出涵蓋多個檔案的修改方案。這種全局視角正是大型程式碼庫維護中最需要的特性。

此外,Muse Code也整合了終端機操作能力,可以直接執行編譯、測試、部署等指令,並根據執行結果自動調整程式碼。這使得它不僅是「寫程式碼的工具」,更像是一位能夠獨立完成任務的虛擬工程師。Meta目前尚未公布Muse Code的正式上市時間表,也未說明是否會推出付費方案。但考慮到該產品目前處於測試階段,且競爭對手如GitHub Copilot已採用訂閱制,Meta未來很可能會推出類似的商業模式。對於開發者而言,Muse Code的出現意味著AI編碼代理市場將更加多元。過去主要由OpenAI與Anthropic主導的局面,如今加入Meta這個重量級玩家,可望加速技術迭代與功能創新。

而祖克柏對開源議題的曖昧回應,更讓外界對後續發展充滿期待。

Related

相關文章

當 human in the loop 變成“閉著眼睛點確認”,企業Agent 安全還能靠誰?

專家指出,AI Agent 從內容安全轉向行為安全,提示詞注入、工具濫用與過度授權成為主要風險。企業應建立可視、可管、可追溯的安全基線,並對工具權限進行最小化與臨時化管理,避免 human in the loop 淪為形式。安全防護需從靜態入口轉向動態行為約束,以因應 Agent 自主執行帶來的全新挑戰。

20 分鐘前

開源Agent框架刷爆ARC-AGI-3,「自我改進」的RLM harness引爭議

一套開源Agent框架在ARC-AGI-3基準測試中創下超過85%的正確率,大幅領先其他解決方案,其核心是名為「RLM harness」的自我改進機制。然而,該方法引發學術爭議,部分研究者批評它透過反覆試錯「鑽漏洞」,不符合ARC-AGI評測一次性推理的精神。這場討論促使AI社群重新審視評測標準,並可能影響未來ARC-AGI版本的設計方向。

26 分鐘前
TechWebAI Agent

ChinaJoy 2026 AI遊戲規模化落地,邊緣雲與API安全重構產業底層邏輯

2026年ChinaJoy展館,“與AI同遊”的主題隨處可見。行業調查顯示,僅有21%的企業擁有完整的API資產清單,大量後臺AI接口仍在無人監控的狀態下裸奔。合規與安全也同步下沉。算力下沉還不夠,API安全必須同步前移邊緣雲解決了體驗問題,但AI交互入口的安全,同樣需要前置到邊緣。算力與安全,缺一不可Akamai的判斷很明確:遊戲AI轉型不能割裂算力與安全。這也是遊戲廠商規模化落地AI智能體、構建AI原生遊戲的標準化底層方案。

5 小時前
量子位AI Agent

螞蟻集團開源Avernet,讓人與智能體像組織一樣高效協作

**螞蟻集團開源Avernet:打造人與智能體高效協作的“組織級”基礎設施** **來源:量子位** **2026-08-07 11:08:51** 近日,螞蟻集團正式宣佈開源多智能體協作基礎設施Avernet,其社區版本已同步上線。作為業界首個聚焦於“組織級協作”的智能體基礎設施,Avernet的首個版本重點開放了智能體協作網絡能力,旨在支持不同智能體之間的發現、共識達成、跨團隊協作與治理,為人工智能從“單點智能”走向“系統智能”提供關鍵支撐。

10 小時前