智東西模型更新

Meta新王牌模型爆衝性價比!小扎時隔三年重返X,馬斯克火速隔空點評

2026年7月10日 14:50
Meta新王牌模型爆衝性價比!小扎時隔三年重返X,馬斯克火速隔空點評

重點摘要

智東西(公眾號:zhidxcom) 編譯 | 茄子 編輯 | 程茜 智東西7月10日消息,昨晚,Meta超級智能實驗室發佈其迄今最強多模態推理模型Muse Spark 1.1。該模型專為Agent任務打造,重點提升了工具調用、電腦操作、編程以及多模態理解能力,能夠圍繞用戶目標規劃任務並調用外部工具完成複雜工作流。 ▲Meta發佈Muse Spark 1.

站內 AI 整理稿

Meta 旗下超級智能實驗室(Super Intelligence Lab)於昨晚正式發表最新多模態推理模型 Muse Spark 1.1,宣稱是該實驗室迄今最強悍的基礎模型。這款模型專門為 AI Agent 任務設計,重點強化了工具調用、電腦操作、程式編寫與多模態理解等能力,能根據用戶目標自動規劃任務並串接外部工具,完成複雜的工作流程。Muse Spark 1.1 的推出標誌著 Meta 在大型語言模型領域的戰略轉向——從單純的對話生成轉向更實用的自主代理(Agent)場景。

Meta 官方在 X 平台發布消息時指出,該模型不僅能理解文字、圖像等多模態輸入,還可以在實際操作層面調用瀏覽器、程式碼編輯器或第三方 API,逐步拆解任務並執行,讓 AI 從「被動回答」進化為「主動執行」。同一日,Meta 正式推出該模型的 API 公開預覽版,並首次向開發者提供付費版本。開發者可以透過標準 API 調用 Muse Spark 1.1,將其整合到自己的應用或服務中。這項收費方案是 Meta 在 AI 商業化路上的重要一步,過去 Meta 多以開源模型為主,這次的付費 API 顯示其開始探索直接變現模式。在定價方面,Muse Spark 1.

1 的輸入價格為每百萬 Token 1.49 元(約新台幣 6.6 元),輸出價格為每百萬 Token 4.99 元(約新台幣 22 元)。該模型支援高達 100 萬 Token 的上下文窗口,能一次性處理長篇文件、大量程式碼或完整對話記錄,對需要長時間推理與多步驟操作的 Agent 應用尤為關鍵。目前,Muse Spark 1.1 已在 Meta AI 行動版 App 與官方網站 meta.ai 上線。用戶可以在「思考模式」(Think Mode)下使用該模型,體驗其深層推理與多步驟規劃能力。Meta 表示,思考模式會讓模型在生成回應前先進行內部推理,以提升答案的正確性與邏輯連貫性。

這款模型的前身是去年底發布的 Muse Spark 1.0,當時已在程式碼生成與工具使用上展現水準。經過半年迭代,1.1 版本在多模態理解與任務規劃的準確度上顯著提升,尤其能在電腦操作情境下正確解析螢幕截圖、按鈕位置等視覺資訊,並輸出對應的滑鼠或鍵盤指令,實現類似人類的操作行為。業界分析認為,Meta 此舉是為了與 OpenAI、Google 等對手在 Agent 賽道上競爭。目前 OpenAI 的 GPT-4o 與 Google 的 Gemini 均已推出具備工具調用與多步驟推理能力的版本,而 Meta 透過開源與低價策略試圖搶佔開發者社群。Muse Spark 1.

1 的定價明顯低於同級競品,例如 OpenAI 的 GPT-4 Turbo 輸入價格約每百萬 Token 10 美元,輸出約 30 美元,相比之下 Meta 的價格極具破壞力。此外,Meta 超級智能實驗室負責人表示,未來將持續強化模型的規劃能力與長期記憶,讓 Agent 能在更複雜的多輪任務中保持一致性。目前 Muse Spark 1.1 已在內部測試中通過多項自動化工具鏈測試,包括網頁爬取、數據分析、自動化報告生成等場景,表現穩定。值得注意的是,這波模型發布恰逢 Meta 創辦人祖克柏時隔三年後重返 X 平台發文,並隨即引來特斯拉執行長馬斯克隔空回應。

雖然雙方互動內容未直接提及新模型,但業界普遍解讀為 AI 領域競爭態勢升溫的信號。馬斯克過去曾批評 Meta 的 AI 策略,而祖克柏這次低調回歸社群平台,意在為 Meta AI 產品爭取更多關注。整體而言,Muse Spark 1.1 的問世為開發者提供了一個性價比極高的 Agent 模型選擇,Meta 也藉此補齊了自家 AI 生態中最關鍵的一塊拼圖。隨著 API 公開預覽版上線,預料將吸引大量新創與中小型企業嘗試導入,進一步推動 AI Agent 從概念走向實際落地。

Related

相關文章

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?

字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

1 小時前

千人聯機世界模型“RhOS-World: Khora”正式發佈

RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

2 小時前
Hugging Face Blog模型更新

TutorMoments:AI 家教何時該出手,何時該放手?

今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

2 小時前