OpenAI、Meta、Manus同時下注,智能體 2.0 來了

光錐智能2026.10.01 08:38 · 來自吉林全文5070字00:00 / 13:38OpenAI想摘走Meta的“大結果”。文 | 光錐智能,作者|魏琳華,編輯|劉俊宏智能體又迎來了史詩級更新。當你還在睡夢中時,你的AI已經替你看完了郵箱裡的幾十封未讀郵件,把緊急的事項總結出來告知你;吃飯的時候,AI告訴你今天彙報要用的PPT數據已經自動更新好了,交給你審閱......這個場景,來自OpenAI展示的個人智能體Dots的宣傳片。但它讓人不由得想起最近爆火的Muse——Meta前不久剛發佈的個人智能體。同樣是主動能力出圈,同樣是C端定位,同樣以雲端虛擬機實現7×24小時運轉。
此前,Muse的爆火,向全世界展示了個人Agent的價值所在:它不是一個“抽鞭子才動”的助手,而是一個跟真人媲美的管家。但Meta還沒蹦躂幾天,就碰上了更強大對手“摘桃”。9月30日凌晨,OpenAI開發者大會正式開幕,OpenAI CEO Sam Altman帶來了超過20項更新。用他本人的話來說,“這是迄今為止最好的一屆開發者大會。”其中,個人Agent Dots成為了當之無愧的主角,這一產品直接對標Muse。Dots擁有自己的雲端電腦和瀏覽器,7×24小時在後臺自主推進任務;配套的ChatGPT Space把同事、ChatGPT和Agent拉進同一份文檔協作,@一下就能派活。
不難看出,藉著開發者大會,OpenAI高調宣佈切入個人智能體賽道,著急在新賽道里搶佔身位。為什麼這麼看重它?是因為個人智能體跑出了一個成功案例,也讓大家看到了C端Agent能爆發的希望。這背後,是Agent發生了一次代際性的變化——如果說第一代Agent的爆發代表是“龍蝦”,那麼第二代,就是這次的個人智能體。跟上一代智能體“龍蝦”和以Codex為代表的工具性智能體不同,新一代智能體最大的不同就在於主動——它自己會判斷該幹什麼,然後主動問用戶,再動手處理。之前的智能體就像一個“小學生”,用戶只能給出明確的要求,然後等待他返回結果。但它能給你的只有意料之內的結果,很難超額完成任務。
但新一代智能體是一個“合夥人”,用戶可以給它設立一個總體的“大目標”,AI拆解任務的同時,還能帶著建議跟你商量什麼需要做、怎麼做。這就是“主動”的差別,只要目標明確,一切都可以想辦法成功。Muse珠玉在前。Dots的切入,也直接證明OpenAI看到了這一趨勢——智能體2.0時代來了。對標Muse OpenAI的個人智能體來了從產品形態到核心賣點,能看出來,Dots幾乎就是完全對標Muse。它們都可以通過不斷學習用戶習慣,自動幫你完成各種瑣碎的工作,而不是等人發號施令才行動。
在OpenAI的宣傳片演示中,生活場景裡,一個Dot會在用戶起床前檢查夜間收到的信息,發現緊急事項主動提醒;董事會召開前,它已經根據最新業務數據更新了演示文稿;婚禮蛋糕供應商臨時毀約,它自己找到新供應商,再回來問用戶什麼時候方便試吃。能做到這些,靠的是打開智能體的權限。Dots擁有云端虛擬機,這讓它能夠7×24小時運轉,還可以在你連接的各類應用中自主開展工作,目前已經支持超過4000個應用連接,能夠跨應用自主推進任務。
此外,OpenAI在智能體的互動方式上做了一些新的嘗試,用戶可以通過ChatGPT向Dots發送消息或直接通話,也可以通過Slack或微軟Teams發送消息,未來還將支持短信互動。不過,目前體驗到Dots的成本不低。它基於自家旗艦模型GPT-6 Astra開發。OpenAI現場宣佈,它同時向Pro、Business Premium和Enterprise用戶開放使用。Muse當下還是有價格優勢,它不僅能免費體驗,最低檔訂閱價格為單月20美元。這比Dots至少要花每月100美元的訂閱費便宜多了。但OpenAI定價,“貴有貴的道理”。雖然是對標Muse,但OpenAI的野心不止於個人版。
OpenAI同步推出了企業版本的Specialist Dots,它擁有自己的企業身份、憑證和系統權限,長期負責某一類崗位,比如郵件營銷、會計、法律分析。OpenAI還和微軟打通,企業未來可以直接通過Microsoft Agent 365來管理這些Agent。OpenAI甚至提出了更遠的構想:未來多個dots將組成團隊,協同為你工作。如果未來你可以同時擁有多個專業的Dot——一個管日程、一個管財務、一個管項目。它們之間還能互相溝通協作,像是一個給個人的專業Agent助理團隊。與Dots一同亮相的,還有一個作為“配套”的協作空間產品,ChatGPT Space。
從功能設計上,讓人一眼聯想到飛書和豆包工作的融合體。ChatGPT Space相當於一個給用戶、同事和眾多Agent協作的工作空間,動態頁面可以生成圖表、交互式儀表板,還能設置從已連接工具自動更新的待辦事項清單;PPT等文檔支持多人同時編輯。如果想讓Agent幹活,在文檔對應位置@它就能加入。圍繞著Dots,OpenAI展開的是一個由個人到企業、再到團隊的完整智能體產品方案。除了新產品發佈,OpenAI也帶來了新模型的發佈——GPT-6.1 Sol。這個迭代速度相當驚人了,畢竟他們上週才發佈了GPT-6 Sol和Luna。
從性能表現上,OpenAI給新模型的定位是“接近GPT-6 Astra的智能水平、但只要五分之一的價格”。以OpenAI給出的官方數據來看,在多個指標表現上,GPT-6.1實現了追平Astra。但尷尬的是,新模型本身也是走性價比的“幹活模型”定位。雖然在複雜任務的表現上超過了Opus 5.5,但綜合表現上,OpenAI還沒有能夠狙擊對手的能力。打不過Opus 5.5,OpenAI眼下的策略就是打價格戰;如果價格戰還不夠,就打速度戰。定價上,GPT-6.1 Sol維持了物美價廉的定位,每百萬token輸入2美元、輸出10美元,上下文緩存從0.2美元直接砍到0.
1美元——對那些反覆重讀同一套指令和文檔的長程Agent來說,這一項降價更能幫開發者省賬單。同步推出的Astra Ultrafast是GPT-6 Astra的高端速度檔位,在Codex和ChatGPT工作中最高可達8倍。這意味著Ultrafast版本的輸出速度可以達到300Token每秒以上。除了新產品和模型,本次DevDay還有不少值得關注的更新:比如Codex被搬上雲端,讓編程可以在雲端託管,實現電腦、手機、雲端三端同步;插件擴展讓開發者可以直接在ChatGPT中構建應用內體驗等等。OpenAI這次的發佈會,確實算得上驚喜連連。智能體2.0來了!為什麼OpenAI這次把主角交給了Dots?
Muse的爆火,讓大眾看到了下一個“龍蝦”的希望,說明Meta精準地抓住了此前市場上的空白。說白了,在龍蝦橫行的智能體1.0時代,它能幹,但更需要人來做決策;但個人智能體開啟的2.0時代,證明“能出主意”的主動型Agent是一套以AI為主導的用戶交互邏輯。這就把原本需要人操心的工作流,解放了出來。9月初,Meta發佈了個人AI Agent產品Muse。它是一個能夠真正替用戶執行任務的個人Agent,運行在獨立的雲端虛擬機上,AI可以在裡面打開網頁、處理郵件、預訂行程、購物,並且在後臺持續執行任務,哪怕你切出App去做別的事也不會中斷。
上線不到10天,Muse就登上美國App Store免費榜第一位。十幾天裡,全網累計下載量約260萬。據Sensor Tower數據,Muse在美國移動端日活用戶達64.2萬,遠高於ChatGPT同期的23.1萬。看到個人Agent的火熱,國內廠商也沒閒著。就在OpenAI DevDay的前一天,Manus宣佈迴歸了。當天發佈的同樣有一款個人AI Agent產品Cue。Cue支持手機和桌面端,和Manus共享同樣的基礎設施。按照官方介紹,Cue中的每個Agent可以有自己的郵箱、電話號碼、錢包和電腦,可以發消息、接聽來電並留下摘要,也能在用戶設定的預算內付款。
它目前還在以邀請碼的方式限量開放中。和一般的AI助手、目前爆火的AI辦公智能體相比,個人智能體為什麼突然迎來了爆發期?本質上是使用體驗發生了變化。如果我們把爆火的“龍蝦”稱為1.0時代的產物,那麼這個能主動辦事、且能在手機端7×24小時運行的個人智能體,就更像是2.0階段的產物。首先,無論是Muse、Cue還是Dots,它們的共同點是有自己的一套辦公設備——雲端虛擬機。雲端虛擬機能解決的問題,那可太重要了。但凡用過AI問答App的人都懂,很多產品一切換後臺再回來,就因為斷網或進程被系統回收,之前生成到一半的內容直接沒了。
但Muse的雲端虛擬機解決了這個痛點,畢竟跑任務是雲端虛擬機,它依然能在切換應用後運行。這讓Muse有了能做長時間任務的能力,如果給一般的AI助手,手機亮屏等著不說,中途切出去就前功盡棄了。簡直是讓AI幹個活,還得“伺候著”。不得不說,雖然Meta跟Manus最終分道揚鑣,但Manus帶火的雲端虛擬機,真讓Meta找到了正確用法。如果說雲端虛擬機給它打好了幹活的基礎,那麼自主性就成了個人智能體的閃光點。為了讓用戶能夠開發更多用法,以及讓它真正從原來的助手角色變成能夠自己幫你辦事的Agent。手機端的Agent需要做好更多場景設計。以Muse為例,它設計了一個靈感啟發的卡片“idea”。
它會在使用的過程中沉澱大量數據,並根據用戶的目標、習慣以及對話中學到的信息來生成建議。早期使用階段,它會給每個用戶量身定做一些建議,也就是想法卡片。比如,它瞭解到你的孩子在本週五要過生日,會詢問你是否需要一個生日大餐的安排計劃。此外,和一般的Agent相比,個人智能體還可以自己判斷情況,主動給用戶發消息。Meta團隊分享了一個案例,就是在用戶讓Agent管理孩子們返校的準備工作時,它在整理重要事項的時候發現郵箱中有一條提醒孩子參加體育選拔賽的通知,並主動提醒用戶關注,最終趕上了遞交表格的ddl。但由於跨應用的權限開放,個人智能體正在面臨被部分應用“封禁”的問題。
比如,上線一段時間後,亞馬遜以“未授權AI代理”為由封殺了Muse的購物功能。這個場景,像極了去年的豆包手機。畢竟,AI替你下單的那一刻,它已經繞過了平臺的流量入口和廣告體系,動了平臺的核心蛋糕。所以無論是AI手機還是Agent,怎麼和應用和平相處,還是一道難題。拋開被封禁的插曲,個人智能體本身的種種功能其實並不是什麼新鮮發明,無論是Manus還是“龍蝦”,都早就學會做這些了。但龍蝦有一個致命問題:它太重了。你需要一臺電腦、需要部署、需要懂點技術才能玩轉。它更像一個開發者工具,而不是普通人能用的消費級產品。更關鍵的是,這一代個人智能體正在把主戰場從PC搬到了手機。
不同的戰場,決定了用戶需求的不同。比如在PC上,大家目前卷的都是AI辦公,因為電腦端場景本身就更契合用戶工作的場景。手機端在其中,本質上還是PC端的遠程控制台。個人智能體徹底顛倒了這個邏輯,它讓手機成為了主角。上下文是手機裡的短信、照片、應用,場景是日常的預訂、購物、跑腿,交互方式是最簡單的聊天。這些功能,電腦端早就有了,但在手機成為移動設備絕對主流的時代,這部分的缺口太大了。Muse點燃了第一把火,但Dots們的到來,意味著這場比賽才剛剛開始。沒有人想缺席這場“新龍蝦”的佔位賽。
Related
相關文章

何愷明團隊新作:看貓片就能學會ARC挑戰
何愷明團隊提出NAT-ARC,一種純視覺的ARC解題方案,不依賴語言模型,而是使用ImageNet上的自然圖像進行MAE預訓練,再遷移到抽象格子推理任務。該方法在ARC-1上達到63.4%的單模型pass@2分數,集成後提升至70.2%,逼近專用LLM系統的表現,並證明了視覺預訓練能有效破解抽象推理的scaling瓶頸。

谷歌Gemini 4突然發佈!RSI加持,GPT和Opus都讓讓
。。。 假期第一天,谷歌攜Gemini 4 Argon空降多榜單第一。 拳打Opus 5.5,腳踢GPT-6 Astra。 更誇張的還在後頭,單項任務成本最低可至1.99美元,直接是Astra費用砍半。 最高百萬Token輸出上限,面向編程、金融和法律等複雜工作流,而且劃重點,網絡安全防禦能力超牛掰。 這波等等黨要贏麻了。 不過吧,咱普通用戶現在只可遠觀,暫時還吃不上。

階躍星辰“第一梯隊”,是“自嗨”嗎?
AIX財經2026.10.01 18:22 · 來自福建全文5252字00:00 / 15:27同行各自跑出了主線,階躍的“全棧”能跑通嗎?文 | AIX財經,作者|雷晶,編輯|魏佳沉寂許久的階躍星辰,正試圖擠進大模型第一梯隊。9月20日,它發佈Step 5 Preview,原生支持文本與視覺輸入,重點面向編程、軟件工程、專業知識工作和長程Agent任務。上線初期,登錄並完成首次調用後可獲得30天的Step Plan免費使用權。幾天後,Step Plan的月度套餐一度售罄。

騰訊經銷、字節駐場、Kimi借船:FDE成了大模型的新成本?
新立場Pro2026.10.01 16:16 · 來自四川全文5421字00:00 / 16:08AI公司活成了它們最討厭的樣子。文 | 新立場Pro今年 3 月 6 日上午十點,深圳騰訊大廈樓下開始排隊。人們帶著電腦,等騰訊雲工程師幫自己安裝 OpenClaw,首批八十多人在十點開始排隊,到十一點,數百個預約號已經發完。

谷歌推出了個“做題家”:Gemini 4 Argon屠榜,但幹活差點意思
字母AI2026.10.01 16:16 · 來自北京全文3510字00:00 / 09:31消失10個月的谷歌,為什麼連Pro這塊招牌都扔了?文 | 字母AIGemini 4可算來了,連名字也換了:這次的旗艦不叫Pro,叫Argon。從谷歌公佈的成績看,Gemini 4 Argon在知識工作方面表現搶眼,多項測試超過了OpenAI和Anthropic的旗艦模型。它主打一個知識面廣,從金融、法律到數學、科學,都有不錯的表現。谷歌還確認,9月15日在LMArena上亮相、表現接近GPT-6 Astra的“3.

豪擲82億美元,芯片巨頭押注的世界模型究竟是什麼
FoST未來敘事2026.10.01 16:04 · 來自北京全文3694字00:00 / 10:23當AI開始生成“世界”,影音遊內容正在被顛覆。文 | FoST未來敘事,作者 | 蔥蔥82億美元,芯片巨頭AMD以全股票形式收購世界模型公司World Labs。AMD在收購公告裡寫道:“World Labs 的模型經驗,將幫助AMD更深入地理解工作負載如何演變,進而塑造未來的技術路線圖。”換句話說,AMD看中的,不只是World Labs今天的模型能力,更是世界模型這類前沿模型可能給芯片硬件研發帶來的“前瞻性”。