個人代理繼續升溫

2026年9月9日 00:00
站內 AI 整理稿

個人代理的開發熱度持續升高,Meta 端出個人 AI 代理「Muse」,把代理能力直接帶進一般使用者的日常情境。這款產品鎖定購物、郵件處理與旅行規劃等任務,使用者只要給出一個目標,Muse 就會接手後續執行流程,而不是像過去那樣只停在對話框裡提供建議。從產品定位來看,這已不只是聊天機器人的功能更新,而是朝「能替人把事情做完」的方向推進。Meta 對 Muse 的描述,重點放在它能實際操作真實世界的數位介面。使用者交付目標之後,Muse 可以自行打開瀏覽器,在網頁上填寫表單,甚至在需要與對方來回溝通的環節中代使用者出面談判。

換句話說,代理不再只是回答「你可以怎麼做」,而是直接進入網頁、動手完成一連串步驟。其中「打開瀏覽器」與「填表」這兩項能力,代表代理必須跨出模型本身的邊界,去面對真實網站的操作邏輯。網頁上的欄位、按鈕、跳轉流程與各種互動設計,原本都是為人類使用者而設計,代理若要代為操作,就必須理解頁面結構、判斷下一步該點哪裡、該輸入什麼內容。這也是為什麼代理的競爭焦點,已經從單純的對話能力,轉移到能否在真實網頁環境中穩定完成任務。至於「代使用者談判」,則是另一個層次的門檻。談判本身牽涉到條件交換、對方回應的解讀,以及在來回往返中調整立場,並非單向執行指令就能完成。

Muse 被賦予這樣的能力,意味著個人代理的設計思路,已經從「幫我查、幫我整理」,推進到「幫我跟對方交涉」的階段。Meta 這次押注的方向,是普通用戶的入口。也就是說,Muse 並不是先瞄準企業內部流程或開發者工具,而是直接面向一般人的日常需求。購物、郵件與旅行規劃這三類任務,正好都是多數人生活裡反覆出現、卻又相對繁瑣的事務,一旦代理能接手,使用者感受到的差異會相當直接。這樣的選擇也反映出一個判斷:個人代理若要真正普及,關鍵在於一般人願不願意把日常小事交出去。相較於專業場景,購物比價、收信回信、安排行程這類任務的門檻較低,使用者也更容易評估代理做得好不好。

當代理能在這些場景中證明自己可靠,使用者才可能逐步把更複雜的事務委託出去。從產業角度來看,代理競爭的戰場正在位移。過去一段時間,各家把重心放在聊天框裡的反應品質,比的是回答是否流暢、是否貼近需求;如今焦點轉向真實網頁操作,比的則是有沒有辦法把任務從頭到尾走完。前者考驗的是語言與理解能力,後者還額外牽涉到流程規劃、狀態追蹤與錯誤處理。這個轉向並不容易。聊天框裡的回答即使不完美,使用者仍可自行接手補救;但當代理已經打開瀏覽器、開始填表,任何一步失誤都可能讓整個流程卡住,甚至產生使用者不樂見的結果。代理要真正可用,就必須在自主執行與使用者掌控之間找到平衡,讓使用者知道它正在做什麼,也能在必要時介入。

個人代理之所以在這段時間持續升溫,正是因為它把 AI 的價值從「提供資訊」推進到「完成任務」。當使用者給出的是一個目標,而不是一連串指令,代理就必須自行拆解步驟、判斷先後順序,並在過程中面對各種突發狀況。這種以目標為核心的互動方式,與傳統問答式 AI 的使用體驗有明顯差異。Muse 所涵蓋的購物、郵件與旅行規劃,正好橫跨三種不同性質的任務。購物涉及搜尋、比較與條件取捨;郵件涉及內容理解與回覆表達;旅行規劃則牽涉時間安排與多方資訊整合。代理若能在這三類任務中都派得上用場,代表它需要具備相當廣度的能力,而不是只專精於單一情境。

值得注意的是,這些任務往往散落在不同的網站與服務之間,沒有一個統一的介面可以呼叫。代理要完成任務,就得像人類一樣逐站操作,透過瀏覽器進到各個頁面處理。這也解釋了為何「真實網頁操作」會成為這一輪代理競爭的核心命題:誰能更穩定地跨站完成任務,誰就更有機會取得使用者的日常依賴。Meta 推出 Muse,等於把個人代理的競爭推向一般消費者市場。當代理不再只是技術展示,而是以購物、郵件、旅行這類貼近生活的任務作為切入點,使用者對代理的期待也會跟著改變。人們關注的不再只是它說得對不對,而是它能不能真的把事情辦好,並且在需要與他人互動時,代替自己把條件談到位。

個人代理繼續升溫,背後其實是 AI 應用重心的轉移。從聊天框走向真實網頁操作,代表代理必須在開放、多變的環境中證明自己的執行力。Muse 的出現,讓這條路線多了一個面向普通用戶的具體案例,也讓外界更清楚看到,下一階段的競爭將圍繞著「誰能替使用者完成更多日常任務」展開。

Related

相關文章

IT之家AI Agent

長安汽車首席專家譚歡:未來要用機器人造車、賣車,讓機器人上車、造機器人

作者:清源 責編:清源 評論: 9 月 18 日消息,在今天(18 日)的第 22 屆中國汽車產業發展(泰達)國際論壇“新賽道生態專場:具身智能新賽道”活動中,長安汽車首席專家、長安天樞智能機器人公司總經理譚歡在演講中指出,AI 正推動以物理具身智能為核心的基礎設施革新,汽車未來形態是“汽車機器人”—— 自學習、自組織、自進化的組合智能體。

1 小時前
量子位AI Agent

具身智能技術路線尚未定型,基礎設施卻先收斂

具身智能技術路線尚未成形,但基礎設施需求已開始收斂,重點從製造機器人轉向持續迭代機器人能力。百度集團沈抖指出,智能體能力邊界快速擴展,進入規模化部署階段,但機器人學習新任務與跨環境適應性仍待突破。

2 小時前

88小時抵一個人思考4000年,OpenAI核心研究員:除了自我進化,更可怕的是AI正學會“隱藏自己”

AI正在把4000年的人類認知勞動壓縮進88小時,OpenAI研究員Noam Brown坦言連他自己也被進展速度持續震驚。AI正在把過去需要數千年完成的認知勞動壓縮到數天。真正的問題已經不只是模型能否變得更聰明,而是實驗能否跟上、人類能否在模型繼續自我改進前確認它仍然安全。

3 小時前
智東西AI Agent

Agent辦事、花式P圖、動嘴玩電腦……實測Wildcat Lake輕薄本玩AI有多爽

作者 | ZeR0 編輯 | 漠影 桂林依山傍水,連城市的輪廓,都是一座座山勾勒出來的。抬眼一望,便是翰墨丹青般的自然光景,既沉靜婉約,又意境悠遠。這種乾淨的留白之美,早已被古人融入山水畫藝中,幾筆山石,一帶煙雲,餘下的留給水色,也留給看畫的人。 淨,並非空無一物,而是通過剋制的取捨,讓真正重要的東西凸顯出來。這與今年推出的第三代英特爾酷睿處理器(代號Wildcat Lake)的設計理念不謀而合。

9 小時前
AIbaseAI Agent

吳恩達回應AI末日論:別被科幻敘事帶偏,應解決現實工程問題

吳恩達曾參與創辦Google Brain和Coursera。吳恩達稱,科技行業早期曾放大AI潛在災難性風險,以獲取關注並影響監管方向;近兩週相關討論再次升溫,也可能存在類似動機。他認為AI確實存在現實風險,尤其包括網絡安全等領域,但不認同將人類滅絕風險作為當前AI發展的核心判斷依據。

9 小時前
IT之家AI Agent

智譜 GLM-5.3-FlashX 模型上線,更快、更流暢

作者:汪淼 責編:汪淼 評論: 感謝網友 Agent 的線索投遞!9 月 18 日消息,智譜今日宣佈推出 GLM-5.3-FlashX(最高 200 tokens/s),為企業與開發者帶來更快、更流暢的模型體驗。智譜官方表示,GLM-5.3-Flash 此前以“Ox Alpha”之名與全球開發者見面,獲得海內外開發者的廣泛認可,調用量持續攀升。

11 小時前