大廠AI入口大戰升級,誰是最能幹活的桌面Agent?

重點摘要
大廠AI入口大戰升級,誰是最能幹活的桌面Agent?劃重點KeyPoints2026.07.22 11:57 · 來自浙江全文4694字00:00 / 13:42實測騰訊WorkBuddy、字節豆包專業版、百度搭子、阿里QoderWork文 | 劃重點KeyPoints,作者|心怡,編輯|重點君互聯網大廠間的AI入口大戰打到了桌面端。先說一條剛出爐的消息。
大廠AI入口大戰升級,誰是最能幹活的桌面Agent?互聯網巨頭之間的AI入口競爭,如今已從手機螢幕延伸至桌面端。就在七月底,傳出阿里即將把旗下QoderWork、悟空、MuleRun三款Agent產品整合為「千問辦公」,並交由釘釘新任CEO陳宇森負責。同一時間,騰訊也將資源集中到WorkBuddy,字節跳動內部則在討論將飛書與豆包專業版深度整合。這些動作顯示,持續半年的「賽馬」模式已告一段落,各家開始把火力集中到桌面Agent這個新戰場。目前戰況如何?數據顯示,騰訊WorkBuddy在今年7月的日活躍用戶數已突破1300萬,是目前國內用戶最活躍的Agent辦公產品。
從六月桌面AI原生辦公智能體的訪問量來看,WorkBuddy與阿里QoderWork穩居第一梯隊。四位主要選手各有來頭:WorkBuddy的底層技術來自打磨多年的CodeBuddy,馬化騰在財報會議上直接稱它為「中國使用最廣的效率智能體服務」;豆包專業版仰賴字節自家的Seedream與Seedance多模態模型,是四者中多模態能力最豐富的,但生態相對封閉;百度搭子雖然入局較晚,但升級動作頻繁,七月剛推出個人版升級、企業版與「搭子聯盟」;QoderWork則是阿里將代碼Agent能力轉向辦公場景的產品,主打技能市場與專家套件,未來將成為「千問辦公」的底層核心。
廣告上各家都稱自己是六邊形戰士,但用戶真正關心的只有一件事:今天要選的Agent,到底能不能真正幫我幹活?為了找出答案,我們在同一台Mac上,使用相同的提示詞、免費帳號,針對兩個高頻真實工作場景進行實測。第一個場景是重複操作型任務:請Agent從OpenAI官方網站檢索最近10條新聞,並整理成一份可直接使用的Excel表格。這項任務看似簡單,但考驗的是Agent能否自主操作瀏覽器、繞過反爬機制、完成數據提取與格式輸出。結果顯示,騰訊WorkBuddy一開始卡在無頭瀏覽器安裝與反爬問題上,但很快轉向官方RSS訂閱源,成功抓取10條新聞,並在桌面生成兩張表——明細表與中文速覽獨立頁,全程約4分鐘。
不過,它顯示的完成時間有誤差,略顯掩耳盜鈴。百度搭子則在任務開始前一次性申請權限,直接跳到默認瀏覽器,能清楚看到它滾動翻頁取數,同樣約4分鐘完成,但摘要列為英文,鏈接也未獨立成列。字節豆包專業版的過程較為黑箱,不顯示開始時間與網頁滾動,但最終產出的中文摘要信息密度高,是唯一將「Agent中文速覽」做進Excel獨立頁的產品,抓取結果也最貼近「最近」的定義。阿里QoderWork則選擇內置瀏覽器檢索,耗時約12分鐘,排名墊底,過程中需反覆通過真人驗證,交互相當磨人,且因日期辨識錯誤漏掉了一條新聞。有趣的是,四家Agent抓出的「最近10條」僅有四條重疊。
原因在於OpenAI新聞頁面本身有兩套排序:卡片視圖是編輯精選順序,RSS才是純時間倒序。豆包與WorkBuddy使用時間序,貼近字面「最近」;百度搭子與QoderWork則跟隨頁面卡片順序,貼近「人打開頁面第一眼看到的」。兩者皆不算錯,但好的Agent應該主動告知用戶它用的是哪種口徑。第二個場景是內容生產型任務:假設你是AI領域的自媒體博主,Agent需檢索七月模型圈重大事件,挑出一個有爆款潛力的選題,並一口氣產出公眾號文章、小紅書圖文、數字人口播視頻三件套。這項任務考驗的是資訊檢索、選題判斷、多媒體生成與交付能力。結果顯示,騰訊WorkBuddy以3分16秒的驚人速度完成,最快、最省心。
它選定《全球最大開源模型誕生——中國開源聯軍改寫AI遊戲規則?》為選題,公眾號直接輸出可渲染的HTML成品,頭圖與金句「美國賣鏟子,中國發鏟子還包郵」相當亮眼,全文約900字,小紅書、口播稿、分鏡表與四張風格統一的配圖一應俱全,僅數字人成片因本機無渲染引擎而未完成,但主動提供了替代方案。百度搭子則在動手前先做需求分析,交付前還檢查字數並精簡兩次。它的檢索數據最細,包含跑分、定價、股價波動等,選題《七月AI大亂鬥》衝突感強,公眾號走深度分析路線,還多合成了一段TTS口播音頻,但成品為.md格式而非可直接渲染的HTML,字數也略超1500字。
字節豆包專業版是唯一命中自媒體寫作技能的產品,下筆前先讀取公眾號、小紅書、短視頻等平台規範,檢索面廣,公眾號約1400字並附四個備選標題,小紅書連置頂評論與回評策略都給出,配圖中的陣營對比圖是四者中最貼題的,交付方式為飛書在線文檔,複製即可發佈,但頭圖文字有錯亂。阿里QoderWork耗時約10分鐘,選題「輪到閉源巨頭睡不著了」鉤子合格,公眾號約1480字結構完整,但配圖服務故障,重試六次全敗,音頻與視頻也未能產出,成為唯一在配圖環節顆粒無收的產品。價格方面,所有產品都提供免費額度,多數任務可順利完成。但我們在實測豆包專業版第二個任務時,免費額度耗盡,不得不充值68元人民幣。
因此,建議重度使用者先以免費檔測試日常任務的積分消耗速度,再決定是否付費。兩個場景跑下來,沒有出現全能冠軍,但各家擅長領域已相當清晰。騰訊WorkBuddy速度快、交付完整,尤其擅長將成品打包成可直接使用的格式;百度搭子檢索數據紮實,流程嚴謹;字節豆包專業版內容專業度高,交付形式獨特;阿里QoderWord文字能力過關,但多媒體與效率仍有待加強。這場桌面Agent大戰的勝負,目前還難以下定論,因為產品幾乎一天一個樣,功能迭代極快。更重要的是,Agent正從桌面往手機端與即時通訊軟體遷移,未來你可能在微信或飛書裡一句話就能派活,無需打開專門App。這兩個新場景我們尚未實測,留待下一輪再做觀察。
對用戶而言,最務實的做法是:想清楚自己最常做的那件事,用免費額度跑通,再決定是否掏錢。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。