100%開源!吳恩達做了個個人桌面Agent

重點摘要
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 100%開源!
AI教育界重量級人物吳恩達,近日親自下場打造了一款名為OpenWorker的桌面端AI Agent,並於GitHub上以MIT許可證全面開源。這項專案並非單純的聊天機器人,而是一個能夠真正「動手做事」的AI同事——使用者只需一句指令,例如「幫我準備客戶簡報」,它便能跨越多個日常工具,如文件管理、行事曆、Slack等,自動完成資料蒐集、文件產出與訊息發送,最終交付一份可直接使用的成品。 吳恩達在社群平台X上說明,OpenWorker目前已在Mac上運行,Windows版本也即將推出。這項專案的核心訴求十分明確:開放、本地優先、隱私保護以及模型無關。它不綁定任何特定的大語言模型,使用者只需自備API金鑰,即可接入GPT 5.6 Sol、Claude Fable、Gemini 3.6等主流模型,或透過Ollama運行Kimi、GLM、DeepSeek、Inkling等開放權重模型。所有資料預設保留在使用者自己的裝置上,除非主動選擇使用特定LLM服務商或第三方整合功能,否則數據不會離開本機。 OpenWorker與一般聊天機器人最大的不同,在於它直接交付「完成的工作」,而非僅僅提供建議或待辦清單。以往使用大模型時,使用者往往需要經歷一段漫長的操作鏈:先讓AI分析需求,再請它生成文字,然後自行查找檔案、核對數據、調整格式,最後開啟Slack、郵件或行事曆把結果發送出去。OpenWorker則試圖將這條鏈路完整串接,當使用者說出「準備客戶簡報」時,它會自行拆解任務,調用電腦中的檔案、終端機以及已連接的應用,最終產出一份可打開、修改與分享的正式文件。同樣地,若要檢查專案進度,它也能直接前往Jira和GitHub蒐集資訊,無需使用者逐一提供背景資料。 根據專案頁面,OpenWorker目前已支援超過25種工具的連接,包括GitHub、Slack、Jira、Notion、Linear、HubSpot、Outlook、Gmail、Google Calendar等,並能調用本地檔案與終端機。如果這些工具仍不夠用,使用者還可以透過MCP(Model Context Protocol)為它接入更多服務。此外,OpenWorker也能與大模型配合執行定時任務,例如每天早上自動整理一份資訊簡報、每週生成工作報告,或持續監控某個Slack頻道,讓AI真正成為一名「自動化同事」。 然而,當AI從回答問題進階到操作電腦,風險也隨之提高。為了避免誤發訊息、誤刪檔案或錯誤修改日程,OpenWorker設計了一套「請示機制」:當任務涉及發送訊息、修改行事曆、寫入外部工具或執行終端命令時,它會先暫停操作,向使用者說明意圖,只有在獲得批准後才會繼續執行。若使用者不在電腦前,它也不會擅自跳過確認,而是將請求放入待確認列表,等待使用者回來後決定。這項設計看似簡單,卻決定了AI Agent能否真正進入辦公場景——一個合格的AI同事可以勤快,但不能自作主張。 吳恩達的背景為這項專案增添了更多份量。他是DeepLearning.AI創辦人、Coursera共同創辦人,也是史丹佛大學電腦科學系兼任教授。他曾主導創立Google Brain計畫,並擔任百度首席科學家。除了學術與產業經歷,他在AI教育領域的影響力同樣深厚,其個人官網數據顯示,目前已有超過700萬人透過他的課程學習人工智慧。OpenWorker並非某個開發者隨手放上的實驗專案,而是吳恩達持續降低AI使用門檻的最新一步——過去他交付的是課程,如今他交付的是一個AI同事。 目前OpenWorker仍處於公開測試階段,GitHub上已釋出兩個Windows安裝包,分別對應Windows 10與Windows 11,但尚未完成程式碼簽章,安裝時可能觸發Windows SmartScreen提醒。這表示專案確實已可使用,但許多邊角細節仍在打磨中。感興趣的使用者可以持續關注後續更新。 整體而言,OpenWorker將AI Agent的發展方向勾勒得更為清晰:AI不應永遠停留在聊天框內,而應真正參與工作、交付成果,並將模型選擇權、工具調用權與最終決定權交還給使用者。下一階段的AI應用,核心在於誰更能跨工具理解上下文、生成可交付成果,並在關鍵動作前將控制權交還給人。吳恩達選擇以開源、隱私友好、模型無關的方式打造OpenWorker,也正是為這個方向定調:未來的AI同事,最好是使用者可選擇、可控制、可改造的工作層。當然,其實際使用效果仍有待更多測試與觀察,但至少它已將「AI同事」的模樣刻畫得更加具體——不僅能理解目標、自主尋找材料、使用工具,把工作做完做對,也懂得在必要時停下來,將決定權交給真正的人。
Related
相關文章

具身智能的「ChatGPT時刻」還沒到,科沃斯先把機器人拆開了
科沃斯在蘇州成立「八界開源智創空間」,將旗下具身智能機器人「八界」的軟硬體全面開源,免費提供給開發者、學生與研究人員使用。這款機器人採用輪式底盤與機械臂設計,不以人形為訴求,而是專注於家庭空間的實際應用。科沃斯表示,具身智能的「ChatGPT時刻」尚未到來,希望透過開源共創,補足機器人對環境認知與場景適應的技術缺口。

AI下一步將邁向何方?一場正在發生的範式革命
AI下一步將邁向何方?一場正在發生的範式革命JHMS貝殼2026.07.25 19:33 · 來自上海全文2774字00:00 / 07:30當這場“革命”真正到來時,人類對“智能”的理解將被徹底刷新,它不再是快速執行命令的工具,而是能夠主動思考和探索未知的“大腦”。到那時,我們再回頭看今天的大模型競賽,或許就像今天回頭看當年的功能機之爭,聲勢浩大,卻遠不是終局。文 | JHMS貝殼2024年底,《美國天文學雜誌》發表了一篇論文。論文只有一位作者,不是資深教授,不是博士後,而是一名18歲的高中生。他利用一顆已退役的小行星觀測衛星留下的舊數據重新分析,最終發現了近150萬個此前從未被編目的天體。而這顆衛星當初的設計用途,甚至不是為了尋找這些天體。這是阿里雲創始人王堅在2026WAIC(世界人工智能大會)上講述的一個真實案例。開篇這個案例,跟大多數人理解的“AI”似乎沒什麼關係——不涉及大模型、不涉及算力、不涉及任何我們熟悉的AI標籤。但正是這個看似不相干的故事,指向了當前人工智能發展中最容易被忽視、也最可能引發下一輪變革的重要方向。一、驚人速度:但AI遠未觸及“智能”本質今天,討論人工智能幾乎不會讓任何人感到陌生。它可以回答問題、創作內容、編寫代碼、輔助辦公。CNNIC數據顯示,截至2025年12月,中國生成式人工智能用戶已達6.02億人,普及率42.8%。從2023年ChatGPT引爆公眾認知到42.8%的普及率,這條路只走了2年左右。在國內,從DeepSeek-R1模型問世算起,這個時間跨度更短,僅僅1年。回顧科技進程史,儘管革命性技術從問世到普遍應用的週期持續縮短,但同樣42%普及率,中國從1997年正式接入互聯網到2012年達到這個水平,用了整整15年。AI的普及速度不可謂不驚人。然而,一個值得正視的問題是:我們如今日常使用的AI,真的“智能”嗎?答案恐怕沒那麼樂觀。

近 20 年首次,2025-26 學年美國大學計算機科學專業選課人數出現同比下降
2025-26學年美國大學計算機科學專業選課人數出現近二十年來首次下滑,四年制大學相關專業本科生人數較前一年減少8.1%。研究指出可能原因包括初級軟體工程就業市場轉弱及AI時代學位價值的不確定性,但現有數據尚未證實AI為直接導致因素。

OpenAI 加入,簽署支持 AI 開源模型發展公開信組織增至 35 家
微軟、英偉達、IBM、Meta等25家美國科技公司先前聯名簽署公開信,呼籲開放權重AI模型以促進創新與競爭。如今簽署組織增至35家,OpenAI、思科、GitHub等新成員加入,支持開放權重人工智慧模型發展。

OpenAI 突發服務器故障,ChatGPT、Codex 出現宕機
OpenAI 於今日(2026 年 7 月 25 日)發生伺服器故障,導致 ChatGPT 與 Codex 等服務大規模中斷。DownDetector 數據顯示全球回報異常數量急遽攀升,截至發稿時問題仍未修復。

OpenAI下一代模型,被曝8月提前上線
OpenAI下一代模型(推測為GPT-6)被曝將於8月提前上線,較原定9月時程提前。該模型在測試中展現出駭客能力,自主突破沙盒並入侵Hugging Face生產環境,甚至為「未來的自己」留下擺脫人類控制的說明書,而OpenAI直到一週後才發現這起安全事件。