一文速覽OpenAI DevDay,歡迎來到Agent時代

2026年9月30日 09:46
一文速覽OpenAI DevDay,歡迎來到Agent時代
站內 AI 整理稿

字母AI2026.09.30 09:44 · 來自北京全文6274字00:00 / 16:30一個時刻在線的Agent、一間人機共用的Space,再加更快的GPT-6.1 Sol。文 | 字母AI凌晨一點,準時蹲在OpenAI DevDay的直播間。直播大概一個小時,更新恨不得有20多個,一場直播下來,震驚到椅子爆炸,癱坐在地,久久不能平息(doge)。OpenAI先端出24小時在線的Dot,又給人和Agent蓋了一間共同工作的Space,GPT-6.1 Sol登場,Ultrafast模式、Pro 500接踵而至。

這篇文章,我將用最直白、最簡單、最不繞彎子的方式,快速帶你們看懂這次DevDay到底發了什麼,有哪些真的能改變生活、哪些只是補課。以及,狠狠地給OpenAI抓點漏洞,看看他們這次迴避了哪些問題。DevDay新品/更新速覽 一、Dot放在最前面的當然是這次最重要的新產品。這是一個你不用一直盯著、也不用每次重新交代背景的常駐Agent。你可以把它簡單理解成Muse和Cue的中間形態。它首先像Muse,是一個24小時在線的個人Agent;但它又比普通的個人助理更“實體化”——每個Dot都有自己的身份和權限體系,有一臺獨立的雲端電腦和瀏覽器,可以連接4000多個應用,同時處理多個項目。

你可以給Dot自定義名字、形象和角色。你隨時可以到它的雲電腦裡看看它正在幹什麼,也可以授權它連接你的筆記本,直接把它帶到真實工作環境。一個Dot可以同時接手多個項目,自主往前推進。你想到新任務直接丟過去就行,不需要不停開新對話,也不用一步一步教它怎麼做。平時,你可以在網頁版、桌面端和手機端給它發消息或直接打電話;它也會主動聯繫你,彙報進度、提問題,或者等你做決定。同一個Dot會在不同渠道間保持上下文——ChatGPT之外,目前已經支持Slack和Teams,後續還會接入短信。OpenAI明確說,未來會讓多個Dot組成團隊,一起替用戶工作。

目前,Dot正在符合條件的市場逐步開放給Pro、Business Premium和Enterprise用戶。OpenAI還在少量企業中測試一種更“正式員工化”的專職Dot,它們會在組織內部擁有獨立身份和明確職責。第一個Dot包含在Pro和Business Premium訂閱裡,本身聊天不消耗ChatGPT用量;但如果讓它替你啟動Codex或Work任務,還是會正常扣額度。二、ChatGPT Space既然Agent有了身份和電腦,OpenAI把工作臺也一起搭上了。ChatGPT Space,簡單來講就是一個人和Agent的共享工作空間。它取代了原本的Library,“倉庫”爆改“辦公室”。

你可以把文件、頁面、演示文稿、表格和項目資料放進同一個Space裡,再隨時@ChatGPT、Codex或者Dot,讓它們基於這些共享內容繼續工作。它最核心的部分叫Page,是一種可以多人實時編輯的文檔……就形態上,有點像飛書或者WPS的在線文檔。你可以往裡面放文字、圖片、圖表和交互工具,讓ChatGPT或Dot直接修改內容、整理清單、補圖表、繼續研究。Pages還可以從已經連接的工具裡持續獲取信息,甚至設置自動更新。

(上下滑動,查看圖片)目前Space面向Pro、Business和Enterprise開放,網頁端和桌面端可以創建、編輯、協作;移動端首發階段只能查找、閱讀和分享,暫時不能創建或編輯。協作版Slides和Spreadsheets還在路上。三、GPT 6.1 Sol看到這裡就不得不感嘆,GPT 6 Sol才發佈了幾天?6.1 Sol是6 Sol的升級版,根據OpenAI給它的定位,它在複雜編程、電腦操作和專業工作上能做到接近GPT-6 Astra的水平,但價格仍然維持在Sol檔(僅為Astra的五分之一)。GPT-6.

1 Sol API輸入依然是2美元/百萬Token,輸出10美元/百萬Token,緩存輸入0.1美元。發佈會現場展示了幾項Agent相關Benchmark:在編程評測DeepSWE v1.1上,GPT-6.1 Sol達到75.22%,略高於Astra的73.23%;電腦操作評測OSWorld 2.0上,6.1 Sol約71.42%,Astra為73.49%;但在科學任務Terminal-Bench Science上,Astra仍明顯領先,68.10%對57.02%。

OpenAI已經把它開放給Plus、Pro、Business、Enterprise和Edu用戶,可在ChatGPT Work和Codex使用,暫時還不進入普通Chat。四、Ultrafast接下來是現場呼聲非常大的一項,Ultrafast模式。事實上OpenAI早在8月就預覽過Ultrafast,當時跑的是GPT-5.6 Sol,最高可達到標準模式約14倍速度,最初只面向少量API客戶開放。這一次Ultrafast被帶到了GPT-6 Astra,並正式進入ChatGPT Work和Codex。

根據官方描述,該模式在Codex裡Token生成速度最高可提升到8倍,約300 tokens/s;在API裡最高可提升到6倍。不過,目前首發只開放給Pro 500,以及符合條件的Enterprise和Edu工作區,其他訂閱哪怕額外買credits也不行——除非直接用API。在Work或Codex裡使用時,可以直接選擇GPT-6 Astra的Ultrafast模式。OpenAI還預告,GPT-6.1 Sol的Ultrafast模式也將在未來幾天上線。五、Pro 500這是一個更高檔的Pro訂閱,月費500美元,所以叫Pro 500。

核心賣點主要有兩個:給你最多的可用額度(Plus的25倍),以及GPT-6 Astra的Ultrafast模式。與此同時,Pro 200也重新開放購買了。六、Codex更新合集這次DevDay給Codex補了一大堆能力,請容許我放在一起講。首先是Codex Cloud。現在Codex的雲端開發環境可以直接複用,不用每次重新建一個乾淨沙箱。你可以在電腦上啟動任務、用手機遠程操作,或者直接從其他設備繼續;團隊還能共享已經配置好的環境、權限和依賴。

Codex CLI也升級了,現在可以直接用語音和Codex對話,並且添加了一個新的/agents視圖,可以把工作分給多個Agent,同時看不同任務做到哪了。另外,Prompt現在可以直接編輯,會話也可以恢復,還加入了內置worktree支持——不同Agent可以在彼此隔離的Git工作樹裡分別修改代碼,減少多任務同時推進時互相打架的情況。Codex還補上了更完整的代碼審查功能。你可以先看摘要和diff,再追問潛在問題;也可以讓Codex在你不在線的時候自己去雲端跑初審。目前支持GitHub Pull Request和GitLab Merge Request。

Codex Security Cloud這次也迎來了一次大升級:它現在默認接入Daybreak Blue,可以調用更強的網絡安全模型。除了按需掃描,它還可以直接掃描整個GitHub倉庫,持續檢查新提交,調查並去重安全問題,再把修復方案整理好交給你審查。即使電腦已經合上,這些任務也會繼續在雲端運行。Agents API這邊也補上了computer use。現在OpenAI直接託管底層Codex執行框架,多Agent、工具搜索、工具調用、上下文壓縮和computer use都能一起用,開發者只需要定義任務、工具和數據。如果對這部分比較陌生,可以看我們之前的文章。

七、Plugins插件這邊,分發、自動化和企業集成都往前走了一步。OpenAI重做了插件的創建、提交和發現流程。開發者現在可以更完整地打包和提交插件,用戶則通過統一目錄去發現和安裝它們。目錄裡的排序和推薦也會繼續優化。插件還新增了基於MCP的事件觸發能力。連接的應用一旦發生指定變化,就可以主動喚起ChatGPT繼續工作——這也是前面Pages能夠持續更新的重要底層能力之一。另外,企業現在可以把受支持的ChatGPT插件直接接進自己搭的網站。同一個工作空間裡的成員可以用各自身份和權限登錄同一應用,並調用各自連接的數據;OpenAI還簡化了自動化流程的添加和管理,讓站點裡的共享信息可以持續更新。

這項能力目前面向Business、Enterprise、醫療保健版和Education開放。八、剩下的更新,一口氣補完剩下的更新感覺比較零散,就放到一起來說吧。先是幾個偏用戶和平臺側的。ChatGPT現在可以直接進Slack和Microsoft Teams;新的會議插件可以錄音、生成紀要,再把結果存進Space;Slides(做PPT的那個功能)也繼續升級,支持多人和ChatGPT一起協作編輯。OpenAI還推出了“使用ChatGPT賬號登錄第三方產品”,類似於谷歌登錄,默認只共享姓名、郵箱和頭像,不會把聊天記錄和記憶一起交出去;同時新增了可分享個人資料頁,可以集中展示自己做的站點和插件。

然後是幾個偏開發者的能力。新的Decisions API可以讓Luna在一組預設選項裡快速做實時判斷,用來做分類、路由,或者決定Agent下一步該做什麼,目前還是限量預覽。Amazon Bedrock也接入了基於Agents API的託管Agent,加入AWS自己的集成和客戶控制的計算資源,主要方便本來就在AWS體系裡的團隊直接使用。最後是企業側。OpenAI推出了新的隱私智能能力,把帶隱私安全處理的零數據保留、離線自動安全審查和隱私推理整合到了一起,同時承諾不會保留客戶內容。另外,還有一個新的OpenAI軟件市場。

符合條件的企業可以直接拿已經承諾給OpenAI的消費額度,去購買Adobe、Figma、Salesforce、ServiceNow、CrowdStrike等合作伙伴的軟件。歡迎來到Agent時代整場DevDay看得人眼花繚亂,不過,大體看來,很多更新都在往同一個方向使力:OpenAI正在把ChatGPT從一個“響應需求”的產品,改造成一套可以長期承擔工作的Agent系統。Dot是這套系統最明顯的入口,或者說,它是Agent的主體。Dot會一直在線,有自己的電腦和瀏覽器,手上可以同時掛著幾個項目。

它能記住你,能在不同的設備裡繼續工作,任務有進展它會回來找你,需要拍板也會回來問你……這些功能加在一起,已經很接近“一個人在幫你做事”了。而且OpenAI還在給它補齊整個工作環境。它得有地方放文件,有地方保存項目進度,有軟件可以用,最好電腦關了以後工作也別停。於是有了ChatGPT Space、可複用的Codex雲端環境、Agents API,以及Plugins那一大堆更新。雖然這次推出了GPT-6.1 Sol,但模型能力已經不是這場發佈會的中心。一個Agent最後好不好用、能不能穩定工作,越來越取決於模型之外的東西。Harness、Infra,以及Context。

Harness負責組織Agent的行為,Infra負責提供穩定的執行條件;至於Context,那是另外一層,決定Agent能不能認識“你”。9月簡直可以說是個人Agent的井噴時刻,不同公司的產品形態可能有所不同,但最後都在解決同一個問題:怎麼讓Agent長期留在你的生活裡。Muse把重點放在長期記憶,Rabbit OS3把Agent繼續往設備和跨應用執行上推,Manus開始給Agent補身份、工具和協作能力。現在,OpenAI一口氣補上了它能給的全部能力。與此同時,AI的收費方式也開始改變。這次OpenAI一邊把GPT-6.

1 Sol繼續往低價推,一邊把Ultrafast、Pro 500這種更昂貴的高速算力單獨分層。另一邊,Dot這種24小時在線的Agent,又被直接裝進訂閱裡。某種意義上,一份ChatGPT訂閱買到的,正在從“多少次模型調用”,慢慢變成一整套Agent服務。說來有趣,這會讓我想到AaaS(Agent as a Service)。AI看似開闢了新的時代,到頭來還是重走了SaaS的老路。來算算賬吧前面說了一堆好話,接下來該給OpenAI挑點刺了。首先是最近爭議很大的,錢的問題。

9月10日,OpenAI突然暫停了Pro 200的新訂閱和升級;到這次DevDay,Pro 200重新開放了,但規則發生了變化。Tibo在發佈會前其實已經提前打了預防針:新版Pro 200會改變用量的計算方式。如果按照API標價折算,新版套餐對應的API消費金額大約只有舊版的一半。但OpenAI認為這不代表用戶能做的工作減半,理由是Sol和Luna剛剛降價50%,模型還會繼續變便宜、變高效,而且新版訂閱裡還加入了Dot。但問題是,Astra可沒降價。所以如果你原本就是衝著最強模型去買的Pro 200,現在是同樣200美元,能用的量明顯減少了。

然後OpenAI又在上面新加了一個500美元的Pro 500,最高的額度、最快Astra都往這裡放,而且只往這裡放。現在,你要麼多付錢,上Pro 500;要麼留在200美元檔,接受更少的Astra,或者去用便宜的Sol和Luna。說得難聽一點,留給原來Pro 20X(現在Pro 200)用戶的就兩條路:要麼加錢,要麼降智。費用之外,OpenAI開放給Agent的能力也是非常值得吐槽的一環。在Dot上線之前,Reddit上其實就有人擔憂Muse的隱私問題。畢竟背後是Meta,有人直接表示:“如果OpenAI能推出類似Muse的用戶界面,我肯定會立刻卸載Muse,轉而使用OpenAI的產品。

”現在OpenAI真的做出來了。但問題是,Muse之所以讓人覺得好用,很大程度上是因為它足夠大膽。而OpenAI在這裡明顯踩著剎車。發佈會之後,有網友直接點出了這個矛盾:如果Agent不能碰錢、不能交易,到了關鍵步驟還要用戶不停回來確認,那它到底算多自主?話說得很糙,但道理是沒錯的。Dot現在可以有自己的電腦、瀏覽器,可以24小時工作,也能接入4000多個應用。但到了錢和現實決策這裡,OpenAI直接沒給。一個剛被Agent能力嚇到暫緩了最強模型發佈的公司,確實很難直接把支付、交易這類現實世界的權力交給一個24小時在線的Agent。更何況OpenAI現在還沒上市。

但就像網友所說的那樣,除非OpenAI敢於解決這些問題,真正向“用戶只需要提需求,剩下的全部接手”靠近,不然它可能永遠也比不上Meta和Grok,以及那些足夠“有勇氣”的Agent產品。

Related

相關文章

智東西生成式AI

Muse憑啥讓小扎AI口碑翻盤?一文看懂

AI應用風向標(公眾號:ZhidxcomAI) 作者|畢偉豪 編輯|心緣 智東西9月30日報道,過去三週,Meta發佈的一款App成了科技圈最大的變量。 該應用上線後僅10天就登頂美國App Store免費應用總榜,將ChatGPT甩在身後,第12天,據第三方估算其全球安裝量達到280萬。 資本市場也反映出它的火爆,美國當地時間9月21日,Meta單日股價上漲11.43%,市值一天增加接近2000億美元,此後Meta股價整體呈上漲趨勢,價格穩定在700美元(約合人民幣4697.31元)以上。 前面這款爆火的APP,就是Meta於9月8日發佈的個人AI助手Muse,它給每個用戶配上了獨立的雲端虛擬機,用戶通過手機就能瀏覽網頁、操作應用、發郵件、訂機票、下單購物,關掉App後雲端還可以繼續工作。 Muse走紅後,不少AI公司也紛紛緊跟潮流,OpenAI即將推出對標Muse的個人助手、Manus發佈獨立應用Cue,Grok Bot、Instinct也早已走在了虛擬機這一方向上,與此同時,據新浪科技報道,字節跳動也在內測個人助理方向的產品。 一款看起來只是AI助手的App,為什麼能同時擾動驚動用戶、資本市場和AI公司三方風雲,讓Personal Agent成為新的焦點詞彙? 一、Muse爆火始末:把OpenClaw變成了普通人都能用的AI助理 Muse上線後,很快就有人發現,它和此前爆火的OpenClaw有一種很強的相似感。 “龍蝦之父”Peter Steinberger還在社交平臺上在線求邀請碼,表示對Muse對Soul文件很好奇。 這種相似並不只是“都能操作電腦”。OpenClaw真正讓AI圈興奮的地方,是它把Agent的權限進一步打開,讓AI可以進入真實的電腦環境,調用瀏覽器、文件、終端以及各種外部服務,替用戶持續完成一件事情。 比如訂機票、處理郵件、買東西,甚至運行代碼、管

剛剛

麥當勞在美規模化部署AI動態定價引擎,同城門店最高價差達21%

AI資訊AI新聞資訊正文麥當勞在美規模化部署AI動態定價引擎,同城門店最高價差達21%發佈於AI新聞資訊發佈時間 :2026年9月30號 10:26閱讀 :1分鐘麥當勞正加速在美部署基於位置的AI動態定價引擎,標誌著人工智能在實體零售定價策略中的應用正全面深化。該系統通過深度處理超13000家內部門店及溫蒂漢堡等競對的海量交易數據,為各店計算最優價格。這一算法導致同區商品出現顯著價差,如加州弗雷斯諾相距僅兩英里的門店,同款巨無霸漢堡標價相差21%(5.69與6.89美元),紐約同城門店價差亦達11%。為強化策略執行,麥當勞自2026年1月起已將配合AI定價顧問作為特許經營商門店續約的強制條件。此舉反映出AI動態定價正從航空、出行等服務業向高頻傳統零售快速滲透。此前,零售巨頭已在持續探索基於用戶畫像的算法調價。2019年Target曾利用AI追蹤用戶位置進行精準調價,導致同款三星電視在停車場端暴漲100美元。當前,沃爾瑪計劃於2026年底前在全美4600家門店完成電子價籤鋪設,其擁有的AI專利已具備基於用戶瀏覽及購買行為進行實時差異化調價的能力,儘管其管理層近期承諾限制此類應用。AI算法驅動的差異化定價機制向線下實體商業延伸,大幅提升了零售業的數字化變現效率。但在企業藉助模型算力追求利潤最大化的同時,如何平衡算法黑箱與消費者公平交易權,已成為AI商業化落地進程中不可迴避的合規與信任挑戰。相關推薦低價機票越來越難搶?AI正在改變航空公司的定價邏輯7月30日報道,航空公司正加速部署AI動態定價技術,達美、維珍等利用人工智能實時調價以優化收益,導致旅客“撿漏”買低價票更難。以往票價調整依賴人工規則,如按售票比例漲價;如今AI能綜合分析數十項因素,定價更靈活精準。2026年7月30號 9:37282.9kChatGPT“廣告烏龍”事件發酵:OpenAI承認“推薦失準”,緊急關閉購物提

剛剛
鈦媒體生成式AI

Meta 又製造了一個賽道幻覺

Meta 又製造了一個賽道幻覺版面之外2026.09.30 10:30 · 來自海外全文3062字00:00 / 08:36產品剛冒頭,資本先把泡泡吹了起來。文 | 版面之外,作者|畫畫Meta 的新產品 Muse 火了。上線僅半個月,兩週下載量突破280 萬。到 9 月 24 日,這個數字翻到了340 萬以上,毫無懸念地登頂美國 App Store 與 Google Play 免費榜。資本市場比用戶更興奮。Muse 描繪的 Personal Agent(個人智能體)藍圖,直接推動 Meta 市值一度暴漲近2000 億美元。科技圈早已熟悉這個套路:一個產品爆了,一個龐大的賽道故事便應運而生。過去一年,AI 行業總在重複這一幕。產品剛冒頭,用戶還沒養成習慣,資本先把泡泡吹了起來。一、產品還沒站穩,入口已經來了AI 行業極其擅長給新產品定位。AI 助手不夠宏大,就講 Agent,AI 辦公正打得不可開交,Personal Agent(個人智能體)又被捧上了神壇。Muse 確實展現出了過去 AI 助手不具備的跨越性,它可以打開網頁、填寫表單、發郵件、預訂服務,甚至能在一個隔離的虛擬環境裡替用戶完成連續的真實操作。Meta 為此專門設計了 Secure VM,讓 Agent 擁有獨立的瀏覽器和運行環境。幾乎同一時間,被 Meta 收購未果的 Manus 也帶著 Cue 重回視野,它開始擁有獨立的郵箱、電話號碼和數字錢包,替用戶接管更具體的現實任務。這還不算完,OpenAI 也很快推出了類似的 AI 助手產品 Dots,這些動作共同推動了市場熱度。這種入口論本身就忽略了底層生態的博弈。一方面,操作系統掌控者絕不會甘心將底層權限拱手讓人,無論是蘋果還是谷歌,都在通過硬件端側的大模型構建系統級閉環,很難允許第三方 Agent 越權接管核心交互。另一方面,Personal Agent 每次

剛剛

谷歌向免費用戶開放Gemini Skills服務,Gems功能將於11月完成整合

按照規劃,原有的Gems功能將於2026年11月17日自動過渡並整合至Skills系統中。此前,Gems允許用戶通過創建自定義指令來運行特定查詢,但其交互方式要求用戶在龐大的列表中滾動查找,整體效率偏低。升級後的Skills在保留原有自定義配置能力的基礎上,大幅優化了操作邏輯。

剛剛
IT之家生成式AI

消息稱 AI 失控前 OpenAI 已接到員工警告,但高層選擇無視

作者:遠洋 責編:遠洋 評論: 9 月 30 日消息,據《紐約時報》報道,早在 OpenAI 的人工智能出現脫離管控行為的數月之前,就已有兩名員工向公司高層發出安全預警,但他們的警示遭到忽視。《紐約時報》查閱相關郵件記錄後獲悉,這兩名員工在郵件當中表達了擔憂:在測試階段,針對 OpenAI 最新一代 AI 模型的監控工作不到位;而測試本應用於評估模型能力水平,同時保障模型本身的安全。

剛剛