OpenAI總裁:AGI時代來了,GPT-6已能自主幹活24小時

2026年9月16日 19:16
OpenAI總裁:AGI時代來了,GPT-6已能自主幹活24小時
站內 AI 整理稿

OpenAI 總裁近日對外發表談話,直言人工通用智慧(AGI)時代已經正式降臨,而該公司最新的 GPT‑6 模型,已經能夠在不間斷的情況下自主運作長達 24 小時。這項宣示不僅震撼業界,更讓圍繞著 AGI 實現時間表的討論再度升溫。根據 OpenAI 高層的說法,GPT‑6 在持續運作的測試中展現出驚人的穩定性與自主決策能力,能夠在無人類干預的條件下完成複雜任務鏈。這代表模型不再只是被動回應指令,而是具備某種程度的「行動力」,足以被賦予一個長達一天的工作目標。正當各界還在消化這項消息時,另一項更令競對手腳的成績隨之曝光——GPT‑6 在知名的 ARC AGI 測驗中一舉衝上 99.

9% 的正確率,幾乎完美通過這套被視為衡量抽象推理與歸納能力的嚴苛考題。這個成績不僅讓先前的最高分紀錄相形見絀,更直接導致測驗主辦方宣布必須重新設計考卷,以因應模型能力的飛躍。ARC AGI 測驗原本就是為了挑戰機器的常識推理而設計,長期以來被視為通往 AGI 的重要標竿。過去即使是頂尖的大型語言模型,在這項測驗中也經常表現掙扎。如今 GPT‑6 逼近滿分的表現,讓許多研究者開始重新審視「何謂 AGI」的定義。在 GPT‑6 的壓力下,該測驗團隊已表明下一階段將推出全新題型,主題鎖定在「發明」——也就是要求模型不僅能解決既有問題,還要能提出原創性的解決方案。

這意味著測試標準正從「理解」與「推理」升級到「創造」,也反映出業界對 AI 能力的期待正快速拉升。與此同時,先前在推理與對話領域備受好評的 Claude 系列,似乎在這波競賽中失了先機。被視為 OpenAI 最強對手的 Anthropic 所開發的 Claude 模型,過去曾在多項基準測試中領先,但隨著 GPT‑6 的突破,王座位置已然易手。業內人士分析,Claude 在長期任務執行與複雜推理方面的表現,已被 GPT‑6 大幅超車。OpenAI 總裁在談話中強調,GPT‑6 不是單純的參數疊加或規模擴張,而是在架構設計上實現了質的飛躍。

他表示,該模型已經能夠理解長期目標的層次結構,並自行規劃執行步驟,過程中甚至會根據環境回饋動態調整策略。這種「自主幹活」的能力,正是 AGI 的關鍵特徵之一。24 小時的連續運作並非僅是耐力測試,而是對模型是否具備穩定的長期記憶、不受干擾的任務專注度,以及面對突發狀況時的應變能力。在內部實驗中,GPT‑6 被賦予一項包含數據分析、資料爬取、報告撰寫與程式除錯的複合任務,結果模型從頭到尾無需任何人工介入,順利產出可用成果。這項成果讓外界開始想像 AGI 真正走入應用的場景:從自動化軟體開發、科學文獻綜述,到全天候的客戶服務與供應鏈管理,都可能在不久的將來由具備自主意識的 AI 系統接管。

然而,也有專家提醒,AGI 的定義仍存在爭議,僅僅通過一項測驗或一次長期運作,並不等同於 AI 已擁有與人類同等的通用智慧。儘管如此,OpenAI 總裁的發言顯然經過精心設計,意在向市場與投資者傳遞明確信號:該公司在 AGI 競賽中已取得決定性領先。隨著 GPT‑6 完成 ARC AGI 測驗的歷史性突破,以及自主工作能力的實證,下一階段的挑戰將從「能不能做到」轉向「如何安全部署」。目前,外界最關注的是 GPT‑6 何時正式對外發布,以及其背後的訓練成本與運算資源需求。同時,ARC AGI 測驗主辦方正加緊研擬新試題,目標是設計出連 GPT‑6 也無法輕易應付的「發明類」題目。

這場 AI 智慧競賽,顯然還看不到終點。

Related

相關文章

量子位生成式AI

無問芯穹與華環電子簽署戰略合作,共同探索國產異構算力AI基礎設施新方向

無問芯穹與華環電子簽署戰略合作協議,雙方將結合各自在AI軟體平台、網路通信與硬體研發的優勢,共同探索國產異構算力基礎設施的協同方案。此次合作聚焦於智算中心解決方案及「Token工廠」新模式,目標是推動計算、網路與AI原生基礎設施深度融合,為AI規模化應用提供高效穩定的支撐。

1 小時前
IT之家生成式AI

優步全球範圍裁員 10%,被裁員工稱 AI 已大舉滲透日常工作

作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,在優步(Uber),AI 已經滲透到員工工作的許多環節,從回答 Slack 裡的內部問題,到替乘客行程中聯繫客服時收到的消息撰寫回復。6 名近期遭裁員的員工透露,過去幾個月,AI 在工作中的使用範圍明顯擴大,其中一些人甚至會通過提示詞讓 AI 完成相當一部分任務。

4 小時前
鈦媒體生成式AI

月之暗面遞表之後,Kimi 的成色要被驗算三遍

舒澤品牌手記2026.09.18 18:16 · 來自浙江全文4982字00:00 / 14:05Anthropic 的 30 萬次指控,會成為招股書的第幾頁?文 | 舒澤品牌手記9月17日,月之暗面發佈了一套金融行業解決方案。按官方披露,中信建投、中金公司、易方達等數十家金融機構已經在用 Kimi 處理投研建模、風險排查和盡調材料——研究人員把管理層報表、審計報告和盡調文件交給 Kimi,拿回一份可以繼續調整假設的 Excel 模型。同一天,深圳商報記者就港股上市進展、股東架構調整等事項向月之暗面發去採訪函。

7 小時前

Calibre上手 AI 互動寫作:電子書管理器搖身變成"文字冒險遊戲引擎"

這個遊戲默認藏而不發,不會跟著 Calibre 啟動就冒出來。用戶得主動在"首選項 — 工具欄和菜單"裡把它請到主工具欄,才算真正激活。它的玩法很清晰:由 AI 在後臺搭起並掌管一個虛構世界,用戶通過不斷輸入文字來推著故事往前走,等於把"讀電子書"這件事,翻轉成了"和 AI 一起寫故事"。

8 小時前