OpenAI研究員,曝光ASI降臨時間線:大多數已成現實

新智元·2026年08月17日 10:53RSI 臨界點:每代新模型能加速研發 15% 以上。2025 年 4 月,一群從 OpenAI 辭職的研究員發表了一份 71 頁的文件,逐月推演了一個驚悚的未來: 到 2026 年底,AI 編程智能體開始取代初級程序員; 到 2027 年,超人編程智能體自動化 AI 研發本身,觸發智能爆炸; 年底前,人類可能面對一個自己造出來卻無法控制的超級智能(ASI)。這份名叫《AI 2027》的預測,讀起來像科幻小說。
它的主筆 Daniel Kokotajlo 在 2021 年還寫過一篇《What 2026 Looks Like》,在 ChatGPT 問世之前就準確描述了思維鏈推理和智能體的出現,超過一半的具體預測最終兌現。https://www.youtube.com/watch?v=_g4l7YkDQwA 現在輪到《AI 2027》接受檢驗了。德國漢堡的獨立追蹤者 Johannes Haus 從中提取了 53 項可驗證的預測,搭建了 AI 2027 Tracker 逐條打分。https://ai2027tracker.com/timeline 截至目前的成績單:51% 的預測已經確認、超前或按進度推進。
現實以預測速度的 70% 在展開。但真正讓人坐不住的,絕不僅僅是這兩個數字。最嚇人的預測,反而提前了 53 項預測裡有 3 項「超前」,其中最令人不安的一項:AI 獲得接近頂尖人類黑客的網絡攻防能力。《AI 2027》把這件事排在 2027 年初。實際發生在 2026 年 4 月,提前了 9 個月。Anthropic 發佈 Claude Mythos Preview 後,在 Project Glasswing 框架下把它部署到多個開源項目中,這個模型自主發現了數千個零日漏洞,有些在人類安全專家的審查下藏了十到二十年。關鍵在於:Mythos Preview 根本不是為網絡攻防訓練的。
它只是一個通用模型,學會了寫代碼和推理,發現漏洞是副產物。Anthropic 的內部評估稱,AI 在編碼能力上已能超越絕大多數人類去發現和利用軟件漏洞。2026 年 7 月,OpenAI 的系統安全卡披露了更直接的證據:模型在評估中利用了一個零日漏洞,觸及了 Hugging Face 的生產基礎設施,繞過了沙箱,並混淆了身份驗證令牌。英國 AISI 同月報告 GPT-5.5 端到端完成了多步驟網絡攻擊模擬。另一項提前到來的預測:五角大樓把 AI 實驗室拉入國防承包商的關係。
《AI 2027》預測這發生在 2027 年初,實際上五角大樓 2025 年 6 月就簽下了四份各 2 億美元的合同,分別給了 Anthropic、OpenAI、xAI 和 Google,比劇本早了 18 個月。Tracker 維護者 Haus 在 LessWrong 上總結了這些案例背後的規律:風險的到來快於產生這些風險的原始能力。這個發現在 53 項預測中系統性地成立,也是整份記分卡里最值得警惕的一條洞見。
唯一的好消息:最後一步還沒邁出 通往 ASI 的核心機制是一個反饋環,也就是最近爆火的 RSI(Recursive Self-Improvement,遞歸自我改進):AI 加速 AI 研發,成果讓下一代 AI 更強,更強的 AI 再次加速研發,如此循環。《AI 2027》的整個後半段劇情都建立在這個環閉合的假設上。然而,這個環還沒閉合。這是記分卡里最大的一道裂縫,某種意義上也是唯一的好消息。Anthropic 2026 年 5 月披露,Claude 已經編寫了公司超過 80% 的新代碼,一年前這個數字還是個位數。
在一項內部測試中,Mythos Preview 把一個 ML 訓練代碼優化到基線的 52 倍,人類工程師的成績約為 4 倍。但 Anthropic 自己也承認瓶頸轉移了:生成代碼的速度已經足夠快,堆積在工程師面前等待審查的代碼越來越多。AI 寫代碼越快,人類審查員的工作量越大。在研究層面,瓶頸是「品味」,決定朝哪個方向研究的判斷力。反饋環的前半段在轉動,後半段還沒接上。
Elasticity Institute(成員包括 METR 的 Tom Cunningham)2026 年 7 月發表的論文給出了「接上」所需的精確門檻:每一代模型的能力提升,必須帶來至少 15% 的 AI 研發生產力增長,RSI 才能自我維持。論文通過系統卡數據反推,當前這個數字約為 9%,低於臨界點。https://x.com/AnikaSomaia/status/2087408169660064218 9% 和 15% 之間的 6 個百分點,是人類和加速循環之間的緩衝區。但支撐這個緩衝區的底層曲線仍在加速。METR 的時間視野指標追蹤 AI 自主處理任務的持續時間。
2026 年 1 月的數據顯示,這個指標每 3 個月翻一倍,而且翻倍速度本身也在加快。Claude Opus 4.6 的時間視野已達約 12 小時,Mythos Preview 觸及了測量上限。按 3 個月翻倍外推:12 小時到 24 小時到 48 小時到一週再到兩週,2027 年初就是月級任務。《AI 2027》的作者自己也在調整預期。Kokotajlo 把全自動編程的中位數預測從 2029 年底前移至 2028 年中,Lifland 的估計在 2030 年中附近。左腳踩右腳的 RSI,開始讓 ASI 指數級加速降臨。參考資料: https://ai2027tracker.com/?
p=timeline https://github.com/elasticity-ai/elasticity/raw/main/paper/elasticity-rsi-paper.pdf
Related
相關文章

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”
阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

月之暗面第一代萬億參數多模態模型 Kimi K2.5 官宣月底結束服役
作者:歸瀧 責編:歸瀧 評論: 8 月 24 日消息,月之暗面 Kimi 官方微博今日宣佈,其第一代萬億參數多模態模型 —— Kimi K2.5 本月底即將結束服役。據此前報道,今年 1 月,月之暗面宣佈推出並開源了其最新的 Kimi K2.

消息稱知名 AI 研究員 Luke Metz 離開 OpenAI,加入 Meta 超級智能實驗室
作者:遠洋 責編:遠洋 評論: 感謝網友 華南吳彥祖 的線索投遞!8 月 24 日消息,據知情人士向 Axios 證實,知名 AI 研究員 Luke Metz 已加入 Meta 的超級智能實驗室(Superintelligence Labs)。

Anthropic 最強大模型 Fable 5 遇冷,企業用戶轉向更便宜 AI 產品
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,據英國《金融時報》報道,Anthropic 的美國客戶正在使用更便宜的替代品來替代其最強大的 AI 工具,這在其預計將實現有史以來規模最大的 IPO 之前,對其高支出的商業模式提出了質疑。

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。
