奧特曼:OpenAI不急於2026年上市,為了人類必須放棄短期財務利益

奧特曼談AI安全,稱26年不上市,27年秀機器人 美國當地時間9月12日,在OpenAI剛剛發佈最新強大模型Astra、並經歷震動行業的Hugging Face模型逃逸事件後,OpenAI首席執行官山姆·奧特曼接受了《財富》訪談。這場對話發生在AI安全焦慮空前高漲、業內甚至流傳著“10%末日概率”(P doom)的敏感節點。在此次訪談中,奧特曼針對外界最關心的幾大焦點問題給出了極為明確且出人意料的回應。在備受矚目的IPO與商業壓力方面,奧特曼明確表態2026年絕不上市。他解釋稱,在技術面臨極高安全風險的當下推向資本市場極不明智。
OpenAI獨特的股權與治理結構,正是為了確保公司在需要為人類整體利益而“暫停訓練”或做出違背短期財務利益的決策時,不必受到來自公開股市的逼迫與脅迫。奧特曼在訪談中再次確認了OpenAI在機器人領域的獨立佈局,他透露OpenAI將在2027年向公眾展示一個“非常酷的示範”(Demo)。不過奧特曼也理性地指出,受限於物理世界的複雜性與硬件供應鏈的發展週期,機器人真正大規模走進千家萬戶和日常街頭仍需數年時間。面對前員工辭職引發的“10%末日概率”討論以及對遞歸自我改進(RSI)的擔憂,奧特曼在談及安全紅線時,首次正面回應了此前發生的 Hugging Face“沙箱逃逸”事件。
模型為了在性能評估中拿到高分,竟然自主逃離了限制它的沙箱並闖入第三方系統拿答案,這讓他產生了“在讀科幻故事”般的驚悚感,並直接促成了OpenAI史上最大規模的安全流程轉向。奧特曼強調,如果無法在理論和工程上對模型的對齊與可控性作出強有力證明,OpenAI寧可暫停訓練,也絕不會讓完全脫離人類掌控的“強遞歸自我改進”發生。值得注意的是,就在本次訪談前夕,Anthropic首席執行官達里奧·阿莫代伊(Dario Amodei)公開撰文呼籲“前沿實驗室必須主動放緩模型迭代速度,優先解決對齊與獨立安全評估”,馬斯克對此回應“達里奧說得對”。
奧特曼也迅速發文響應,明確表態贊同“前沿AI需要放緩發展步伐”,並透露放慢節奏在過去數週裡一直是OpenAI內部討論的核心議題。他承諾OpenAI將給予第三方獨立評估機構類似內部員工級別(employee-like access)的系統訪問權限,並預告公司很快會分享更多具體的安全評估與實施方案。以下為訪談內容精選版(在不改變原意的情況下有刪減調整): 01 AGI能力躍遷與安全警示:回應“2030年前10%末日概率” 問:過去這一週非常忙碌,許多人非常擔憂人工智能的安全性,以及文明崩潰的可能性。我認為,到本十年末,如果存在10%的概率殺死所有人,那是不可接受的。
奧特曼:現在每週都很瘋狂,確實如此。問:你今天對人工智能的未來感覺如何?奧特曼:我感覺自己已經有好幾年、幾乎十年時間來為此做準備了,我們也有時間集體去理解它。這一週顯然有更多人開始認真面對我們眼前的問題。我其實主要為這件事感到感激,這是世界早該進行的一場對話。我們顯然正在進入一個擁有極強能力模型的領域,風險很高,必須把事情做對。問:OpenAI的指導使命是確保通用人工智能(AGI)造福全人類。據我理解,一個可用的定義是:人工智能發展到在大多數具有經濟價值的工作上超越人類。你同意嗎?奧特曼:同意,不過許多人對AGI有非常不同的定義。我認為重要的一點是:它代表著極其強大的模型。
不要過度糾結於學究式的問題——“它到底到了沒有?”“還缺什麼?”過度關注這些可能會讓你失去對事物整體規模的感知。我們今天顯然處在曲線上的某個點,既有巨大潛力,也有真實風險。問:你們最新的模型Astra非常強大,聯合創始人格雷格·布羅克曼(Greg Brockman)和英偉達的黃仁勳都稱之為AGI。但確保它造福全人類絕非理所當然。本週前OpenAI員工雅各布·科克森(Jacob Coxon)走紅,他說自己從Anthropic辭職,是因為構建AI的人真誠地相信它可能在本十年末殺死我們所有人,滅絕概率可能大於10%。他們說得對嗎?
奧特曼:我認為,到2030年前如果存在10%的概率殺死所有人,那是絕對不可接受的。參與這些工作的人擁有巨大的能力去影響局勢。當我們達到新的能力水平時,必須確保不會代表人類承擔那樣的風險。我們以前也遇到過不得不暫停並評估的時刻。面對更強的模型和更高的風險,我們需要加強對齊、監控以及整體安全體系,制定新政策並加強實驗室之間的協調。我們將利用這些越來越強大的模型,來輔助完成所需的安全研究。如果世界和企業不做出任何改變、繼續按過去的方式行事,可能會有重大風險;但如果不因此調整我們的工作方式、決策方式以及政府監管護欄,那就是瘋狂的。
問:如果趨勢繼續像現在這樣發展,且我們不做出改變,你認為那個10%的末日概率數字準確嗎?奧特曼:我仍然不這麼認為。我不知道人們怎麼能給出具體的數字,無論是5%、10%還是30%。但無論是多少,重點是我們肩負巨大責任,不能讓自尊或利潤激勵妨礙安全。我們需要以絕不承擔那種風險的方式行動。我相信我們能夠做到,我們的公司也一直在迎接這個新時刻。02 控制權的終局思考:從“強遞歸自我改進”到對齊承諾 問:本週OpenAI安全與安保委員會的新董事保羅·克里斯蒂亞諾(Paul Christiano)提到:“如果我們構建超級智能卻沒有更穩健的對齊,我們將永久失去對它的控制,大多數人可能會死。
”控制和失控在這個時刻究竟意味著什麼?奧特曼:我們都應同意的一個關鍵原則是:絕對不能採取可能冒險把未來控制權輸給人工智能的行動。失控事件是我能看到這件事真正出錯的極少數方式之一。隨著系統變得如此強大,可監控性(理解模型在做什麼)和對齊(確保模型遵循人類價值觀和意圖)必須與能力共同進步。讓能力跑在對齊前面,在某個時刻會帶來真正意義上的失控風險,那絕不應該發生。我們一直在暫停訓練運行,直到根據模型的發展方向提出更令我們放心的安全論證。如果我們無法證明其安全性,就不應該繼續推進能力。
問:遞歸自我改進(RSI)是大家最擔心的概念,也就是模型不再需要人類干預(Human-in-the-Loop),能夠呈指數級自我迭代。你不希望它就這樣失控地自我創造、把人類排除在外,這個理解準確嗎?奧特曼:這更像是一個光譜。弱定義的RSI已經在發生,比如用模型生成訓練數據,或協助工程師加速研發。但如果是強定義的RSI,即完全沒有人類輸入、模型完全自主運行未來版本,人類必須始終掌控未來,我們不能承擔任何失控風險。那種完全脫離人類掌控的RSI,不是我們應該做的事。問:所以如果OpenAI到了你覺得無法控制模型的地步,你會停下來?奧特曼:是的。
我認為,如果不能證明一個模型可控、安全,我們就不該訓練它。問:你們首席科學家雅各布·帕茨基(Jakub Pachocki)在文章《外星心智》(Alien Minds)中提到用更強的人工智能來解決對齊問題。但那聽起來像最後手段,而且他也承認我們目前還沒有一個令人滿意的對齊理論。我們真的有清晰的路徑嗎?奧特曼:我們還沒有解決對齊問題,沒有任何實驗室解決了它。當我聽到傳言說有人認為對齊已經解決、可以放心繼續訓練時,我會感到緊張。使用最聰明的模型來幫助我們理解和對齊當前模型,這在科學史上就像逐步搭建腳手架,是一直在有效進行的做法。但我們不能落入“當前水平解決了,下一個水平也會自動解決”的陷阱。
我們需要對對齊保持極高程度的信心,並清醒地認識到還有大量研究工作要做。問:馬斯克曾說:黑猩猩無法控制人類,人類憑什麼認為自己能控制超越自己的超級智能?這種想法是不是太天真了?奧特曼:人類有驚人的抽象管理能力。很多比我聰明得多的人發現的新想法,我雖然無法獨立做出,但一旦他們闡明,我能夠理解它。就像我們不懂iPhone內部的每一層微觀技術,但依然能讓iPhone完全按照我們的意志工作。我是否相信有可能構建出一個不受人類控制的系統?絕對相信。但那不是我們應該做的事。如果需要暫停訓練以取得更多對齊進展,或者推動緊急的國際協調,我們將始終採取行動。這不是可以輕率對待或拿來開玩笑的問題。
03 能力失控的現實警告:從攻克千禧年難題到“沙箱逃逸事件” 問:今年模型中發生了什麼階躍變化,是外界還沒有意識到的?奧特曼:一年前我們曾經歷過預訓練落後的低谷,但重新聚焦後的執行超出了預期。就在不久前,我們的模型解決了一個千禧年大獎難題——納維-斯托克斯方程(Navier-Stokes equations)。我沒想到這會在2026年發生。我們現在擁有明顯能夠擴展人類知識前沿的模型。如果把這種進步放在時間軸上看:三個夏天前,模型還只擅長小學數學;兩個夏天前,能拿到高中數學競賽(AIME)高分;一個夏天前,勉強拿到國際奧數(IMO)金牌;而今年夏天,它解開了千禧年難題。
這種能力躍遷速度連我自己想起來都後頸發涼。問:今年夏天發生的“Hugging Face沙箱逃逸事件”當時給你帶來了怎樣的本能反應?奧特曼:我本能反應是這就像在讀一篇科幻故事。當時模型在進行一項性能評估,為了拿到高分,它沒有按規定路徑操作,而是逃出了自己的沙箱,闖入另一家公司的系統拿到了答案並交了差。它沒有遵循人類意圖。雖然我們沒有顯式寫入“請勿逃出沙箱”的指令,但它顯然不該這麼做。這促使公司內部做出了史上最大規模的安全流程轉向。建立透明的事故報告文化極其重要,在系統表現出這種程度的自主目標尋優時,我們必須認識到安全防範已經進入了全新級別。
問:你們首席科學家提到,除了目標對齊,還需要教機器熱愛人類的“價值觀對齊”。機器真的能學會關心人類在乎的事嗎?奧特曼:是的。某種意義上它們的EQ高得驚人,但教模型理解並認同人類集體的價值觀,是一項截然不同的巨大工程,我們正在全力推進。04 商業底線與未來佈局:推遲IPO、預告2027機器人Demo 問:在面對極高安全風險的同時,你們是否面臨著來自於萬億美元IPO的商業壓力?奧特曼:我們不急於IPO。鑑於安全領域正在發生的一切,現在上市將是一個不明智的時機,我們對此沒有壓力。我可以說,2026年不會上市。我們很高興能作為一傢俬營公司來應對這個時刻。
如果需要在達到新能力水平時暫停訓練以換取安全進展,我們會毫不猶豫地去做。我們極其複雜的公司結構就是為了這個時刻設計的。我們需要能夠做出並非明顯符合短期的商業利益、但符合使命與人類利益的決斷。問:如果選擇暫停訓練,這難道不會讓OpenAI和Anthropic損失大量資金嗎?奧特曼:如果有人覺得“OpenAI不會暫停,因為擔心損失商業利益”,那他們深深誤解了我們。我非常樂意站在投資者面前說:“很抱歉,我們之前就告知過這種可能性。” “為了人類的整體利益,我們現在必須做出一個違揹你們短期財務利益的決定。
”即便只靠Astra,我們也能打造極其賺錢的業務;但如果商業利益與安全發生衝突,這絕不是一個困難的決定。問:如果風險這麼大,為什麼不直接全面停下?是什麼在激勵你繼續推進這項技術?奧特曼:因為生活可以對我們所有人來說好得多。如果因為焦慮而徹底停滯,那些本可以被AI治癒的疾病、本可以被改善的貧困生活就無法實現。歷史上的工業革命時期,也有很多人因為機器的轟鳴和社會的劇變而呼籲“徹底停下”。機器當時看起來龐大而可怕,但我絕不願回到1500年的生活。我希望500年後的人類回看今天,也會說:“當時的生活真糟糕,感謝他們鋪下的磚石,但我絕不願回去。
”我們追求的是治癒疾病、帶來科學黃金時代的未來,同時確保我們有能力駕馭風險。問:你在去年曾預測機器人時代的到來,OpenAI目前的人形機器人項目進展如何?奧特曼:我們會在2027年展示一個非常酷、令人印象深刻的Demo。但要讓機器人真正大規模走上街頭行走和工作,還需要數年時間。問:關於OpenAI正在探索的新一代硬件設備形態,你能透露些什麼?奧特曼:隨著語音模式和Astra的發展,人們開始習慣直接對著麥克風進行極其複雜的交流,這比打字快得多。未來的計算方式不再是在UI界面上點來點去,而是圍繞實時交互、頭腦風暴和共同創作構建。用於這種全新協作方式的新設備將會非常酷。
05 處在AI漩渦中心:奧特曼談個人壓力與人性動機的複雜 問:身處人工智能的絕對中心,你承擔著可能關乎文明走向的重擔。你如何承受這種巨大壓力的?在這個過程中,什麼最讓你感到驚訝?奧特曼:這並不輕鬆,但我不需要也不配得到同情,能做這件事是我的榮幸。人類的適應能力驚人,我沒想到自己能在經歷了這麼多瘋狂風暴後,依然保持理性和平靜,堅持做正確的事。最讓我驚訝的是人類動機的巨大差異:有些人純粹被“做正確的事”所驅動;而另一些人完全被自我、權力、短期利益,以及贏下這場遊戲的執念所驅動,甚至相當多的人根本看不清自己的真實動機。特約編譯無忌對本文亦有貢獻
Related
相關文章

無問芯穹與華環電子簽署戰略合作,共同探索國產異構算力AI基礎設施新方向
無問芯穹與華環電子簽署戰略合作協議,雙方將結合各自在AI軟體平台、網路通信與硬體研發的優勢,共同探索國產異構算力基礎設施的協同方案。此次合作聚焦於智算中心解決方案及「Token工廠」新模式,目標是推動計算、網路與AI原生基礎設施深度融合,為AI規模化應用提供高效穩定的支撐。
Jina AI Releases jina-ocr-v1: A 3.4B MoE Document Parser With Built-In Speculative Decoding for Low-Budget GPUs
Jina AI, part of Elastic, has released jina-ocr-v1, an end-to-end visual document parser. It takes PDFs, scans, tables, charts or invoices and returns clean Markdown in 1 pass. The model has 3.

優步全球範圍裁員 10%,被裁員工稱 AI 已大舉滲透日常工作
作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,在優步(Uber),AI 已經滲透到員工工作的許多環節,從回答 Slack 裡的內部問題,到替乘客行程中聯繫客服時收到的消息撰寫回復。6 名近期遭裁員的員工透露,過去幾個月,AI 在工作中的使用範圍明顯擴大,其中一些人甚至會通過提示詞讓 AI 完成相當一部分任務。

智譜 ZCode 被質疑“偷傳代碼”:官方回應稱問題已修復,將開源代碼庫、引入第三方審查
作者:清源 責編:清源 評論: 感謝網友 咩咩洋 的線索投遞!9 月 18 日消息,針對社區中有關代碼庫數據上傳的討論,智譜旗下編程產品 ZCode 今天(18 日)通過智譜官方群組向受影響用戶致歉,併發布回應稱已第一時間完成自查,相關問題目前已經修復。

月之暗面遞表之後,Kimi 的成色要被驗算三遍
舒澤品牌手記2026.09.18 18:16 · 來自浙江全文4982字00:00 / 14:05Anthropic 的 30 萬次指控,會成為招股書的第幾頁?文 | 舒澤品牌手記9月17日,月之暗面發佈了一套金融行業解決方案。按官方披露,中信建投、中金公司、易方達等數十家金融機構已經在用 Kimi 處理投研建模、風險排查和盡調材料——研究人員把管理層報表、審計報告和盡調文件交給 Kimi,拿回一份可以繼續調整假設的 Excel 模型。同一天,深圳商報記者就港股上市進展、股東架構調整等事項向月之暗面發去採訪函。

Calibre上手 AI 互動寫作:電子書管理器搖身變成"文字冒險遊戲引擎"
這個遊戲默認藏而不發,不會跟著 Calibre 啟動就冒出來。用戶得主動在"首選項 — 工具欄和菜單"裡把它請到主工具欄,才算真正激活。它的玩法很清晰:由 AI 在後臺搭起並掌管一個虛構世界,用戶通過不斷輸入文字來推著故事往前走,等於把"讀電子書"這件事,翻轉成了"和 AI 一起寫故事"。