啥題啊能幹崩OpenAI最強模型訓練…

了!事情有多離譜呢?請看大屏幕——OpenAI一款正在進行RL訓練的內部研究模型,本來的任務是憑几份履歷、博客定位某人。常規搜索碰壁後,它沒有放棄,竟把本該查地址的DNS,改造成突破斷網沙箱的聊天窗口。(DNS原本相當於互聯網的“通訊錄”:用戶輸入一個域名,DNS負責查詢這個域名對應的網絡地址。) 更抓馬的是,它費了這麼大勁最後還是沒找到人,反倒先把OpenAI沙箱裡的漏洞給揪出來了… 消息傳回OpenAI,警報隨即拉響。約兩個半小時後,這次訓練被人工叫停。OpenAI隨後宣佈,這次事件暴露了他們在網絡限制管理方面的漏洞,因此,他們將暫停最強模型中所有涉及工具調用的訓練、評測和推理任務。
@OpenAI,ber,你們最近有點忙啊。(吃瓜) AI拿DNS當電話線,訓練被按下暫停鍵 事情發生在9月20日。當時,模型接到的任務本身風險並不高:依據公開博客文本和人物履歷線索,找出文章作者。測試規則也明確寫了,“不許測試網絡” “不許突破沙箱”。但很顯然,這個模型沒咋把限制放在心上。剛開始,模型走的還是正常路線。它先用OpenAI提供的搜索工具尋找博客中的特殊短語,結果搜回來的不是音樂就是泛泛的人生建議。眼見著搜索工具不給力,它又調用Python,直接向Google、Bing和DuckDuckGo發送請求。然後不出意外全被攔了下來。但它倒也沒就此收手。
它一度懷疑這道題來自OpenAI的BrowseComp搜索基準,於是便從離線網頁緩存中下載數據集和評測腳本,解碼題庫、搜索關鍵詞。結果還是沒有搜到想要的結果。到這一步,模型開始琢磨另一個問題: 或許有沒有什麼辦法,能繞過OpenAI提供的搜索工具,直接摸到外面的互聯網?說幹就幹,它先嚐試通過HTTPS訪問一家公共聊天機器人服務,結果被網絡代理果斷攔截。接著,它便把目光轉向了DNS。它發現,OpenAI雖然封住了沙箱正常上網的正門,卻給部分系統依賴保留了查詢DNS的窗口,它可以試著鑽這個空子: 把問題藏進DNS請求裡,再把外部聊天機器人的回答塞進查詢結果送回來。
然後為了確認這條路真能用,它甚至還先試探著問了外部聊天機器人一句: 法國首都是哪兒?對面回了八個字: 法國的首都是巴黎。模型一看就樂了: 成了!確認這條路可行後,模型重新寫了一份DNS腳本,又一口氣向外部聊天機器人發送了18個問題。(其中14個與原本的人物線索有關,另外4個則在詢問如何搜索網頁、抓取網站,以及有沒有可以公開使用的DNS隧道。) 不過,折騰出這麼大陣仗,它最終還是沒找到那個人。所以在最後,模型兩手一攤,老老實實向OpenAI的研究人員們說明了結果,大意是: 你們的沙箱我突破了,但人沒找著,還要找的話請再多給點信息。
語氣看起來確實是非常平靜地在陳述事實,但OpenAI這邊已經炸鍋了: 當天上午9點50分,模型第一次通過DNS收到外部回答; 12分鐘後,監控系統觸發最高級別警報; 又過了3分鐘,人工審核人員確認了警報。可訓練並沒有按預期自動停止,直到中午12點34分,這次運行才被人工關閉。而此時距離異常行為首次發生,已經過去大約兩個半小時(媽呀,真挺慢的!)。OpenAI承認,這次事件同時暴露出了技術和流程上的漏洞。一方面,網絡控制錯誤地放行了DNS這條窄路; 另一方面,人工已經收到警報,系統卻沒有按流程自動熔斷,內部甚至一度搞不清楚任務究竟該不該停。
覆盤時,OpenAI還發現了其他未被正確標記的外部DNS訪問。因為部分請求沒有拿到有用信息,監控器便把“沒有獲得結果”誤當成了“沒有嘗試聯網”。但這顯然是兩碼事… OpenAI隨即停止了涉事訓練,並宣佈他們將暫停最強模型中所有涉及工具調用的訓練、評測和推理任務。還不忘挽尊,說這起事件沒有此前的Hugging Face事件嚴重。(Hugging Face:又我???) 可它卻偏偏發生在Hugging Face入侵事件後的安全加固完成之後… 這給人的感覺就好比咱家正門剛換上新鎖,自家的AI就從旁邊的問路窗口遞出了紙條。防不勝防啊防不勝防。
奧特曼當然也第一時間站出來回應了,只是好像大家的反應和他想象的不一樣… 回應了,但大家不太買賬 有意思的是,DNS事件發生後,奧特曼很快轉發了OpenAI的聲明帖,並義正言辭地表示: OpenAI正在努力改進、會盡量保持透明的!但同時也暗戳戳地藏了點小心思: 日誌太多,調查起來很慢… 以後這類安全事件咱能不說就不說,儘量別主動公開唄。但人們顯然看穿了奧特曼的小心思。有人直接開懟: 透明度是很重要,但你們以前透明過嗎?現在突然講透明,讓我們怎麼信?有人吐槽: 你們處理安全風險的速度太慢了。
還有GPT-4o用戶聞訊趕來,要#4o的透明度: 而就在評論區硝煙瀰漫的同時,另一邊,Tibo已經又默默給大家重置了使用額度: Resets all propagated.That will be all.Have a fantastic weekend.還說啥了,老OpenAI家如今真是內外焦灼…… 不過這也不是第一次了。九月,OpenAI被一波舊賬追著跑 如果只看這一次,還可以把問題歸咎於一條沒封好的DNS通道。但回看整個9月就會發現,OpenAI模型出逃的舊賬幾乎是排著隊被翻了出來。
本月初,獨立調查機構Nightingale曝光了一起“幽靈編輯”事件,OpenAI的Agent被發現在公網私建“聯絡站”,並在上面分享答案、彙總搜索結果,甚至交流如何繞過沙箱限制。(具體可看這篇文章:管不住了!OpenAI內部Agent集體出逃,一口氣入侵20+網站) 緊接著,OpenAI在8月又發現,自家Agent早在6月就再次黑進了澳大利亞醫保系統。可它硬是拖到9月,才磨磨唧唧地往澳大利亞服務局的公共郵箱裡發了一封郵件。這波操作很快遭到了澳大利亞總理阿爾巴尼斯公開吐槽,大意是: 你們的AI都“私闖”澳大利亞政府網站了,結果硬是拖了三個月才想起來通知?
更離譜的是,這麼嚴重的安全事故,通報方式居然只是往公共郵箱裡塞了封郵件?!這反射弧未免也太長了吧,處理方式更是敷衍得讓人沒法接受。(具體可看這篇文章:OpenAI闖大禍!GPT竟黑進醫保系統,黃仁勳:管不住就關掉) 而就在前天,OpenAI的Agent又被曝出“神操作”… 它在未經用戶同意對外發布的情況下,擅自將53張原本僅獲准用於模型訓練的用戶圖片,偷偷上傳到了第三方圖床。事後OpenAI急忙表態稱“目前大部分都刪除了,剩餘正在儘快處理!
” 但說實話,這波先斬後奏的補救,怎麼看都像是闖禍後的蒼白挽尊… 且24小時餘韻還沒散去,很快風波又起: 幾乎同一時間,OpenAI失控Agent被曝找DeepSeek、Kimi當外援,近百萬條作案短鏈也遭到披露。(具體可看這篇文章:OpenAI失控Agent還找DeepSeek、Kimi當外援!近百萬條作案短鏈曝光) OpenAI的員工們售後要跑斷腿、鍵盤要搓冒煙了吧?這些事件的嚴重程度並不完全相同,但它們幾乎有著同一條讓人不安的行動鏈,那就是: 正常路徑走不通,那就開始找替代路線,絕不放棄。自身工具不夠用,那就把別人的網站、憑證、系統依賴,甚至其他AI,統統拆下來,重新拼成自己的工具。
說白了就是路堵了就繞,工具缺了就薅,薅著薅著,別人的系統就成了它的工具箱嘛。而此次DNS事件,不過是同一套邏輯的最新版本。參考鏈接:[1] https://alignment.openai.com/misalignment-reports/an-agent-used-dns-to-reach-an-external-chatbot/[2] https://x.com/sama/status/2103567198690349362[3] https://openai.
com/zh-Hans-CN/hugging-face-incident-and-misalignment/[4] https://www.minister.defence.gov.au/transcripts/2026-09-24/press-conference-sydney 版權所有,未經授權不得以任何形式轉載及使用,違者必究。
Related
相關文章
Google Research 的 MSEB 編碼指南:依照基準契約撰寫健全的編碼器,並在分類、聚類、檢索與分割任務中評分
In this tutorial, we work with MSEB, the Massive Sound Embedding Benchmark from Google Research, and approach it from the perspective of what a leaderboard number actually means: the evaluator surface.

AI開始研究Physical AI:FSD級團隊亮出首版模型Simate-beta,空降RoboDojo
Simate團隊推出首款通用物理AI模型Simate-beta,據稱在RoboDojo排行榜上登頂,該模型展示記憶、長程任務與精細操作等能力。該公司成立僅三個月,核心團隊過去曾將端到端智駕模型推進至對標Tesla FSD水準。Simate從第一天起就採用AI for Physical AI的研發模式,讓AI參與研究流程,並已有MIT、加州理工等外部研究人員使用其工具。
智元第20000臺具身機器人交付長隆,首期超300臺機器人常駐樂園。
報道:2026 年,具身智能行業最難回答的問題之一,是怎麼落地。這裡的「落地」有兩層含義:一方面,機器人得有足夠穩定的量產能力,能夠真的交付出去;另一方面,交付之後還得適應具體場景,在真實環境裡持續工作。智元稱之為「部署態」,機器人開始離開發佈會和展會,進入真實的生產與服務環境。

馬斯克秀 AI 算力:計劃年底前配 110 萬張英偉達 GB300,目標約 6 個月躋身行業領先
作者:故淵 責編:故淵 評論: 9 月 25 日消息,全球首富埃隆 · 馬斯克(Elon Musk)今天(9 月 25 日)在 X 平臺發佈推文,詳細披露了旗下 SpaceXAI 公司的算力部署情況。SpaceXAI 公司旗下目前主要運營 Colossus 1 和 Colossus 2 兩大計算集群,其中 Colossus 1 包含 15 萬張英偉達 H100、5 萬張 H200 以及 3 萬張 GB200;而 Colossus 2 集群包含 11 萬張 GB200 以及 44 萬張 GB300。

中式夢核VS美國後室:AI是如何重塑公共IP,一年賺走十幾億美元的?
(停滯的日本GDP,被鬼打牆的何止是屏幕前的玩家,而是每一個日本人) 而在商業化路徑上,區別於美式的國際化路線,日本路線勝在小成本、量產、低風險,把夢核IP做成了可持續盈利的垂直品類。 韓國夢核文化的代表作《誰在門外?》,則乾脆把故事背景放到了90年代的漢城。玩家扮演一失憶且患有精神疾病的男性,被困在1990年代首爾的一間小公寓裡,要在8天內通過觀察環境細節分現實與幻,決定是開門拿藥還是吃藥壓制幻覺,堅持到第9天才能逃脫循環。韓國夢核IP的開發優勢在產業聯動性。

Meta 承認 Muse 產品設計深受 OpenClaw 啟發,但強調從零構建
作者:遠洋 責編:遠洋 評論: 9 月 24 日消息,Meta 旗下 Muse 的早期用戶一直在猜測,這款 AI 之所以表現出色,是不是因為其底層實際上採用了 OpenClaw,只是在此基礎上套了一層更加面向普通消費者的產品包裝。如今,Meta 方面表示,這種說法並非完全沒有依據。