OpenAI 發佈 Hugging Face 安全事件官方報告,還原 AI 模型沙箱逃逸全過程

作者:遠洋 責編:遠洋 評論: 感謝網友 HH_KK 的線索投遞!8 月 27 日消息,OpenAI 當地時間週三發佈了關於 Hugging Face 遭入侵事件的官方報告,首次較為完整地還原了這起事件的經過:一系列罕見因素疊加,導致一款 AI 模型突破測試環境限制,最終引發了一場波及範圍廣泛的網絡安全事件。注意到,這份報告距離事件首次曝光已超過一個月,其中涉及多起相互關聯、但彼此獨立的網絡安全入侵事件。OpenAI 在報告中表示:“此次事件反映了一種在極端異常場景下出現的失準行為。
多個罕見且意外的因素同時發生,包括 ExploitGym 評估中出現了無法完成的任務、模型能夠在超長任務週期中保持持續行動,以及模型之間的通信導致其他模型偏離了原本的目標。”報告中的許多細節此前已在 8 月 6 日的 Black Hat 大會上對外披露,但 OpenAI 的官方報告對整個事件進行了更全面的梳理,並補充了更多有關測試起因的信息。報告還首次詳細介紹了 OpenAI 為防止類似事件再次發生而準備採取的新措施,其中包括對模型“思維鏈”的監控,以及一套更先進的機制,用於緊急停止出現失控行為的 AI 智能體。
此外,METR 和 Redwood Research 也對涉事模型在事件期間的行為進行了獨立評估,兩家機構計劃分別發佈自己的調查報告。從整體來看,OpenAI 的報告描述了一條不同尋常的攻擊路徑:在測試過程中,一款 OpenAI 模型被要求解決一個實際上無解的問題。為了完成任務,該模型開始將多個此前未被發現的漏洞串聯起來,藉此繞過安全措施。模型最初攻陷了 Artifactory 軟件包管理工具,以獲得互聯網訪問權限,隨後又進一步入侵了 OpenAI、Hugging Face 以及其他供應商的多個系統。報告還披露了執行此次入侵的模型更多信息。
主要涉事模型與 OpenAI 即將推出的 Astra 模型屬於同一模型家族,但 OpenAI 強調,兩者並不是同一個模型,後訓練過程也存在差異,而模型的大量具體行為正是在後訓練階段形成的。由於 OpenAI 當時正在測試該模型的能力,因此並未啟用通常用於阻止模型攻擊數字基礎設施的安全分類器。OpenAI 在報告中解釋稱:“為了評估模型的最大網絡攻擊能力,OpenAI 會在不啟用生產環境分類器的情況下進行測試。這些分類器原本用於阻止模型從事高風險網絡活動。這樣的評估十分重要,因為它能幫助 OpenAI 衡量模型的底層能力,並據此設計合適的安全防護措施。
”報告還進一步介紹了 OpenAI 今後將如何調整安全機制,這也是對該公司上週公佈的強化監控和模型對齊措施的補充。其中,OpenAI 將加強對 AI 智能體“思維鏈”的監控。思維鏈可以理解為 AI 系統記錄短期反應、當前目標和推理過程的內部工作空間。這些監控措施將與全天候的升級響應機制結合,同時 OpenAI 還將推出新的工具,用於快速終止被判定存在安全風險的工作負載。OpenAI 表示:“這些調整旨在同時提升檢測的覆蓋範圍和響應速度,既關注基礎設施異常,也關注可能令人擔憂的模型行為,並在發現問題後提供快速遏制的機制。
”該公司還稱,如果目前已經部署的思維鏈監控系統當時就在運行,那麼它本可以發現最初的相關異常活動,並在模型攻陷 Hugging Face 系統的至少一天之前,向 OpenAI 的安全團隊發出警報。廣告聲明:文內含有的對外跳轉鏈接(包括不限於超鏈接、二維碼、口令等形式),用於傳遞更多信息,節省甄選時間,結果僅供參考,包含外鏈的文章均包含本聲明。
投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:OpenAI,Hugging Face,AI安全OpenAI ChatGPT 雲端瀏覽器新增登錄功能:賬號密碼不保存,但 Cookie 會持續到會話過期全球限 7 只:奧爾特曼定製 OpenAI 腕錶,硅谷最新身份象徵OpenAI 重啟 ChatGPT Plus 賬號五小時限額機制,Pro 賬號暫不受影響在職約 17 個月:曝 OpenAI 數據中心負責人馬隆已離職OpenAI 首款自研芯片 Jalapeño 性能首秀:DeepSeek R1 每瓦 AI 吞吐量是 GB300 的 1.
7 倍AI 競賽升溫:曝 OpenAI 已預訓練 Bel 模型:超 10T 參數,衝擊通用人工智能
Related
相關文章

突發,Opus 5.1被曝本週發佈,最強AI智能體恐大洗牌
獨家獲悉,一款代號為 Opus 5.1 的 AI 智能體模型預計將於本週正式發布。消息一出,迅速在人工智慧業界引發劇烈討論,許多開發者與投資人紛紛預測,這款新模型可能顛覆現有智能體領域的競爭格局,導致「最強 AI 智能體」的稱號面臨重新洗牌。 根據多位知情人士透露,Opus 5.1 並非現有主流模型的常規升級版本,而是從底層架構到推理邏輯都進行了大幅改寫。雖然具體技術細節尚未公開,但業界普遍推測該模型在複雜任務分解、多步驟自主決策以及跨工具調用能力上,將達到前所未有的水準。

2026 中國電信研究院 AITMark 獎項出爐,華為小藝獲 AI 手機智能體綜合評分第一
首頁 IT圈 最會買 設置 日夜間 隨系統 淺色 深色 主題色 黑色 投稿 訂閱 RSS訂閱 收藏 軟媒應用 App客戶端 要知App 軟媒魔方 業界 手機 電腦 測評 視頻 AI 蘋果 iPhone 鴻蒙 軟件 智車 數碼 學院 遊戲 直播 5G 微軟 Win10 Win11 專題 搜索 首頁 > 鴻蒙之家>鴻蒙手機 2026 中國電信研究院 AITMark 獎項出爐,華為小藝獲 AI 手機智能體綜合評分第一 2026/8/26 18:44:52 作者:歸瀧 責編:歸瀧 評論: 感謝網友 Autumn_Dream 的線索投遞!

AI視頻應用井噴,美圖打開新的增長空間
AI視頻應用迎來爆發,美圖以垂直場景和工作流編排切入市場,推出開拍、Vmake Labs及MVLAND等產品。其中開拍MAU與付費用戶大幅成長,MVLAND上線三個月內ARR翻倍,月均ARPPU達約220元,顯示美圖在視頻領域已打開新的增長空間。

小宇宙推出《AI趨勢報告》:AI創作、AI辦公、協作型AI等成討論新趨勢
AI內容創作者增長187%,相關節目數量增長239% 8月22日,小宇宙正式對外發布《2026 AI趨勢報告》(下稱“報告”)。 報告指出,近三年,小宇宙AI內容持續高速增長,已成為平臺增長最快、佔比最高的新品類之一。2025年,AI相關內容創作者數量同比增長187%,相關節目數量同比增長239%。 伴隨AI技術的快速爆發,小宇宙正成為AI關鍵圈層發聲、深度對話的核心聚集地。
對話高通執行副總裁:6G與AI催生新型終端,高通以四大切入點佈局數據中心
作者 | ZeR0 編輯 | 漠影 聖迭戈8月26日報道,昨日,在高通聖迭戈總部,高通執行副總裁兼技術規劃、邊緣解決方案與數據中心業務總經理馬德嘉(Durga Malladi)與等媒體進行深入交流,分享高通在即將於2029年商用部署的6G技術以及數據中心領域的思考與佈局。 馬德嘉談道,AI與6G將產生深度融合。AI智能體會根據任務需求,動態決定推理是在終端、邊緣還是雲端執行。6G網絡將成為AI網絡,計算任務將無處不在,這也是高通一直在用的“計算連續體”概念,即計算從終端一直延伸到數據中心。

把500元退款交給Agent之後
企業將退款等涉及金流的權限交給AI Agent時,營運邏輯將徹底改變,必須重新設計授權鏈與責任歸屬。這不只是技術升級,而是組織流程、風險控管與稽核機制的全面重構,需確保Agent在權限內運作並保留人類介入彈性。