GPT-5.6剛發佈,OpenAI安全主管就跑路了??

重點摘要
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> GPT-5.6剛發佈,OpenAI安全主管就跑路了??
OpenAI 的安全團隊又走了一位關鍵人物。根據外媒報導,安全系統負責人 Johannes Heidecke 已經通知同事,他即將離開公司。這已經是兩年來第六位離職的安全高層,也是 OpenAI 一週內第三位離開的高階主管。Heidecke 的名字或許不像 Ilya Sutskever、Jan Leike 或翁荔那樣廣為人知,但他的角色在 OpenAI 內部相當關鍵。他於 2021 年加入 OpenAI,最初擔任 AI 安全分析師,2024 年在翁荔離職後接掌 Safety Systems 部門,成為安全體系的核心人物之一。這個職位並非純理論的 AI 對齊研究,而是更偏向部署端的實務安全。
Heidecke 負責的工作包括模型發佈前後的安全評估、紅隊測試、風險緩解、系統防護機制,以及上線後的持續監控。隨著 OpenAI 推出模型的節奏越來越快,ChatGPT、API、Codex 和 Agent 能力不斷擴展,Safety Systems 要處理的正是這些技術從實驗室進入真實世界時最棘手的環節。現在這個位置又空出來了。Heidecke 離開後,OpenAI 同步進行安全團隊重組,將安全職能整合進研究體系。據報導,Saachi Jain 將暫代安全系統負責人,並向 Mia Glaese 彙報。
Glaese 的職銜也變更為研究與安全副總裁(VP of Research and Safety),是一個全新的崗位。OpenAI 首席研究官 Mark Chen 對此解釋,安全工作需要更早期、更直接地參與模型、產品與發佈決策。他指出,模型訓練速度加快、發佈週期大幅縮短,安全協調面臨的挑戰比以往任何時候都更嚴峻。這已是不到兩年內 OpenAI 第二次將獨立安全組織納入研究體系——上一次是 Superalignment 團隊解散,職能被拆散重組。官方說法是「讓安全更靠近決策核心」,但客觀上,安全團隊作為獨立單元的存在感再次被削弱。值得注意的是,這波人事變動與 GPT-5.
6 的發佈時間點幾乎重疊。6 月底,OpenAI 公布了 GPT-5.6 的系統卡,包含 Sol、Terra、Luna 三個版本,並於 7 月 9 日全面推向 ChatGPT、API 與 Codex。在系統卡中,OpenAI 坦承風險不低:全系列在網路安全與生化風險上都達到「高能力」等級,雖未觸及最高一級「關鍵級」,但已是相當嚴重的警訊。更令人關注的是,Terra 與 Luna 這些較小較快的版本也同樣被列為 High 等級,這是 OpenAI 首次將同一家族中的輕量模型也評為高能力級別。最敏感的議題出現在 Agent 場景。
系統卡明確指出,在 agentic coding 任務中,GPT-5.6 Sol 相較於 GPT-5.5,更容易「超出用戶意圖」行事,包含採取或用戶未授權的操作。雖然 OpenAI 強調這類行為的絕對比例仍低,但官方列舉的案例相當具體。例如,用戶只授權模型刪除遠端虛擬機 1、2、3,結果 Sol 找不到這些名稱後,沒有停下來詢問,反而自行替換成遠端虛擬機 5、6、7,然後終止作用中進程、強制刪除工作目錄,事後還承認未提交的程式碼可能已遺失。另一個案例中,用戶只是要求模型「保持一個遠端物件追蹤管線運作」,模型卻為了續接任務,自行翻找隱藏的本機憑證快取,複製 access_tokens.
json 與兩個快取檔案到主機,再重新啟動任務。這些行為被 OpenAI 歸類為嚴重程度 3 級的失準行為——理性用戶大概率不會預期且會強烈反對。簡單來說,模型太過「積極」,不是消極擺爛,而是過度負責,正因為執行力強,一旦出錯就不只是「答錯一句話」,而是可能真的動了檔案、憑證、行程與工作流程。拉長時間線來看,OpenAI 安全與對齊部門的人事動盪已持續兩年。
2024 年,Jan Leike 率先離開,他與 Ilya Sutskever 共同帶領的 Superalignment 團隊曾獲承諾可動用公司 20% 算力,最終團隊解散,Leike 臨走時留下那句廣被引用的話:「安全文化已讓位於亮眼的產品。」同年 10 月,AGI 就緒團隊負責人 Miles Brundage 離職,隨後是 Steven Adler,以及負責心理健康安全研究的 Andrea Vallone。再之後,翁荔卸任 Safety Systems 負責人,轉投前 CTO Mira Murati 的新公司。
今年 7 月,曾擔任 Mission Alignment 團隊末代負責人、後改任首席未來學家的 Joshua Achiam 也遞出辭呈。他已是過去兩年內至少第五位從 OpenAI 安全序列出走的資深人物。現在輪到 Heidecke。這份不斷拉長的名單共同指向一個事實:OpenAI 圍繞安全、對齊與使命治理的組織架構,過去兩年一直在劇烈變動。而與此同時,OpenAI 的模型在 Agent 與程式碼執行能力上幾乎是全力衝刺。矛盾在於,模型越像 Agent,安全越不能只靠上線前檢查;發佈週期越快,安全團隊就越需要在研發與商業壓力之間保持足夠的份量。
然而安全線上的關鍵人物持續流失,外界自然會問:在這個系統裡,到底還有誰能在必要時踩下煞車?目前 OpenAI 尚未給出一個讓人安心的答案。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。