OpenAI安全團隊再失核心,近年已有 8 名安全負責人相繼出走

2026年7月14日 01:306400 次瀏覽

重點摘要

OpenAI安全系統團隊負責人約翰內斯·海德克離職,累計已有八名安全負責人相繼出走。多位離職成員公開質疑公司重產品輕安全,聯合創始人揚·萊克直言安全文化已被邊緣化。

站內 AI 整理稿

OpenAI 安全系統團隊負責人約翰內斯·海德克(Johannes Heidecke)近日傳出即將離職,這是這家頂尖人工智慧公司在安全與對齊領域最新一位離開的核心成員。據《商業內幕》報導,海德克自 2021 年加入 OpenAI,在前任安全負責人翁荔(Lilian Weng)離職後接掌團隊,主要負責模型發佈前的風險評估與緩解措施。隨著他的離去,OpenAI 內部安全高層的頻繁變動再次引發外界關注,甚至有 AI 分析師借用《哈利·波特》中的說法,將此現象形容為一種「詛咒」。

OpenAI 表示,研究與安全副總裁米婭·格萊澤(Mia Glaese)將接替海德克的職務,未來會把安全工作更深入地融入各個研究團隊,而非僅由單一部門獨立承擔。然而,這樣的調整能否穩定團隊仍待觀察。近年來 OpenAI 一直無法留住高階安全負責人,部分離職員工甚至公開質疑公司對安全工作的真正態度。聯合創始人揚·萊克(Jan Leike)在 2024 年 5 月離職時直言,OpenAI 更看重推出產品而非確保安全,他強調「安全文化和安全流程已經被光鮮的產品擠到次要位置」。

另一位高階主管、曾擔任 AGI 準備工作高級顧問的布倫戴奇(Brundage)則警告:「OpenAI 沒有準備好,其他任何前沿實驗室也沒有準備好,整個世界同樣沒有準備好。」這些言論進一步加深了外界對 OpenAI 安全承諾的疑慮。盤點近年離開的安全重點團隊負責人,名單相當可觀。聯合創始人伊利亞·蘇茨克維(Ilya Sutskever)離職後創立了 Safe Superintelligence;揚·萊克隨後加入競爭對手 Anthropic 繼續對齊研究;研究與安全副總裁翁荔在 OpenAI 工作近七年後,於 2024 年 11 月離職。

此外,還有模型政策安全研究負責人瓦隆(Valon)、風險準備團隊負責人馬德里(Madry)、首席未來學家阿基亞姆(Akiyam),以及如今的安全系統團隊負責人海德克。總計至少有八名核心安全負責人在近年相繼出走,其中瓦隆和萊克均選擇加入 Anthropic,這股流向對手的趨勢持續削弱 OpenAI 的安全團隊實力。海德克的離職時間點也頗為敏感。OpenAI 正處於快速擴張產品線、推出新模型的關鍵階段,安全團隊的穩定性直接影響外界對其負責任發展 AI 的信心。雖然公司強調將安全工作分散至各研究團隊,但批評者認為,缺乏統一且高層級的安全領導,可能導致風險評估被邊緣化。

先前已有員工指控公司內部存在「重產品、輕安全」的文化,安全團隊的頻繁換血似乎印證了這些觀察。值得注意的是,OpenAI 並非完全沒有應對措施。接任的米婭·格萊澤在安全研究領域有豐富經驗,她過去主導過多項對齊研究,並參與制定模型行為準則。然而,她能否有效整合各團隊的安全工作、重建離職員工對管理層的信任,仍是未知數。與此同時,競爭對手如 Anthropic 持續吸納 OpenAI 前安全高層,其「憲法式 AI」路線獲得了部分業界人士的認可。從整體趨勢來看,OpenAI 安全負責人的「走馬燈」現象已非新鮮事。

自 2023 年以來,幾乎每隔數月就有高層安全人員離職,且多位在公開場合表達過對公司方向的失望。這種高頻率的人事動盪,不僅影響內部團隊士氣,也可能削弱監管機構與公眾對 OpenAI 安全治理能力的評價。海德克的下一步尚未公開,但外界普遍預期他可能追隨前同事的腳步,轉往其他 AI 實驗室或創業。OpenAI 則需在產品創新與安全治理之間找到更平衡的運作模式,否則安全團隊的「詛咒」恐將持續發酵。隨著人工智慧技術的影響力日益擴大,這家行業龍頭能否穩住內部安全專業人士的信心,將是決定其長期發展的關鍵變數之一。

Related

相關文章

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?

字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

2 小時前

千人聯機世界模型“RhOS-World: Khora”正式發佈

RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

2 小時前
Hugging Face Blog模型更新

TutorMoments:AI 家教何時該出手,何時該放手?

今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

3 小時前