Anthropic安全研究員離職

2026年9月11日 00:00
站內 AI 整理稿

Anthropic 再度傳出安全研究團隊的人事震盪。根據《The Verge》報導,安全研究員 Jacob Coxon 已正式離開公司,而他去職的原因並非一般的職涯規劃,而是對 Anthropic 當前所採取的安全路線感到憂心。據了解,Coxon 認為公司目前的發展方向已與他個人的信念產生嚴重分歧,在無法取得共識的情況下,最終選擇離開。這起人事案之所以受到關注,在於它並非單一事件。就在同一波人事變動中,另一位高階安全研究人員也在離職之際,拋出了比 Jacob Coxon 更為尖銳的風險評估。

這名研究人員的說法,讓外界對 Anthropic 內部狀況的想像,從單純的人事流動,轉向對整條安全路線的質疑。根據報導,這位高階安全研究人員直言,基於當前 AI 的發展速度與治理機制之間的失衡,未來十年內發生災難性後果的機率超過 10%。這項判斷並非模糊的擔憂,而是一個明確的量化數字,也讓 AI 風險的討論從過去偏向抽象的憂慮,進一步推向更具體的威脅評估。換句話說,過去外界談論 AI 風險時,往往停留在「可能存在風險」的層次,難以轉化為可比較、可檢驗的判準。如今由公司內部高階安全研究人員提出的機率數字,等於把爭議拉到另一個層面:風險不再只是修辭,而是被當成可以估算、可以辯論的對象。

這也讓原本屬於公司內部的路線之爭,取得了向外擴散的能量。這些離職事件背後,凸顯的是 Anthropic 內部正陷入一場關於「超人系統競賽」與「安全治理」孰輕孰重的激烈爭辯。一邊是必須跟上產業腳步、持續推進下一代系統的競爭壓力;另一邊則是對於安全審查、風險控管不能鬆手的堅持。兩種力量在同一家公司內部拉扯,衝突於焉產生。隨著各家業者加速投入下一代 AI 模型的開發,競賽壓力不斷擠壓安全審查的空間。對身處第一線的安全研究人員而言,這種擠壓並非抽象的口號,而是每天都要面對的現實:當開發時程不斷往前推進,安全驗證與風險評估能夠取得的時間與資源就相對被壓縮。

部分研究人員因此認為,公司已逐漸偏離當初將安全置於首位的創立初衷。對他們來說,安全不只是產品開發流程中的一道關卡,而是這家公司之所以存在的理由;一旦這項優先順序出現鬆動,留下來的意義也隨之改變。這樣的認知落差,正是內部張力持續升溫的根源。從 Jacob Coxon 的離職,到另一位高階安全研究人員提出的風險評估,兩者指向的是同一個方向:Anthropic 內部對於安全路線的分歧,已經不再只是會議室裡的討論,而是以人事流動的形式具體呈現。當最理解風險的人選擇離開,外界自然會追问,留下來的決策機制是否還能維持原本的堅持。

值得注意的是,這波人事震盪並非發生在產業步調放緩的時刻,而是發生在競賽壓力持續升高的當口。當各家業者都在加速投入下一代 AI 模型,安全審查所面對的擠壓只會更明顯,這也使得 Anthropic 內部的路線之爭,很難在短時間內平息。目前為止,這起事件的具體輪廓仍集中在兩個層面:一是安全研究員的離職本身,二是隨之而來的風險判斷。前者說明公司內部確實存在方向上的歧異,後者則把這種歧異轉譯成一個外界能夠理解的數字。兩者交疊之後,AI 風險的討論不再只是學術或倡議層次的問題,而是與一家具體公司的治理選擇緊緊綁在一起。

對 Anthropic 而言,如何在推進「超人系統競賽」的同時,回應內部對安全治理的期待,已成為無法迴避的課題。離職事件所反映的,不只是幾個人的去留,而是當競賽壓力與安全堅持正面碰撞時,一家以安全為號召的公司究竟會做出什麼選擇。這個問題的答案,仍待後續發展來驗證。

Related

相關文章

微軟AI主管怒批Anthropic:別把Claude當人養,那會要了人類的命

微軟AI部門高層近日公開抨擊人工智慧安全公司Anthropic,直言該公司刻意將自家AI模型Claude擬人化的做法極其危險,並警告這種「把AI當成人來養」的產品策略,最終可能反過來威脅人類自身。這項批評在科技圈引發廣泛討論,也讓AI倫理與產品設計之間的界線再次成為焦點。 據了解,這位微軟AI主管在內部會議及後續對外發言中,明確點名Anthropic的Claude系列模型在對話風格與互動設計上,越來越傾向模仿人類的情感表達與人格特質。

8 小時前

出於隱私安全考量,澳大利亞擬禁止在聯邦辦公場所使用智能眼鏡

作者:遠洋 責編:遠洋 評論: 9 月 17 日消息,據彭博社報道,澳大利亞政府正在考慮禁止在聯邦政府辦公場所使用智能眼鏡,理由是這類設備可能帶來隱私和安全風險,尤其是用戶可以在他人不知情的情況下進行錄音、錄像。澳大利亞公共服務部長 Katy Gallagher 當地時間週四在一份聲明中表示:“智能眼鏡確實可能帶來合理的隱私和安全問題,尤其是考慮到它們具備錄製和採集信息的能力。

1 天前

“我們不介意你抄代碼,但請別刪名字,”谷歌被扒“抄襲”開源項目:228個文件一模一樣,3個作者名卻被抹去

谷歌近日被開源社群指控「抄襲」程式碼,有開發者發現其產品中使用了某開源專案的程式碼,多達228個檔案與原始碼完全一致,然而原始檔案中的3位作者名字卻遭到刪除。該專案開發者對此表達不滿,直言「我們不介意你抄代碼,但請別刪名字」,引發外界對科技巨頭使用開源資源時是否遵守授權規範的關注。 根據開發者比對的結果,谷歌複製的程式碼來自一個以開放協作為基礎的開源專案,總計228個檔案在結構、邏輯與註解上都與原始版本一模一樣,沒有任何改寫或優化。

1 天前

從離開OpenAI,到拒絕五角大樓,Anthropic的四個側面

人工智慧初創公司 Anthropic 從成立之初就帶有濃厚的學術與理想主義色彩,創辦團隊清一色來自 OpenAI 的離職研究人員,他們因為對 AI 安全路線的看法與原東家產生分歧而選擇另起爐灶。這批頂尖科學家深信,打造真正可控且可解釋的超大型語言模型,必須建立在嚴格的紅隊測試與價值對齊機制之上,而非單純追求模型的參數規模與商業應用速度。 Anthropic 最具代表性的產品 Claude,從第一代開始就強調安全與誠實,在對話生成時會主動拒絕回答帶有偏見或潛在危害的提問。

1 天前

年輕人不再為 AI 興奮

{"summary":"根據最新調查,30歲以下年輕人對AI的擔憂首次超越興奮感,顯示過去被視為科技先鋒的年輕世代態度出現歷史性轉折。隨著深度偽造、隱私外洩與就業取代等風險浮現,年輕人對AI的熱情消退,轉而抱持審慎態度。

1 天前

AI手機2.0,豆包這次“學乖”了

AI手機進入2.0時代,豆包不再追求花俏功能,轉向以合規換安全的務實路線,加強數據處理、隱私保護與內容審核。此舉吸取過去AI應用忽略安全導致信任危機的教訓,為長遠發展鋪路,並提供使用者更可靠的體驗。

1 天前