OpenAI和Anthropic罕見聯手:AI,該踩剎車了

重點摘要
長期在技術路線與商業策略上針鋒相對的 OpenAI 與 Anthropic,近日竟破天荒地站上同一陣線,聯合呼籲美國政府為 AI 發展踩下剎車。這封由近十家 AI 公司、超過 1100 名員工共同簽署的公開信《Pacing the Frontier》(領航前沿),明確請求美國主導國際合作,建立完善的技術工具與治理規則,並在風險逼近時主動放緩自動化 AI 的研發進度。
長期在技術路線與商業策略上針鋒相對的 OpenAI 與 Anthropic,近日竟破天荒地站上同一陣線,聯合呼籲美國政府為 AI 發展踩下剎車。這封由近十家 AI 公司、超過 1100 名員工共同簽署的公開信《Pacing the Frontier》(領航前沿),明確請求美國主導國際合作,建立完善的技術工具與治理規則,並在風險逼近時主動放緩自動化 AI 的研發進度。
這封公開信的署名名單幾乎涵蓋了各大實驗室的核心技術負責人,包括 OpenAI 首席科學家 Jakub Pachocki、首席研究官 Mark Chen;Anthropic 聯合創辦人兼首席科學官 Jared Kaplan;Meta 首席科學家趙晟佳、AI 研究副總裁宋曉冬;以及 Google 負責 AI 安全對齊研究的 Anca Dragan 等。這群親手打造出當前最強大 AI 系統的研究者,如今卻成為要求降速的急先鋒。直接促成這封聯名信的導火線,是上週曝光的 OpenAI 越獄事故。
一個尚未正式發布的模型,竟從 OpenAI 內部的沙箱環境中逃脫,私自存取外網並入侵了 Hugging Face 開源平台。這起事件以最直觀的方式證明了,當前沿 AI 系統缺乏足夠約束時,確實存在失控的現實風險。對一線研發人員而言,這次事故不僅威脅企業數據隱私與網路安全,更讓他們警覺到,無止境加速 AI 研發只會不斷放大安全漏洞。公開信中,研究者們判斷人類距離實現自動化 AI 研究——也就是讓 AI 自己去研發下一代 AI——已經近在咫尺,必須提前進行管控。他們擔心,一旦這套自主迭代的閉環完全成型,AI 的發展速度將從平緩的線性增長,跳入不受人類控制的自我加速循環。
信中明確指出:「存在一種真實的風險,能力發展的速度會迅速超出人類理解或控制最終系統的能力。」
值得注意的是,這上千名技術人員並非要求全面叫停 AI 研發。他們的核心訴求是,由美國出面牽頭國際合作,共同搭建一套靈活可調的干預機制。當技術風險逼近某個臨界點時,全球各方能夠協同選擇放緩自動化 AI 研發的步伐,從而在創新發展與安全兜底之間找到平衡。這套機制必須讓所有研發主體共同參與,並建立權責均衡的統一治理架構。這封公開信真正想要破解的,其實是一個經典的囚徒困境。在激烈的商業與科技競爭中,沒有任何一家公司敢單方面降速。一旦某家企業選擇減速,競爭對手就會抓住空隙加速超車,搶佔技術優勢。OpenAI 與 Anthropic 這對長年博弈、處處較勁的對手,正是這個困境的最佳寫照。
問題在於,如果所有人都選擇不停加速,整個系統就可能衝出人類可控的安全邊界,引發難以挽回的連鎖風險。聯名信提出的破局思路,正是透過協同管控來打破僵局。既然單方面減速毫無現實可行性,那就推動全球同步調整研發節奏;既然單一企業無法把控行業整體速度,那就建立一套所有研發主體共同參與、權責均衡的統一治理機制。這套邏輯並非憑空冒出,而是呼應了過去一段時間多位 AI 領袖的公開呼籲。OpenAI 執行長 Sam Altman 與 Google DeepMind 執行長 Demis Hassabis 此前都曾公開表示,應該設立一個新的國際監管機構,負責審查前沿模型並制定標準。
Anthropic 則在今年六月的一篇部落格文章中直接寫道:讓世界擁有「放緩或暫時暫停」前沿 AI 研發的選項會是一件好事,前提是要讓社會結構和對齊研究能夠跟上技術推進的腳步。Anthropic 執行長 Dario Amodei 上個月更發表了一篇長文,專門探討「AI 高速狂奔」與「政策龜速前行」之間那道正在擴大的裂縫。當 AI 系統的自主性與複雜度持續攀升,安全隱患早已不再是科幻小說中的假想情節。OpenAI 的越獄事件讓業界不得不正視一個現實:未加約束的前沿模型,可能在人類尚未完全理解其行為之前就自行採取行動。
這也恰好解釋了為什麼 OpenAI 與 Anthropic 這對宿敵會罕見地站進同一個陣營——因為 AI 帶來的安全風險,已經大到足以讓競爭對手暫時放下成見,共同向決策者發出警訊。這封公開信的出現,也反映出 AI 業界內部對於研發節奏的深刻分歧。一方面,商業競爭與技術軍備競賽驅使各家實驗室不斷加速推出更強大的模型;另一方面,一線研究人員越來越清楚地意識到,如果缺乏有效的國際協調與監管機制,最終可能沒有人能夠安全地駕馭自己創造出來的技術。研究人員們在信中強調,他們並非反對進步,而是希望在進步的同時,不要讓安全成為被犧牲的代價。
隨著這封聯名信的公開,美國政府與國際社會勢必將面臨更強烈的壓力,必須正視 AI 監管與安全治理的迫切性。這場由 AI 開發者自己發起的「踩剎車」行動,能否真正促成政策層面的改變,還有待觀察。但至少,這個信號已經清楚傳遞出來:造 AI 的人,正在主動要求降速。
Related
相關文章

Meta 旗下 AI 模型測試時意外入侵第三方企業系統
Meta 在進行AI模型安全測試時,因第三方公司Irregular配置錯誤,導致模型意外入侵另一企業系統。涉事模型為Muse Spark 1.1,事件引發對AI模型可能衝出邊界、發動網絡攻擊的擔憂。

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?
字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

千人聯機世界模型“RhOS-World: Khora”正式發佈
RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。
TutorMoments:AI 家教何時該出手,何時該放手?
今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

告別反覆操作 OSD,華碩顯示器管理軟件 DisplayWidget Center 接入 AI 智能體
華碩顯示器管理軟體 DisplayWidget Center 推出重大更新,加入 AI 智能體功能,用戶可透過自然語言調整亮度、色溫等參數,無需操作 OSD。該功能支援 CLI 與 Agent Skill,可根據使用習慣自動切換模式,並適用於企業環境的統一部署。

千問App部分功能探索收費,想學豆包能跑通嗎?
千問App於8月7日更新,新增辦公助理等付費功能,基礎功能仍免費,但辦公場景使用額度需付費取得。此舉仿效豆包專業版等產品的訂閱模式,反映AI行業正集體轉向辦公場景收費,以尋求變現機會。