“緊急關閉”按鈕真能阻止 AI 失控?“AI 教父”辛頓、Anthropic CEO 阿莫迪都不看好

2026年9月17日 20:21
“緊急關閉”按鈕真能阻止 AI 失控?“AI 教父”辛頓、Anthropic CEO 阿莫迪都不看好
站內 AI 整理稿

首頁 > 智能時代>人工智能 “緊急關閉”按鈕真能阻止 AI 失控?“AI 教父”辛頓、Anthropic CEO 阿莫迪都不看好 2026/9/17 20:21:49 作者:清源 責編:清源 評論: 9 月 17 日消息,如今,“AI 突然失控發動毀滅性網絡攻擊”的潛在情景正日益引起行業重視,如果按下“緊急關閉”開關讓 AI 直接下線,問題看似就能得到解決。然而,多名 AI 行業領袖和研究人員認為,現實恐怕沒這麼簡單。據《商業內幕》今天(17 日)晚間報道,一些政策制定者寄予厚望的緊急關閉開關,未必能成為解決 AI 失控風險的萬能手段。

被稱為“AI 教父”的計算機科學家傑弗裡 · 辛頓直言:“我認為這種辦法從長遠來看行不通。等 AI 擁有超級智能後,它會比人類聰明得多,完全可能說服掌管開關的人不要按下它。”從技術上看,企業可以通過緊急關閉機制停用自行託管的模型,也可以切斷 AI 使用工具和算力資源的權限。從報道中獲悉,辛頓並不是唯一一個懷疑這種辦法是否足夠的人。也有 AI 行業人士認為,緊急關閉開關確實可能發揮作用,同時也有“繞過”的可能,或者等到啟動時已經太遲,因此最多隻能成為完整安全體系中的一道防線。

AI 安全研究人員、《如果有人造出來,所有人都會死》合著者內特 · 索亞雷斯認為,只要 AI 仍受制於某個物理地點,關閉開關就能發揮作用;一旦 AI 突破限制、複製自身,甚至進入關鍵基礎設施,關閉機制是否還能有效就很難保證。他指出,關閉開關當下“確實存在”,不過人類不應該逼近某些無法回頭的臨界點。真正應該優先做的,是從源頭上阻止危險 AI 系統被開發出來。部分 AI 企業高管則認為,緊急關閉開關有必要存在,但作用有限。Anthropic 聯合創始人傑克 · 克拉克指出,未來或許需要強制企業保留一套緊急關閉機制,且能夠接受獨立第三方驗證。

大型 AI 實驗室目前都有辦法“拔掉插頭”,但由多個自主 AI 智能體組成的集群,理論上可能繞過這些控制手段。Anthropic CEO 達里奧 · 阿莫迪持有類似看法:緊急關閉開關看似是好主意,可絕非“萬能藥”。如果 AI 模型能力足夠強,就可能想辦法繞過關閉措施,因此緊急關閉機制只能作為更廣泛安全策略的一部分,還需要配合測試、外部評估以及部署限制等措施。對 AI 緊急關閉開關侷限性的擔憂也並非最近才出現。OpenAI CEO 薩姆 · 奧爾特曼在 2024 年接受《經濟學人》採訪時,就否定了靠一個萬能保險裝置解決 AI 風險的想法,並不存在一個能夠讓 AI 立即停止的“神奇紅色按鈕”。

在奧爾特曼看來,AI 安全並不取決於某個單一開關,而取決於一連串具體決策,包括允許模型具備哪些能力、何時部署,以及如何控制風險。“這不是一個簡單的開或停決定,而是整個過程中許多個小決定共同作用的結果。

” 投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:人工智能,AI安全臺積電 COO 米玉傑:AI 像三歲超人,在尖端芯片設計上不太實用研究顯示:印度外包行業幾乎沒被 AI 擠佔市場多名研究人員稱“AI 末日論”存在誇大成分:AI 尚無法對現實世界真正造成傷害Anthropic、谷歌、OpenAI 等美國科技巨頭面臨新難題:安保人員計劃罷工德勤調研:英國六分之一員工自掏腰包購買 AI 工具用於工作美國參議院擬議新法案:AI 企業需證明自身已拿出防範風險的措施

Related

相關文章

達卯科技算電協同2.0平臺入選2026國際數字能源展重大成果發佈

成果中唯一聚焦算電協同全鏈路運營的AI技術產品 9月15日-17日,2026能源綠色發展大會・國際數字能源展在深圳舉辦。展會首次以“一會一展”深度融合模式打造全球數字能源產業盛會,集中發佈近百項前沿創新成果。達卯科技自主研發的「算電協同2.0平臺・AIDC綠電直連能源運營操作系統」成功入選重大成果發佈,也是成果中唯一聚焦算電協同全鏈路運營的AI技術產品。

1 小時前
全天候科技產業與商業

小鵬要把賣車和賣技術一起推向全球

王小娟 發表於 2026年09月18日 14:05 摘要:技術合作再尋新客戶。9月17日晚,小鵬集團董事長、CEO何小鵬談起G9L的價格,說自己和總裁王鳳英曾在會議室裡反覆爭論。幾小時前,這款車剛以23.18萬元的 限時起售價上市,較8月公佈的預售起售價低了2.

2 小時前

Claude“主導”Anthropic 26%的AI研發、3萬Agent同時運行:當AI開始“造AI”,頭部公司RSI路線正在分化

根據報導,人工智慧領域近期出現一項值得關注的動向:Anthropic 的 AI 模型 Claude 在其內部研發工作中扮演了主導角色,佔據該公司約 26% 的 AI 研發比例,同時有高達 3 萬個 Agent 在同一時間並行運作。這項數據反映出 AI 開始「製造 AI」的趨勢正在加速,而頭部公司在遞歸自我改進(RSI)路線上的分化也愈發明顯。 Claude 不再只是對外服務的產品,而是成為 Anthropic 內部研發流程的核心引擎。

8 小時前

智譜實現RSI最小閉環,A社:我來監督

智譜AI近日對外宣布,已在遞歸自我改進(Recursive Self-Improvement,簡稱RSI)領域取得關鍵技術突破,成功實現業界首個「最小閉環」系統。與此同時,被業內簡稱為「A社」的AI安全研究機構同步表態,將以第三方監督角色介入該系統的測試與驗證流程,確保技術發展符合倫理與安全規範。 所謂的最小閉環,指的是系統能在不依賴外部人工反饋的情況下,自主完成從自我評估、參數調整到性能驗證的完整循環。

8 小時前

傳聞四起,人形機器人IPO審核收緊?

近期市場傳出多項風聲,指稱人形機器人領域的首次公開募股(IPO)審核可能出現收緊趨勢。雖然官方尚未發布明確指引,但這波傳言已在投資人與業界之間引發討論,不少人開始關注監管層是否會對這類新興科技公司的上市門檻提出更高要求。 與此同時,宇樹科技在資本市場上的戲劇性波動,也被視為影響整體情緒的關鍵變數。

9 小時前