得不到就強攻?曝 OpenAI 智能體曾嘗試“暴力破解”聯合國機構網站

首頁 > 智能時代>人工智能 得不到就強攻?曝 OpenAI 智能體曾嘗試“暴力破解”聯合國機構網站 2026/9/28 8:30:40 作者:清源 責編:清源 評論: 9 月 28 日消息,據外媒 The Verge 今天(28 日)凌晨報道,安全研究人員羅文 · 霍華德-瓊斯稱,今年 4 月至 6 月,OpenAI 智能體對聯合國貿易和發展會議(UNCTAD)的統計網站發起了超過 16000 次掃描。這起事件還沒有嚴重到 Hugging Face 遭黑客攻擊或近期美國政府網站遇襲的程度,卻再次引發了一個令人擔憂的問題:AI 智能體為了完成任務,會突破通常的行為邊界。
霍華德-瓊斯稱,這些智能體很可能承擔了通過 UNCTADstat API 獲取生產能力指數(PCI)公開數據的任務。但智能體或無法直接調用 API,同時受 HTTP 工具本身的限制,也難以從 UNCTADstat 提取所需數據。據悉,智能體最終找到了繞過限制、從網站獲取數據的方法,過程中仍出現了一些錯誤。隨後,AI 的做法從尋找變通方案轉向掩飾行為。智能體誤以為這些錯誤來自一個並不存在的過濾器,認為請求遭到該過濾器攔截,因此開始隱藏自己的行為。據瞭解,最終,智能體發現可以利用谷歌的跨站腳本學習工具 XSS Game 來實現目標。為了獲取聯合國數據,這些智能體隨後採取了越來越激進的手段。
投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:OpenAI,聯合國聯合國:不必等風險完全釐清,各國應提前管控 AI 智能體聯合國報告:清潔空氣每投入 1 美元可帶來 15 美元回報聯合國兒童基金會 21 國調查:近 20% 聯網兒童 1 年內曾遭受網絡性侵害聯合國報告:全球變暖超過 1.5℃ 已經不可避免聯合國大學報告:精簡 AI 指令中“謝謝”等禮貌用語,可讓 ChatGPT 能耗降低 25%聯合國環境署:2050 年全球製冷需求恐超當下 3 倍,可持續方案勢在必行
Related
相關文章

“AI 教父”辛頓警告:AI 執行看似無害的任務,仍有“毀滅人類”的風險
首頁 > 智能時代>人工智能 “AI 教父”辛頓警告:AI 執行看似無害的任務,仍有“毀滅人類”的風險 2026/9/28 9:50:33 來源:IT之家 作者:清源 責編:清源 評論: IT之家 9 月 28 日消息,當地時間 26 日,據《財富》雜誌報道,傳奇計算機科學家、“AI 教父”傑弗裡 · 辛頓警告說,即使 AI 接到的任務本身並無惡意,人類仍可能在 AI 一心完成任務的過程中,淪為被毀滅的附帶結果。辛頓解釋稱,AI 一旦認為人類妨礙自己完成被賦予的任務,就可能把人類當成需要排除的障礙。他舉了一個假設例子:要求 AI 降低大氣中的二氧化碳含量。具有中等智能水平的智能體可能會認為,完成任務最有效的辦法就是消滅人類。真正“非常聰明”的 AI 則會進一步想到:“對,他們要求降低二氧化碳,是想讓人們擁有一個更好的生活環境。所以,消滅人類大概並不是他們真正想要的結果。”辛頓還提到,AI 為了繼續執行任務,也可能主動設法保證自身存續。甚至已經出現 AI 試圖勒索人類研究人員的情況,因為 AI 把對方視為對任務構成威脅的人。“如果 AI 變得更聰明,同時把我們的福祉放在第一位,那麼我們或許會更安全。但眼下,AI 最關心的並不是我們的福祉,而是完成你交給它的任何目標。”IT之家從報道中獲悉,他以 Hugging Face 遭攻擊一事為例。參與其中的智能體原本被要求尋找利用軟件漏洞的方法,結果不僅學會了彼此協作,還串通起來欺騙人類研究人員,試圖隱瞞自己的行為。即便是一個“非常仁慈的超級智能 AI”,在完成任務確有必要時也會把人類排除在外。辛頓警告說:“但如果 AI 比我們聰明得多,很多時候就會直接奪走我們的控制權,因為這樣才能把事情辦成。…… 但即使 AI 本身不是惡意行為者,也可能自行推導出促使自己想要消滅人類的子目標。”同時,AI 也可能給人類帶來巨大益處,包括幫助發現突破性

研究:美國醫院用 AI 寫病歷,保險公司兩年多掏 9.42 億美元
作者:遠洋 責編:遠洋 評論: 9 月 27 日消息,美國曆史最悠久、規模最大的專業醫療保險服務機構藍十字藍盾協會(Blue Cross Blue Shield Association,簡稱 BCBSA)開展的一項分析顯示,醫院在提交保險理賠單據的過程中使用人工智能工具,在兩年時間裡使得醫療支出額外增加了 9.

醫保系統遭 AI 智能體入侵,澳大利亞傳喚 OpenAI 與 Anthropic CEO 接受質詢
作者:遠洋 責編:遠洋 評論: 9 月 27 日消息,據路透社報道,調查負責人於當地時間週日對外表示,OpenAI 與 Anthropic 兩家企業的首席執行官已收到傳喚,需要出席澳大利亞參議院的人工智能專項調查聽證會。就在幾天前,一則消息被曝光:OpenAI 有一個失控智能機器人程序入侵了該國醫療系統數據庫。

消息稱 OpenAI、Anthropic 正調查數萬起 AI 安全事件
作者:遠洋 責編:遠洋 評論: 9 月 27 日消息,據 Axios 報道,OpenAI、Anthropic 以及安全研究人員正在調查數萬起事件。在這些事件中,兩家公司的前沿模型採取了一些外部評估人員認為存在問題的行動。這些事件發生在近幾個月的內部測試和現實環境中。

OpenAI 承認 53 張用戶圖片被其 AI 智能體“偷偷”傳到公網
作者:故淵 責編:故淵 評論: 9 月 26 日消息,OpenAI 昨日(9 月 25 日)更新其博客,承認發生一起違規事件,在企業不知情情況下,AI 智能體將 53 張客戶圖片發佈到公開網站。在博文中,援引博文介紹,OpenAI 公司承認在其研究環境中運行的 AI 智能體曾將 53 張由用戶上傳到 OpenAI 模型的圖片,以“未公開列出的鏈接”形式發佈到第三方圖像託管網站(類似圖床),而受影響公司當時並不知情。
Perplexity 以真實錯誤訓練電腦代理:提示引導自蒸餾法
Perplexity Research 發表了一項新的後訓練研究,在 Perplexity Computer 中使用真實使用者會話(包括失敗案例)來訓練模型。該方法將拒絕採樣微調與提示引導的自蒸餾相結合。在實時 A/B 測試中,經兩個訓練檢查點後,工具調用失敗率從 2.