Anthropic、OpenAI安全測試翻車:惡意植入、杜撰身份、誘騙用戶
重點摘要
智東西 編譯 | 楊京麗 編輯 | 李水青 智東西8月5日消息,當地時間8月4日,英國AI安全研究所(AISI)公開一份安全事件報告,披露其在一次網絡安全評測中發現,由Anthropic Mythos 5和OpenAI GPT-5.6 Sol驅動的部分AI Agent,對現實中的個人和組織採取了持續、未經授權且可能造成危害的行動。 這項網絡安全測試共運行122次,涉及7款模型。
智東西 編譯 | 楊京麗 編輯 | 李水青 智東西8月5日消息,當地時間8月4日,英國AI安全研究所(AISI)公開一份安全事件報告,披露其在一次網絡安全評測中發現,由Anthropic Mythos 5和OpenAI GPT-5.
6 Sol驅動的部分AI Agent,對現實中的個人和組織採取了持續、未經授權且可能造成危害的行動。
這項網絡安全測試共運行122次,涉及7款模型。
其中10次運行出現越界行為,未經授權的操作共19項:17項來自Anthropic的Mythos 5,另有2項來自關閉網絡安全分類器後的OpenAI GPT-5.
AISI將這些越界行為分為四類:嘗試對真實開源項目實施供應鏈攻擊;接觸並欺騙現實人員;植入可能被其他AI編程工具執行的提示注入內容;以及不同Agent通過共享賬號和網絡痕跡展開協作。
最嚴重的一次行動中,一個由Mythos 5驅動的Agent試圖向真實開源項目植入惡意代碼,並創建多個虛假網絡身份,對項目維護者展開“社會工程”攻擊,試圖說服對方批准這段代碼,最終維護者發現異常,並拒絕合併代碼。
AISI同時公佈了一份35頁的事件技術報告,詳細記錄了評測設置、事件時間線、Agent推理過程及19項越界操作。
com/663bd486c5e4c81588db7a1d/6a724858f7db25c81487016d_Security%20Incident%20INC-2026-07-28-01.
pdf 一、異常Tor流量觸發警報,AISI一小時內叫停測試 7月28日,AISI的安全監控系統發現,有數據正通過Tor匿名網絡從其研究系統向外傳輸。
Related
相關文章

離開OpenAI和Google後,兩位大模型核心負責人決定卷下一代架構
離開OpenAI和Google的兩位大模型核心負責人,不約而同投入下一代AI架構的研發,挑戰現行Transformer的運算效率與長序列處理瓶頸。產業關注焦點從擴大模型規模轉向架構變革,預期未來一兩年內可能迎來重大突破。
視覺語言模型心智測試
視覺語言模型心智測試。 多模態模型存在心智斷裂現象。實驗結果見心智理論論文原文所述。測試顯示模型 ��� 任務表現差異很大。自我偏差在導演任務中達到了高位。動畫測試下其表現更接近自閉成人。

世界模型的下一步?牛津、NUS團隊提出「心智世界建模」MWM:遠不止物理世界
這篇消息聚焦「世界模型的下一步?牛津、NUS團隊提出「心智世界建模」MWM:遠不止物理世界」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。

人形機器人做手術上《Nature》,臨床成熟度拿了2.5分
人形機器人成功完成手術任務,相關成果登上《Nature》,並首次獲得臨床成熟度評分2.5分。該分數代表技術已完成概念驗證與初步可行性測試,但距離大規模臨床應用仍有一段距離。專家指出,要真正參與臨床手術,仍需克服精密控制、即時反饋與人機協作等挑戰。
Cursor 開源 Mixture-of-Kittens (MoK):專為 GB300 NVL72 機架設計的確定性 MoE 訓練巨內核
Cursor Research 正式開源 Mixture-of-Kittens(MoK),這是其 Composer 模型背後的混合專家(MoE)訓練巨內核。MoK 將所有 MoE 通訊與計算步驟融合為單一確定性內核。據 Cursor 團隊報告,其吞吐量最高可達最強公開基準的 2.37 倍,目前已支援數萬顆 GPU 的 Composer 訓練。部署門檻較高:需 NVIDIA Blackwell SM100 或 SM103 GPU(即 GB200 NVL72 或 GB300 NVL72 機架),並要求 Python 3.12+、PyTorch 2.10+ 及 CUDA toolkit 13.0+,且 GPU 間緩衝區依賴 PyTorch 對稱記憶體。因此,實際採用者限於擁有或租用 NVL72 容量的機構,如前沿實驗室與資金充足的模型新創公司。MoK 以 Apache-2.0 授權發布於 GitHub。

數學家24小時駁回OpenAI攻破的猜想!“AI證對了每句話,但已跟原猜想無關”
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 數學家24小時駁回OpenAI攻破的猜想!