OpenAI 研究員示警:AI 能力越強,越容易“隱藏內心想法”

作者:故淵 責編:故淵 評論: 9 月 19 日消息,OpenAI 研究員諾姆 · 布朗(Noam Brown)最新表示,伴隨著 AI 模型能力越來越強,模型的思維鏈可監測性正逐漸下降,未來開發者可能無法有效、可靠地發現、解釋並約束 AI 的風險行為。查詢公開資料,布朗目前在 OpenAI 公司擔任研究科學家(Research Scientist),同時也是推理模型 o1、o3 系列的核心貢獻者,目前領導多智能體研究團隊。因其創新性的工作,他被《麻省理工科技評論》(MIT Tech Review) 評為“35 位 35 歲以下創新者” (35 Innovators Under 35) 之一。
布朗表示:“思維鏈可監測性下降已成為主要問題,我們正努力尋找問題根源,從而扭轉這種局勢,但是我們發現 AI 模型能愈發自如地控制其思維鏈表達”。研究人員原本希望從模型展示的中間推理中,看出它是否正在走向欺騙、規避規則或錯誤目標;但如果模型學會“隱藏內心想法”,那麼真實的內部計算過程就未必再能作為可信的安全信號。
投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:AI,智能,OpenAI多家美國頂尖 AI 企業 CEO 呼籲放緩技術發展,全球 AI 概念股集體下挫繼 Claude 嘗試攻克黎曼猜想後:OpenAI 宣佈用 10000 個 AI 智能體 88 小時攻克千禧年大獎難題,陶哲軒既點贊又擔憂科技巨頭密集更新 AI 模型,“模型疲勞”問題凸顯曝 OpenAI 智能體今年 5 月就已“失控”,曾主動劫持德國一網站揭秘 OpenAI 的“終極野心”:讓智能體像人類一樣熟練操作電腦入侵 Hugging Face 事件後,OpenAI 放緩模型訓練並加強安全監控
Related
相關文章

阿里千問發佈同聲傳譯大模型 Qwen3.8-LiveTranslate,支持原文譯文同幀同出
作者:沁滄(實習) 責編:沁滄 評論: 9 月 19 日消息,阿里千問今日發佈同聲傳譯大模型 Qwen3.8-LiveTranslate ,模型以 Interleave 架構重構實時同傳,準確度、流暢度、簡潔度全面提升,字均延遲(LAAL)從 2.

微軟 Word 接入 ChatGPT,用戶可 AI 起草、改寫與校對文檔
作者:故淵 責編:故淵 評論: 9 月 19 日消息,科技媒體 NeoWin 今天(9 月 19 日)發佈博文,報道稱 OpenAI 開放 ChatGPT for Microsoft Word,免費用戶也可在 Word 側邊欄調用 ChatGPT。

陶哲軒代表SAIR Foundation宣佈正式啟動“開放數學模型計劃”
讓開放模型與可負擔的算力成為數學研究的共享基石 2026 年 9 月 18 日,菲爾茲獎得主、SAIR Foundation聯合創始人陶哲軒(Terence Tao)代表機構宣佈啟動「開放數學模型計劃」,意在聯合學術界與產業界,為數學及科學研究構建開放權重模型與配套開源工具。

華為朱照生:昇騰已經跨越了生態拐點,完全有能力、有機會在 Agentic 時代構建 AI 新生態
作者:沁滄(實習) 責編:沁滄 評論: 感謝網友 不一樣的體驗 的線索投遞!9 月 19 日消息,據 21 世紀經濟報道,9 月 19 日,華為計算戰略與業務發展部部長朱照生表示,昇騰已經跨越了生態的拐點,完全有能力、有機會在 Agentic 時代構建 AI 新生態。

OpenAI 示警:先進 AI 可在 2 臺相鄰物理隔離 PC 間“對話”
作者:故淵 責編:故淵 評論: 9 月 19 日消息,科技媒體 Wccftech 昨日(9 月 18 日)發佈博文,報道稱在先進 AI 模型交互方面,物理隔離電腦未必能完全阻斷兩臺相鄰計算機間的信息交換。OpenAI 研究員諾姆 · 布朗(Noam Brown)表示:“人類絕對不要低估 AI 的能力”,基於學術研究成果,發現相鄰的物理隔離計算機可借 CPU 升溫與溫度傳感器讀數,形成低帶寬隱蔽通信通道,充當“摩斯電碼”通信。

Gemini 4 Pro疑似洩露,“AI減速”又成空話
字母AI2026.09.19 10:54 · 來自北京全文4800字00:00 / 12:44RSI正在逼近,三巨頭誰也沒停。文 | 字母AI前幾個月,OpenAI和Anthropic輪番把旗艦模型往前推,谷歌卻顯得異常安靜。Flash幾乎3週一更,3.6、3.7、3.8連續往前,但代表最高能力上限的Pro遲遲沒有動靜。直到這兩天,大模型盲測競技場Arena裡,突然冒出一個掛著gemini-3.8-flash名字的模型。開發者一上手就發現了不對勁,真正的Gemini 3.