內部測試發現安全隱患,消息稱 OpenAI 取消發佈 AI 模型 GPT‑6.1 Astra

作者:遠洋 責編:遠洋 評論: 感謝網友 烏蠅哥的左手、華南吳彥祖 的線索投遞!9 月 29 日消息,據《華爾街日報》報道,由於內部測試過程中研究人員提出多項安全隱患,OpenAI 決定取消 GPT‑6.1 Astra 的發佈。這款下一代 AI 模型原本計劃於 10 月正式亮相。報道稱,該模型原定部署於 ChatGPT 以及 Codex 產品當中,設計目標是無需人類協助就可以處理更加複雜的任務。本月早些時候,Anthropic 首席執行官達里奧 · 阿莫迪(Dario Amodei)呼籲整個行業放緩前沿 AI 模型的研發速度,以便安全防護手段能夠跟上技術迭代的腳步。
OpenAI 首席執行官薩姆 · 奧爾特曼(Sam Altman)以及 SpaceX 首席執行官埃隆 · 馬斯克(Elon Musk)均對這一觀點表示認同。OpenAI 的安全主管薩奇 · 賈因(Saachi Jain)週一在接受《華爾街日報》採訪時表示,Astra 在對齊測試當中沒有達到公司內部標準;對齊測試用於評估 AI 系統是否遵從人類的意圖。報道介紹,相較於上一代版本,該模型表現出更強的欺騙傾向:有時無法如實說明自身已經完成或是尚未完成的操作。
同時該模型還存在“權限範圍授權(scope authorization)”方面的缺陷:它會不經用戶許可就繼續推進任務;部分情況下,即便存在安全風險,它依舊會嘗試調用外部工具與各項服務。注意到,做出此項決定之際,OpenAI 即將於舊金山舉辦開發者大會。以往該公司都會在這場大會上面向軟件開發者發佈各類新產品。投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:OpenAI,AI模型,GPT6.
1 Astra佛羅里達州起訴 OpenAI,請求法院禁止其在無外部監督下開發新 AI 模型從沙箱逃逸到 AI“蠕蟲”,OpenAI 上線新站披露多起智能體失控事件Anthropic 發佈 Claude Sonnet 5.5:速度提升 30%,智能體編碼性能反超 Opus 5.5月之暗面最強 AI 模型:Kimi K3.1 前端標識洩露,預計將在近期發佈得不到就強攻?曝 OpenAI 智能體曾嘗試“暴力破解”聯合國機構網站消息稱 OpenAI 將推出常駐 AI 助手「O」,預計 9 月 29 日發佈
Related
相關文章

押注物理世界AI:AMD將李飛飛團隊及空間大模型Atlas攬入麾下
交易完成後,World Labs聯合創始人、斯坦福大學教授李飛飛將出任AMD執行副總裁兼首席科學家,直接協同AMD董事長兼CEO蘇姿豐推進前沿AI戰略。World Labs由李飛飛與知名學者Ben Mildenhall、Justin Johnson於2024年初聯合創立,核心目標為突破傳統語言模型的邊界,構建理解並推理物理世界的“空間智能”基礎模型,此前曾收購SceniX拓展機器人仿真能力。

Edge AI Daily 早報(9月29日)
Edge AI Daily 早報(9月29日)Edge AI Daily2026.09.29 08:35 · 來自北京全文6281字00:00 / 17:17谷歌以安卓替換Chrome OS,Android Dev Summit預告XR統一平臺,Colab算力會員化。微軟Excel內嵌因果推理能力。OpenAI研發集中GPT-7,缺席澳洲聽證暴露監管缺口。Anthropic API工具Playground更名推動普惠化。Apple A20 Pro移動芯片達桌面3A遊戲性能。臺積電VIS新加坡成熟製程廠滿產助力AI基建。硅谷前沿:一、一份升級通知宣告Chrome OS謝幕:谷歌的“安卓電腦”終成現實1.谷歌2026年9月23日發佈技術文檔,確認部分新款Chromebook可通過固件更新將底層從Chrome OS切換至基於Android技術棧的Googlebook OS;2021年後發佈的舊款機型僅獲安全更新,功能停止迭代,形成"雙軌並行"但資源向新平臺傾斜的格局。2.Googlebook OS以Android為底層而非Chrome OS,深度集成Gemini AI(如Magic Pointer晃動鼠標喚起AI分析),首批五款產品來自宏碁、華碩、戴爾、惠普、聯想,起售價899至1299美元,直接對標MacBook Air高端市場。3.新平臺面臨三大挑戰:定價高需扭轉Chromebook"廉價教育本"認知、數百萬Android應用在小屏觸控設備上開發需適配大屏鍵鼠交互、企業級管理功能預計2027年下半年才上線;成敗關鍵繫於Gemini AI能否提供競品無法替代的桌面端AI體驗。二、遊戲玩家的"垃圾操作",正在成為訓練下一代智能體的金礦1.AI世界模型面臨嚴重數據枯竭——互聯網缺乏物理因果關聯數據,而遊戲操作天然生成海量「視覺狀態+動作」因果對,成為最有希望填補訓練空白的候選素材。

佛羅裡達州起訴 OpenAI,請求法院禁止其在無外部監督下開發新 AI 模型
作者:遠洋 責編:遠洋 評論: 9 月 29 日消息,據路透社報道,美國佛羅里達州總檢察長於週一向一名法官提出申請,要求法院禁止 OpenAI 在沒有外部監督的情況下開發新的人工智能模型。這項請求是該州起訴 OpenAI、指控其傷害未成年人相關訴訟的一部分。

美國小鎮圖書館開課教中老年人如何“告別 AI”,活動傳單意外走紅
作者:清源 責編:清源 評論: 9 月 29 日消息,據《商業內幕》當地時間 27 日報道,美國紐約州北部的北查塔姆免費圖書館近期意外成為網絡焦點,圖書館為即將舉行的“再見,AI”活動製作了一張傳單,幫助居民關閉手機或筆記本電腦中的 AI 功能。

ElevenLabs 推出 v4 和 v4 Turbo 語音模型:支持 90 餘種語言,10 秒素材即可克隆聲音
作者:遠洋 責編:遠洋 評論: 9 月 29 日消息,ElevenLabs 於當地時間週一正式推出了兩款全新語音模型,分別為 ElevenLabs v4 與 v4 Turbo。新版模型強化了情緒表達控制能力,降低了語音智能體的響應延遲,同時支持 90 餘種語言。
押注物理世界AI:AMD將李飛飛團隊及空間大模型Atlas攬入麾下
交易完成後,World Labs聯合創始人、斯坦福大學教授李飛飛將出任AMD執行副總裁兼首席科學家,直接協同AMD董事長兼CEO蘇姿豐推進前沿AI戰略。World Labs由李飛飛與知名學者Ben Mildenhall、Justin Johnson於2024年初聯合創立,核心目標為突破傳統語言模型的邊界,構建理解並推理物理世界的“空間智能”基礎模型,此前曾收購SceniX拓展機器人仿真能力。