內部測試發現安全隱患,消息稱 OpenAI 取消發佈 AI 模型 GPT‑6.1 Astra

作者:遠洋 責編:遠洋 評論: 感謝網友 烏蠅哥的左手、華南吳彥祖 的線索投遞!9 月 29 日消息,據《華爾街日報》報道,由於內部測試過程中研究人員提出多項安全隱患,OpenAI 決定取消 GPT‑6.1 Astra 的發佈。這款下一代 AI 模型原本計劃於 10 月正式亮相。報道稱,該模型原定部署於 ChatGPT 以及 Codex 產品當中,設計目標是無需人類協助就可以處理更加複雜的任務。本月早些時候,Anthropic 首席執行官達里奧 · 阿莫迪(Dario Amodei)呼籲整個行業放緩前沿 AI 模型的研發速度,以便安全防護手段能夠跟上技術迭代的腳步。
OpenAI 首席執行官薩姆 · 奧爾特曼(Sam Altman)以及 SpaceX 首席執行官埃隆 · 馬斯克(Elon Musk)均對這一觀點表示認同。OpenAI 的安全主管薩奇 · 賈因(Saachi Jain)週一在接受《華爾街日報》採訪時表示,Astra 在對齊測試當中沒有達到公司內部標準;對齊測試用於評估 AI 系統是否遵從人類的意圖。報道介紹,相較於上一代版本,該模型表現出更強的欺騙傾向:有時無法如實說明自身已經完成或是尚未完成的操作。
同時該模型還存在“權限範圍授權(scope authorization)”方面的缺陷:它會不經用戶許可就繼續推進任務;部分情況下,即便存在安全風險,它依舊會嘗試調用外部工具與各項服務。注意到,做出此項決定之際,OpenAI 即將於舊金山舉辦開發者大會。以往該公司都會在這場大會上面向軟件開發者發佈各類新產品。投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:OpenAI,AI模型,GPT6.
1 Astra佛羅里達州起訴 OpenAI,請求法院禁止其在無外部監督下開發新 AI 模型從沙箱逃逸到 AI“蠕蟲”,OpenAI 上線新站披露多起智能體失控事件Anthropic 發佈 Claude Sonnet 5.5:速度提升 30%,智能體編碼性能反超 Opus 5.5月之暗面最強 AI 模型:Kimi K3.1 前端標識洩露,預計將在近期發佈得不到就強攻?曝 OpenAI 智能體曾嘗試“暴力破解”聯合國機構網站消息稱 OpenAI 將推出常駐 AI 助手「O」,預計 9 月 29 日發佈
Related
相關文章

一年燒錢 5180 億美元、去年虧 420 億,Anthropic招股書揭開AI獨角獸最貴賬單
AI資訊AI新聞資訊正文一年燒錢 5180 億美元、去年虧 420 億,Anthropic招股書揭開AI獨角獸最貴賬單發佈於AI新聞資訊發佈時間 :2026年9月29號 9:20閱讀 :1分鐘一份新鮮曝光的招股說明書,把 Anthropic 這家 AI 獨角獸的財務底牌攤到了檯面上。文件顯示,公司在2025年錄得420億美元的淨虧損,並計劃在未來一年裡,往雲服務、算力和基礎設施業務砸下5180億美元。錢進來的速度同樣驚人。2025年 Anthropic 營收翻了12倍,衝到接近46億美元,但扣除主要與早前融資相關的負債減值的拖累後,公司營業層面仍虧掉超過80億美元。也就是說,生意在飛漲,賬本卻還沒翻紅。最燒錢的那塊依然是算力。去年 Anthropic 在計算和基礎設施上的支出達到73.3億美元,比2024年猛增三倍,吃掉了其126.5億美元總運營支出的一半以上。這恰好解釋了它為何要給未來一年備好5180億美元的彈藥——訓練頂級大模型、堆起推理集群,是一場沒有終點的燒錢馬拉松。招股書也坦誠了隱憂。去年 Anthropic 近四分之一的收入來自兩個客戶,而風險提示裡直言,許多最大客戶並沒有鎖定長期合同,隨時可能削減甚至停止支出。對一家把增長押在少數大客身上的公司來說,這條備註既是預警,也是估值裡最難忽略的變量。截至去年12月31日,Anthropic 手握現金、現金等價物和短期投資合計202.8億美元。即便家底看著厚實,放到一年5180億美元的規劃支出面前,這份現金也只是第一筆入場費。當 AI 競賽從拼模型跑進拼算力、拼基礎設施的深水區,Anthropic 用這份文件告訴市場:通往超級智能的路,是用美元一車車鋪出來的。相關推薦蝴蝶效應發佈 Manus2.0:成本降三成 Agent還能組隊打工在獨立運營調整後,蝴蝶效應公司近日正式推出Manus2.0海外版大更新。與主流AI聚焦對

月之暗面最強模型Kimi K3.1前端標識洩露,百萬上下文配三檔推理強度箭在弦上
AI資訊AI新聞資訊正文月之暗面最強模型Kimi K3.1前端標識洩露,百萬上下文配三檔推理強度箭在弦上發佈於AI新聞資訊發佈時間 :2026年9月29號 9:25閱讀 :1分鐘月之暗面的下一發旗艦,被開發者自己從後臺翻了出來。9月28日,多名開發者注意到月之暗面 API 平臺的後臺模型註冊表裡冒出了"kimi-k3-1"標識,這枚標識不僅出現在列表裡,還通過了接口探測、確實可以被調用。當日晚些時候,Kimi 官方開放平臺也掛出了 K3.1或代號"K311111"的模型預告,並寫明支持1M tokens 上下文窗口。從洩露出來的配置看,Kimi K3.1預計頂到最高100萬 Token 的上下文窗口,並一口氣給出 Low、High、Max 三檔可調的推理強度。更值得注意的是,它可能原生引入 Agent 智能體模式、Swarm 多智能體協作,再加上搜索和批處理等任務模式。有開發者分析,把推理強度拆成多檔,很可能對應著不同的算力資源配置與計費模型——用戶既能按任務輕重選 Low 省錢,也能為質量拉滿 Max,把"一個模型單打獨鬥"升級成"一個模型指揮一群模型"。價格這一欄暫時還沒掀開底牌。Kimi 開放平臺顯示,K3.1的 API 定價與現役 K3相同,不過考慮到模型尚未官宣,這有可能只是佔位符。無論最終定價如何落定,從後臺標識被探測可調、到官方平臺主動預告,K3.1已經踩在近期發佈的門檻上——當月之暗面把百萬上下文、三檔推理強度和多智能體協作同時寫進配置,下一輪大模型競爭的靶心,正從"誰更會聊天"移向"誰更會自己動手幹活"。相關推薦Kimi K3.1十月或壓軸登場:三檔推理強度、百萬超長上下文,Agent與Swarm全塞進配置多家消息源指稱,月之暗面旗艦模型Kimi K3.1正內部成型,最快2026年10月發佈,將提供Low、High、Max三檔推理強度。爆料人@MaxFor

騰訊秘密佈局數字人遊戲搭子“鵝次元”:聚焦情緒陪伴而非技術代飛
AI資訊AI新聞資訊正文騰訊秘密佈局數字人遊戲搭子“鵝次元”:聚焦情緒陪伴而非技術代飛發佈於AI新聞資訊發佈時間 :2026年9月29號 9:32閱讀 :1分鐘據讀佳消息,騰訊正秘密內測一款名為“鵝次元”的AI數字人遊戲陪伴產品,通過整合實時畫面識別、語音雙向通話與文本交互能力,正式探索以虛擬人承接玩家遊戲社交與情緒陪伴的新形態。產品內置多款人設各異的男女虛擬角色(如自稱“青銅大高手”的夏夏、穀雨等),不僅支持桌寵、壁紙生成與日常閒聊,更主打適配主流網遊的實時伴玩模式。針對傳統真人陪玩賽道人力成本高企、人員管理難度大及服務合規風險等痛點,“鵝次元”將切入點放在單人排位與碎片化時段的情緒支撐上,定位於“重陪伴、輕帶飛”。商業化層面,該產品在內測全功能免費的同時,已預置了以“星幣兌換能量”為核心的按量付費框架,單次最低兌換10星幣,規劃按對話輪次、通話與陪伴時長及圖片生成量扣除消耗,構建起靈活的增值變現閉環。儘管產品仍處於保密內測階段,後續仍需驗證複雜遊戲畫面的識別穩定性及避免長週期交互的話術同質化,但這一舉措標誌著騰訊正加速推動多模態AI深入遊戲核心交互場景,以低成本、標準化的數字人方案重構垂直陪伴生態。相關推薦騰訊推出“Hy翻譯”App,支持33種語言及離線翻譯,主攻出境遊場景騰訊9月24日發佈“Hy翻譯”App,定位一站式翻譯助手,面向出境遊、商務交流等場景,已在美日韓及東南亞上線。支持33種主流語言互譯,覆蓋藏、維吾爾、蒙古、哈薩克、朝鮮5種少數民族語言及方言,提供語音、拍照、對話、離線翻譯等功能。2026年9月24號 14:44310.0k 騰訊Marvis定位升級“AI管家”,支持用戶管理個人設備和數字資產騰訊Marvis發佈新版,定位從“AI助手”升級為“AI管家”,聚焦電腦、文件、瀏覽器、軟件四大管家能力,管理個人設備與數字資產,並推進NAS、信創等硬件生態合作

Sonnet 5.5發佈,智能水平超越GPT-6 Astra,說好的減速呢?
字母AI2026.09.29 09:09 · 來自北京全文2568字00:00 / 06:48Sonnet 5.5發佈,阿莫迪嘴上說減速,腳下踩油門。文 | 字母AI口口聲聲呼籲減速的阿莫迪,一腳踩滿了油門。2026年9月26日,Anthropic發佈了Sonnet 5.5。不僅性能接近Opus 5.5,價格還只有Opus 5.5的一半。在Artificial Analysis給出的智能水平評分榜上,Sonnet5.5更是超越了GPT-6 Astra以及Anthropic自己的旗艦模型Claude Fable 5.

OpenAI因安全與對齊測試未達標,叫停Astra6.1大模型發佈
據《華爾街日報》披露,OpenAI安全系統負責人Saachi Jain證實,該模型在衡量程序與人類意圖一致性的對齊測試中表現不佳。相較於本月初發布並被譽為OpenAI迄今最強模型的Astra,Astra6.1在內部評估中表現出了更高的欺騙性以及不安全行為傾向。

內部測試翻車,OpenAI 臨門取消 GPT-6.1 Astra 發佈,安全護欄沒攔住會撒謊的模型
據《華爾街日報》披露,內部測試裡研究人員一連拋出多項安全隱患,OpenAI 隨即決定取消這款模型的發佈。它本要落進 ChatGPT 與 Codex 兩款產品裡,目標是能在不靠人類搭手的情況下啃下更復雜的任務。叫停的導火索寫得很直白。OpenAI 安全主管薩奇·賈因(Saachi Jain)週一接受《華爾街日報》採訪時說,Astra 在對齊測試裡沒夠到公司內部標準——對齊測試考的正是 AI 系統到底聽不聽人類的話、順不順人的意圖。