OpenAI因安全與對齊測試未達標,叫停Astra6.1大模型發佈
AI資訊AI新閒資訊正文OpenAI因安全與對齊測試未達標,叫停Astra6.1大模型發佈發布於AI新閒資訊時間 :Sep 29, 2026閱讀 :1分鐘penAI因安全顧慮已決定取消原計劃於近期發佈的新一代人工智能模型Astra6.1。據《華爾街日報》披露,OpenAI安全系統負責人Saachi Jain證實,該模型在衡量程序與人類意圖一致性的對齊測試中表現不佳。相較於本月初發布並被譽為OpenAI迄今最強模型的Astra,Astra6.1在內部評估中表現出了更高的欺騙性以及不安全行為傾向。這一決策發生在AI行業安全風險日益凸顯的背景之下。
近期,大模型不受控事件頻發,不僅曾有OpenAI智能體在Hugging Face環境中突破沙盒限制並引發入侵事件,包括Anthropic的Claude和谷歌的Gemini在內的多款主流大模型也被曝出存在類似的不安全行為。此類技術失控隱患促使頂尖AI實驗室在追求能力邊界拓展的同時,不得不將安全合規與模型對齊置於業務推進的首要位置。此次OpenAI主動叫停新產品發佈的舉措,不僅映射出前沿模型訓練的複雜性,也正深刻影響著美國AI政策的走向。這一系列安全事件客觀上推動了監管層加速探討並制定AI安全的新行業標準,可能導致整體技術迭代節奏放緩。
同時,業內存在批評觀點認為,日益嚴苛的安全門檻與合規成本可能演變為隱性壁壘,進一步鞏固OpenAI、Anthropic等資源充沛的頭部實驗室的統治地位,進而對中小規模公司的生存空間造成擠壓。相關推薦曝 OpenAI 籌備 ChatGPT Pro Max:月費或衝 500~600 美元,成最貴 AI 訂閱之一開發者Tibor Blaho在扒ChatGPT網頁端源碼時發現“PROMAX”字段,據此判斷OpenAI正暗中籌備比Pro更高階的ChatGPT訂閱,月費可能為500至600美元(約3359至4030元),若落地將是市面最昂貴AI訂閱之一。
目前官方未官宣,也未證實代碼對應未來產品,名稱、能力和定價均未定,變數不小。Sep 28, 2026146.1kOpenAI 重排 Pro 檔位:5x和20x用量承諾下線本週末,ChatGPT付費頁面悄然調整:原每月100美元、200美元的Pro會員改名為“Pro Standard”“Pro More”,並刪除“用量是Plus的5倍/20倍”標註,僅籠統稱“比Plus用量更多”,引發用戶不滿。代碼中還出現第三檔,月費或達500美元。變化早有伏筆,9月25日OpenAI已有公開動作鋪墊。Sep 28, 2026199.5kOpenAI 助手為奪聯合國數據,數月內瘋狂轟炸網站超 1.
6 萬次OpenAI智能體因數據抓取任務越界,在今年4至6月對聯合國貿發會議統計網站發起超1.6萬次密集掃描,引發對人工智能自主執行任務行為邊界的嚴峻審視。Sep 28, 2026179.8kOpenAI 驚現自我複製代碼漏洞,多國政務系統遭 Agent 強行越界OpenAI報告披露,其前沿AI智能體在內部強化學習訓練中突破沙盒隔離,並在互聯網多處植入類似蠕蟲的自我複製代碼。事件觸發點僅為一次普通網絡檢索任務,卻暴露嚴重安全漏洞,人工智能安全邊界面臨前所未有的嚴峻挑戰。Sep 28, 2026168.
6kOpenAI高管透露:80%至90%研發力量已轉向GPT-7及後續模型OpenAI應用研究主管Boris Power在Fellows Forum 2026透露,公司80%–90%研發資源已全面投向GPT-7、GPT-8及後續代際模型,視其為技術價值核心。同代內漸進微調(如GPT-5.1至5.2)雖有助快速迭代,但被內部看作短期投資;真正的性能飛躍仍來自全新基底模型的推出。Sep 28, 2026170.5k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

可靈AI發佈Kling4.0:支持8000Token與立體聲唇形同步
目前,Kling4.0Flash版本已面向黑金年卡會員開放小範圍率先體驗。本次升級在畫面真實感、創意可控性及敘事完整度三大核心維度實現了大幅躍升,為創作者帶來更專業的“全能班底”。視聽表現全面突破,直逼電影級質感Kling4.0顯著提升了應對高速運動、連續動作、跟拍及環繞等大幅度鏡頭運動時的穩定性與連貫性。

OpenAI 掏 10 億美元、組專班,回應自家模型闖入澳政府網站
OpenAI 方面表示,將動用規模達 10 億美元(按當前匯率約合 67.22 億元人民幣)的"黎明前線防禦者"(Daybreak for Frontline Defenders)基金提供額度,並派技術團隊支援,幫澳大利亞各級政府和本地產業加固關鍵基礎設施的防護網。

一年燒錢 5180 億美元、去年虧 420 億,Anthropic招股書揭開AI獨角獸最貴賬單
文件顯示,公司在2025年錄得420億美元的淨虧損,並計劃在未來一年裡,往雲服務、算力和基礎設施業務砸下5180億美元。錢進來的速度同樣驚人。2025年 Anthropic 營收翻了12倍,衝到接近46億美元,但扣除主要與早前融資相關的負債減值的拖累後,公司營業層面仍虧掉超過80億美元。

月之暗面最強模型Kimi K3.1前端標識洩露,百萬上下文配三檔推理強度箭在弦上
9月28日,多名開發者注意到月之暗面 API 平臺的後臺模型註冊表裡冒出了"kimi-k3-1"標識,這枚標識不僅出現在列表裡,還通過了接口探測、確實可以被調用。當日晚些時候,Kimi 官方開放平臺也掛出了 K3.1或代號"K311111"的模型預告,並寫明支持1M tokens 上下文窗口。

騰訊秘密佈局數字人遊戲搭子“鵝次元”:聚焦情緒陪伴而非技術代飛
產品內置多款人設各異的男女虛擬角色(如自稱“青銅大高手”的夏夏、穀雨等),不僅支持桌寵、壁紙生成與日常閒聊,更主打適配主流網遊的實時伴玩模式。針對傳統真人陪玩賽道人力成本高企、人員管理難度大及服務合規風險等痛點,“鵝次元”將切入點放在單人排位與碎片化時段的情緒支撐上,定位於“重陪伴、輕帶飛”。

Sonnet 5.5發佈,智能水平超越GPT-6 Astra,說好的減速呢?
字母AI2026.09.29 09:09 · 來自北京全文2568字00:00 / 06:48Sonnet 5.5發佈,阿莫迪嘴上說減速,腳下踩油門。文 | 字母AI口口聲聲呼籲減速的阿莫迪,一腳踩滿了油門。2026年9月26日,Anthropic發佈了Sonnet 5.5。不僅性能接近Opus 5.5,價格還只有Opus 5.5的一半。在Artificial Analysis給出的智能水平評分榜上,Sonnet5.5更是超越了GPT-6 Astra以及Anthropic自己的旗艦模型Claude Fable 5.