都學壞了!奧特曼親手封鎖最強模型Astra,重蹈Mythos覆轍

重點摘要
OpenAI 執行長奧特曼宣布延後發布最強模型 Astra,原因是內部評估顯示其網路安全能力可能達到「關鍵」級別,需進一步確保安全。此舉被認為與先前 Anthropic 推遲 Mythos 模型發布的策略類似,引發外界質疑是否為恐懼行銷。
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 都學壞了!奧特曼親手封鎖最強模型Astra,重蹈Mythos覆轍 Jay 2026-08-08 12:33:53 來源:量子位 唉,趕緊整完快點發布吧。。。Jay 發自 凹非寺 量子位 | 公眾號 QbitAI 不er,鬧呢?剛剛,奧特曼發文,宣佈推遲最強模型Astra的發佈。Astra是一個強大的模型,我們正努力讓它向所有用戶開放。
我們認為,把強大的模型只提供給少數特定人群使用,並不是一個好的策略。不過,考慮到Astra具備網絡安全方面的能力,我們還需要多花一點時間,以確保能夠安全地開放它。是的,被「囚禁」了,哈哈哈哈(無力)……又要走一遍Mythos的流程。Astra的披露之旅 所以Astra,究竟是個啥?這是OpenAI的最新模型類別,踩在Sol、Terra 和Luna之上。你可以理解為,這是OpenAI的Fable系。上週,是這隻大怪獸的初次亮相。奧特曼在華盛頓向政府介紹了Astra,重點展示了多個 Agent長時間協同工作的能力,旨在展示該模型在處理複雜項目方面的潛力,比如—— 數學。
果然,幾乎是消息出來第二天,OpenAI便官宣了Astra相關的數學突破—— 一次性拿下了10項長期懸而未決的數學與理論計算機科學公開難題,橫跨高維幾何、編碼理論、群論、算子代數、量子複雜度和極值組合學等領域。數學圈直接炸了,一度引起不少數學家驚呼,甚至有人將這一突破定義為「菲爾茨獎」級。還有一個大家懷疑比較多的,就是之前Hugging Face事件。也是很神了,OpenAI自己公開認領了一項「安全事故」,說自家模型在接受網絡安全測試,不小心(並非)逃出了內部隔離環境,一路闖進了Hugging Face的家門,直接原地開黑。給Hugging Face也是整無語了,只能拿起GLM 5.2自衛。
具體是哪個模型,OpenAI當時沒說,但後來不少人將這個鍋丟在了Astra上。這次倒是表態了,說是Astra確實很危險,但跟Hugging Face這茬沒關係嗷。但無論如何吧,也是吊足了大家胃口,雖然沒Mythos那次整那麼神,但也算OpenAI這幾個月來最受矚目的一款模型了吧。誰能想到,又來Mythos那一套啊!!!OpenAI表示,考慮到Astra網絡安全方面的風險,將暫緩這個模型的發佈。「恐怖如斯」的Astra 所以Astra,到底觸發了什麼?OpenAI專門寫了篇博客,故事是這樣的。過去幾天,OpenAI對Astra進行了最新一輪內部評估。
結果顯示,該模型在智能體編碼和網絡安全方面取得了「顯著進展」。結合專家評估意見,公司於昨晚得出結論,無法排除Astra在Preparedness Framework下達到「關鍵(Critical)」級網絡能力的可能性。什麼,你問這串英文是個啥玩意兒。hmm,簡單來說就是OpenAI於2023年末修的一個「安全警報器」,初衷是為能力進展提供識別指南,並據此規劃應對措施。此前發佈的模型,包括GPT-5.6 Sol,均在前沿網絡能力評估中被評定為「高(High)」級別,從未觸及Critical線。那Critical線在哪?
根據OpenAI的定義,一個模型達到Critical的標準是: 能在無人干預的情況下,自主識別並開發針對眾多經過加固的現實世界關鍵系統的全等級功能性零日漏洞利用,或僅憑一個高層目標描述,就能自主設計並執行針對加固目標的端到端新型網絡攻擊策略。Astra基本就是這個級別。不過,OpenAI也打了補丁,目前Astra的基準測試和評估仍在繼續,初步結果雖然已經差不多實錘,但並不等於已經確認。同時官方澄清,Astra並未參與此前Hugging Face被攻擊事件。
基於上述評估,OpenAI已在內部採取以下措施: 1、對高能力模型及相關活動實施更嚴格的安全控制,包括隔離測試環境、限制網絡和工具訪問、增強模型權重保護和加密、部署額外監測與檢測能力、推行沙盒化執行。2、暫停所有尚未達到上述強化安全標準的Astra內部活動。3、在Astra所有智能體應用(含訓練和評估環節)中部署通用風險行為監控,審查模型思維鏈,在高風險活動發生時觸發安全響應並中斷操作。4、相關政府機構和選定的AI安全組織合作,對Astra進行外部能力測試。5、向第三方測試夥伴提供推薦的安全控制指南,用於安全運行更高風險的評估和工作負載。其實吧,歸根結底就一句話—— 寄了。哈哈!真那麼嚇人?
唉,此情此景,我咋總感覺這麼眼熟呢。奧特曼,你這宣發流程,簡直和Mythos 5一模一樣啊。。。今年4月,Anthropic以網絡安全風險為由推遲了其旗艦模型Mythos的公開上線,僅通過「Project Glasswing」計劃向約40家合作伙伴提供訪問權限。當時奧特曼曾在播客節目中公開批評此舉為「恐懼營銷」,稱這顯然是一種令人難以置信的營銷手段,告訴別人我們造了一顆炸彈,馬上就要扔到頭上了,但公司有一套價值1億美元的地堡可以賣給你。如今同樣的炸彈落到了OpenAI自己頭上。所以為啥又打臉了?
業界有觀點認為,「安全威脅敘事」正成為前沿AI公司針對DeepSeek、Kimi等開源模型的競爭策略,當市場普遍接受當前模型確有風險的說法後,公司便能以安全管制為由將開源對手排除出競爭賽道。好消息是,從評論區來看,用戶對這一套說辭並不太買賬,每次涉及安全威脅話題,討論區的質疑聲都佔了多數。黃仁勳此前在開源倡議書中也指出,對開源模型的攻擊大部分是無稽之談,如果真為安全著想,最好的方式是公開發布、集眾人之力解決問題。誰能想到,OpenAI還是如此執著於打安全牌。。。那還說啥了,等著唄。關於發佈時間,奧特曼在文中表示正在努力讓Astra向所有用戶開放,但未給出新的時間表。
求求了,安全管制可以,但至少保證下使用體驗,別閹割著玩。Fable 5大家也看到了,安全邊界做的不好,基本上就只能寫寫代碼,問個生物學問題都能被路由成Opus 4.8。。。唉,趕緊整完快點發布吧。參考鏈接: [1]https://x.com/sama/status/2085862292311396515 [2]https://openai.com/index/responding-next-frontier-critical-cyber-capabilities/ 版權所有,未經授權不得以任何形式轉載及使用,違者必究。OpenAI Jay 剛剛,ChatGPT免費版史詩升級!GPT-5.
6可以無限白嫖了2026-08-07 沒有人靠段子永載GitHub,除非谷歌姐夫2026-08-06 又一家AI基金暴雷了2026-08-05 DeepSeek低價風暴打服硅谷!海外平臺爭相倒貼V4 Flash2026-08-04 掃碼分享至朋友圈 相關閱讀 GPT-4o新版本突然上線:絲滑解決9.11和9.9誰大,更強也更便宜了 API支持結構化輸出 明敏2024-08-07 GPT-4o OpenAI 大模型API 月入7億!OpenAI首次披露商業化能力,CEO:營收年化超95億!2月內漲30% 系去年全年46倍 明敏2023-10-13 OpenAI 奧特曼 太抓馬了!
馬斯克OpenAI開庭,硅谷鉅富互揭老底像極了村口吵架 瓜多到吃不完 聽雨2026-05-01 AI OpenAI 馬斯克 DeepMind元老創業AI編程:亮相即獲1.55億美元,英偉達紅杉搶著投,團隊太豪華了!
要做「AI編程助手界的Waymo」 衡宇2025-03-08 AI初創 AI編程 DeepMind OpenAI OpenAI微軟關係現裂痕,奧特曼緊急公關,導火索竟是DeepMind聯創 形勢所迫,為算力折腰 白交2025-01-23 OpenAI 奧特曼 微軟 ChatGPT學會自己提問題了,還支持多文件上傳 看來OpenAI有被Claude刺激到(手動狗頭) 魚羊2023-08-04 ChatGPT OpenAI
Related
相關文章

微軟預告 Win10/Win11 經典版 Outlook 更新:基於上下文 AI 解釋用戶選中文本
首頁 > 智能時代>人工智能 微軟預告 Win10/Win11 經典版 Outlook 更新:基於上下文 AI 解釋用戶選中文本 2026/8/8 11:39:29 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 8 月 8 日消息,科技媒體 Windows Latest 昨日(8 月 7 日)發佈博文,報道稱面向 Windows 10、Windows 11 經典版 Outlook 應用,微軟開始推送名為 Explain This 的 Copilot AI 功能。功能方面,用戶打開郵件後,只需選中任意文本,Copilot 就會結合整封郵件的內容,給出貼切的上下文解釋。微軟在更新說明裡寫道,這項改進讓用戶對 Copilot 有更高的控制權,可以決定其在何時、如何協助完成任務,從而在工作流中整合生產力、清晰度和決策能力。時間表方面,微軟預計經典版 Outlook 的 Explain This 功能會在 9 月底前完成推送,大多數用戶會在 9 月初看到它。 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:Outlook,AI,微軟微軟 Win10/Win11 新版 Outlook 收件箱塞入 Copilot,AI 摘要過去 8 小時郵件Win10/Win11 新版 Outlook 本月將集成 Planner 任務管理,微軟希望藉此推動經典版用戶遷移微軟承認 Outlook 存在嚴重 Bug,郵件中的圖片無法正常顯示微軟修復 Outlook 奇怪 Bug:打開 Office 文檔顯示空白或“已損壞”微軟增強 Outlook AI 功能:自主梳理收件箱、調整日程安排等部分微軟 Outlook 365 用戶反饋安裝 2603 更新後出現“幽靈滾動”

A股不賺API賺,梁文鋒永遠不虧
A股不賺API賺,梁文鋒永遠不虧超聚焦2026.08.08 10:57 · 來自湖北全文4149字00:00 / 12:06Alpha沒了?API有了!文 | 超聚焦最近,梁文鋒的兩門生意,走出了不一樣的曲線。私募排排網統計數據顯示,截至2026年7月31日,梁文鋒旗下幻方量化對外展示的9只主流量化產品中,8只年內收益由正轉負,僅九章幻方中證500量化多策略2號勉強維持0.04%微弱正收益。

聊聊DeepSeek漲價:低價是手段,不是目的
聊聊DeepSeek漲價:低價是手段,不是目的市值榜2026.08.08 09:34 · 來自四川全文2802字00:00 / 07:58對於DeepSeek而言,低價已經幫助它完成了市場教育。下一步,它得證明自己能賺錢,而且能一直賺下去。
Mistral AI Releases Shieldstral 1.0 3B: An Open-Weights Policy-Adaptive Multimodal Safety Classifier Matching Models 7× Its Size
Mistral AI has released Shieldstral 1.0 3B, an open-weights, policy-adaptive multimodal safety classifier that treats content moderation as a single yes/no question rather than a fixed taxonomy of harm categories.