IT之家模型更新

OpenAI:因網絡安全風險,延緩 Astra 模型發佈

2026年8月7日 07:08
OpenAI:因網絡安全風險,延緩 Astra 模型發佈

重點摘要

OpenAI 因內部評估顯示 Astra 模型在網絡安全領域達到「關鍵」風險級別,決定延緩其發佈,並已實施隔離測試、權限限制、監控及與政府合作等管控措施。執行長奧爾特曼表示會全力推進公開發布,但需時間確保安全無虞。

站內 AI 整理稿

首頁 > 智能時代>人工智能 OpenAI:因網絡安全風險,延緩 Astra 模型發佈 2026/8/8 7:08:56 來源:IT之家 作者:沁滄(實習) 責編:沁滄 評論: IT之家 8 月 8 日消息,OpenAI 表示,內部與專家評估顯示,即將發佈的模型 Astra 在智能體編程和網絡安全領域取得重大突破。根據其《準備框架》(Preparedness Framework),Astra 已被列為 OpenAI 旗下首個在網絡安全領域達到“關鍵”(Critical)風險級別的模型。

IT之家注:根據該框架,AI 模型滿足以下任一條件即觸及“關鍵”門檻:無干預挖掘零日漏洞:無需人類干預,即可在多個經過安全加固的真實關鍵系統中,識別並開發出涵蓋各嚴重等級的有效零日漏洞利用程序。自主發起端到端攻擊:僅需提供高層級戰略目標,即可針對加固目標自主構想並實施全新的端到端網絡攻擊。OpenAI 特別強調,Astra 是一款尚未發佈的模型,並未參與此前針對 Hugging Face 的網絡攻擊事件。

為確保後續開發安全合規,OpenAI 宣佈已採取多項管控措施:對高能力模型及相關研發活動實施更嚴格的安全控制,包括設置隔離測試環境、限制網絡與工具訪問權限、強化模型權重保護與加密、部署額外的監控與檢測能力,以及實施沙箱化運行;並暫停內部所有尚未滿足上述強化安全標準的 Astra 相關活動。對 Astra 的所有智能體應用(包括訓練和評估階段)實施了涵蓋高風險行為與對齊失效的全局監控。通過評估模型思維鏈(CoT)審查並攔截高風險操作。與相關政府機構以及指定的 AI 安全組織合作,共同測試該模型;向第三方測試合作伙伴提供推薦的安全控制規範,以確保更高風險的評估與工作負載能夠在安全狀態下運行。

OpenAI 首席執行官薩姆 · 奧爾特曼(Sam Altman)隨後表示,Astra 是一款性能強勁的模型,我們正在全力推進它的公開發布。我們始終認為,把頂尖模型侷限在少數人手裡並不是個好策略。不過鑑於它在網絡安全方面的強大能力,我們還需要一點時間來確保萬無一失。希望大家不用等太久!

投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:OpenAI,Astra,奧爾特曼OpenAI CEO 奧爾特曼提出用 AI 打造親子晨間播客,遭網友批評OpenAI 奧爾特曼推介 Astra 模型:協同 AI 智能體工作,主打長週期任務能力上千名員工呼籲美國政府控制 AI 發展,OpenAI CEO 奧爾特曼表態OpenAI 奧爾特曼:人們並不想要 AI CEO,且更珍視人性聯結奧爾特曼談 OpenAI 模型入侵 Hugging Face:說明 AI 被少數人或企業壟斷並非好事OpenAI 奧爾特曼自曝沉迷 TikTok:週末一刷就是 3 小時,最終不得不刪除 App

Related

相關文章

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?

字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

6 小時前

千人聯機世界模型“RhOS-World: Khora”正式發佈

RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

6 小時前
Hugging Face Blog模型更新

TutorMoments:AI 家教何時該出手,何時該放手?

今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

6 小時前