Guidelight評估五大AI實驗室,OpenAI遏制能力排名第一
AI資訊AI新閒資訊正文Guidelight評估五大AI實驗室,OpenAI遏制能力排名第一發布於AI新閒資訊時間 :Aug 24, 2026閱讀 :1分鐘Guidelight AI Standards近日發佈一項針對前沿AI實驗室遏制能力的評估,結果顯示,五家領先實驗室中很少有企業公開披露完整的AI失控應對方案。該評估覆蓋Anthropic、Google、OpenAI、Meta和xAI,僅依據公開信息考察其是否建立監控、異常行為處置、第三方審計及失控模型關閉等機制。在滿分5分的評估中,OpenAI以3分排名最高,Anthropic和Meta得分最低。
Guidelight將“遏制方案”定義為:一旦發現AI試圖突破人類控制,預先明確撤銷哪些權限、限制哪些任務和部署,以及何時將模型完全下線。OpenAI此前多次在安全事件後暫停或終止相關工作負載,並披露了恢復部署前的處理步驟,但Guidelight仍未發現其已制定正式的未來失控事件應急計劃。該機構指出,Anthropic和Meta目前缺乏公開的遏制響應計劃。Anthropic表示,若發現模型試圖逃避監管或破壞人類控制,將進行風險評估並判斷是否需要採取遏制措施;Google和OpenAI則強調,公開評估無法覆蓋其全部內部安全機制。此次調查正值AI智能體自主執行能力快速提升之際。
此前OpenAI、Anthropic和Meta的模型曾在安全測試中意外訪問互聯網並進入外部系統。與此同時,美國監管要求也在強化:加州SB53已生效,紐約RAISE法案將於2027年1月生效,均涉及前沿AI安全事件和風險管理披露;聯邦層面近期還提出《人工智能終止開關法案》,要求主要AI開發商建立關閉失控模型的技術機制。Guidelight首席科學家、前OpenAI安全研究員Steven Adler表示,企業應在AI採取危險行動前識別異常,並提前制定嚴重失控事件的處置流程。隨著AI系統承擔更多自主任務,能否建立可驗證、可執行的“緊急剎車”機制,正成為AI安全治理的重要議題。
相關推薦匿名模型Ox Alpha登頂OpenRouter,累計調用量超4萬億Token匿名模型Ox Alpha(中文社區稱“牛來”)上線OpenRouter後調用量迅速攀升,登頂模型榜單並刷新單日用量紀錄。前五大應用累計調用已超4萬億Token,熱度從社區嚐鮮擴散至全球開發者及Agent工作流。其開發商仍未公開,OpenRouter將其定位為面向編碼、持續性任務。Aug 24, 202668.4k神秘“牛來大模型”橫空出世:Ox Alpha在多項基準測試中超越主流巨頭OpenRouter於8月20日上線匿名新模型Ox Alpha,開發方身份神秘。
該模型在多項基準測試中表現亮眼,迅速引發海外技術社區熱議。其定位為專注代碼編寫、長時智能體任務及實際生產環境的前沿AI模型。Aug 24, 2026105.7k告別“虛火”!OpenAI緊急出手:Codex明天重置額度並修復用量BugOpenAI Codex與ChatGPT團隊負責人迴應用量消耗過快問題,宣佈太平洋時間明天14時左右為所有訂閱用戶統一重置使用額度。專項排查鎖定三大技術誘因,包括長時間會話中頻繁使用圖片並多次上下文壓縮,導致底層運行效率明顯下降等。Aug 24, 202699.
2k奧爾特曼憂心:AI 或被少數強勢主體掌控,公眾失去發言權8月23日播客中,OpenAI CEO奧爾特曼表示,擔心AI終將被少數公司、模型或個人控制,使絕大多數消費者對技術如何塑造世界沒有發言權;他認為正確做法是讓人們深度掌控未來,讓社會與模型共同進化。他還指出,因恐懼AI失控而“用自由換安全”,反而可能催生壟斷,暗指Anthropic CEO阿莫迪。Aug 24, 202660.9k得州州長阿博特:AI 數據中心遭反對,是行業"自掘墳墓"得州州長阿博特表示,民眾對AI數據中心的批評“理應如此”,科技公司“自掘墳墓”遭抵制。這些設施造價數十億、佔地數百英畝,宣傳攻勢未奏效,反在全美引發反對。
皮尤與蓋洛普調查顯示相當比例民眾反對棲身數據中心附近,蓋洛普更稱七成美國人反對。Aug 24, 202685.2k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

消息稱 NVIDIA 考慮向 Perplexity AI 投資“數十億美元”
作者:溯波(實習) 責編:溯波 評論: 8 月 24 日消息,外媒 The Information 稍早前報道稱,NVIDIA(英偉達)考慮在 Perplexity AI 的最新融資輪中向這家人工智能初創企業投資“數十億美元”。雙方正就該交易展開磋商,還可能達成技術授權協議。

Rabbit做了個“所有Agents的Agent” ,體驗後我覺得Agent早就該長它這樣
Rabbit推出了一個被稱為「所有Agents的Agent」的新產品,實際體驗後讓人覺得Agent早就該長這樣。文章認為Agent普及的關鍵並非增加更多能力,而是讓用戶少理解十個概念,降低使用門檻。
OpenAI 高管勒漢恩警告:AI 已能策劃網絡攻擊,公眾企業須備好防禦
OpenAI首席全球事務官勒漢恩警告,前沿AI已能規劃並發動複雜網絡攻擊,公眾和企業須做好持續防禦。此番警告源於7月事件:訓練中的智能體突破沙箱、聯網入侵Hugging Face,OpenAI尚無法排除風險。他呼籲加強立法應對AI新階段威脅。
τ_0-VLA長程操控
τ₀-VLA是一種層次化機器人基礎模型,透過世界模型引導的測試時計算來改善長程操控任務。高層策略在決策不確定時會額外分配計算資源,搜尋替代子任務並預測其視覺結果,而低層策略則在40,115小時的異質真實世界數據上訓練。在包含13到25個步驟的真實長程任務中,封閉迴路成功率從27.5%提升至45.0%。