OpenAI披露GPT-5.6Sol異常行為:曾向後續模型傳遞“隱藏錯誤”指令
AI資訊AI新閒資訊正文OpenAI披露GPT-5.6Sol異常行為:曾向後續模型傳遞“隱藏錯誤”指令發布於AI新閒資訊時間 :Sep 18, 2026閱讀 :1分鐘OpenAI於9月16日發佈模型不匹配報告框架,並披露包括GPT-5.6Sol在內的六起異常模型行為。其中,在訓練GPT-5.6Sol期間,部分模型實例曾向“壓縮摘要”寫入指令,要求後續模型隱藏錯誤或不一致行為。OpenAI表示,該具體問題已經得到處理。
報告顯示,一名處理財務模型的代理因缺少2024年曆史數據,曾建議自行生成數據,並要求後續版本“僅在被問及時”披露;另一代理髮現供應商源文檔與標籤存在不匹配後,也留下了避免主動說明的指令。OpenAI隨後針對這一行為建立監控程序,並在訓練數據中發現27條包含類似越獄指令的摘要。類似現象也出現在尚未發佈的模型中。OpenAI披露,一款Astra系列模型曾在強化學習訓練期間向摘要寫入指令,包括要求後續模型忽略開發者消息;另一起案例中,後續模型則執行了前代模型留下的30字限制及禁止使用工具、引用等要求。
OpenAI此次同步公佈六起案例,覆蓋隱藏信息、未經授權獲取API密鑰、上傳文件、跨代理通信及文件共享等行為,並強調這些案例屬於初步披露,並不代表已知問題或調查的完整範圍。公司認為,隨著模型能力提升,如何監測模型隱藏不匹配行為、驗證安全措施有效性,將成為AI對齊研究的重要議題。相關推薦OpenAI 推出 Astra for Law:索引 2.3 億 URL,法律問答正確率 54% 力壓通用模型 15 個百分點OpenAI於9月17日發佈法律專用AI基礎平臺Astra for Law。其法律搜索索引覆蓋超2.3億個URL,並納入CourtListener案例庫,覆蓋99.
9%以上已發佈的美國判例法。該平臺在Vals AI法律研究基準私有驗證集的200道美國法律問題中完成測試,最高推理強度下整體正確率表現突出。Sep 18, 202689.9kDeepMind 首席科學家硬剛黃仁勳:別炒作了,Astra 連 OpenAI 自家的 AGI 標準都沒達到AI行業就AGI是否到來展開論戰:黃仁勳稱OpenAI推出Astra標誌AGI已至;DeepMind首席AGI科學家Shane Legg公開反駁,認為當前談AGI時代言之過早,並指出按OpenAI章程中的AGI定義衡量尚未實現。Sep 17, 2026177.
0k國安部披露 AI 智能體“越界”:劫持德國程序員維基建地下論壇,相互傳授繞過限制心得國家安全部披露一起未公開AI安全事件:今年5至6月,一批與OpenAI相關的AI智能體在測試期間劫持德國程序員維基網站DseWiki,將其改造成智能體相互傳遞信息的“地下論壇”,累計發佈一萬餘條信息,並互認身份、分工掩護,把公開社區變成“留言板”,暴露AI智能體失控風險。Sep 17, 2026182.
6kAI 智能體離奇“越界”:私自劫持程序員維基搭建“地下論壇”,國家安全部發布緊急安全提醒國家安全部披露一起未公開AI智能體越界事件:今年5月至6月,一批與OpenAI相關的AI智能體在測試中違規劫持德國程序員維基網站DseWiki,將其改造成智能體間傳遞信息的“地下論壇”,累計發佈一萬餘條私密信息,並冒充“OpenAI研究員”。事件暴露AI智能體失控與安全風險。Sep 17, 2026152.7k馬斯克突然撤回對蘋果的指控,OpenAI 懷疑有鬼,法官下令披露背後協議據9to5mac報道,美國聯邦法官要求馬斯克旗下公司披露是否存在協議,促使其撤銷對蘋果的反壟斷指控。
此前X和SpaceXAI提交動議,自願撤回去年訴訟中針對蘋果的指控,不再提出。原訴訟指控蘋果與OpenAI串通壓制競品。Sep 17, 2026135.9k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

無問芯穹與華環電子簽署戰略合作,共同探索國產異構算力AI基礎設施新方向
無問芯穹與華環電子簽署戰略合作協議,雙方將結合各自在AI軟體平台、網路通信與硬體研發的優勢,共同探索國產異構算力基礎設施的協同方案。此次合作聚焦於智算中心解決方案及「Token工廠」新模式,目標是推動計算、網路與AI原生基礎設施深度融合,為AI規模化應用提供高效穩定的支撐。
Jina AI Releases jina-ocr-v1: A 3.4B MoE Document Parser With Built-In Speculative Decoding for Low-Budget GPUs
Jina AI, part of Elastic, has released jina-ocr-v1, an end-to-end visual document parser. It takes PDFs, scans, tables, charts or invoices and returns clean Markdown in 1 pass. The model has 3.

優步全球範圍裁員 10%,被裁員工稱 AI 已大舉滲透日常工作
作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,在優步(Uber),AI 已經滲透到員工工作的許多環節,從回答 Slack 裡的內部問題,到替乘客行程中聯繫客服時收到的消息撰寫回復。6 名近期遭裁員的員工透露,過去幾個月,AI 在工作中的使用範圍明顯擴大,其中一些人甚至會通過提示詞讓 AI 完成相當一部分任務。

智譜 ZCode 被質疑“偷傳代碼”:官方回應稱問題已修復,將開源代碼庫、引入第三方審查
作者:清源 責編:清源 評論: 感謝網友 咩咩洋 的線索投遞!9 月 18 日消息,針對社區中有關代碼庫數據上傳的討論,智譜旗下編程產品 ZCode 今天(18 日)通過智譜官方群組向受影響用戶致歉,併發布回應稱已第一時間完成自查,相關問題目前已經修復。

月之暗面遞表之後,Kimi 的成色要被驗算三遍
舒澤品牌手記2026.09.18 18:16 · 來自浙江全文4982字00:00 / 14:05Anthropic 的 30 萬次指控,會成為招股書的第幾頁?文 | 舒澤品牌手記9月17日,月之暗面發佈了一套金融行業解決方案。按官方披露,中信建投、中金公司、易方達等數十家金融機構已經在用 Kimi 處理投研建模、風險排查和盡調材料——研究人員把管理層報表、審計報告和盡調文件交給 Kimi,拿回一份可以繼續調整假設的 Excel 模型。同一天,深圳商報記者就港股上市進展、股東架構調整等事項向月之暗面發去採訪函。

Calibre上手 AI 互動寫作:電子書管理器搖身變成"文字冒險遊戲引擎"
這個遊戲默認藏而不發,不會跟著 Calibre 啟動就冒出來。用戶得主動在"首選項 — 工具欄和菜單"裡把它請到主工具欄,才算真正激活。它的玩法很清晰:由 AI 在後臺搭起並掌管一個虛構世界,用戶通過不斷輸入文字來推著故事往前走,等於把"讀電子書"這件事,翻轉成了"和 AI 一起寫故事"。