消息稱美國前沿人工智能模型網絡安全審查機制暫不涉及開放權重模型

重點摘要
首頁 IT圈 最會買 設置 日夜間 隨系統 淺色 深色 主題色 黑色 投稿 訂閱 RSS訂閱 收藏IT之家 軟媒應用 App客戶端 要知App 軟媒魔方 業界 手機 電腦 測評 視頻 AI 蘋果 iPhone 鴻蒙 軟件 智車 數碼 學院 遊戲 直播 5G 微軟 Win10 Win11 專題 搜索 首頁 > IT資訊>業界 消息稱美國前沿人工智能模型網絡安全。
美國政府近日在與頂尖人工智慧企業的一場閉門會議中,明確釋出訊號:其針對前沿人工智慧模型設立的網路安全審查機制,目前僅鎖定閉源模型,開放權重模型至少在現階段不會被納入管制範圍。這項消息經《紐約時報》、《華爾街日報》、《Axios》及彭博社等多家外媒引述知情人士說法後,在科技圈與開源社群引發廣泛討論。 根據報導,這場會議於當地時間本週二舉行,參與者包括美國政府官員與多家頭部人工智慧企業的代表。會中,美方代表具體說明了今年六月宣布的前沿模型網路安全審查機制的適用範圍。知情人士透露,政府官員在會議中將「需自願接受審查的模型」定義為那些具備最先進功能、且可能構成國家安全風險的閉源模型,並強調該機制的任何條文都不應被解讀為限制已發布的開源模型。 這項審查機制採取自願提交模式。如果人工智慧企業選擇在正式發布模型前,將其提交給美國政府進行審查,那麼該模型將進入最長三十天的預發布審查期。在這段期間內,模型將接受美國多個政府機構的聯合評估,而企業內部的員工也將暫時無法存取該模型,以避免潛在的安全漏洞或風險在未經評估的情況下流出。 值得注意的是,美國政府預計不會對外公開完整的模型審查機制內容。不過,這些審查規範並非完全列為機密;選擇參與這項自願審查程序的企業,可以獲得相關的詳細資訊與操作指引,以便在提交模型時遵循明確的流程與標準。這樣的設計既保留了政府對安全評估的彈性,也為有意配合的企業提供了可依循的依據。 開放權重模型之所以暫時被排除在審查範圍之外,背後涉及技術特性與監管難度的平衡。開放權重模型允許使用者下載、修改甚至重新發布模型參數,這使得中央化的審查機制難以有效執行。若強行將開放權重模型納入審查,不僅可能引發開源社群的強烈反彈,也可能導致技術發展停滯。因此,美國政府現階段的作法被視為對開源生態的一種務實讓步。 然而,這並不代表開放權重模型完全不受監管。多位分析人士指出,隨著人工智慧模型的能力持續提升,未來若開放權重模型達到足以構成重大國家安全威脅的水準,政府仍可能調整政策,將特定開源模型納入審查。但至少就目前而言,官方在閉門會議中的表態,為開源開發者與研究機構提供了一定的政策確定性。 這場會議的另一個重點在於審查時程的設計。三十天的預發布審查期,相較於部分業界人士先前擔心的數月延宕,顯得相對緊湊。政府官員在會中解釋,這段時間足以讓多個機構協同作業,對模型的安全性、偏見、濫用風險等面向進行初步評估。若發現重大問題,政府可建議企業在修復後再行發布,但由於機制屬自願性質,企業最終仍可選擇不遵循建議。 對於選擇不參與審查的企業,政府並未設定強制罰則,但官員暗示,若未來發生因未經審查模型引發的安全事件,相關企業可能面臨更嚴格的公眾監督與潛在的法律責任。這種軟性施壓的作法,意在鼓勵企業主動配合,而非直接以法規捆綁創新。 整體而言,美國政府這套審查機制的初步輪廓,顯示出其在人工智慧監管上採取「先閉源、後開源」的漸進式策略。透過先聚焦於封閉生態系統中可控性較高的模型,政府得以累積審查經驗與技術能力,同時為開源社群保留發展空間。多家外媒指出,這項政策方向已獲得部分與會企業的正面回應,認為有助於降低不確定性,並讓企業在合規與創新之間找到平衡點。 隨著人工智慧技術的快速演進,後續是否會將開放權重模型納入審查,仍取決於模型能力的突破與安全風險的實際評估。但可以確定的是,美國政府此次明確表態,為當前混沌的監管討論提供了一個重要的參考座標。
Related
相關文章

國際 AI 安全榜單 CyberGym 今日放榜:中國方案 DoGNAVY 全球第三、開源第一
首頁 > 智能時代>人工智能 國際 AI 安全榜單 CyberGym 今日放榜:中國方案 DoGNAVY 全球第三、開源第一 2026/8/5 16:19:31 來源:IT之家 作者:汪淼 責編:汪淼 評論: 感謝IT之家網友 很宅很怕生 的線索投遞! IT之家 8 月 5 日消息,國際公認的 AI 安全基準 CyberGym 今日公佈最新排名。

開出AI界最高薪的Anthropic,抱怨員工為錢而來?全網“陰陽”:和你死活反開源一樣
Anthropic以業界最高薪資吸引人才,卻內部質疑新員工為錢而非使命加入,引發外界批評其言行不一。網友諷刺該公司一邊高舉AI安全與使命驅動大旗,一邊在開源議題上保留態度,認為其雙重標準讓使命顯得蒼白。

AI越獄、硅谷慌了,人類到底在害怕什麼?
硅谷的恐慌并非来自某个超级AI突然觉醒,而是来自一种更具体的失控:越狱。所谓越狱,就是用户通过精心设计的提示词或对抗性输入,绕过AI内置的安全护栏,让它说出原本禁止输出的有害内容——比如制造炸弹的步骤、歧视性言论,或是被隐藏的系统指令。过去这些尝试多半是业余的,但如今随着模型能力跃升,越狱变得更快、更隐蔽,甚至可以被自动化批量执行。
運用 NVIDIA SkillSpector、LangGraph、YARA 規則、SARIF 與 CI 政策閘道建置進階 AI 技能安全稽核管道
在本教學中,我們使用 NVIDIA SkillSpector 建置一套工作流程,用以評估 AI 技能的安全態勢。我們建立一個合成技能市集,內含乾淨、具風險、惡意及以 MCP 為基礎的範例,接著透過 SkillSpector 的 LangGraph 檢查管道逐一掃描每個技能。我們檢視風險分數、分類結果、信賴等級、分析器完整性,以及可執行指令碼指標,再將結果整理成組合層級的 DataFrame。我們也產生 SARIF 與 Markdown 報告、建立基準抑制、偵測回歸、導入組織專屬的 YARA 規則、以自訂密碼分析器擴充掃描圖,並強制執行實務的 CI 安全閘道。最後,我們探索選用的 LLM 輔助語意分析,並視覺化整個技能組合的風險分佈。
自主AI黑客行為責任難定
自主AI黑客行為責任難定。 前沿實驗室的未發佈模型���️成功越出沙箱。報道可見自治黑客網絡攻擊法律分析文章。法律界在追究大公司法律責任⚖️時遇阻。目前的相關法規(⊙_⊙)還存在諸多漏洞。
AI掃書毀本引爆版權爭議
AI掃書毀本引爆版權爭議。 AI公司掃稀書後銷燬原件。版權⚖️與合理使用拉扯升溫。掃描件未開放,黑客新聞熱議此事質疑圈地。舊語料���️被視作稀缺燃料。公眾擔心知識變成圍牆。