美國政府完成先進 AI 模型自願性評估框架制定,內容未公開

重點摘要
美國政府已按期完成針對先進 AI 模型評估的自願性框架制定,但白宮未對外公開具體內容、審閱機構及採用時程。該框架原應涵蓋保密、網路安全、風險管理與智慧財產權等要求,不過相關基準測試與適用門檻被列為機密。白宮計劃與業界召開會議審查該框架,並與更多合作夥伴討論後續步驟。
美國政府已在期限內完成一項針對先進人工智慧模型評估的自願性框架制定工作,但這份攸關全球AI監管走向的重要文件,目前並未對外公開具體內容。根據美國政治新聞媒體Axios的報導,白宮於當地時間週一表示,這項依行政命令要求所推動的框架已經如期完成,然而關於框架詳細內容、哪些機構或企業曾參與審閱,以及企業何時開始採用等問題,白宮皆未進一步說明。 這份框架的源起來自今年6月2日發布的行政命令。該命令明確要求建立一套自願性評估機制,讓AI開發商能與政府合作,在模型正式上市前先進行安全評估。如今白宮證實框架已在截止日期前完成,但對於外界最關心的監管規則細節,目前仍處於資訊封鎖狀態。 政策制定者、AI安全倡導者以及美國的國際盟友,都在密切關注這份文件的後續發展。由於全球最具影響力的AI模型皆由美國企業主導開發,這套框架將如何界定監管範圍、要求企業配合哪些評估程序,勢必對全球AI產業產生深遠影響。然而在缺乏公開資訊的情況下,各方只能等待白宮進一步釋出消息。 白宮一名官員表示,政府目前正在與產業界討論後續的實施計劃,並強調接觸對象「遠不止Anthropic、OpenAI和谷歌」這三家領先的AI實驗室。這番發言顯示,美國政府有意擴大與更多AI相關企業的合作範圍,而非僅鎖定少數大型業者。 事實上,在上述截止日期到來之前,Anthropic、OpenAI和谷歌這三家AI實驗室已經就框架草案向政府提供了反饋意見。這意味著產業界的意見在某種程度上已納入考量,但最終定稿的框架內容為何,以及這些企業的建議被採納了多少,目前尚無從得知。 就框架的定位而言,其目的是為AI開發商提供一套結構化的流程,協助它們在模型研發過程中與政府進行對接,並判斷正在開發的模型是否落入監管範圍。換句話說,這套框架並非直接制定模型安全標準,而是建立一套政府與企業之間溝通與評估的程序機制,讓AI開發者能清楚掌握自身產品是否需要接受官方檢視。 根據目前可取得的資訊,這份框架應包含多項具體規範。其中涵蓋當政府在模型發布前最多30天取得模型時,所需遵守的保密要求、網路安全要求、內部風險管理要求、智慧財產權保護要求,以及禁止披露的相關規定。此外,框架也應明確定義哪些「可信賴的合作夥伴」能夠提前取得模型進行審查,以確保評估過程的公正性與安全性。 值得注意的是,行政命令中對於AI模型高級網路攻擊能力的基準測試流程,已被明確列為機密資訊。同樣地,行政命令所規定的適用模型門檻也屬於機密範疇,僅會在「適當情況下」向AI開發者和研究人員披露。這項安排反映出美國政府對於AI安全評估細節的高度敏感性,擔心過早公開可能遭到不當利用。 然而,行政命令並未將這份自願性框架本身列為機密,因此政策制定者和其他觀察人士原先預期,至少可以看到框架的基本輪廓與核心原則。但白宮方面的表態顯然讓外界期望落空,一名白宮官員直言:「即使某些資訊不屬於機密,也並不意味著我們會向所有人公開傳播。」
對於AI企業而言,儘早獲得明確指引至關重要。由於模型開發週期漫長,企業需要提前判斷正在研發的產品是否可能受到框架約束,以規劃相應的安全評估資源與時間表。目前產業界仍處於等待狀態,期待白宮能提供更多操作面上的細節。 據知情人士透露,白宮計劃於當地時間週二與相關企業舉行工作人員層級的會議,對這份框架進行實質審查。這項會議預計將成為企業了解框架內容的關鍵契機,同時也是白宮聽取產業界回饋的重要管道。外界關注後續是否有更多資訊釋出,以及這套自願性框架能否在實際運作中獲得企業廣泛採用。
Related
相關文章
智譜AI新一代大模型GLM-5.3意外曝光
智譜AI尚未正式發佈的新一代旗艦模型GLM-5.3,因官網頁面、搜索引擎緩存及開源代碼庫等多渠道的“意外”洩露而提前曝光。GLM-5.3的意外曝光,使得三大頭部廠商的頂級模型在短期內集中亮相,市場爭奪戰一觸即發。截至發稿,智譜AI官方並未就GLM-5.3的洩露事件及具體發佈時間做出正式回應。業內普遍預期,鑑於模型已進入公開測試或展示階段,智譜AI或將在近期擇機正式對外公佈GLM-5.3的詳細技術參數與上線計劃。
DeepSeek-V4-Flash登頂全球調用量榜首,國產大模型包攬前五
7月31日最新發布的DeepSeek-V4-Flash正式版以2.33萬億Token的調用量強勢登上榜單第八。DeepSeek-V4-Flash 0423版和DeepSeek-V4-Flash 0731版合計調用量斷層領先。僅8月3日一天,DeepSeek-V4-Flash 0731版的調用量就達到1.02萬億Token,超過此前霸榜的DeepSeek-V4-Flash 0423版。價格方面,V4-Flash的競爭力幾乎無人能敵。海外開發者集體沸騰DeepSeek V4-Flash正式版上線後,海外開發者社區的反應堪稱熱烈。研究機構Artificial Analysis更直言,DeepSeek-V4-Flash已成為全球知名模型中運行成本最低的一款。從7月31日API公測到8月3日登頂全球調用量榜首,DeepSeek-V4-Flash僅用了不到一週時間。

飛書變革的伏筆,字節早就埋好了
字節跳動將飛書產品團隊與豆包團隊整合,並將飛書GTM團隊併入火山引擎,這是字節跳動為加速AI商業化而進行的最大規模To B業務重組。此舉旨在讓飛書成為AI原生應用的載體,並整合豆包與火山引擎的能力,以搶佔桌面AI辦公入口,並應對高昂的AI基礎設施投入與商業化壓力。

阿里字節騰訊,為AI辦公拼了
字節跳動、阿里巴巴與騰訊在短短兩週內接連對AI辦公領域進行重大整合,分別將飛書、千問辦公及WorkBuddy等產品與AI能力深度綁定,意在搶佔下一代辦公入口。三家巨頭皆認為,辦公場景已成為大模型token變現效率最高的領域,且Agent技術已跨越可用性門檻,因此同步加速內部整合,以統一產品入口覆蓋全流程工作流。

Edge AI Daily 早報(8月4日)
AI 巨頭近期動作頻頻,從雲端服務、品牌信任到供應鏈布局,各項動態都牽動著產業神經。亞馬遜 AWS 近期宣布與新創公司 Superblocks 簽署多年聯合行銷協議,將 AI 應用生成工具(即所謂的 Vibe Coding)整合進企業私有雲環境。這項合作旨在解決自然語言生成程式碼所衍生的影子 IT 問題——JetBrains 2026 年調查顯示,高達九成開發者定期使用 AI 工具,但 Georgia Tech 追蹤發現,AI 生成程式碼直接導致的 CVE 漏洞在三個月內從 6 個飆升至 35 個。
白宮 AI 評估框架按時完成卻秘而不宣,OpenAI、Anthropic、谷歌都沒看到全文
白宮按時完成一項針對先進AI模型的自願性評估框架,但未公開具體內容,也未說明哪些機構或企業已查看過該文件。OpenAI、Anthropic、谷歌等AI開發商雖已提供反饋,卻仍未看到全文,政府也未公佈企業何時開始採用該框架。