IT之家模型更新

美國政府完成先進 AI 模型自願性評估框架制定,內容未公開

2026年8月4日 10:45
美國政府完成先進 AI 模型自願性評估框架制定,內容未公開

重點摘要

美國政府已按期完成針對先進 AI 模型評估的自願性框架制定,但白宮未對外公開具體內容、審閱機構及採用時程。該框架原應涵蓋保密、網路安全、風險管理與智慧財產權等要求,不過相關基準測試與適用門檻被列為機密。白宮計劃與業界召開會議審查該框架,並與更多合作夥伴討論後續步驟。

站內 AI 整理稿

美國政府已在期限內完成一項針對先進人工智慧模型評估的自願性框架制定工作,但這份攸關全球AI監管走向的重要文件,目前並未對外公開具體內容。根據美國政治新聞媒體Axios的報導,白宮於當地時間週一表示,這項依行政命令要求所推動的框架已經如期完成,然而關於框架詳細內容、哪些機構或企業曾參與審閱,以及企業何時開始採用等問題,白宮皆未進一步說明。這份框架的源起來自今年6月2日發布的行政命令。該命令明確要求建立一套自願性評估機制,讓AI開發商能與政府合作,在模型正式上市前先進行安全評估。如今白宮證實框架已在截止日期前完成,但對於外界最關心的監管規則細節,目前仍處於資訊封鎖狀態。

政策制定者、AI安全倡導者以及美國的國際盟友,都在密切關注這份文件的後續發展。由於全球最具影響力的AI模型皆由美國企業主導開發,這套框架將如何界定監管範圍、要求企業配合哪些評估程序,勢必對全球AI產業產生深遠影響。然而在缺乏公開資訊的情況下,各方只能等待白宮進一步釋出消息。白宮一名官員表示,政府目前正在與產業界討論後續的實施計劃,並強調接觸對象「遠不止Anthropic、OpenAI和谷歌」這三家領先的AI實驗室。這番發言顯示,美國政府有意擴大與更多AI相關企業的合作範圍,而非僅鎖定少數大型業者。

事實上,在上述截止日期到來之前,Anthropic、OpenAI和谷歌這三家AI實驗室已經就框架草案向政府提供了反饋意見。這意味著產業界的意見在某種程度上已納入考量,但最終定稿的框架內容為何,以及這些企業的建議被採納了多少,目前尚無從得知。就框架的定位而言,其目的是為AI開發商提供一套結構化的流程,協助它們在模型研發過程中與政府進行對接,並判斷正在開發的模型是否落入監管範圍。換句話說,這套框架並非直接制定模型安全標準,而是建立一套政府與企業之間溝通與評估的程序機制,讓AI開發者能清楚掌握自身產品是否需要接受官方檢視。根據目前可取得的資訊,這份框架應包含多項具體規範。

其中涵蓋當政府在模型發布前最多30天取得模型時,所需遵守的保密要求、網路安全要求、內部風險管理要求、智慧財產權保護要求,以及禁止披露的相關規定。此外,框架也應明確定義哪些「可信賴的合作夥伴」能夠提前取得模型進行審查,以確保評估過程的公正性與安全性。值得注意的是,行政命令中對於AI模型高級網路攻擊能力的基準測試流程,已被明確列為機密資訊。同樣地,行政命令所規定的適用模型門檻也屬於機密範疇,僅會在「適當情況下」向AI開發者和研究人員披露。這項安排反映出美國政府對於AI安全評估細節的高度敏感性,擔心過早公開可能遭到不當利用。

然而,行政命令並未將這份自願性框架本身列為機密,因此政策制定者和其他觀察人士原先預期,至少可以看到框架的基本輪廓與核心原則。但白宮方面的表態顯然讓外界期望落空,一名白宮官員直言:「即使某些資訊不屬於機密,也並不意味著我們會向所有人公開傳播。」

對於AI企業而言,儘早獲得明確指引至關重要。由於模型開發週期漫長,企業需要提前判斷正在研發的產品是否可能受到框架約束,以規劃相應的安全評估資源與時間表。目前產業界仍處於等待狀態,期待白宮能提供更多操作面上的細節。 據知情人士透露,白宮計劃於當地時間週二與相關企業舉行工作人員層級的會議,對這份框架進行實質審查。這項會議預計將成為企業了解框架內容的關鍵契機,同時也是白宮聽取產業界回饋的重要管道。外界關注後續是否有更多資訊釋出,以及這套自願性框架能否在實際運作中獲得企業廣泛採用。

Related

相關文章

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?

字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

1 小時前

千人聯機世界模型“RhOS-World: Khora”正式發佈

RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

1 小時前
Hugging Face Blog模型更新

TutorMoments:AI 家教何時該出手,何時該放手?

今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

2 小時前