白宮 AI 評估框架按時完成卻秘而不宣,OpenAI、Anthropic、谷歌都沒看到全文

2026年8月4日 03:30

重點摘要

白宮按時完成一項針對先進AI模型的自願性評估框架,但未公開具體內容,也未說明哪些機構或企業已查看過該文件。OpenAI、Anthropic、谷歌等AI開發商雖已提供反饋,卻仍未看到全文,政府也未公佈企業何時開始採用該框架。

站內 AI 整理稿

美國白宮於當地時間週一正式對外宣布,已如期完成一項針對先進人工智慧模型的自願性評估框架制定工作。這份框架源自今年6月2日由總統簽署的行政命令,旨在為AI開發商提供一套結構化的流程,協助他們與政府協作,判斷正在研發中的模型是否落入監管範圍。然而,白宮在公告中既未揭露框架的具體內容,也未說明哪些機構或企業已經查閱過該文件,更未給出企業何時開始遵循這套指引的時間表,引發外界高度關注與質疑。 根據報導,這項自願性評估框架應包含多項關鍵要素,包括當政府在模型發布前最多提前30天取得相關模型時,所需遵守的保密要求、網路安全要求、內部風險管理要求、智慧財產權保護以及禁止揭露規定。同時,框架還需界定哪些「可信賴的合作夥伴」能夠提前獲得模型的存取權限。這些要求原本是為了讓AI開發商在模型正式上線前,能有明確的規範可循,避免因監管模糊而產生合規風險。 值得注意的是,行政命令本身已明確將評估AI模型高級網路攻擊能力的基準測試流程列為機密,適用模型的門檻參數同樣屬於機密資訊,僅在「適當情況下」向AI開發者與研究人員揭露。然而,行政命令並未將自願性評估框架本身列為機密,因此政策制定者與觀察人士普遍預期能夠看到相關細節。但截至目前,白宮仍未公開這份框架文件,令外界感到困惑與失望。 一名白宮官員的回應更引發諸多揣測。該官員表示:「即使某些資訊不屬於機密,也並不意味著我們會向所有人公開傳播。」他同時透露,政府正在與「遠不止Anthropic、OpenAI和谷歌」的更多行業合作夥伴進行接觸。這番話暗示,白宮對於框架的公開範圍與對象有自己的考量,並非單純因為保密需求而隱瞞。 在框架制定過程中,Anthropic、OpenAI與谷歌這三家頂尖AI實驗室已經針對草案向政府提供了反饋意見。然而,就連這些直接參與反饋的企業,至今仍未看到框架的全文。這意味著,全球最強大的AI模型開發商,對於即將適用的監管規則仍處於資訊不對等的狀態,無法在產品開發與風險評估上做出準確判斷。 業界普遍認為,AI企業迫切需要儘早獲得明確的指引,以判斷正在開發中的模型是否可能受到這套框架的約束。框架的內容不僅關係到模型的發布時程,更影響企業的研發資源配置與合規成本。如今框架雖然按時完成,卻無法讓關鍵參與者檢視,無疑將延緩產業的合規進程,也可能導致部分企業在不明確的監管環境下採取更保守的策略。 據知情人士透露,白宮計劃於當地時間週二與相關企業舉行工作人員層級的會議,針對框架進行審查。這項會議預計將是自框架完成後,產業界首次有機會深入討論其內容與適用範圍。然而,會議的具體議程與參與對象尚未公開,外界也無法確定這是否能夠真正解決資訊不透明所帶來的問題。 這起事件反映出美國政府在AI監管上的兩難處境。一方面,行政命令要求加速制定框架,展現對AI安全與治理的重視;另一方面,對於框架的公開程度與溝通機制,卻顯得謹慎甚至保守。白宮官員的發言更暗示,政府可能傾向於選擇性地與特定合作夥伴分享資訊,而非全面公開,這與外界期待的政策透明度存在落差。 整體而言,這份「完成了但看不到」的評估框架,不僅讓參與反饋的AI企業感到困惑,也可能引發外界對政府監管意圖的更多猜測。當全球最先進的AI模型即將接受新的監管規則時,卻連最直接的利害關係人都無法掌握完整資訊,這本身就已經說明了不少問題。未來框架能否順利落地,以及政府是否會進一步公開細節,將是產業界與政策觀察者密切關注的焦點。

Related

相關文章

IT之家模型更新

美國政府完成先進 AI 模型自願性評估框架制定,內容未公開

美國政府已按期完成針對先進 AI 模型評估的自願性框架制定,但白宮未對外公開具體內容、審閱機構及採用時程。該框架原應涵蓋保密、網路安全、風險管理與智慧財產權等要求,不過相關基準測試與適用門檻被列為機密。白宮計劃與業界召開會議審查該框架,並與更多合作夥伴討論後續步驟。

剛剛

智譜AI新一代大模型GLM-5.3意外曝光

智譜AI尚未正式發佈的新一代旗艦模型GLM-5.3,因官網頁面、搜索引擎緩存及開源代碼庫等多渠道的“意外”洩露而提前曝光。GLM-5.3的意外曝光,使得三大頭部廠商的頂級模型在短期內集中亮相,市場爭奪戰一觸即發。截至發稿,智譜AI官方並未就GLM-5.3的洩露事件及具體發佈時間做出正式回應。業內普遍預期,鑑於模型已進入公開測試或展示階段,智譜AI或將在近期擇機正式對外公佈GLM-5.3的詳細技術參數與上線計劃。

剛剛

DeepSeek-V4-Flash登頂全球調用量榜首,國產大模型包攬前五

7月31日最新發布的DeepSeek-V4-Flash正式版以2.33萬億Token的調用量強勢登上榜單第八。DeepSeek-V4-Flash 0423版和DeepSeek-V4-Flash 0731版合計調用量斷層領先。僅8月3日一天,DeepSeek-V4-Flash 0731版的調用量就達到1.02萬億Token,超過此前霸榜的DeepSeek-V4-Flash 0423版。價格方面,V4-Flash的競爭力幾乎無人能敵。海外開發者集體沸騰DeepSeek V4-Flash正式版上線後,海外開發者社區的反應堪稱熱烈。研究機構Artificial Analysis更直言,DeepSeek-V4-Flash已成為全球知名模型中運行成本最低的一款。從7月31日API公測到8月3日登頂全球調用量榜首,DeepSeek-V4-Flash僅用了不到一週時間。

剛剛
鈦媒體模型更新

飛書變革的伏筆,字節早就埋好了

字節跳動將飛書產品團隊與豆包團隊整合,並將飛書GTM團隊併入火山引擎,這是字節跳動為加速AI商業化而進行的最大規模To B業務重組。此舉旨在讓飛書成為AI原生應用的載體,並整合豆包與火山引擎的能力,以搶佔桌面AI辦公入口,並應對高昂的AI基礎設施投入與商業化壓力。

剛剛

阿里字節騰訊,為AI辦公拼了

字節跳動、阿里巴巴與騰訊在短短兩週內接連對AI辦公領域進行重大整合,分別將飛書、千問辦公及WorkBuddy等產品與AI能力深度綁定,意在搶佔下一代辦公入口。三家巨頭皆認為,辦公場景已成為大模型token變現效率最高的領域,且Agent技術已跨越可用性門檻,因此同步加速內部整合,以統一產品入口覆蓋全流程工作流。

剛剛
鈦媒體模型更新

Edge AI Daily 早報(8月4日)

AI 巨頭近期動作頻頻,從雲端服務、品牌信任到供應鏈布局,各項動態都牽動著產業神經。亞馬遜 AWS 近期宣布與新創公司 Superblocks 簽署多年聯合行銷協議,將 AI 應用生成工具(即所謂的 Vibe Coding)整合進企業私有雲環境。這項合作旨在解決自然語言生成程式碼所衍生的影子 IT 問題——JetBrains 2026 年調查顯示,高達九成開發者定期使用 AI 工具,但 Georgia Tech 追蹤發現,AI 生成程式碼直接導致的 CVE 漏洞在三個月內從 6 個飆升至 35 個。

剛剛