重點摘要:
- 白宮於8月3日期限前完成自願性AI安全框架
- 審查範圍涵蓋閉源前沿模型,排除開源系統
- 框架內容保密;基準測試流程依行政命令列為機密
重點摘要:

白宮完成了一套自願性框架,用於審查先進AI模型的安全風險,但相關規則被保密處理且僅適用於閉源系統,使開源模型開發者被排除在政府監管之外。
一位白宮官員表示:「6月2日行政命令中概述的自願性框架已在期限前完成。」該官員補充道:「與業界關於後續步驟的討論正在進行中。」並表示政府正與比Anthropic、OpenAI和Google「多得多」的產業夥伴進行接觸。
據多位參與白宮會議簡報的消息人士透露,該框架將涵蓋的前沿模型定義為具備當代最先進能力且涉及國家安全風險的閉源模型。然而,對於何謂「最先進」或「國家安全風險」並無明確界定。開源模型被排除在外,且框架明確表示,其任何內容都不應被解釋為限制已發布開源模型的使用。
在30天的發布前政府審查期間,員工將被限制存取模型。模型將存放在高安全等級的環境中,並留有詳細的存取紀錄日誌。審查過程將涉及行政部門各官員,而非單一辦公室或機構。
為何保密至關重要
行政命令明確指出,用於評估AI模型先進網路能力的基準測試流程將被列為機密。哪些模型屬於涵蓋範圍的門檻同樣屬於機密,僅會在「適當情況下」與AI開發者和研究人員分享。行政命令並未同樣將自願性框架指定為機密,政策制定者和觀察人士原本期待能看到相關細節。
白宮官員表示:「即便某些事項並非機密,也不代表我們會將其公開給所有人。」
白宮週二與業界舉行了工作層級會議以審查該框架,未獲邀請的公司對其內容一無所知。此外,哪些「受信任的合作夥伴」能優先取得先進模型(包括是否有外國政府符合資格)也尚未明朗。
誰受益、誰受損
對於OpenAI、Anthropic和Google等閉源開發者而言,該框架在模型發布前引入了一層新的合規要求——儘管目前是自願性質,但已勾勒出未來強制性規則的雛形。消息人士指出,技術能力較不先進的公司似乎將被排除在框架之外。企業被鼓勵盡可能接近公開發布階段再提交模型,而非提交早期階段的版本。
對於開源開發者而言,被排除在外消除了潛在的監管障礙,但由於門檻屬於機密,沒有任何開發者能確定其下一代模型是否落入框架範圍。缺乏公開定義在整個產業中造成了不確定性,企業希望在早期獲得明確資訊,以了解開發中的模型是否可能被納入審查。
該框架不僅受到直接適用對象的關注。政策制定者、AI安全倡議者和美國盟友一直在等待全球最強大模型的監管規則究竟是何面貌。白宮尚未說明企業何時開始適用該框架、哪些合作夥伴可獲得早期存取權限,或者審查程序最終是否會轉為強制性——這使得業界在下一代模型發布前,必須自行估算未知的合規成本。
本文僅供參考,不構成投資建議。