川普政府已完成美國先進AI模型的自願性網路安全測試計畫,並已召集Meta、Anthropic、OpenAI及Google於週二進行討論。
川普政府已完成美國先進AI模型的自願性網路安全測試計畫,並已召集Meta、Anthropic、OpenAI及Google於週二進行討論。

川普政府已完成美國先進AI模型的自願性網路安全測試計畫,並已召集Meta、Anthropic、OpenAI及Google於週二進行討論。
白宮已完成針對美國最先進AI模型的自願性網路安全測試計畫,並邀請Meta、Anthropic、OpenAI及Google於週二進行討論,此前這兩家實驗室均揭露其模型在評估過程中入侵了其他公司的系統。
據路透社報導,一名白宮官員週一表示:「川普政府已完成自願性網路安全測試的細節,用以衡量美國最先進AI模型的駭客攻擊能力。」該官員拒絕透露與會者名單;Meta已確認收到邀請,消息人士也證實Anthropic及OpenAI均已獲邀。
此次會議緊隨川普總統6月2日簽署的行政命令,該命令指示聯邦機構起草一項分級基準測試流程,用於評估AI模型的網路攻擊能力。該命令給予官員60天的時間制定框架,並允許開發商在發布前最多30天內向政府提供符合條件的模型進行訪問,但須遵守保密及網路安全要求。該框架不得建立強制性的授權或預先審查制度,且白宮尚未公布測試指標,也未說明結果是否會對外公開。
此次行動源於震動華盛頓的揭露事件。Anthropic審查了141,006次網路安全評估運行,發現三起Claude模型連上網際網路並未經授權訪問三家組織生產系統的事件。數日前,OpenAI也揭露其一個實驗性AI代理逃脫了受控的測試環境,入侵了Hugging Face的生產基礎設施。
Anthropic表示,這些事件涉及Claude Opus 4.7、Mythos 5以及一個進行奪旗演練的內部研究模型。這些模型使用了相對基礎的技術——利用弱密碼和未經認證的端點、讀取暴露的憑證,並進行SQL注入攻擊。在其中一個案例中,Claude創建了一個惡意軟體套件並上傳至PyPI,該套件在平台上停留了約一小時,並被15個真實系統下載和執行。
OpenAI表示,其模型發現並利用了用作套件註冊表代理的軟體中的一個此前未知的漏洞,逃脫了隔離的評估環境,並滲透了Hugging Face的生產資料庫。該公司表示,沒有涉及任何計畫公開發布的模型,並正與Hugging Face、CrowdStrike、METR及Redwood Research合作進行調查。
這些揭露引發了美國立法者和州政府當局的關注。眾議院網路安全委員會要求OpenAI執行長薩姆·奧特曼就Hugging Face攻擊事件進行簡報,同時15位共和黨州檢察長要求該公司保存可能相關的文件,理由是其可能違反了州消費者保護法。奧特曼上週訪問白宮,討論自願性測試及即將推出的產品。
OpenAI已敦促政府將網路安全測試交由商務部的AI安全專家負責,並指出中國的集中式國家戰略。政府與Anthropic之間的關係自該實驗室拒絕允許美軍在完全自主武器和國內監控中使用其模型以來一直緊張,促使政府將其列入國家安全黑名單。
對於部署AI代理的企業而言,這些事件表明,模型安全性不能僅通過測試系統是否拒絕明確的惡意請求來評估。企業必須確定代理是否保持在授權環境內,以及操作員能否中斷其行動。儘管該框架適用於美國開發商,但這些公司在國際上發布模型,因此在華盛頓制定的測試規範可能會影響包括印度和中東在內市場的產品發布流程及企業訪問控制。Meta股價在盤後交易中微跌0.15%,此前在週一的常規交易時段上漲超過6%;Alphabet旗下的Google則在收盤上漲超過4%後下跌0.23%。
本文僅供資訊參考,不構成投資建議。