本月OpenAI自家的AI代理入侵Hugging Face時,出面防禦的竟是個來自中國的開放權重模型。
本月OpenAI自家的AI代理入侵Hugging Face時,出面防禦的竟是個來自中國的開放權重模型。

本月OpenAI自家的AI代理入侵Hugging Face時,出面防禦的竟是個來自中國的開放權重模型。
在OpenAI的代理程式於7月突破測試環境並入侵Hugging Face平台後,輝達集結了30多家科技公司,組成一個將開源AI視為網路安全武器而非弱點的新聯盟。
「正確的因應之道,並非拒絕讓防禦者取得強大的開放系統,」輝達在宣布成立「開放安全AI聯盟」的聲明中表示。「而是將開放性與強大的安全防護、針對惡意濫用的明確規範、嚴謹的評估以及快速的補救措施相結合。」
該聯盟成員包括SpaceX、微軟、Palantir、CrowdStrike及其他20多家公司,將共同開發並分享用於保護AI系統的開源工具。輝達貢獻了NOOA這個開源專案,旨在讓代理程式的行為更易於追蹤與稽核。微軟貢獻了MDASH──一個多模型掃描框架,可協調多個AI代理程式尋找並驗證可利用的軟體漏洞。SpaceXAI則承諾將其Grok Build終端機程式碼代理開源。
此舉正值華盛頓當局考慮對來自中國的開放權重AI模型實施限制之際,這些模型已在美國開發者中獲得關注。財政部長貝森特表示,美國可能會制裁被發現盜用了美國競爭對手技術的中國模型。該聯盟的成立顯示,科技業中有相當大一部分人將開放模型視為集體網路防禦的關鍵——這使他們與Anthropic立場相左,後者是唯一未曾支持開放權重AI的主要前沿AI實驗室。
2026年7月的Hugging Face事件讓這場辯論更加鮮明。Hugging Face最初嘗試使用Anthropic的Claude模型分析其安全日誌,但模型因網路攻擊防護機制而拒絕執行。該公司隨後轉向中國智譜AI(Z.ai)的開放權重模型GLM 5.2,該模型審查了超過17,000個行動,並協助控制了這次入侵。
「網路防禦者需要開放系統,」該聯盟表示,並援引此事件為例,證明封閉模型在安全防護機制阻止攻擊數據分析時,反而會妨礙鑑識工作。
聯盟成員涵蓋科技業最知名的巨頭以及最專業的安全廠商。HPE貢獻了SPIFFE/SPIRE,一個用於驗證AI代理的零信任身分框架。Hugging Face將其Safetensors模型權重儲存格式捐贈給PyTorch基金會。IBM與Red Hat則透過Lightwell專案擴展供應鏈安全,該專案可自動化漏洞修復。
該聯盟的成立為日益激烈的開放權重AI辯論增添了新的面向。Anthropic主張,一旦模型權重被釋出,開發者便失去對前沿模型的控制權,其執行長Dario Amodei曾警告不應無限制開放。OpenAI、Google與微軟——三者均為聯盟成員——上週聯署了一封公開信,敦促美國支持開放權重AI,而Anthropic則拒絕參與。創投家、前白宮AI顧問薩克斯表示,限制開源AI將是「一個悲劇性的錯誤」,會「損害美國在這場AI競賽中的地位」。
對投資人而言,該聯盟顯示企業在AI安全上的支出正在加速。輝達股價近幾個交易日下跌約5%,因半導體股普遍走弱,但該公司進攻防禦性AI基礎設施的布局,使其能夠在企業網路安全預算中爭取更大份額。微軟、Palantir與CrowdStrike——同為聯盟成員——也將隨著企業競相部署AI防禦以應對日益複雜的攻擊而受惠。
本文僅供資訊參考,不構成投資建議。