白宮關閉了美國頂尖的 AI 模型,然而一家中國競爭對手卻在週日發布了參數量達 2.8 兆的開源權重,暴露了「關機策略」的局限性。
白宮關閉了美國頂尖的 AI 模型,然而一家中國競爭對手卻在週日發布了參數量達 2.8 兆的開源權重,暴露了「關機策略」的局限性。

白宮關閉了美國頂尖的 AI 模型,然而一家中國競爭對手卻在週日發布了參數量達 2.8 兆的開源權重,暴露了「關機策略」的局限性。
白宮關閉了美國頂尖的 AI 模型,卻在同一天看到一家中國競爭對手發布了參數量達 2.8 兆的開源權重,這凸顯了「關機策略」的局限性。
「華盛頓只有一種工具——關機鍵——而且它果斷地使用了,」AE Studio 執行長兼 AI Alignment Foundation 總裁 Judd Rosenblatt 在《華爾街日報》的專欄文章中寫道。「但中國的發布時機就像砲兵一樣精準。」
Kimi K3 在 Arena.ai 的前端程式碼排行榜上獲得 1,679 Elo 積分,領先 Claude Fable 5 的 1,631 分和 GPT-5.6 Sol 的 1,618 分。在 Artificial Analysis Intelligence Index 上,K3 以 57.1 分排名第四,落後於 Fable 5 的 59.9 分和 GPT-5.6 Sol 的 58.9 分。該模型採用稀疏混合專家架構,擁有 896 個子網路,每個 token 啟動其中 16 個,並具備 100 萬 token 的上下文窗口。
此次發布從根本上改變了政策計算方式。一旦權重可供下載,沒有任何政府能夠將其召回。中國商務部正在諮詢阿里巴巴、字節跳動和智譜有關出口管制的問題,這些管制措施可能限制未來權重的下載,而財政部長 Scott Bessent 則威脅要制裁那些從美國模型中提取能力的中國 AI 公司。
K3 獨立的基準測試結果在程式碼生成領域最為強勁,在盲測開發者投票中領先所有測試模型。但速度和可靠性方面則有所落後:Artificial Analysis 測量 K3 每秒約產生 32.6 個 token,而行業中位數為 70.9;同時,中位數首 token 延遲時間達到 161.17 秒,相比之下中位數僅為 2.87 秒。在 AA-Omniscience 基準測試中的幻覺率約為 51%,較其前代 Kimi K2.6 的 39% 有所上升。
白宮於 7 月 22 日指控 Moonshot 蒸餾 Anthropic 的 Fable 模型以建構 K3。財政部長 Bessent 威脅實施制裁,並可能將其列入實體清單。但時間線存在爭議:Fable 5 於 7 月 1 日才開放使用;K3 則於 7 月 15 日至 17 日發布。多位研究人員認為,這段時間間隔太短,不足以對一個新發布的模型進行大規模蒸餾。Anthropic 另於 2 月指控 Moonshot 產生了超過 340 萬次詐欺性的 Claude 互動。
對於評估 K3 的企業而言,API 存取與自託管之間的關鍵區別至關重要。若透過 Moonshot 託管的 API 存取,每一次提示都會傳送至受中國《國家情報法》、《網路安全法》和《資料安全法》管轄的伺服器。若選擇自託管權重——需要約 1.4 TB 的快速記憶體(MXFP4 精度)以及至少 64 個加速器——則推論流量永遠不會到達 Moonshot 的伺服器。
這樣的硬體需求將實際的自託管能力限制在雲端運營商、大型推理服務提供商以及資源充足的機構。對於大多數開發者而言,Moonshot API 或第三方提供商仍是唯一選擇。但對於擁有敏感工作負載、受監管資料或政府合約的企業而言,權重的發布使資料主權的論證變得具體而實際。
由 Nvidia、OpenAI、Meta 和微軟於 7 月 24 日簽署的開源權重公開信,敦促華盛頓不要限制開源權重的 AI 模型。Anthropic 並未簽署。這條分歧線反映了相互競爭的商業利益:那些無論哪個模型勝出都能銷售算力的公司支持開源權重生態系統,而那些銷售專有模型存取權的公司則希望監管機構對可下載的權重保持警惕。
本文僅供資訊參考,不構成投資建議。