2026年夏天標誌著中國開源權重模型不再追趕前沿,而是開始定義前沿的時刻。
2026年夏天標誌著中國開源權重模型不再追趕前沿,而是開始定義前沿的時刻。

月之暗面(Moonshot AI)推出的 Kimi K3,這款擁有2.8兆參數的開源權重模型,在關鍵基準測試上的表現達到或超越了 Anthropic 的 Fable 5,而成本僅約為其一半,徹底抹平了閉源模型的領先優勢。該模型於7月27日在 Hugging Face 上發布後,首24小時內就吸引了約10萬次下載,需求之旺盛甚至導致月之暗面暫時停止了新消費者的註冊。
「開源權重已成為AI開發的主流,」前 Hugging Face 亞太開源計畫負責人王鐵振表示。「模型本身可以是免費的,但運行它所需的整套雲端服務都是收費的。」
Kimi K3 的發布伴隨一波浪潮,包括 DeepSeek V4 Pro 和 V4 Flash、MiniMax H3,以及阿里巴巴的 Qwen3.8-Max——這是阿里巴巴旗艦模型首次以開源權重形式發布。這些模型在推論成本上比閉源 API 低50%至90%,同時在程式編寫、推理和智慧代理任務上達到前沿效能。K3 的技術報告披露了其完整架構,包括移除旋轉位置編碼(RoPE)、採用名為「Kimi Delta Attention」的新型注意力機制,以及三個基礎設施組件:MoonEP、FlashKDA 和 AgentEnv。
此一轉變對 Anthropic 高達1.12兆美元的估值以及 OpenAI 8,480億美元的私募市場估值構成威脅,兩家公司均計劃在未來數月內進行IPO。Alphabet 的股價在 K3 發布後的數日內下跌了10%。輝達(NVIDIA)的黃仁勳以成立「開放與安全AI聯盟」(Open and Safe AI Alliance)作為回應,聯盟共有77個簽署方,意在將基礎設施供應商定位為開源權重部署所產生運算需求的受益者。
AI領域中的「開源」一詞涵蓋了廣泛的光譜。完全開源的模型如 Ai2 的 OLMo 會發布訓練資料、程式碼和檢查點。大多數商業發布屬於「開源權重」——僅公開最終訓練參數。Meta 的 Llama 系列代表的是基本層級:權重和推論程式碼,但不含資料配方或訓練策略。DeepSeek 和 Kimi 則更進一步,在發布權重的同時公開詳細的技術報告和內部工程工具鏈。
授權協議已成為戰場。DeepSeek 將 V3/R1 轉為 MIT 授權,智譜的 GLM 也跟進。阿里巴巴的 Qwen 轉用 Apache 2.0。Kimi K3 推出了一種新的授權模式,對連續12個月營收超過2,000萬美元的 MaaS 供應商和雲端廠商收取費用,而終端用戶應用程式則保持免費。Meta 的 Llama 社群授權仍是最嚴格的,要求逐案商業審查,並禁止使用 Llama 的輸出訓練其他大型模型。
商業邏輯很直接:開源權重是獲取客戶的工具,而非產品本身。收入來自雲端消費、私有部署、後訓練服務和授權費用。阿里雲將 Qwen 與其基礎設施搭配銷售。Thinking Machines 在其開源權重模型 Inkling 之上銷售後訓練服務。月之暗面的年度經常性收入(ARR)已通過 Kimi 訂閱和 API 銷售達到3億美元。
黃仁勳在 X 平台上的首條推文呼籲業界推進美國的開源運動。他組建的聯盟包括輝達、微軟、亞馬遜、谷歌、Palantir 和 Databricks——涵蓋了從模型擴散中獲利的AI技術堆疊的每一層。OpenAI 的 Sam Altman 和谷歌的 Sundar Pichai 罕見地發表了公開支持聲明。唯有 Anthropic 拒絕加入。
Anthropic 的 Dario Amodei 發表聲明,主張前沿模型開源權重會降低惡意使用的門檻,並指出中國實驗室通過產業化規模蒸餾美國閉源模型而取得進展。他建議阻止先進晶片流入中國、打擊蒸餾行為,並要求對所有強大模型進行安全測試。
評論者指出了其中的商業利害關係。在 K3 發布後,Anthropic 的市值下跌了13%——約2,300億美元。該公司於7月20日就使用盜版書籍進行訓練一事,以15億美元和解了一樁版權訴訟,這是AI領域有史以來金額最高的版權和解案。川普政府時期的前AI特使 David Sacks 稱「蒸餾」的説法是「監管俘獲」,並指出 Anthropic 和 OpenAI 長期以來一直主張根據合理使用原則,有權使用所有公開網路內容進行訓練。
這場辯論已重塑企業行為。包括 Cursor 和 Lovable 在內的初創企業已從前沿 API 轉向在自己硬體上運行的開源權重模型,節省了50%至90%的成本,同時在大多數任務上實現了可比的品質。OpenRouter 的數據顯示,目前流向開源權重模型的流量中,有一半來自託管在美國的中國原產模型。
對投資人而言,問題在於開源權重浪潮是擴大整個AI市場,還是蠶食高階市場。Cerebras 執行長 Andrew Feldman 表示「開源模型推出時,晶片股沒有理由下跌」,他引用傑文斯悖論——更便宜的AI會驅動更多使用量,而非更少。晨星分析師 Malik Khan 指出,企業整合到開源權重模型上後,仍需要雲端基礎設施來運行工作負載、儲存資料和管理安全。輝達股價目前約為前瞻本益比35倍,在公司將自身定位為開源權重運算需求的主要受益者之際,股價表現穩健。
接下來的30天將考驗這一趨勢的走向。白宮正面臨8月1日關於前沿模型規則的最後期限,OpenAI 和 Anthropic 正在遊説聯邦政府對最強大的模型進行審查。政府是限制中國開源權重的取得,還是讓市場自行決定,將決定開源權重浪潮是加速推進還是撞上監管之牆。
本文僅供資訊參考,不構成投資建議。