Z.ai 的 GLM-5.3 在人工分析智能指數中達到 60 分,與月之暗面的 Kimi K3 持平,且每 token 價格僅約為其一半。
Z.ai 的 GLM-5.3 在人工分析智能指數中達到 60 分,與月之暗面的 Kimi K3 持平,且每 token 價格僅約為其一半。

Z.ai 的 GLM-5.3 在人工分析智能指數中獲得 60 分,與月之暗面的 Kimi K3 持平,並以三分之差緊追 Anthropic 的 Claude Opus 5,同時在價格上低於兩者。這家獨立評估機構於 8 月 18 日發布的評測結果,將這家中國實驗室最新的推理模型排在比較類別中 181 個模型的第八位,遠高於 35 的中位數。
「GLM-5.3 在編碼和智能體能力方面展現了顯著提升,」中銀國際在重申對 Z.AI(02513.HK)買入評級的報告中表示。Z.ai 表示,該模型的進步完全來自於訓練後階段,而非新的預訓練過程。
Z.ai 於 8 月 14 日發布 GLM-5.3,採用與 GLM-5.2 相同的基础模型,並在長時程任務環境中進行了一個月的規模化強化學習。這種方法使 Terminal-Bench 3.0 從 4.6 提升至 28.3,DeepSWE v1.1 從 46.2 提升至 66.9。在 Z.ai 的 API 上,GLM-5.3 每百萬輸入 token 收費 1.40 美元,每百萬輸出 token 收費 4.40 美元,而月之暗面平台上 Kimi K3 的價格分別為 3.00 美元和 15.00 美元。按智能指數每項任務計算,GLM-5.3 為 0.68 美元,Kimi K3 為 0.84 美元,Claude Opus 5 為 2.34 美元。
API 已於 8 月 18 日開放使用,定價與 GLM-5.2 保持一致,該模型已整合至 Z.ai 的 ZCode 編碼平台和 GLM 編碼方案中。模型權重預計將於發布兩周後的 8 月 28 日開源,待安全評估和加固工作完成後進行。Z.AI 股價當日下跌 4.3%,沽空金額為 6.3941 億美元,沽空比率為 5.698%。
與 Kimi K3 的持平是本次最引人注目的比較。Kimi K3 於 7 月 16 日發布,至今仍是人工分析排名中得分最高的開放權重模型,GLM-5.3 現在在分數上與其並列(儘管授權方式不同)。月之暗面於 7 月以按收入分級的授權方式開放了 Kimi K3 的權重;GLM-5.3 目前被列為專有模型,人工分析記錄該模型擁有 7,530 億個參數。
於 7 月 24 日發布的 Claude Opus 5 仍以 63 分領先該指數。GLM-5.3 與領先者之間的三分差距,是快速訓練後循環未能彌合的距離,而前沿模型本身自春季以來也在不斷推進。
成本優勢是兩個 60 分模型之間差異最明顯的地方。GLM-5.3 以三者中最低的每任務成本達到該分數,不過它也是三者中最冗長的模型,在整個評測套件中產生了 1.7 億個輸出 token,而同類中位數僅為 7,200 萬。這種冗長性可能在實際編碼工作負載中抵消部分每 token 的成本節省。
該模型需要啟用思考功能,提供三種努力等級,Z.ai 警告仍以禁用思考方式呼叫該模型的應用程式在遷移完成前將無法正常運作。下周五發布的權重將使 GLM-5.3 與 Kimi K3 並列為該指數 60 分水準的開放權重選項,且每 token 價格僅約為後者的一半。
Z.AI 股價當日下跌 4.3%,正面對開放權重模型日益激烈的競爭。GLM-5.3 下週開源可能加速開發者採用,並強化公司相對於月之暗面、Anthropic 以及 OpenAI GPT-5.6 Sol 的競爭地位——GLM-5.3 目前在指數上已與 GPT-5.6 Sol 持平。中銀國際重申買入評級表明此次拋售可能過度,但與 Claude Opus 5 的三分差距顯示前沿並未停止前進。
本文僅供參考之用,不構成投資建議。