Google 週二推出三款輕量級 AI 模型,但對延遲的旗艦產品 Gemini 3.5 Pro 何時上市,仍未有更新說明。
Google 週二推出三款輕量級 AI 模型,但對延遲的旗艦產品 Gemini 3.5 Pro 何時上市,仍未有更新說明。

Google 週二推出三款輕量級 AI 模型,但對延遲的旗艦產品 Gemini 3.5 Pro 何時上市,仍未有更新說明。
Google 新版 Gemini 3.6 Flash 的輸出 token 使用量較前一代減少 17%,同時在價格上低於 OpenAI 與 Anthropic 的同級模型,在旗艦產品持續延宕之際,進一步加劇 AI 定價戰。
「我們專注於提供業界最佳的性價比,」一位 Google DeepMind 發言人表示。
Gemini 3.6 Flash 定價為每百萬輸入 token 1.50 美元、每百萬輸出 token 7.50 美元——低於 3.5 Flash 的 9 美元——在 DeepSWE 程式編碼基準測試中得分 49%,高於前一代的 37%;在機器學習研究 MLE Bench 上得分 63.9%,前一版本為 49.7%。該模型的知識截止日期從 2025 年 1 月更新至 2026 年 3 月。Google 同時推出 Gemini 3.5 Flash-Lite,每百萬輸入 token 0.30 美元、每百萬輸出 token 2.50 美元,在 SWE-Bench Pro 上表現超越前代 3 Flash(54.2% 對 49.6%),在 OSWorld-Verified 上也以 74% 勝過 65.1%。
這波新品發布之際,Google 的 Gemini 3.5 Pro——原定於今年 6 月 I/O 開發者大會上亮相——目前仍在合作夥伴測試階段,尚未公布公開上市日期。Alphabet 將於週三發布第二季財報,外界預期執行長 Sundar Pichai 將面臨有關延遲問題的追問。Google 已開始對 Gemini 4 進行預訓練,該公司稱其為「迄今最具野心的預訓練計畫」。
新產品陣容還包括 Gemini 3.5 Flash Cyber,這是一款專門用於偵測與修補軟體漏洞的特殊變體,初期將透過限額試點計畫向政府及可信合作夥伴提供。Google 表示,其 CodeMender 工具利用多個 Flash Cyber 代理,以大規模方式尋找並修復安全問題。
此一定價策略反映了 Google 的押注:成本效率可以彌補其在高階模型發布節奏上的相對緩慢。Artificial Analysis 數據顯示,Gemini Flash 在成本上已低於 OpenAI、Anthropic 及中國競爭對手的同級模型。該公司表示,Gemini 3.6 Flash 每項任務的成本均低於 OpenAI 的 GPT-5.6 Terra Max、Moonshot AI 的 Kimi K3 以及阿里巴巴的 Qwen 3.7 Max。
Gemini 3.5 Pro 的延遲已讓競爭對手搶佔先機。Anthropic 的 Mythos 5 與 Fable 5 模型被美國政府認定威力強大,足以構成國家安全風險;而 OpenAI 在本月稍早推出了 GPT-5.6,此前同樣經歷了政府要求的安檢審查。中國競爭對手同樣勢頭強勁——Moonshot AI 的 Kimi K3 需求過於旺盛,公司因產能限制而限制新訂閱;阿里巴巴則正在預告 Qwen 3.8 Max,稱其整體效能僅次於 Anthropic 的 Fable 5。
對投資人而言,關鍵問題在於 Google 以規模驅動的定價策略能否彌補頂級模型缺席的缺口。Alphabet 目前本益比約為預估盈餘的 22 倍,Pichai 曾表示,企業若將多數 AI 工作負載移至 Gemini 模型,每年可節省逾十億美元。據報導,該公司還正在開發一款專用晶片,旨在將 Gemini 的執行效率提升最多十倍,此為降低 AI 服務成本的廣泛策略之一。
本文僅供資訊參考,不構成投資建議。