Google DeepMind 週二再擴大 Gemini Flash 產品線,一口氣推出三款新模型,鎖定希望以更低成本、更高速度部署 AI 代理人的企業客戶。不過,外界關注已久的旗艦級 Gemini 3.5 Pro 依舊只在合作夥伴間封測,正式上線時程再度落空。
重點整理
- Google 週二發表 Gemini 3.6 Flash、3.5 Flash-Lite,以及強化資安用途的 3.5 Flash Cyber 三款模型。
- 主力型號 3.6 Flash 相較前代,輸出 token 使用量最多可降低 17%。
- 先前高調預告的 Gemini 3.5 Pro 仍停留在合作夥伴測試階段,未給出明確上線時間。
Gemini Flash 產品線再擴大
Google 在週二貼文中證實這三款新模型,並將 3.6 Flash 定位為旗下處理程式開發、知識型工作與多模態任務的「主力工作馬」。
三款新品都屬於相對平價的 Flash 階層,優先強調推論速度與高並發量,而非頂級模型那種深度推理能力。Google 表示,這一波更新的核心目標,是替大規模建置 AI 代理人的客戶,優化效率、延遲與穩定性。
最新的旗艦級 Flash 模型,在輸出端 token 使用量最多可比前一代減少 17%,直接壓低推論成本。Google 目前訂價為每百萬輸入 token 1.50 美元、每百萬輸出 token 7.50 美元,低於前代每百萬輸出 token 9 美元的水準,並將知識截止時間更新至 2026 年 3 月。
更便宜的 Flash-Lite 則鎖定大量文檔處理、代理式搜尋等高吞吐量工作,在價格上也壓在 3.6 Flash 之下。第三款則屬於特殊用途:Flash Cyber 內建在 Google 的 CodeMender 代理人中,用來掃描並修補軟體漏洞。Google 在測試 V8 JavaScript 引擎時發現,該模型成功標記出 55 個經確認的安全弱點,不過目前僅開放給政府與特定信任夥伴使用。
延伸閱讀:Anthropic 傳曾洽談收購 110 億美元機器人新創,否認聲明前內情曝光
Gemini 3.5 Pro 一再延後 壓力漸增
這次發表「缺席」的產品,受到的關注不下於真正上線的模型。Google 在 5 月開發者大會上曾承諾,旗艦級 Gemini 3.5 Pro 將於 6 月登場,如今卻仍停留在合作夥伴內測階段,沒有新的正式上市時間表,與當初公開宣示的時程出現明顯落差。
產品負責人 Logan Kilpatrick 在受訪時表示,團隊仍希望能儘快推出 Pro 版,並已啟動迄今規模最大、最具野心的 Gemini 4 預訓練作業。
但競爭對手並未放慢腳步。短短一週內,OpenAI、Anthropic 等陸續釋出新模型,市場對 Google 母公司 Alphabet 的耐心也在消耗。從上週四到本週二午盤為止,Alphabet 股價一度下挫近 6%。
外界對這種節奏並不陌生:當高階旗艦一再延宕,Google 便持續推陳出新較便宜、速度更快的 Flash 系列,以維持市場存在感。今年 5 月,Google 還曾對外宣稱 3.5 Pro 已接近量產邊緣,如今旗艦產品與競品之間的落差卻愈拉愈大,而對手仍持續以更快節奏推出新一代模型。





