Google DeepMind 週二一次推出三款全新 Gemini Flash 模型, 全數鎖定「AI 代理」(AI agents)場景,訴求更便宜、更快速, 但備受市場期待的旗艦級模型,則仍卡在合作夥伴測試,遲遲未正式亮相。
重點整理
- Google 週二發布 Gemini 3.6 Flash、3.5 Flash-Lite,以及主打資安場景的 3.5 Flash Cyber。
- 新一代主力 3.6 Flash 輸出 Token 使用量最高可較前代減少 17%。
- 市場關注的 Gemini 3.5 Pro 依舊缺席,仍在合作夥伴測試中,未給出明確上市時程。
Gemini Flash 產品線再擴張
Google 在週二的部落格文章中證實新增三款模型, 並將 Gemini 3.6 Flash 定調為主力工作模型,鎖定程式開發、知識型工作與多模態任務等應用。
三款新品皆歸入相對平價的 Flash 等級,設計重點在於「速度+高吞吐量」,而非追求頂規模型的深度推理能力。 Google 表示,新系列主要為大規模建置 AI 代理的企業客戶,強化效能效率、延遲表現與服務穩定性。
此次的旗艦級 Flash 模型,相較前代最高可減少約 17% 的輸出 Token 使用量,直接壓低推論成本。 Google 目前訂價為: 每百萬個輸入 Token 1.50 美元、每百萬個輸出 Token 7.50 美元, 低於前一代每百萬輸出 Token 9 美元的水準,同時將知識截斷時間(knowledge cutoff)更新至 2026 年 3 月。
相對更輕量的 Flash-Lite 則鎖定文檔批次處理、海量檢索與「代理式搜尋」等高流量任務, 價位與定位皆低於 3.6 Flash,作為成本更敏感場景的選項。
第三款 3.5 Flash Cyber 則屬於異類,專為資安攻防而設計, 用於 Google 自家 CodeMender 代理中,協助掃描與修補程式漏洞。 Google 在測試 V8 JavaScript 引擎時發現, 該模型共標記出 55 個經確認的安全弱點。 不過,這款資安模型目前僅向政府單位及特定信任夥伴開放,尚未全面商用。
延伸閱讀:Anthropic 曾追價洽談一間 110 億美元機器人新創,否認聲明曝光後案情逆轉
Gemini 3.5 Pro 一再延後 壓力漸增
此次發表會中「缺席的產品」,受到的關注並不亞於實際推出的新品。 Google 在 5 月開發者大會上承諾,旗艦級 Gemini 3.5 Pro 將在 6 月正式登場, 但如今仍停留在合作夥伴測試階段,沒有公布具體上市日期, 與兩個月前台上宣示的時程,出現明顯落差。
產品負責人 Logan Kilpatrick 在受訪時表示, 團隊「希望能儘快」讓 Pro 上線, 並透露已經啟動 Gemini 4 迄今規模最大的一輪前訓練計畫,為下一代旗艦鋪路。
然而競爭對手並未放慢腳步。 在短短一週內,OpenAI、Anthropic 等多家業者陸續推出新模型, 市場對 Google 在高階模型賽局中的節奏產生疑慮。 Alphabet 股價自上週四至本週二午盤為止,已回落近 6%。
對 Google 而言,這樣的節奏並非首次出現: 近來頻頻以價格更低、速度更快的 Flash 系列維持產品能見度, 但真正頂規的旗艦級模型卻一再延後。 早在 5 月,Google 便將 3.5 Pro 描述為「幾乎準備就緒」, 然而兩個月過去,與同業的旗艦差距不減反增,競爭壓力持續累積。





