Google DeepMind 周二正式推出三款全新 Gemini Flash 模型, 全部瞄准“更便宜、更快速”的AI智能体场景,而备受关注的旗舰型号依旧只在合作伙伴内部测试,继续“缺席”公开发布。
要点概览
- 谷歌周二发布 Gemini 3.6 Flash、3.5 Flash‑Lite 以及安全强化版 3.5 Flash Cyber
- 主力型号 3.6 Flash 输出Token消耗较前代最多降低17%
- 备受期待的 Gemini 3.5 Pro 仍在合作伙伴测试中,尚无明确上线时间表
Gemini Flash 产品线加码
谷歌在周二博文中确认将 3.6 Flash 定位为当前的“主力机型”,重点面向代码生成、知识型工作以及多模态任务等高频场景。
三款新品全部归入价格更低的 Flash 系列,侧重速度和高并发能力,而非顶级模型的复杂推理深度。 谷歌表示,新一轮迭代的核心目标是为大规模构建AI智能体的企业客户提升成本效率、响应时延和稳定性。
最新旗舰级 Flash 模型在输出侧最多可减少17%的Token使用,相当于直接压低了推理成本。 谷歌目前将其定价为每百万输入Token 1.50美元、每百万输出Token 7.50美元,低于前代每百万输出Token 9美元的价格, 同时将其知识截止时间更新至2026年3月。
价格更低的 Flash‑Lite 则锁定批量文档处理、智能体搜索等高吞吐场景,在定价上进一步低于“兄长”型号。 第三款 Flash Cyber 则是一只“异类”——该模型内嵌于谷歌的 CodeMender 智能体之中,用于自动扫描并修补软件漏洞。 谷歌在针对 V8 JavaScript 引擎的测试中发现, 它成功标记出55个已确认漏洞。不过,该模型目前仅向政府机构及少数“高度信任”的合作方开放。
延伸阅读: Anthropic曾私下追逐一家估值110亿美元机器人初创公司,否认消息前博弈已上演
Gemini 3.5 Pro一再押后
此次未能登场的内容,与发布本身一样抢眼。谷歌在5月开发者大会上承诺,旗舰模型 3.5 Pro 将于6月问世, 如今却仍停留在合作伙伴测试阶段,未给出明确的上线日期,相比当初公开立下的时间表已明显拖后。
产品负责人 Logan Kilpatrick 在接受采访时表示, 团队“希望尽快”推出 Pro 版本,同时已开启 Gemini 4 有史以来最雄心勃勃的预训练任务。
但竞争对手并未放慢脚步。短短一周时间内,OpenAI、Anthropic 等多家厂商密集发布新模型, Alphabet 股价从上周四至周二午盘已回调近6%。
这种节奏对谷歌而言并不陌生——在高端旗舰反复延期的同时,公司持续依靠更便宜、更快速的 Flash 系列维持在市场上的“存在感”。 早在5月,谷歌还将 3.5 Pro 描述为“几乎准备就绪”,但随着动作更快的对手不断上新,旗舰产品的空档期反而愈发明显。





