Google DeepMind周二一口气上线三款全新Gemini Flash模型, 全部瞄准“更便宜、更快捷”的AI智能体应用场景,而外界最关注的旗舰级产品仍停留在合作伙伴测试阶段,迟迟未能正式发布。
要点概览:
- 谷歌周二推出Gemini 3.6 Flash、3.5 Flash-Lite以及针对安全场景强化的3.5 Flash Cyber。
- 核心主力3.6 Flash输出token用量最多可较前代减少17%。
- 久拖未决的旗舰Gemini 3.5 Pro依旧缺席,仍在合作伙伴测试中。
Gemini Flash产品线加码
谷歌在周二的博文中确认, 将3.6 Flash定位为其在代码生成、知识性工作及多模态任务上的“主力机型”。
三款新品全部归入价格更亲民的Flash档位,优先优化速度与吞吐量,而非顶级模型所强调的深度推理。 谷歌表示,目标是为大规模构建AI智能体的企业客户,在效率、时延和稳定性之间找到平衡。
新的旗舰级Flash模型在输出端token消耗上相比前代最高节省17%,直接摊薄使用成本。 谷歌最新公布的定价为: 每百万输入token收费1.50美元,每百万输出token收费7.50美元,较此前9美元的输出价格有所下调, 同时模型知识截断时间更新至2026年3月。
更低价位的Flash-Lite锁定文档批量处理、检索式与智能体搜索等高频任务场景,在定价上低于3.6 Flash本体。 第三款则更为特化:Flash Cyber用于在谷歌的CodeMender智能体中自动发现并修补软件漏洞。 谷歌在测试V8 JavaScript引擎时发现, 该模型共标记出55个已确认漏洞。目前这款产品仍仅向政府机构及少数“可信合作伙伴”开放。
延伸阅读:Anthropic曾追逐一家估值110亿美元的机器人独角兽,直至被公开否认
Gemini 3.5 Pro跳票压力加重
与其说市场关注谷歌推出了什么,不如说更在意它“没有推出什么”。
在今年5月开发者大会上被高调预告、承诺6月发布的旗舰Gemini 3.5 Pro,如今仍滞留在合作伙伴的封闭测试中,
官方没有给出明确上市时间,比台上公布的时间表已经落后数月。
产品负责人Logan Kilpatrick表示, 团队“希望尽快”让Pro落地,并已启动迄今为止最雄心勃勃的Gemini 4预训练任务。
然而竞争对手并未放慢脚步。短短一周内,OpenAI、Anthropic等陆续上新模型, Alphabet股价在上周四至本周二午盘间累计回调近6%。
对谷歌而言,这一节奏并不陌生:在高端旗舰一再延期的同时,公司不断倚重更便宜、更快速的Flash系列维持市场存在感。 早在5月,谷歌就曾把3.5 Pro包装成“几乎准备就绪”的产品,如今旗舰缺口却越拉越大, 而动作更快的对手还在源源不断发新。





