谷歌 DeepMind 在周二丢出了三款新模型:Gemini 3.6 Flash、3.5 Flash-Lite,以及 3.5 Flash Cyber。光看名字像是在挤牙膏,但这次的重心很明确——不跟你卷参数,卷的是便宜、快、稳。
先说当家花旦 3.6 Flash。谷歌管它叫“主力模型”,在写代码、知识工作和多模态上都有提升,关键是把 token 消耗量砍了最多 17%,比上一代 3.5 Flash 更省钱。3.5 Flash-Lite 则是这个档位里最划算的一个,主打一个“量大管饱还便宜”。
谷歌说,这一波发布的核心,是给那些“大规模部署 AI 智能体”的客户,交付效率、延迟和可靠性。
有一款,专门给搞安全的
三款里最特别的,是 3.5 Flash Cyber。它是为找漏洞、修漏洞专门微调出来的模型,价格也压得不算离谱。但谷歌给它加了道门:这款只面向政府和“可信合作伙伴”,走限量试点,不公开随便用。把安全能力收在门槛后面,既说明了它的分量,也透着谷歌对这类敏感能力的谨慎。
真正的大招,又没来
这次发布的看点,一半在发的东西,一半在没发的。所有人都在等的旗舰 Gemini Pro,这次依然缺席。上一次 Pro 更新还是今年二月。这几个月里,对手可没闲着:OpenAI 出了 GPT-5.5,正在铺 GPT-5.6;Anthropic 连发 Claude Opus 4.8、Claude Sonnet 5,还把前沿的 Fable 5 放开了一部分。发布节奏一对比,压力给到了谷歌这边。
其实谷歌五月就吊过胃口,说 Pro 版“已经在内部用上了,下个月就推”。结果上周彭博社报出来:3.5 Pro 因为达不到内部性能目标,发布被往后拖了。产品负责人 Logan Kilpatrick 周二在 X 上说,3.5 Pro 正在和合作伙伴一起测,“希望很快落地”,顺带还透露团队已经启动了迄今最雄心勃勃的 Gemini 4 预训练。

- Gemini 3.6 Flash:主力模型,token 用量最多降 17%,比 3.5 Flash 更便宜
- Gemini 3.5 Flash-Lite:同档最省,适合高吞吐场景
- Gemini 3.5 Flash Cyber:专攻漏洞挖掘与修复,仅限政府及可信伙伴试点
- 旗舰 Pro 继续缺席,3.5 Pro 因内部目标未达成而延期
所以这一轮,谷歌交出的答卷是“把便宜好用的 Flash 做更便宜更好用”,而真正的王牌 Pro,还在打磨。在对手疯狂刷版本的当下,这种“先发辅料、压着主菜”的节奏,到底是无奈还是策略,可能要等 3.5 Pro 真正落地那天才有答案。
发表回复