Google又发新模型了,不是大家苦等的3.5 Pro。
谷歌一口气甩出三款新模型:Gemini 3.6 Flash、Gemini 3.5 Flash-Lite,外加一版叫Cyber的网络安全特 供。
清一色Flash系,主打一个便宜、快、能规模化地跑Agent。
但是!两个月前在Google I/O大会的台上,劈柴哥当着一屋子开发者的面拍胸脯:
再给我们一个月,就把3.5 Pro交给你们。
现在两个月过去了,3.5 Pro依旧没影。
开发者等来的是3.6 Flash的发布公告,以及藏在博客末尾的一句:
Gemini 4已经启动了史上最激进的预训练。

意思是要憋更大的了??
01、Flash三连发
先不说Pro到底怎么了,咱先把刚发这三个新面孔盘一盘。
3.6 Flash,是这三款里最能打的,代码、AI科研、多模态能力均有提升。
编码基准DeepSWE从37%抬到了49%,多模态的OSWorld从78.4%干到83.0%,知识截止时间也一路推到了2026年3月。

按照官方给的数据,3.6 Flash的输出token消耗比上一代3.5 Flash少了17%。
在一些编码场景里这个数字能拉到65%。
也就是说同等任务下推理步骤更少、工具调用更省,而且还降价了。
价格上每百万token输入$1.5,输出$7.5,比3.5 Flash更便宜。

3.5 Flash-Lite,是3.5系列中速度最快、性价比最高的模型。
双A指数显示其每秒可输出350个 token,读一篇上万字的长文可能不到半分钟。
在Agent工作流场景下,性能相较前代Flash-Lite模型实现大幅提升。
成本也是白菜价,输入$0.3/M,输出$2.5/M。
但就这么个低配版,在不少编码和Agent任务上甚至超越了3 Flash(不是Lite)。

至于第三个Cyber,它基于Flash微调,专门干找漏洞、补漏洞的活儿。
而且不向普通人开放,只面向政府和可信伙伴搞限量试点。
“很猛,但我不敢随便给你用”——
怎么有一股熟悉的Anthropic味儿…
但官方数据归官方数据,新模型一出来评价却是一般。

有网友反馈,在真实使用场景里,3.6 Flash的使用成本比GPT-5.6 Sol medium还要高,但智力表现反而更低。

02、3.5 Pro去哪了
尽管谷歌一次性更新多款Flash中端模型试图补齐产品线,但开发者真正期待的旗舰Pro依旧缺席。
把时间线捋一下,5月19号的I/O大会上,Pichai拍胸脯说一个月交付。
结果6月到了,鸽了。
彭博社当时爆过内幕,采访了10名现任和前任员工,说是3.5 Pro因为coding能力不达标被内部压住了。
于是团队紧急在6月底更新训练数据试图补救,结果“令人失望”。
还有传闻是,Google一度推翻基座重头训练,目标7月17号上线,但在最新的公告中,3.5 Pro目前仍然停留在partner testing的状态——
问就是ready了就发。

如果只是Pro在延期,那顶多是个项目管理问题。
但Google却宣布Gemini 4的预训练已经跑起来了??
而且还被官方定性为史上最雄心勃勃的一次。
外界普遍猜测,这背后可能涉及全新的训练架构、更大规模的数据飞轮、甚至多模态能力的代际跃迁。
Gemini 4是不是真的开工咱不知道,只能说Google的命名体系已经彻底乱了。
Nano、Flash、Flash-Lite、Pro、Ultra、Cyber六条产品线同时维护,版本号还各跑各的,Flash干到了3.6,Pro却卡在3.5。
而就在谷歌还很混乱的这两个月里,Anthropic发了Fable 5,xAI发了Grok 4.5,OpenAI迭代了GPT-5.6三个小版本。
Google现役能打的旗舰还是今年2月那款3.1 Pro,旗舰这条线等于断档了大半年。
那么问题来了,3.5 Pro如果再拖几个月,会不会一出生就过时了……








