这次 Google 发新模型,大家最等的那款反而继续缺席。
7 月 21 日(美国时间),Google 一口气发布三款模型:新一代主力 Gemini 3.6 Flash、走最低价路线的 Gemini 3.5 Flash-Lite,以及专门为找漏洞、修漏洞而调校的 Gemini 3.5 Flash Cyber。至于 5 月 Google I/O 亮相至今的旗舰 Gemini 3.5 Pro,官方只说「很快会全面开放」,正式上市仍然无期。
3.6 Flash 升级了什么
Flash 是 Gemini 家族的「工作马」档:不是最聪明,但够快、够便宜,为日常大量使用而设。好比茶餐厅的常餐与招牌大菜——招牌菜偶然吃一次,常餐才是一日三餐的主角。大部分人的大部分 AI 用量,其实都落在这一档。
这次升级的实际内容,三个数字:
输出定价由每百万 token 9 美元降至 7.5 美元,便宜约 17%;
在 Artificial Analysis 指数上,完成同样工作的输出 token 用量比上代少 17%(编程基准 DeepSWE 最多少 65%);
两者叠加,同类任务的实际输出成本最多可低约三成——降价之余,它还更省 token。
能力不跌反升:DeepSWE 得分由 37% 升至 49%。可用性方面,3.6 Flash 即日进驻 Gemini app,全员可用;开发者可经 Google AI Studio 与 Android Studio 接入 API。
冷静看:旗舰迟到,工作马先行
值得留意的不是单一模型,而是节奏。7 月以来,GPT-5.6 家族主打入场价,Kimi K3 直接开源免费(我们在《从第 18 到第 1:开源 Kimi K3 压过付费旗舰,然后呢》拆解过),如今 Gemini 3.6 Flash 降价登场——大厂的主战场,已由「谁最聪明」移到「谁够用又便宜」。旗舰仍在路上(Google 称 Gemini 4 已开始 pre-training),但当下斗得最凶的是中价档,因为走量的正是这一档。
对用户,这是实实在在的红利:同一份工作,成本一个月比一个月低。需要提防的只有「最多」两个字——省 17% 是指数上的平均表现,65% 是个别测试的上限,你手上任务实际能省多少,要自己跑过才算数。官方数字供参考,判准永远是你的任务。
对香港与中国用户的实际意义
香港用户这次直接受惠。Gemini 是少数官方支持香港的顶级 AI(2026 年 3 月起正式可用),3.6 Flash 已在 Gemini app 上线——无需任何设定,打开就是新模型,免费档已够日常使用。官方渠道能直接用的,我们一向建议直接用。
中国用户是另一幅风景:Gemini 官方仍不支持中国;Claude、GPT 系列同样不开放。网络以外,还有支付与封号两座山。需要顶级模型的现实做法,是经稳定直连网关按用量使用官方模型——萃灵 Essevin 做的正是这件事:一个账户用多个顶级模型,中国用户支付宝、微信支付即可增值,香港用户转数快、PayMe 同样通行,用多少付多少。
收尾
三个月前,「便宜档」还带点「将就用」的意味;现在它是大厂斗得最凶的战场。与其等一个迟迟不来的旗舰,不如把工作按任务分档:日常走量用 Flash 这类工作马,难题才出动顶级模型。钱花在刀口上,这一波价格战才算真正落到你口袋。
*本文资料截至发稿日(2026 年 7 月 22 日),仅供一般参考,不构成任何建议;第三方产品之功能、价格与政策,以其官方最新公布为准;Essevin 服务详情以官网与 console 实际显示为准。