9月2日,谷歌上线了Gemini 3.8 Flash。官方话术很漂亮——"我们迄今最聪明的主力模型",HLE-Verified 54.9%、Terminal-Bench 2.1 90.8%、DeepSWE v1.1 71%。
但开发者社区的反应是:又一只Flash。
这已经是谷歌四个月里发布的第四个Flash模型。过去六周里更是连发三款。Gemini 3.5 Flash、3.6 Flash、3.7 Flash、3.8 Flash,四个Flash排在桌上。开发者等的那款Pro模型,连影子都没有。
一款meme在X上被转疯了:图里Fable 5.1站在领奖台最高处,GPT 5.6、Kimi 3、Grok 4.6、GLM 5.3分列第二第三档,都戴着奖牌。台下角上,三个Gemini Flash挤在一起鼓掌,配文是讽刺的"Gemini选手处于不同的层次"。
另一张更扎心:一个人拽着脖子上挂着"Gemini"牌子的孩子,硬把他拖向又一场Flash发布会,孩子尖叫着"不!谷歌不要!3.5 Pro怎么办!"这张图被转发了几千次。
问题的根源要回到今年5月。那时的谷歌I/O大会上,桑达尔·皮查伊亲口承诺Gemini 3.5 Pro下个月发布。据在场的人回忆,会场里有人当场叹气。六月过了,七月过了,八月也过了。Pro模型没来,Flash一个接一个。
更扎心的是时间线背后的人事地震:8月5日,德米斯·哈萨比斯卸任DeepMind CEO转任董事长;同一天,老员工杰夫·迪恩确认27年后离开;今年6月诺姆·沙泽尔投奔OpenAI,8月奥里奥尔·维尼亚尔斯也走了。双子座两个联合技术负责人,全部出走。Alphabet市值蒸发约2700亿美元。
在这种背景下看到又一款Flash打着"我们迄今最聪明"的旗号登陆,开发者读出来的是完全相反的故事。
3.8 Flash的定价看起来确实便宜:每百万输入token 0.75美元,输出3.75美元。比GPT-5.6 Sol的5美元/30美元、Claude Fable 5.1的10美元/50美元便宜得多。但问题是,Flash本来就不是和这些顶级模型一个段位的——3.7 Flash在BencLM vibe coding榜单上排第17,Fable和GPT-5.6 Sol都在前十。把一款经济型产品和顶级产品比价格,然后说"看我们的价差多大",这对比本身就是错位的。
更要命的是这个低价有时限:到2026年12月31日。2027年1月1日开始,输入价翻倍到1.50美元,输出价翻倍到7.50美元。所有今天的对比文章都在引用那个不会持续太久的价格。
谷歌也在坦诚承认一个设计取舍:3.8 Flash会"更努力地工作"——遇到复杂任务会跑额外的推理步骤、迭代调用工具。听起来是优点,但翻译成开发者账单就是:每token价格虽然没变,每个任务花的钱可能反而更高,因为模型烧了更多token才到达终点。
这场发布会里唯一被认真讨论的不是Flash主线,而是3.8 Flash Cyber——一款专注漏洞检测和安全补丁的安全变体。Chrome安全团队据说在内部用它生成的合法补丁数,是顶级商用方案2.6倍,虽然参数规模比对手小得多。访问权限被锁在Fairwind Program里,只对经过审查的安全防御方开放。
这是谷歌现在能拿出来的最清晰信号:专业领域、受控分发的AI模型,可能才是这家公司能真正差异化的地方。但开发者社区会不会买这个账,又是另一个问题。
6周3款Flash,行业里没人比谷歌更快。但速度和信任是两套货币,眼下的汇率对谷歌不利。
基准分数将来或许能被独立测评验证。Flash这个层级的定价确实有竞争力。Cyber模型也的确切入了一个真实存在的市场。这些都没争议。
争议的是另一件事:一家承诺6月发Pro、丢了两个Gemini联席负责人、改成连续四款增量Flash的公司,还能不能重新赢得开发者把生产负载押上来的那种信任?
梗图不是问题。梗图是症状。