9月2号,谷歌悄悄上线了Gemini 3.8 Flash。这是4个月里的第4个Flash版本,也是6周内的第3个。
同一天,X上一张梗图传疯了。画面里,三个Gemini Flash模型挤在最底层的领奖台上,上面的位置站着Fable 5.1、GPT 5.6、Kimi 3——它们都戴着奖牌。
谷歌说这是"我们迄今最聪明的主力模型"。开发者们用脚投票:还有人转发了一个"Press X to Doubt"的梗,配文是"我记得这个模型去年就有了"。
更扎心的是另一张图:谷歌拽着一个写着Gemini的小男孩往Flash发布会的方向拖,小男孩尖叫着——"不!谷歌不!3.5 Pro呢!"
106天,4个Flash,Pro在哪里
这事的起点是今年5月的谷歌I/O。桑达尔·皮查伊在台上宣布Gemini 3.5 Pro即将发布,台下的开发者们发出了一阵嘘声——他们听这种承诺听得太多了。
6月,没发。
7月,没发。
8月,发的还是Flash。
3.5 Flash、3.6 Flash、3.7 Flash、3.8 Flash——四个版本一路更迭,Pro始终不见踪影。SemiAnalysis八月份发了一份报告,结论很直接:3.5 Pro已经被谷歌内部悄悄砍掉了。Android Authority独立验证了这个消息。产品负责人洛根·基尔帕特里克站出来说报告"流于表面",但谷歌至今没有给出Pro的发布日期。
用户的不信任正在累积。X上一条高赞评论写着:"你们这么有钱,怎么能把游戏玩得这么烂?"
DeepMind的高管在出逃
模型出得慢不是最致命的。最致命的是人没了。
8月5日,德米斯·哈萨比斯卸任DeepMind CEO,转任董事长。同一天,在谷歌干了27年的老将杰夫·迪恩确认离开。Gemini的两位联合技术负责人双双出走,加上诺亚姆·沙泽尔——整个Gemini 1.0的核心创始团队已经走得七零八落。
就在这个节骨眼上,谷歌还在以6周3个版本的节奏往前推Flash。速度是有了,信任没了。
价格是真的香,但有截止日期
抛开情绪,回到真金白银:3.8 Flash每百万token输入0.75美元,输出3.75美元。GPT-5.6 Sol是5美元和30美元,克劳德Fable 5.1是10美元和50美元。差距是真的大。
但便宜有个时间窗口。
(1) 0.75美元/3.75美元的促销价只撑到2026年12月31日
(2) 2027年1月1日,输入价直接翻倍到1.50美元,输出价翻倍到7.50美元
(3) 上下文缓存价格也跟着翻倍
(4) 谷歌整个Flash 3.x系列都套用这个时间表,新模型没重置计时器
如果你现在在3.8 Flash上跑生产任务,跨年夜那天你的账单会自动变成两倍。
另外两件事值得提一下
第一,3.8 Flash不是新基础模型。它的模型卡直接链回3.7 Flash的训练和架构细节。谷歌给的是一次调优,不是架构革命。
第二,3.8 Flash Cyber这个安全专用版值得单独说。Chrome安全团队在内部用它,发现它生成的安全洞察数量是上一代3.5 Flash Cyber的2.6倍。但这玩意儿不进公开市场,只通过Fairwind Program给经过审核的安全研究员用。
这是谷歌第一次用"专用模型+受控分发"的玩法做产品,信号很明确:以后真正值钱的AI模型,可能走的是另一条路。
跑得最快的厂商,也可能是最缺信任的
6周3个版本的速度,全行业没人能做到。问题在于,速度和信任是两套货币,当下的汇率对谷歌不利。
基准测试可能很扎实,价格也确实有竞争力,Cyber版的安全定位也很精准——这些都没争议。有争议的是:一家承诺6月发Pro、丢了两个核心负责人、发了4个增量版本的公司,还能不能让开发者把核心业务压在它的平台上。
梗图不会消失。
Gemini 4已经在预训练中了。等真正能在前沿和Fable扳手腕的Pro版出来之前,每一个Flash发布都会落在同样的逆风里。
你在用Gemini的哪个版本?Flash系列的快速迭代,对你是机会还是坑?