106天发了4个Flash,谷歌Gemini的Pro去哪了

3次阅读

9月2号,谷歌悄悄上线了Gemini 3.8 Flash。这是4个月里的第4个Flash版本,也是6周内的第3个。

同一天,X上一张梗图传疯了。画面里,三个Gemini Flash模型挤在最底层的领奖台上,上面的位置站着Fable 5.1、GPT 5.6、Kimi 3——它们都戴着奖牌。

谷歌说这是"我们迄今最聪明的主力模型"。开发者们用脚投票:还有人转发了一个"Press X to Doubt"的梗,配文是"我记得这个模型去年就有了"。

更扎心的是另一张图:谷歌拽着一个写着Gemini的小男孩往Flash发布会的方向拖,小男孩尖叫着——"不!谷歌不!3.5 Pro呢!"

106天,4个Flash,Pro在哪里

这事的起点是今年5月的谷歌I/O。桑达尔·皮查伊在台上宣布Gemini 3.5 Pro即将发布,台下的开发者们发出了一阵嘘声——他们听这种承诺听得太多了。

6月,没发。
7月,没发。
8月,发的还是Flash。

3.5 Flash、3.6 Flash、3.7 Flash、3.8 Flash——四个版本一路更迭,Pro始终不见踪影。SemiAnalysis八月份发了一份报告,结论很直接:3.5 Pro已经被谷歌内部悄悄砍掉了。Android Authority独立验证了这个消息。产品负责人洛根·基尔帕特里克站出来说报告"流于表面",但谷歌至今没有给出Pro的发布日期。

用户的不信任正在累积。X上一条高赞评论写着:"你们这么有钱,怎么能把游戏玩得这么烂?"

DeepMind的高管在出逃

模型出得慢不是最致命的。最致命的是人没了。

8月5日,德米斯·哈萨比斯卸任DeepMind CEO,转任董事长。同一天,在谷歌干了27年的老将杰夫·迪恩确认离开。Gemini的两位联合技术负责人双双出走,加上诺亚姆·沙泽尔——整个Gemini 1.0的核心创始团队已经走得七零八落。

就在这个节骨眼上,谷歌还在以6周3个版本的节奏往前推Flash。速度是有了,信任没了。

价格是真的香,但有截止日期

抛开情绪,回到真金白银:3.8 Flash每百万token输入0.75美元,输出3.75美元。GPT-5.6 Sol是5美元和30美元,克劳德Fable 5.1是10美元和50美元。差距是真的大。

但便宜有个时间窗口。

(1) 0.75美元/3.75美元的促销价只撑到2026年12月31日
(2) 2027年1月1日,输入价直接翻倍到1.50美元,输出价翻倍到7.50美元
(3) 上下文缓存价格也跟着翻倍
(4) 谷歌整个Flash 3.x系列都套用这个时间表,新模型没重置计时器

如果你现在在3.8 Flash上跑生产任务,跨年夜那天你的账单会自动变成两倍。

另外两件事值得提一下

第一,3.8 Flash不是新基础模型。它的模型卡直接链回3.7 Flash的训练和架构细节。谷歌给的是一次调优,不是架构革命。

第二,3.8 Flash Cyber这个安全专用版值得单独说。Chrome安全团队在内部用它,发现它生成的安全洞察数量是上一代3.5 Flash Cyber的2.6倍。但这玩意儿不进公开市场,只通过Fairwind Program给经过审核的安全研究员用。

这是谷歌第一次用"专用模型+受控分发"的玩法做产品,信号很明确:以后真正值钱的AI模型,可能走的是另一条路。

跑得最快的厂商,也可能是最缺信任的

6周3个版本的速度,全行业没人能做到。问题在于,速度和信任是两套货币,当下的汇率对谷歌不利。

基准测试可能很扎实,价格也确实有竞争力,Cyber版的安全定位也很精准——这些都没争议。有争议的是:一家承诺6月发Pro、丢了两个核心负责人、发了4个增量版本的公司,还能不能让开发者把核心业务压在它的平台上。

梗图不会消失。

Gemini 4已经在预训练中了。等真正能在前沿和Fable扳手腕的Pro版出来之前,每一个Flash发布都会落在同样的逆风里。

你在用Gemini的哪个版本?Flash系列的快速迭代,对你是机会还是坑?

正文完
 0