Google又发新模型了。这次是Gemini 3.7 Flash,距离上一个版本3.6 Flash发布才过去三周。
三周一个版本,这个速度有点离谱。
来看看3.7到底升级了什么。编程能力提升最明显——FrontierCode测试从34.4%跳到43.6%,DeepSWE从49%飙到65.3%。网页开发基准分数从1538升到1588。处理复杂文档的能力翻了一倍多(22%→34%),自动化工作流程执行从17%升到30.4%。
数字看着挺唬人,但Ars Technica泼了盆冷水:这可能更多是"看起来在持续进步"的公关操作,而不是真正的代际跨越。
Google这次急着推新版本,有个背景不能不提:竞争对手在疯狂打价格战。Anthropic的克劳德、OpenAI的GPT系列,还有中国的DeepSeek,价格一个比一个低。Google需要用"高频发布"来证明自己没掉队。
更有意思的是,Google在5月份的I/O大会上承诺的旗舰模型Gemini 3.5 Pro,压根没发布。说好的6月见,现在8月了连影子都没有。
所以3.7 Flash更像是填空题——告诉市场"我们还在跑,没停"。
对普通用户来说,这意味着什么?你现在用的Google AI助手,可能三个月后又要换新一代。AI军备竞赛已经进入"拼手速"阶段,谁发布得快谁有面子。至于实际体验提升多少——反正大部分人感知不到编程测试分数从34到43意味着什么。
真正的竞争不在发布频率,在价格和落地场景。这场仗,才刚开始。
正文完