谷歌最近搞了个大动作。
他们正在研发一款内部代号叫"Frozen v2"的服务器芯片,专门用来跑Gemini模型。最狠的一点是:谷歌工程师直接把Gemini的部分架构永久嵌入了芯片里,不再需要把数据来回传输到别的地方处理。
效果怎么样?官方数字是:跟最新的TPU(张量处理器)相比,Frozen芯片在同等功耗下,Token处理能力提升了6到10倍。
这个数字什么概念?简单说就是:以前跑一个AI问题要费老大劲,现在同样一度电,能多处理将近10倍的工作量。对数据中心来说,这意味着要么性能暴涨,要么电费暴跌——或者两者同时发生。
消息一出来,谷歌股价立刻往上窜。美股早盘,谷歌A(GOOGL)一度涨了3.7%,谷歌C(GOOG)更高,涨了约3.9%。市场对这个消息明显很买账。
谷歌为什么要这么做?答案还是老问题:效率。AI模型越来越大,每次回答用户问题都需要大量计算和数据传输。Frozen v2的思路是把模型"刻"进硬件里,让芯片生来就懂Gemini怎么工作,少走弯路,省能源。
这其实代表了AI芯片发展的一个新方向——不再只是堆算力,而是让硬件和模型更深度地绑定。谷歌不是第一个想到这招的,但显然是目前走得最激进的之一。
对普通用户来说,这意味着以后问Gemini问题,响应可能更快、更便宜。对竞争对手来说,这又是一个必须追赶的目标。
AI芯片战,才刚热身。
正文完