Google为Gemini定制芯片Frozen v2,能效6-10倍

据报道,Google 在做一张专给 Gemini 用的芯片,内部叫 Frozen v2。 简单说:…

精选理由

Google为Gemini专门做了芯片Frozen v2,能效是TPU的6-10倍,2028年上线。把部分计算固化到硅片,思路挺实用。

AI 摘要

据内部报道,Google正在开发一款名为Frozen v2的专用芯片,专为Gemini模型推理设计。该芯片通过将部分模型架构和计算流程固化到硅片中,减少运行时判断和数据搬运,权重可更换。内部估计其单位功耗下的Token生成数量可达最新自研AI芯片的6-10倍。Frozen v2不替代TPU,预计2028年上线。背景是Google算力紧张,SEC文件显示其与SpaceX签署了约11万张Nvidia GPU的合同,月费约9.2亿美元。

原文 · 岚叔

据报道,Google 在做一张专给 Gemini 用的芯片,内部叫 Frozen v2。 简单说:…

据报道,Google 在做一张专给 Gemini 用的芯片,内部叫 Frozen v2。

简单说:把模型里一部分架构和跑法直接焊进硅片,少做一些运行时判断,少搬一点数据;权重还能换。他们自己估,单位功耗吐出的 Token,有机会到最新自研 AI 芯片的 6–10 倍。注意,这是内部数,测试条件和对比基线都没公开。

这东西不替代 TPU,主要是扛 Gemini 推理。最早 2028上线。

为啥急着做?算力真紧。SEC 文件里写过,Google 跟 SpaceX 签了大概 11 万张 Nvidia GPU 的算力合同,从 2026 年 10 月起,一个月约 9.2 亿美元。

Frozen 其实是在押注:未来几代 Gemini 的核心架构和计算方式保持相对稳定。押对了,同样的电可以生成更多 Token、服务更多请求;如果 Gemini 底层大改,这颗芯片的适配范围和能效优势就会缩水,严重时可能刚量产就失去价值。

堆卡当然还在继续。但下一层比的,已经是每度电能吐多少 Token。

Google为Gemini定制芯片Frozen v2,能效6-10倍 · AI 热点