事件专题 · 官方一手

Google DeepMind 发布 Gemma 4 QAT 检查点:Q4_0 和新移动格式降低内存

Google DeepMind 推出 Gemma 4 的 QAT(量化感知训练)检查点,包含 Q4_0 格式(4-bit 量化)和新开发的移动格式。与 BF16 版本相比,Q4_0 可将模型内存占用降低约 75%,而移动格式进一步优化至适合手机等设备。这些检查点面向边缘计算场景,平衡了精度和推理速度。

当前结论

Gemma 4 量化版来了,内存省 75%

11 个信源0° AI 热度最后更新 2026/6/5 18:59:38

证据链

相关来源 3Google AI Developers
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情