主要来源marktechpost
查看原文事件专题 · 官方一手
Google DeepMind 发布 Gemma 4 QAT 检查点:Q4_0 和新移动格式降低内存
Google DeepMind 推出 Gemma 4 的 QAT(量化感知训练)检查点,包含 Q4_0 格式(4-bit 量化)和新开发的移动格式。与 BF16 版本相比,Q4_0 可将模型内存占用降低约 75%,而移动格式进一步优化至适合手机等设备。这些检查点面向边缘计算场景,平衡了精度和推理速度。
当前结论
Gemma 4 量化版来了,内存省 75%
11 个信源0° AI 热度最后更新 2026/6/5 18:59:38
证据链
相关来源 1Decoder
查看原文相关来源 2小互
查看原文相关来源 3Google AI Developers
查看原文相关来源 4ollama
查看原文相关来源 5Paul Couvert
查看原文相关来源 6rohanpaul_ai
查看原文相关来源 7Sundar Pichai
查看原文相关来源 8berryxia
查看原文相关来源 9Philipp Schmid
查看原文相关来源 10AI Breakfast
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。