主要来源ollama
查看原文事件专题 · 多源确认
Gemma 4 QAT 权重上线 Ollama,内存需求降低
Ollama 宣布 Gemma 4 的量化感知训练(QAT)权重现已可用。这些权重在保持模型质量的同时,显著降低了内存需求。用户可以通过 Ollama 直接运行多个 Gemma 4 变体,包括 e2b、e4b、12B、26B 和 31B 等版本。Google Gemma 团队也在 Hugging Face 上发布了所有 Gemma 4 模型大小及其 drafters 的 QAT 检查点,旨在优化设备端性能。这为在资源受限环境中部署大型语言模型提供了更高效的方案。
当前结论
QAT 权重让 Gemma 4 在更低内存下运行,适合在本地或边缘设备部署大模型的开发者,可以直接用 Ollama 命令体验。
11 个信源67° AI 热度最后更新 2026/6/5 18:32:33
证据链
相关来源 1Google AI Developers
查看原文相关来源 2小互
查看原文相关来源 3marktechpost
查看原文相关来源 4Paul Couvert
查看原文相关来源 5rohanpaul_ai
查看原文相关来源 6Demis Hassabis
查看原文相关来源 7Sundar Pichai
查看原文相关来源 8Decoder
查看原文相关来源 9berryxia
查看原文相关来源 10Philipp Schmid
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。