主要来源Paul Couvert
查看原文事件专题 · 多源确认
Google 发布 Gemma 4 QAT,内存需求降低 3 倍
Google 发布了 Gemma 4 QAT 模型,相比前代内存需求降低 3 倍,使得高性能模型能在本地设备上运行。其中 Gemma 4 E4B 模型性能优于 GPT-4o,仅需 2GB RAM 即可在手机上运行。而 Gemma 4 31B 模型(约 Opus 4 级别)现在可以在笔记本电脑上运行。这标志着本地 AI 部署的重大突破,让更多用户无需依赖云端即可使用强大模型。
当前结论
本地 AI 爱好者终于等到了——Gemma 4 QAT 让旗舰级模型跑在手机和笔记本上,做边缘计算或隐私敏感应用的开发者可以直接试试。
11 个信源88° AI 热度最后更新 2026/6/5 19:02:46
证据链
相关来源 1Google AI Developers
查看原文相关来源 2rohanpaul_ai
查看原文相关来源 3小互
查看原文相关来源 4berryxia
查看原文相关来源 5ollama
查看原文相关来源 6marktechpost
查看原文相关来源 7Sundar Pichai
查看原文相关来源 8Decoder
查看原文相关来源 9Philipp Schmid
查看原文相关来源 10AI Breakfast
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。