主要来源@atomic_chat_hq
查看原文事件专题 · 多源确认
Google Gemma 4 12B实测:接近26B性能,VRAM减半
Google Gemma 4 12B模型在RTX 4090上实测仅需9GB VRAM,生成8.9k tokens,速度80 tok/s,性能接近26B版本。其对比的Gemma 4 26B-A4B使用15GB VRAM,生成6.9k tokens,速度138 tok/s,所有场景胜出。但12B在近半VRAM下表现十分接近,成为16GB笔记本的理想选择。
当前结论
新Gemma 4 12B别看参数小,实测代码能力接近26B版,而且只需要9GB显存,16GB笔记本就能跑。
5 个信源63° AI 热度最后更新 2026/6/18 05:00:37
证据链
相关来源 1arXiv cs.AI
查看原文相关来源 2SuperTechFans
查看原文相关来源 3Philipp Schmid
查看原文相关来源 4vLLM
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。