主要来源IT之家
查看原文事件专题 · 多源确认
谷歌推出 DiffusionGemma 文本扩散模型,本地推理速度提升 4 倍
谷歌发布 DiffusionGemma,一种基于文本扩散机制的开源 AI 模型,在本地推理速度上比传统自回归模型快 4 倍。该模型通过并行处理所有 token 并逐步去噪生成输出,避免了自回归模型在低带宽环境下的计算浪费。在单块 H100 GPU 上可达每秒 1000 token,DGX Station 上达每秒 2000 token。代码生成和数学推理能力出色,但科学推理等部分基准仍有短板。模型采用 Apache 2.0 开源,可从 Hugging Face 下载。
当前结论
本地 AI 推理终于有了速度突破——DiffusionGemma 让低带宽设备也能高效运行,做边缘部署或本地应用的开发者可以直接从 Hugging Face 下载试试。
7 个信源72° AI 热度最后更新 2026/6/10 22:53:45
证据链
相关来源 1rohanpaul_ai
查看原文相关来源 2NVIDIA AI
查看原文相关来源 3Decoder
查看原文相关来源 4小互
查看原文相关来源 5shao__meng
查看原文相关来源 6marktechpost
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。