6月11日
01:49
01:49Philipp Schmid@_philschmid
78°
DiffusionGemma 是基于 Gemma 4 构建的 26B MoE 扩散语言模型,推理时仅激活 3.8B 参数。它采用并行生成 256-token 块的方式,实现了每秒 1000+ tokens 的生成速度。量化后模型可适配 18 GB VRAM,且采用 Apache 2.0 开源协议。这一架构突破了传统自回归模型的生成瓶颈,为高效文本生成提供了新思路。
事件专题

推荐理由:每秒 1000+ tokens 的生成速度让推理成本大幅降低,做大规模文本生成或实时应用的开发者值得关注,量化后 18GB VRAM 就能跑,门槛很低。
5月21日
08:00
08:00Poe@poe_platform
72°
Google 的最新 Flash 模型 Gemini-3.5-Flash 已在 Poe 平台上线。该模型专为快速、高效的响应设计,在编程、复杂工作流和智能体任务上表现强劲。用户可直接通过 Poe 访问并试用。这标志着 Google 在轻量级高性能模型领域的又一进展,为开发者提供了更便捷的 AI 工具选择。

推荐理由:做编程和智能体开发的团队终于有了一个轻量又高效的选择——Gemini-3.5-Flash 在 Poe 上直接可用,建议立即上手试试响应速度和任务处理能力。