8月25日
20:33
20:33官方账号Decoder@Maximilian Schreiner
精选
Nvidia 的 Groq 3 LPX 推理芯片进入量产,Gemma 4 31B 上每秒处理 3,400 个 token,是 Cerebras 的四倍。但需要至少 64 个加速器,而 Cerebras 只需一个或两个,架构在大 MoE 模型上的扩展性仍待定。
事件专题

推荐理由:Nvidia 的 Groq 3 LPX 芯片在性能上超越了 Cerebras,但需要更多加速器,了解其扩展性如何。
08:58
08:58IT之家博客/媒体
精选72°
英伟达宣布Groq 3 LPX机架全面量产,预计今年晚些时候上线。该机架集成500MB高速SRAM,由三星制造,英伟达GPU由台积电生产。Groq 3 LPX机架每秒可处理3400个Token,与Vera中央处理器和Rubin图形处理器一起部署在Nebius平台。

推荐理由:英伟达推出Groq 3 LPX机架,性能强大,适用于编程场景,与Vera Rubin和Rubin图形处理器协同工作,是低延迟推理领域的有力竞争者。