20:33官方账号Decoder@Maximilian Schreiner精选Nvidia 的 Groq 3 LPX 推理芯片进入量产,Gemma 4 31B 上每秒处理 3,400 个 token,是 Cerebras 的四倍。但需要至少 64 个加速器,而 Cerebras 只需一个或两个,架构在大 MoE 模型上的扩展性仍待定。AI模型NvidiaGroq 3 LPXCerebras5 个信源在谈事件专题推荐理由:Nvidia 的 Groq 3 LPX 芯片在性能上超越了 Cerebras,但需要更多加速器,了解其扩展性如何。原文稍后读已读值得跟进有用关注 Nvidia
08:58IT之家(博客/媒体)精选72°英伟达宣布Groq 3 LPX机架全面量产,预计今年晚些时候上线。该机架集成500MB高速SRAM,由三星制造,英伟达GPU由台积电生产。Groq 3 LPX机架每秒可处理3400个Token,与Vera中央处理器和Rubin图形处理器一起部署在Nebius平台。行业英伟达Groq 3 LPX低延迟推理推荐理由:英伟达推出Groq 3 LPX机架,性能强大,适用于编程场景,与Vera Rubin和Rubin图形处理器协同工作,是低延迟推理领域的有力竞争者。原文稍后读已读值得跟进有用关注 英伟达