事件专题 ·多源确认

Cognition 实测 NVIDIA Vera Rubin NVL72:推理吞吐达 GB200 的 4.8 倍

Cognition 在智能体编程这种长上下文、高并发的负载下,对比了 NVIDIA Vera Rubin NVL72 与自家 GB200 NVL72 基线。结果显示 Vera Rubin NVL72 推理总 token 吞吐量最高达 4.8 倍,RL 的输出 token 吞吐量达 3.8 倍。测试聚焦于编码智能体场景的实际推理与强化学习性能。

当前结论

Cognition 拿 Vera Rubin NVL72 和自己的 GB200 对比,智能体编程场景下推理吞吐直接到 4.8 倍,做推理部署的可以看看数据。

11 个信源72° AI 热度最后更新 2026/10/9 22:04:06

证据链

11 个信源
相关来源 1LMSYS Org (SGLang)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。