主要来源CoreWeave
查看原文事件专题 ·多源确认
Cognition 实测 NVIDIA Vera Rubin NVL72:推理吞吐达 GB200 的 4.8 倍
Cognition 在智能体编程这种长上下文、高并发的负载下,对比了 NVIDIA Vera Rubin NVL72 与自家 GB200 NVL72 基线。结果显示 Vera Rubin NVL72 推理总 token 吞吐量最高达 4.8 倍,RL 的输出 token 吞吐量达 3.8 倍。测试聚焦于编码智能体场景的实际推理与强化学习性能。
当前结论
Cognition 拿 Vera Rubin NVL72 和自己的 GB200 对比,智能体编程场景下推理吞吐直接到 4.8 倍,做推理部署的可以看看数据。
11 个信源72° AI 热度最后更新 2026/10/9 22:04:06
证据链
11 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。