行业精选73°

英伟达重启Rubin CPX推理芯片项目

消息称英伟达重启推理预填充优化芯片 Rubin CPX 项目,设计大幅调整

精选理由

英伟达重启并大幅调整Rubin CPX推理芯片,专为处理AI推理中超过50%的KV Cache负载设计,2027年量产。

AI 摘要

英伟达已重启AI推理预填充加速GPU项目Rubin CPX,设计大幅调整。新Rubin CPX拥有接近标准Rubin GPU的算力,预填充性能进一步提升,单体功耗2300W,配备168GB HBM4内存。新项目预计2027Q1开始生产,采用1:1配对与标准Rubin部署。新Rubin CPX计算托盘具备1.34TB HBM内存,可满足大多数长上下文预填充需求。

原文 · IT之家

消息称英伟达重启推理预填充优化芯片 Rubin CPX 项目,设计大幅调整

IT之家 9 月 1 日消息,分析师郭明錤昨日表示,其最新产业调查显示 NVIDIA(英伟达)已重启人工智能推理预填充加速 GPU "Rubin CPX" 项目 ,不过其设计得到了大幅度的调整,预计 2027Q1 开始生产。 在芯片级别, 新 Rubin CPX 拥有接近标准 Rubin GPU 的算力 , 预填充性能进一步提升 ,单体最高功耗同为 2300W, 配备 168GB HBM4 内存 (IT之家注:旧 Rubin CPX 为 128GB GDDR7,168GB 或指向 7×24GB 设计)。 来到托盘与机架级别,8 颗新 Rubin CPX 构成 1 个计算托盘;8 个计算托盘构成 1 个机架模组,内部以 Spectrum-6 全铜以太网横向扩展 (Scale-out);新 Rubin CPX 采用独立的 MGX ETL 机架,每个机架包含 1~4 组机架模组,机架模组间横向扩展则是 Spectrum-6 + OSFP 光学方案。 而在系统层面, NVIDIA 建议 Rubin CPX 与标准 Rubin 按 1:1 配对 ,Rubin CPX ETL 机架与 Vera Rubin NVL72 机架间采用基于以太网的 RDMA 连接。 这位分析师评论称,目前的 AI 推理工作量中超过 50% 来自处理输入并建立相应的 KV Cache,新 Rubin CPX 能以更具弹性的部署方式与更低成本承接预填充负载;新 Rubin CPX 计算托盘具备 1.34TB HBM 内存,足以满足大多数长上下文预填充与 KV Cache 建立需求。