NVIDIA 与 d-Matrix 合作打造混合算力基础设施

AI 芯片竞合并存:NVIDIA 牵手 d-Matrix 打造混合算力基础设施

精选理由

NVIDIA 和 d-Matrix 搞了个混合算力方案,GPU 负责预填充、专用芯片负责解码,推理 Token 生成速度翻了 10 倍。不是单纯的拼硬件,是真正分工优化。

AI 摘要

NVIDIA 正与 ASIC 初创企业 d-Matrix 合作,将 Hopper/Blackwell GPU 与 d-Matrix 的 Corsair ASIC 结合形成混合算力基础设施。Parasail 通过该组合实现了 10 倍的 Token 生成速率。Corsair 采用台积电 N6 制程 D-IMC 架构,集成计算单元和足量 SRAM 降低数据开销。方案中 GPU 负责推理前端的预填充任务,Corsair 处理延迟敏感的解码任务。

原文 · IT之家

AI 芯片竞合并存:NVIDIA 牵手 d-Matrix 打造混合算力基础设施

IT之家 7 月 8 日消息,据美媒 The Information 当地时间 7 日报道,AI 芯片巨头 NVIDIA(英伟达)正与 ASIC 初创企业 d-Matrix 合作,打造一个结合双方硬件的混合型混合算力基础设施,支持 AI 模型的运行。 IT之家注意到,d-Matrix 在一份美国当地时间今日发布的新闻稿中表示,Neocloud 企业 Parasail 通过将 NVIDIA 的 Hopper / Blackwell GPU 与 d-Matrix 的 Corsair ASIC 相结合, 实现了 10 倍的 Token(词元)生成速率 。 d-Matrix 的 Corsair 采用 D-IMC(数字存内计算)架构,这颗台积电 N6 制程 SoC 将计算单元和足量 SRAM 集成在同一芯片上,降低数据传输带来的开销,并通过片外 LPDDR5 进一步扩展内存容量。 Parasail 将 NVIDIA GPU 用于 AI 推理工作负载前端的计算密集型预填充任务 ;与此同时,拥有大容量 SRAM 的 d-Matrix Corsair 非常适合推理后端的延迟敏感型解码任务 。 d-Matrix 创始人兼首席执行官 Sid Sheth 表示: Parasail 正在印证我们从一开始就坚信的观点:推理的未来是异构的。GPU 和专用推理加速器并非竞争对手,而是相辅相成。通过将 Corsair 与其 NVIDIA 产品线结合使用,Parasail 正在采用一种异构推理方法,旨在优化工作负载的每个阶段。

NVIDIA 与 d-Matrix 合作打造混合算力基础设施 · AI 热点