AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

推理加速器

共 3 条相关 AI 资讯
8月19日
11:48
11:48IT之家(博客/媒体)
精选
Cerebras推出新一代芯片WSE-3 Turbo和基于该芯片的CS-4系统,与上代CS-3相比带来10倍词元容量和2倍速度。WSE-3 Turbo集成90万个核心和44GB SRAM片上缓存,其FP16稀疏AI算力、内存带宽、片上互联带宽、I/O带宽均实现翻倍。CS-4系统在OpenAI GPT-OSS模型上拥有4465 Token/s的词元交付速度,是GPU方案的30倍,较CS-3提升93%。对于超高参数模型,CS-4的2μs低延迟晶圆间互连能在10T规模上实现超1000 Token/s的词元输出。
AI产品CerebrasWSE-3 TurboCS-4
事件专题

推荐理由:Cerebras新推WSE-3 Turbo芯片和CS-4系统,词元容量提升10倍,速度是GPU方案的30倍。
原文
6月25日
09:18
09:18IT之家(博客/媒体)
精选
高通在投资者日宣布Dragonfly数据中心解决方案,包含HBC架构、C1000 CPU和AI300推理加速器。HBC采用分离式设计,通过TSV堆叠LPDDR,其AI250加速器单卡内存读写速率达133TB/s,有效带宽是AI200的18倍。C1000 CPU支持250+个Oryon核心,频率超5GHz,能效可达竞品2倍以上,2028年上市。AI300基于HBC Gen2,单卡每W内存带宽较当前GPU提升4-8倍,预计2028年送样。
AI产品QualcommDragonflyC1000

推荐理由:高通推出数据中心专用CPU和AI加速器,C1000有250核5GHz,AI300带宽飞跃,2028年见真章,关注硬件升级的朋友别错过。
原文
5月28日
09:43
09:43IT之家(博客/媒体)
精选
韩国 AI 芯片企业 FuriosaAI 宣布与博通合作开发第三代 AI 推理加速器,采用 2nm 制程、HBM4 内存和博通 SUE 以太网互连技术。该芯片基于 FuriosaAI 自研的 TCP 架构,专注于高带宽数据传输和大规模张量运算,而非管理细线程。博通认为推理性能越来越依赖数据重用和通信效率,而非单纯的计算能力。产品目标 2028 年上半年出样,以机架级系统形式出货。
AI产品AI芯片推理加速器2nm制程

推荐理由:FuriosaAI 的 TCP 架构和博通的互连技术直击大规模 AI 推理的通信瓶颈,做数据中心或 AI 基础设施的团队值得关注,这可能是 2028 年推理加速的新方向。
原文
精选全部日报登录