#AI推理
Szegedy 回应 Tao 和 Gowers 的文章,说 AI 数月内就能猜想和理论化,他还写了篇长文讲自己的判断,可以看看他怎么论证的。
英特尔新推出的Crescent Island加速卡,专为AI推理设计,内存高达480GB,是处理AI工作负载的理想选择,比同类产品内存容量更高。
Marvell 出了新一代 SSD 主控 Bravera SC6,PCIe Gen6 速度比上代翻倍,还能把 AI 推理的 KV Cache 挪到 SSD 上,做存储的可以关注。
宜鼎新内存速度提升 45%,容量最高 128GB,适合跑 AI 推理和计算密集型任务,2026 Q4 送样。
OpenAI研究员认证!AMD和Cerebras合作搞的AI推理方案,延迟低到任务秒完成,每瓦性能提升5倍,搞AI推理的可以看看。
AMD和Cerebras联手搞推理方案,把Helios和晶圆引擎用在推理上,每瓦token吞吐能翻5倍,专治英伟达Groq组合。
俩公司把高吞吐和低延迟硬件凑一块,2026年推云服务。合作消息一出,Cerebras股价涨11%,说明市场很看好。
英伟达 Vera CPU 在智能体 AI 任务上干翻英特尔,延迟 29ms 对 64ms,直接快 2 倍多,搞 AI 推理的得关注。
微软要用 AMD 最新的 Helios 平台(EPYC Venice+MI455X)跑 AI 推理,32TB 显存、2900 PFLOPS 算力,适合大规模推理负载。
Gary Marcus 用数据告诉你,AI 推理价格一年内垮塌到原来的百分之一,中国模型成本只有 Anthropic 的零头,这对整个行业都是改变游戏规则的事。
Rambus 新芯片把 DDR5 内存速度拉到 9600MT/s,比上一代快 20%,AI 和 HPC 场景更有优势。
澜起科技的第二代MRDIMM内存速度达到12800MT/s,比上一代快45%,是普通RDIMM的两倍,专门解决AI推理时的带宽瓶颈,适合关注服务器硬件的朋友。
Groq 刚拿了 6.5 亿美元,转型做 AI 推理云,背后有英伟达的 LPU 技术和团队支持,目标是 2027 年搞定 200MW 算力。