#GPU
共 111 条 · 7 天 15 条 · 30 天 39 条
信息流里打上「GPU」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月10日
10月9日
Meta 推出 KernelAgent:多智能体自动优化 Triton GPU 内核
Meta 要在 PyTorch 大会上讲 KernelAgent,用多智能体自动写 Triton 内核,100 个任务上比 torch.compile 快 1.56 倍,写算子的人可以看看。
10月7日
SemiAnalysis 的 Oliver Kennon:GPU 定价不能只看算力
SemiAnalysis 的 Oliver Kennon 讲了个容易被忽略的点:同样一块 GPU,部署运维水平不同产出差很多,算力定价不能只看硬件。
10月6日
行业09:17
高盛上调台积电目标价至 3300 新台币,维持买入评级高盛把台积电目标价提到 3300 新台币,理由很具体:AI 智能体把 CPU 需求也带起来了,2026 年营收预计涨 42%,想看芯片代工景气度的不妨读读。
IT之家原文
10月5日
10月4日
Cerebras CEO 解释晶圆级架构为何推理比 GPU 快 2500 倍
Cerebras 的 CEO 亲自讲清楚自家芯片为什么比 GPU 快 2500 倍,关键就在权重存在 SRAM 而不是 HBM,听完就懂。
10月2日
10月1日
9月30日
NVIDIA Vera Rubin NVL72 登陆 CoreWeave 平台
CoreWeave 推出 NVIDIA 最新 Vera Rubin NVL72,Cognition 已用它运行 Devin,性能提升近 5 倍。
9月29日
9月26日
9月25日
9月24日
9月23日
9月18日
苹果 M5 Ultra 款 Mac Studio 性能再曝:Metal GPU 跑分较 M3 Ultra 快 56.2%
苹果新 Mac Studio 的 Metal GPU 跑分数据出来了,比 M3 Ultra 快 56%,对想买新 Mac 的朋友有参考价值。
IT之家原文
9月17日
9月15日
DeepSeek-V4-Flash 在 AMD GPU 上实现 74.5 tok/s 解码性能
DeepSeek 的工程师们优化了他们的 V4-Flash 模型,让它跑在 AMD 的 GPU 上更快了,解码速度提升明显。
9月11日
研究LLM训练的电力弹性特性,提出Power Flexibility Index(PFI)指标
这是关于如何让AI训练更节能的研究,作者通过大量实验数据,提出了一个叫PFI的指标,能帮助在功率受限时优化训练效率,挺实用的。
9月9日