8月17日
13:15
13:15AI Will@FinanceYF5
精选72°
Scott Gray于2016年加入OpenAI,曾参与稀疏Transformer、Scaling Laws和GPT-3的研发,长期负责底层GPU系统。据Business Insider统计,OpenAI今年已有12位高层离职。这些十年老将的离开比普通高管更难替代。
事件专题

推荐理由:Scott Gray是给OpenAI早期模型搭GPU地基的人,连他都走了,今年走的12个人里属他最可惜。
8月14日
8月13日
23:23
8月6日
01:11
8月5日
16:16
16:16官方一手pandaily@contact@pandaily.com (Pandaily)
野村和花旗在报告中表示,美国即便推出光学模块禁令,对中国厂商的损害也有限。Macquarie将国产芯片公司Biren Technology的目标价上调4.5倍。上调的理由是该公司赢得新的GPU订单,国内AI芯片平均售价随之走高。

推荐理由:野村花旗说美国禁光模块影响有限,麦格理把Biren Technology目标价上调4.5倍,国产算力链预期在变。
7月22日
02:14
02:14Cognition@cognition_labs
精选72°
Cognition宣布Devin Outposts可在NVIDIA Brev上部署。这一集成使Devin能够访问GPU基础设施,用于调试训练运行、检查GPU状态、重现故障,并在实际硬件上验证修复。部署入口位于brev.nvidia.com的launchable页面。该方案面向需要GPU调试的AI工程团队。
事件专题

推荐理由:Cognition把Devin Outposts搬上NVIDIA Brev,让Devin能直接动用GPU来定位训练bug、检查显存状态,不用自己搭环境。
7月14日
07:15
07:15官方账号NVIDIA AI@NVIDIAAI
精选
NVIDIA发布“AI Model Co-Design”系列文章,首篇探讨模型维度与GPU性能的关联。文章指出,调整模型维度(如宽度、深度)能直接影响GPU的计算效率。通过合理设计,可提升系统吞吐量和单用户响应速度。该系列旨在推动模型与硬件的协同优化。
事件专题

推荐理由:NVIDIA新系列讲模型和硬件怎么配合更高效,首篇教你调维度来榨干GPU性能,部署AI服务的人值得一看。
7月7日
22:27
01:11
01:11官方账号NVIDIA AI@NVIDIAAI
精选
在 ICML 2026 上,NVIDIA 的 Nemotron 模型和数据集被 145 篇论文引用。NVIDIA 自身有 74 篇论文被接受,约 2000 篇论文引用了 NVIDIA GPU。这些数据体现了 NVIDIA 在 AI 研究中的基础设施地位。Nemotron 作为开放模型正在成为现代 AI 研究的基础。
事件专题

推荐理由:NVIDIA在ICML 2026上刷了一波存在感:145篇论文用上Nemotron,74篇自家论文入选,还有2000篇靠NVIDIA GPU跑出来的。学术圈地位一览无余。
7月3日
17:28
17:28量子位@衡宇
AI模型利用28个GPU的计算资源,发现了4种人类此前完全未知的超导体。这些新材料在传统方法下从未被预测或合成。该成果将AI在材料科学领域的效率提升到新高度,超越了人类超导体发现100年的历史积累。
推荐理由:朋友,AI又搞大事了!只用28张GPU就发现4种全新超导体,效率比人类100年研究还高。快来看看是什么神奇操作。
7月1日
02:02
02:02官方账号Decoder@Matthias Bastian
据 The Information 报道,OpenAI 将 AI 模型的推理成本降低超过一半。这项优化已应用于 ChatGPT,使得响应 guest 用户所需的 Nvidia GPU 数量有时降至仅几百块。这一调整显著降低了运营成本。
事件专题

推荐理由:OpenAI 给免费用户省了钱,自家推理成本砍半,GPU 数量降到了几百块,效率提了不少。
6月20日
16:43
16:43官方一手pandaily@contact@pandaily.com (Pandaily)
摩尔线程与 SGLang 社区在首次线下见面会上宣布,MUSA 后端已合并入 SGLang 主线。该合并使 SGLang 能够原生支持摩尔线程 GPU,不再依赖 CUDA。此次 Meetup 聚焦中国开源 AI 生态的 GPU 兼容性与性能优化。此举为国内开发者提供了更低门槛的国产 GPU 推理方案。

推荐理由:想用国产GPU跑大模型?摩尔线程和SGLang把MUSA后端合到主线了,以后直接用,不用再折腾CUDA转译。