09:46IT之家(博客/媒体)AMD高管称,与英伟达的AI芯片竞争中,开放是重要优势,核心是开源软件ROCm。CEO苏姿丰在财报电话会上表示,ROCm处于转折点,过去一年开源社区贡献量增长10倍。AMD认为这能低成本调用全球数千名工程师的技术贡献,加快AI软件开发,并让自家芯片更适配AI智能体。AMD最新季度营收115亿美元,资本支出约8.08亿美元,同比接近3倍;过去一年AMD股价涨约193%,英伟达约20%。行业AMDNvidiaROCm10 个信源在谈事件专题推荐理由:AMD说自家比英伟达更开放,ROCm开源贡献一年涨10倍,还聊了财报和股价,想了解AI芯片竞争可以看。原文稍后读已读值得跟进有用关注 AMD
09:16IT之家(博客/媒体)AMD 与 Anthropic 宣布多层次战略合作,包括 2GW 的 Instinct MI450 系列 GPU 部署和 50 亿美元战略投资承诺。双方启动多年工程合作,使用 Claude 优化 AMD Instinct GPU 工作负载并加速 ROCm 软件发展。AMD 还将在工程和产品开发团队中广泛采用 Claude。Anthropic 首席计算官表示,与 AMD 合作可确保计算资源并优化 Claude 的训练和服务。行业AMDAnthropicClaude10 个信源在谈事件专题推荐理由:AMD 宣布和 Anthropic 深度绑定,不仅投钱,还要在自家工程里用 Claude 来加速 GPU 和 ROCm 开发。原文稍后读已读值得跟进有用关注 AMD
14:16IT之家(博客/媒体)AMD 在 ROCm 7.14 中新增对 Ryzen AI MAX PRO 400 系列(代号 Gorgon Halo)的支持,涉及三个型号:Ryzen AI Max+ PRO 495、Ryzen AI Max PRO 490 和 Ryzen AI Max PRO 485。ROCm 是 AMD 针对 AI 和高性能计算的开源软件栈,包含驱动、编译工具和数学库。ROCm Systems Profiler 和 Compute Profiler 现已可在该平台运行,其中 Compute Profiler 还增加了与 Strix Halo 和 Strix Point 芯片的兼容层。AI产品AMDROCmRyzen AI MAX PRO 400推荐理由:AMD 更新 ROCm 7.14,为即将发布的 Ryzen AI MAX PRO 400 系列处理器提供支持,开发者可以提前适配 Profiler 工具。原文稍后读已读值得跟进有用关注 AMD
11:17IT之家(博客/媒体)精选Ubuntu 内核团队于 7 月 16 日报告,Linux 7.0.0-28.28 内核中的 AMDGPU 驱动问题导致 ROCm 计算负载吞吐量降至 1/42。在 Stable Diffusion XL 通过 ComfyUI 推理时,原先约 9 秒的任务延长至 388 秒。该回归源自 Linux 7.0 稳定版上游内核,CachyOS 和 Fedora 用户也已反馈相同问题。行业UbuntuAMDGPUROCm推荐理由:Ubuntu 说这个内核版本让 AMD 显卡跑 AI 慢 42 倍,SDXL 推理从 9 秒变成 388 秒。如果你在用 Ubuntu,赶紧看看内核版本号。原文稍后读已读值得跟进有用关注 Ubuntu
18:45Dify@dify_aiDify 与 AMD 合作推出 AI DevMaster 黑客马拉松,参赛者可使用 Dify 的可视化编排工具快速构建智能体项目,免去环境搭建、工具集成、RAG 管道等基础设施工作。Dify 通过插件节点连接外部能力,并用 Knowledge Pipeline 实现本地知识检索。AMD 的 ROCm 负责在 Radeon GPU 上部署和调优本地推理。黑客马拉松报名链接已在 Luma 开放。AI产品DifyAMDROCm推荐理由:想用 Dify 搭智能体但怕环境配置?AMD 和 Dify 合办了场黑客马拉松,用可视化编排和 ROCm 帮你省掉基础设施,直接上手做项目。原文稍后读已读值得跟进有用关注 Dify
13:56官方账号vLLM@vllm_project精选76°AMD团队将ROCm支持引入vime,vime是vLLM生态的RL后训练框架,端到端RL后训练现在原生运行在AMD Instinct MI355X GPU上。vime使用vLLM作为rollout后端,在ROCm上继承完整vLLM栈,无需独立代码路径。AMD验证了pipeline并上游了ROCm修复,提供了预构建容器。支持GRPO训练、colocated和非colocated训练/rollout、Megatron-LM训练+vLLM rollout、Qwen3密集和MoE模型。在MI355X上,Qwen3-8B达到约4100 tokens/gpu/s,训练-rollout logprob差异低且稳定。AI产品AMDROCmvime推荐理由:AMD给vLLM生态的RL训练框架vime加了ROCm支持,现在你的Qwen3-8B在MI355X上能跑到4100 tokens/gpu/s,训练和rollout的logprob很稳,还直接提供预构建容器,省去编译麻烦。原文稍后读已读值得跟进有用关注 AMD
03:37官方账号LMSYS Org (SGLang)@lmsysorg精选73°LMSYS 发布博客,介绍 DeepSeek-V4 Flash RL 在 AMD Instinct MI355X GPU 上使用 Miles 框架完成端到端训练。训练100+步后,log-prob gap 稳定在0.09,AIME-2024 pass@1 从0.39提升至0.49,pass@8 从0.53提升至0.67。采用 FP8 推演加 BF16 演员模型,支持数据类型感知在线权重更新。在 ROCm 上实现了稳定的 TP1/PP4/EP4 布局,无集体通信停顿。混合注意力、mHC 混合和哈希路由 MoE 在 SGLang 和 Megatron 引擎间保持一致。AI模型DeepSeek-V4AMDROCm推荐理由:DeepSeek-V4 Flash RL 在 AMD 显卡上跑通了,训练结果还不错,AIME 分数涨了一截。想试试 AMD 平台搞 RL 训练可以看看这篇。原文稍后读已读值得跟进有用关注 DeepSeek-V4
10:48IT之家(博客/媒体)在 2026 台北国际电脑展上,AMD 客户端业务高级副总裁 Rahul Tikoo 对英伟达推出 RTX Spark AI PC 芯片表示欢迎,认为竞争将加速 AI PC 生态成熟。Tikoo 强调大容量本地内存对智能体工作负载至关重要,并指出 AMD 的 Strix Halo 及后续 Gorgon Halo 芯片足以与 RTX Spark 竞争,后者统一内存最高可达 192GB。AMD 还认为其 ROCm 软件生态的迁移难度低于英伟达的 CUDA,壁垒正在下降。行业AI PCRTX SparkStrix Halo推荐理由:AMD 高管正面回应英伟达入局 AI PC 芯片,明确自家 Strix Halo 和 Gorgon Halo 的硬件优势,做 AI 本地推理或智能体开发的团队可以关注内存容量和生态迁移成本,值得点开了解竞争格局。原文稍后读已读值得跟进有用关注 AI PC
07:59IT之家(博客/媒体)精选AMD AI 开发者大会 2026 首次在中国上海举办,AMD CEO 苏姿丰与零一万物创始人李开复围绕多智能体技术、端侧 AI 计算等议题展开对话。大会展示了锐龙 AI Max+ 系列处理器,支持 200B 参数模型本地运行,并宣布 ROCm 开源平台新增对锐龙 AI 400 系列的支持。惠普、华硕等厂商已推出超 35 款基于该处理器的智能体主机产品。大会还设置了 GPU 实操工作坊和技术研讨会,聚焦大模型推理优化、端侧智能体等前沿方向。行业AMD智能体ROCm推荐理由:AMD 首次把开发者大会带到中国,苏姿丰和李开复的对话点出了端侧智能体主机的未来方向,做本地 AI 开发和部署的开发者值得关注 ROCm 的新支持和硬件生态。原文稍后读已读值得跟进有用关注 AMD