事件专题 · 单一信源

华为昇腾支持RL训推一致性,实测最高60%性能收益

华为计算8月5日宣布,昇腾基于Ascend C编程语言提供完整训推一致算子集。在Qwen3-30B MoE模型上测试实现Logdiff为0,并通过FA算子优化在Eager模式下获得20%-60%性能收益。该方案通过统一注意力语义、锁定reduce累加序等4项修改,解决训练与推理累加不保序问题。相关基础设施已开源至GitHub,并将上线训推一致问题识别Skill。

当前结论

华为昇腾把RL训推一致做出来了,Qwen3-30B上Logdiff归零,还能提速20%-60%,搞强化学习训练可以看看。

2 个信源72° AI 热度最后更新 2026/8/6 08:13:17

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情