论文Agent 与开发者多源确认精选00:19NVIDIA 提出 NeMo-DCR,RL 训练检查点同步提速 12 到 40 倍NVIDIA 发现 RL 每步只改 1% 的权重,于是做了个只传差异的检查点同步方案,1T 模型从 87 分钟降到 150 秒,跑大规模 RL 的团队可以看看。#NVIDIA#NeMo-DCR#强化学习#检查点同步4 个信源在谈事件专题DAIR.AI@dair_ai5 个信源在谈原文稍后读已读值得跟进有用关注 NVIDIA