18:15官方账号NVIDIA AI@NVIDIAAI72°AgileRL 宣布与 NVIDIA 合作,支持 Nemotron 系列模型的后训练。NVIDIA 提前提供了 30B3A 参数 MoE 模型 Nemotron 3.5 Lightning。在 Arena 平台上,该模型经微调后在长程推理和真实客服任务上超过 Claude Sonnet 5。单次训练只需四块 H100 GPU 运行六小时即可掌握推理任务,上下文长度超过 50,000 token。Arena 客户可在 Nemotron 模型发布后立即获得相应的训练与评估环境。AI模型NemotronNVIDIAAgileRL10 个信源在谈事件专题推荐理由:AgileRL 把 Nemotron 3.5 Lightning 放到 Arena 上微调,6 小时就能超过 Claude Sonnet 5,训练完权重还归你。原文稍后读已读值得跟进有用关注 Nemotron