论文精选12:26Mind Dreamer: 主动潜变量干预打破历史束缚,加速稀疏奖励强化学习做强化学习稀疏奖励研究的团队终于有了突破历史束缚的新工具——Mind Dreamer 通过主动生成想象起点,大幅提升样本效率,建议跑过 DreamerV3 的开发者直接试。#强化学习#基于模型的强化学习#稀疏奖励#潜变量干预aarXiv: Google DeepMind@Shaojun Xu 等 7 人原文稍后读已读值得跟进有用关注 强化学习