论文12:57OG-SPR:观察锚定的自预测强化学习用于视觉连续控制OG-SPR把两种预测目标结合起来,28个控制任务上超过现有方法,难任务提升明显。搞视觉RL的可以看看。#OG-SPR#强化学习#视觉控制#DeepMind Control SuiteaarXiv: Google DeepMind@Xinwei Liu 等 4 人原文稍后读已读值得跟进有用关注 OG-SPR