论文21:01VIGOR:基于潜空间一致性实现 MBRL 零样本视觉泛化强化学习在换背景、变光照时就崩的问题,这篇用潜空间一致性给出解法,Robosuite 上比第二名的基线高了 43.6%。#MBRL#VIGOR#强化学习#零样本泛化aarXiv: Google DeepMind@Mingyu Park 等 4 人原文稍后读已读值得跟进有用关注 MBRL
论文Agent 与开发者18:16Neural ODEs与并发学习结合实现稳定在线学习Neural ODEs首次获得Lyapunov稳定性保证,在动态系统学习中表现优异,尤其在噪声环境下优势明显。#Neural ODEs#Lyapunov#并发学习#在线学习aarXiv: Google DeepMind@Omkar Sudhir Patil原文稍后读已读值得跟进有用关注 Neural ODEs
论文12:57OG-SPR:观察锚定的自预测强化学习用于视觉连续控制OG-SPR把两种预测目标结合起来,28个控制任务上超过现有方法,难任务提升明显。搞视觉RL的可以看看。#OG-SPR#强化学习#视觉控制#DeepMind Control SuiteaarXiv: Google DeepMind@Xinwei Liu 等 4 人原文稍后读已读值得跟进有用关注 OG-SPR
论文10:10T2RD:面向视觉强化学习泛化的任务相关表示解耦方法这篇论文教你用自监督方法解耦视觉特征,T2RD在泛化能力上比现有方法强出一截,做机器人和控制任务的值得看看。#T2RD#视觉强化学习#泛化#DeepMind Control SuiteaarXiv: Google DeepMind@Jinwen Wang 等 7 人原文稍后读已读值得跟进有用关注 T2RD
论文精选10:38双流强化学习与状态感知探索这篇论文用条件流匹配把回报分布和多模态策略一起建模,解决了强化学习中的多模态探索难题,在DeepMind控制任务上吊打了扩散方法。#Dual-Flow RL#DeepMind Control Suite#Humanoid-Bench#强化学习aarXiv: Google DeepMind@Qijun Li 等 7 人原文稍后读已读值得跟进有用关注 Dual-Flow RL