模型11:47POGP:连续控制的前缀最优动态扩散策略,学习何时停止POGP能在保持性能的同时把去噪步数砍掉近三分之二,还比现有动态扩散方法更准,做连续控制的可以看看。#POGP#Diffusion Policy#MuJoCo#连续控制aarXiv cs.LG@Rohit Kumar Salla 等 3 人原文稍后读已读值得跟进有用关注 POGP
论文10:11FAR: 失败感知重试框架实现测试时恢复与持续策略改进机器人老是失败?试试FAR,它让机器人从失败自学习,不用人管。仿真和真实环境都提升10%以上。#FAR#Failure-Aware Retry#Diffusion Policy#机器人策略aarXiv cs.AI@Haoran Hao 等 4 人原文稍后读已读值得跟进有用关注 FAR