模型11:47POGP:连续控制的前缀最优动态扩散策略,学习何时停止POGP能在保持性能的同时把去噪步数砍掉近三分之二,还比现有动态扩散方法更准,做连续控制的可以看看。#POGP#Diffusion Policy#MuJoCo#连续控制aarXiv cs.LG@Rohit Kumar Salla 等 3 人原文稍后读已读值得跟进有用关注 POGP