00:38官方账号arXiv cs.LG@Wendong Li, Jochen Garcke研究团队提出规划扩散策略优化(PDPO)框架,使用扩散策略生成短程动作块处理人群导航问题。PDPO先在碰撞避免演示数据上预训练,再通过PPO在线微调。实验显示PDPO在成功率上超越强基线模型,尤其在修改后的有界基准中,动作块对性能提升至关重要。论文PDPO扩散策略人群导航推荐理由:CMU团队新方法PDPO让机器人能提前规划5步动作,在拥挤人群中导航成功率更高。原文稍后读已读值得跟进有用关注 PDPO