AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

PDPO

共 1 条相关 AI 资讯
8月29日
00:38
00:38官方账号arXiv cs.LG@Wendong Li, Jochen Garcke
研究团队提出规划扩散策略优化(PDPO)框架,使用扩散策略生成短程动作块处理人群导航问题。PDPO先在碰撞避免演示数据上预训练,再通过PPO在线微调。实验显示PDPO在成功率上超越强基线模型,尤其在修改后的有界基准中,动作块对性能提升至关重要。
论文PDPO扩散策略人群导航

推荐理由:CMU团队新方法PDPO让机器人能提前规划5步动作,在拥挤人群中导航成功率更高。
原文
精选全部日报登录