论文11:36VLM-PBRS:用视觉语言模型自动进行势能奖励塑形这论文教你用VLM给RL智能体自动设计奖励函数,不用手动调公式,在Meta-World和Franka Kitchen上训练更快,还防奖励黑客。#VLM-PBRS#强化学习#奖励塑形#Meta-WorldaarXiv cs.AI@Henrik Müller, Daniel Kudenko原文稍后读已读值得跟进有用关注 VLM-PBRS