论文精选10:55ReCoVLA:VLM引导奖励编译,提升VLA策略故障恢复能力做机器人操作策略的团队终于有了一个不重新训练就能处理故障的方案——ReCoVLA 用 VLM 做奖励选择器,零样本迁移到真实环境。做 VLA 策略部署的开发者可以直接参考这个框架。#VLA策略#故障恢复#奖励编译#零样本迁移aarXiv cs.AI@Haodi Hu 等 7 人原文稍后读已读值得跟进有用关注 VLA策略