Estimate, Don't Imitate:复用可微状态策略做视觉运动控制
训练机械臂策略的新思路:不蒸馏专家,只学视觉补状态,真机 Panda 上 76% 成功率,做 sim-to-real 的朋友可以看看。
训练机械臂策略的新思路:不蒸馏专家,只学视觉补状态,真机 Panda 上 76% 成功率,做 sim-to-real 的朋友可以看看。
伯克利这边搞了个 X-Reset,把人类手部演示只用来当 RL 重置点,不用模仿,20 个物体三种机器人本体都能训出通用抓取策略,还能 sim-to-real 直接迁移。
铰接工具操作是机器人灵巧操作的硬骨头,Mana 用动画思路解决了数据生成和迁移难题,做机器人操作或 sim-to-real 的团队可以直接参考其零样本迁移方法。