论文Agent 与开发者14:35VLM-Safe-RL:用 CLIP 信号改进安全强化学习,事故率从 31.6% 降至 19.4%把 CLIP 接进 PPO-Lagrangian 做安全强化学习,MetaDrive Hard 上事故率降了 12 个点,但作者自己发现信号并不能预判碰撞,分析很实在。#VLM-Safe-RL#CLIP#PPO-Lagrangian#强化学习aarXiv cs.LG@Samuel Tetteh, Cody Fleming原文稍后读已读值得跟进有用关注 VLM-Safe-RL
论文09:26能量约束强化学习实现水下机器人节能控制这篇论文用约束强化学习给水下机器人设功率预算,省电14-65%,而且不用针对不同机器人和任务调参,在模拟器上验证了。#PPO-Lagrangian#MarineGym#水下机器人#约束强化学习aarXiv cs.AI@Yinuo Wang 等 3 人原文稍后读已读值得跟进有用关注 PPO-Lagrangian