论文15:34QVIRL:基于Q值的变分逆强化学习方法想学逆强化学习?QVIRL能边学边给不确定性,还能主动问你要数据,比老方法稳多了。#QVIRL#逆强化学习#贝叶斯#主动学习aarXiv cs.LG@Ondrej Bajgar 等 5 人原文稍后读已读值得跟进有用关注 QVIRL