论文09:52Wasserstein不确定性下平均场控制的鲁棒Q-learning这篇论文给了一个能应对不确定性干扰的Q-learning方法,在系统和疫情模型上都试过了,效果不错。#Q-learning#Wasserstein不确定性#平均场控制#鲁棒强化学习aarXiv cs.LG@Mathieu Laurière 等 3 人原文稍后读已读值得跟进有用关注 Q-learning