论文精选10:44连续状态动作下Q-learning在Hölder空间的正则性与DeepONet近似这篇论文把Q-learning的Bellman目标正则性研究透了,还给出了DeepONet的近似界限,适合搞理论强化学习的人细读。#Q-learning#DeepONet#Hölder空间#正则性aarXiv cs.AI@Qian Qi原文稍后读已读值得跟进有用关注 Q-learning