论文Agent 与开发者精选09:16研究提出对抗扰动下风险敏感强化学习的下界认证方法这个研究挺有意思,作者解决了RL在对抗环境下的风险认证问题,方法上用了φ-散度松弛,还改进了训练参数的选择,结果也比风险中性训练好。#风险敏感强化学习#对抗扰动#认证方法#凸优化aarXiv: OpenAI@Tong Li 等 3 人原文稍后读已读值得跟进有用关注 风险敏感强化学习