论文10:19连续时间强化学习在Hawkes跳跃扩散控制中的应用研究这研究发布了针对Hawkes过程的连续时间强化学习新方法,用近似技术优化求解,和传统离散方法比效果不同,值得了解。#Hawkes-CT-DDPG#强化学习#连续时间RL#Hawkes过程aarXiv cs.LG@Tomasz R. Bielecki 等 3 人原文稍后读已读值得跟进有用关注 Hawkes-CT-DDPG