#多目标强化学习
共 4 条 · 7 天 0 条 · 30 天 0 条
信息流里打上「多目标强化学习」标签的资讯、产品与论文,按刊登时间排,新的在上。
8月3日
7月13日
模型10:47
Semantic Pareto-DQN 多目标强化学习框架用于金融异常检测金融欺诈检测的老大难问题有了解法:Semantic Pareto-DQN 不用重采样,直接多目标优化,既能抓到欺诈又少误拦正常交易。
6月18日
论文10:36
Pareto Q-Learning with Reward Machines:多目标强化学习算法这篇论文提出了PQLRM,把Pareto Q-Learning和奖励机器结合起来,在多目标任务里比基线收敛更快,还能找到普通方法找不到的最优策略。
6月17日