论文精选12:16重复博弈中自适应对手的遗憾最小化:RP-Regret 新指标这篇论文为多智能体博弈场景提供了更合理的遗憾度量,做强化学习、博弈论或多智能体系统的研究者值得关注,它可能改变你对自适应对手环境下算法设计的理解。#遗憾最小化#重复博弈#自适应对手#博弈论aarXiv cs.AI@Mingyang Liu 等 4 人原文稍后读已读值得跟进有用关注 遗憾最小化