Bandit PCA的极小极大最优遗憾
这篇论文把Bandit PCA的遗憾上界从O(d√(rT log T))降到O(r√(dT)),下界也提到Ω(r√(dT)),彻底解决了这个优化问题的理论最优性。
这篇论文把Bandit PCA的遗憾上界从O(d√(rT log T))降到O(r√(dT)),下界也提到Ω(r√(dT)),彻底解决了这个优化问题的理论最优性。
约束在线优化是机器学习中的核心问题,这篇论文用简洁的投影算法大幅降低了累积约束违反,做在线学习或凸优化理论的研究者值得关注,其自收缩性技巧可能启发更多改进。