论文10:24
论文提出鲁棒老虎机首个多项式时间学习器搞 bandit 或理论机器学习的可以看看:这论文给 robust bandits 找到了第一个多项式时间算法,遗憾 Õ(√T),还划清了 NP-hard 边界。
搞 bandit 或理论机器学习的可以看看:这论文给 robust bandits 找到了第一个多项式时间算法,遗憾 Õ(√T),还划清了 NP-hard 边界。
这篇论文为有界记忆下的语言生成建立了理论基础,对设计内存受限的AI生成系统(如边缘设备上的语言模型)有直接指导意义。做理论或系统优化的开发者值得关注其中的密度与识别界限。
这篇论文澄清了机器学习理论中一个长期被误解的基础问题——Valiant 原始模型与 PAC 学习的区别,做学习理论或计算复杂度研究的学者值得一读,尤其是对成员查询能力感兴趣的人。