09:26官方账号arXiv cs.LG@Zonghuan Xu, Krishna Harish该论文通过过参数化线性回归模型分析渐进适应的训练时间分配。当任务数N增大且每任务训练时间为s_N时,若Ns_N趋近τ,学习进度收敛为连续曲线。进度在小τ时按Θ(τ)增长,大τ时按Θ(1/τ)下降,因此最优每任务训练时间缩放为s_N^*=Θ(1/N)。实验在逐渐旋转的MNIST和Yearbook时间偏移上验证了该结论。论文MNISTYearbook持续学习推荐理由:这篇论文发现:渐进适应时任务分得越细,每个任务训练时间反而要按1/N缩放。用MNIST和Yearbook验证了,做持续学习的朋友可以看看。原文稍后读已读值得跟进有用关注 MNIST