12:26官方账号arXiv cs.LG@Dmytro Knopov论文复现了无归一化层的WideResNet-28-10上的联合能量模型(JEM),两个独立运行达到92.88%测试精度和44.46的buffer-FID,而原基准为92.9%和38.40。研究记录了两种失败模式:后期训练中通过异常缓冲机制引发的发散,以及SVHN OOD检测行为的运行依赖性。在约130个训练轮次中,Predictor-Corrector(PC)采样器替换SGLD并未带来任何方法级优势:所有十个检查点-OOD对上的AUROC绝对差低于0.007,FID差低于0.5。分层种子-图像自助抽样给出宏平均AUROC差值的95%置信区间包含零,种子级等价检验无法建立正式等价。论文JEMCIFAR-10SGLD推荐理由:这篇论文复现JEM,对比PC和SGLD采样器,结果在CIFAR-10上几乎没差别,AUROC差小于0.007,还暴露了训练发散问题。搞能量模型的人可以看看。原文稍后读已读值得跟进有用关注 JEM