论文12:32
MixFrag:脆弱性引导的视觉Transformer混合精度训练后量化MixFrag用KL散度定位模型里对量化最敏感的部分,再把位宽分配变成背包问题。在COCO上比之前最好的混合精度PTQ方法涨了9.6 AP,跑ViT的可以看看。
MixFrag用KL散度定位模型里对量化最敏感的部分,再把位宽分配变成背包问题。在COCO上比之前最好的混合精度PTQ方法涨了9.6 AP,跑ViT的可以看看。
这篇论文用SAM掩码改进了LeJEPA,让自监督学习在数据少时更管用。跟踪、分类、分割结果都比原版强,适合想提升视觉特征效率的同学看。