论文12:32MixFrag:脆弱性引导的视觉Transformer混合精度训练后量化MixFrag用KL散度定位模型里对量化最敏感的部分,再把位宽分配变成背包问题。在COCO上比之前最好的混合精度PTQ方法涨了9.6 AP,跑ViT的可以看看。#MixFrag#量化#视觉Transformer#PTQaarXiv cs.LG@Md. Mehrab Hossain Opi 等 3 人原文稍后读已读值得跟进有用关注 MixFrag