09:35官方账号arXiv cs.AI@Nikos Giakoumoglou, Andreas Floros, Kleanthis-Marios Papadopoulos, Tania Stathaki精选73°ViTAMINS方法将合成难例整合到无监督视觉Transformer预训练中,提升表示质量。在ImageNet和迁移学习、图像检索、拷贝检测、图像视频分割任务上全面基准测试。ViTAMINS的难例带来涌现特性,学习到的表示包含图像语义内容信息,作为分类器表现优异,比基线提升最高11.3%。ViTAMINS通过简单修改现有对比框架实现,资源效率更高,ViT-B版本超越V-JEPA的ViT-L版本。论文ViTAMINSVision Transformers自监督学习推荐理由:ViTAMINS用合成难例提升视觉Transformer性能,资源效率还更高,ViT-B就能打败V-JEPA的ViT-L。原文稍后读已读值得跟进有用关注 ViTAMINS