AITP
精选全部 AI 动态AI 日报Agent 接入关于更新日志信源提报反馈
登录 / 注册
AITOP
精选
AI 自动挑选的高价值内容
全部模型产品行业论文技巧
标签:清华/阿里×
5月20日
12:21
pandaily@contact@pandaily.com (Pandaily)
精选72
清华大学与阿里巴巴联合发表论文,提出ViT³(Vision Test-Time Training)架构,这是一种纯Transformer模型,在视觉任务中实现了线性计算复杂度。该架构使得在边缘设备上进行高分辨率图像理解成为可能,解决了传统Transformer在视觉应用中计算量过大的问题。该论文已被CVPR 2026接收为Oral论文,标志着视觉Transformer在效率上取得重要突破。
论文视觉Transformer线性复杂度边缘计算高分辨率图像清华/阿里

推荐理由:视觉Transformer终于突破了计算瓶颈,做边缘计算或高分辨率图像处理的开发者可以直接关注,这可能是部署到手机等设备的关键技术。