论文10:01AnyGroundBench:面向视觉语言模型的视频定位专用领域基准想看看现在的VLM在专业视频场景下有多拉胯?这篇论文搞了个AnyGroundBench基准,测了15个模型在动物、手术等5个领域的表现,结果全翻车了。#AnyGroundBench#VLM#视频定位#域适应aarXiv cs.AI@Rintaro Otsubo 等 9 人原文稍后读已读值得跟进有用关注 AnyGroundBench