13:14官方账号arXiv cs.AI@Zongyi Chen, Yu Liang, Jie Lin, Liansheng WangPathVU是一个面向病理图像细粒度多尺度视觉理解的基准,基于23个公共病理数据集构建,包含14个VQA任务、61,673张图像和308,070个样本,覆盖28个器官。该基准通过Region FOV和Slide FOV两种视野,评估模型的区域定位、视觉识别、数量估计、空间推理和上下文不足判断能力。对18个通用、医学和病理专用的多模态大语言模型评测显示,现有模型在细粒度视觉任务上存在明显局限。论文PathVU病理图像多模态推荐理由:PathVU这个新基准测了18个多模态模型,发现它们在病理图上连定位和数数都容易出错,搞医学AI的值得看看。原文稍后读已读值得跟进有用关注 PathVU