AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

SciFigQual-Bench

共 1 条相关 AI 资讯
7月30日
12:12
12:12官方账号arXiv cs.AI@Zihan Deng, Chuanzhi Xu, Huiqi Liang, Haoyang Li, Xiaozhen Zhong, Lequan Yu
SciFigQual-Bench是一个全新的科学图像质量评估基准,涵盖2020至2025年间顶级计算机科学会议的6308张图像,由多个领域专家在清晰度、布局、标题匹配、上下文相关性和误导风险五个维度进行独立评分并聚合为黄金标准。该基准将每张图像与其标题、引用句和论文上下文绑定,不同于仅做视觉表面比较的以往研究。在eval1200测试子集上,配备GPT-5.6-Sol的SFQ-Agent(F3)取得了最低平均绝对误差0.418和最高一致率93.4%,显著优于直接评估和辅助VLM方案。
AI模型SciFigQual-BenchGPT-5.6-SolSFQ-Agent

推荐理由:评估论文图表质量?SciFigQual-Bench这个新基准让GPT-5.6-Sol驱动的SFQ-Agent打分,误差比直问模型低43%,更靠谱。
原文
精选全部日报登录