模型中美对照12:12SciFigQual-Bench:面向科学图像质量评估的全文本基准评估论文图表质量?SciFigQual-Bench这个新基准让GPT-5.6-Sol驱动的SFQ-Agent打分,误差比直问模型低43%,更靠谱。#SciFigQual-Bench#GPT-5.6-Sol#SFQ-Agent#图像质量评估aarXiv cs.AI@Zihan Deng 等 6 人原文稍后读已读值得跟进有用关注 SciFigQual-Bench