论文Agent 与开发者10:42医学视觉语言模型后训练审计:SFT 与 GRPO 对图像依赖能力的影响用 Qwen2.5-VL-3B 在 PMC-VQA 上做了严谨对照实验,发现答案准确率涨了,模型可能反而不看图了,做医疗 VLM 微调的都该看看。#Qwen2.5-VL#PMC-VQA#GRPO#LoRAaarXiv cs.AI@Wang Jingxin原文稍后读已读值得跟进有用关注 Qwen2.5-VL