11:31官方账号arXiv cs.AI@Ke Li, Jiayu Chen, Maoliang Li, Zihao Zheng, Hailong Zou, Hengyi Zhang, Xuanzhe Liu, Xiang ChenEcoFrame是一个无需训练的视觉证据调度框架,让长视频理解模型按需调整帧预算。它用熵门控判断当前证据是否足够,并用注意力引导在信息密集区域补充候选帧。在Video-MME、LongVideoBench和MLVU上,EcoFrame在Qwen2.5-VL上平均准确率达64.4,超过BOLT的63.5。相比AKS和BOLT,EcoFrame获得1.85倍加速;相比agent方法A.I.R.,推理加速最高达13.5倍且精度相当。论文EcoFrameQwen2.5-VLVideo-MME推荐理由:EcoFrame不用微调,靠熵和注意力决定该看哪些帧,在长视频任务上比BOLT准还快1.85倍,代码已开源。原文稍后读已读值得跟进有用关注 EcoFrame