论文09:17测试时扩展对小视觉语言模型在多语言视觉选择题中的有效性研究这篇论文告诉你,在小模型上用测试时扩展,关键是让模型把答案写出来,而不是复杂搜索。Qwen2.5-VL调参后性价比很高。#Qwen2.5-VL-7B-Instruct#Qwen3.5-4B#EXAMS-V#测试时扩展aarXiv cs.LG@Spiros Baxevanakis, Peng-Jian Yang原文稍后读已读值得跟进有用关注 Qwen2.5-VL-7B-Instruct
论文09:42评估VLM零样本学习替代YOLO+OCR的尼日利亚车牌识别用真实非洲场景测了5个主流VLM,发现Gemini和Qwen在车牌识别上比YOLO+OCR更准,有数据有对比。#Gemini 2.0 Flash Exp#Qwen2.5-VL-7B-Instruct#零样本学习#车牌识别aarXiv: Google DeepMind@Ismail Ismail Tijjani 等 4 人原文稍后读已读值得跟进有用关注 Gemini 2.0 Flash Exp