8月14日
10:39
10:39官方账号arXiv cs.LG@Yi-Chung Chen, Philip Jacobson, Tom Lampo, Yiren Lu, Jin Yao, David I. Inouye, Jing Gao, Danhua Guo, Burhan Yaman
论文提出TraVEL方法,用于提升驾驶视频检索。研究者先在nuReasoning数据集上对Qwen3-VL-Embedding进行InfoNCE微调,再引入轨迹相似度作为GRPO奖励。相比纯监督微调,TraVEL在2B模型上使纵向和横向mAP分别提升9.8和4.7个百分点,在8B模型上分别提升7.2和1.5个百分点。该方法不需要外部感知输出,推理时仅靠单向量检索。
推荐理由:想搞自动驾驶数据检索的可以看看这个TraVEL,用行车轨迹当训练信号,让模型更懂左转右转、加速减速,比普通微调强不少。