论文精选10:55RAVEL:基于在线强化学习的交互式行人重识别提问策略想让模型学会'下一步该问什么'?这篇论文把提问当成强化学习问题,用检索排序反馈训练,五轮交互持续涨点。#RAVEL#Interactive-PEDES#强化学习#行人重识别aarXiv cs.AI@Lyucheng Qian 等 3 人原文稍后读已读值得跟进有用关注 RAVEL