论文09:42STAR:时空自适应奖励分配用于文本到图像RL后训练这篇论文提出STAR方法,通过空间和时间自适应分配奖励,让RL后训练更精准地优化文本到图像生成,效果在GenEval等基准上显著提升。#STAR#文本到图像生成#强化学习#Stable DiffusionaarXiv cs.AI@Jinjie Shen 等 5 人原文稍后读已读值得跟进有用关注 STAR