#文本到图像生成
共 5 条 · 7 天 0 条 · 30 天 0 条
信息流里打上「文本到图像生成」标签的资讯、产品与论文,按刊登时间排,新的在上。
7月17日
7月16日
6月24日
论文12:11
IV-CoT:隐式视觉思维链用于结构感知文本到图像生成这篇论文解决了文生图模型在物体数量、空间位置等结构细节上经常翻车的问题,用隐式思维链单次前向传播搞定,在GenEval和T2I-CompBench上效果更好。
6月17日
论文09:42
STAR:时空自适应奖励分配用于文本到图像RL后训练这篇论文提出STAR方法,通过空间和时间自适应分配奖励,让RL后训练更精准地优化文本到图像生成,效果在GenEval等基准上显著提升。
5月21日
Linear-DPO:统一扩散与流匹配的线性偏好优化方法
做文本到图像生成的团队终于有了更稳定的对齐方法——Linear-DPO 统一了扩散和流匹配,解决了 DPO 在生成任务中的目标不匹配问题,做图像生成微调的建议试试。