18:15官方账号arXiv cs.AI@Aman Tyagi, Hemanth Boinpally, Jonathan Chen, Douglas Gebert, Steven Hickson该论文提出Agentic Self-Improvement框架,将图像到视频(I2V)生成重构为闭环优化。第一阶段用多模态大模型迭代优化提示词,通过Davidsonian Scene Graph(DSG)查询和Common Mistake Questions(CMQ)分别检测语义一致性与伪影。第二阶段用贝叶斯优化联合调优随机种子和CFG尺度,并引入Video-Text Adherence(VTA)评分作为质量指标。在人类偏好测试中,该方法生成的视频对比无引导搜索方法最高获得69%的胜率。论文Agentic Self-Improvement图像生成视频贝叶斯优化推荐理由:想让视频生成听你的话?这篇论文用多模态大模型加贝叶斯优化调提示词和参数,胜率最高69%,告别瞎试。原文稍后读已读值得跟进有用关注 Agentic Self-Improvement