AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

图像生成视频

共 2 条相关 AI 资讯
8月13日
18:15
18:15官方账号arXiv cs.AI@Aman Tyagi, Hemanth Boinpally, Jonathan Chen, Douglas Gebert, Steven Hickson
该论文提出Agentic Self-Improvement框架,将图像到视频(I2V)生成重构为闭环优化。第一阶段用多模态大模型迭代优化提示词,通过Davidsonian Scene Graph(DSG)查询和Common Mistake Questions(CMQ)分别检测语义一致性与伪影。第二阶段用贝叶斯优化联合调优随机种子和CFG尺度,并引入Video-Text Adherence(VTA)评分作为质量指标。在人类偏好测试中,该方法生成的视频对比无引导搜索方法最高获得69%的胜率。
论文Agentic Self-Improvement图像生成视频贝叶斯优化

推荐理由:想让视频生成听你的话?这篇论文用多模态大模型加贝叶斯优化调提示词和参数,胜率最高69%,告别瞎试。
原文
6月12日
00:41
00:41lmarena.ai@lmarena_ai
精选
Gemini Omni Flash在Video Arena排名第一。文本转视频得分比Veo 3.1 (1080p)高158分,领先Seedance 2.0达61分。图像转视频同样位居榜首。这是Google DeepMind发布的多模态模型,结合了Gemini的智能与生成式媒体系统。
AI模型Gemini Omni FlashGoogle DeepMindVideo Arena

推荐理由:视频生成双料第一
原文
精选全部日报登录