12:22官方账号arXiv cs.AI@Vedant Shah, Onkar Susladkar, Tushar Prakash, Kiet Nguyen, Tianjio Yu, Adheesh Juvekar, Muntasir Waheed, Ismini LourentzouGraphVid是一种基于图结构的图像到视频生成模型,通过交互图实现多对象精准控制。研究团队构建了GraphVid-Bench数据集,包含结构化关系标注。与Motion-I2V相比,GraphVid的FID降低39.9%,FVD降低37.6%,PSNR从9.87提升至15.98,SSIM从0.38提升至0.61。该方法使用更少训练数据和参数,在可控性和质量上均表现更优。AI模型GraphVidGraphVid-BenchMotion-I2V推荐理由:想精确控制视频里多个物体的互动?GraphVid用交互图代替画轨迹,效果比Motion-I2V好很多,FID降了40%。原文稍后读已读值得跟进有用关注 GraphVid