论文02:55自适应奖励路由:多奖励优化音频视频扩散模型新论文提出自适应奖励路由,让音频视频扩散模型能同时优化多个奖励目标,比传统方法更灵活。#扩散模型#多模态#强化学习#音频视频生成AK@_akhaliq原文稍后读已读值得跟进有用关注 扩散模型