论文11:44Squeeze MLLM: 多模态大模型驱动的主体驱动图像生成做图像生成或AI绘画的开发者,这篇论文解决了主体身份保留与文本指令跟随的长期矛盾,提出的DLA模块和多阶段去噪策略可以直接参考,值得点开看看具体实现。#多模态大语言模型#主体驱动生成#扩散模型#身份保留aarXiv cs.AI@Shuhong Zheng 等 5 人原文稍后读已读值得跟进有用关注 多模态大语言模型