论文10:27MoTE:多任务视频理解混合任务专家MoTE模型在多任务视频语言学习方面提供了可解释且计算高效的解码器替代方案,值得一看。#多任务视频理解#混合任务专家#VideoLLM-MoTE#COIN基准aarXiv cs.LG@Muhammad Asad Ali 等 4 人原文稍后读已读值得跟进有用关注 多任务视频理解
模型76°11:17MODUS: 仅解码器的任意到任意多模态建模MODUS用一个解码器统一处理各种模态的输入输出,省去多个专用组件,性能不输专家模型,还开源了。#MODUS#多模态#解码器架构#any-to-anyaarXiv cs.AI@Mingqiao Ye 等 14 人原文稍后读已读值得跟进有用关注 MODUS