№mllm·general
MLLM
别名
- 首次出现
- 2026-05-22
- 最近出现
- 2026-07-30
- 累计提及
- 38
§ 01综述
MLLM 近期进展
渐进式多模态对齐解决持续指令微调中的投影仪遗忘问题
原文标题:研究人员提出了一种渐进式多模态对齐方法,旨在解决持续指令微调中的投影仪遗忘问题。
ClinFusion:面向整体医学理解的视觉中心多模态LLM系统
原文标题:该系统旨在通过结合视觉和语言信息,提供更全面的医学理解。
抖音未成年人模式升级:引入多模态大语言模型优化适龄推荐
原文标题:抖音通过引入多模态大语言模型,优化未成年人模式的适龄推荐。
ActiveVision新基准:GPT-5.5和Claude Fable 5主动观察得分不足11%
原文标题:GPT-5.5和Claude Fable 5在ActiveVision新基准测试中的表现不佳。
多模态大模型的科学可视化素养基准测试
原文标题:研究人员开发了新的基准测试,以评估多模态大模型在科学可视化方面的能力。
Read It Back:预训练MLLM成为文本到图像生成的零样本奖励模型
原文标题:该研究提出了一种预训练MLLM,作为文本到图像生成的零样本奖励模型。
1B以下多模态情感语言模型Light-MER:知识蒸馏实现高效识别
原文标题:Light-MER模型通过知识蒸馏实现了高效的多模态情感识别。
十年视觉语言AI模型进化:准确性与视觉认知错误分析
原文标题:研究人员对十年来的视觉语言AI模型进行了准确性和视觉认知错误分析。
MedPMC:可扩展的高保真医学多模态数据挖掘框架
原文标题:MedPMC框架旨在提高医学多模态数据挖掘的可扩展性和准确性。
CoMet:多模态大语言模型不确定性估计的新方法
原文标题:CoMet方法为多模态大语言模型的不确定性估计提供了新的思路。
当前焦点与观察点
MLLM领域的研究正日益深入,从多模态对齐到医学应用,再到科学可视化和情感识别,MLLM的应用场景不断扩大。同时,对模型准确性和不确定性的研究也日益受到重视。