mllm·general

MLLM

别名
首次出现
2026-05-22
最近出现
2026-07-30
累计提及
38
§ 01综述

MLLM 近期进展

渐进式多模态对齐解决持续指令微调中的投影仪遗忘问题

原文标题:研究人员提出了一种渐进式多模态对齐方法,旨在解决持续指令微调中的投影仪遗忘问题。

ClinFusion:面向整体医学理解的视觉中心多模态LLM系统

原文标题:该系统旨在通过结合视觉和语言信息,提供更全面的医学理解。

抖音未成年人模式升级:引入多模态大语言模型优化适龄推荐

原文标题:抖音通过引入多模态大语言模型,优化未成年人模式的适龄推荐。

ActiveVision新基准:GPT-5.5和Claude Fable 5主动观察得分不足11%

原文标题:GPT-5.5和Claude Fable 5在ActiveVision新基准测试中的表现不佳。

多模态大模型的科学可视化素养基准测试

原文标题:研究人员开发了新的基准测试,以评估多模态大模型在科学可视化方面的能力。

Read It Back:预训练MLLM成为文本到图像生成的零样本奖励模型

原文标题:该研究提出了一种预训练MLLM,作为文本到图像生成的零样本奖励模型。

1B以下多模态情感语言模型Light-MER:知识蒸馏实现高效识别

原文标题:Light-MER模型通过知识蒸馏实现了高效的多模态情感识别。

十年视觉语言AI模型进化:准确性与视觉认知错误分析

原文标题:研究人员对十年来的视觉语言AI模型进行了准确性和视觉认知错误分析。

MedPMC:可扩展的高保真医学多模态数据挖掘框架

原文标题:MedPMC框架旨在提高医学多模态数据挖掘的可扩展性和准确性。

CoMet:多模态大语言模型不确定性估计的新方法

原文标题:CoMet方法为多模态大语言模型的不确定性估计提供了新的思路。

当前焦点与观察点

MLLM领域的研究正日益深入,从多模态对齐到医学应用,再到科学可视化和情感识别,MLLM的应用场景不断扩大。同时,对模型准确性和不确定性的研究也日益受到重视。
§ 02相关报道10 条在档
  1. 01
    渐进式多模态对齐解决持续指令微调中的投影仪遗忘问题
    arXiv cs.AI
  2. 02
    ClinFusion: 面向整体医学理解的视觉中心多模态LLM系统
    arXiv cs.AI
  3. 03
    抖音未成年人模式升级:引入多模态大语言模型优化适龄推荐
    IT之家
  4. 04
    ActiveVision新基准:GPT-5.5和Claude Fable 5主动观察得分不足11%
    arXiv cs.AI
  5. 05
    多模态大模型的科学可视化素养基准测试
    arXiv cs.AI
  6. 06
    Read It Back:预训练MLLM成为文本到图像生成的零样本奖励模型
    AK
  7. 07
    1B以下多模态情感语言模型Light-MER:知识蒸馏实现高效识别
    arXiv cs.AI
  8. 08
    十年视觉语言AI模型进化:准确性与视觉认知错误分析
    arXiv cs.AI
  9. 09
    MedPMC:可扩展的高保真医学多模态数据挖掘框架
    arXiv cs.LG
  10. 10
    CoMet:多模态大语言模型不确定性估计的新方法
    arXiv cs.LG
§ 03邻近话题

本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

/topic/MLLM