论文12:04MASER:面向具身3D空间智能的模态自适应路由框架做具身智能或3D视觉问答的团队,终于有了一个不用暴力融合所有模态的轻量方案——MASER根据问题语义动态选最优模态,点云在超半数场景下最准,值得在Open3D-VQA上试试。#具身智能#3D空间智能#多模态路由#视觉语言模型aarXiv cs.AI@Hilton Raj, Vishnuram AV原文稍后读已读值得跟进有用关注 具身智能