11:59官方账号arXiv cs.AI@Pouya Ardekhani, Zahra Dehghanian, Morteza Abolghasemi, Hamid R. Rabiee论文提出 MonoVoc,一种无需训练的 3D 场景理解框架,将几何重建与语义集成解耦。它仅需单目视频序列输入,即可输出紧凑可搜索的对象级语义高斯地图。在 Replica 数据集上,该方法保持了高渲染保真度,分割精度与现有方法相当。相比 SOTA 基线,MonoVoc 通过对象级嵌入替代密集逐高斯存储,内存占用降低一个数量级。论文MonoVocReplica3D高斯推荐理由:想用单目视频做3D语义搜索?MonoVoc把几何和语义分开处理,内存直接省一个数量级。原文稍后读已读值得跟进有用关注 MonoVoc