16:25官方账号arXiv cs.AI@Ali Saleh, Abdul Karim Gizzini, Mohamad Ghassany, Ali J. Ghandour该论文提出一种以熵为中心的可解释AI(XAI)方法,用于遥感图像的语义分割。作者还设计了一种新的XAI评估方法,以高效衡量所提方法高亮区域的相关性。实验结果表明,该方法在性能上优于近期为语义分割适配的XAI方法。研究旨在提升黑盒模型在遥感等关键领域的透明度和信任度。论文可解释AI遥感图像分割熵推荐理由:这篇论文给遥感图像分割的可解释性带来了新思路,用熵做核心,还配了新的评估方法,比现有方法效果更好。原文稍后读已读值得跟进有用关注 可解释AI
11:38官方账号arXiv cs.AI@Xuchen Zhu, Yajuan Wei, Shuang Hao, Jiwei Jiang, Guanxiang Mao, Fang Ren针对 RGB-D 语义分割模型在缺失 RGB 或深度模态时性能骤降的问题,研究者提出 Condition Dropout (ConD) 方法。ConD 在预训练模型基础上增加第二阶段训练,随机模拟完整、缺 RGB 或缺深度输入,冻结原编码器并训练带有零初始化特征注入的副本。在 NYU-Depth V2 和 SUN RGB-D 数据集上,ConD 在缺失模态下显著提升鲁棒性,且完整模态下略有增益。代码将在论文接收后公开。论文ConDNYU-Depth V2SUN RGB-D推荐理由:做语义分割的可以看看 ConD,训练完一个模型就能同时应付缺 RGB 或缺深度的情况,还能保持全模态精度。简单有效,代码也快开源了。原文稍后读已读值得跟进有用关注 ConD
11:35官方账号arXiv cs.LG@Nikolai Röhrich, Julian Gleißner, Ahmed H. A. Ibrahim, Silvan Mertes, Tobias Huber该论文提出一种不确定性引导的合成上下文增强策略,利用基线分割器的预测熵识别不确定语义区域,仅对互补视觉上下文进行修补。在Cityscapes、UAVID和BDD100K数据集上,微调后mIoU分别提升1.2%、2.1%和1.8%,尤其在公交车、火车和汽车等稀有类别上增益最大。该方法无需外部模型,严格保持标签有效性,且计算损失时仅基于原始像素。论文扩散模型Cityscapes语义分割推荐理由:搞语义分割的可以试试这个,它只增强模型犯难的区域,在几个自动驾驶数据集上提点挺明显,尤其是稀有类别。原文稍后读已读值得跟进有用关注 扩散模型
12:12官方账号arXiv cs.LG@Tran Dinh Tien, Zhiqiang ShenActiveSAM是一个无需训练、零样本推理的框架,将SAM 3改造为主动词汇分割器。它先通过低分辨率预视估计图像条件下的活跃类别集,再对保留类别进行全分辨率解码。在8个开放词汇语义分割基准上,ActiveSAM平均mIoU比当前最优的SegEarth-OV3高1.4,且在大词汇数据集上速度提升高达5.5倍。该方法无需目标数据集训练或权重更新,在图像损坏鲁棒性测试中也表现最强。论文ActiveSAMSAM 3SegEarth-OV3推荐理由:研究者用ActiveSAM让SAM 3分割更快更准,比SegEarth-OV3提升1.4的mIoU,速度快5.5倍,还不用重新训练。原文稍后读已读值得跟进有用关注 ActiveSAM
11:13官方账号arXiv cs.LG@Constanza A. Molina Catricheo, Simon Boeder, Ting-Jia Guo, Giacomo May, Clément Berthelot, Devis Tuia, Friedrich Fedor Reinhard, Fabio Remondino, Benjamin Risse该研究发布了1.4 TB多模态无人机数据集,覆盖104棵含巢树木,包含27,945张RGB图像、111,780张多光谱图像及约7.81亿个3D点。语义分割基准测试中,Point Transformer V3在测试集上达到86.35% mIoU,优于KPConv和RandLA-Net。数据集结合光谱、空间与结构信息,可支持巢体积估计等生态应用,并为极端类别不平衡下的3D分割算法提供挑战性基准。论文NEST3D多模态3D分割推荐理由:生态数据集,3D分割新基准原文稍后读已读值得跟进有用关注 NEST3D