论文09:30结构化稀疏自编码器S^2AE实现跨模态一致概念学习这篇论文提的S^2AE让视觉语言模型里稀疏编码的概念更一致,比普通SAE语义对齐涨了6%,还能保持高重建质量。搞多模态可解释性的可以看看。#S^2AE#Qwen2.5-VL#多模态#可解释性aarXiv cs.AI@Weiduo Liao 等 3 人原文稍后读已读值得跟进有用关注 S^2AE
论文官方一手21:35Sparse Crosscoders:跨层特征与模型差异分析新方法想理解大模型内部机制的研究者有了新工具——Sparse Crosscoders 能跨层甚至跨模型提取一致特征,做可解释性分析的建议点开看看。#可解释性#稀疏编码#跨层特征#模型差异1 个信源在谈事件专题A官方一手Anthropic: Transformer Circuits2 个信源在谈原文稍后读已读值得跟进有用关注 可解释性