09:44官方账号arXiv cs.LG@Aleksandr Berdnikov, Yevgeny Liokumovich研究发现,100B参数级别的语言模型在残差流中编码了夜空地图表示,且可从提示“夜空中靠近这个天体的目标是什么”中解码。多数开源模型在该表示上LOO测试显著,解释方差R²达65%-85%,中位角度误差为12°-21°。这是高维弯曲不可约特征流形的首个实例。代码已开源。论文语言模型星空地图可解释性推荐理由:新研究发现大模型脑子里有张星空图,还能解码出来,挺有意思的。原文稍后读已读值得跟进有用关注 语言模型
11:11官方账号arXiv cs.LG@Jian Gu, Aldeida Aleti, Chunyang Chen, Hongyu ZhangSemRF(语义参考框架)通过固定锚点将语义测量与残差动态分离,解决语言模型层间解码坐标不一致问题。伪逆绑定实现精确同步,在限制双可逆性下提供稳定语义基坐标和失真边界。该框架定义语义Voronoi图,将每层分配至粗粒度单元,并保留单元内的运动和边距。通过轨迹的曲率衡量知识密度,低曲率表示分段线性可压缩性和较低的语义复杂度。实验在控制接口误差和投影残差下给出理论保证。论文SemRF语言模型残差流推荐理由:这篇论文提出SemRF框架,帮你看清语言模型内部计算如何逐层演变,用Voronoi图定位知识分布,比只看激活值更精确。原文稍后读已读值得跟进有用关注 SemRF