论文精选73°09:07语言模型逻辑有效性研究这篇论文揭示了语言模型内部逻辑表示与行为表达的分离现象,对理解LLM推理机制有重要价值。#transformer#逻辑推理#语言模型#隐藏状态aarXiv cs.LG@Smitha Muthya Sudheendra, Jaideep Srivastava原文稍后读已读值得跟进有用关注 transformer
论文精选73°10:17几何发散:追踪隐藏状态轨迹实现自适应多轮推理这篇论文用几何方法追踪LLM推理轨迹,能提前发现错误路径,提升任务成功率还降低token成本。#LLM#多轮推理#隐藏状态#τ-BenchaarXiv cs.AI@Jie Liang 等 4 人原文稍后读已读值得跟进有用关注 LLM
论文12:10D-Score:大语言模型中基于谱分析的隐藏状态幻觉检测信号这篇论文给出一个简单检测幻觉的方法,只靠模型内部的隐藏状态算一个分数,不用外部工具,在FAVA和RAG上验证有效。#D-Score#FAVA-Annotation#RAGTruth#幻觉检测aarXiv cs.AI@Bianca Raimondi 等 4 人原文稍后读已读值得跟进有用关注 D-Score
论文11:11Qwen3代码正确性在隐藏状态中的可解码性论文揭示Qwen3隐藏状态如何预测代码正确性#Qwen3#代码正确性#隐藏状态#LiveCodeBenchaarXiv cs.LG@Carlo Di Cicco原文稍后读已读值得跟进有用关注 Qwen3