09:07官方账号arXiv cs.LG@Smitha Muthya Sudheendra, Jaideep Srivastava精选73°研究者在五个开源transformer模型中测试逻辑验证能力,使用有效-无效前提-声明对。尽管行为表现接近随机水平,逻辑有效性仍可从隐藏状态中完美解码。在保留模板、领域和推理家族条件下,有效性仍保持强可解码性。在行为不正确但评估条件明确的例子中,有效性仍高度可解码。论文transformer逻辑推理语言模型推荐理由:这篇论文揭示了语言模型内部逻辑表示与行为表达的分离现象,对理解LLM推理机制有重要价值。原文稍后读已读值得跟进有用关注 transformer