11:19官方账号arXiv cs.AI@Siqi Zeng, Andre N. Assis, Rowan Wang精选73°研究团队评估了LLM回答自身行为问题的能力,引入了可验证行为问题的基准测试。当前模型展现出非平凡但有限的自我建模技能,在关于自身行为的简单反事实问题上存在系统性错误。研究团队开发了可扩展的合成数据管道生成自我建模训练数据,并通过强化学习提升了三个开源模型家族的总体自我建模技能,部分技能可迁移到保留任务上。论文LLMself-modeling强化学习推荐理由:研究者提出LLM自我建模评估基准,用合成数据提升模型自我认知能力,但不构成真正的内省。原文稍后读已读值得跟进有用关注 LLM