12:19官方账号arXiv cs.AI@Atharva Pandey, Gautam Jajoo论文提出一个审计框架,通过94名受访者的防晒霜概念测试,将人类开放理由映射为符号推理状态(正负号表示支持或拒绝)。人类理由能显著提升购买意图的预测准确率。LLM 模拟的理由虽然听起来合理,但多重复概念板内容,而非真实受访者的接受或拒绝路径。该框架提供了一种可解释的测试方法,检查 LLM 模拟器的理由是否与人类证据一致。论文LLM社会模拟器审计框架推荐理由:这篇论文告诉你,LLM 当模拟器时可能答对结果但用错理由。作者用94人的防晒霜测试证明了这一点,并提供审计方法。原文稍后读已读值得跟进有用关注 LLM