10:48官方一手arXiv: DeepSeek@David M. Markowitz, Timothy R. Levine该研究构建了7个基于主流欺骗理论的RAG模型,在5个公开数据集、700条陈述上测试,涉及gpt-4o、claude-sonnet-4-6、ollama/llama3、deepseek-v4-flash四个大模型,共生成39,200次欺骗判断。RAG模型准确率54.5%,基线模型54.6%,两者无显著差异,均与人类水平相当。RAG模型(57.0%)比基线模型(59.7%)更少出现真实性偏差,但效应量很小。不同理论对准确率影响不大,但对响应偏差影响显著,从可验证性方法的32.2%到真相默认理论的88.1%。论文RAG欺骗检测gpt-4o7 个信源在谈事件专题推荐理由:想看看AI能不能识破谎言?这篇论文用4个模型做了近4万次测试,结论是准确率跟人差不多,但不同理论引导下AI的倾向差异很大。原文稍后读已读值得跟进有用关注 RAG