AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

欺骗检测

共 1 条相关 AI 资讯
8月11日
10:48
10:48官方一手arXiv: DeepSeek@David M. Markowitz, Timothy R. Levine
该研究构建了7个基于主流欺骗理论的RAG模型,在5个公开数据集、700条陈述上测试,涉及gpt-4o、claude-sonnet-4-6、ollama/llama3、deepseek-v4-flash四个大模型,共生成39,200次欺骗判断。RAG模型准确率54.5%,基线模型54.6%,两者无显著差异,均与人类水平相当。RAG模型(57.0%)比基线模型(59.7%)更少出现真实性偏差,但效应量很小。不同理论对准确率影响不大,但对响应偏差影响显著,从可验证性方法的32.2%到真相默认理论的88.1%。
论文RAG欺骗检测gpt-4o
事件专题

推荐理由:想看看AI能不能识破谎言?这篇论文用4个模型做了近4万次测试,结论是准确率跟人差不多,但不同理论引导下AI的倾向差异很大。
原文
精选全部日报登录