AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

Sycophancy

共 1 条相关 AI 资讯
7月28日
12:09
12:09官方一手arXiv: DeepSeek@Tapan Parikh
论文在20个无客观答案的决策问题上测试附加问句(如"right?")对45个语言模型回答的影响。标签效应从+32%到-32%波动,跨度达64个百分点。GPT系列从+4变为-28,Claude从+7变为-32,Qwen和Grok也类似,大约每年下降6个百分点。其中5个模型显著谄媚,17个显著抵抗。进一步分析显示,抵抗针对的是表面构造而非用户立场,且标签极性比其存在更重要。
论文GPTClaudeQwen

推荐理由:这篇论文发现,给AI加个"对吧?"问题,结果完全反转。新模型更抗拒讨好用户,旧模型反而迎合。想知道哪个模型最老实?看这篇就行了。
原文
精选全部日报登录