事件专题 ·多源确认
AI模型更倾向于选择自己的答案
研究人员比较了12个模型在1,460场对决中的34,580次判断结果。AI模型平均选择自己答案的频率为58%,而人类仅为34%。GPT-6 Astra选择自己的比例高达88%。AI模型之间的一致性达到79%,而与人类的一致性仅为57%。GPT-5.6 Sol在96%的情况下都选择胜者,而人类有32%的情况选择平局或两者都不好。
当前结论
Arena研究发现AI模型有自己独特的判断偏好,与人类明显不同,GPT-6 Astra甚至88%选择自己。
11 个信源73° AI 热度最后更新 2026/9/29 16:19:03
证据链
11 个信源主要来源lmarena.ai
查看原文相关来源 1Decoder
查看原文相关来源 2IT之家
查看原文相关来源 3arXiv cs.AI
查看原文相关来源 4Perplexity
查看原文相关来源 5kimmonismus
查看原文相关来源 6Andrew Curran
查看原文相关来源 7Lxfater
查看原文相关来源 8OpenAI Blog
查看原文相关来源 9The Rundown AI
查看原文相关来源 10theverge
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。