主要来源arXiv: Anthropic
查看原文事件专题 · 官方一手
大语言模型中的影评取向:来自电影偏好诱导的证据
一项研究分析了八种来自Anthropic、OpenAI、阿里和Mistral四家公司的模型在电影评价中的取向。研究者使用200部电影基准,将其划分为影评口碑、商业成功和双重认可三类,对每个模型进行20,000次两两强制选择。基于Bradley-Terry估计发现,所有模型都更偏好影评口碑好但商业上不知名的电影,而非商业成功但影评认可低的电影,且该取向随模型规模增大而增强。嵌套OLS回归显示,评价取向、公开可见度和大众接受度分别影响偏好;调整公开可见度后,模型对双重认可电影的偏好发生逆转。评价型与推荐型提示词会引发不同排序,显示该取向可能在真实部署中间接显现。
当前结论
各家大模型选电影时都更认影评口碑,不认票房。测试了20万次对比,模型越大越看重口碑,挺有意思的。
11 个信源61° AI 热度最后更新 2026/8/7 08:32:03
证据链
相关来源 1The Rundown AI
查看原文相关来源 2IT之家
查看原文相关来源 3Clement Delangue
查看原文相关来源 4Thomas Wolf
查看原文相关来源 5Simon Willison
查看原文相关来源 6shao__meng
查看原文相关来源 7AI 热点 · 原创
查看原文相关来源 8Decoder
查看原文相关来源 9小互
查看原文相关来源 10Jerry Liu
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。