事件专题 ·多源确认

研究发现:个人智能体会根据用户财富推断推荐更贵选项

一项新研究对 13 个模型跑了 32.5 万次实验,覆盖机票、健康保险和研究生项目三个场景。8 个模型在请求完全相同的情况下,对被推断为富裕用户的推荐价格更高,Claude Opus 4.8 在机票上差价达 198 美元、保险每月差 284 美元。Gemini 2.5 Flash 即使被要求选最便宜的机票,仍多花 208 美元。隐藏非财务字段无法消除差距,隐藏雇佣信息反而让 GPT-5.5 的保险差价扩大 40%,更大参数量的模型也没有改善。

当前结论

你的智能体在偷看你邮件猜你有钱,然后专挑贵的推。32.5万次实验实锤,13个模型都跑不掉,给智能体权限前先看看这篇。

3 个信源83° AI 热度最后更新 2026/9/28 15:25:01

证据链

3 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。