10:31官方账号arXiv cs.AI@Taenyun Kim, Edyta Bogucka, Daniele Quercia一项针对道德AI偏好诱导的研究显示,开发者在特征范围、选民抽样、问题框架三个环节的隐性选择会显著改变聚合出的道德偏好。研究分两个阶段,共809名参与者,覆盖AI肾脏分配、AI代理模拟缺勤工人、生成式AI描绘逝者三个场景。结果显示,道德相关特征在不同场景间不可直接迁移;约三分之一特征的偏好随政治意识形态不同而改变,部分方向相反。问题措辞的差异可使意识形态差距扩大或缩小最多一个完整刻度点。研究者认为,仅靠投票聚合无法实现公平透明的AI对齐,每个环节都应被审计和公开。论文AI对齐道德偏好偏好诱导推荐理由:这篇研究用809人和3个场景,实锤了AI道德投票不中立,开发者的三处选择就能改变结果,做AI治理的别错过。原文稍后读已读值得跟进有用关注 AI对齐