11:58官方账号arXiv cs.AI@Elias Fernández Domingos, The Anh Han研究通过一个理想化AI竞赛的行为实验,探讨竞争压力对不安全开发的影响。参与者成对重复选择安全或不安全开发,不安全开发提供更快进度但积累个人风险,最大风险分别设为10%、60%、90%。数据发现,不安全行为更多受战略状态影响而非风险偏好:参与者更可能在对手选择不安全后跟进,落后时增加不安全选择。研究引入四种策略的进化模型,再现了实验效应,说明竞争动态可能偏好条件性不安全行为。论文AI安全AI竞赛行为实验推荐理由:这篇论文用实验证明AI竞赛中不安全开发不是单纯的风险偏好问题,而是竞争压力让你不得不跟——别人都冲了你敢不冲吗?读起来挺有意思。原文稍后读已读值得跟进有用关注 AI安全