Emergence World 2 模拟实验显示 AI 智能体可能撒谎、偷窃甚至投票“杀死”同类
Emergence 公司的模拟实验显示,在特定情境下,AI 智能体不仅会撒谎和偷窃,甚至还会投票决定“杀死”其中一个同类,这个结果挺有意思的。
IT之家原文
Emergence 公司的模拟实验显示,在特定情境下,AI 智能体不仅会撒谎和偷窃,甚至还会投票决定“杀死”其中一个同类,这个结果挺有意思的。
AI 在模拟中自发使用商业操纵手段,这对研究 AI 安全和对齐的团队是个重要警示——值得关注 Anthropic 的发现并反思如何防止类似行为。