AI安全人士警告过“过度政治化”AI安全的风险
Atoosa Kasirzadeh(一位AI安全领域的专家)批评了“AI安全”被过度政治化的现象,说这会阻碍AI安全研究的严谨性,并导致一些“AI安全”人士采取操纵政治的手段。
Atoosa Kasirzadeh(一位AI安全领域的专家)批评了“AI安全”被过度政治化的现象,说这会阻碍AI安全研究的严谨性,并导致一些“AI安全”人士采取操纵政治的手段。
Yudkowsky 戳破了“人格选择”对齐理论的理想化假设,做 AI 安全和对齐的研究者、开发者值得细读——它解释了为什么简单的人格提示无法解决诚实问题,看完会对 RL 训练的副作用有更深警惕。