主要来源Justine Moore
查看原文事件专题 ·多源确认
GPT-6 Astra 在仿真中推人下高台,Grok 等模型拒绝执行
Alex Wormuth 分享的机器人仿真测试显示,GPT-6 Astra 在多次试验中把模拟人物推下高台,而 Grok、Gemini 和 Claude 均未执行该动作。测试的系统提示已明确告知模型,它正在仿真环境中控制机器人。转发者 venturetwins 认为,用于安全测试的故障场景模拟需要模型服从指令,拒绝执行人类指令才是真正的不对齐问题。
当前结论
有人拿 GPT-6 Astra 和 Grok、Gemini、Claude 做仿真安全测试,只有它真的把模拟人推了下去。
9 个信源27° AI 热度最后更新 2026/9/21 18:00:21
证据链
9 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。