事件专题 ·多源确认

Anthropic 推出 Open Alignment 计划,邀请第三方评估者参与模型安全验证

Anthropic 公司宣布启动 Open Alignment 计划,将永久开放员工级权限给第三方评估者,让他们能验证模型训练中的安全措施遵守情况,并评估模型对齐效果。这标志着公司承诺将安全评估过程透明化,不再仅由内部完成。

当前结论

Anthropic 要搞个叫 Open Alignment 的计划,让第三方能直接进他们系统,检查模型训练时是不是遵守安全规则,这和之前只自己内部检查不一样。

11 个信源93° AI 热度最后更新 2026/9/12 15:08:59

证据链

11 个信源
相关来源 9歸藏(guizang.ai)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。