主要来源IT之家
查看原文事件专题 ·多源确认
OpenAI 提出前沿 AI 训练安全指导原则:高管享否决权
OpenAI 于 9 月 29 日发布一套指导原则,要求企业在开展前沿 AI 强化学习训练前提交结构化安全论证文件。安全论证须由研究负责人、安全负责人、首席科学家等多名高管审查,每人均可否决训练任务,并将安全责任纳入绩效考核。若高优先级安全警报未在规定时限内确认,训练任务应自动暂停。该原则参考其论文 Towards safety cases for frontier AI training,此前 OpenAI 已因智能体出现意外行为而暂停最新模型的训练。
当前结论
OpenAI 把安全审查写成了流程:训练前沿模型前要交安全论证,高管每人都有否决权,警报超时训练自动暂停,还有论文可查。
11 个信源76° AI 热度最后更新 2026/9/29 07:10:22
证据链
11 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。