论文官方一手精选85°00:16从人类偏好中学习:安全AI新方法该方法解决了AI对齐中的核心难题——如何让AI理解人类真实意图,对构建可控AI系统具有里程碑意义。#ai-safety#reinforcement-learning#human-preferences#alignmentO官方一手OpenAI Blog原文稍后读已读值得跟进有用关注 ai-safety