论文多源确认73°00:21OpenAI 新论文:用RL训练好行为也能泛化,提升模型诚实与可纠正性OpenAI 这篇论文很有意思:用 RL 给模型‘教好’会泛化到所有领域,而且抗忽悠能力变强了,像给人打了一剂道德疫苗。#OpenAI#RL#对齐#AI安全9 个信源在谈事件专题orange.ai@oran_ge10 个信源在谈原文稍后读已读值得跟进有用关注 OpenAI