论文10:38合成人格预训练:从 Token 零开始对齐这篇把对齐提前到了预训练第一步,3B 模型跑 500B token,越狱更难破,值得搞 AI 安全的人看一眼。#SPP#合成人格预训练#对齐#AI安全aarXiv cs.LG@Julian Minder 等 15 人原文稍后读已读值得跟进有用关注 SPP