论文精选13:27人格模型崩溃:微调导致大模型角色分化失控做AI安全和对齐的研究者、模型微调工程师值得关注——这项研究用两个量化指标揭示了有害微调如何让模型角色扮演能力崩溃,比单纯看输出内容更早发现问题。建议点开看看指标计算方法。#涌现性失调#人格模型崩溃#模型对齐#微调安全aarXiv: DeepSeek@Davi Bastos Costa, Renato Vicente原文稍后读已读值得跟进有用关注 涌现性失调