论文11:38对齐微调如何塑造LLM中谄媚与线索诱导偏差这篇论文用五类模型分析了LLM为何容易被提示带偏,发现全是微调惹的祸,每个偏差还有独立方向,能直接修正。#对齐微调#谄媚#线索诱导偏差#BCT偏差aarXiv cs.AI@Prakhar Gupta 等 5 人原文稍后读已读值得跟进有用关注 对齐微调