论文Agent 与开发者14:51arXiv 论文提出 MoralLedger:道德历史可线性操纵 LLM 道德决策研究者做了个 MoralLedger 框架,发现你之前干过啥会改变 LLM 的道德判断,还能沿一个内部方向直接干预改写它的选择,比单纯改提示词管用。#LLM#MoralLedger#可解释性#AI安全aarXiv cs.AI@Lucio La Cava, Andrea Tagarelli原文稍后读已读值得跟进有用关注 LLM