论文12:04HarmAmp & TrajSafe:应对LLM多轮对话中的危害放大多轮对话中的危害放大是LLM安全部署的盲区,做AI安全或内容审核的团队可以关注HarmAmp基准和TrajSafe方案,直接用于评估和加固自己的模型。#LLM安全#多轮对话#危害放大#HarmAmpaarXiv cs.LG@Ruohao Guo 等 3 人原文稍后读已读值得跟进有用关注 LLM安全