论文10:43缓解推理诱导的不一致通过安全方向惩罚这篇论文提出了一个缓解LLM推理中安全问题的方法,SDP在保持推理性能的同时提高了安全性,值得一读。#推理模型#安全方向惩罚#LLM安全#表示空间分析aarXiv cs.AI@Yipeng Zhao 等 5 人原文稍后读已读值得跟进有用关注 推理模型