#大推理模型
共 3 条 · 7 天 0 条 · 30 天 0 条
信息流里打上「大推理模型」标签的资讯、产品与论文,按刊登时间排,新的在上。
7月21日
6月16日
论文10:49
Safe Trigger: 触发大推理模型的潜在安全意识实现自适应安全这篇论文发现LRM自己就能识别风险,用SFT+DPO触发安全分析,让DeepSeek-R1的越狱成功率高降36%,还不用外部数据,挺实用的。
5月15日
这篇论文发现LRM自己就能识别风险,用SFT+DPO触发安全分析,让DeepSeek-R1的越狱成功率高降36%,还不用外部数据,挺实用的。