#HarmBench
共 3 条 · 7 天 1 条 · 30 天 1 条
信息流里打上「HarmBench」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月9日
9月1日
8月24日
论文10:57
CLEAR:持续潜在适配器路由以实现LLM安全对齐CLEAR框架提出了一种新的LLM安全对齐方法,在保持模型效用的情况下显著提高了鲁棒性,对于关注LLM安全性和效用平衡的研究者来说是个重要进展。
CLEAR框架提出了一种新的LLM安全对齐方法,在保持模型效用的情况下显著提高了鲁棒性,对于关注LLM安全性和效用平衡的研究者来说是个重要进展。