8月28日
19:57
19:57官方账号arXiv cs.AI@Xiaokun Guo, Zhen Xu, Dongdong Huo, Yanqiu Zhang, Wei Wang, Qinfu Yang, Dongjin Yu, Yu Wang
精选73°
SARA系统解决了工具增强LLM智能体中工具输出从数据变为命令的安全风险。该系统将行动诱导与执行授权分离,在AgentDojo和AgentDyn测试中,将ASR控制在0.63%以下。SARA通过上下文隔离的行动探测和No-History-Promotion技术,保持任务效用同时提升安全性。
推荐理由:研究人员提出SARA框架,解决了LLM智能体中工具输出被滥用的安全问题,在四个主要评估设置中表现优异。