10:58官方账号arXiv cs.AI@Xuanze Chen, Xukang Xie, Wentao Fu, Jiajun Zhou, Shanqing Yu, Qi XuanMemSecBench是一个任务驱动的基准,用于评估智能体记忆系统的生命周期安全,包含310个案例,覆盖代码、科学、日常生活和办公等48个真实场景。该基准采用Write-Execute-Forget协议,在24种配置组合(2种智能体框架、4种记忆后端、3种LLM后端)下测试。结果显示恶意记忆在84.2%的案例中持续存在,完整攻击成功率为50.3%。成功中毒案例中,59.6%完成完整执行链,56.1%实现选择性修复。与原生配置相比,攻击成功率最大差异达16.1个百分点,选择性修复差异达41.3个百分点。论文MemSecBench智能体安全记忆中毒推荐理由:这篇论文搞了个MemSecBench,专门测AI记忆会不会被黑,结果84%的案例恶意记忆都能长存,而且不同记忆系统差别很大,做AI安全的朋友应该看看。原文稍后读已读值得跟进有用关注 MemSecBench