论文10:58MemSecBench:追踪智能体记忆从持久化到后果与修复的中毒过程这篇论文搞了个MemSecBench,专门测AI记忆会不会被黑,结果84%的案例恶意记忆都能长存,而且不同记忆系统差别很大,做AI安全的朋友应该看看。#MemSecBench#智能体安全#记忆中毒#基准测试aarXiv cs.AI@Xuanze Chen 等 6 人原文稍后读已读值得跟进有用关注 MemSecBench
论文15:13LLM Agent记忆中毒检测的取证轨迹签名这篇论文发现了一个简单规律就能检测AI Agent的记忆中毒攻击,准确率高达99%,还能区分不同攻击类型,非常实用。#LLM Agent#记忆中毒#行为检测#GPT-4.1aarXiv cs.LG@Jun Wen Leong原文稍后读已读值得跟进有用关注 LLM Agent