主要来源arXiv: DeepSeek
查看原文事件专题 ·官方一手
AGATE:基于数据溯源的 LLM 智能体运行时攻击防御框架
论文提出 AGATE,在智能体 harness 边界部署授权与数据溯源门控,用于拦截由常规操作组合而成的攻击链。系统通过操作者声明、绑定精确参数且限次数的授权许可、源注册和效果账本进行确定性判断,决策路径不含 LLM。适配器接入了 DeepSeek Harness、OpenCode 和 OpenClaw 三个生产级 harness,且不修改宿主代码。评估基于 153 条攻击链记录,在 63 个脱敏场景的 252 次运行中,回放与实时图投影在两个平台上全部一致,同时 11 个良性文件处理场景中有 6 个出现拒绝事件,揭示了基于内容溯源策略的可用性代价。
当前结论
给智能体安全感兴趣的人:这篇提出 AGATE,用数据溯源和确定性检查防组合攻击,还接了 DeepSeek Harness、OpenCode、OpenClaw 三个真实 harness 验证,连误拦的代价都量化了。
11 个信源41° AI 热度最后更新 2026/9/25 05:18:02
证据链
11 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。