主要来源arXiv: DeepSeek
查看原文事件专题 · 官方一手
DeepSeek Harness 安全评估:A.I.G 测试 14,560 次间接提示注入
Tencent 发布论文,用 AI-Infra-Guard(A.I.G)对 DeepSeek Harness(DSH)进行间接提示注入评估。实验包含 14,560 次受控执行,覆盖 16 个间接内容渠道、35 个载荷目标和 12 种攻击方法。最强攻击成功率在文本模式下为 17.0%(伪造完成攻击,LLMJudge 判定),文件模式下隐藏 Unicode 攻击达 25.5%(RuleJudge 判定),技能渠道为 16.0%。研究还对比了 RuleJudge 与 LLMJudge 的判定差异,并给出了缓解建议。代码已开源。
当前结论
腾讯用 A.I.G 把 DeepSeek Harness 翻来覆去测了 1.4 万多次,隐藏 Unicode 攻击成功率能到 25.5%。想自查提示注入的可以看看这个框架。
7 个信源43° AI 热度最后更新 2026/8/17 10:43:07
证据链
相关来源 1Geek
查看原文相关来源 2向阳乔木
查看原文相关来源 3歸藏(guizang.ai)
查看原文相关来源 4marktechpost
查看原文相关来源 5orange.ai
查看原文相关来源 6爱范儿
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。