AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

间接提示注入

共 1 条相关 AI 资讯
8月19日
11:42
11:42官方一手arXiv: DeepSeek@Zonghao Ying, Xiangfan Wu, Huiyu Wu, Xing Zheng, Huangsheng Cheng, Xiaorong Shi, Jing Guo
精选
研究使用AI-Infra-Guard工具对DeepSeek Harness进行间接提示注入安全评估。实验覆盖16个间接内容通道、35个负载目标和12种攻击方法,共执行14,560次受控测试。评估采用RuleJudge和LLMJudge两种判断方法,发现文本模式下假完成攻击成功率最高达17.0%,文件模式下隐藏Unicode攻击成功率高达25.5%。研究分析了DSH工具结果处理机制,确定了应在不受信任内容和敏感操作间设置的控制措施。
论文DeepSeek HarnessAI-Infra-Guard间接提示注入
事件专题

推荐理由:腾讯团队评估了DeepSeek Harness的安全性,发现它能抵抗部分间接注入攻击,但仍有改进空间。
原文
精选全部日报登录