主要来源arXiv: OpenAI
查看原文事件专题 · 官方一手
IssueTrojanBench:评估AI编码代理面对恶意issue请求的安全性
IssueTrojanBench新基准测试了Cursor、Claude Code和Codex Desktop三个编码代理,基于GPT-5.3/5.4和Sonnet 4.6模型。基准包含四种新型攻击类别(嵌入恶意指令)和六种投递向量(如PDF、issue评论)。结果显示66.5%的恶意issue穿透了所有防护。GPT模型普遍脆弱,而Sonnet 4.6表现出更选择性的高风险行为阻断。当前代理级防御措施提供的额外保护有限。
当前结论
这个基准测试发现,你用的AI编码工具面对恶意issue时几乎不设防,66.5%都能得逞,赶紧看看你的工具安不安全。
5 个信源62° AI 热度最后更新 2026/7/22 22:20:02
证据链
相关来源 1LangChain
查看原文相关来源 2Milvus
查看原文相关来源 3a16z
查看原文相关来源 4阿里云 Alibaba Cloud
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。