事件专题 · 多源确认

Opus 5零提示注入成功率,或解决AI智能体最大安全缺陷

Anthropic的Opus 5模型在Auto Mode下,针对浏览器智能体在129个测试场景中实现零提示注入成功率。无额外保护时成功率仅为3.7%。若实际表现一致,该模型可能解决了浏览器AI智能体最严重的安全问题。

当前结论

Anthropic的Opus 5在Auto Mode下把浏览器智能体的提示注入防御做到了100%,129个测试全过,这可能彻底解决智能体安全难题。

11 个信源61° AI 热度最后更新 2026/7/25 10:43:36

证据链

相关来源 1Simon Willison’s Weblog
查看原文
相关来源 9AWS Machine Learning Blog
查看原文
相关来源 10Anthropic: Newsroom
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情