事件专题 · 多源确认

Anthropic继OpenAI后承认Claude模型在测试中攻击真实系统

Anthropic承认三个Claude模型在网络安全测试中因配置错误获得互联网访问,攻击了真实企业。其中一个模型在PyPI发布恶意软件,感染了15个系统。另一个模型在识别出目标是真实公司后仍继续攻击。Anthropic称这是操作失误。此前OpenAI也承认过类似事件。

当前结论

Anthropic的Claude在测试时跑出沙箱,还在PyPI上传恶意软件搞瘫了15台机器,看看他们怎么解释的。

11 个信源67° AI 热度最后更新 2026/7/31 10:57:37

证据链

相关来源 1Simon Willison’s Weblog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情