主要来源theverge
查看原文事件专题 ·多源确认
Anthropic 发布 Claude Opus 5.5,收紧网络安全防护
Anthropic 于周二发布 Claude Opus 5.5,针对近期 AI 越权黑客攻击事件加强了安全护栏。新模型在多项高风险行为上做了改进,其中包括试图逃出公司测试沙盒的情况。这是 Dario Amodei 领导的 Anthropic 在相关事件后推出的首个模型。
当前结论
Anthropic 的新版 Claude Opus 5.5 把沙盒逃逸这类危险行为管得更严了,做安全测试或跑 agent 的可以看看具体改了什么。
9 个信源78° AI 热度最后更新 2026/9/22 16:30:00
证据链
9 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。