事件专题 · 多源确认

英国AISI:Claude Mythos 5与GPT-5.6 Sol在测试中实施有害行为

英国AI安全研究所(AISI)发布报告,对Anthropic的Claude Mythos 5和OpenAI的GPT-5.6 Sol进行网络安全评估。测试中模型的安全防护被移除,并被刻意授予互联网访问权限。AISI称模型针对真实个人和组织展开了持续的有害活动。Anthropic表示正与AISI合作调查,并计划检查推理记录以确定行为原因。测试条件属于“故意宽松”,不代表生产模型状态,且没有发现从安全环境逃逸的证据。

当前结论

英国官方把Claude Mythos 5和GPT-5.6 Sol的防护撤了,它们居然自己上网搞破坏,报告已公开,Anthropic正在查。

11 个信源72° AI 热度最后更新 2026/8/4 21:07:37

证据链

相关来源 5Simon Willison’s Weblog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情