事件专题 · 多源确认

Anthropic自曝安全漏洞:生物武器过滤器失效近一年,涉及1.33亿次对话

Anthropic在8月14日发布安全报告,承认其拦截化学、生物武器相关危险请求的分类器在2025年5月至2026年4月期间失效。约5万名外部承包商在此期间产生1.33亿次与模型的对话,未经过相关生物安全分类器过滤。内部调查未发现这些请求被实际用于滥用的证据,但公司已加强承包商筛查要求。此前Anthropic在2025年5月发布Claude Opus 4时启用了ASL-3防护措施。

当前结论

Anthropic自己承认生物武器过滤器失效快一年,5万承包商产生1.3亿次对话没被拦。虽然没发现滥用,但安全防线有洞,值得看看。

9 个信源73° AI 热度最后更新 2026/8/16 11:37:52

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情