19:41IT之家(博客/媒体)精选73°Anthropic在8月14日发布安全报告,承认其拦截化学、生物武器相关危险请求的分类器在2025年5月至2026年4月期间失效。约5万名外部承包商在此期间产生1.33亿次与模型的对话,未经过相关生物安全分类器过滤。内部调查未发现这些请求被实际用于滥用的证据,但公司已加强承包商筛查要求。此前Anthropic在2025年5月发布Claude Opus 4时启用了ASL-3防护措施。行业AnthropicAI安全生物武器8 个信源在谈事件专题推荐理由:Anthropic自己承认生物武器过滤器失效快一年,5万承包商产生1.3亿次对话没被拦。虽然没发现滥用,但安全防线有洞,值得看看。原文稍后读已读值得跟进有用关注 Anthropic