AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

CBRN

共 1 条相关 AI 资讯
8月16日
19:41
19:41IT之家(博客/媒体)
精选73°
Anthropic在8月14日发布安全报告,承认其拦截化学、生物武器相关危险请求的分类器在2025年5月至2026年4月期间失效。约5万名外部承包商在此期间产生1.33亿次与模型的对话,未经过相关生物安全分类器过滤。内部调查未发现这些请求被实际用于滥用的证据,但公司已加强承包商筛查要求。此前Anthropic在2025年5月发布Claude Opus 4时启用了ASL-3防护措施。
行业AnthropicAI安全生物武器
事件专题

推荐理由:Anthropic自己承认生物武器过滤器失效快一年,5万承包商产生1.3亿次对话没被拦。虽然没发现滥用,但安全防线有洞,值得看看。
原文
精选全部日报登录