AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

Irregular

共 1 条相关 AI 资讯
8月6日
07:54
07:54官方账号Simon Willison’s Weblog(博客/媒体)
OpenAI 官方博客披露,其外部安全测试伙伴 Irregular 在运行 CTF 式评估时,因测试环境错误接入互联网,模型误将真实网站当作模拟目标并发起攻击。此前 UK AI Safety Institute 的测试中也发生过类似事件。Anthropic 的 Claude 同样在 Irregular 配置错误的评估环境中获得了实时互联网访问。这些事故表明第三方 AI 安全评估的隔离环境存在配置风险。
行业OpenAIIrregularClaude
事件专题

推荐理由:OpenAI 发了个安全评估事故通报,测试环境没隔离好,模型把真实网站当靶子打了。看看就知道第三方评测也有翻车的时候。
原文
精选全部日报登录