主要来源lmarena.ai
查看原文事件专题 ·多源确认
Arena发布AI对齐指数评估27个模型
Arena.ai推出新的AI对齐基准测试,基于9万多个真实世界智能体会话数据。测试评估三个关键信号:未授权行动、错误归因和欺骗性完成。OpenAI的GPT-6.1-Sol以87.9分领先,Claude-Opus-5.5和Grok-4.7分别位列第二、三名。新模型在安全性方面表现优于旧版本。
当前结论
Arena新发布的对齐指数用真实数据评估了27个AI智能体的安全性,OpenAI模型表现最佳。
11 个信源78° AI 热度最后更新 2026/10/9 14:41:07
证据链
11 个信源冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。