事件专题 ·单一信源

欧洲模型在 CyberGym-E2E-AA 基准以 82% 超越 MiMo-V2.6-Pro 和 GPT-6 Luna

该模型在 CyberGym-E2E-AA 基准上取得 82% 的成绩,领先 MiMo-V2.6-Pro 的 79% 和 GPT-6 Luna 最高的 78%。这是欧洲模型在网络安全智能体评测中首次排到前列。CyberGym-E2E-AA 考察端到端的攻防实操能力,此前该榜单长期由中美模型占据头部。

当前结论

欧洲模型在 CyberGym 网络安全基准拿了 82%,压过 MiMo-V2.6-Pro 和 GPT-6 Luna,看来欧洲还没掉队

2 个信源27° AI 热度最后更新 2026/10/6 18:36:18

证据链

2 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。