cybergym·general

CyberGym

别名
首次出现
2026-05-22
最近出现
2026-07-29
累计提及
33
§ 01综述

CyberGym 近期进展

CyberGym 是什么

CyberGym 是一个专注于AI安全领域的基准测试平台,旨在评估AI模型在网络安全场景下的表现。

CyberGym 近期进展

  • 阿图因 AI 在 CyberGym 测试中超过 Mythos,但两者不可简单对比:阿图因 AI 在 CyberGym 测试中取得了优异成绩,但其与 Mythos 的对比并不简单。
  • 中国AI团队MopMonk闯入CyberGym安全基准全球第七:MopMonk 团队的 AI 模型在 CyberGym 安全基准测试中排名全球第七。
  • GPT-5.5-Cyber 在 CyberGym 击败 Mythos 5,申请权限开放:GPT-5.5-Cyber 在 CyberGym 测试中击败了 Mythos 5,并已开放申请权限。
  • OpenAI推出GPT-5.5-Cyber安全专用模型,CyberGym得分85.6%超Claude Mythos 5:OpenAI 推出的 GPT-5.5-Cyber 在 CyberGym 上的得分达到了 85.6%,超过了 Claude Mythos 5。
  • 当前焦点与观察点

    CyberGym 作为 AI 安全领域的重要基准测试平台,其测试结果受到广泛关注。当前焦点在于不同 AI 模型的性能比较,以及如何提高 AI 在网络安全场景下的应用效果。同时,OpenAI 和微软等大公司的参与,使得 CyberGym 的发展备受期待。

    § 02相关报道10 条在档
    1. 01
      Wiz公布漏洞挖掘系统Atlas:多AI智能体协作已发现超200漏洞
      IT之家
    2. 02
      微软发布MAI-Cyber-1-Flash:5B活跃参数网络防御模型,MDASH在CyberGym达95.95%
      marktechpost
    3. 03
      纳德拉官宣微软首个AI安全模型MAI-Cyber-1-Flash,跑分超Mythos 5和GPT-5.5 Cyber
      IT之家
    4. 04
      微软发布网络安全模型MAI-Cyber-1-Flash,复杂任务仍依赖OpenAI
      Decoder
    5. 05
      微软发布首个网络安全模型MAI-Cyber-1-Flash,基准得分96%
      The Rundown AI
    6. 06
      MAI-Cyber-1-Flash 可处理 90% 漏洞检测任务
      Mustafa Suleyman
    7. 07
      MAI-Cyber-1-Flash模型搭配MDASH在CyberGym基准达96%,成本减半
      Mustafa Suleyman
    8. 08
      Sakana AI 发布 Fugu-Cyber:CyberGym 86.9%,CTI-REALM 72.1%
      marktechpost
    9. 09
      Google AI发布Gemini 3.5 Flash Cyber,专注网络安全漏洞修复
      Google AI
    10. 10
      Sakana AI推出网络安全模型Fugu Cyber,基准测试胜GPT-5.5-Cyber
      IT之家
    § 03邻近话题

    本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

    /topic/CyberGym