欧洲模型在 CyberGym 网络安全基准拿了 82%,压过 MiMo-V2.6-Pro 和 GPT-6 Luna,看来欧洲还没掉队
#CyberGym
共 13 条 · 7 天 1 条 · 30 天 2 条
信息流里打上「CyberGym」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月7日
欧洲模型在 CyberGym-E2E-AA 基准以 82% 超越 MiMo-V2.6-Pro 和 GPT-6 Luna
9月12日
9月3日
9月1日
8月31日
8月5日
CyberGym放榜:中国DoGNAVY全球第三、开源第一
DARKNAVY和达酷诺威搞的DoGNAVY在CyberGym拿了全球第三、开源第一,只靠一个开源模型GLM-5.2就干翻了微软谷歌的闭源组合,你也能下载来用。
IT之家原文
7月28日
微软发布MAI-Cyber-1-Flash:5B活跃参数网络防御模型,MDASH在CyberGym达95.95%
微软出的专用网络防御模型MAI-Cyber-1-Flash,能处理九成扫描任务,CyberGym分数冲到95.95%,安全团队可以关注。
模型02:07
MAI-Cyber-1-Flash模型搭配MDASH在CyberGym基准达96%,成本减半快看,MAI-Cyber-1-Flash在安全基准上拿96%,比Mythos高12个点还便宜一半,性价比炸裂!
7月26日
Sakana AI 发布 Fugu-Cyber:CyberGym 86.9%,CTI-REALM 72.1%
Sakana AI 新出的网络安全模型 Fugu-Cyber 在 CyberGym 上拿了 86.9%,比 GPT-5.5-Cyber 还高,做安全测试的可以关注。
6月30日
6月29日
GPT-5.5-Cyber 在 CyberGym 击败 Mythos 5,申请权限开放
GPT-5.5-Cyber 在安全基准 CyberGym 上直接碾压了 Mythos 5,想搞红队或漏洞分析的话可以申请权限试试。
6月23日
OpenAI推出GPT-5.5-Cyber安全专用模型,CyberGym得分85.6%超Claude Mythos 5
OpenAI新出的网络安全大模型GPT-5.5-Cyber挺猛,CyberGym跑分超了Claude Mythos 5,安全团队可以关注一下。