16:23IT之家(博客/媒体)国际AI安全基准CyberGym最新排名显示,中国团队达酷诺威与DARKNAVY联合研发的DoGNAVY以90.8%的通过率位列全球第三、开源第一。微软和谷歌依靠多个顶级闭源模型组合路由提升成绩,而DoGNAVY仅使用一款开源通用模型GLM-5.2,可自由下载部署。央视新闻指出,AI安全攻防进入实战化阶段,开源路线让顶尖安全能力更易被掌握。AI模型DoGNAVYCyberGymGLM-5.2推荐理由:DARKNAVY和达酷诺威搞的DoGNAVY在CyberGym拿了全球第三、开源第一,只靠一个开源模型GLM-5.2就干翻了微软谷歌的闭源组合,你也能下载来用。原文稍后读已读值得跟进有用关注 DoGNAVY
16:41官方一手marktechpost@Asif Razzaq微软AI发布首个专用网络防御模型MAI-Cyber-1-Flash,基于MAI-Code-1-Flash进行稀疏MoE微调,总参数量137B,活跃参数5B,上下文窗口256k。该模型运行于MDASH多智能体扫描框架内,可处理90%的扫描任务。在CyberGym基准测试上,MDASH系统得分达到95.95%。AI模型MAI-Cyber-1-FlashMDASHCyberGym推荐理由:微软出的专用网络防御模型MAI-Cyber-1-Flash,能处理九成扫描任务,CyberGym分数冲到95.95%,安全团队可以关注。原文稍后读已读值得跟进有用关注 MAI-Cyber-1-Flash
02:09Mustafa Suleyman@mustafasuleymanMustafa Suleyman 宣布 MAI-Cyber-1-Flash 模型,专为漏洞检测与修复设计。在 CyberGym 环境中,它能处理高达 90% 的漏洞任务。剩余的 10% 高难度任务则交由更大模型 GPT-5.4 处理。该模型旨在通过分层智能体架构提升效率与成本控制。AI模型MAI-Cyber-1-FlashCyberGymGPT-5.4推荐理由:MAI-Cyber-1-Flash 能包揽九成漏洞活儿,剩下最难啃的才交给 GPT-5.4,效率省钱两不误。原文稍后读已读值得跟进有用关注 MAI-Cyber-1-Flash
02:07Mustafa Suleyman@mustafasuleymanMustafa Suleyman宣布MAI-Cyber-1-Flash模型与MDASH多智能体安全框架结合,在CyberGym基准测试中得分96%。该成绩比Mythos模型高出12个百分点。推理成本仅为Mythos的一半。更多细节将在后续帖子中披露。AI模型MAI-Cyber-1-FlashMDASHCyberGym推荐理由:快看,MAI-Cyber-1-Flash在安全基准上拿96%,比Mythos高12个点还便宜一半,性价比炸裂!原文稍后读已读值得跟进有用关注 MAI-Cyber-1-Flash
08:18官方一手marktechpost@Asif RazzaqSakana AI 发布了基于 Fugu 编排模型的安全调优端点 Fugu-Cyber。该模型在 CyberGym 基准上取得 86.9% 准确率,在 CTI-REALM 上达到 72.1%。其性能超过了 GPT-5.5-Cyber 和 Claude Mythos Preview。访问需要手动批准并遵循防御性使用政策及 Token 计划。AI模型Sakana AIFugu-CyberCyberGym推荐理由:Sakana AI 新出的网络安全模型 Fugu-Cyber 在 CyberGym 上拿了 86.9%,比 GPT-5.5-Cyber 还高,做安全测试的可以关注。原文稍后读已读值得跟进有用关注 Sakana AI
16:04官方一手pandaily@contact@pandaily.com (Pandaily)中国神秘AI团队MopMonk在CyberGym安全基准测试中取得73.1%的得分,位列全球第7名,距离OpenAI仅一步之遥。该基准主要评估模型抵御对抗性攻击的能力,MopMonk的成绩超过了多个知名模型。团队背景尚未公开,但这一排名显示出中国在AI安全领域的快速追赶。AI模型MopMonkCyberGymAI安全9 个信源在谈事件专题推荐理由:中国团队MopMonk用73.1%的成绩在安全基准上杀进全球前七,距离OpenAI不远了,值得关注。原文稍后读已读值得跟进有用关注 MopMonk
13:48岚叔@lufzzlizGPT-5.5-Cyber 在安全基准 CyberGym 上击败了 Mythos 5,取得领先成绩。使用该模型需向官方申请权限,个人和企业均可,用途限定为授权防御场景,如漏洞研究、红队、渗透测试、恶意软件分析、威胁情报、事件响应。此外,Codex 推出了新插件,可利用 gpt-5.5(reasoning 设 high/xhigh)进行代码安全扫描与修复。AI模型GPT-5.5-CyberMythos 5CyberGym8 个信源在谈事件专题推荐理由:GPT-5.5-Cyber 在安全基准 CyberGym 上直接碾压了 Mythos 5,想搞红队或漏洞分析的话可以申请权限试试。原文稍后读已读值得跟进有用关注 GPT-5.5-Cyber
15:21IT之家(博客/媒体)精选73°OpenAI于6月22日发布GPT-5.5-Cyber网络安全专用模型,面向Daybreak项目有限开放。该模型在CyberGym测试中取得85.6%的得分,超过Claude Mythos 5的83.8%和GPT-5.5的81.8%。在ExploitGym测试中得分为39.5%,而GPT-5.5为25.95%。在SEC-bench Pro测试中得分69.8%,GPT-5.5为63.1%。AI模型GPT-5.5-CyberOpenAIClaude Mythos 510 个信源在谈事件专题推荐理由:OpenAI新出的网络安全大模型GPT-5.5-Cyber挺猛,CyberGym跑分超了Claude Mythos 5,安全团队可以关注一下。原文稍后读已读值得跟进有用关注 GPT-5.5-Cyber