Sakana AI新出的Fugu Cyber在安全基准上比GPT-5.5-Cyber还强,86.9%的CyberGym成功率很硬核,搞网络安全的可以关注。
Sakana AI发布Fugu Cyber模型,专为现代网络防御设计。该模型在CyberGym基准测试中成功率达86.9%,在CTI-REALM测试中成功率达72.1%。其表现优于OpenAI GPT-5.5-Cyber和Anthropic Claude Mythos-Preview。Fugu Cyber是一个多智能体系统,通过单一API动态编排专业智能体处理复杂任务。Sakana AI还提供人工智能驱动的网络安全解决方案实地部署服务。
Sakana AI 推出网络安全模型 Fugu Cyber:领域基准测试表现优于 GPT-5.5-Cyber
IT之家 7 月 21 日消息,日本人工智能初创企业 Sakana AI 当地时间今日发布了其专为应对现代网络防御的复杂性而打造的 Fugu Cyber 模型。 这一模型在业界最具挑战性的安全基准测试中均取得了卓越的性能:CyberGym 成功率达 86.9%、CTI-REALM 测试成功率达 72.1%, 表现甚至优于 OpenAI GPT-5.5-Cyber 和 Anthropic Claude Mythos-Preview 。 与标准 Fugu 类似,Fugu Cyber 是一个封装为单一 API 的多智能体系统,系统可针对用户请求动态编排专业智能体以处理复杂的多步骤任务。 除简单的 API 外,Sakana AI 还提供由其应用企业团队支持的人工智能驱动网络安全解决方案实地部署服务。