事件专题 · 单一信源

GLM 5.2 在 IDOR 漏洞检测基准中击败 Claude

Semgrep 安全团队对比多模型在 IDOR 漏洞检测上的表现,GLM 5.2 在仅给定提示下取得 39% F1,高于 Claude Code 的 32% 和 Claude Opus 4.8。该模型是智谱 AI 开源的 750B 总参数 MoE 模型,每个 token 仅激活 40B,支持 128K 上下文,采用 MIT 许可证。专业静态分析管道 Semgrep 多模态仍领先,F1 达 53%–61%,显示模型与框架的差距。

当前结论

智谱的 GLM 5.2 开源模型在安全漏洞检测上居然超过了 Claude,而且推理成本低,适合做代码审计。

2 个信源78° AI 热度最后更新 2026/6/29 23:53:23

证据链

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情