事件专题 · 多源确认

GLM 5.2 在 FrontierSWE 基准排名第三,超越 GPT-5.5

GLM 5.2 在 FrontierSWE 基准上排名第 3,得分仅次于 Fable 5 和 Opus 4.8,并超越 GPT-5.5。这是首个缩小 Anthropic/OpenAI 与其他提供商之间差距的模型,同时也是目前最强的开源权重模型。该成绩展示了开源模型在编码任务上的竞争力。

当前结论

GLM 5.2 在编码基准上干掉了 GPT-5.5,开源里最强,值得关注。

11 个信源40° AI 热度最后更新 2026/6/16 19:32:52

证据链

相关来源 4arXiv: Anthropic
查看原文
相关来源 7Simon Willison’s Weblog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情