论文06:47FrontierSWE v2 发布超长编码基准测试ProximalHQ 推出了超长编码基准 v2,Claude Fable 5.1 在测试中大幅领先其他模型。#FrontierSWE#Fable 5.1#Claude#ProximalHQelvis@omarsar0原文稍后读已读值得跟进有用关注 FrontierSWE
模型Agent 与开发者多源确认05:03Proximal发布FrontierSWE v2编程基准Proximal发布了新版编程基准FrontierSWE v2,Claude Fable 5.1在测试中表现最佳。#FrontierSWE#ProximalHQ#Claude Fable 5.1#编程基准9 个信源在谈事件专题Suhail@Suhail10 个信源在谈原文稍后读已读值得跟进有用关注 FrontierSWE
模型Agent 与开发者09:15Grok 4.5 在 FrontierSWE 基准排名第二,研究能力第一Grok 4.5 在代码基准上超越 GPT-5.5 和 Opus 4.8,研究能力还拿了第一,值得关注。#Grok 4.5#FrontierSWE#Proximal#编程助手官方账号xAI@xai原文稍后读已读值得跟进有用关注 Grok 4.5
模型中美对照多源确认04:01GLM 5.2 在 FrontierSWE 基准排名第三,超越 GPT-5.5GLM 5.2 在编码基准上干掉了 GPT-5.5,开源里最强,值得关注。#GLM 5.2#FrontierSWE#GPT-5.5#开源模型10 个信源在谈事件专题elvis@omarsar011 个信源在谈原文稍后读已读值得跟进有用关注 GLM 5.2