AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

FrontierSWE

共 2 条相关 AI 资讯
7月16日
09:15
09:15官方账号xAI@xai
Grok 4.5 在 Proximal 的 FrontierSWE 基准测试中综合排名第二,仅次于 Claude Fable 5。在实现与性能维度上同样位列第二。在研究能力维度上排名第一,超过 Opus 4.8、GPT-5.5 和 GLM-5.2。该基准测试评估模型在真实软件工程任务中的表现。
AI模型Grok 4.5FrontierSWEProximal

推荐理由:Grok 4.5 在代码基准上超越 GPT-5.5 和 Opus 4.8,研究能力还拿了第一,值得关注。
原文
6月17日
04:01
04:01elvis@omarsar0
GLM 5.2 在 FrontierSWE 基准上排名第 3,得分仅次于 Fable 5 和 Opus 4.8,并超越 GPT-5.5。这是首个缩小 Anthropic/OpenAI 与其他提供商之间差距的模型,同时也是目前最强的开源权重模型。该成绩展示了开源模型在编码任务上的竞争力。
AI模型GLM 5.2FrontierSWEGPT-5.5
事件专题

推荐理由:GLM 5.2 在编码基准上干掉了 GPT-5.5,开源里最强,值得关注。
原文
精选全部日报登录