事件专题 ·多源确认

SWE-2 在 Kimi-K3 上微调后,在 FrontierCode 基准上超越 SWE-1.7、Grok 4.6 和 GPT 5.6

SWE-2 是 Cognition 公司发布的模型,在 Kimi-K3 上进行微调后,在 FrontierCode 基准测试中取得了 50.0% 的分数。这个成绩超过了 SWE-1.7、Grok 4.6 和 GPT 5.6,同时成本比 Fable 5.1 低 64%。

当前结论

Cognition 公司发布了 SWE-2,这个模型在 Kimi-K3 上微调后,在 FrontierCode 基准上表现更好,成本也更低。

9 个信源78° AI 热度最后更新 2026/9/10 15:21:01

证据链

9 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。