事件专题 ·单一信源

Claude Opus 5.5 登顶 FrontierCode 1.1 Extended 榜首

Cognition 发布的 FrontierCode 1.1 是评测真实工程任务的基准,会考察代码合并可行性与质量。在该基准的 Extended 集上,Claude Opus 5.5 拿到 65.3%,取代 Fable 5 成为第一。Cognition 提到其成本远低于原榜首模型。

当前结论

Cognition 自家的 FrontierCode 榜更新了,Claude Opus 5.5 拿 65.3% 超过 Fable 5,成本还更低,写代码的可以看看。

2 个信源67° AI 热度最后更新 2026/9/22 17:35:46

证据链

2 个信源

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。