事件专题 · 多源确认

Opus 5 在 FrontierCode 1.1 上得分63.6%,接近Fable 5但成本减半

FrontierCode 1.1 是 Cognition 发布的评估真实工程任务的基准,考核代码合并性和质量。Opus 5 在该基准上取得 63.6% 的分数,扩展测试通过率 69.6%,性能接近 Fable 5 而成本仅为后者的一半。在 Devin 环境中,Opus 5 在困难调试和根因分析任务上表现突出。

当前结论

Opus 5 在代码工程基准上接近顶级模型,但价格只要一半,做调试分析特别强。

5 个信源58° AI 热度最后更新 2026/7/24 17:07:20

证据链

相关来源 4歸藏(guizang.ai)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情