主要来源Cognition
查看原文事件专题 · 多源确认
Opus 5 在 FrontierCode 1.1 上得分63.6%,接近Fable 5但成本减半
FrontierCode 1.1 是 Cognition 发布的评估真实工程任务的基准,考核代码合并性和质量。Opus 5 在该基准上取得 63.6% 的分数,扩展测试通过率 69.6%,性能接近 Fable 5 而成本仅为后者的一半。在 Devin 环境中,Opus 5 在困难调试和根因分析任务上表现突出。
当前结论
Opus 5 在代码工程基准上接近顶级模型,但价格只要一半,做调试分析特别强。
5 个信源58° AI 热度最后更新 2026/7/24 17:07:20
证据链
相关来源 1Alex Albert
查看原文相关来源 2Claude
查看原文相关来源 3techcrunch
查看原文相关来源 4歸藏(guizang.ai)
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。