主要来源lmarena.ai
查看原文事件专题 · 多源确认
Claude Opus 5 在 Agent Arena 与代码榜上表现强劲
Anthropic 的 Claude Opus 5 (Max) 在 Agent Arena 中排名第二,基于超过 7000 次真实代理会话,净提升 11.88%。Opus 5 (High) 紧随其后排名第三,净提升 11.73%,两者均低于第一名 Fable 5,但高于 GPT-5.6 Sol (xHigh)。在 Frontend Code Arena 中,Opus 5 Max 排名第一,Opus 5 High 排名第三(落后于 Kimi K3)。在 Text Arena(事实性开启)中,Opus 5 Max 位列第一,Opus 5 High 第二。这些成绩基于全球社区的百万级真实长周期任务评测。
当前结论
Claude Opus 5 在 Agent Arena 和代码榜都冲进前三,Max 版更是双榜第一,比 GPT-5.6 还靠前,很强悍。
11 个信源82° AI 热度最后更新 2026/7/29 15:15:49
证据链
相关来源 1AI Will
查看原文相关来源 2Poe
查看原文相关来源 3Fireworks AI
查看原文相关来源 4Y Combinator
查看原文相关来源 5IT之家
查看原文相关来源 6Lenny Rachitsky
查看原文相关来源 7arXiv: Anthropic
查看原文相关来源 8Decoder
查看原文相关来源 9Anthropic: Newsroom
查看原文相关来源 10向阳乔木
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。