主要来源Decoder
查看原文事件专题 · 多源确认
Anthropic Opus 5在ARC-AGI-3得分30.2%,达GPT-5.6 Sol近四倍
Anthropic的Claude Opus 5在ARC-AGI-3基准测试中取得30.2%的成绩,接近此前GPT-5.6 Sol记录7.8%的四倍。测试开发者指出,Opus 5是首个独立推导出反射方程的模型,这一行为此前从未在其他模型中出现。开发者认为这归因于其更强的逻辑推理能力。ARC-AGI-3被设计为衡量真实智能的测试。
当前结论
Anthropic的Opus 5在智能测试上把GPT-5.6 Sol甩开一大截,还自己学会推方程了。
11 个信源86° AI 热度最后更新 2026/7/26 09:43:02
证据链
相关来源 1Claude
查看原文相关来源 2orange.ai
查看原文相关来源 3AI SDK
查看原文相关来源 4宝玉
查看原文相关来源 5elvis
查看原文相关来源 6Alex Albert
查看原文相关来源 7Guillermo Rauch
查看原文相关来源 8cat
查看原文相关来源 9Gary Marcus
查看原文相关来源 10The Rundown AI
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。