主要来源AI Will
查看原文事件专题 · 多源确认
GPT-5.6 Sol 在 Agents' Last Exam 中创 53.6 高分
GPT-5.6 Sol 在 Agents' Last Exam 测试中得分 53.6,比 Claude Fable 5(adaptive)高出 13.1 分。在中等推理强度下,GPT-5.6 Sol 仍比 Fable 5 高出 11.4 分,预估成本约为后者的四分之一。GPT-5.6 Terra 和 Luna 版本也在约十六分之一成本下超过 Fable 5。
当前结论
OpenAI 的 GPT-5.6 新系列在智能体考试中大幅领先 Claude Fable 5,成本还低很多,值得看看。
10 个信源86° AI 热度最后更新 2026/7/10 04:21:50
证据链
相关来源 1OpenAI
查看原文相关来源 2Simon Willison’s Weblog
查看原文相关来源 3SuperTechFans
查看原文相关来源 4小互
查看原文相关来源 5爱范儿
查看原文相关来源 6Geek
查看原文相关来源 7Decoder
查看原文相关来源 8IT之家
查看原文相关来源 9lmarena.ai
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。