主要来源OpenAI
查看原文事件专题 · 多源确认
GPT-5.6 Sol在Agents' Last Exam上以53.6分超越Claude Fable 5
OpenAI发布的GPT-5.6 Sol在Agents' Last Exam基准测试中取得53.6分,比Claude Fable 5 (adaptive)的40.5分高出13.1分。在中等推理模式下,GPT-5.6 Sol以约四分之一成本领先Fable 5达11.4分。此外,GPT-5.6 Terra和Luna版本也以约十六分之一成本超越Fable 5。
当前结论
OpenAI新出的GPT-5.6 Sol在智能体测试里比Claude Fable 5强13分,而且更便宜,中推理下成本才四分之一,性价比很高。
11 个信源68° AI 热度最后更新 2026/7/9 17:30:38
证据链
相关来源 1Simon Willison’s Weblog
查看原文相关来源 2SuperTechFans
查看原文相关来源 3AI Will
查看原文相关来源 4小互
查看原文相关来源 5IT之家
查看原文相关来源 6@koltregaskes
查看原文相关来源 7The Rundown AI
查看原文相关来源 8@OpenAIDevs
查看原文相关来源 9Decoder
查看原文相关来源 10Poe
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。