事件专题 · 多源确认

GPT-5.6 Sol在Agents' Last Exam上以53.6分超越Claude Fable 5

OpenAI发布的GPT-5.6 Sol在Agents' Last Exam基准测试中取得53.6分,比Claude Fable 5 (adaptive)的40.5分高出13.1分。在中等推理模式下,GPT-5.6 Sol以约四分之一成本领先Fable 5达11.4分。此外,GPT-5.6 Terra和Luna版本也以约十六分之一成本超越Fable 5。

当前结论

OpenAI新出的GPT-5.6 Sol在智能体测试里比Claude Fable 5强13分,而且更便宜,中推理下成本才四分之一,性价比很高。

11 个信源68° AI 热度最后更新 2026/7/9 17:30:38

证据链

相关来源 1Simon Willison’s Weblog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情