事件专题 · 多源确认

GPT-5.6 Sol 在 Agents' Last Exam 中创 53.6 高分

GPT-5.6 Sol 在 Agents' Last Exam 测试中得分 53.6,比 Claude Fable 5(adaptive)高出 13.1 分。在中等推理强度下,GPT-5.6 Sol 仍比 Fable 5 高出 11.4 分,预估成本约为后者的四分之一。GPT-5.6 Terra 和 Luna 版本也在约十六分之一成本下超过 Fable 5。

当前结论

OpenAI 的 GPT-5.6 新系列在智能体考试中大幅领先 Claude Fable 5,成本还低很多,值得看看。

10 个信源86° AI 热度最后更新 2026/7/10 04:21:50

证据链

相关来源 2Simon Willison’s Weblog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情