事件专题 · 多源确认

OpenAI 发布 GPT-5.6 系列模型,性能大幅提升且成本降低

GPT-5.6 Sol 在 Agents' Last Exam 上得分 53.6,领先 Claude Fable 5 达 13.1 分。中等推理模式下仅用约四分之一成本即领先 11.4 分。Terra 和 Luna 以约十六分之一成本超越 Fable 5。在 Artificial Analysis Coding Agent Index 上 Sol 取得 80 分,领先 Fable 5 2.8 分,token 和成本大幅降低。新推出 ultra 模式默认协调四个智能体并行工作,提升浏览和证券基准表现。安全方面经过广泛红队测试和自动化评估。

当前结论

OpenAI 刚发了 GPT-5.6,三个型号性能都爆表,尤其 Sol 在编码和推理测试里吊打 Claude Fable 5,成本还低很多,编程和复杂任务都更强了。

11 个信源92° AI 热度最后更新 2026/7/11 00:01:15

证据链

相关来源 1Simon Willison’s Weblog
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情