事件专题 · 多源确认

GPT-5.6 Sol 两处 API 设置调优,ARC-AGI-3 从 13.3% 涨至 38.3%

OpenAI 发现 GPT-5.6 Sol 在 ARC-AGI-3 公开题库中仅得 13.3%,原因是推理过程中的私有思考被丢弃,上下文到达阈值后直接删除早期消息。通过开启 Responses API 将上一次响应 ID 传回以保留推理链,并启用 compaction 将超限上下文压缩为浓缩摘要,得分升至 38.3%。最高档每局输出 token 从 290 万降至 49 万,新程序在“高”档即达到旧程序“最高”档的分数,token 消耗相差约 12 倍。

当前结论

OpenAI 分享了两个超实用的 API 开关,GPT-5.6 Sol 在 ARC-AGI-3 上分数直接翻了三倍,token 还省了十二倍,搞推理优化的一定要看看。

11 个信源81° AI 热度最后更新 2026/7/30 04:12:00

证据链

相关来源 10歸藏(guizang.ai)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情