主要来源OpenAI
查看原文事件专题 · 多源确认
GPT-5.6 Sol 在数学难题上成功,却在 ARC-AGI-3 表现差?调整 API 设置后性能三倍提升
GPT-5.6 Sol 成功解决了数学中的开放问题,但在 ARC-AGI-3 2D 拼图基准测试中表现挣扎。调查发现,问题出在 API 的 harness 不允许模型记住之前学到的内容。启用两个 API 设置后,分数提高了 3 倍,同时输出 token 减少了 6 倍。
当前结论
OpenAI 发现 GPT-5.6 Sol 在 ARC-AGI-3 上表现差是因为 API 设置没开对。改两个参数分数涨三倍,token 省六倍,学起来很实用。
7 个信源68° AI 热度最后更新 2026/7/29 23:57:54
证据链
相关来源 1歸藏(guizang.ai)
查看原文相关来源 2Greg Brockman
查看原文相关来源 3@OpenAIDevs
查看原文相关来源 4Augment Code
查看原文相关来源 5宝玉
查看原文相关来源 6IT之家
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。