事件专题 ·多源确认

Cognition 评测:GPT-6 Sol 读取上下文比 GPT-5.6 Sol 少约 17%

Cognition 发布了对 GPT-6 系列模型的编程评测结果。数据显示,GPT-6 Sol 达到与 GPT-5.6 Sol 相同分数所需的上下文读取量少约 17%,且最后一次编辑后很少在仓库中留下失败测试。GPT-6 Luna 的提升集中在低、中推理档位,此时它会编写真实的回归测试而非基于 mock 的测试。

当前结论

Cognition 跑了 GPT-6 两个型号的编程实测:Sol 省了 17% 上下文还少留烂尾测试,Luna 会写真回归测试了,写代码的可以看看。

11 个信源83° AI 热度最后更新 2026/9/22 18:22:56

证据链

11 个信源
相关来源 6歸藏(guizang.ai)
查看原文
相关来源 9阿里通义 Qwen
查看原文
相关来源 10掘金本周最热
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。