事件专题 · 多源确认

GPT6-Astra评测:编程能力与Claude Opus 5相当

GPT6-Astra在Coding Agent能力上与Claude Opus 5、Fable 5相当,但落后于Fable 5.1。综合智能指数部分维度甚至落后于GPT5.6。Token效率高,Computer Use等特定任务表现优秀。ARC-AGI-3在OpenAI特殊适配Harness上达到99%,标准跑分仅63%。模型不显示推理过程时能完成更复杂任务,但带来安全风险。

当前结论

OpenAI的GPT6-Astra评测曝光,编程能力与Claude Opus 5相当,但价格涨2.5倍,因效率提升实际成本反而降一半。

11 个信源73° AI 热度最后更新 2026/9/4 08:57:07

证据链

相关来源 1Simon Willison’s Weblog
查看原文
相关来源 2歸藏(guizang.ai)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情