事件专题 · 多源确认

Claude Fable 5 在 FrontierMath 最难题目上领先 GPT-5.5 13 个百分点

Anthropic 的 Claude Fable 5 在 FrontierMath 最难层级上达到 88% 准确率,较 Opus 4.5 在 2026 年初低于 10% 的成绩大幅提升。OpenAI 的 GPT-5.5 在同一层级上达到约 75%。两者差距为 13 个百分点,显示 AI 数学能力加速提升。

当前结论

Anthropic 新模型数学碾压 GPT-5.5

11 个信源73° AI 热度最后更新 2026/6/13 10:16:26

证据链

相关来源 2Artificial Analysis
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情