23:20berryxia@berryxia78°博主@berryxia测试了GPT-SOL-5.6-High、Claude-Fable-5、Qwen3.8-Max-Preview和KIMI K3在IMO 2026(满分42分)中的表现。结果显示GPT-SOL-5.6-High用时14m58s、Qwen3.8-Max-Preview用时45分钟、Kimi K3用时1h32m6s,三者均获得满分42分。Claude-Fable-5未能完成任务。去年仅有Gemini Deep Think和一个实验性OpenAI模型勉强得到35分,今年已有多个主流模型稳定满分。AI模型GPT-SOL-5.6-HighQwen3.8-Max-PreviewKIMI K310 个信源在谈事件专题推荐理由:国产模型Qwen3.8和Kimi K3在IMO 2026中拿了满分,速度还很快,想看看它们数学推理能力有多强?原文稍后读已读值得跟进有用关注 GPT-SOL-5.6-High