主要来源Decoder
查看原文事件专题 · 多源确认
Moonshot Kimi K3前端代码超越Fable 5,复杂数学落后显著
Moonshot的Kimi K3在Code Arena: Frontend排行榜上超越Claude Fable 5和GPT-5.6 Sol,成为首个登顶该榜单的中国模型。但在FrontierMath Tier 4数学测试中,Kimi K3仅得约39%,而OpenAI和Anthropic模型得分接近90%。差距主要体现在复杂数学推理能力上。
当前结论
国产模型Kimi K3前端代码很强,能超过Fable 5,但数学推理还差得远。想了解具体差距多大,可以看看这篇。
11 个信源52° AI 热度最后更新 2026/7/19 09:32:19
证据链
相关来源 1@koltregaskes
查看原文相关来源 2IT之家
查看原文相关来源 3Jerry Liu
查看原文相关来源 4lmarena.ai
查看原文相关来源 5AI Will
查看原文相关来源 6歸藏(guizang.ai)
查看原文相关来源 7向阳乔木
查看原文相关来源 8Thomas Wolf
查看原文相关来源 9Together AI
查看原文相关来源 10elvis
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。