主要来源@koltregaskes
查看原文事件专题 · 多源确认
开源模型Kimi K3登顶Arena前端代码榜,超越Claude Fable 5和GPT-5.6 Sol
Kimi K3在Arena's Frontend Code盲测中击败Claude Fable 5和GPT-5.6 Sol,排名第一。在DeepSWE基准上,K3得69%且每任务成本$4.65,而Sol得73%成本$8.39,Fable 5得70%成本$21.63。在Artificial Analysis的Intelligence Index上,K3得57分,仅比Fable 5的60分低3分。该模型在长时编码和知识工作方面表现突出,在AA-Briefcase排名第二。但幻觉率为51%,接近Grok 4.5的54%。开放权重将于7月27日发布。
当前结论
中国开源模型Kimi K3编码能力比Claude和GPT还强,价格却便宜好几倍,做长上下文编程选它准没错。
11 个信源71° AI 热度最后更新 2026/7/19 12:06:44
证据链
相关来源 1Jerry Liu
查看原文相关来源 2lmarena.ai
查看原文相关来源 3IT之家
查看原文相关来源 4Decoder
查看原文相关来源 5AI Will
查看原文相关来源 6elvis
查看原文相关来源 7Thomas Wolf
查看原文相关来源 8SuperTechFans
查看原文相关来源 9Together AI
查看原文相关来源 10向阳乔木
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。