主要来源Together AI
查看原文事件专题 · 多源确认
Kimi K3 vs. Claude Fable 5 软件工程基准测试分析
TogetherCompute使用DeepSWE评估了Kimi K3与Claude Fable 5在软件工程任务上的表现。Kimi K3以约35%的价格达到与Claude Fable 5相同的性能水平。在更高的pass@k指标上,Kimi K3甚至领先于Claude Fable 5。该分析为开发者提供了性价比更高的模型选择参考。
当前结论
如果你写代码,Kimi K3花不到一半的钱就能干和Claude Fable 5一样好的活,高通过率时还更强。
11 个信源68° AI 热度最后更新 2026/7/18 01:38:10
证据链
相关来源 1Aravind Srinivas
查看原文相关来源 2Amjad Masad
查看原文相关来源 3AI Will
查看原文相关来源 4shao__meng
查看原文相关来源 5Viking
查看原文相关来源 6lmarena.ai
查看原文相关来源 7Simon Willison’s Weblog
查看原文相关来源 8IT之家
查看原文相关来源 9orange.ai
查看原文相关来源 10Jerry Liu
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。