7月20日
23:46
23:46小互@imxiaohu
之暗面发布了2.8万亿参数的Kimi K3模型后,引发关于中美AI差距的讨论。独立分析者Lisan al Gaib使用Epoch能力指数(ECI)重新评估,认为差距为160天(近6个月),而非传闻中的45天。该评测基于多个基准和能力维度,提供了更细致的量化对比。
事件专题

推荐理由:别只看45天的热搜,这个分析用ECI指数掐指一算,说差距是160天。想认真了解中美AI到底差多远,可以看看这个评测。
16:06
16:06官方一手Pandaily@contact@pandaily.com (Pandaily)
Moonshot AI旗下Kimi K3模型在AlphaEngine的专有IRB投资研究基准测试中,以更高得分击败GPT-5.5和OPUS-4.8。测试涵盖时间判断、证据边界控制和前提修正三个维度。Kimi K3已部署在AlphaEngine平台上。
事件专题

推荐理由:Kimi K3在投资研究上直接干翻了GPT-5.5和OPUS-4.8,时间判断和证据边界控制尤其强,已经在AlphaEngine上用了,搞金融研究的可以试试。
12:20
12:20量子位@梦瑶
Kimi K3上线仅48小时,用户访问量激增导致GPU算力资源严重不足。月之暗面紧急宣布暂停会员新购,以保障服务器稳定运行。该模型在中文长文本理解等任务上表现突出,吸引大量用户涌入。
事件专题

推荐理由:Kimi K3刚上线48小时就火到GPU扛不住,会员都卖停了,赶紧围观是什么模型这么猛。
07:22
07:22SuperTechFans博客/媒体
73°
Qwen3.8是阿里巴巴即将开源的新模型,拥有2.4万亿参数,预览版Qwen3.8-Max-Preview已在阿里云平台上线。该模型实力仅次于Fable 5,直接对标Moonshot AI的2.8T参数开源模型Kimi K3。阿里巴巴通过开源策略可能意在削弱美国AI实验室并获取客户支持。
事件专题

推荐理由:阿里巴巴要开源一个2.4万亿参数的Qwen3.8,预览版已经能用了,据说只比Fable 5差一点,和Kimi K3直接对标,想试试大模型的可以关注。
7月19日
21:27
21:27shao__meng@shao__meng
DeepSeek V4 和 GLM 5.2 已发布。本周 Kimi K3 和 Qwen 3.8 曝光,对标 Claude Fable 5 和 GPT-5.6 Sol。Tencent Hy3 提升很大,MiniMax M3 落后但后续期待。Gemini 3.5 Pro 原定7月17日发布,因内部评估未通过而推迟。
事件专题

推荐理由:这周模型圈太热闹了,DeepSeek V4、GLM 5.2 刚发,Kimi K3 和 Qwen 3.8 又来了,还有 Claude 和 GPT 对标,开源 SOTA 随时变天。
20:15
17:51
17:51官方账号Decoder@Matthias Bastian
精选
Moonshot的Kimi K3在Code Arena: Frontend排行榜上超越Claude Fable 5和GPT-5.6 Sol,成为首个登顶该榜单的中国模型。但在FrontierMath Tier 4数学测试中,Kimi K3仅得约39%,而OpenAI和Anthropic模型得分接近90%。差距主要体现在复杂数学推理能力上。
事件专题

推荐理由:国产模型Kimi K3前端代码很强,能超过Fable 5,但数学推理还差得远。想了解具体差距多大,可以看看这篇。
14:07
09:48
09:48官方一手marktechpost@Michal Sutter
82°
文章对三款开源万亿参数MoE模型Kimi K3、DeepSeek V4 Pro和GLM-5.2进行了全面对比。对比涵盖了在多项基准测试中的表现、采用的MIT或Modified MIT许可证以及实际服务成本。文章提供了这些模型在不同维度上的差异分析,帮助读者了解各模型的优劣势。
事件专题

推荐理由:想选开源万亿模型?这篇直接拿三个主流模型比了基准、许可证和成本,看完就知道选哪个合适。
04:12
04:12Aravind Srinivas@AravSrinivas
Together AI 在 DeepSWE 基准上对比了 Kimi K3 与 Claude Fable 5 的软件工程任务表现。结果显示,Kimi K3 以 Fable 5 约 35% 的价格实现了相同性能,且在更高 pass@k 指标上领先。该分析来自 Together AI 的 Arav Srinivas,数据基于内部测试。
事件专题

推荐理由:想省钱又要强性能?Kimi K3 在编程任务上和 Claude Fable 5 打个平手,价格只要三分之一,高要求场景还更强。
00:09
00:03
00:03@koltregaskes@koltregaskes
xAI的Grok 4.6(2T参数模型)将在下周完成初始训练。其性能可能超过Kimi K3。速度和成本与Grok 4.5相当。根据Elon Musk以往从训练完成到发布的时间,估计发布时间为9月中旬。
事件专题

推荐理由:xAI的Grok 4.6下周完成训练,号称又快又便宜,还比Kimi K3强,预计9月中旬发布,可以关注。
7月18日
16:45
09:38
09:38官方账号Together AI@togethercompute
TogetherCompute使用DeepSWE评估了Kimi K3与Claude Fable 5在软件工程任务上的表现。Kimi K3以约35%的价格达到与Claude Fable 5相同的性能水平。在更高的pass@k指标上,Kimi K3甚至领先于Claude Fable 5。该分析为开发者提供了性价比更高的模型选择参考。
事件专题

推荐理由:如果你写代码,Kimi K3花不到一半的钱就能干和Claude Fable 5一样好的活,高通过率时还更强。
09:28
09:28官方一手pandaily@contact@pandaily.com (Pandaily)
76°
Moonshot AI将Kimi K3定价为每百万token 3-15美元,是此前K2.6价格的3-4倍。该定价为DeepSeek同类模型的3-15倍,成为当前中国最贵的大模型。此举标志着Moonshot AI从成本领先战略转向高价值复杂任务能力。国内计算生态系统的成熟为其提供支撑。
事件专题

推荐理由:Moonshot AI出了个超贵模型Kimi K3,比DeepSeek贵3-15倍,但专攻复杂任务,不是打价格战。
03:40
03:40官方账号Decoder@Matthias Bastian
73°
Moonshot AI 发布 Kimi K3 模型,初步评估表现匹配 Anthropic 的 Opus 4.8。该模型由仅 300 人团队开发,OpenAI 战略师 Dean W. Ball 评价其“非常好”。Ball 同时警告开源权重模型主导将导致“AI 共产主义”,重新引发关于算力重要性及美国出口管制有效性的讨论。
事件专题

推荐理由:Kimi K3 用 300 人就追上 Anthropic 顶配,OpenAI 的人还吐槽开源是 AI 共产主义,值得看算力是否真的重要。