10:17IT之家(博客/媒体)78°据路透社消息,阿里巴巴计划对下一代通义千问开源模型的大型商用用户收取费用,从收益中抽取一定比例分成。该模式与月之暗面旗下Kimi K3类似,Kimi K3要求年销售额超2000万美元的实体签订商业协议,收益分成最高可达30%。阿里相关谈判仍在进行,具体抽成比例尚未确定。DigitalOcean已与月之暗面签署商业协议,其CEO证实该模式为开源“免费增值”模式。行业阿里巴巴QwenKimi K310 个信源在谈事件专题推荐理由:阿里要向用千问赚钱的大户抽成了,学的是Kimi K3那套2000万美元门槛,做生意前先看下规则。原文稍后读已读值得跟进有用关注 阿里巴巴
08:11a16z@a16z71°a16z官方账号发布访谈视频,vLLM维护者、Inferact CEO Simon Mo与合伙人Matt Bornstein讨论开源权重模型的价值。Simon Mo认为世界不能被专有API垄断,闭源模型成本过高,而开源权重允许企业自行控制基础设施、扩展模型或添加护栏。他提到,控制问题近两年一直重要,成本问题从近几个月开始凸显,例如语音智能体公司需要自有模型保证响应时间。访谈还提及vLLM目前在任意时刻运行于约50万块GPU上,并讨论了Kimi K3的发布与开源模型许可证变化。行业开源模型vLLMInferact10 个信源在谈事件专题推荐理由:Simon Mo是vLLM作者,他讲开源权重模型怎么在成本和控制上赢过闭源API,还吐槽专有API宕机问题,适合做线上服务的开发者。原文稍后读已读值得跟进有用关注 开源模型
03:20Fireworks AI@FireworksAI_HQFireworks AI与Arize AI联合举办的网络研讨会将于30分钟后开始,主题为'GPT-5.5、Kimi K3和另外8个模型:AI工作的真实成本'。活动将对比10款模型在成功完成任务时的成本表现。会后设有公开问答环节,由Fireworks AI的AI教育主管@Prof_OZ与Arize AI团队参与。下一场研讨会定于8月6日举行。AI模型Fireworks AIArize AIGPT-5.510 个信源在谈事件专题推荐理由:马上有一场AI模型成本对比直播,看GPT-5.5和Kimi K3等10个模型谁完成任务更省钱,还能直接提问。原文稍后读已读值得跟进有用关注 Fireworks AI
03:07GitHub@githubKimi K3 是月之暗面推出的开源权重模型,现已正式可用并集成到 GitHub Copilot。该模型在智能体编程(agentic coding)场景展现出前沿级能力,同时保持较低的使用成本。目前 Kimi K3 由 Fireworks AI 托管,开发者可直接在 GitHub Copilot 中调用。AI模型Kimi K3GitHub CopilotFireworks AI10 个信源在谈事件专题推荐理由:Kimi K3 正式上线 GitHub Copilot,开源权重还能便宜跑 agentic 编程,想试试的可以直接用。原文稍后读已读值得跟进有用关注 Kimi K3
02:43a16z@a16z71°vLLM是一个开源推理引擎,任意时刻运行在约50万张GPU上,构成开源模型生产环境的隐形基础设施。Simon Mo作为vLLM维护者和Inferact CEO,在a16z播客中讨论了开放模型的优势、发布首日模型适配的幕后冲突,以及Kimi K3实际带来的提升。他还对比了OpenRouter、Ollama等工具在ChatGPT出现前的起源,并解释了开源模型许可证正在变化的原因。访谈也涉及如何基于开源项目建立公司。行业vLLMInferactKimi K310 个信源在谈事件专题推荐理由:vLLM同时占着50万张GPU,却是开源模型的隐身基座。听Simon Mo拆解Kimi K3和开源模型上生产的坑。原文稍后读已读值得跟进有用关注 vLLM
01:28官方账号LangChain@LangChainAI精选LangSmith LLM Gateway 新增对 Kimi 3 的支持,用户只需使用已有的 LangSmith API key 即可运行智能体。该服务由 Fireworks AI 提供底层算力,无需单独申请 Kimi 的接口权限。Kimi 3 作为开放模型,现在可以直接在 LangChain 生态中调用。这降低了接入国产模型的配置门槛。AI产品Kimi K3LangSmithFireworks AI10 个信源在谈事件专题推荐理由:LangSmith 网关现在直接支持 Kimi 3 了,拿你现有的 API key 就能跑,不用另外搞权限,Fireworks 提供算力。原文稍后读已读值得跟进有用关注 Kimi K3
21:51官方账号Decoder@Maximilian Schreiner阿里发布的Qwen3.8 Max在Artificial Analysis Intelligence Index上得分56,比上一代Qwen3.7 Max的46分高出10分。该分数追平了Claude Opus 4.8。但Kimi K3的得分更高,且成本低25%。AI模型Qwen3.8 MaxClaude Opus 4.8Kimi K310 个信源在谈事件专题推荐理由:Qwen3.8 Max一口气涨10分追平Claude,但Kimi K3更便宜还更强,值得看。原文稍后读已读值得跟进有用关注 Qwen3.8 Max
21:49OpenRouter@OpenRouterAIOpenRouter发布两个基于真实花费份额的任务排行榜。Shell执行任务中,DeepSeek V4 Pro排名第一。工具调度任务中,Kimi K3占据首位。两个榜单均由开放模型登顶。AI模型DeepSeek V4 ProKimi K3OpenRouter10 个信源在谈事件专题推荐理由:OpenRouter按真实花费给模型排名,DeepSeek V4 Pro拿下Shell执行第一,Kimi K3拿下工具调度第一,开放模型领先。原文稍后读已读值得跟进有用关注 DeepSeek V4 Pro
00:13lmarena.ai@lmarena_ai82°Claude Opus 5 (Max)在Fullstack Code Arena获得1699分,排名第一。它还同时登顶Frontend Code Arena和开启事实性检查的Text Arena。默认推理强度的Claude Opus 5在Frontend Code Arena排第三,落后于Kimi K3。官方称Max的1699分仍是初步结果,可能还会变化。AI模型Claude Opus 5AnthropicFullstack Code Arena10 个信源在谈事件专题推荐理由:Anthropic新出的Claude Opus 5(Max)把代码榜刷到第一,1699分,前端和文本也登顶,这波挺猛。原文稍后读已读值得跟进有用关注 Claude Opus 5
19:50IT之家(博客/媒体)DeepSeek于7月31日发布V4-Flash正式版API,跑分显示其单任务成本比GPT-5.6 Luna低约60%。OpenRouter周度统计中,V4-Flash以7.22万亿Token调用量位居全球第一。荣耀CMO关海涛称这是“法拉利的性能,电动小摩托的价格”。该模型引发的“行业生死线”讨论,已倒逼OpenAI等巨头大幅降价并提升入门级模型能力,Kimi K3等国产模型同样加剧了竞争。AI模型DeepSeek-V4-FlashGPT-5.6 LunaOpenRouter10 个信源在谈事件专题推荐理由:DeepSeek-V4-Flash比GPT-5.6 Luna便宜六成,一周调用7.22万亿Token登顶,逼得硅谷连夜降价,你要不要看看?原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash
16:43官方一手pandaily@contact@pandaily.com (Pandaily)Moonshot AI的Kimi K3、阿里Qwen3.8-Max和字节Doubao-Seed-2.1均采用原生多模态训练,而DeepSeek、智谱和腾讯混元仍坚持纯文本路线。在长程智能体任务中,视觉信息的实时参与成为决定性因素。这一差异将影响下一代模型在复杂环境中的表现。AI模型Kimi K3DeepSeek V4多模态6 个信源在谈事件专题推荐理由:Kimi K3和DeepSeek V4现在走了两条路:一个搞原生多模态,一个纯文本硬扛。长任务里能不能看懂画面,差距会越来越大。原文稍后读已读值得跟进有用关注 Kimi K3
05:35Gary Marcus@GaryMarcus精选Jonathan Gorard在X平台发文指出,包括GPT-5.6 Sol、Fable 5和Kimi K3在内的前沿AI模型,在实现基本非线性PDE求解器时普遍失败,常引入数值稳定性、精度阶数或物理一致性方面的显著错误,即使给出详细提示并要求用Lean形式化实现也是如此。即使成功的案例中,较可靠的模型如Fable 5也常消耗超过Lanyon这类轻量神经符号模型100倍的token。其团队认为,只有像Lanyon这样的真正神经符号模型才能为复杂科学问题生成具有端到端正确性保证的超可靠数值求解器,且目前差距明显。AI模型GPT-5.6Fable 5Kimi K38 个信源在谈事件专题推荐理由:Gorard团队实测了GPT-5.6、Fable 5等模型,发现它们连基础非线性PDE都解不对,而Lanyon用更少token就能搞定,想了解模型短板可以看看。原文稍后读已读值得跟进有用关注 GPT-5.6
04:29lmarena.ai@lmarena_ai76°AI 评测平台 LMSYS CEO Angelopoulos 在 20VC 播客中表示,中国开源模型 Kimi K3 已超越西方顶级闭源模型,打破了“外国实验室只是蒸馏美国技术”的说法。他警告,开源模型权重可能被植入后门,某个触发词可导致企业数据大规模外泄。他还判断,70% 的 neo-labs 只是研究项目,无法成为可持续业务。他强调,未来企业的护城河将来自专有数据和网络效应,而非可即时生成的软件。行业Kimi K3开源模型AI安全5 个信源在谈事件专题推荐理由:LMSYS CEO 在 20VC 直接开讲:Kimi K3 已经超越西方闭源模型,还警告开源权重可能藏后门。想听不绕弯的行业实话,可以看这个。原文稍后读已读值得跟进有用关注 Kimi K3
22:17官方账号Nathan Lambert: Interconnects@Florian Brand开放模型系列第23期介绍了Laguna S2.1、Inkling和Kimi K3。这三个模型展示了开源权重在帕累托前沿上的竞争力,兼顾性能与效率。文中指出,训练强模型的能力正在快速扩散到更多团队。AI模型Laguna S2.1InklingKimi K37 个信源在谈事件专题推荐理由:三个新开源模型:Laguna S2.1、Inkling和Kimi K3,这期合集讲清楚了它们好在哪。原文稍后读已读值得跟进有用关注 Laguna S2.1
17:14官方账号Decoder@Gregor KobsikClaude Opus 5 能用单一提示词生成完整 3D 游戏,包括第一人称射击、卡丁车赛车和《我的世界》克隆,全程不依赖任何外部资源。几何、纹理、物理乃至部分音乐均以代码形式生成,并在浏览器中直接运行。与 GPT-5.6 Sol 和 Kimi K3 的并排对比中,Opus 5 产出细节明显更丰富。AI模型Claude Opus 5AnthropicGPT-5.6 Sol10 个信源在谈事件专题推荐理由:想用一句话生成游戏?Claude Opus 5 能直接做出带物理和音乐的3D完整原型,比 GPT-5.6 Sol 更精细。原文稍后读已读值得跟进有用关注 Claude Opus 5
21:08IT之家(博客/媒体)埃隆·马斯克今早关注了 DeepSeek 的 X 账号,Big Tech Alert 账号发布了这一动态。DeepSeek 昨日通过 API 文档宣布 DeepSeek-V4-Flash 正式版上线公测,主打超高性价比,相关 X 消息已获超 2.5 万点赞和超 5000 条转发。马斯克在 7 月 23 日《经济学人》专访中称中国在机器人和 AI 领域实力雄厚,可能成为领导者,并特别提到对月之暗面 Kimi K3 模型印象深刻。他认为中国在 AI 竞赛中有决定性优势,电力供应能力是关键因素。AI模型DeepSeek-V4-FlashDeepSeekKimi K310 个信源在谈事件专题推荐理由:马斯克刚关注了 DeepSeek,同一天 V4-Flash 正式版 API 公测,性价比拉满,X 上已经 2.5 万赞,值得围观。原文稍后读已读值得跟进有用关注 DeepSeek-V4-Flash
11:12shao__meng@shao__meng华为在 Hugging Face 发布 openPangu-2.0-Pro 的开源权重。官方称这是首个完全在昇腾 NPU 上训练的 500B+ 级模型,MoE 总参数量 505B、激活 18B,上下文 512K。在少量有交集的基准上,GPQA-Diamond 87.9,低于 Kimi K3 的 93.5 和 GLM-5.2 的 91.2;SWE-bench Verified 68.5,与 DeepSeek V3.1 的 66.0 接近。其 BrowseComp 65.7 也明显落后于 Kimi K3 的 91.2。AI模型openPangu-2.0-Pro华为昇腾8 个信源在谈事件专题推荐理由:华为开源 openPangu-2.0-Pro(505B/512K,昇腾训练),但 GPQA 87.9 不如 Kimi K3。原文稍后读已读值得跟进有用关注 openPangu-2.0-Pro
06:11官方账号Simon Willison’s Weblog(博客/媒体)81°Bryan Cantrill和Adam Leventhal邀请Simon Willison讨论开放权重模型与专有模型的竞争,Kimi K3展示了开源模型可对标前沿闭源模型。节目还提到DeepSeek V4 Flash 0731的发布,以及Anthropic的一起安全事件。多位AI领域重要人物签署了关于开放权重和美国AI领导力的公开信,但有一人未签名。他们回顾了1月的预测,并新增预测称教皇年内会谈论开放模型。行业Kimi K3DeepSeek V4 FlashAnthropic10 个信源在谈事件专题推荐理由:这期播客聊了Kimi K3和DeepSeek V4 Flash,还有Anthropic翻车的事,听听Simon怎么评价开放权重和闭源模型的差距。原文稍后读已读值得跟进有用关注 Kimi K3
16:21官方一手pandaily@contact@pandaily.com (Pandaily)Kimi K3技术报告披露了MoonEP、KDA和AttnRes三套基础设施方案。报告强调MFU对训练效率的关键作用。Moonshot AI认为专家并行与共享专家的工程实现是真正壁垒。这些经验让开源模型的经济优势难以被复制。AI模型Kimi K3Moonshot AIMoonEP9 个信源在谈事件专题推荐理由:Moonshot AI公开了Kimi K3的MoonEP等设计,但真正难抄的是工程调优经验,这决定了开源模型能不能打。原文稍后读已读值得跟进有用关注 Kimi K3
10:01官方一手pandaily@contact@pandaily.com (Pandaily)Kimi K3 是 Moonshot AI 开源的 2.8T 参数模型,也是目前最大的开放权重模型。发布两天内因访问量过大导致服务短暂过载。该模型上线后占全球开源下载量的 41%,海外付费用户增长 4 倍,API 收入增长 400%。AI模型Kimi K3Moonshot AI开源模型9 个信源在谈事件专题推荐理由:Moonshot 开源的 Kimi K3 有 2.8T 参数,是目前最大开源权重模型,一上线就过载,海外付费和 API 收入都翻了几倍。原文稍后读已读值得跟进有用关注 Kimi K3
15:32IT之家(博客/媒体)微软于7月28日宣布,用户可通过Fireworks AI在Microsoft Foundry部署月之暗面的Kimi K3模型。该模型拥有2.8万亿参数,上下文窗口达100万词元,单次可处理约75万单词。定价方面,输入每百万Token为3.30美元,输出16.50美元,缓存输入0.33美元。Kimi K3是当前最大的开放模型之一。AI模型Kimi K3Fireworks AIMicrosoft Foundry10 个信源在谈事件专题推荐理由:Kimi K3来了,2.8万亿参数、百万上下文,还能在微软平台直接部署,开发者可以试试。原文稍后读已读值得跟进有用关注 Kimi K3
13:32官方一手marktechpost@Michal SutterMoonshot AI 在 Kimi K3 Open Day 上开源了 MoonEP,这是一个专家并行(EP)通信库,专为分布式 Mixture-of-Experts(MoE)训练优化。该库采用 MIT 许可证发布,旨在解决大规模 EP 通信的效率瓶颈。MoonEP 提供平衡的负载分配和低延迟通信,可与 Kimi K3 等模型配合使用。AI模型Moonshot AIMoonEPKimi K310 个信源在谈事件专题推荐理由:Moonshot AI 开源了 MoonEP,一个专门加速 MoE 训练中专家并行通信的库,比现有方案更均衡高效,做分布式训练的同学可以试试。原文稍后读已读值得跟进有用关注 Moonshot AI
12:15shao__meng@shao__meng精选Cline 团队让 Kimi K3 模型对自身运行的 Cline harness 框架进行递归式自我改进。连续运行 17 小时后,Terminal-Bench 2.1 基准从 77.5% 提升至 88.8%,同时运行成本从 $79 降至 $49.8。实验通过分析失败日志、形成假设、修复再验证的闭环迭代实现性能优化。AI模型Kimi K3ClineTerminal-Bench10 个信源在谈事件专题推荐理由:Cline 让 Kimi K3 自己优化自己,17 小时让基准从 77.5% 涨到 88.8%,成本还降了 37%,这波自举操作有点意思。原文稍后读已读值得跟进有用关注 Kimi K3
08:32Gary Marcus@GaryMarcus72°Gary Marcus 指出 Derek Thompson 对 Anthropic 收入的预测过于乐观。Anthropic 第二季度收入 109 亿美元,但得益于一次性补贴和 tokenmaxxing 热潮,之后面临 Kimi K3、GLM 5.2 等中国模型的激烈竞争。Marcus 认为全年达到 1000 亿美元以上不现实,且对比 Elon Musk 旗下公司收入(特斯拉 940 亿、SpaceX 180 亿、X 30 亿)具有误导性。关键在于盈利,Anthropic 除 Q2 外每季度都亏损,Q3 前景不明。行业Anthropic收入预测Kimi K310 个信源在谈事件专题推荐理由:Gary Marcus 用具体数字拆穿了 Anthropic 年入 1500 亿美元的夸张说法,点出了中国模型竞争和盈利困境,值得一看。原文稍后读已读值得跟进有用关注 Anthropic
05:09宝玉@dotey75°Cline团队让Kimi K3进行自我迭代改进,在17小时内将Terminial Bench评测分数从77.5%提升至88.8%。同时每轮成本从79美元降低至49.8美元。但评论指出这并非模型自我进化(修改权重),而是Agent利用明确验收标准优化Harness的过程。优化后的Harness只对自身Benchmark有效,未必证明通用性能提升。AI模型ClineKimi K3Terminial Bench10 个信源在谈事件专题推荐理由:Cline让Kimi K3自己当工程师优化测试框架,17小时得分从77.5%涨到88.8%,成本还降了快一半,挺有意思的实验。原文稍后读已读值得跟进有用关注 Cline
03:08v0@v0Kimi K3 在 Deepsec.sh 私有网络安全基准测试中达到最佳性价比,召回率与价格平衡。GPT 5.6 召回率最高但单次运行成本是 Kimi K3 的 7 倍以上。GLM 5.2 价格比 Kimi K3 低 40%,召回率接近。Fable 5 完全拒绝执行,无法用于安全分析。推荐用 GPT 5.6 做一次性基线,用 Kimi K3 做持续分析。AI模型Kimi K3GPT 5.6GLM 5.210 个信源在谈事件专题推荐理由:Malte Ubl 实测发现 Kimi K3 在网络安全漏洞检测上性价比吊打 GPT 5.6,适合做持续扫描,省大钱。原文稍后读已读值得跟进有用关注 Kimi K3
16:53IT之家(博客/媒体)82°月之暗面(Moonshot AI)本轮融资筹集35亿美元,远超原计划的10亿至20亿美元,投后估值达350亿美元。其突破性模型Kimi K3在硅谷引发轰动,推动融资规模超预期。公司已启动新一轮融资,投前估值目标500亿美元,计划在香港IPO前完成最后一轮,最快今年上市。行业月之暗面Moonshot AIKimi K310 个信源在谈事件专题推荐理由:月之暗面靠Kimi K3模型融了35亿美元,估值冲到350亿,远超预期,还准备去香港上市,值得关注。原文稍后读已读值得跟进有用关注 月之暗面
11:16量子位@量子位的朋友们九章云极Alaya Token平台宣布完成对Kimi K3模型的适配。Kimi K3是全球首个开源3T级模型,参数规模达到3万亿。用户可通过Alaya Token直接部署和调用该模型。AI产品Kimi K3Alaya Token九章云极10 个信源在谈事件专题推荐理由:想用3T开源模型?Alaya Token现在直接支持Kimi K3,省去部署麻烦。原文稍后读已读值得跟进有用关注 Kimi K3
11:02IT之家(博客/媒体)72°月之暗面于7月28日开源了2.8万亿参数模型Kimi K3,该模型采用KDA混合注意力机制和Stable Latent MoE架构,原生支持视觉理解与100万token上下文。摩尔线程基于MTT S5000智算卡及MUSA软件栈,第一时间完成了Day-0适配,包括核心算子、分布式链路及SGLang-MUSA的Hybrid State Pool管理。面对Kimi K3的MXFP4 checkpoint,摩尔线程设计了在线逐层量化方案,无需离线转换即可推理。MTT S5000单卡AI稠密算力达1000TFLOPS,配备80GB显存和1.6TB/s显存带宽。AI模型Kimi K3摩尔线程MTT S500010 个信源在谈事件专题推荐理由:月之暗面刚开源2.8万亿参数的Kimi K3,摩尔线程的国产GPU MTT S5000立马适配,能直接跑官方MXFP4格式,推理部署很方便。原文稍后读已读值得跟进有用关注 Kimi K3
08:24Amjad Masad@amasadReplit 联合创始人 Amjad Masad 宣布公司已加入 NVIDIA、微软等企业支持开源权重 AI。今日起,Replit 产品引入模型选择功能,首发支持 Kimi K3 模型。用户可根据任务、成本和性能在 Replit 平台上切换模型。此举旨在实现“合适的模型做合适的工作”的理念。AI产品ReplitKimi K3开源模型10 个信源在谈事件专题推荐理由:Replit 现在让你选模型了,首发 Kimi K3,和 NVIDIA、微软一起力挺开源,编程时能按需切换,挺实用。原文稍后读已读值得跟进有用关注 Replit
08:21Fireworks AI@FireworksAI_HQ精选Trilogy AI基于Kimi K3模型在Fireworks平台开发了网络安全防御剧本。该方案可自动审计每个代码仓库、分类每个安全扫描结果、审查每个PR。这体现了AI单位经济性在安全领域的重要性。完整细节见其博客文章。AI产品Kimi K3FireworksTrilogy AI10 个信源在谈事件专题推荐理由:Fireworks和Trilogy AI用Kimi K3搞了个安全自动化方案,能自动审计仓库、扫描和PR。做安全运维的值得看看。原文稍后读已读值得跟进有用关注 Kimi K3
08:20Fireworks AI@FireworksAI_HQFireworks宣布支持对Kimi K3进行微调。Kimi K3是首个3万亿参数的开源前沿模型。通过Training API,用户可进行监督微调、偏好微调和强化学习。训练支持专用和无服务器两种模式,适合产品化部署。AI模型Kimi K3Fireworks微调10 个信源在谈事件专题推荐理由:Fireworks现在可以微调Kimi K3了,3万亿参数的开源模型,支持多种训练方式,适合定制产品。原文稍后读已读值得跟进有用关注 Kimi K3
04:41Aravind Srinivas@AravSrinivasPerplexity 宣布为 Pro 和 Max 订阅用户新增 Kimi K3 模型,该模型同时可用在 Search 和 Computer 两种模式下。Kimi K3 托管于美国服务器,Perplexity 称其为前沿模型。此举扩展了 Perplexity 的多模型生态,用户可直接在搜索和桌面级操作中调用 Kimi K3。AI产品PerplexityKimi K3AI搜索10 个信源在谈事件专题推荐理由:Perplexity 把 Kimi K3 放进来了,Pro/Max 用户现在能在搜索和电脑模式直接用,服务器还在美国,速度应该不错。原文稍后读已读值得跟进有用关注 Perplexity
03:10Fireworks AI@FireworksAI_HQFireworks AI 宣布在其平台上支持微调 Kimi K3 模型。用户可使用自有数据训练模型,并托管在美国端点。微调后的模型权重归用户所有,且平台承诺零数据留存。无需担心数据泄露风险,直接通过 Fireworks 平台开始构建。AI产品Kimi K3Fireworks微调10 个信源在谈事件专题推荐理由:想用自己的数据微调模型还不想把数据交给别人?Fireworks 上的 Kimi K3 能做到,权重归你,数据不留。原文稍后读已读值得跟进有用关注 Kimi K3
01:15lmarena.ai@lmarena_ai精选Code Arena 新增全栈开发能力评测,涉及多步推理、工具调用和端到端应用生成。Kimi K3 (Max) 排名第一,GPT 5.6 Sol (xHigh) 第二,Claude Fable 5 第三。榜单完整排名可在 arena.ai 查看。AI模型Kimi K3GPT 5.6 SolClaude Fable 510 个信源在谈事件专题推荐理由:Code Arena 刚上线了全栈能力排行榜,Kimi K3 拿了第一,GPT 5.6 和 Claude Fable 紧随其后,想比模型写代码能力的可以看看。原文稍后读已读值得跟进有用关注 Kimi K3
20:18官方一手歸藏(guizang.ai)@op7418开源模型Kimi K3(2.8T参数)在80张RTX 5090上以单流20 tok/s运行。该配置使用GDDR7游戏显卡和普通以太网,无需HBM,权重为官方MXFP4格式。此前同一集群运行GLM-5.2时从30 tok/s优化至110 tok/s。任何实验室或大学均可使用该配置复现。AI模型Kimi K3RTX 5090GDDR710 个信源在谈事件专题推荐理由:80张游戏卡就能跑2.8T参数的Kimi K3,20 tok/s挺实用,比之前GLM-5.2快了好几倍。原文稍后读已读值得跟进有用关注 Kimi K3
18:53The Rundown AI@therundownaiMoonshot 公司发布了其 Kimi K3 模型的权重。该模型在多项任务上表现出色。开发者可通过公开渠道下载权重,用于微调或部署。此次开源为社区提供了更强大的基础模型选择。AI模型Kimi K3Moonshot开源模型10 个信源在谈事件专题推荐理由:Moonshot 开放了 Kimi K3 权重,你可以直接下载这个强力模型,比之前很多开源模型更强。原文稍后读已读值得跟进有用关注 Kimi K3
18:44IT之家(博客/媒体)71°阿里云宣布灵骏真武M890超节点实例成功适配月之暗面2.8万亿参数大模型Kimi K3。Kimi K3采用MoE架构,基于平头哥真武M890训推一体AI芯片,64张M890通过ICN Switch 1.0实现800GB/s All-to-All高速互联,显存规模达9TB。联合优化使万亿级MoE模型EP专家并行通信流量运行在单一高带宽域内,提升推理效率。T-Head SAIL软件栈让Mooncake推理框架即开即跑,Triton支持减少自定义算子重写工作量。AI产品Kimi K3阿里云灵骏真武M89010 个信源在谈事件专题推荐理由:阿里云真武M890超节点实例首发适配Kimi K3,2.8万亿参数MoE模型推理效率获硬件级优化,适合关注大模型部署和推理加速的开发者。原文稍后读已读值得跟进有用关注 Kimi K3
17:39量子位@量子位的朋友们Kimi K3和Unlimited OCR两个中国开源模型在全球排行榜上分获第一和第二名。这一排名来自最新一期开源大模型评测榜单。两个模型分别由不同中国团队研发,展示了在推理和多模态OCR任务上的领先性能。海外开发者社区对此给予高度关注。AI模型Kimi K3Unlimited OCR开源模型10 个信源在谈事件专题推荐理由:中国开源模型又霸榜了,Kimi K3和Unlimited OCR直接把前二占了,海外网友都看呆了。原文稍后读已读值得跟进有用关注 Kimi K3
16:26AI Will@FinanceYF5Claude Opus 5(Max 推理版)在 Frontend Code Arena 和 Text Arena 两个基准测试中均取得第一,超越此前领先的 Kimi K3。其默认 high 推理版本表现也不错,在 Code Arena 排名第三(仅次于 Kimi K3),在 Text Arena 排名第二。这一成绩显示 Claude 系列在编码和文本推理任务上的最新进展。AI模型Claude Opus 5Kimi K3Frontend Code Arena10 个信源在谈事件专题推荐理由:Anthropic 的 Claude Opus 5 刚发布就刷榜,在编码和文本两个任务上超过了之前很火的 Kimi K3,值得关注。原文稍后读已读值得跟进有用关注 Claude Opus 5