11:02IT之家(博客/媒体)72°月之暗面于7月28日开源了2.8万亿参数模型Kimi K3,该模型采用KDA混合注意力机制和Stable Latent MoE架构,原生支持视觉理解与100万token上下文。摩尔线程基于MTT S5000智算卡及MUSA软件栈,第一时间完成了Day-0适配,包括核心算子、分布式链路及SGLang-MUSA的Hybrid State Pool管理。面对Kimi K3的MXFP4 checkpoint,摩尔线程设计了在线逐层量化方案,无需离线转换即可推理。MTT S5000单卡AI稠密算力达1000TFLOPS,配备80GB显存和1.6TB/s显存带宽。AI模型Kimi K3摩尔线程MTT S500010 个信源在谈事件专题推荐理由:月之暗面刚开源2.8万亿参数的Kimi K3,摩尔线程的国产GPU MTT S5000立马适配,能直接跑官方MXFP4格式,推理部署很方便。原文稍后读已读值得跟进有用关注 Kimi K3
09:59官方一手pandaily@contact@pandaily.com (Pandaily)摩尔线程在WAIC 2026上展示了三个AI工厂框架:模型训练工厂、Token生成工厂和智能体生产工厂。其中,由北京大学训练的5D世界模型基于MTT S5000 GPU部署。该模型在斯坦福WorldScore基准上取得了全球第一的成绩。这个框架试图将GPU算力从单一代工扩展到端到端AI生产流水线。AI模型Moore ThreadsMTT S50005D世界模型1 个信源在谈事件专题推荐理由:摩尔线程用自家MTT S5000 GPU训出的世界模型拿了斯坦福评测第一,三个AI工厂的划分也挺新鲜,值得关注国产GPU的进展。原文稍后读已读值得跟进有用关注 Moore Threads
23:09IT之家(博客/媒体)精选摩尔线程联合创始人王东指出,推理市场没有万能芯片,而是解决方案的组合。他强调,中国前沿基础模型相比国外同级模型有明显成本优势。摩尔线程旗舰产品MTT S5000已规模量产,基于第四代MUSA架构,单卡AI算力最高1000 TFLOPS,配备80GB显存。公司2026年上半年营收预计16.5-17.5亿元,同比增长135%-149%。行业摩尔线程MTT S5000推理市场1 个信源在谈事件专题推荐理由:王东聊推理市场碎片化,摩尔线程MTT S5000性能参数和营收增长都挺亮眼,适合关注国产GPU的朋友。原文稍后读已读值得跟进有用关注 摩尔线程
13:30IT之家(博客/媒体)精选美团正式开源万亿参数 MoE 大模型 LongCat-2.0,总参数量达 1.6T,平均激活约 48B,支持 1M 超长上下文,专为 Agentic Coding 场景设计。摩尔线程基于 AI 训推一体 GPU 智算卡 MTT S5000 及 MUSA 软件栈完成全链路快速适配,覆盖模型加载、推理引擎拉起、算子优化等环节。MTT S5000 具备硬件原生 FP8 加速能力,结合 SGLang-MUSA 推理引擎协同优化,提升长上下文推理性能与系统吞吐。摩尔线程将适配过程标准化,降低了前沿模型在国产算力平台的部署门槛,并在 AI Coding、Agent 工作流等场景完成部署验证。AI模型LongCat-2.0摩尔线程MTT S50002 个信源在谈事件专题推荐理由:美团开源了 LongCat-2.0,摩尔线程的 MTT S5000 卡当天就适配好了,国产 GPU 也能流畅跑这个万亿参数模型。原文稍后读已读值得跟进有用关注 LongCat-2.0
13:23IT之家(博客/媒体)6月12日,MiniMax 开源了新一代原生多模态旗舰模型 M3。同日,摩尔线程宣布其旗舰级 AI 训推一体智算卡 MTT S5000 已完成对该模型的 Day-0 适配。MTT S5000 凭借硬件级原生 FP8 加速,单卡 AI 算力(稠密)高达 1000 TFLOPS,配备 80GB 显存与 1.6TB/s 带宽,支撑百万 token 级长序列。适配通过原生算子定制提升推理吞吐并降低延迟,同时同步拉起 vLLM 与 SGLang 两大推理框架。AI模型MiniMax M3摩尔线程MTT S50007 个信源在谈事件专题推荐理由:摩尔线程让国产模型跑得更快原文稍后读已读值得跟进有用关注 MiniMax M3