主要来源LMSYS Org (SGLang)
查看原文事件专题 · 多源确认
SGLang 首发支持 MiniMax-M3:428B 多模态 MoE 推理模型
SGLang 宣布 Day-0 支持 MiniMax-M3,这是 MiniMax 推出的原生多模态 MoE 推理模型,总参数量约 428B(活跃参数约 23B),支持文本、图像和视频的融合处理。M3 采用 MiniMax 稀疏注意力机制,在 1M 上下文下相比 M2 实现 9 倍预填充和 15 倍解码加速,每 token 计算量降至 1/20。该模型在编码和协作任务上达到前沿智能体性能,并原生支持 NVIDIA Blackwell 和 AMD MI350X/MI355X 上的 MXFP8 格式。开发者可通过 SGLang 立即运行该模型。
当前结论
SGLang 第一时间支持 MiniMax-M3,做多模态推理和长上下文应用的团队可以直接上手体验 428B 模型的稀疏注意力加速,编码和智能体任务表现值得一试。
11 个信源73° AI 热度最后更新 2026/6/12 14:18:34
证据链
相关来源 1vLLM
查看原文相关来源 2IT之家
查看原文相关来源 3NVIDIA AI
查看原文相关来源 4Poe
查看原文相关来源 5Together AI
查看原文相关来源 6Tri Dao (FlashAttention)
查看原文相关来源 7karminski-牙医 (AI工具)
查看原文相关来源 8Dylan Patel (SemiAnalysis)
查看原文相关来源 9lmarena.ai
查看原文相关来源 10rohanpaul_ai
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。