事件专题 · 多源确认

MiniMax M3 发布:长上下文多模态模型,支持文本/图像/视频推理

MiniMax 团队发布了 MiniMax M3,这是一个支持文本、图像和视频推理的长上下文多模态模型。模型采用稀疏注意力机制,总参数量约 428B,激活参数仅约 23B,在保持高性能的同时大幅降低了计算成本。该模型已开源权重,可在 Hugging Face 获取,并可通过 NVIDIA 的 GPU 加速端点免费试用。M3 的长上下文能力使其在处理视频、长文档等场景中具有优势。

当前结论

多模态推理模型终于有了高效的开源选择——MiniMax M3 用 23B 激活参数实现长上下文多模态推理,做视频分析或长文档处理的团队可以直接在 NVIDIA 端点免费试,值得关注。

11 个信源63° AI 热度最后更新 2026/6/12 14:44:39

证据链

相关来源 2LMSYS Org (SGLang)
查看原文
相关来源 3Simon Willison’s Weblog
查看原文
相关来源 5Sebastian Raschka
查看原文
相关来源 10Tri Dao (FlashAttention)
查看原文

冲突核查

现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。

查看资讯详情