mamba·general

Mamba

别名
首次出现
2026-05-22
最近出现
2026-07-27
累计提及
30
§ 01综述

Mamba 近期进展

Mamba 是一种高性能的混合架构 Transformer 模型,近期在人工智能领域取得了显著进展。以下是对其近期进展的综述。

Mamba 近期进展

Soofi 发布 Soofi S 30B-A3B:开源混合 Mamba-Transformer MoE 模型支持德英双语:Soofi 协会发布了 Soofi S 30B-A3B 模型,这是一个开源的混合 Mamba-Transformer MoE 模型,支持德英双语。

NVIDIA 压缩 MoE 模型 Puzzle-75B-A9B,吞吐量翻倍可保持质量:NVIDIA 发布了 Puzzle-75B-A9B 模型,该模型通过压缩技术将吞吐量翻倍,同时保持模型质量。

Ternary Mamba:基于预训练检查点的分组 QAT 实现 W1.58A16 量化:Ternary Mamba 模型通过分组 QAT 实现了 W1.58A16 量化,提高了模型的效率。

Nemotron 3 Ultra 开源:Mamba-2 混合架构,效率惊人:Nemotron 3 Ultra 模型开源,它采用了 Mamba-2 混合架构,展现出惊人的效率。

当前焦点与观察点

Mamba 模型在近期的发展中,其混合架构和高效的性能成为了焦点。开源模型的发布和量化技术的应用,使得 Mamba 模型在人工智能领域具有了更广泛的应用前景。

§ 02相关报道10 条在档
  1. 01
    Google发布JAXBench:文档优化使Gemini 3 Flash正确率从5.8%升至37.3%
    elvis
  2. 02
    解读Gated Delta Networks:为何大模型参数能上T且质量好
    向阳乔木
  3. 03
    Soofi 发布 Soofi S 30B-A3B:开源混合 Mamba-Transformer MoE 模型支持德英双语
    marktechpost
  4. 04
    选择性状态空间模型状态使用的精确测量工具及其揭示的输入驱动迁移
    arXiv cs.LG
  5. 05
    英伟达发布 Audex 统一模型:30B 总参数,避免多模态扩展后文本能力下滑
    IT之家
  6. 06
    NVIDIA压缩MoE模型Puzzle-75B-A9B,吞吐量翻倍可保持质量
    elvis
  7. 07
    Ternary Mamba:基于预训练检查点的分组QAT实现W1.58A16量化
    arXiv cs.LG
  8. 08
    重计算技巧使SSM的推测解码速度翻倍
    Tri Dao (FlashAttention)
  9. 09
    Nemotron 3 Ultra 开源:Mamba-2 混合架构,效率惊人
    Sebastian Raschka
  10. 10
    NVIDIA Nemotron 3 深度解析:混合 Mamba Transformer + 潜在 MoE + MTP
    NVIDIA AI
§ 03邻近话题

本页综述由 AITOP 基于公开报道整理。原报道版权归各自来源所有。

/topic/Mamba