混合专家(Mixture-of-Experts,MoE)是一种神经网络架构,通过稀疏激活多个专家子网络来扩展模型容量而不显著增加计算成本,近年来被广泛应用于大语言模型中以提升效率与性能。其核心思想是将输入仅路由到部分专家,从而在保持推理成本较低的同时扩大模型总参数量。
№mixtureofexperts·general
mixture-of-experts
别名
- 首次出现
- 2026-05-22
- 最近出现
- 2026-07-24
- 累计提及
- 99
§ 01综述
§ 02相关报道10 条在档
- 01开源模型Laguna S 2.1发布:118B MoE,8B激活,1M上下文
- 02Thinking Machines Lab 发布 Inkling:975B 参数开源多模态 MoE,激活 41B 参数,可控思考努力
- 03Agents-A1:35B MoE智能体模型在长视野任务上媲美万亿参数性能
- 04CAEE: 成本感知的专家执行框架提升多设备MoE推理
- 05SARA:通过语义锚定路由对齐解锁MoE多语言知识
- 06Prime Intellect 发布 prime-rl 0.6.0,用于训练万亿参数 MoE 模型的智能体 RL
- 07现代神经网络架构中的守恒定律统一框架
- 08从自监督语音模型到混合专家:稳健的反欺骗
- 09vLLM 日零支持 Cohere North Mini Code 模型
- 10MPI 方法重新设计 MoE 路由器:对齐专家主奇异方向
§ 03邻近话题