论文13:06ConMoE:无需微调的MoE压缩框架,通过原型重分配保留专家池MoE模型部署内存瓶颈的团队终于有了无需微调的压缩方案——ConMoE通过原型重分配直接减少专家数量,做模型推理优化的开发者可以试试这个即插即用的方法。#MoE压缩#原型重分配#无需微调#专家池整合aarXiv: DeepSeek@Yilun Yao 等 6 人原文稍后读已读值得跟进有用关注 MoE压缩