论文精选12:05ZEDA:让MoE模型具备算力预算意识,跳过半数专家做MoE模型部署或推理优化的团队,ZEDA直接解决了算力浪费问题——跳过一半专家还能保持效果,值得一试。#MoE/混合专家#模型压缩/加速#自蒸馏#算力优化AI Will@FinanceYF5原文稍后读已读值得跟进有用关注 MoE/混合专家