模型中美对照多源确认精选02:16NVIDIA压缩MoE模型Puzzle-75B-A9B,吞吐量翻倍可保持质量英伟达把大MoE模型压到9B活跃参数,吞吐量翻倍,智能体应用部署成本大幅下降,适合模型高效推理场景。#Puzzle-75B-A9B#Nemotron-3-Super#MoE#模型压缩10 个信源在谈事件专题elvis@omarsar011 个信源在谈原文稍后读已读值得跟进有用关注 Puzzle-75B-A9B