论文11:58Ternary Mamba:基于预训练检查点的分组QAT实现W1.58A16量化把Mamba-2压缩到1比特权重不用花大钱从头训练,用预训练模型加少量微调就行,效果只差0.3%。#Mamba-2#Ternary Mamba#量化感知训练#模型压缩aarXiv cs.LG@Ramprasath Ganesaraja 等 3 人原文稍后读已读值得跟进有用关注 Mamba-2