AITP
精选全部 AI 动态AI 日报Agent 接入关于更新日志信源提报反馈
登录 / 注册
AITOP
全部 AI 动态
AI 相关资讯全量信息流
全部博客资讯推文论文
全部模型产品行业论文技巧
标签:Ternary Mamba×
6月17日
11:58
11:58arXiv cs.LG@Ramprasath Ganesaraja, Sahil Dilip Panse, Swathika N
Mamba-2 1.3B参数模型通过分组量化感知训练(QAT)从FP16教师蒸馏,仅消耗4 GPU小时(单H100)和102M tokens,将内存从2,687 MB压缩至744 MB(3.61倍)。零样本七任务平均准确率达48.1%,接近Bi-Mamba的48.4%(±0.9pp置信区间)。该方法无需从头训练150B tokens,使用预训练检查点即可。研究还发现零比例坍缩现象,即可学习量化尺度导致的不稳定性,这在从头训练中不会出现。后处理校正策略对SSM无效,因循环结构导致误差累积。
论文Mamba-2Ternary Mamba量化感知训练模型压缩状态空间模型

推荐理由:把Mamba-2压缩到1比特权重不用花大钱从头训练,用预训练模型加少量微调就行,效果只差0.3%。
原文
6月16日
20:46
AITOP6月16日 20:46
600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI600亿美元买下Cursor,xAI终于拿到了编程工具,但真正值得跟踪的或许不是AI
6月12日
12:57
AITOP6月12日 12:57
Claude代码里藏了个20260612,18个月后的AI记忆革命已经开始倒计时
6月11日
15:28
AITOP6月11日 15:28
1107 vs 303:谷歌悄悄开源了一个“拆打字机”的模型,把大模型速度翻了4倍
15:23
AITOP6月11日 15:23
DiffusionGemma颠覆文本生成?自回归模型的“统治”要结束了
15:07
AITOP6月11日 15:07
每秒1107个token,Google开源的扩散模型为什么能改变本地推理格局?
精选全部日报登录