一篇有意思的论文:不靠每次采样几十个候选,而是把 power sampling 的锐化直接蒸进模型,单次生成就超过 64 候选采样,数学和代码基准都有实测数字。
#蒸馏
共 61 条 · 7 天 4 条 · 30 天 17 条
信息流里打上「蒸馏」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月6日
OPPD 蒸馏法让模型单次生成即达 power sampling 64 候选的效果
10月5日
10月4日
10月2日
10月1日
9月30日
9月28日
DyMD:用分布匹配蒸馏把 14B 视频模型压缩成四步 1.3B 学生模型
一篇把 14B 视频世界模型压到 1.3B、四步就能跑的蒸馏论文,专治 DMD 蒸馏后机器人动作变僵的问题,做具身智能的可以看看。
9月24日
Google 研究:Harness-Zero 在训练后移除专用 harness,任务成功率反升
Google 这篇论文把 agent harness 蒸馏进模型,移除专用 harness 后成功率反而从 23.3% 涨到 44.3%,比带 harness 还高,做 agent 的都该看看。
9月23日
Anthropic 报告:代理查询路由如何支撑大规模蒸馏
Anthropic 出了份报告,讲有人拿代理偷偷转发用户 prompt 到 Claude API 蒸馏模型,还点出隐私风险,做 AI 产品的人都该看看。
OPD 蒸馏方法让低比特量化模型恢复推理能力
量化到 2-bit 后模型做数学题会发疯循环?这篇论文用 on-policy 蒸馏把 MATH-500 保留率从 35% 拉到 70%,做端侧部署的可以看看。
9月15日
9月13日
9月11日
9月9日
9月4日
9月1日
8月31日
8月12日
8月11日
8月6日
8月4日
7月29日
7月26日
7月25日
7月24日
7月23日
美科技顾问指控Moonshot AI蒸馏Anthropic的Fable造Kimi K3
美国科技顾问直接点名Moonshot AI偷学Anthropic的Fable造Kimi K3,K3最近成绩逼近前沿,但背后是蒸馏争议,这场中美AI摩擦值得关注。
7月22日
开源模型回顾:Kimi K3、Qwen 3.8、习近平WAIC演讲、蒸馏、开闭源差距及未来
聊了Kimi K3、Qwen 3.8这些新进展,还有WAIC上习近平的发言,分析了蒸馏和开闭源差距,看完对开源格局心里有数。
7月21日
行业01:21
Ben Thompson提案:训练数据应属合理使用,禁止服务条款阻止蒸馏Ben Thompson提出了一个实际解决蒸馏禁令与训练数据版权矛盾的方案,同时还能帮美国开源模型对抗中国对手,值得一看。
7月20日
7月19日
7月17日