论文精选19:12OGLS-SD:用结果引导的logit校准改进LLM推理自蒸馏如果你在做LLM推理优化或自蒸馏训练,OGLS-SD解决了教师-学生分布不匹配的痛点,用结果奖励校准logits的思路直接可复用,值得仔细看方法细节。#自蒸馏#推理模型#logit校准#结果引导aarXiv cs.AI@Yuxiao Yang 等 3 人原文稍后读已读值得跟进有用关注 自蒸馏