10:18官方账号arXiv cs.AI@Zhu Zhang, Jixun Wang, Xiaoang Xu, Xiaorong Wang, Zihan Zhou, Zhiyuan Wang, Shuo Wang, Chaojun Xiao, Yuezhi Zhou长语境推理任务中,传统策略蒸馏存在教师支持偏差导致效果下降问题。该研究提出GC-OPD组校准策略,对Qwen3-4B等模型优化后,在五个长语境基准测试中表现提升。应用该策略后,Qwen3-8B模型的平均得分从35.12提升至44.65,验证了方法有效性。论文Qwen3-4BQwen3-8BLong-Context推荐理由:SolereZhang团队推出的GC-OPD方法,用于优化Qwen系列大模型完成长语境任务,比传统方法效果更好,值得尝试一下。原文稍后读已读值得跟进有用关注 Qwen3-4B