论文11:34Skill Entropy:长程推理的技能切换评测与训练Skill Entropy能测出模型切换推理技能的短板,还能当训练信号:Qwen3小模型得分从34%飙到68%,也能用在OpenR1-Math数据上。#Skill Entropy#Skill^2-Bench#Qwen3#长程推理aarXiv cs.LG@Yinghui He 等 9 人原文稍后读已读值得跟进有用关注 Skill Entropy