10:34官方账号arXiv cs.LG@Ziyang Luo, Zhongyao Chu, Xinjie He, Youting Wang, Xukui Qin, Runxiong Wu, Yan-Syuan ChenYOPO 在冻结的 Qwen2.5(1.5B/3B/7B)上实现单次前向传播同时作答和弃权。它用条件转向探针改写残差流,并用零样本充足性方向判断信息是否足够,同时训练小网络从转向后的状态重建转向前的残差。在 alphaNLI 上,1.5B 模型的三路准确率从 0.375 提升到 0.798,超过两遍推理参考的 0.753。在十个骨干模型、六个模型家族上,YOPO 在 1.5B/3B/7B 分别取得 0.798/0.830/0.893,均高于两遍参考。论文在 SQuAD2、RepLiQA、MuSiQue 上完成原生标签验证,并提出首个 answer-or-abstain 基准。论文YOPOQwen2.5弃权机制推荐理由:YOPO 让冻结的 Qwen2.5 单次前向传播就完成作答和弃权判断,alphaNLI 达 0.798,超过两遍推理,值得看。原文稍后读已读值得跟进有用关注 YOPO