AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

弃权机制

共 1 条相关 AI 资讯
8月17日
10:34
10:34官方账号arXiv cs.LG@Ziyang Luo, Zhongyao Chu, Xinjie He, Youting Wang, Xukui Qin, Runxiong Wu, Yan-Syuan Chen
YOPO 在冻结的 Qwen2.5(1.5B/3B/7B)上实现单次前向传播同时作答和弃权。它用条件转向探针改写残差流,并用零样本充足性方向判断信息是否足够,同时训练小网络从转向后的状态重建转向前的残差。在 alphaNLI 上,1.5B 模型的三路准确率从 0.375 提升到 0.798,超过两遍推理参考的 0.753。在十个骨干模型、六个模型家族上,YOPO 在 1.5B/3B/7B 分别取得 0.798/0.830/0.893,均高于两遍参考。论文在 SQuAD2、RepLiQA、MuSiQue 上完成原生标签验证,并提出首个 answer-or-abstain 基准。
论文YOPOQwen2.5弃权机制

推荐理由:YOPO 让冻结的 Qwen2.5 单次前向传播就完成作答和弃权判断,alphaNLI 达 0.798,超过两遍推理,值得看。
原文
精选全部日报登录