11:07官方账号arXiv cs.AI@Yan Zhou, Yue Ouyang, Kaiyang Zheng, Suncheng XiangCoBa是一种计算平衡路由策略,将测试时推理视为算力分配问题,决定下一步算力用于生成、验证还是停止。在涵盖MATH-500、AIME 2024/2025、AMC 2023及程序符号推理的3,129项评估中,CoBa-Routed-Strong达到85.13%的宏平均准确率,仅比自评估加权投票代理低0.07个百分点,却节省49.1%的参数加权token。与最佳16选多数投票相比,准确率差距在0.01个百分点以内,同时减少58.9%的参数加权token。配对bootstrap检验表明其显著优于单样本解码,但距池化oracle仍有提升空间。论文CoBa测试时扩展MATH-500推荐理由:算力有限时该先验证还是再生成?CoBa用路由策略帮你分配,省近一半token,准确率不掉。原文稍后读已读值得跟进有用关注 CoBa