10:14官方账号arXiv cs.LG@Chih-Hsuan Yang, Anjir Ahmed Chowdhury, Cheng-Hau Yang, Weijian Zheng, Fernando Llorente, Xiaolong Ma, Xinyang Li, Eliu A. Huerta, Ian T. Foster, Rajeev Thakur论文提出DHD协议,通过缓存五条独立生成的消息并回放给下游集成器,测量每条消息的轨迹价值。在五个数学与科学基准上,使用gpt-oss-120b和gemma-4-31B-it两个模型系列,错误但有用的消息出现在每个模型-基准组合中。在改变最终正确性的错误消息里,超过四成是有帮助的。重复实验显示这种效果不太可能来自回放随机波动(p=0.0002)。论文还发现,保留完整错误消息比只保留其推理或答案更有效,但完整消息优势的来源仍待解释。论文DHDgpt-oss-120bgemma-4-31B-it推荐理由:这篇论文给多智能体提了个醒:答错的消息也可能有用。用DHD协议能找出该留该扔的消息,比单看答案正确率更靠谱。原文稍后读已读值得跟进有用关注 DHD