8月27日
09:55
09:55官方账号arXiv cs.AI@Jia-Hao Ji, Sijie Li, Jiabei Cheng, Zixi She, Jin-Tai Yu, Zhiyuan Yuan
研究多智能体系统中候选供应和答案选择对LLM判断价值的影响,分析15,336个问题,发现正确答案常在候选中,但系统仍可能报告错误答案。通过结合答案频率和判断者的评估,将准确率从63.82%提升至70.82-70.95%,主要通过挽救被常见错误压倒的正确答案。
推荐理由:这篇论文分析了多智能体系统中LLM判断的价值,揭示了候选供应和答案选择的重要性,值得一读。