论文11:55多智能体互审提升LLM医学问答推理能力这篇论文让多个AI模型互相评审对方的思考过程,医学问答准确率比单模型高5个百分点,比投票集成也高3个百分点,有意思。#Llama-3.1-8B#Qwen2.5-7B#Phi-4#DeepSeek-LLM-7BaarXiv: DeepSeek@Zaifu Zhan 等 3 人原文稍后读已读值得跟进有用关注 Llama-3.1-8B