论文Agent 与开发者精选19:20提出首个多边对话参与者评估基准 MP-Bench研究团队提出了首个专门评估语音代理在多边对话中表现的基准 MP-Bench,通过12个语音代理的测试,揭示了当前实时语音代理在多边对话中的不足。#MP-Bench#语音代理#多模态aarXiv cs.AI@Yi-Jen Shih 等 10 人原文稍后读已读值得跟进有用关注 MP-Bench