论文Agent 与开发者10:30MADBench评测多智能体辩论安全性MADBench首次系统评估多智能体辩论安全性,发现三个恶意智能体只能影响28.3%的正确答案。#MADBench#多智能体辩论#大语言模型#安全基准aarXiv cs.AI@Yuwan Liu 等 4 人原文稍后读已读值得跟进有用关注 MADBench