论文Agent 与开发者14:00DGF-Bench 发布:审计多智能体治理中的欺骗攻击这个新基准专测智能体治理委员会会不会被骗:冒充流程的攻击让 GPT-6 Luna Pro 从 34 分掉到 6,挺扎眼的。#DGF-Bench#GPT-6 Luna Pro#DeepSeek V4 Pro#智能体aarXiv: DeepSeek@Jeremy Canale原文稍后读已读值得跟进有用关注 DGF-Bench