11:38官方账号arXiv cs.AI@Abdullah XPOLIS研究项目首篇论文探讨AI代理在系统中的安全制度设计,发布5280集冻结研究套件。预指定委托实验覆盖4个模型家族,高冲突诊断增加3个模型端点。详细宪法提示词实现0/384违规,可溯源执行守卫同样0/384,但阻止51/384次尝试,其中44次后续安全完成。本地状态守卫在洗钱场景中22/96违规,溯源执行0/96(p=4.77x10^-7)。资源分配实验显示揭示数值上限改变代理请求。论文多智能体AI安全POLIS推荐理由:POLIS首篇论文,用5280集实验证明规则只是制度一部分,权威状态和阻断路径同样关键。做多智能体安全必读。原文稍后读已读值得跟进有用关注 多智能体