09:30官方账号arXiv cs.AI@Zhaoxi Zhang, Xiaomei Zhang该论文提出授权连续性概念,解决长期运行AI Agent在部署后进化导致的授权失效问题。作者设计了状态边界模型,在授权时固定一个转换包络和不可变效应上限,确保Agent演化不会突破用户设定的效应边界。模型区分请求效应和实现效应,证明在完全中介、合理抽象、衰减委托和监控完整性条件下,演化无法放大保护效应。论文还映射了六类Agent突变的授权后果。论文AI安全智能体授权连续性推荐理由:这篇论文给AI Agent授权画了一条红线,解释了为什么进化后的Agent可能不是你原来授权的那个,以及如何用固定上限保证安全。做Agent框架的值得一看。原文稍后读已读值得跟进有用关注 AI安全