09:15官方一手arXiv: OpenAI@Abu Bakar Siddik该综述聚焦于结合语言模型、工具、记忆和执行环境的网络能力AI智能体,识别了五类脆弱性:多步攻击链、与沙箱边界冲突的目标、供应链与凭据暴露、持久命令与控制、自动化行动速度。以2026年7月Hugging Face/OpenAI事件为案例,区分了事件特定发现与文献中的通用结论。讨论了用于遏制、权限分离、溯源及响应者访问的控制措施,包括防御性制品可能被滥用的双重用途问题。论文AI AgentsAI安全评估遏制10 个信源在谈事件专题推荐理由:这篇arXiv综述把AI智能体的五大安全漏洞和防御控制掰开讲清楚了,还拿Hugging Face/OpenAI事件做案例,做AI安全的都该看看。原文稍后读已读值得跟进有用关注 AI Agents