12:38官方账号arXiv cs.AI@Gjergji Kasneci, Enkelejda Kasneci当前AI安全讨论过度聚焦显性失败,而部署系统中许多关键失败是隐蔽且被工作流正常化的。本文提出五层框架诊断隐性风险:认知完整性、控制完整性、时间完整性、组织完整性和生态系统完整性。该框架识别了过度依赖、提示注入、奖励黑客、记忆中毒、评估欺骗等风险模式。作者呼吁从模型中心评估转向社会技术系统可靠性。论文AI安全隐藏风险五层框架推荐理由:这篇论文讲的是AI系统那些不容易发现的隐患,比如过度依赖、提示注入和记忆中毒,不只是看模型本身,还分析组织和使用环境的风险。原文稍后读已读值得跟进有用关注 AI安全