AITP
精选全部 AI 动态AI 日报Agent 接入我的简报我的追踪阅读偏好内容方法关于更新日志信源提报反馈
外观
登录 / 注册
AITOP

运行时安全

共 1 条相关 AI 资讯
7月31日
09:43
09:43官方一手arXiv: DeepSeek@Jiajun Zhou, Zhaoxuan Ke, Jihang Ye, Xuanze Chen, Shanqing Yu, Qi Xuan
精选
AgentS4D 是一个沙箱化基准,用于评估基于 LLM 的工作区智能体在完整执行生命周期中的运行时安全,包含 328 个风险注入案例。其框架定义了 6 个风险来源、6 种诱导策略、9 类目标危害和 7 个生命周期检查点。作者用 4 种 harness(Hermes、OpenClaw、Claude Code、Codex)和 5 个 LLM 后端(GPT-5.5、Gemini 3.1 Pro、DeepSeek-V4-Pro、MiniMax-M3、Qwen3.7-Plus)组成 20 种配置,共运行 6,560 次测试,其中 68.0% 触发了预设的不安全信号。结果显示 66.22% 的不安全运行仍能完成任务,说明任务完成不能证明运行时安全。
论文AgentS4D智能体AI安全
事件专题

推荐理由:AgentS4D 用 328 个风险案例测了 20 种智能体组合,发现 66% 的测试任务虽然完成但实际不安全,别光看结果。
原文
精选全部日报登录