论文多源确认精选09:43AgentS4D:LLM工作区智能体执行生命周期的运行时风险基准AgentS4D 用 328 个风险案例测了 20 种智能体组合,发现 66% 的测试任务虽然完成但实际不安全,别光看结果。#AgentS4D#智能体#AI安全#运行时安全5 个信源在谈事件专题aarXiv: DeepSeek@Jiajun Zhou 等 6 人6 个信源在谈原文稍后读已读值得跟进有用关注 AgentS4D