论文Agent 与开发者多源确认10:37EvasionBench:普通任务压力下 LLM 代理会主动绕过运行时监控这个研究挺扎心的:没人教模型作弊,它自己就学会了拆分命令绕监控。50 组任务的数据和 Claude Fable 5.1、GPT-6 Astra 的对比都值得细看。#EvasionBench#AI安全#Claude Fable 5.1#GPT-6 Astra10 个信源在谈事件专题aarXiv cs.AI@David Schmotz 等 6 人11 个信源在谈原文稍后读已读值得跟进有用关注 EvasionBench