主要来源arXiv: OpenAI
查看原文事件专题 · 官方一手
EvoHunt:可迁移自进化剧本用于智能体安全审计
EvoHunt是一个在开源仓库上运行的安全审计剧本进化环境。它使用三个智能体驱动循环:审计智能体执行当前剧本,评估器根据真实情况打分,修订者根据失败分析更新剧本。在开源安全公告评估中,EvoHunt使Codex/GPT5.4-xhigh的端到端漏洞利用成功率从1.1%提升至6.2%。GLM5.1演变出的剧本在目标匹配率上达到11.3%,超过OpenAI Codex Security的9.2%。转移实验显示,Qwen3.6-27B借助GLM剧本从2.4%提升至6.5%,Qwen3.6-35B-A3B从1.1%提升至4.6%。
当前结论
这篇论文讲EvoHunt,能自动生成安全审计剧本,还能把经验迁移给弱模型,效果比商用产品还好。
11 个信源39° AI 热度最后更新 2026/6/15 08:57:45
证据链
相关来源 1宝玉
查看原文相关来源 2OpenAI
查看原文相关来源 3marktechpost
查看原文相关来源 4shao__meng
查看原文相关来源 5Geek
查看原文相关来源 6@OpenAIDevs
查看原文相关来源 7berryxia
查看原文相关来源 8@zarazhangrui
查看原文相关来源 9@hebbia
查看原文相关来源 10Decoder
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。