#红队测试
共 24 条 · 7 天 2 条 · 30 天 5 条
信息流里打上「红队测试」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月9日
10月8日
10月1日
9月28日
9月11日
9月6日
8月19日
8月13日
7月29日
7月17日
OpenAI 详解 GPT-Red:自动红队模型以84%胜率击败人类
OpenAI 搞了个 GPT-Red 自动红队模型,提示注入赢人类 84% 对 13%,还发现了 Fake Chain-of-Thought 攻击。
7月16日
7月14日
AHA:自动化红队测试发现Claude Code和Codex的智能体漏洞
想了解如何自动化挖Claude Code和Codex的漏洞?这篇论文提出了AHA方法,比现有方法强14%,还能跨场景复用。搞智能体安全的值得看。
7月9日
论文11:20
制度性红队测试:部署规则而非仅模型因果影响多智能体AI安全这篇论文拿多个模型种群跑了几万局游戏,发现换一条规则,事故率能差 58 个百分点,而且匿名化也挡不住针对性消除。做多智能体安全的一定要看。
7月3日
6月23日
6月9日
6月7日
6月4日
论文11:10
FoeGlass:上下文学习即可红队测试音频深度伪造检测器做音频安全或深度伪造检测的团队,终于有了一个无需手动标注就能自动发现模型盲点的工具——FoeGlass用LLM上下文学习就搞定了,建议直接跑一下开源代码看看效果。
5月29日
400次实验揭示LLM攻击一致性:Gemini 2.5 Flash-Lite成功率85%领先
这项研究揭示了LLM作为攻击者的行为规律和可靠性差异,做AI安全评估或红队测试的团队值得关注——它告诉你不同模型在真实攻击场景下的稳定性和失败模式,直接指导模型选型和防御策略。
5月12日