AITOP6月11日 15:28
精选
过去 24 小时,从 958 条中筛出 57 条
6月11日
15:28
1107 vs 303:谷歌悄悄开源了一个“拆打字机”的模型,把大模型速度翻了4倍
15:23
AITOP6月11日 15:23
15:07
AITOP6月11日 15:07
6月9日
12:41
12:41
arXiv cs.AI@Blake Bullwinkel, Eugenia Kim, Amanda Minnich, Mark Russinovich
精选
推荐理由:做AI安全对齐的团队终于有了一个稳定的GRPO攻防协同训练方案,能同时提升攻击发现能力和防御鲁棒性,建议做红队测试的开发者直接参考。
6月7日
13:42
13:42
marktechpost@Sana Hassan
精选
推荐理由:对于需要系统化测试 LLM 安全性的团队,这个教程提供了从零到自定义探针的完整路径,建议直接跟着步骤搭建自己的红队流程。
6月1日
00:09
AITOP6月1日 00:09
5月29日
13:00
13:00
arXiv: Anthropic@Galip Tolga Erdem
精选72°
推荐理由:这项研究揭示了LLM作为攻击者的行为规律和可靠性差异,做AI安全评估或红队测试的团队值得关注——它告诉你不同模型在真实攻击场景下的稳定性和失败模式,直接指导模型选型和防御策略。
