论文精选72°13:00400次实验揭示LLM攻击一致性:Gemini 2.5 Flash-Lite成功率85%领先这项研究揭示了LLM作为攻击者的行为规律和可靠性差异,做AI安全评估或红队测试的团队值得关注——它告诉你不同模型在真实攻击场景下的稳定性和失败模式,直接指导模型选型和防御策略。#LLM安全#渗透测试#攻击一致性#模型对比aarXiv: Anthropic@Galip Tolga Erdem原文稍后读已读值得跟进有用关注 LLM安全