AdvSim2Real:在Web世界模型中同时训练任务、注入攻击与智能体
页面上的恶意提示能劫持浏览器智能体,这篇论文让任务、攻击和智能体在模拟器里互相对抗着变强,4B 小模型对未见攻击完成率提升 33.6%。
页面上的恶意提示能劫持浏览器智能体,这篇论文让任务、攻击和智能体在模拟器里互相对抗着变强,4B 小模型对未见攻击完成率提升 33.6%。
给做 IoT 安全的人:论文实测了 5 种流式学习器被投毒时的表现,AT-SRP 防标签翻转 F1 到 0.904,方法可复现。
多智能体系统开发者终于有了保护KV缓存中隐式敏感信息的方案——LCGuard在不牺牲任务性能的前提下阻断信息重建攻击,做分布式AI协作的团队值得关注。