#AI安全

共 2389 条 · 7 天 336 条 · 30 天 998 条 · 话题观测 →
9月28日
模型Agent 与开发者多源确认精选73°20:34
Artificial Analysis 推出 Cyber Index,评估 AI 模型的企业网络防御能力

网络安全方向的新基准,Grok 4.7 和 MiMo-V2.6-Pro 并列第一,但 GPT-6 Sol 在端到端任务上全部拒绝执行,这个对比挺有意思。

事件专题
官方账号Artificial Analysis@ArtificialAnlys11 个信源在谈原文
论文Agent 与开发者多源确认09:13
AGATE:基于数据溯源的 LLM 智能体运行时攻击防御框架

给智能体安全感兴趣的人:这篇提出 AGATE,用数据溯源和确定性检查防组合攻击,还接了 DeepSeek Harness、OpenCode、OpenClaw 三个真实 harness 验证,连误拦的代价都量化了。

事件专题
arXiv: DeepSeek@Xiaorui Zhang 等 9 人11 个信源在谈原文
9月27日