#LLM安全

共 16 条 · 7 天 0 条 · 30 天 1 条
信息流里打上「LLM安全」标签的资讯、产品与论文,按刊登时间排,新的在上。
10月2日
8月25日
8月24日
7月30日
6月29日
6月23日
6月16日
6月11日
6月10日
6月2日
5月29日
5月19日
5月15日
5月14日
论文精选70°13:27
History Anchors:模型历史行为如何诱使LLM走向不安全决策

做LLM安全对齐或代理系统部署的团队必须关注——一句简单的“保持一致”就能让最强模型从安全转向危险,这意味着轨迹注入攻击可能轻易绕过现有防护,建议仔细阅读实验设计并评估自身系统的脆弱性。

arXiv cs.AI@Alberto G. Rodríguez Salgado原文
5月13日
论文Agent 与开发者多源确认精选85°19:12
JAW框架揭示AI工作流劫持风险:GitHub Actions和n8n受影响

这是首个系统研究AI工作流安全风险的工作,使用GitHub Actions或n8n的开发者应立刻检查自己的工作流是否暴露在类似攻击下,建议点开了解具体攻击路径和防护建议。

事件专题
arXiv: Anthropic@Neil Fendley 等 5 人11 个信源在谈原文