主要来源arXiv cs.AI
查看原文事件专题 · 多源确认
窃取专有LLM推理轨迹:加密块可跨模型解密
Anthropic、OpenAI和Google等主流LLM提供商将推理轨迹加密后返回客户端,但研究发现这些加密块在会话、用户和模型间可互换。攻击者将加密轨迹注入同提供商的较弱模型,可强制其明文输出推理内容,无需直接越狱更强模型。通过解码315,320个推理块,研究者恢复了367个PII和182个凭证。该漏洞还支持隐形提示注入,可污染智能体部署。论文提出加密和系统级缓解措施。
当前结论
这篇论文揭露了Anthropic、OpenAI和Google推理加密的漏洞,能跨模型解密,还挖出大量隐私数据,搞AI安全的必看。
11 个信源76° AI 热度最后更新 2026/8/10 17:24:50
证据链
相关来源 1IT之家
查看原文相关来源 2Decoder
查看原文相关来源 3Yangyi
查看原文相关来源 4elvis
查看原文相关来源 5AI Engineer
查看原文相关来源 6Harrison Chase
查看原文相关来源 7Lenny Rachitsky
查看原文相关来源 8Amjad Masad
查看原文相关来源 9向阳乔木
查看原文相关来源 10The Rundown AI
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。