论文08:23提示注入新研究:角色混淆让LLM更信文本风格而非内容这篇论文揭示了一个反直觉的发现:LLM会被文本的风格欺骗,而不是内容。研究者用简单的'去风格化'就能把攻击成功率从61%打到10%,对理解AI安全很有启发。#prompt injection#角色混淆#LLM安全#论文解读S官方账号Simon Willison’s Weblog原文稍后读已读值得跟进有用关注 prompt injection