8月13日
18:14
18:14官方账号Decoder@Matthias Bastian
IIT Bombay和Adobe Research的研究者构建了一个逆语言模型,能从LLM输出文本反向重建原始提示词。该方法名为Previous-Token Prediction,达到近乎完美的准确率。它不需要访问模型权重,并且能跨不同模型使用。这一能力对依赖专有系统提示词的公司构成严重安全风险。

推荐理由:IIT Bombay和Adobe搞了个反向模型,能从AI输出还原你藏的提示词,不用看权重就能扒出系统提示,提示词秘密要保不住了。