主要来源arXiv: OpenAI
查看原文事件专题 · 官方一手
单提示词即可洗除水印:基础图像模型的新威胁
研究人员发现,攻击者可通过单个重建提示词,从OpenAI和Google的六种图像编辑模型中获取无法可靠解码水印的输出。研究评估了三种水印方案和1800个重建结果,发现OpenAI模型在有效载荷干扰方面表现最强,而Nano Banana 2显示DwtDct在高保真重建下仍然脆弱。提示词消融实验表明,无需特定的移除指令即可实现有效载荷干扰,这主要是由重建路径而非攻击性措辞引起的。
当前结论
这篇论文揭示了基础图像模型如何被用来洗除水印,比传统攻击方式更隐蔽有效。
4 个信源58° AI 热度最后更新 2026/9/1 13:46:31
证据链
相关来源 1techcrunch
查看原文相关来源 2elvis
查看原文相关来源 3DeepLearning.AI
查看原文冲突核查
现有去重数据只说明这些来源讨论同一事件,不代表立场相同。当前没有结构化的支持或反驳证据,不自动推断冲突。