22:05宝玉@dotey精选73°本文以Claude的水印为例,详解了KGW方法的原理:生成时用密钥和已生成token计算哈希,将词表分为绿组和红组,并提高绿组词被选中的概率。检测时用同一密钥还原分组,若绿组词占比显著超50%则判定带水印。改写可破解水印,但统计模型生成的哈希(如SIR、Adaptive Watermark)能增强鲁棒性。Google在2万条文本的人类反馈实验中称质量下降难以感知,但短文本或高确定性输出(如1+1=2)会失效。工程难点包括流式输出、密钥轮换和代码类输出的限制。技巧文本水印KGWAnthropic10 个信源在谈事件专题推荐理由:想搞懂AI文本水印到底怎么运作、能不能被破解?这篇把KGW方法、改写攻击和工程难点讲得明明白白,还对比了Anthropic和Google的做法。原文稍后读已读值得跟进有用关注 文本水印
09:46宝玉@dotey精选文本水印通过在大模型生成文本时嵌入隐藏标记来工作,例如当A/B两个同义词都可用时始终选择B。另一种方式是遇到C/D两种表达时选择次高概率的D,让文本看起来完全正常。这种水印即使把文本转成图像再用OCR扫描也依然存在,因为水印加在内容本身而非排版。添加和检测都由大模型自动完成,人类难以感知;修改文本可能破坏水印,但人不知道水印加在哪些词上,很难全部破坏。技巧文本水印AI水印OCR推荐理由:刘群用同义词和表达方式这两个例子,把AI文本水印的机制讲清楚了,看完就懂为什么改字也去不掉。原文稍后读已读值得跟进有用关注 文本水印
06:01Paul Graham@paulgAnthropic宣布,从2026年8月2日起发布的新Claude模型将自动嵌入不可见水印。这种Claude水印是文本的一部分,而非元数据,复制粘贴后依然存在,并能经受部分编辑。该计划源于Anthropic签署的欧盟AI法案行为准则,适用于全球范围的Claude服务。现有Claude模型的水印功能仍在开发中,具体时间尚未公布。AI产品ClaudeAnthropic文本水印10 个信源在谈事件专题推荐理由:Anthropic给Claude文本加隐形水印,2026年8月起,复制编辑都去不掉。做去水印工具可提前动手。原文稍后读已读值得跟进有用关注 Claude