12:55IT之家(博客/媒体)精选Anthropic 宣布新版 Claude 模型将在 AI 生成的文本中嵌入无法察觉的水印,水印不改变文本含义或可读性,复制粘贴后仍保留,部分编辑后也可能存在。此举是 Anthropic 根据欧盟《人工智能法案》提高透明度承诺的一部分,8 月 2 日或之后发布的新 Claude 模型从上线之日起支持该功能,旧版模型也在逐步加入。水印适用于全球范围内由 Claude 生成的内容,包括通过云服务商使用 Claude 时产生的内容,Anthropic 计划向第三方提供检测工具。然而,大幅修改、改写、翻译或混合其他文字可能导致水印无法检测,且检测到水印不能证明 Claude 是原始作者。Anthropic 是继 Google DeepMind 的 SynthID 之后第二家推出文本水印技术的大型 AI 实验室。AI产品ClaudeAnthropic水印10 个信源在谈事件专题推荐理由:Anthropic 给 Claude 生成文本加了隐形水印,复制粘贴也去不掉,出版社和学校以后查 AI 代写更方便了。原文稍后读已读值得跟进有用关注 Claude
19:08techcrunch@Rebecca BellanPangram完成900万美元融资,用于扩展其AI检测软件。该公司发布了新的AI文本检测模型Pangram 4,并推出了一个AI图像检测模型的研究预览版。这些工具旨在识别互联网上日益泛滥的AI生成内容。行业PangramPangram 4AI安全1 个信源在谈事件专题推荐理由:Pangram拿了900万刀发布Pangram 4文本检测模型,还有图片检测预览版。想找出AI写的文章?试试这个。原文稍后读已读值得跟进有用关注 Pangram
09:33官方账号arXiv cs.AI@Yangjun Lu, Hongyi Zhou, Fabian Spill, Kai Ye, Chengchun Shi, Jin Zhu论文提出一种token级检测方法,通过平滑相邻token分数并采用自适应Lepski规则选择带宽,识别人机协作文本中由LLM生成的部分。该方法无需token级标注数据训练,在合成和真实数据集上优于多种基线。作者部署了公开网站实现该方法。论文LLMtoken级检测文本检测推荐理由:这篇论文给了一个新方法,能精确找出LLM写的片段,不用提前标注,比现有文档级检测更细。原文稍后读已读值得跟进有用关注 LLM
17:52官方账号Epoch AI@EpochAIResearch精选Epoch AI Research对AI检测器进行了压力测试,发现它们很少将人类文本误判为AI生成。但当要求LLM模仿特定作者风格时,检测器将AI文本误判为人类的比例约为13%。对于科学写作场景,假阴性率进一步上升至约26%。研究表明,AI检测器在应对模仿性文本时存在显著缺陷。论文AI detectorsLLMEpoch AI Research推荐理由:Epoch AI的测试告诉你,用AI检测器查作业或论文可能不靠谱,模仿作者风格就能骗过13%的检测,科学写作更糟。原文稍后读已读值得跟进有用关注 AI detectors
03:09官方账号Simon Willison’s Weblog(博客/媒体)Simon Willison 对 LLM 生成文章中充斥的套话感到不满,于是用 Fable 5 的 vibe code 开发了一个高亮工具。该工具能识别 10 种常见写作模式,例如“no fluff, no filler, no jargon”这类陈词滥调。用户粘贴文本即可自动标记出这些模式,帮助识别 AI 生成痕迹。技巧Fable 5LLM文本检测10 个信源在谈事件专题推荐理由:Simon Willison 用 Fable 5 搓了个小工具,专门高亮 LLM 文章里那些“无废话、无填充”的套路句,一共 10 种模式,对付一眼 AI 文很好用。原文稍后读已读值得跟进有用关注 Fable 5