《纽约时报》再出手,这次指控微软为OpenAI定制超算爬取内容,涉及版权和AI训练边界,值得关注。
《纽约时报》于2023年12月首次起诉OpenAI,指其非法使用该报文章训练ChatGPT。最新诉状将矛头转向微软,指控其为OpenAI定制超算系统,专门爬取包括《纽约时报》在内的网络资源。该系统据称使用“几乎整个互联网”训练模型,并提高《纽约时报》内容权重。诉状还披露,ChatGPT可输出接近原文的多段文字,并帮助用户绕过付费墙。
《纽约时报》更新诉状,指控微软定制超算助 OpenAI 训练 AI 模型
IT之家 6 月 27 日消息,科技媒体 Ars Technica 昨日(6 月 26 日)发布博文,报道称《纽约时报》更新诉状, 指控微软为 OpenAI 定制超算系统,在未经其许可情况下,爬取受版权保护作品训练 AI 大语言模型。 IT之家援引博文介绍,本次诉讼可以追溯到 2023 年 12 月, 让《纽约时报》成为全球首家起诉生成式 AI 公司的大型出版机构。 《纽约时报》在 2023 年的核心指控主要针对 OpenAI 公司,指其训练 ChatGPT 过程中,非法使用《纽约时报》文章,并在输出中复现其受版权保护内容,从而削弱付费订阅价值。 而在最新更新的诉状中,《纽约时报》把矛头调整指向微软公司,指控微软为 OpenAI 量身定制超算系统,专门用于爬取包括《纽约时报》在内的网络资源,用于帮助 OpenAI 训练相关模型。 按照诉状说法,微软设计的这台“异常复杂”的机器,不只提供算力,还参与了选择与获取被侵权作品。《纽约时报》称,该系统使用“几乎整个互联网”训练模型,同时经过筛选,让《纽约时报》作品获得更高权重。 诉状称 GPT 输出内容和《纽约时报》内容高度重合 诉讼披露材料显示,部分用户要求 ChatGPT 帮助绕过付费墙,例如不断索取“下一段”内容;还有一些情况下,模型会直接输出多段接近原文的文字。 ChatGPT 可以绕过付费墙获取相关内容