纽约时报修订诉讼,指控微软为OpenAI建造版权侵权超级计算机
NYT slams Microsoft for building copyright-infringing supercomputer for OpenAI
《纽约时报》周四提交经大量编辑的法庭文件,提议修订对OpenAI和微软的版权诉讼,明确指控微软通过建造全球最强大的超级计算系统之一,主动鼓励OpenAI窃取其作品。此举源于最高法院在Cox案中确立的新帮助侵权标准,要求原告证明被告有意诱导非法行为。《纽约时报》认为新证据显示该超级计算机专为帮助OpenAI未经许可训练AI而设计,其文章在训练数据中被加权处理。微软称修订是“挽救不利先例的最后手段”。
NYT将矛头指向微软定制的超级计算机,指控其蓄意协助侵权,这一升级可能让公平使用抗辩失效,我觉得任何建立在全网爬取上的模型都该紧张了。
在周四一份经过大量涂黑处理的法庭文件中,《纽约时报》提议修改其对 OpenAI 和微软的版权诉讼,以澄清一项主张,并指控微软通过构建一套跻身全球最强之列的定制超级计算系统,积极鼓励 OpenAI 窃取《纽约时报》的作品。
《纽约时报》提出这一动议之前,最高法院在 Cox Communications 一案中作出了有利于 Cox 的裁决。在该案中,索尼试图主张 Cox 作为互联网服务提供商助长了音乐盗版,但未能成功,此案为帮助性侵权确立了新的标准。今后,原告必须证明相关方有意采取行动诱导非法行为。鉴于法律先例已经发生变化,《纽约时报》现在希望修改其诉状,使其针对微软的帮助性侵权主张与这一新标准保持一致。
“今天,我们请求法院允许提交一份修改后的诉状,以进一步加强我们的案件,依据新法律和取证过程中发现的新证据,澄清我们对微软的帮助性侵权主张,”《纽约时报》发言人 Graham James 在提供给 Ars 的一份声明中表示。
除了澄清一项主张外,《纽约时报》还同意自愿撤销针对所有被告的两项帮助性版权侵权和商标淡化的主张。
微软发言人告诉 Ars,该公司认为这份修改后的诉状是“原告为将其主张从近期其他裁决中形成的不利先例中挽救出来而做出的最后一搏”。
但在其动议中,NYT 主张,允许提交修正后的起诉书不会对 Microsoft 或 OpenAI 造成任何损害。NYT 辩称,当法律标准发生变化时,允许原告修改其主张是恰当的,而且案件日程也不会因此推迟,因为“《时报》并未为其修正后的主张寻求任何额外的证据开示”。
“正如我们长期以来所主张的,Microsoft 积极怂恿 OpenAI 窃取我们受版权保护的作品,”James 表示。“除了修正这一主张并将案件精简至最有力的论点之外,我们的核心主张自提起本诉讼之日起始终如一——即 Microsoft 和 OpenAI 窃取了《时报》数百万件受版权保护的作品,以与我们自己的产品竞争并非法中饱私囊。”
NYT 将矛头指向 Microsoft 超级计算机
2023 年,NYT 成为首家起诉 OpenAI 的大型出版商。这家知名报纸指控 ChatGPT 在其文章上进行了非法训练,通过逐字输出文章侵犯了其版权,并通过将 ChatGPT 定位为 NYT 订阅的替代品而造成市场损害,还通过将某些主张错误归因于 NYT 的报道而造成声誉损害。此外,NYT 还指控,ChatGPT 输出对 Wirecutter 评测的摘要,导致用户不再点击联盟营销链接,从而使撰稿人损失了佣金。
在最初的诉状中,《纽约时报》将微软的超级计算系统描述为仿佛是在提供通用的云计算服务。更新后的诉状试图明确指出,这台超级计算机是为帮助 OpenAI 实施侵权而量身定制的,并声称其构建的明确目的就是在未经许可的情况下,用受版权保护的作品训练 AI。而正如《纽约时报》所主张的,其文章在这套系统中被赋予了更高的权重,因为两家公司都希望尽可能用最高质量的新闻业内容来训练模型,从而让这种写作水准能够在输出结果中被自信地模仿出来。
《纽约时报》主张,通过构建这台“异常复杂”的机器,微软不仅帮助挑选了被侵权的作品,还提供了一种在未经许可的情况下攫取受版权保护作品的手段。
《纽约时报》主张:“微软专门设计它,目的就是利用基本上整个互联网——并经过筛选,使其不成比例地突出《纽约时报》的作品——来训练史上能力最强的大语言模型。”
而如今,它被指控从中不公平地获利。
“微软在其整个产品线中部署了使用《纽约时报》内容训练的 LLM,仅在过去一年就帮助其市值提升了 1 万亿美元,”《纽约时报》指控称。
《纽约时报》指控称,模型输出显示出市场损害
对《纽约时报》而言,在证据开示过程中共享的输出内容——包括大量用户的 ChatGPT 会话记录——仍然是最有力的证据之一,表明 OpenAI 和 Microsoft 构建的工具通过生成《纽约时报》版权作品的近乎逐字摘录,据称取代了《纽约时报》。
在某些情况下,用户告诉 ChatGPT 他们试图绕过付费墙,并通过请求查看“下一段”就能看到文章的大量内容。在另一些情况下,“模型直接输出好几个段落”,无需此类操作。为了证明替代效应造成的市场损害,他们在诉状中分享了并排对比的示例,以及涉嫌侵权输出的截图:
来源:Ars Technica:AI(RSS) · arstechnica.com