在周四提交的一份经过大量删节的法庭文件中,《纽约时报》提议修改其对 OpenAI 和微软的版权诉讼,以澄清一项指控,并声称微软通过构建一套跻身全球最强大之列的定制超级计算系统,积极鼓励 OpenAI 窃取《纽约时报》的作品。
《纽约时报》提出这一动议之前,最高法院在一起案件中支持了考克斯通信公司,索尼在该案中试图指控考克斯作为互联网服务提供商助长了音乐盗版行为,但未能成功,这为帮助侵权设定了新标准。今后,原告必须证明相关方是故意采取行动以诱导违法行为。认识到法律先例已发生变化,《纽约时报》现在希望修改其诉讼,使其针对微软的帮助侵权指控符合这一新标准。
“今天,我们请求法院允许提交一份经修改的诉讼,以进一步加强我们的案件,根据新法律和在证据开示过程中发现的新证据,澄清我们对微软帮助侵权的指控,”《纽约时报》发言人格雷厄姆·詹姆斯在提供给 Ars 的一份声明中表示。
除了澄清一项指控外,《纽约时报》还同意自愿撤销针对所有被告的两项帮助版权侵权和商标淡化的指控。
微软一位发言人告诉 Ars,该公司认为这份修改后的诉讼是“原告为使其指控免受近期其他裁决中不利先例影响而做出的最后努力。”
但在其动议中,《纽约时报》辩称,允许提交修改后的诉讼不会对微软或 OpenAI 造成损害。《纽约时报》认为,当法律标准发生变化时,允许原告修改论点是合理的,而且案件时间表也不会因此推迟,因为“《纽约时报》并未寻求为支持其修改后的指控而进行任何额外的证据开示。”
“正如我们长期以来所声称的那样,微软积极鼓励 OpenAI 窃取我们的受版权保护作品,”詹姆斯表示。“除了修改这一指控并将案件精简为最有力的论点外,我们的核心主张自提起诉讼之日起从未改变——即微软和 OpenAI 窃取了《纽约时报》数百万篇受版权保护的作品,以与我们竞争产品并非法牟利。”
《纽约时报》将矛头指向微软超级计算机
2023 年,《纽约时报》成为首家起诉 OpenAI 的大型出版商。这家知名报纸指控 ChatGPT 非法使用其文章进行训练,通过逐字输出文章侵犯其版权,并通过将 ChatGPT 定位为《纽约时报》订阅的替代品造成市场损害,同时因虚假归因于《纽约时报》报道的言论造成声誉损害。此外,《纽约时报》还指控,ChatGPT 输出的 Wirecutter 评测摘要,因减少了来自联盟链接的点击量,从而剥夺了撰稿人的佣金。
在最初的诉状中,《纽约时报》将微软的超级计算系统描述为提供通用云计算服务。更新后的诉状则试图明确指出,该超级计算机是为帮助 OpenAI 实施侵权行为而量身定制的,并指控其建造目的明确是为了在未经许可的情况下,在受版权保护的作品上训练 AI。正如《纽约时报》所声称的,其文章在该系统中被赋予了更高的权重,因为两家公司都希望尽可能在最高质量的新闻内容上训练模型,从而使输出内容能够自信地模仿这种写作水平。
《纽约时报》指控,通过构建这台“异常复杂”的机器,微软不仅协助选择了被侵权的作品,还提供了未经许可获取受版权保护作品的手段。
《纽约时报》指控称:“微软专门设计该机器,目的是利用几乎整个互联网——并经过筛选以不成比例地突出《纽约时报》作品——来训练史上最强大的大语言模型。”
而现在,据称它正在不公平地获利。
《纽约时报》指控称:“微软在其全线产品中部署了经过《纽约时报》作品训练的大语言模型,仅在过去一年就帮助其市值提升了万亿美元。”
《纽约时报》指控,模型输出显示了市场损害。
对于《纽约时报》而言,在证据开示阶段共享的输出内容——包括用户 ChatGPT 会话的巨量片段——仍然是证明 OpenAI 和微软构建的工具涉嫌取代《纽约时报》的最有力证据之一,这些工具生成了其受版权保护作品的近乎逐字摘录。
在某些情况下,用户告诉 ChatGPT 他们正试图绕过付费墙,并通过请求查看“下一段”而看到了文章的大量段落。在其他情况下,“模型直接吐出多个段落”,无需如此周旋。为了证明替代性造成的市场损害,他们在投诉中分享了并排对比的示例,以及涉嫌侵权的输出截图: