据《金融时报》报道,根据《纽约时报》提交的最新诉讼文件,OpenAI在明知其对出版商构成“生存威胁”的情况下,仍复制了数百万篇受版权保护的文章,以打造潜在价值高达“天文数字”的AI技术。

《纽约时报》
目前,《纽约时报》和其他媒体机构正向OpenAI寻求数十亿美元的损害赔偿金。此案的关键在于,OpenAI和共同被告微软是否通过利用出版商的内容训练其模型,侵犯了版权法。
《纽约时报》的律师表示,OpenAI受商业利益驱动,大量获取该报的内容。他们称,OpenAI联合创始人格雷格·布罗克曼(Greg Brockman)大约在2017年写道,他“被那些天文数字般的财富深深驱动”,希望通过OpenAI技术的商业化获得这笔财富。
《纽约时报》周四提交的文件披露了新的证据。这起案件是版权持有人针对AI公司提起的数十起诉讼中最受关注的案件之一。版权持有人指控这些公司盗用相关材料训练AI模型,而这些模型正在威胁人类内容创作者的工作岗位。
OpenAI一直辩称,根据版权法,利用公开可获得的内容训练模型属于“合理使用”,这一法律依据与搜索引擎访问相关内容时采用的理由类似。该公司表示,其大语言模型会对原始内容进行转换,而不是对其进行复制,而且不会成为《纽约时报》或其他出版物的替代品。
但《纽约时报》的律师表示,“被告未经许可,反复完整复制数百万篇受版权保护的文章,以开发具有替代性的商业AI产品”。
《纽约时报》律师还称,OpenAI是在明知其AI工具可能取代原始材料的情况下这样做的。根据周四提交的文件,OpenAI旗下ChatGPT负责人曾写道,AI产品对出版商构成“生存威胁”,这些产品“在很大程度上具有替代性,就是这样,而且随着它们变得更好,替代性会越来越强”。
诉讼还引用了微软应用科学总监布伦特·赫克特(Brent Hecht)的话。赫克特据称曾写道,用受版权保护的内容训练大语言模型是“一场规模空前的惊人盗窃”,此案胜诉将“彻底嘲弄‘合理使用’这一理念”。
微软发现,与传统搜索引擎相比,使用其AI回答工具的用户对原始内容的点击率低了83%至93%。
微软在一份声明中表示:“这些言论反映的是一名员工的个人观点,并非法律分析。”
诉讼文件还称,OpenAI采用了“越界且具有欺骗性”的手段获取付费墙后的内容,而如今担任OpenAI总裁、实际上第二号高管的布罗克曼当时已经知悉这一做法。文件称,当一名员工告诉布罗克曼“有办法绕过《纽约时报》付费墙”后,布罗克曼回应道:“啊,不错。”
微软CEO萨蒂亚·纳德拉(Satya Nadella)为该案所作的证词中表示,如果当时“得知OpenAI抓取并利用付费墙后的信息进行训练”,他会依据两家公司当时的协议,行使微软的权利,要求OpenAI“重新训练其模型”。
微软周四表示,纳德拉的证词“谈的是广泛原则以及人们查找和消费信息方式正在发生的变化”,并非对本案核心“版权问题的结论”。
OpenAI未立即回应置评请求。该公司此前曾表示:“本案不是人类创作与AI之争,而是《纽约时报》想以牺牲惠及所有人的进步为代价,谋求一笔不该得的横财。”