IT之家:https://www.ithome.com/ 7 月 15 日消息,一群出版商和作家已对谷歌提起集体诉讼,指控这家科技巨头未经授权使用他们的版权作品训练其人工智能平台 Gemini。

Các nhà xuất bản và tác giả đã cùng nhau kiện Google, cáo buộc họ lạm dụng nội dung có bản quyền để huấn luyện Gemini AI

原告方包括 Hachette Livre、Cengage Group、Elsevier、作家 Scott Turow 以及 S.C.R.I.B.E . 等。

诉讼还指控,谷歌曾故意删除或修改这些作品中的版权信息,以“掩盖 Gemini 模型是基于被盗资料训练而成的事实”。

这起诉讼只是出版商、作者以及其他版权持有者针对 AI 公司发起的众多诉讼之一。目前,包括谷歌、Meta、OpenAI 和 Anthropic 在内的多家人工智能企业,都面临类似版权纠纷。

虽然这些案件大多仍在审理过程中,但美国加州法院此前已有两起早期裁决倾向于支持 AI 公司。相关法官认为,在美国版权法框架下,使用受版权保护的内容训练 AI 模型可以被视为“合理使用”(fair use)。

而美国现行版权法律是在互联网出现之前制定的,因此如何适用于 AI 时代仍存在大量争议。

不过,Anthropic 曾因训练 AI 时盗用版权作品而被处以 15 亿美元(IT之家注:现汇率约合 101.73 亿元人民币)罚款,这成为美国版权法历史上金额最高的一笔赔偿。大约 50 万名作者符合赔偿资格,每人至少可以获得 3000 美元(现汇率约合 20346 元人民币)。

但许多作者选择放弃领取和解赔偿,希望继续通过法律途径追究 AI 公司在训练模型时使用版权内容的问题。

加州法院此前的裁决并不意味着其他法院一定会认可科技公司的“合理使用”抗辩。不过,这一问题涉及复杂的法律和技术因素,因此这些判决也难以形成一个所有法院都必须遵循的明确先例。

此次针对谷歌的诉讼是在美国纽约南区联邦地区法院提起,这意味着另一位法官将有机会对 AI 训练是否属于合理使用发表不同意见。

在谷歌案件中,出版商与谷歌之间存在更复杂、更长期的合作历史。诉讼文件指出,出版商和作者过去长期向谷歌提供版权作品,目的是让这些书籍能够通过 Google Books 进行搜索。

但 Google Books 的搜索结果并不会让用户查看整本书,而是只提供有限的文本片段以及书籍目录信息。

原告认为,谷歌后来利用这些书籍副本训练 Gemini 模型。此外,谷歌还使用了上传至 Google Play 商店中的书籍内容进行训练,尽管其从未获得相关授权。

诉讼文件称:“谷歌非法复制了所有这些受到限制用途约束的作品,并用于 AI 训练,同时明知自己并未获得这样做的授权。”

原告还引用了一份谷歌内部文件。据称,该文件指出,使用版权书籍训练 AI 模型可能会给谷歌带来“严重问题”,并可能导致“数百亿美元至数千亿美元的潜在罚款”。