德里高等法院裁定 OpenAI 利用印媒 ANI 内容训练 AI 未侵犯版权

法院认定合理使用,ANI举证失败

德里高等法院在审理ANI诉OpenAI版权侵权案时,法官明确表示,OpenAI在训练ChatGPT过程中使用ANI的新闻内容属于“合理使用”例外。ANI未能向法院提交充分证据,证明ChatGPT生成的回复中直接复制了其受版权保护的原创报道。法院因此驳回了ANI要求OpenAI立即停止使用其内容并赔偿2000万卢比(约23.7万美元)的初步禁令申请。

OpenAI辩护:训练数据仅为“非表达性元素”

OpenAI的律师Amit Sibal在法庭上强调,其大型语言模型(LLM)在训练中仅将数据分解为“标记”——这些标记包含句法、语义和语法信息等非表达性元素,而非受版权保护的表达本身。OpenAI将这一过程类比为“阅读一本书”:阅读并不构成侵权,且模型在预训练阶段后已无法再访问原始训练数据。此外,OpenAI声称已主动将ANI网站列入内部屏蔽名单,停止在训练中使用其内容。

管辖权争议与ANI的“永久存储”指控

ANI在诉讼中主张,其新闻作品“永久存储在ChatGPT的内存中”,且未被程序性删除。但OpenAI反驳称,公司服务器位于印度境外,AI训练也不在印度进行,因此印度法院无权管辖。不过,法院任命的两名版权专家顾问均认为,由于ANI在德里开展业务,德里高等法院对此案拥有管辖权。

行业立场分化:出版商与音乐界反对,初创公司担忧创新受阻

多家行业组织申请介入此案。印度出版商联合会和数字新闻出版商协会指出,OpenAI未经授权使用内容会降低作品经济价值,威胁新闻业可持续发展。印度音乐产业(IMI)也主张在未获许可情况下使用版权歌曲构成侵权。然而,初创公司Flux Labs AI警告称,若强制征收AI训练许可费,将扼杀小公司的创新空间。目前,印度《信息技术法》第43条及2023年《数字个人数据保护法》对未经授权的数据抓取有严格规定,但法院此次裁定未直接适用这些条款。