数十年来,版权法主要关注的是未经作者许可对作品进行复制、分发或传播的行为。生成式人工智能的出现将关注点推向了更早的阶段。核心争议不再是人工智能生成内容是否复制了受保护的作品,而是利用版权素材训练人工智能模型这一行为本身,是否落入版权人专有权利的控制范围。1957年《印度版权法》并未就此作出明确回答。
2026年7月24日,印度德里高等法院AmitBansal法官在亚洲新闻国际传媒私人有限公司(以下简称“ANI”)诉OpenAI运营有限责任公司(以下简称“OpenAI”)案(ANIMediaPvt.Ltd.v.OpenAIOpCoLLC,案件编号:CS(COMM)1028/2024;临时禁令申请案号:I.A.45300/2024)中,针对这一法律空白开展审查:人工智能模型训练行为是否构成版权侵权?如构成侵权,该行为是否仍可适用1957年《印度版权法》第52条所规定的合理使用例外情形。
大型语言模型运行原理
在评述双方诉辩主张之前,法院先行厘清了大型语言模型(LLM)的运行机制,因为本案各项争议均直接涉及该类模型的运作方式。法院阐释:大型语言模型依托从多方来源收集到的海量数据集开展训练。训练过程中,数据被拆解为更小单元,即词元(token),再转换为被称为嵌入向量(embeddings)的数值表征,并通过运算提炼语言模式与语义关联。模型并不会存储或调取完整文章,而是学习词汇之间的统计关联,并根据用户提示预测下一个出现概率最高的词元。法院同时指出,在部分场景下,模型输出内容可借助检索增强生成技术(RAG)予以补充,即模型在生成答案前,先从外部数据源调取相关信息。
管辖权争议
法院优先审理管辖权异议,因该异议触及案件根本。法院初步认定,依据《印度版权法》第62条第2款以及1908年《民事诉讼法》第20条,本院享有地域管辖权:ANI的主要营业地与注册地址位于本院辖区;OpenAI面向印度全境用户提供服务;被诉侵权的模型输出内容在印度境内生成。
OpenAI提出抗辩,主张模型训练服务器设立在美国,《印度版权法》无法规制境外开展的训练行为。法院驳回该观点,并阐述理由:境外服务器存储数据仅是完整行为链条的末端环节,整个行为始于印度境内访问涉案作品;倘若采纳该抗辩逻辑,侵权主体只需将最后一个环节转移至境外,即可规避印度版权法律约束。
两项相互独立的版权争议
针对实体诉讼请求,法院指出ANI提出了两项相互独立的问题:
(1)OpenAI存储ANI的数据用于训练ChatGPT,是否侵犯ANI的版权;
(2)OpenAI使用ANI受版权保护的数据为用户生成回复是否侵犯ANI的版权。
针对ChatGPT输出内容相关争议,法院比对ANI新闻原文与OpenAI生成回复后认为,即便仅对比标题,ChatGPT生成内容的标题与ANI官网刊载的文章标题亦存在实质性差异。法院进一步适用R.G.阿南德诉豪华电影公司案(R.G.Anandv.DeluxeFilms,(1978)4SCC118)确立的侵权判定标准,认定双方内容不存在实质性相似。法院同时指出,ANI据以举证的新闻报道发布时间晚于对应模型训练截止日期,不存在模型记忆复述原文的可能性。
AI模型训练行为是否构成版权侵权?
更为关键的争议,是OpenAI在训练大型语言模型过程中使用ANI新闻报道的行为定性问题。法院认定,在训练ChatGPT底层大型语言模型时存储ANI原创文字作品的行为,构成《印度版权法》第14条(a)(i)项定义下的复制行为。法院继而审查,OpenAI的该种使用行为能否依据《印度版权法》第52条第(1)(a)(i)项,归入“私人或个人使用(包括研究目的)”范畴而受到合理使用规则保护。
法院指出,印度司法实践尚未形成统一的合理使用判定标准,各方代理律师亦普遍认同美国版权法四要素审查标准不适用于印度。据此,法院结合本案事实确立三项审查要素:(1)OpenAI对ANI作品的使用是否仅限于训练ChatGPT底层大型语言模型;(2)该使用行为是否形成市场竞争、损害ANI合法权益,并造成实际或潜在损失;(3)ChatGPT所实现的功能是否符合社会整体公共利益。法院表示,上述审查要素大体契合《伯尔尼公约》第9条所蕴含的法律原则。法院还驳回了ANI关于“营利性主体不得援引第52条第(1)(a)(i)项例外”的主张,理由在于,印度议会已对第52条项下部分例外明文限定仅适用于非商业使用,但并未对本项例外设置同类限制。
法院适用前述原则审查后认为,在临时救济阶段,并无证据能够证明OpenAI将ANI作品用于训练大型语言模型以外的其他用途。法院进一步指出,起诉状中未提出相关主张,案卷内亦无证据显示OpenAI的行为造成ANI订阅用户流失,或是使其新闻供稿业务遭受损失。法院将公共利益作为合理使用的重要考量因素:大型语言模型能够提升信息获取渠道、助力教育与科研、提供翻译服务、为残障人群开发工具,由此产生的社会收益,是评判使用行为是否合理的重要依据。法院还判定,该项例外所指的研究并不局限于人类开展的研究;如若作出相反认定,将是阻碍社会发展的倒退观点,因此法条中的“研究”范畴可涵盖机器学习。综上,法院初步认定,OpenAI使用ANI作品训练大型语言模型的行为,可以受到第52条第(1)(a)(i)项合理使用规则的保护。
核心要点总结
对人工智能研发企业
根据法院初步观点:为训练大型语言模型存储受版权保护文字作品,构成《印度版权法》第14条(a)(i)项下的复制行为。但如果满足第52条第(1)(a)款的适用条件,该存储行为可归入合理使用例外范畴,不构成第51条规定的版权侵权。值得注意的是,上述结论仅基于临时禁令阶段的初步证据标准作出,不代表实体庭审以及上诉程序的最终结论。
对版权权利人
不能仅以人工智能模型依托版权素材生成输出内容,直接认定构成版权侵权。模型输出内容必须通过实质性相似检验。结合本案事实,ANI未能就ChatGPT生成内容侵权建立表面成立的诉因。
案件后续进展
本案本诉继续审理。法院明确记录:其全部评述仅为裁决临时禁令申请作出,不会影响案件最终实体裁判结果。
OpenAI是否永久存储训练数据、用于记忆并复述ANI作品,属于事实争议问题,只能在正式庭审中依靠证据判定;上诉法院亦有可能对第52条第(1)(a)款作出不同解释。
【来源】
DelhiHighCourtHoldsAITrainingtoBePrimaFacieFairDealingundertheCopyrightAct
https://foxmandal.in/News/delhi-high-court-holds-ai-training-to-be-prima-facie-fair-dealing-under-the-copyright-act/



粤公网安备 44190002007347号