印度法院裁定OpenAI使用新闻内容训练AI不侵权,判例或成全球标杆

# 印度法院裁定OpenAI使用新闻内容训练AI不侵权,判例或成全球标杆

近日,印度德里高等法院在一起备受关注的版权侵权案中作出裁决,认定OpenAI在训练其大语言模型(如ChatGPT)时使用新闻机构的公开内容,不构成对印度《版权法》的违反。该判决不仅为印度本土的AI训练数据合规提供了关键指引,更因其对“合理使用”原则的扩张性解释,有望成为全球AI治理与版权法律交叉领域的标杆性判例。

## 法院核心推理:技术中性下的“合理使用”边界

法院在判决中主要援引了印度版权法第52条中关于“合理使用”的例外条款,强调AI训练过程本质上属于对事实性信息的“非表达性使用”。法官指出,OpenAI模型并未直接复制或再现新闻作品的独创性表达,而是通过统计学习提取其中的语言模式、事实关联与逻辑结构。这种“非消费性”的文本与数据挖掘(TDM)行为,与人类阅读新闻后通过记忆与思考形成知识的过程并无本质区别,因此不应被纳入版权侵权的范畴。

此外,法院还着重考量了公共利益平衡。判决书明确写道:“若要求AI开发者为每一条训练数据取得授权,将严重阻碍技术创新与知识传播,尤其不利于印度在AI领域的追赶。”这一逻辑与美国《版权法》第107条下的“转换性使用”理论高度相似,但更侧重于技术发展的社会效益。

## 全球影响:为AI训练数据争议提供“印度解法”

当前,全球范围内针对AI训练数据是否侵犯版权的诉讼正密集爆发,从《纽约时报》诉OpenAI案到欧盟《人工智能法案》的版权披露条款,各国处于法律真空与激烈博弈中。印度法院的裁决为业界提供了另一种范式:**只要训练数据不用于直接生成侵权性复制品,且AI模型不存储原始作品,即不构成侵权**。这比欧盟《数字单一市场版权指令》中强制要求文本与数据挖掘例外(TDM例外)的条款更为宽松,但比美国法院尚未明确的“合理使用”判例更具可操作性。

对于新兴市场国家而言,此判例尤其具有示范意义——它可能激励更多发展中国家在AI创新与版权保护之间优先选择前者,从而降低本地AI公司的合规成本,加速本土大模型研发。但批评者指出,该判决可能削弱传统新闻媒体赖以生存的“内容付费”模式,长期来看或加剧优质新闻内容的供给危机。

## 潜在争议与未来展望

尽管判决赢得科技界广泛欢迎,法律界与媒体行业仍存在三点质疑:其一,法院未区分“事实性新闻”与“深度报道、评论等具有独创性表达的作品”,可能导致后续对虚构类、评论类内容的侵权争议;其二,判决未要求OpenAI提供详细的数据来源清单,这为未来验证“是否存在实质性复制”留下取证困难;其三,印度尚未出台专门针对AI训练数据的立法,过度依赖司法判例可能导致法律适用的不确定性。

可以预见,本案的上诉过程将备受关注,而印度最高法院或立法机构的最终态度,将决定该判例能否真正成为全球“规则输出者”。无论如何,这一裁决已为AI与版权法的全球对话注入了新的变量——**在技术飞速迭代的时代,法律的弹性或许比刚性更为重要**。

相关文章