近日,印度德里高等法院就新闻机构亚洲新闻国际通讯社(ANI)诉OpenAI版权侵权案作出关键裁决,认定OpenAI使用ANI的新闻内容进行人工智能模型训练不构成版权侵权。这一判决在全球人工智能与版权法交叉领域引发广泛关注,或将为其他司法管辖区处理类似案件提供重要参考。
案件背景:新闻机构诉AI公司数据使用
ANI是印度主要新闻通讯社之一,其新闻内容被广泛转载。2023年,ANI发现OpenAI在训练其大型语言模型(包括GPT系列)时,爬取并使用了包括ANI新闻在内的网络数据。ANI认为,这种行为未经授权复制其受版权保护的新闻文章,侵犯了其专有权利,遂向德里高等法院提起诉讼。ANI同时要求法院下令阻止OpenAI继续使用其内容,并删除已训练的数据。
OpenAI方面则辩称,其使用ANI新闻内容属于“合理使用”(fair use)范畴,因为模型训练是一种非表达性、转换性的使用方式,并不直接复制或再现原始作品,而是从中学习语言模式和知识。OpenAI强调,其训练过程不涉及向用户直接提供ANI的文章内容,用户通过ChatGPT获取的信息是基于模型对海量数据的综合理解,并非简单的复制粘贴。
法院裁决:转换性使用不构成侵权
经过审理,德里高等法院法官阿米特·巴恩萨(Amit Bansal)于近日作出裁决,驳回了ANI的侵权主张。法院认为,OpenAI在训练人工智能模型时使用ANI的新闻内容,属于“转换性使用”(transformative use)。所谓转换性使用,是指对原作品的使用并非为了再现或替代其原有价值,而是赋予其新的目的、意义或表达方式。
法院在判决书中指出:“OpenAI使用ANI新闻内容的目的在于训练人工智能系统,使其能够理解和生成语言,而非向用户提供ANI的新闻文章本身。这种使用方式具有高度转换性,不构成对ANI新闻内容的直接竞争或市场替代。”法院还强调,ANI的新闻文章在被用于训练后,其原有的新闻价值并未因AI模型的存在而减损,读者仍然可以通过传统渠道阅读ANI的新闻。
此外,法院也考虑到公共利益因素。法院认为,人工智能技术的发展对于印度乃至全球的科技进步具有重要推动作用,过度限制AI训练数据的来源将阻碍创新。法院同时指出,ANI作为新闻内容生产者,其版权应当受到尊重,但在此案中,OpenAI的行为并不构成传统意义上的侵权。
争议焦点:数据训练与版权保护的平衡
这一裁决引发了法律界和科技界的热议。支持者认为,法院准确抓住了人工智能时代版权法的关键问题——即训练数据的使用是否应当被视为一种新的、独立的利用方式。长期以来,版权法主要规制对作品的复制、发行、表演、改编等行为,但AI训练过程中的“复制”是否属于侵权,各国法律尚未明确。
反对者则担忧,这一裁决可能削弱内容生产者的议价能力。新闻机构投入大量资源采编新闻,而AI公司无偿使用这些内容训练模型,并借助模型实现商业盈利,这似乎构成了一种不公平的价值提取。有观点认为,法院虽然认定“转换性使用”,但忽略了ANI新闻内容作为训练数据对提升AI模型质量的实质性贡献。
值得注意的是,美国此前已有类似案件处于不同阶段。2023年12月,《纽约时报》起诉OpenAI和Microsoft未经许可使用其数百万篇文章训练AI模型,要求赔偿数十亿美元。该案目前仍在审理中,尚未有最终裁决。印度法院的此次判决,可能在学术和实务层面为美国法院提供比较法参考,但美国合理使用原则的适用标准更为复杂,最终结果仍有不确定性。
行业影响与未来展望
德里高等法院的裁决对印度人工智能行业是一个积极信号,意味着在现有法律框架下,AI公司使用公开网络数据训练模型具有一定合法性空间。但这也促使内容生产者与AI公司之间就数据授权模式展开更深入的商业谈判。
事实上,一些新闻机构已开始与AI公司建立合作。例如,美联社与OpenAI达成了授权协议,允许后者使用其新闻档案进行训练;Axel Springer(德国出版集团)也与OpenAI签订了内容授权合同。这种“付费训练”模式或许将成为行业主流,既保障内容创作者的权益,又为AI发展提供合法数据来源。
展望未来,随着通用人工智能技术加速演进,版权法的适应性调整已势在必行。印度法院的此次判决虽然解决了具体个案,但并不能为所有类似问题提供统一答案。各国立法机构可能需要考虑建立专门的“文本与数据挖掘”(text and data mining)例外规则,或进一步完善合理使用制度,以在保护版权与促进创新之间寻找到动态平衡。
对于ANI而言,其仍可以选择上诉至印度最高法院,或者考虑与OpenAI协商达成内容使用协议。无论后续走向如何,这一案件已经为全球人工智能版权治理提供了重要注脚:技术发展的车轮不会因法律模糊而停止,但法律的边界必须在实践中不断被重新厘定。