德里高等法院驳回印度主要新闻机构对OpenAI的版权禁令申请
德里高等法院驳回了印度新闻机构ANI对OpenAI的版权禁令申请,裁定AI训练属于私人使用范畴。这是法院首次将AI训练归类为私人使用,对ANI的诉讼构成重大打击。主要审判仍在进行中。
德里高等法院驳回了印度新闻机构ANI对OpenAI的版权禁令申请,裁定AI训练属于私人使用范畴。这是法院首次将AI训练归类为私人使用,对ANI的诉讼构成重大打击。主要审判仍在进行中。
SynthePulse Insight · AI 深度解读
版本 1 · 1 个来源
印度德里高等法院驳回亚洲新闻国际(ANI)对OpenAI的初步禁令请求,认定AI训练可能属于“私人使用”例外,且ANI未能证明ChatGPT逐字复制其文章。但法院保留了对RAG输出、永久存储等核心问题的最终裁决权。
ANI向法院提交了多份ChatGPT输出,声称其大量复制了ANI的文章。然而,OpenAI证明所使用的模型GPT-4和GPT-4o的训练数据分别截止于2022年4月和2024年4月,而ANI引用的文章大多发表于2024年8月和9月,因此不可能包含在训练数据中。
法官初步认为输出相似性源于RAG(检索增强生成),即模型实时从互联网检索信息,类似于搜索引擎。ANI在诉状中未涉及RAG问题,因此法院无法就此作出最终裁决,但表示RAG输出可能构成“向公众传播”,这一问题将在主审中处理。
ANI使用了对抗性提示,明确要求模型“精确”复制文章,即便如此仍未产生任何逐字副本。法官指出,新闻中的事实通常不受版权保护,且复制主题和标题在本案中不构成与ANI的直接竞争。
双方均承认OpenAI在训练中使用了ANI内容,但OpenAI辩称该材料在整体数据集中占比极小,且模型仅提取了非表达性元素(如语法、句法和语言模式)。
法官依据印度版权法中的“私人或个人使用,包括研究”条款,将“研究”宽泛解释为涵盖AI训练。这是法院首次明确将AI训练纳入私人使用例外。但该例外有条件:训练副本必须来自合法来源(非影子图书馆或付费墙网站),且OpenAI从未公开训练副本,仅内部处理。
法院进行了三要素公平性测试,全部支持OpenAI:OpenAI对ANI作品的使用仅限于训练(未证明记忆或复制);ANI未能证明经济损失(双方处于不同行业);即使ChatGPT被问及ANI标题,模型仅返回主题和至多几个文章标题。
法官引用了美国案例(如Bartz诉Anthropic、Kadrey诉Meta)以及Google Books案,认为语言模型输出具有转换性。
德里裁决加入了一系列结论冲突的国际判例。在美国,Raw Story和AlterNet诉OpenAI案因原告未能证明损害而被驳回;GitHub Copilot案因原告未能提供相同代码示例而败诉;The Intercept则通过DMCA投诉获得部分胜利。
相反,Ross Intelligence诉Thomson Reuters案中,法院拒绝适用合理使用,因为AI研究工具直接与Westlaw竞争。Anthropic案中,法院称AI训练“惊人地”具有转换性,但因使用盗版书籍作为训练数据而类比Napster,最终Anthropic向作者支付了15亿美元。
美国版权局驳回了AI行业关于训练“大量受版权作品”广泛构成合理使用的论点。欧洲方面,慕尼黑地区法院在GEMA案中认定歌词在模型权重中可复制,构成版权相关复制;而伦敦高等法院驳回了Getty Images诉Stability AI案,裁定AI模型不是“侵权副本”。
所有案件中,核心问题仍未解决:AI模型是否永久存储训练数据?训练能否构成合理使用?合法与非法获取数据的界限何在?通过对抗性提示生成的副本是否反映正常使用?
即使法院裁定AI训练合法,AI搜索产品仍可能削弱新闻市场。皮尤研究中心最新研究显示,使用Google AI概览时,外部网站点击率降至仅8%,而无AI摘要时为15%。用户往往在获得AI回答后停止搜索,不再查看其他来源。
对于ANI等新闻机构而言,AI系统摘要新闻并使得点击原始来源变得不必要的趋势,可能侵蚀其商业模式。
本文基于THE DECODER对德里高等法院裁决的报道,该报道引用了法院裁决内容及AI版权法专家Andres Guadamuz的评论。全球判例部分为报道中列举的已知案例,皮尤研究中心数据为报道中引用的第三方研究。所有事实均来自单一来源,未交叉验证。
德里高等法院的裁决为OpenAI在印度赢得重要喘息空间,但并未解决AI版权法的根本分歧。ANI的禁令被驳回主要因其证据缺陷(文章日期晚于训练数据)和未能证明经济损失。然而,RAG输出定性、训练数据永久存储等关键问题留待主审。全球范围内,法院在AI训练是否构成合理使用上仍无共识,而AI搜索对新闻业点击率的实际冲击可能成为比版权更紧迫的威胁。
主报道
主报道来源