大多数作者在不知情情况下贡献了训练数据,文章从法律角度厘清了版权争议的复杂性。
你大概已经知道,驱动 ChatGPT、Gemini、Claude 和其他聊天机器人的 AI 模型,是在看似无穷无尽的已出版作品数据库上训练出来的——这些数据库包含数亿本书籍、在线文章、学术论文,以及互联网上能找到的各种内容。大多数作者在不知情、未授权的情况下,为威胁自身生计的 AI 工具开发做出了贡献。这看起来显然违法,对吧?
现实并非如此简单。
"我认为整个法律领域和整个技术领域的问题是,其中涉及的事情太多了,"专注于知识产权、版权和技术的律师 Cathy Gellis 告诉 TechCrunch。"这非常复杂,而且对于正在发生的事,无论支持还是反对,都有很多复杂的情绪。"
去年,在首批同类裁决之一中,法官 William Alsup 命令 Anthropic 向一群作家支付 15 亿美元的巨额版权和解金,这些作家的作品被用于训练该公司的 AI 模型。从表面看,这似乎是作者一方的道德胜利,但 Alsup 法官实际上裁定 Anthropic 的 AI 训练是合法的。Alsup 处罚 Anthropic 的原因是从非法在线影子图书馆盗取这些书籍。
"像任何渴望成为作家的读者一样,Anthropic 的 LLM 训练这些作品,不是为了赶超并复制或取代它们——而是为了拐个弯,创造出不同的东西,"法官写道,他将 LLM 吸收数万亿单词的方式比作作家对文学的研究。
Gellis 认为这一裁决对 AI 公司更为有利。对于一家预计到 2028 年年收入约 2000 亿美元的公司来说,15 亿美元的罚款算什么?
"我认为对于 AI 训练来说总体是好消息——他审视了正在发生的事情,并真正将其类比为阅读受版权保护的作品,而非复制受版权保护的作品,"Gellis 说。"版权法关键在于复制,但它不取决于使用作品、体验作品、消费作品、阅读作品。"
版权法自 1976 年以来从未更新,这意味着法官在面对可能塑造 AI 行业未来的法律问题时,必须弄清楚如何诠释 50 年前的指导原则。
"现在每个人都非常担心,因为法律五花八门,这就是问题的根源,"JWL International 知识产权与媒体业务高级律师兼创始人 Jason Henderson 告诉 TechCrunch。"他们知道 AI 模型已经基于大量内容进行了训练,而法律还没有真正跟上这个问题。"
这些问题往往取决于合理使用法——即,使用受版权保护的作品是否足够"转化性"才能被视为法律允许。
合理使用是版权法的例外,允许在未经明确许可的情况下使用受版权保护的材料,保护通过批评、模仿、教育和其他方式评论和迭代受版权作品的能力。法官在判断某事是否属于合理使用时,会考虑具体因素,包括作品的目的和性质、使用的数量,以及对市场的影响。
"版权始终是为了保护和拓展市场,"Henderson 指出。"在 AI 案件中,法院的推理方式五花八门。趋势是,如果你正在基于某人的财产进行训练,而你的目的是直接竞争,法院会对此持否定态度……如果你所做的不会构成竞争,那么法院往往会找到方法认定它没问题。"
Henderson 指的是媒体和科技公司 Thomson Reuters 起诉研究公司 Ross Intelligence 的案件,后者复制其内容以构建一个具有竞争力的 AI 法律平台。
"Ross 的使用不具有转化性,因为它没有比 Thomson Reuters 的作品'更进一步的目的或不同的性质',"法官 Stephanos Bibas 去年写道。
在该案中,Bibas 法官裁定,为了创建一个与 Reuters 直接竞争的新平台而对 Reuters 内容进行训练,不属于合理使用。虽然作者可能论证聊天机器人通过使用他们的作品来生成新的合成书籍是在与他们竞争,但这一论点尚未在法庭上获胜。
在 AI 与版权的关系问题上,Gellis 发现缩小讨论范围有所帮助——我们对 AI 训练中版权问题的思考方式,与我们对 AI 生成内容进行版权保护的方式完全不同。
在其中一个案例 Thaler v. Perlmutter 中,法院裁定如果作品 100% 由 AI 生成,则不受版权保护,这打开了一个全新的麻烦——我们如何明确证明一件作品是否使用了 AI 生成,如果是,又如何知道其中有多少比例是由 AI 创建或辅助的?
"如果你在 Microsoft Word 中写小说并使用拼写检查,我们基本上会觉得 Word 不拥有你的小说这件事很合理,"Gellis 说。"[AI] 正在迫使我们审视我们一段时间以来一直忽略的诸多决策。"
大多数 AI 公司仍深陷这些问题的待决诉讼,这意味着我们不会很快得到这些问题的最终解决方案。
"你所看到的是,初始的开场炮正在产生影响,而这种影响本身可能会被其他法院的不同裁决所推翻,后续诉讼阶段将决定哪一种论点会占上风,"Gellis 说。"但与此同时,所有这些裁决都在塑造正在发生的一切。AI 公司忽视这些裁决会是相当愚蠢的。"