首页/新闻/Is it legal to train AI models on copyrighted books? It’s complicated
技术突破

在受版权保护的书籍上训练人工智能模型合法吗?这很复杂

techcrunch
2026年8月23日 08:00
2026年8月23日 08:00
访问原文

你现在可能已经知道,ChatGPT、Gemini、Claude和其他聊天机器人的AI模型是在看似无限的已出版作品数据库上训练的,这些数据库包含数亿本书籍、在线文章、学术论文,以及你在互联网上能找到的基本上任何东西。大多数已出版的作者在不知情或未经同意的情况下,为威胁破坏他们生计的人工智能工具的开发做出了贡献。这似乎是非法的,不是吗?事实并非如此简单。“我认为整个法律领域和整个技术领域的问题之一是存在很多问题,”具有知识产权、版权和技术专业知识的律师凯茜·盖利斯(Cathy Gellis)告诉TechCrunch。“这非常复杂,对正在发生的事情有很多原始的感觉,无论是赞成还是反对。”去年,威廉·阿尔索普法官在此类最早的裁决中命令Anthropic向一群作家支付巨额15亿美元的版权和解金,这些作家的作品被用来训练该公司的人工智能模型。从表面上看,这似乎是有利于作者的道德胜利,但Alsup法官实际上裁定Anthropic的人工智能训练是合法的。Alsup惩罚Anthropic的原因是从非法的在线影子图书馆盗版这些书。法官写道:“就像任何渴望成为作家的读者一样,Anthropic的法学硕士接受的作品训练不是为了追赶并复制或取代它们,而是为了扭转困境并创造不同的东西。”他将法学硕士吸收数万亿字的方式与作家对文学的研究进行了比较。盖利斯认为这一裁决对人工智能公司更有利。对于一家预计到2028年年收入约为2000亿美元的公司来说,15亿美元的罚款算什么?盖利斯说:“我认为,对于人工智能培训来说,他观察了正在发生的事情,并确实认为这类似于阅读受版权保护的作品,而不是复制受版权保护的作品。”“版权法取决于复制,但我

注:以上内容摘选自原始新闻,点击「访问原文」查看完整内容。

标签

AI
copyright law
Exclusive

新闻来源

techcrunch · 2026年8月23日 08:00

查看原文

相关新闻