一、案例背景
(一)事件缘起:一场迟来的正面交锋
2026年7月,随着Anthropic以15亿美元天价和解作家集体诉讼的消息震动业界,AI版权之争的激烈程度被推向新的历史高点。这是美国版权诉讼赔偿金额的最高纪录,其背后折射出的是人工智能产业与传统内容产业之间日益尖锐的利益冲突。
这场冲突的源头可追溯至2023年底。彼时,《纽约时报》正式对OpenAI及微软提起诉讼,指控两家公司未经授权使用其数百万篇新闻报道训练大语言模型,侵犯了其版权。这起诉讼被视为AI版权之争的里程碑事件——它代表主流新闻机构首次以系统性方式挑战AI开发者的数据获取行为。
《纽约时报》在诉状中指出,OpenAI的ChatGPT和微软的Copilot在训练过程中大规模复制其文章内容,不仅侵害了版权,更构成了对新闻业商业模式的根本性威胁。而OpenAI与微软的回应则颇具代表性:他们认为使用公开网络数据进行模型训练属于”合理使用”范畴,因为训练过程是对数据的”非表达性”使用——算法并不”阅读”文章以获取信息,而是将其转化为统计模式。
(二)行业全景:AI版权纠纷的扩散与升级
《纽约时报》诉OpenAI案并非孤例。自2023年起,AI版权诉讼呈现爆发式增长态势:
在文学创作领域,2023年7月,喜剧演员Sarah Silverman联合多位作家起诉OpenAI和Meta,指控其未经授权使用受版权保护的书籍训练模型。2024年初,《权力的游戏》作者乔治·R·R·马丁等17位知名作家加入类似诉讼行列。
在视觉艺术领域,Getty Images起诉Stability AI,指控其从网站上抓取数百万张受版权保护的图片训练Stable Diffusion模型。
在音乐产业,环球音乐集团等主要唱片公司对Anthropic提起侵权诉讼,指控其AI模型Claude在训练和输出过程中使用了大量受版权保护的歌词。
在新闻出版领域,除《纽约时报》外,美联社、路透社等多家新闻机构也与AI公司展开谈判或诉讼。2025年,Axel Springer与OpenAI达成合作协议,允许OpenAI使用其新闻内容,同时获得经济补偿——这一”授权模式”被视为行业可能的发展方向之一。
……