索尼和华纳起诉 Anthropic 侵犯版权

The Decoder··作者 Matthias Bastian

关键信息

起诉书要求对每一项侵权作品最高赔偿 15 万美元,并对移除版权管理信息的每一项违规最高赔偿 2.5 万美元。文件还指控 Anthropic 未经出版商同意,从 MusixMatch 和 LyricFind 等授权平台抓取歌词,并使用了可能包含未授权内容的 Books3、The Pile 和 Common Crawl 等数据集。

资讯摘要

索尼音乐、华纳音乐和其他出版商已在加州北区联邦法院起诉 Anthropic,指控该公司非法下载并使用数以万计受版权保护的音乐作品来训练 Claude。起诉书称,这些作品主要是歌词,同时还包括乐谱和衍生作品。文件还把首席执行官 Dario Amodei 和联合创始人 Benjamin Mann 列为个人被告,指控他们指挥并监督了这些文件的种子下载行为。原告把这起案件形容为“历史上最大、最明目张胆的持续知识产权盗窃之一”。

这起诉讼不仅关注 Anthropic 如何使用这些材料,也关注它如何获得这些材料。根据起诉书,Anthropic 据称至少从盗版书库 LibGen 和 PiLiMi 中通过种子下载获取了 700 万本书,而这种下载本身就构成独立的版权侵权。诉状还称,Anthropic 在未经出版商同意的情况下,从 MusixMatch 和 LyricFind 等授权平台抓取歌词。原告同时质疑该公司使用 Books3、The Pile 和 Common Crawl 等数据集,认为这些数据集里包含未获授权的内容。

原告要求对每一项被侵权作品最高赔偿 15 万美元,并对每一项移除版权管理信息的违规行为最高赔偿 2.5 万美元。诉状还指控 Anthropic 扫描并销毁了二手歌曲集和乐谱收藏。另一个重要指控是,Anthropic 试图通过合成数据绕开版权问题:文件称,一个曾学习 LibGen 和 PiLiMi 文本的非商业模型生成了合成数据,随后这些数据又被用来训练商业 Claude 模型,或为其提供强化反馈。Anthropic 公开否认直接使用 LibGen 和 PiLiMi 的书籍来训练商业版 Claude,但原告认为该公司对“训练”的定义可能掩盖了上述做法。相关指控的全部范围很可能会在证据开示阶段进一步展开。

文章还提到,Anthropic 之前已经在另一宗版权案件中遭遇重大挫折,并于 2025 年 9 月同意向作者和出版商支付 15 亿美元和解金,原因是其在 AI 训练中使用了盗版书籍。那起案件的核心问题并不是是否能使用版权数据训练,而是这些书籍是通过非法种子下载获得的。新诉讼瞄准的是同一个薄弱点,只不过场景换成了音乐。文章还引用了 2025 年 11 月慕尼黑地区法院的一项相关裁决,法院认为受版权保护的歌词在模型参数中也可能构成复制,而聊天机器人输出这些歌词则属于非法公开披露。

索尼和华纳起诉 Anthropic 侵犯版权

资讯正文

索尼和华纳就“历史上规模最大、最明目张胆的持续知识产权盗窃之一”起诉 Anthropic

要点

- 包括 Sony Music 和 Warner Music 在内的多家大型音乐出版商,已将 Anthropic 及其高管个人告上法庭。

- 这家 AI 公司被指未经许可使用数万首受版权保护的作品——大多是歌词——来训练其 Claude 模型。

- 此案的核心在于 Anthropic 获取训练数据的方式,而不仅仅是它如何使用这些数据。

多家大型音乐出版商指控 Anthropic 违法下载并使用数万首受版权保护的音乐作品来训练 Claude。

Sony Music、Warner Music 以及其他出版商已在北加州联邦法院起诉 Anthropic。根据诉状,首席执行官 Dario Amodei 和联合创始人 Benjamin Mann 作为个人被告列名,理由是他们据称在指挥并监督对受版权保护文件的盗链下载中发挥了作用。

诉状写道:“Amodei 博士明确指示、批准、控制并故意促成了 Mann 先生和其他 Anthropic 员工实施这些侵权行为。” 这份长达 48 页的诉状称,此案是“历史上规模最大、最明目张胆的持续知识产权盗窃之一”。

诉状主要聚焦于音乐作品,尤其是歌词,以及乐谱和衍生作品。原告要求就每一项侵权作品索赔最高 15 万美元,并就每一次非法移除版权管理信息的行为索赔最高 2.5 万美元,相关信息包括版权声明和其他识别信息。

Anthropic 之前已经在这场斗争中输过一次

2025 年 9 月,Anthropic 同意支付美国历史上最大的一笔版权和解金,向作者和出版商支付 15 亿美元,原因是其在 AI 训练过程中使用了盗版书籍。让 Anthropic 在那起案件中败下阵来的,并不是将受版权保护的数据用于训练,而是通过非法的种子下载获取这些数据。

索尼-华纳这起诉讼瞄准的是同一个薄弱环节。据称,Anthropic 至少从盗版图书馆 LibGen 和 PiLiMi 中下载了 700 万本书。无论这些作品最终是否被纳入商业版 Claude 模型,诉讼都将这种下载本身视为独立的版权侵权行为。

该公司还被指未经出版商同意,从 MusixMatch 和 LyricFind 等受许可的平台抓取歌词,违反了这些平台的服务条款。诉状还质疑 Anthropic 对 Books3、The Pile 和 Common Crawl 等数据集的使用,称这些数据集中据称包含未经授权的内容。诉状还指控该公司扫描并销毁了二手歌本和乐谱收藏。

合成数据作为版权漏洞

原告还将矛头对准 Anthropic 在训练过程中如何处理通过种子下载获得的内容。Anthropic 公开否认直接使用 LibGen 和 PiLiMi 的书籍来训练商业版 Claude 模型,但诉状认为,这一否认取决于 Anthropic 如何定义“训练”。

原告指控 Anthropic 使用一个非商业模型生成的合成数据训练了至少一个商业版 Claude 模型,而该非商业模型本身又是从 LibGen 和 PiLiMi 文本中学习而来。他们还声称,Anthropic 曾使用这样的模型向商业版 Claude 模型提供强化反馈。围绕这些指控的全部范围,将在证据开示阶段揭晓。

在另一宗相关案件中,慕尼黑地区法院于 2025 年 11 月裁定,受版权保护的歌词即便仅存在于模型参数中,也属于复制;而聊天机器人输出这些歌词则构成非法公开披露。法院认定,应由模型运营方为其模型生成的内容负责,而不是由提示输出的用户负责,即便这些提示是专门用来生成受版权保护歌词的。

来源与参考

  1. 原始链接
  2. Sony and Warner sue Anthropic over "one of the largest and most blatant ongoing thefts of intellectual property in history"

收录于 2026-08-31