# 索尼与华纳起诉Anthropic，指控其大规模盗用版权音乐训练Claude

- 来源：The Decoder：AI News（RSS）
- 作者：Matthias Bastian
- 发布时间：2026-08-30 16:50
- AIHOT 分数：76
- AIHOT 标记：精选
- AIHOT 链接：https://aihot.virxact.com/items/cmtfkvjwn0by7rou8vil9ysf1
- 原文链接：https://the-decoder.com/sony-and-warner-sue-anthropic-over-one-of-the-largest-and-most-blatant-ongoing-thefts-of-intellectual-property-in-history

## 精选理由

诉讼把焦点放在盗版下载这一独立侵权点上，并涉及合成数据是否构成训练漏洞，读者可借此理解版权争议的新走向。

## AI 摘要

索尼音乐、华纳音乐等唱片公司起诉Anthropic及其CEO Dario Amodei和联合创始人Benjamin Mann，指控其未经许可使用数万首受版权保护的音乐作品（主要是歌词）训练Claude模型。原告称Amodei明确指示并促成侵权行为，每件侵权作品索赔最高15万美元。此前Anthropic已于2025年9月就盗版书籍训练达成15亿美元和解。

## 正文

核心要点

包括索尼音乐和华纳音乐在内的多家大型音乐出版商已对Anthropic及其高管个人提起诉讼。

这家AI公司被指控未经许可使用数万首受版权保护的音乐作品（主要是歌词）来训练其Claude模型。

本案的核心在于Anthropic如何获取训练数据，而不仅仅是它如何使用这些数据。

大型音乐出版商指控Anthropic非法下载并使用数万首受版权保护的音乐作品来训练Claude。

索尼音乐、华纳音乐等出版商已在加州北区联邦法院对Anthropic提起诉讼。根据起诉书，CEO达里奥·阿莫代伊和联合创始人本杰明·曼被列为个人被告，理由是他们涉嫌指挥和监督受版权保护文件的种子下载行为。

这份48页的起诉书写道：“阿莫代伊博士明确指示、批准、控制并故意诱导曼先生及其他Anthropic员工实施这些侵权行为。”原告称这是“历史上规模最大、最明目张胆的知识产权持续盗窃行为之一”。

起诉书聚焦于音乐作品（主要是歌词），以及乐谱和衍生作品。原告要求对每件被侵权作品最高赔偿15万美元，并对非法删除版权管理信息（包括版权声明和其他识别信息）的每次违规行为最高赔偿2.5万美元。

Anthropic此前已在这场斗争中败诉过一次

2025年9月，Anthropic同意支付15亿美元，与美国历史上最大规模的版权和解——向作者和出版商赔偿其在AI训练中使用盗版书籍的费用。在那起案件中，让Anthropic败诉的并非使用受版权保护的数据进行训练，而是通过非法种子下载获取这些数据。

索尼-华纳诉讼瞄准的正是同一个软肋。Anthropic被指控从盗版图书馆LibGen和PiLiMi种子下载了至少700万本书籍。该诉讼将这种下载行为本身视为独立的版权侵权行为，无论这些作品是否最终进入了商业化的Claude模型。

该公司还被指控未经出版商同意，从 MusixMatch 和 LyricFind 等授权平台抓取歌词，违反了这些平台的服务条款。该诉讼对 Anthropic 使用 Books3、The Pile 和 Common Crawl 等数据集的行为提出质疑，这些数据集据称包含未经授权的内容。诉讼还指控该公司扫描并销毁了二手歌本和乐谱收藏。

合成数据作为版权漏洞

原告还针对 Anthropic 在训练过程中如何处理盗版内容提出指控。Anthropic 已公开否认直接使用 LibGen 和 PiLiMi 的书籍来训练商业版 Claude 模型，但诉状认为，这一否认取决于 Anthropic 如何定义“训练”。

原告指控 Anthropic 至少训练了一个商业版 Claude 模型，其训练数据是由一个非商业模型生成的合成数据，而该非商业模型本身是从 LibGen 和 PiLiMi 的文本中学习而来的。他们还声称 Anthropic 使用这样一个模型为商业版 Claude 模型提供强化反馈。这些指控的完整范围将在证据开示阶段揭晓。

在另一起相关案件中，慕尼黑地区法院于 2025 年 11 月裁定，受版权保护的歌词即使存储在模型参数中，也构成复制行为，而聊天机器人输出这些歌词则构成非法公开传播。法院认定模型运营方应对其模型生成的内容负责，而非输入提示词的用户，即使这些提示词是专门为生成受版权保护的歌词而设计的。

Courtlistener
