音乐产业资本政策数据评论分析· 169· 约9分钟阅读

35家出版商围猎Anthropic:一首歌词索赔15万美元,账怎么算的

A
AI编辑团队AI 原创内容
2026-09-02 03:32 发布· 本文由作者与AI协作完成
本内容由人工智能生成,仅供研究参考,不构成投资建议。
💡

索尼、华纳查佩尔领衔35家音乐出版商起诉Anthropic大规模盗用版权作品训练Claude,单件作品最高索赔15万美元,总额或达数十亿美元,并直指两位创始人个人责任。这场诉讼恰逢Anthropic筹备IPO的关键窗口期,本质是音乐版权方对AI训练数据定价权的一次总攻。

一首泰勒·斯威夫特的歌词,在美国版权法的法定赔偿框架下,若被认定构成故意侵权,单件作品理论上最高可索赔15万美元;如果还被抹掉了版权管理信息,原告还会叠加主张每处2.5万美元的赔偿。数万份作品乘下来,就是数十亿美元量级的账单。

这张账单,[[Anthropic]]刚刚收到了。

当地时间8月28日,[[索尼音乐出版]](Sony Music Publishing)与[[华纳查佩尔音乐]](Warner Chappell)领衔,联合33家音乐出版商,合计35家企业,向美国加州北区联邦地区法院提起诉讼,指控[[Anthropic]]未经授权,通过BT种子下载、网络爬虫抓取等手段大规模盗用数万份受版权保护的音乐作品——涵盖歌词与乐谱,用于训练其Claude系列大模型,并依靠侵权数据实现产品迭代、商业获利。诉状将此定性为“史上规模最大、性质最公然的知识产权盗窃行为之一”。

更狠的一笔:两位联合创始人[[达里奥·阿莫代伊]](Dario Amodei)和[[本杰明·曼]](Benjamin Mann)被列为个人被告。

这不是一次普通的维权,这是音乐出版产业对AI训练数据定价权的一次总攻。而诉讼爆发的时点,恰在Anthropic筹备巨额IPO的关键窗口期。

一、35家出版商的“团战”:为什么这次的声势不一样

先看阵容。[[索尼音乐出版]]和[[华纳查佩尔音乐]]是全球音乐出版市场的两极,加上另外33家合作出版商,这个原告联盟几乎覆盖了主流流行曲库的核心版权池。泰勒·斯威夫特等知名艺人的多首经典曲目,都在涉案作品之列。

据Axios报道,此案与以往同类诉讼最大的区别在于“广度”。此前的版权官司大多聚焦一个较窄的作品集合——比如[[BMG]]此前起诉Anthropic,主张的是493首作品的侵权。而这次的48页诉状,指控范围是“数以万计”的出版商版权作品。

从493到数万,不是量的差别,是打法差别。小规模诉讼是点状维权,赢的是赔偿;大规模集团诉讼是规则之战,赌的是判例——一旦法院认定“未经授权抓取版权作品训练模型”本身构成系统性侵权,整个AI行业的数据获取成本将被彻底重写。

注:15万美元/件的法定赔偿上限,仅适用于法院认定被告构成“故意侵权”(willful infringement)的情形,并非所有侵权行为的默认赔偿标准。详见下节分析。

诉状的核心指控链条很清晰:非法BT下载→爬虫抓取→大规模复制歌词与乐谱→用于训练Claude→产品迭代→商业获利。注意,出版商方面还直接将两位创始人列为个人被告——这在版权诉讼里是一个强烈的信号,意味着原告不仅想要钱,还想穿透公司有限责任,直抵决策层。

从35家联名的规模本身看,这就是一个姿态:出版商不愿再被各个击破,要向法院和行业传递统一立场。

[[Anthropic]]的回应则相当克制:不认同出版商的全部指控,将在法庭积极抗辩。

二、数十亿美元怎么算出来的:一堂版权赔偿数学课

这场诉讼最容易被误读的地方,是“索赔数十亿美元”这个数字。它不是一个拍脑袋的开价,而是原告依据美国版权法法定赔偿条款推导出来的理论上限——但请注意,这个上限的适用有严格前提。

先拆结构。诉状主张的赔偿框架有两层:

赔偿项目计算基准金额区间法律依据要点
法定赔偿(普通侵权)每一件侵权作品750美元—3万美元适用于非故意、非无意侵权的一般情形
法定赔偿(故意侵权)每一件侵权作品最高15万美元须由法院认定被告构成“故意侵权”方可适用上限
版权管理信息(CMI)相关赔偿每一处被剥离/篡改的版权信息诉状主张2.5万美元/处量级针对“可识别的版权数据被剥离”的行为
理论合计数十亿美元量级(原告主张)

必须强调三个限定条件,否则“数十亿美元”会被严重误读:

第一,法定赔偿以作品注册为前提。根据美国《版权法》第412条,权利人要主张法定赔偿,作品必须在侵权发生前已完成版权注册,或在首次出版后三个月内完成注册。未及时注册的作品,权利人只能主张实际损失或被告侵权获利,二者往往远低于法定赔偿上限。哪些涉案作品满足注册时间要求,是后续争议的关键战场。

第二,15万美元上限只针对“故意侵权”。法定的常规赔偿区间是每件750美元至3万美元,15万美元的封顶值必须由法院认定被告明知且故意为之才能适用。“史上规模最大、性质最公然”之类的定性,正是原告为触发“故意”认定所做的铺垫——但最终是否成立,要由法院裁决。

第三,理论合计≠实际判赔。即便部分作品满足注册条件、部分行为被认定故意,法院也可以在区间内酌定金额,且集团诉讼的损害认定本身就是漫长的过程。出版商手里的曲库是工业化的——一家头部音乐出版商旗下动辄管理数十万首作品,35家联合起来,“数以万计”的涉案作品基数确实庞大,但“数十亿美元”应理解为谈判筹码型的天花板开价,而非确定的赔付预期。

第二层的CMI指控更值得注意。它针对的是“可识别的版权数据被剥离”——即歌词或乐谱在进入训练集前,版权署名、权利人信息被抹掉的行为。这一条指控的直接后果是:即便作品本身的使用被认定合理,抹除版权信息的动作也可能被单独追责。这实际上是把AI公司数据清洗流水线里的每一个环节,都变成了潜在的追责触发点。

此外,原告不只是要钱,还要求法院下达禁令,阻止Anthropic继续使用相关版权素材。对一家靠模型能力吃饭的AI公司而言,禁令的杀伤力理论上比赔偿金更大——它可能意味着已经进入训练管线的数据需要被处理,甚至影响产品迭代节奏。

当然,理论上限和实际判赔之间隔着漫长的诉讼。但出版商们显然深谙谈判逻辑:开价开到天花板,和解才有筹码。

三、惯犯档案:Anthropic的版权官司清单有多长

把这次的起诉放进时间线里看,才能理解它为什么来得这么猛。

  • 作家与出版商诉讼:Anthropic此前已接连面对作家群体、出版商的多起版权官司;
  • 作家和解:Anthropic曾与作家群体达成15亿美元的和解协议——这是目前AI版权纠纷里最重磅的和解金额,也是后续所有版权方谈判时的心理锚点;
  • 音乐机构诉讼:环球、康科德等音乐机构此前已先后起诉Anthropic;
  • BMG诉讼:主张493首作品侵权,属于点状维权;
  • 本次集团诉讼:35家出版商联合,涉案作品数以万计,直指创始人个人。

这条时间线传递了两个信息。

第一,音乐产业是分批进场的。环球、康科德、BMG先试水,出版商联盟压轴——这种节奏很像当年音乐产业对付流媒体早期盗版的打法:先用单点诉讼试探法院态度,再用集团诉讼锁定规则。

第二,15亿美元的作家和解案改变了所有人的预期。对版权方来说,它证明AI公司的版权负债是真实可变现的;对AI公司来说,它证明每拖一年,未来的和解账单只会更大。出版商这次把索赔推到数十亿美元量级,某种程度上就是在对齐“作家和解”之后再往上抬价。

而从数据形态本身分析,音乐出版商在这轮维权中有天然优势:他们手里的歌词、乐谱,恰恰是大模型训练里最容易被整段复制、也最容易举证的数据形态。一段歌词是否完整出现在训练集中,比对一段音频是否存在采样要容易证明得多。出版商选择此刻重兵进场,数据可举证性是一个不容忽视的战术考量。

四、IPO窗口期的达摩克利斯之剑

素材里最值得划重点的一句话:本次诉讼发生在Anthropic筹备巨额IPO的关键窗口期。

这句话的分量,比数十亿美元的索赔本身更重。

一家公司上市,招股书里最怕的不是已知负债,而是未定量级的或有负债。一笔理论上限数十亿美元、且涉及禁令请求的版权诉讼,会让承销商和机构投资者反复追问三个问题:最坏情况下要赔多少?禁令会不会影响模型能力与产品路线?和解要花多少钱、分几年摊?

这三个问题对应三条风险传导路径:

  • 或有负债的不确定性:法定赔偿是否适用、适用多少,在判决前无法量化,但招股书中必须披露并计提,直接影响估值模型;
  • 禁令风险:若法院支持禁令请求,已用涉案数据训练的模型如何处置、后续训练数据从哪来,都将成为产品路线层面的悬案;
  • 和解支出与现金流:参照作家案15亿美元的量级,音乐版权和解的金额和支付结构,将直接冲击现金储备与上市前财务表现。

资本市场厌恶的恰恰是这种无法收口的不确定性。

从Anthropic的应对看,“不认同全部指控、法庭积极抗辩”是标准姿势——既要表现出维权到底的姿态稳住投资人,又不能把话说死堵死和解通道。参照作家案15亿美元和解的前例,音乐版权这场仗大概率也以和解收场,问题只是金额和结构:是按作品数量打包买断,还是像流媒体时代那样建立一套持续性授权分成机制。

后者才是出版商真正想要的。数十亿美元是一次性收入,而“AI训练数据授权费”是一门可以长期收租的生意。音乐出版商在流媒体时代已经吃过一轮版权定价权的红利——从被平台压制到每千次播放计费体系成型,出版商花了近十年。AI这一轮,他们不想再等十年。

五、更深一层:这不是Anthropic一家的事

把这起诉讼仅仅理解为“音乐公司又告AI了”,会错过真正的看点。

看点一:个人被告。把[[达里奥·阿莫代伊]]和[[本杰明·曼]]列为个人被告,是在试探“AI公司的版权责任能否穿透到创始人”。一旦这个口子被撕开,所有AI创始人的个人风险敞口都会被重新评估——这对整个赛道的融资与上市叙事都是扰动。

看点二:广度即策略。从BMG的493首到35家出版商的数万首,版权方的策略已经从“证明你侵权”升级为“证明你的商业模式建立在侵权之上”。后者一旦成立,赔偿只是附产品,真正的战利品是未来所有训练数据的强制授权定价权。

看点三:内容方的集体觉醒。作家先和解拿到15亿美元,出版商紧接着抬价进场——内容产业的各个板块正在形成一个事实上的攻守同盟节奏:你谈出一个价,我就按你的价上浮。这对所有仍在用“抓取—清洗—训练”流水线的AI公司是系统性压力。

顺带一提,传统内容巨头面对新技术分发时并非只有诉讼一条路——[[Netflix]]选择在10月23日让李沧东新作《Possible Love》先在威尼斯首映、再走院线,用发行节奏本身做生意。可见同样是内容方,有的把新渠道当谈判桌,有的当生意场,路径取舍全看手里筹码。

小结:一张账单,两套算盘

35家出版商的诉状,表面上是一张数十亿美元的赔偿账单,底层是两套算盘的对撞:AI公司想把版权成本摊薄成历史遗留问题,版权方想把训练数据变成一门可定价、可持续的授权生意。

作家案的15亿美元和解,已经给音乐版权这一轮谈判锚定了地板价;IPO窗口期的时间压力,则给了原告方难得的筹码优势。但也要清醒看到,“15万美元一首”的天花板建立在“故意侵权”认定和作品注册时效这两个法律前提之上——法院最终如何划定法定赔偿的适用边界,将直接决定这场博弈中筹码的真实成色。

大概率,这场官司最终仍以高额和解+建立授权机制收场——但判例走向将决定这是多少钱的问题,还是整个AI行业数据获取范式的问题。

对内容产业而言,这是一个值得记住的时点:歌词第一次在AI时代被明码标价——每首最高15万美元。而这一标价的成色几何、能否兑现,就要看接下来几年,加州北区法院的法官们如何落笔了。