8月28日,索尼音乐出版、华纳查普尔、EMI等音乐出版商在加州北区联邦法院提起诉讼(案号5:26-cv-09217),把图书作者集体诉讼里曝光的一句员工闲聊重新搬上台面:Anthropic联合创始人Benjamin Mann在2021年催同事下载盗版镜像时说"来得正好",一名员工回复"zlibrary my beloved"。这句话被当作Anthropic明知且纵容盗版的证据,读起来确实扎眼。

但真正值得盯的不是这句梗,而是这份48页起诉书的设计思路——音乐出版商没有照搬图书案的"盗版训练"套路,而是新增了一条试图绕开Anthropic核心辩护的因果链理论,外加一项过去很少被讨论的版权管理信息删除诉因。这才是这场官司跟前一场的真正区别。

四条诉因,一条是新武器

起诉书把责任拆成四块:Anthropic、CEO Dario Amodei、Mann因直接下载盗版书籍构成直接侵权;Amodei和Mann个人因指挥、批准盗版行为构成帮助侵权;Anthropic因抓取歌词网站、模型训练与输出构成新的直接侵权;最后一条,依据17 U.S.C. § 1202,指控Anthropic移除了歌词的版权管理信息(CMI)。

前三条是图书案思路的延伸——2021年Mann用BitTorrent从LibGen下载数百万本书,FBI关停LibGen后,数据流入名为PiLiMi的镜像库,Anthropic继续torrent。第四条不一样,CMI诉因不需要证明"训练本身构成侵权",只需要证明Claude输出歌词时删掉了署名信息,门槛更低,也更难被"合理使用"挡住。

  • 风险.CMI这条路径如果被法院认可,可能成为其他内容行业(影视、新闻)绕开"训练合理使用"辩护的通用模板。

700万本盗版书,48万部和解,数万首潜在赔偿

Anthropic今年7月刚就图书盗版问题拿到法院批准的15亿美元和解,但那笔钱只覆盖法院核准的Works List里48万余部作品,而Anthropic涉盗版的书籍总量超过700万本。差距接近15倍。

音乐出版商这次起诉,涉及的是"数万首"歌曲,故意侵权法定赔偿单首最高15万美元,CMI每项违规最高2.5万美元。起诉书没有列固定索赔金额,但按这个量级粗略估算,潜在赔偿敞口和图书案的15亿美元完全不在一个层级。

三个数字,一个量级落差 700万 Anthropic涉盗版 书籍总量 48万部 图书和解 实际覆盖作品 15万美元 单曲故意侵权 法定赔偿上限 数万首歌曲 × 单曲赔偿上限,量级远超图书和解

绕开"从未直接训练"的辩护

Anthropic一直坚持一件事:从LibGen和PiLiMi下载的书籍从未直接用来训练"商业版"Claude模型。这是它在图书案里躲开更大赔偿的关键防线。

音乐出版商没有硬碰这条防线,而是绕了一圈:他们主张Anthropic用盗版数据训练过至少一个非商业模型,再拿这个非商业模型生成的合成数据强化反馈去调教商业Claude模型。换句话说,盗版数据没有直接进商业模型的门,但可能通过"训练出来的模型"这一层中介,间接影响了最终产品。

音乐出版商的因果链理论 非商业模型 训练自LibGen /PiLiMi盗版数据 合成数据 / 强化反馈 关键中介环节 商业Claude 模型 Anthropic否认直接训练 这条链尚未被法院认定,目前只是指控阶段的理论

这条因果链目前只是指控,法院还没认定。但它的巧妙之处在于:即便Anthropic的"从未直接训练"辩护完全属实,也未必能挡住间接影响的追责路径。


Anthropic的官方回应是"这是同一批律师的第三起诉讼,重复了已在法院审理的指控",并强调训练模型属于"转型性合理使用",援引图书案的Bartz判决背书。但这句话回避了一个关键前提——Bartz判决之所以认定合理使用,是因为图书作者没能证明AI输出对图书市场构成了实质替代。

和解买的是过去的账,买不来未来的官司。

音乐出版商恰恰想在"市场替代"这一点上翻盘。他们提到AI生成歌曲已经登上排行榜,和真人词曲作者直接抢位置,这一点书作者从未证明成立。如果法院认为AI生成的歌词或旋律确实"替代"了词曲作者的市场,那么Anthropic在图书案里赢下的合理使用护身符,在音乐版权上未必还灵。

高管个人被列为被告(Amodei、Mann)同样存在不确定性——起诉不等于责任成立,还需要具体证据链证明他们个人的参与和授权,而不只是代表公司行事。接下来最该盯的,是法院会不会受理这条因果链理论,以及CMI诉因是否真能绕开合理使用抗辩单独成立。这两点一旦有结果,会直接决定其他内容行业要不要跟进这套打法。