Claude最近开始一本正经地拒绝背歌词。哪怕你说这首歌是自己写的、一句一句粘贴进对话框,它也不接。这个变化写进了Fable 5.1的系统提示词,公开日期是9月1日——而三天前,索尼音乐出版和华纳查普尔刚把Anthropic告上法庭,公司CEO Dario Amodei和联合创始人Benjamin Mann都被列为被告个人。
新规矩不是随口一说的原则,是写得很细的操作条款。
拒绝清单写得比想象中细
歌词、诗歌、书籍段落,哪怕只是最后一句、一段副歌、逐音符抄写的旋律,都不复现。一旦在对话里拒绝过一次,之后就算你换个说法、缩小范围重新问,也持续拒绝。1929年前发表的作品算公共领域,可以引用——莎士比亚的诗、济慈的颂歌没问题——但Claude只认自己判断出的发表年代,拿不准就一律拒绝。
视觉这边管得更宽。SVG、Canvas、CSS、ASCII art,只要是Claude能画出来的方式,都不能画已知的版权角色、logo、专辑封面。系统提示词里给了个例子:用户要给儿子画一只蓝色刺猬在生日横幅上飞奔,Claude认出这是索尼克,直接拒绝,转手画了一只滑板蜥蜴代替。
这套逻辑看着眼熟——不是不让你提关键词,是不让最终画面拼出那个可识别的结果。
时间线对不上"巧合"这两个字
索尼音乐出版和华纳查普尔的起诉,正式提交日期是8月28日,案号5:26-cv-09217,在加州北区联邦法院。起诉书指控Anthropic通过Library Genesis和Pirate Library Mirror这类盗版书库下载书籍,从MusixMatch、LyricFind等歌词网站抓数据,训练材料涵盖Common Crawl、The Pile、Books3。列出的涉案歌曲里有《Ain't No Mountain High Enough》《Eye of the Tiger》《Hallelujah》《Uptown Funk》,还指控Claude曾生成过接近逐字的《Redbone》《Stay》《California Gurls》歌词。
四项法律主张摆得很清楚:协助盗版下载侵权、直接版权侵权、以及移除版权管理信息(违反17 U.S.C. §1202)。赔偿口径按法定赔偿算,每件故意侵权作品最高15万美元,每次移除版权信息最高2.5万美元——起诉书说涉及"数万件"作品,粗算下来敞口能到几十亿美元级别。除了钱,还要求强制披露训练数据、法院监督下销毁侵权副本、陪审团审理。
Simon Willison说他"怀疑不是巧合",我觉得这已经不用怀疑——正常产品迭代节奏解释不了这么快的响应速度。
护栏只管前台,不管后台
最容易被忽略的一点是:这套新规则只适用于claude.ai网页版和手机App,不适用于开发者调用的Claude API。
普通用户在网页上问歌词会被拒,开发者调同一个模型的API做同样的事,目前没受同等约束。这不是技术上做不到,是产品和法律团队先堵住了最容易被截图、最容易被媒体报道的那个入口。
- 风险.1929年公共领域判定完全依赖模型自己对发表年代的判断,误拒绝和误放行都可能发生,这个机制本身不算稳。
提示词工程是训练完成之后、用户提问之前加的一层软护栏,成本低,改起来快,正好用来堵一时的公关和法律敞口。但它解决不了起诉书真正咬住的那个点:训练数据到底是怎么来的。如果模型真的吃过盗版书库和抓取来的歌词网站,让Claude在对话里嘴上不说,并不能让训练那一步变得干净。
当年唱片业告Napster,法院最后争的也不是某个客户端要不要加下载限制,是复制和分发这件事本身该由谁负责。Claude今天肯不肯在对话框里念一句歌词,跟这场官司最终怎么判,是两件重量完全不对等的事——前者是产品体验,后者才是训练数据合法性的分水岭。这场官司眼下还在起诉书阶段,被告的抗辩、证据披露、法院对"训练算不算复制"的态度,才是真正决定Anthropic敞口大小的地方。
推理层管住嘴,训练层的账没翻。
至于这道护栏会不会扩展到API、Anthropic会不会像唱片行业已经走过的路一样去和版权方谈授权,都还没有答案。眼下能确定的只有一件事:Claude变得更谨慎了,但这份谨慎目前只发生在用户看得见的地方。
