Anthropic在自己的支持页面上写了两句互相拆台的话。一句说水印是文本本身的一部分,复制粘贴到别处依然会跟着走;另一句又说,从Claude对话框里直接复制粘贴的纯文本,并不会保留隐藏的水印标记。同一份文档,两种说法,读者到底该信哪句?
发生了什么
Anthropic确认,8月2日之后发布的新模型会自动为生成的文本和文件加水印,覆盖Claude、Claude Code、Claude Cowork、Claude Tag和平台API这条完整产品线。文件层面用的是C2PA开放标准,公司说未来也会给老模型补上支持。
TechCrunch问了一个很实际的问题:用户要改多少内容,才能把水印去掉?Anthropic没有回答。
这个问题问得对。因为往下细看,水印到底"存在于哪一层",本身就没说清楚。
水印到底加在哪一层
C2PA是文件签名,类似给图片、文档盖一个可验证的元数据戳,前提是文件本身没被截图、转格式或重新导出。这一层技术成熟、行业通用,Google、Meta、Microsoft也都在用。
真正难的是纯文本水印。理想状态下,它应该像Google的SynthID Text那样,把统计特征嵌进模型选词的过程里,哪怕复制粘贴也能被检测出来。
- 结论.目前没有公开证据表明Anthropic给Claude文本部署了这种令牌级算法,OpenAI也没有——它甚至因为准确率不佳下架了自己的AI文本分类器。
Anthropic支持页面的另一处说法,恰恰印证了这层空白:直接从Claude对话里复制粘贴的纯文本,不带隐藏水印标记。这和"水印会跟着文本走"的官方表态,明显对不上。是页面更新滞后,还是把C2PA文件签名和文本水印这两件事混在了一起说,现在说不清楚。
合规喊的是哪一条法
原文把这次动作定性为响应"欧盟Transparency Code"。这个说法值得再拆一下。
欧盟AI法案的时间线其实是三段式:2025年8月2日是通用目的AI模型提供者的合规起始日,管的是技术文档和风险披露,跟文本水印没直接关系;2026年8月2日,第50条"合成内容透明度义务"才正式适用,这才是强制要求给AI生成内容打机器可读标记的条款;2027年8月2日,是2025年8月之前已上市模型的最终合规截止日。
而所谓的"行为准则"(Code of Practice),本质是自愿性质,Anthropic、Google、OpenAI、Microsoft签了,Meta拒绝签署,理由是准则带来法律不确定性、要求超出法案本身。签这份准则,主要涉及技术文档和下游信息披露,并不等于承诺给每条聊天回复都打上可见水印。
这场水印竞赛,更像姿态还是治理
“天下熙熙,皆为利来。”这句话放在这波水印潮里挺贴切。Suno加水印是因为版权诉讼缠身,Substack联手Pangram标记AI内容是因为CEO公开抱怨"Claudefishing"、用户反弹太大。监管合规更像一个体面的说法,真正的驱动力是声誉和法律风险管理。
技术天花板也摆在那儿:任何有意义的语义改写、翻译、或者拿别的模型再生成一遍,基本都能把水印信号冲掉。水印检测的结果,本质是统计推断,不是身份证明,存在假阳性和假阴性。
- 风险.把水印检测结果单独用来指控学术不端或版权侵权,本身就不靠谱。
Meta拒签行为准则,也不是孤立姿态。它意味着监管落地会出现明显的产业分裂——签了的公司先被架在明面上做样子,没签的反而暂时不受这层舆论压力。等第50条真正开始被执法检验,这种不对等大概会浮出水面。
Claude的水印,眼下更像一张写好台词的公关脚本,文件层面的部分能站住,纯文本那部分,支持页面自己都还没把话说圆。读者不用急着相信"AI生成内容从此可追溯"这句话,至少现在,它还只是一句宣传语。
