Anthropic宣布,从今年发布的新一代Claude模型开始,凡是经它处理过的内容都会被打上一个人眼看不见的水印——不只是AI从零生成的文字,哪怕只是让Claude把语法改顺、把中文翻成英文,输出也会带上同样的标记。这套方案本是为了应付欧盟《人工智能法案》第50条的强制披露要求,但Anthropic选择的覆盖范围比法律要求的还宽。
这不是单纯的合规动作,而是一次没说清楚代价的取舍。水印能证明的只有“Claude碰过这段文字”,证明不了“这段文字是Claude写的”——而这个区别,恰恰是老师判作业、编辑审校稿件、企业审内容时最需要分清楚的东西。
全球新模型“从第一天”打标,欧盟给的豁免它没用
欧盟AI法案的时间表很明确:第50条的透明度义务从2026年8月2日起正式生效,要求AI系统给实质性生成或操纵的音频、图像、文本、视频内容打水印;已经上线的老模型有宽限期,到2026年12月才必须补齐。Anthropic的回应是,往后所有全球发布的新Claude模型,不管卖不卖给欧盟用户,都从发布当天就启用水印。
文本水印是嵌入式的,靠模型选词时留下的统计规律,得靠专门工具批量检测才能读出来,肉眼看不出差别。图片、视频等非文本内容,在系统支持的情况下用C2PA元数据记录来源,这是Adobe、微软等公司也在用的行业标准,不算新发明。
问题出在覆盖范围。欧盟法律明确留了口子:如果AI只是做“辅助性的标准编辑”,比如改语法、顺句子,原则上不需要打标,因为内容的实质意思没被改变。Anthropic没用这个口子——它选择的是能覆盖到的内容全打标,不区分从零生成还是润色一遍。官方自己的说法是,用户常拿Claude校对、翻译、总结或转换文件格式,输出照样会带上标记,即使“原始的想法、文字或数据来自别处”。
水印证明不了“AI写的”,也证明不了“人写的”
这才是真正麻烦的地方。Anthropic自己承认,检测到水印只能说明“内容可能被Claude处理过”,不是内容由Claude生成的证据——水印甚至可能出现在Claude根本没生成的内容上。反过来,没检测到水印也不代表内容没用AI,因为不少平台和功能压根不支持水印,水印本身也能被后续编辑冲掉。
- 风险.教师、编辑等审核人员若把“检测到水印”直接等同于“AI生成”,判断就会出错;水印目前唯一能确认的是“可能被Claude处理过”。
水印也不难绕过。把带水印的文字复制到另一个聊天工具里重新编辑,水印可能就碎了;截图、用元数据工具清一下图片视频,来源信息说没就没。目前Anthropic还没公开检测工具,也没给出误报率、漏报率这类实测数据——这套系统到底管不管用,现在没人能验证。
欧盟规则本身也有点自相矛盾。按第50条第4款,一篇完全由AI生成、涉及公共利益的文章,只要有编辑负责审校,就不需要向读者公开标注是AI写的。模型层面“逢内容必打标”,公开披露层面却是“编辑看过就不用说”——同一件事,两套口径。
水印能证明的只是“AI碰过”,证明不了“AI写的”。
违规的处罚不轻:最高1500万欧元或全球年营收3%,两者取高。这个数字大概足够让Anthropic选择“宁可管多一点也别管少了”,但管多的代价,是把水印变成一个信息量很低、却容易被误读的信号。对经常用Claude校对、翻译、改稿的人来说,往后交出去的文字大概率会带上这个隐形戳——不代表抄袭或造假,但解释起来多了一道麻烦。接下来真正该盯的,是Anthropic什么时候放出检测工具,那套工具的误报率能不能经得起外部测试。
