Claude要给AI生成的文字和图片打隐形水印了——这是本周科技媒体圈流传的一条消息。但把这条新闻从头查到尾,会发现一件挺尴尬的事:翻遍Anthropic官方渠道,找不到任何一份对应的技术公告,说清楚这套水印到底是什么、什么时候上线、覆盖哪些场景。
这不是说这件事一定是假的。更可能的情况是,报道把三件级别完全不同的事揉在了一起:2023年白宫AI自愿承诺里Anthropic承诺"探索"溯源技术的政策表态,欧盟AI法案对AI标识的强制合规要求,以及"Claude现在真的能生成带水印的内容"这个具体的产品事实。前两件是承诺和义务,最后一件才是普通用户能感知到的东西,三者不该被写成一句话。
标题很大,官方通道却对不上号
欧盟AI法案的AI标识新规已经生效,给已上线产品留了几个月的合规缓冲期,这是真实存在的监管压力,Anthropic大概率确实在推进相应工作。
问题在于,"在推进"和"已经上线并公开技术细节"是两件事。目前能查到的,只有政策层面的合规义务,没有独立的产品公告或技术文档能佐证具体的水印机制、检测方式和适用范围。这种信息断层,普通读者光看标题根本看不出来。
水印和C2PA证明的不是同一件事
更容易被忽略的是,"隐形水印"和"C2PA元数据"经常被媒体当同义词用,但原理完全不同。
统计水印是在内容生成的那一刻,往里面塞进只有机器能识别的模式——文字选词时留下统计偏置,图片像素里嵌入信号,内容本身就是水印的载体。C2PA走的是另一条路,靠加密签名记录"这个文件是谁在什么时候生成或编辑的",元数据是挂在文件外面的一张身份卡,不是嵌进内容本身。
前者更难被彻底抹掉,但技术门槛高;后者行业标准成熟、Adobe和多家公司都在用,但上传截图、转发压缩时经常被意外剥离。这两种机制能证明的东西不一样,能被绕过的方式也不一样,混着讲只会让读者对"AI能不能被识别"产生错误的信心。
就算功能属实,Anthropic也是追赶者
放在行业里对比,即便Anthropic真的把水印做出来,位置也不算领先。
Google DeepMind的SynthID目前是公开程度最高的内容级水印方案,已经覆盖文本、图像、音频、视频四种形态。OpenAI这条路走得更保守——早期的文本分类器因为准确率太低已经下架,现在主要靠C2PA元数据给Sora等图像视频产品做溯源,文本层面并没有对外公开成熟方案。Anthropic这次连技术路径都没讲清楚,自然排不到前面。
还有一个容易被忽略的技术细节:Claude本身并不原生生成图像。报道标题里的"AI images"水印,大概率指的是Claude调用第三方工具生成图片时的输出,而不是Claude自己画出来的东西。这个适用边界没有说清楚,读者很容易以为Claude已经是一个能自己出图、还自带水印的全能工具。
即便上线,也挡不住改写和翻译
同类系统的脆弱性,学界早就有过反复验证。
论文层面已经证明,对AI生成的文字做一次简单的paraphrase改写,或者换一种语言翻译一遍,统计水印的检测率会明显下降。更麻烦的是,这类检测器对非英语母语写作者存在系统性的假阳性风险——写作习惯不同,很容易被误判成AI生成。
- 风险.教育机构如果把水印检测结果当作学术不端的直接证据,非母语学生会承担不成比例的误判风险。
这也是为什么Anthropic自己在支持文档里都在打预防针:没有检测到水印的内容,不代表就是人写的。这句免责声明本身,已经说明了这套系统的边界在哪里。
对内容平台和监管者来说,现实的判断是:水印和C2PA可以当作一个辅助信号,但不能当作认定AI内容的唯一证据。真正该盯的,是Anthropic什么时候拿出可供第三方复现的技术规范和检测数据——那才是判断这次"隐形水印"究竟是产品还是公关话术的分水岭。
