Anthropic在Claude的官方支持中心新增了一篇文档,标题是《How Claude marks AI-generated content》。
公开可见的部分目前只有一堆导航链接和历史文章目录。怎么标记、标在哪儿、标记能不能被验证,这些正文细节还没有完整呈现。文档也没标注发布时间,也没写清楚覆盖Claude网页版、API还是Claude Code——这本身就是一个信息缺口。
这更像是Anthropic在支持库里补一份"我们在做内容溯源"的说明,而不是一份对外正式承诺的技术白皮书。用Claude生产或审核内容的媒体、教育机构和企业合规团队,这篇文档值得记一笔,但不该被理解成"Claude的AI内容现在都能被准确识别出来"。
Anthropic单独立了一篇文档,但没进合规专区
这篇说明被放在Claude产品支持页的常规知识库里,和Artifacts、Projects、Skills这些功能说明并列。它不在单独的合规或安全专区。
这多少说明,Anthropic目前把"内容标记"当成一项产品能力在介绍,还没升级成对外的政策承诺。
从行业背景看,大模型公司专门写文档讲"怎么标记AI内容",通常和外部压力有关。版权纠纷、教育领域的AI代写争议、欧盟《人工智能法案》里对AI生成内容透明度的要求,都在推着各家把这件事摆上台面。
但压力促成了"写文档",不等于压力已经促成了"标记真的管用"。
标记不是检测,中间隔着四层
可见标记、元数据、数字水印、检测器,这四个词经常被混成一回事。
可见标记是界面上一行提示文字,肉眼能看到,也最容易在转发中被删掉。元数据写进文件属性里,普通用户根本看不见。
数字水印是编码嵌进文本或像素里的,需要专门工具才能读出来。检测器完全是另一套东西——第三方独立判断内容像不像AI写的,不依赖生成方有没有主动打标。
文本水印天生比图片水印脆弱。2023年底OpenAI给DALL·E 3图像加C2PA元数据时,就遇到过"元数据在下载转发环节容易被裁掉"的问题。据2024年的公开报道,OpenAI内部也测试过给ChatGPT文字加水印的工具,但一直没有正式上线,原因之一是担心影响用户体验、也容易被简单改写绕过。
文本比图片更难做水印,这是全行业目前都没走通的一条路,Claude大概率也不例外。
对媒体、教育机构和合规团队意味着什么
标记解决的是"愿不愿意说",不是"能不能查清"。不同角色该怎么用这件事,答案并不一样。
| 群体 | 现实处境 | 建议动作 |
|---|---|---|
| 媒体/企业内容审核团队 | 只能看到Claude界面里的标记,复制转发后大概率消失 | 把标记当参考信号,出稿前人工复核一遍 |
| 教育机构 | 没标记不代表没用AI,有标记也可能被删除或改写 | 不把"有没有标记"当唯一证据,结合写作过程记录等其他核验方式 |
| 内容创作者/合规人员 | 文本水印比图片水印更容易在转写中失效 | 涉及版权或合规审计的内容,另外做人工留痕或第三方存证 |
这几类读者,把Claude的标记当成一个辅助信号更现实,不该当成终审证据。能不能验真,短期内还得靠平台之间互相配合,靠一个界面标记解决不了。
接下来最值得盯的,是Anthropic会不会补上具体机制说明——覆盖哪些产品、标记能不能被第三方工具核验。这些信息,目前都还没公开。
