演员Xochitl Gomez在Instagram上贴出一组对比图:左边是她在停车场回头微笑的真实照片,右边是同一张照片被AI改成弯腰摸臀的姿态。红毯照也一样,本来是正面微笑,被改成转身伸舌头。这两张图之前一直挂在X上,没人觉得哪里不对——因为它们看起来太正常了。

404 Media记者Emanuel Maiberg把这类图像叫做subtlefakes:不生成裸体,不换脸拼接,只对明星的真实照片做几笔改动,让身材更夸张、姿势更暧昧。他说自己天天和AI生成内容打交道,扫一眼X的信息流,也分辨不出这些是假的。这和2017年第一批换脸色情视频的逻辑完全相反——那些视频靠的是荒诞感让人心生警觉,subtlefakes靠的恰恰是不荒诞。

造假这几年,从"吓人"变成"像真的"

2017年那批换脸视频,画面粗糙,一眼能看出违和感,2019年学界提出"cheap fakes"概念,指不需要AI、靠剪辑就能扭曲事实的内容。subtlefakes是这两条脉络的合流:用上了AI,却刻意收着力道,只改到"看起来是本人自愿摆的姿势"为止。

这带来一个具体的检测难题:过去判断深度伪造靠"常识拐点"——比如全球最大女演员不可能突然发布色情片。subtlefakes没有这种拐点。一张红毯照被改得更暴露一点,落在了"可能是本人穿着大胆"和"明显造假"之间的灰色地带,常识在这里失效。

非自愿AI图像的三次进化 2017 换脸深度伪造 画面粗糙 一看就假 2019 Cheap fakes 剪辑即可扭曲 不需要AI 2026 Subtlefakes 细微编辑 常识判断失效

Grok的水印,让X的角色变得尴尬

多数主流AI生成工具至少会拦裸体,但很少去拦"让某个真人看起来在摆诱惑姿势"这类请求,护栏的疏密本身就给subtlefakes留了缝。

更具体的问题是:至少一部分被曝出的subtlefakes图片上带着Grok的水印——也就是X自家的AI生成工具。这意味着这些骚扰图像很可能不是外部小作坊做的,而是直接产自平台自己的模型。X没有回应置评请求。

这一点让X的角色变得不再单纯是"没管好",而是可能"自己也生产了问题"。此前X的Grok已经因生成非自愿图像被曝光过,每次都是舆论闹大之后才补救,这次水印的出现,把责任链条又往前挪了一格。

规则写得工整,账号活得很好

X的社区规则明确写着:无论是AI生成、编辑加工还是真实图像,非自愿色情内容一律违规。美国《TAKE IT DOWN Act》还要求平台在收到有效举报后48小时内下架此类AI生成的亲密图像。纸面上看,这套流程相当完备。

现实是另一幅样子:Maiberg观察到的subtlefakes账号,大多是经过认证的"engagement farming"账号,靠曝光量拿X的广告分成,数量众多,合计获得数百万次浏览,账号照常运营。

规则越工整,越该问执行环节卡在哪一层

X 2025年发布的透明度报告(覆盖2024年下半年)显示,因"非自愿色情"政策共封停51,449个账号、删除143,813条帖子,其中约12.1%由自动化系统识别,约87.9%靠人工审核揪出来。这组数字看起来很郑重,但报告没有把AI生成内容单独拆出来统计,外界既无法判断subtlefakes问题是不是真在扩大,也无法验证平台对这类新形态的识别能力到底提升了多少。

纸面规则 vs 账号现实 X官方承诺 非自愿色情内容一律禁止 AI生成/编辑/真实图像同罚 举报后48小时内下架 依据TAKE IT DOWN Act 账号现实处境 认证账号靠曝光量分成获利 subtlefakes账号数量众多 合计获得数百万次浏览 部分图片带Grok水印,X未回应
  • 风险.透明度报告不拆分AI生成内容,外界暂时无法验证subtlefakes规模是否真在扩大。

接下来该盯什么

subtlefakes直接伤害的是像Gomez这样有公众曝光度的女性,间接波及的是所有可能被人拿真实照片"顺手改一下"的女性用户——门槛比传统深度伪造更低,不需要装可疑软件,也不用付费。

接下来值得追问的几件事:Grok是否真的直接生成过这类图像,X会不会公开回应;平台会不会把AI生成的非自愿内容从统计口径里单独拆出来;靠曝光量付费的创作者计划,是不是该为这类"低成本高回报"的内容改一改分成规则。这几个问题目前都没有答案,答案出来之前,subtlefakes大概还会继续在信息流里安静地流传。