一位独立博主上个月在自己的个人博客上发了一篇短文,标题很直接:《AI生成的图片让我不想读你的博客》。他说自己越来越受不了博客里出现AI配图,宁愿看一张粗糙的Microsoft Paint手绘图,也不想看AI生成的插画——因为一旦看到AI图,他就会怀疑,这篇博客的正文是不是也是AI写的。企业博客用AI图他能接受,个人博客用他就不能忍。这篇文章随后被转上了Hacker News,引来一轮讨论。

这套逻辑听起来顺理成章:图是假的,人多半也没那么认真,文字可能也是糊弄的。但把这个前提放进过去两三年关于感知和信任的实证研究里检验一下,会发现第一步就站不住——多项研究发现,普通人识别AI合成图像的能力其实相当有限,某些实验里,AI合成的人脸甚至被评价为比真实照片更真实、更可信。

一篇吐槽帖,为什么戳中了独立博客圈的痒处

2022年前后,DALL-E、Midjourney、Stable Diffusion这批工具把图像配图的成本压到了几乎为零。企业内容营销和SEO农场最先大规模用起来,一篇文章配一张风格统一、毫无成本的AI插画,成了标准动作。与此同时,以Hacker News为据点的“indie web”个人博客复兴社群,长期把“真人写作”当成稀缺价值来强调,AI配图被他们视为对这种“人味”的稀释,慢慢催生出“AI slop”(AI垃圾内容)这个带贬义的标签。

这篇博客的作者显然站在后一边。有意思的是他自己划了一条线:企业博客用AI图,他能理解;个人博客用,他就觉得是背叛。这条双重标准背后,其实藏着读者对“个人”和“机构”两种身份完全不同的信任预期——机构本来就不指望它有多真实,个人却被要求“必须是真的”。

“一眼能看出AI图”,可能只是我们的错觉

问题是,这条推论的第一环——“AI图一眼能看出,看出就不信任”——恰恰是可以拿数据检验的地方,而检验结果和直觉相反。Nightingale与Farid在2022年发表于PNAS的研究发现,AI合成的人脸与真实照片几乎难以区分,甚至被评为略微更可信。Dawel等人2023年在《心理科学》上的研究进一步发现,部分参与者把AI生成的白人面孔评价得比真实照片“更像人类”。跨国代表性研究(Frank等,发表于《自然·通讯》)也显示,公众识别合成媒体的能力普遍有限,且因媒体类型和人群差异很大。

同一个问题,两种答案 常识 / 原文假设 AI图一眼能看出 看出=立刻不信任 配图假 → 怀疑正文也假 研究发现 识别能力普遍有限 AI合成人脸曾被评为更真实 信任惩罚取决于用途和披露

换句话说,这位博主自信满满的“一眼看穿”,在实验室里未必成立。他的反感是真实的情绪,但支撑这份情绪的判断依据,并不牢靠。

真正决定信任的,不是“是不是AI”

那问题出在哪?检索到的证据指向两个被原文忽略的变量。

第一个是图片的功能定位。如果一张图被当作纪实证据使用——比如配一张“真人经历”的照片,结果是AI生成的——读者感受到的欺骗感会重得多。但如果只是装饰性、概念性的插图,惩罚就轻得多。Nielsen Norman Group的研究也提到,读者本来就更在意图片里有没有有用信息,对纯装饰性配图往往直接忽略,谈不上多大的信任成本。原文把所有AI配图一刀切地否定,恰恰跳过了这层区分。

第二个是披露方式,而且效果是双向的。有研究显示,公开承认图片是AI生成会降低说服力和真实感;但Yahoo与Publicis的一份研究报告却发现,当受众清楚看到明确的AI披露标签时,信任度和吸引力反而上升。也就是说,“说了”不等于“更糟”,关键在于怎么说、说给谁、在什么场景下说。

决定信任的不是"是不是AI" 图片功能 纪实证据 → 惩罚更重 / 装饰概念图 → 惩罚更轻 是否披露 沉默 → 事后被拆穿更伤 / 清晰披露 → 有时反而加分 信任结果 由上面两个变量共同决定,不是"AI图=原罪"
信任的开关不在“AI”二字上,在用途和有没有说清楚。

点击可能涨,信任可能跌——原文把两件事混成了一件

还有一个更容易被忽略的分离:engagement(点击、停留)和trust(可信度、回访、分享意愿),不是同一条曲线。一张鲜亮抓眼的AI插画,可能确实提升了打开率——广告行业的研究早就证明视觉刺激对点击有用。但同一批研究也发现,当图片被用在信任敏感的场景(比如慈善、个人服务、奢侈品),读者对AI创意的“诡异感”会明显拖累说服力和长期好感。谷歌Performance Max的案例数据甚至显示,含真人的广告图片在营销目标达成上比不含人物的图片高出三成以上——这条数据来自广告场景,不能直接套到博客上,但方向上提示了同一件事:“抓眼”和“可信”经常不是一回事

点击和信任,可能是两条曲线 短期:点击/停留 AI图鲜亮抓眼 装饰效果不差 可能上升 长期:信任/回访 怀疑真实性 降低分享意愿 可能下降
  • 风险.以上多数实证来自广告和新闻场景,针对“个人博客读者”的专门数据目前还没有,原文吐槽反映的更多是情绪立场而非可验证结论,HN原帖评论区的实际分歧比例也未见系统整理。

对写博客的人来说,这件事落到实处就是一句话:要不要在文章里用AI插画,答案不该由“会不会被读者一眼看穿”决定——因为大概率看不穿——而应该看这张图是不是在冒充证据,以及要不要老老实实说一句“这张图是AI画的”。前者决定伤害有多深,后者决定伤害能不能被抵消。这比“讨厌AI图所以不想读”这句情绪判断,能给博主的选择提供更多依据。