研究机构Trellner Research把380个软件采购类目喂给Perplexity的sonarsonar-pro两个模型,一共发出760次调用,收回7,534条引用来源。结果里59.8%的引用指向Tranco百万强榜单里排名差于10万位的域名,23.4%的引用干脆连百万强都挤不进去。作为对照,Wikipedia在全部7,534条引用里只出现了3次。

问题不在"AI又引用了垫底网站"这种老生常谈。真正扎眼的是三个网站——wifitalents.com、worldmetrics.org、gitnux.org,疑似还牵着第四个zipdo.co——它们各自的博客加起来只写过6篇文章,却各自生成了超过7万篇"/best/xxx软件/"页面,三站合计215,128篇机器生成的采购榜。更反常的是,这几个网站的首页HTML标题干脆写着"Facts & Grounding Page"——grounding正是检索增强生成模型抓取网页时那个动作的专业术语。这些页面从一开始就不是写给人看的,是写给爬虫看的。

三站都在2023年12月到2024年5月之间通过NameCheap注册,共用同一对Cloudflare名字服务器,页面模板、导航栏、连"编辑团队"的九个虚构人名布局都高度雷同。它们不是巧合撞车的三家公司,更像同一套流水线的三个马甲。

三个网站,一套流水线 215,128 三站生成的"最佳"页面数 (篇) 18 三站真人博客文章数 (篇,每站各6篇) 59.8% 引用指向Tranco百强外 10万位之后的域名 首页标题统一写作"Facts & Grounding Page"——不是给人看的,是给检索模型看的 注册时间集中在2023年12月至2024年5月,共用同一对Cloudflare名字服务器

Guideflow反超Gartner,说明检索层根本不看"是不是评测网站"

比三站群更能说明问题的是guideflow.com——一家卖交互式产品演示工具的营销博客,Tranco排名177,039,不在任何评测赛道里竞争。它在380个类目里的96个被引用,累计194次,超过Gartner,成为第三大被引来源

这家公司没有做错什么。写行业内容营销博客的B2B厂商成千上万,guideflow只是恰好写得够多、够杂。真正该问的是:一个从不参与竞争的厂商博客,凭什么在"选哪个软件"这件事上,比行业分析机构说的话更响?

被引用次数排名:谁挤进了前五 g2.com 291次 reddit.com 261次 guideflow.com 194次(第三) gartner.com 158次 capterra.com 68次 Wikipedia 3次(对照)

三站号称"共同标准",给出的答案却互相打脸

如果这三个站真是一套统一标准生产的内容,至少该给出一致的答案。事实相反。同一个类目"项目估算软件",三家给出的前三名完全不重叠:

网站冠军亚军季军
worldmetrics.orgFloatScoroTeamwork.com
wifitalents.comFloatScoroTeamwork.com
gitnux.orgSaviomMosaicBuildertrend

gitnux.org的冠军Saviom,在另外两家的前五里根本没出现。每个页面还都挂着"AI-verified·专家审核"之类的字样,署名三位子虚乌有的员工,九个人给同一个问题吵出了三个答案。模板做得再像"标准流程",内容其实是随机生成的空壳。


这套打法专挑Perplexity下手,不代表所有AI搜索都失守

Trellner的测试只覆盖了Perplexity的sonar系列,主动排除了Google的Gemini(OpenRouter调用Gemini时走的是自家搜索插件,不是Google原生检索),也没测ChatGPT Search、Copilot。这个边界很重要——不能把这次发现直接推广成"所有AI搜索都在被内容农场攻陷"

但把视野拉宽一点,类似的信号并非孤例。Ahrefs对上百万条搜索结果、数百万条被引URL的分析发现,Google的AI Overviews里也只有约38%的引用落在自然搜索前十名,相当一部分引用同样来自排名百名之外的页面。一项2024年针对生成式搜索系统的学术审计也指出,这类系统普遍存在商业性偏向,严重依赖新闻和商业站点,来源质量参差不齐。

  • 洞见.AI搜索的"引用"看起来像可信度背书,实际只证明检索系统抓到了这份文档,不代表它审核过内容真假。

但也要澄清一层容易被忽略的反向证据:有分析显示,网站的传统权威度(domain authority)和被AI引用的频率之间相关性本就很弱。也就是说,排名低不一定等于被刻意操纵——AI检索本来就未必按传统SEO那套逻辑挑来源。这三个站群的可疑之处,不是排名低,而是它们注册时间集中、模板雷同、内容量级远超正常博客产出,再加上把自己明确标注成"给检索系统看的证据页"——这才是刻意为之的证据,不是排名低这件事本身。

Perplexity官方文档里其实提供了域名黑白名单和"政府/学术/可信"来源标签这类过滤工具,但官方也说明这些标签只作用于域名整体,不覆盖域名下每一页的具体内容。这意味着,只要一个域名整体没被标记为可疑,它底下批量生成的21万篇页面就能全部绕过审核。

  • 风险.软件采购者如果直接照搬AI给出的排名,可能被引导向内容农场编出来的"冠军",而不是真正经过评测的产品。

真正受冲击的是两类人。一是靠AI搜索做选型的采购者,他们看到的"前五名"可能只是模板批量生成的结果,而不是真评测。二是G2、Gartner、Capterra这类传统评测机构,它们积累多年的权威性,在被引份额上正在被几个注册不到两年、内容全靠脚本生成的域名分掉一部分份额。

接下来该盯的,不是这三个网站会不会被封——那只是打地鼠的第一枪。真正的变量是Perplexity会不会把过滤精度做到页面级,以及这套"写给机器看的证据页"打法会不会被复制到Google AI Overviews和ChatGPT Search上。如果连产品名带排名都能被批量生成的模板文章左右,这场SEO战争已经换了对手。