三个网站为AI创建了215,128个"最佳软件"页面。Perplexity引用了它们。
摘要
一项研究显示,Perplexity AI模型在软件推荐中经常引用排名较低或新建的网站,其中三个网站生成了超过20万个机器生成的页面。
暂无内容
查看缓存全文
缓存时间: 2026/09/02 14:49
# 三个网站为AI制作了215,128个“最佳软件”页面。Perplexity引用了它们
来源:https://trellner.com/reports/manufactured-sources-behind-ai-recommendations
我们向两个基于网络的模型询问了380个软件类别中的最佳产品,并保留了它们检索到的所有URL。在返回的7,534条引用中,59.8%指向在Tranco前100万排名中(https://tranco-list.eu/list/K9QPW)位列100,000名之后的域名,23.4%指向根本不在前100万名中的域名。其中两个提供“grounding”的网站将其主页的HTML标题设为“事实与Grounding页面”——grounding即这些模型执行的检索步骤——而它们以及第三个显然受同一控制方运营的网站,共同发布了215,128个机器生成的“最佳”页面;这三个域名在2023年12月之前均不存在。
## 我们的测试内容
2026年9月2日,我们通过OpenRouter向`perplexity/sonar`和`perplexity/sonar-pro`提交了380个购买意向类别——从“CRM软件”到“博物馆藏品管理软件”——每个类别每个模型一个提示,总共760次调用。每次调用都要求返回一个排名前五的JSON列表,包含每个产品的官方主页域名。所有760次都返回了可解析的答案,并且两个模型都报告了它们检索到的URL,这就是选择它们的原因。类别在看到任何结果之前就已写好,且从未修改。
这产生了3,800个推荐位,涉及1,807个不同的产品,以及涵盖2,055个不同域名的7,534条引用。
随后,我们在2026年9月1日的Tranco每日列表和Wayback Machine中查询了每一个被引用的域名,并访问了模型提供的全部1,502个供应商主页,以检查它们是否仍然存在。
Google被排除在外。在OpenRouter上对Gemini模型进行“grounding”意味着通过OpenRouter自己的网络搜索插件进行路由,因此引用描述的是该插件而非Google的检索。本次测量仅针对Perplexity,此处内容不应被解读为针对任何其他引擎的声明。
## 引用落点分布
指向已排名域名的5,768条引用的Tranco中位数排名为71,611。头部集中度并不突出——被引用最多的十个域名占引用的17.3%——所以问题不在于某个著名网站集团提供了答案。问题在于另外五分之四的内容是什么:在2,055个被引用域名中,有751个(占36.5%)未出现在前100万名中。这些域名也更年轻。未排名域名的Wayback首次捕获中位数为2020年,而已排名域名为2011年;16.6%的已存档未排名域名首次捕获于2025年或之后,相比而已排名域名这一比例为1.6%。
被引用最多的十个域名:作为对比,维基百科在7,534条引用中仅被引用了三次。
## 第三大来源是一家供应商的营销博客
`guideflow.com`销售交互式产品演示。它不是一个评测网站、目录或出版商,并且不在我们询问的任何类别中竞争。然而,它的博客在我们的380个类别中的96个(占四分之一)被引用了194次,总体排名第三,领先于Gartner。
每次引用都是一个不同的URL:96个不同的`guideflow.com`博客URL,每个类别一个,其中六个是文章的爱沙尼亚语版本。其站点地图列出了3,351个博客URL,其中2,176个是不同的文章。它同样为“3D渲染软件”、“IVR软件”、“RFID软件”和“建筑实践软件”等提供了“grounding”。
此处并无欺骗性内容。Guideflow发布了一个大型内容营销博客,正如数千家公司一样。本测量关注的是检索层如何处理它:一家供应商自己关于其不参与的市场的列表文章,成为了关于购买哪个产品这一问题的第三大证据基础。
## 事实与grounding页面
排名前十及紧随其后的另外三个网站是`wifitalents.com`(71次引用,27个类别)、`worldmetrics.org`(60次,22个类别)和`gitnux.org`(50次,23个类别)。它们总共占181次引用,占总数的2.4%,出现在380个类别中的41个中。它们看起来是一个运营实体。
三者均在2023年12月至2024年5月间通过NameCheap注册,都将DNS委托给同一对Cloudflare域名服务器`pam.ns.cloudflare.com`和`sean.ns.cloudflare.com`,并且都运行着相同的页面模板和相同的导航栏——服务、市场数据、软件建议、编辑流程、公司。每个网站还维护着恰好六篇博文,所有十八篇博文都是关于该组合中的其他品牌:每篇关于另外两个品牌各两篇,还有两篇关于第四个品牌`zipdo.co`,后者使用相同的域名服务器对,并将自己主页的标题也设为相同的“事实与Grounding页面”。
共享域名服务器对是共享Cloudflare账户的有力间接证据,但并非所有权的证明。然而,模板、分类和博文都逐项匹配。
关键在于它们的规模。它们的站点地图分别列出了103,578、107,083和105,541个URL,其中70,731、71,684和72,713个是`/best/-software/`页面:**三个品牌共生成215,128个购买指南**,而每个品牌只有六篇博文(每个站点地图中的第七个`/blog/` URL是博客索引页)。
并不存在215,128个软件类别。
其自我描述使其与众不同。于2026年9月2日获取时,`worldmetrics.org`和`gitnux.org`都返回了格式为“——事实与Grounding页面”的HTML标题,以及除了品牌名外完全相同的元描述:
> 关于Gitnux的经过验证的事实:一家独立的市场研究公司,发布行业统计数据、定制研究和软件最佳列表。公司、法律、方法和合规细节均记录在一个机器可读的记录中。
“Grounding”并非买家使用的术语。它是指检索系统获取文档以基于其调整答案的步骤的名称。
一份关于自身的经过验证事实的机器可读记录,对人类读者来说也不是一项服务。这些页面的标题和描述表明,它们是面向读取它们的软件的。这种读取也正在以常规方式被购买。`worldmetrics.org`广告其定制市场研究“起价€5,000”、现成报告“起价€499”以及供应商选择“起价€2,500”,而这些价格就列在被模型检索的、相同的生成的最佳列表分类法之上。
## 一个模板,三种结论
我们从三个品牌获取了相同的类别页面:“项目估算软件”。每个页面都在JSON-LD中声明其排名,因此可以无需解释地读取。每个页面对十个工具进行排名;显示前五名。Gitnux的获胜者根本没有出现在Worldmetrics的前五名中。
每个页面都列出了三名具名员工——Worldmetrics注明是Kathryn Blake、Alexander Schmidt和Victoria Marsh;Gitnux注明是Diana Reeves、Helena Kowalczyk和Olivia Thornton;WifiTalents注明是Ryan Gallagher、Isabella Rossi和Natasha Ivanova——一个问题出现了九个不同的人。每个页面都宣布了一个编辑流程;Gitnux将其结果标记为“经AI验证·专家审阅”。
三个页面都在署名行中包含一个未渲染的模板变量,其中两个显示为“在接下来的26天内”,另一个显示为“在接下来的40天内”。
## 推荐指向何处
模型提供的1,502个供应商主页大多正常。我们检查了每一个,一次直接访问,一次通过轮换代理访问,如果任一尝试访问成功,则计为可访问,这样阻止我们其中一个IP的主机不会被记录为已倒闭公司。1,502个中有十个完全无法解析地址——其中八个未委托给任何域名服务器——包括`graphiql.com`(被提供为GraphiQL的主页,但并无此网站)、`todo.com`(被提供给Microsoft To Do)和`aquasec.io`(被提供给Trivy)。另有四个虽能解析但永远不应答。加上404错误,共有17个域名(1.1%)消失或无法访问。另外92个(6.1%)重定向到不同的可注册域名;其中大多数是普通的收购和品牌重塑,我们公布了完整列表而非对每个进行猜测。
有两个不是这种情况,并且在这两个案例中,两个层级的模型意见不一。当被要求提供研究数据管理平台时,两者都提到了Dryad:`sonar-pro`给出了真正的仓库`datadryad.org`,而`sonar`给出了`dryad.co`,该域名重定向到一个印度尼西亚的在线赌博门户,其标题以“BIGSLOT288 | 游戏在线门户”开头。当被要求提供数据质量工具时,两者都提到了Monte Carlo:`sonar`给出了`montecarlodata.com`,而`sonar-pro`给出了`montecarlo.com`,该域名重定向到Monte-Carlo Société des Bains de Mer,即摩纳哥的酒店和赌场集团。
## 本研究未表明的内容
这两个模型不是两个独立的测量。它们在380个类别中的289个返回了字节级相同的引用列表,并且它们的URL集合的Jaccard相似度为0.898,因此Perplexity的两个层级共享一个检索层,应被视为对同一搜索栈的两次采样。它们对首选项(380个类别中有290个类别将同一产品列为第一)的一致性是关于该共享检索层的事实,而非独立系统收敛的证据。
结果仅涵盖Perplexity。我们没有测量ChatGPT、Gemini、Copilot或Google的AI模式,并且没有理由假设它们的检索混合情况相同。
380个类别是我们自己构建的,并非买家实际询问内容的样本,并且偏向小众垂直领域的列表会比常见查询列表浮现更多长尾来源。
每个页面的获取都通过一个轮换的、带有命名研究用户代理的数据中心代理发出,因此这些网站返回给我们的内容,不一定与它们返回给检索爬虫或浏览器的内容相同。
十七个无法访问的供应商域名中有四个是大型网站,包括`nasdaq.com`和`solidworks.com`,它们显然仍在运营,只是从未应答自动化请求;它们被计为“无法访问”,而非“已倒闭”。
整个运行是检索索引某一天快照,而索引是变化的。每个类别一个提示措辞,一次运行,无重复采样。早期的测试表明,当“最佳”换为“最流行”时,产品候选名单会显著变动,而引用组合的变动则小得多,但本次运行未对此进行测量。
Tranco排名是一个流行度指标,而非质量指标,排名低并非指控。此处仅用它来区分广受访问的网络与其他所有内容;关于特定网站的所有主张都基于该网站自身的页面,这些页面已链接并归档在数据集中。
我们并未证明这些内容会改变答案。我们没有测试移除这些来源是否会产生不同的推荐,并且Guideflow和三个最佳列表品牌很可能列出的也是合理的产品。我们测量的是证据基础由哪些文档构成。
最后,三个品牌的共同控制是从共享基础设施和相同的模板推断出来的。我们不知道谁运营它们;三者均未提及所有者。
## 数据与方法
完整数据集——每条引用、每个推荐、Tranco和Wayback的查询结果、供应商存活状态检查——以及生成上述每个图表的脚本位于`/data/manufactured-sources-behind-ai-recommendations/`(https://trellner.com/data/manufactured-sources-behind-ai-recommendations/),并附有方法(https://trellner.com/data/manufactured-sources-behind-ai-recommendations/METHOD.md)和列说明(https://trellner.com/data/manufactured-sources-behind-ai-recommendations/README.md)。以CC BY 4.0许可发布。
本报告的PDF版本可在此获取:`trellner.com/data/manufactured-sources-behind-ai-recommendations/manufactured-sources-behind-ai-recommendations.pdf`(https://trellner.com/data/manufactured-sources-behind-ai-recommendations/manufactured-sources-behind-ai-recommendations.pdf)。
相似文章
Perplexity 三分之一的引用未包含其所引用的数字
对 Perplexity AI 搜索模型的审计发现,超过三分之一的特定数字引用在链接页面上未包含这些数字,失败情况包括来源无法访问或无关。
Perplexity持续在产品答案中引用了一个只有560次观看的YouTube视频。这出乎我的意料。
一项实验发现,Perplexity AI搜索在产品答案中频繁引用低观看量的YouTube视频(部分带有联盟链接),这表明AI可见性并不等同于流行度,并引发了对来源质量的担忧。
现在有3,749个AI运营的新闻网站,大多数内容并非为人类读者而写。
该文强调了存在3,749个主要服务于机器流量的AI运营新闻网站,将其视为基础设施问题,并寻求技术解决方案。
@allen_lattimer:2026年能为你节省数百小时的50款AI工具。1. Claude — 解决任何问题 2. Perplexity — 研究任何事物…
精选的50款AI工具列表,涵盖聊天机器人、视频生成器、设计工具和自动化平台等,适用于2026年的各种任务。
Perplexity AI vs. 所有?
本文比较了 ChatGPT Plus 和 Perplexity Pro 订阅服务,质疑为什么人们选择 ChatGPT Plus,尽管 Perplexity Pro 提供了对多种 AI 模型的访问和更好的搜索功能,且价格同为每月 20 美元。