# 三个网站批量生成了21.5万页“最佳软件”指南，Perplexity 把它们当成了引用来源

> 原标题：Three sites made 215,128 "best software" pages for AI. Perplexity cites them

- 来源：Hacker News 首页
- 发布时间：2026-09-02T13:59:59.000Z
- AX AI 日报：https://ai-daily.ax0x.ai/items/54304
- 原文：https://trellner.com/reports/manufactured-sources-behind-ai-recommendations/

## 摘要

Trellner Research 用 380 个软件品类测试了 Perplexity 的两个模型，发现返回的 7534 条引用里，近六成来自全球排名十万开外的网站，还有 23.4% 根本不在前一百万名里。最扎眼的是 wifitalents.com、worldmetrics.org 和 gitnux.org 这三个站，它们总共用机器生成了 215128...

## 推荐理由

这篇研究的方法很直接：拿 380 个软件品类去测 Perplexity 两个模型，统计引用来源的域名排名。结果很扎眼——wifitalents.com、worldmetrics.org 和 gitnux.org 三个站合计用机器吐了 21.5 万页内容，却被频繁引用。我会先打个折：研究没披露具体查询词和模型版本，也没说明这些引用在答案里的权重有多大，但近六成引用来自低权威域这个比例已经足够说明问题。对从业者来说，这不是 Perplexity 一家的事，而是整个“搜索+生成”模式在信源质量上的系统性漏洞。

## 锐评

这份报告测的是 Perplexity 两个模型在 380 个软件品类里的引用来源，总共 7534 条。结果挺直接：59.8% 的引用域名在 Tranco 全球排名十万名之后，23.4% 甚至不在前一百万。也就是说，模型给你的“靠谱推荐”，大部分依据来自互联网的犄角旮旯。最扎眼的是 wifitalents.com、worldmetrics.org 和 gitnux.org 这三个站，它们从 2023 年底开始批量注册，用同一套模板生成了 215128 个“最佳某某软件”页面，其中两个站甚至把首页标题写成“Facts & Grounding Page”，明摆着是写给检索模型看的，不是给人看的。另外，一个叫 guideflow.com 的厂商营销博客，靠批量发榜单成了第三大引用源，排在 Gartner 前面。

数字本身有边界：测试只跑了 Perplexity，没碰 Google，所以不能直接说所有 AI 搜索都这样。但问题很清晰——当检索层把机器批量生成的 SEO 内容当成可信证据时，推荐质量就悬了。报告没披露这些引用最终对推荐结果的影响权重有多大，也没说 Perplexity 内部有没有过滤机制，这两点缺了就没法判断实际伤害有多深。
