跳到正文
Waseit
← 全部文章
AEOGEO

147 个名字出现过,28 个留了下来:AI 的大多数提及是路过,不是席位

同一问题问 3 次,5 个行业,2 个引擎:被提及的名字里三个中有两个只出现一次。而且提及的价值取决于引擎 - 在 Perplexity 上两次里有一次站得住,在 Gemini 上二十次里才有一次。

19 %

被提及的名字中撑过全部三轮的比例 - 147 个中的 28 个

2026年8月30日8 分钟读完
本文目录
  1. 我们测了什么
  2. 一个引擎在建核心,另一个几乎不建
  3. 中位数的组合根本没有核心
  4. 你能拿它做什么

简短回答:被 AI 提及,和在 AI 那里拥有席位,是两回事,而且差距可以测量。 我们把同一个问题连问三遍,覆盖 5 个行业、2 种语言、2 个引擎。至少出现一次的企业名有 147 个。三轮全部在场的只有 28 个。98 个 - 三个中的两个 - 只出现了一次:是路过,不是席位。

5 个

清洗后一份推荐列表长度的中位数

1/2 vs 1/20

一次提及是稳定席位的概率 - Perplexity 对 Gemini

三轮中出现过的 147 个名字里,留下的是 28 个。只出现一次的那 98 个不是席位:是路过。

我们测了什么

沿用 8 月 23 日以来所有测量的同一道基准问题 -「最好的 X 有哪些」- 连续三次、一字不改地,在 5 个全球行业里,用英语和法语,问 Perplexity 和 Gemini。请求 60 轮,API 失败 9 轮,可用 51 轮,采集于 8 月 29 日晚。

对每个行业-语言-引擎组合,我们数三样东西:并集(至少出现一次的所有名字)、核心(三轮全在的名字)、尾巴(只出现一次的名字)。核心是唯一可以经营的名单;尾巴是任何优化都瞄不准的偶然。

原始数和清洗数一起公布。 我们的提取器仍会放过一些不是企业名的碎片,每个碎片都会凭空造出一个席位。清洗后,一条回答的中位数是 5 个名字(原始为 8 个)- Perplexity 7 个,Gemini 4 个,英语 5 个,法语 4 个。

一个引擎在建核心,另一个几乎不建

各组合的并集、核心(三轮全在)与尾巴(仅出现一次)- 节选,2026 年 8 月 29 日测量,清洗后计数。
组合出现的名字核心核心占比
酒店预订(en)- Perplexity88100 %
支付(en)- Perplexity8788 %
支付(fr)- Perplexity9444 %
CRM(en)- Perplexity9333 %
酒店预订(en)- Gemini13215 %
CRM(en)- Gemini1318 %
支付(en)- Gemini1400 %
网站托管(en)- Gemini1200 %

同一行业、同一语言、同一天:Perplexity 在酒店预订上三次给出同样的 8 个名字 - 核心 100 %。Gemini 在支付上三轮冒出 14 个名字,一个都没留住

在两个引擎都作答的 7 个组合上,账目清清楚楚:Perplexity 上出现过的 47 个名字里有 23 个撑过三轮 - 两个中有一个Gemini 上是 65 个里的 3 个 - 二十个中才有一个。「Gemini 的提及」和「Perplexity 的提及」不是同一种货币,不加说明就把两者相加的评分,是在把金币和筹码混在一起。

中位数的组合根本没有核心

这次测量里最扎眼的数字不是平均值:每个组合的核心中位数是零。随机挑一个行业-语言-引擎组合,最可能的情况是那里没有任何名字能撑过三轮,同时有五个名字路过一次就消失。周二「被 AI 推荐」这件事,对周三几乎什么都说明不了。

  • 三次采集失败全部集中在 Perplexity 一侧。

    法语的酒店预订和两种语言的网站托管没有任何 Perplexity 轮次(API 限流)。引擎对决因此只能在双方都作答的 7 个组合上读取 - 「1/2」和「1/20」正是从那里来的。

  • 跑鞋行业的失败是我们自己的。

    我们的降噪过滤器会丢弃带数字的条目 - 可鞋款偏偏叫「Pegasus 41」「Clifton 10」。这个行业的名单清洗后几乎全空:掏空它们的是过滤器,不是引擎。我们把它原样公布,而不是悄悄拿掉。

  • 三轮、一个晚上、两个引擎:是抽样,不是普查。

    三轮足以把核心和尾巴分开;不足以给名字的轮换速度定标。也没有任何东西保证下一晚或下一周会给出同样的比例。

你能拿它做什么

瞄准核心,别瞄准名单。

三轮里只出现一次的名字并不「在 AI 里有席位」:它只是路过了一轮。庆祝一次提及之前,先问它会不会回来。

永远要问是哪个引擎。

同一句话 -「你们被提及了」- 在 Perplexity 上描述的是 50 % 稳定的位置,在 Gemini 上是 5 % 的抽签。不写明引擎的报告等于什么都没说。

用同样的方式,隔一段时间再测。

这是分辨席位和路过的唯一办法 - 单独一轮从构造上就做不到。我们的监测每 3 天重复同一个问题,原因正在于此。

常见问题

只被提及一次,有意义吗?
作为信号,有:引擎知道你的名字,并且叫得出来。作为位置,没有:在这次测量里,被提及的名字三个中有两个在三轮相同实验中只出现一次。一次提及是一次路过 - 它预告不了下一次。
Gemini 为什么这么频繁地换名单?
我们只观测到差距,无法从内部解释:同一晚同样的问题,Gemini 是 65 个里 3 个稳定,Perplexity 是 47 个里 23 个。测量能说的,是 Gemini 的名单在两轮之间几乎整个换掉;引擎在两轮之间做了什么,只有它的制造者知道。
我到底能争取几个席位?
清洗后一条回答的中位数是 5 个名字,一个组合的稳定核心因行业和引擎而异,从 0 到 8。核心存在的地方,它很短:挤进去价值很大。核心不存在的地方,没有人「占着」席位 - 你的竞争对手也一样。