跳到正文
Waseit
← 全部文章
AEO测量

同一个问题,24 小时之后:昨天一家都不提的引擎,今天点了四家诊所

2026 年 8 月 13 日和 14 日在六座城市测的。Perplexity 隔一天能留下一半的名字,Gemini 留下三分之一 - 而 ChatGPT 依旧一家本地商户都不提。

2026年8月14日7 分钟读完
本文目录
  1. 光这一个案例就够回答了
  2. 有多少名字能过一夜
  3. 当 ChatGPT 终于报名字时,报的不是本地商户
  4. 这对测量本身意味着什么
  5. 拿这个做什么

昨天我们量的是三个助手在同一分钟里的分歧。剩下的,是做生意的人真正会问的那个问题:明天再测一次,它还会这么说吗?

今天早上,我们把昨天那六个问题重跑了一遍。不是重写:是从前一天的文件里读出来,原样发给同样的三个引擎。唯一变化的变量是时间。

光这一个案例就够回答了

昨天问尼斯最好的牙医,Gemini 一家诊所都没提。它回答的是预约平台和挑选标准。今天,同一个问题,它点了四家:Cabinet Avident、Arenas Dentistes、Dentego、Clinadent。

这二十四小时里,这几家诊所没有任何变化。问题也没有任何变化。一位昨天去测的尼斯牙医,会带着「AI 在我这行谁都不提」的结论离开;同样的测试今天却给他看四个对手。

一次测试量的不是你的可见度。它量的是你那一天的可见度。

有多少名字能过一夜

我们把两份名单逐个名字手工比对,把写法不同的合并为同一家(「Victor Plomberie」和「Victor Plombier」,「Caroline Meunier Avocat」和「Cabinet Caroline Meunier」)。六座城市合计:

Perplexity 留下 44 个里的 23 个

,即 52%。三者中最稳。

Gemini 留下 38 个里的 13 个

,即 34%。三个里剩一个。

ChatGPT 一家本地商户都没提

- 昨天没有,今天也没有,六座城市里一家都没有。

稳定程度因行当差得很远。尼斯的牙医那边,Perplexity 七家里留了七家,只多加了一家:几乎是一份定死的名单。南特的修车行那边,同一个引擎七家里只留了一家。同一个引擎、同一天、两个行当:一边是稳定的名单,一边是抽签。

当 ChatGPT 终于报名字时,报的不是本地商户

有个细节值得记下来。在南特修车行这一题上,ChatGPT 今天打破了沉默 - 但它给的名字是 Bosch Car Service、Norauto、Midas、Feu Vert、Speedy。这些是全国连锁,不是南特的修车行。

这跟我们昨天量到的是一致的:这个引擎不推荐本地商户,它把人引向品类和连锁。对南特一家独立修车行来说,「在 ChatGPT 上不存在」并说明不了什么 - 跟他一样的人,一个都不在上面。

这对测量本身意味着什么

这种不稳定不是我们工具的毛病,它就是对象本身的性质。会上网搜的引擎读的是一直在变的页面,回答自然跟着变。正因如此,我们测多次而不是一次,并且不对任何波动做「平滑」处理:这一串序列本身就是信息,不是要抹掉的噪声。

也正因如此,我们从来没有向任何人承诺过在 ChatGPT 里的位置。在一个一夜之间三分之一到一半的名字会换掉的引擎上,承诺排名,等于承诺一次抽签的结果。

拿这个做什么

  • 别从一次测试里下结论。不管是「我有曝光」还是「AI 谁都不提」:你知道的只是那天早上的情况。
  • 看趋势,别看那个点。五次测量里回来三次的名字,比一次冒到最前面的名字更有分量。
  • 把稳定的行当和易变的行当分开。牙科那边名单撑得住,修车行那边会重新洗牌。有用的测量频率并不一样。
  • 别只拿 ChatGPT 当尺子来衡量你的存在:在我们这六座城市里,它连着两天一家本地商户都没点。

局限:六个问题、六座城市、两天、每个引擎一个模型。两个点连不成一条曲线,我们也不声称用两次测量就量出了趋势。但这两个点立住的事实是牢的:面对一字不差的同一个问题,今天的回答不是昨天的回答。