同一个问题,24 小时之后:昨天一家都不提的引擎,今天点了四家诊所
2026 年 8 月 13 日和 14 日在六座城市测的。Perplexity 隔一天能留下一半的名字,Gemini 留下三分之一 - 而 ChatGPT 依旧一家本地商户都不提。
昨天我们量的是三个助手在同一分钟里的分歧。剩下的,是做生意的人真正会问的那个问题:明天再测一次,它还会这么说吗?
今天早上,我们把昨天那六个问题重跑了一遍。不是重写:是从前一天的文件里读出来,原样发给同样的三个引擎。唯一变化的变量是时间。
光这一个案例就够回答了
昨天问尼斯最好的牙医,Gemini 一家诊所都没提。它回答的是预约平台和挑选标准。今天,同一个问题,它点了四家:Cabinet Avident、Arenas Dentistes、Dentego、Clinadent。
这二十四小时里,这几家诊所没有任何变化。问题也没有任何变化。一位昨天去测的尼斯牙医,会带着「AI 在我这行谁都不提」的结论离开;同样的测试今天却给他看四个对手。
一次测试量的不是你的可见度。它量的是你那一天的可见度。
有多少名字能过一夜
我们把两份名单逐个名字手工比对,把写法不同的合并为同一家(「Victor Plomberie」和「Victor Plombier」,「Caroline Meunier Avocat」和「Cabinet Caroline Meunier」)。六座城市合计:
Perplexity 留下 44 个里的 23 个
,即 52%。三者中最稳。
Gemini 留下 38 个里的 13 个
,即 34%。三个里剩一个。
ChatGPT 一家本地商户都没提
- 昨天没有,今天也没有,六座城市里一家都没有。
稳定程度因行当差得很远。尼斯的牙医那边,Perplexity 七家里留了七家,只多加了一家:几乎是一份定死的名单。南特的修车行那边,同一个引擎七家里只留了一家。同一个引擎、同一天、两个行当:一边是稳定的名单,一边是抽签。
当 ChatGPT 终于报名字时,报的不是本地商户
有个细节值得记下来。在南特修车行这一题上,ChatGPT 今天打破了沉默 - 但它给的名字是 Bosch Car Service、Norauto、Midas、Feu Vert、Speedy。这些是全国连锁,不是南特的修车行。
这跟我们昨天量到的是一致的:这个引擎不推荐本地商户,它把人引向品类和连锁。对南特一家独立修车行来说,「在 ChatGPT 上不存在」并说明不了什么 - 跟他一样的人,一个都不在上面。
这对测量本身意味着什么
这种不稳定不是我们工具的毛病,它就是对象本身的性质。会上网搜的引擎读的是一直在变的页面,回答自然跟着变。正因如此,我们测多次而不是一次,并且不对任何波动做「平滑」处理:这一串序列本身就是信息,不是要抹掉的噪声。
也正因如此,我们从来没有向任何人承诺过在 ChatGPT 里的位置。在一个一夜之间三分之一到一半的名字会换掉的引擎上,承诺排名,等于承诺一次抽签的结果。
拿这个做什么
- 别从一次测试里下结论。不管是「我有曝光」还是「AI 谁都不提」:你知道的只是那天早上的情况。
- 看趋势,别看那个点。五次测量里回来三次的名字,比一次冒到最前面的名字更有分量。
- 把稳定的行当和易变的行当分开。牙科那边名单撑得住,修车行那边会重新洗牌。有用的测量频率并不一样。
- 别只拿 ChatGPT 当尺子来衡量你的存在:在我们这六座城市里,它连着两天一家本地商户都没点。
局限:六个问题、六座城市、两天、每个引擎一个模型。两个点连不成一条曲线,我们也不声称用两次测量就量出了趋势。但这两个点立住的事实是牢的:面对一字不差的同一个问题,今天的回答不是昨天的回答。