「便宜」「急」「最好」:五种问法,五份不同的名单
2026 年 8 月 11 日在里昂和蒙彼利埃测的。没有一家公司出现在全部五种问法里 - 而其中一种问法下,AI 一个名字都不肯说。
你的客户并不都问同一个问题。有人问「里昂最好的水管工」。另一个人怕账单,问「便宜的水管工」。第三个人天花板在漏水,问「谁能马上来」。同一个行当、同一座城、同一天里的三位客户。他们得到的是同一个答案吗?
2026 年 8 月 11 日今天早上我们量了。只用一个助手 - 开了联网搜索的 Gemini,一座城,一个行当,只变一样东西:问题的问法。五种意图:最好的、便宜的、急的、评价最好的、活儿细的。然后在蒙彼利埃的牙科上重做一遍。
结果是逐个名字核对过的:没有任何一家公司出现在全部五种问法里。里昂没有,蒙彼利埃也没有。
谁被点名由问题决定 - 甚至有没有人被点名,也由它决定
最扎眼的不是名单不一样,而是在某些问法下,助手一个名字都不说。问「里昂有便宜的水管工吗」,它一个水管工都不提。它讲怎么判断价格 - 一定要报价单、别轻信传单、核对注册 - 然后把你推给平台。牙科这边一样:「便宜」问不出任何一家诊所,只问出了医保定价这个概念。
在价格这个问题上,没有一家公司赢 - 因为 AI 拒绝说出任何人的名字。
反过来,「急」生出的是一份完全另起炉灶的名单:在里昂,那些名字在别的任何问法里都没出现过,还带着电话号码。在蒙彼利埃,「急」把一些牙科中心带了出来,而「最好的牙医」那一问根本没提到它们 - 后者本身几乎没点名任何诊所,只列了挑选标准和一个名录网站。
能扛过好几个问题的,不是企业
一个细节改变了整场测量的读法。换了问法之后最常回来的名字,既不是水管工也不是牙医,而是平台。在里昂,Bilik 出现在五个意图中的四个,Blicko 出现在三个。在蒙彼利埃,Doctolib 出现在三个。真正的企业则到顶了:里昂水管工里排得最好的一家出现在三种问法里,蒙彼利埃没有一家诊所超过两种。
这和我们三份全国研究得出的教训是同一个,只是换了个角度看:能穿过所有问题的,是中间人。只要出现在助手不论怎么问都会引用的那个平台上,你就从后门进了这条回答 - 通常比等着被直接点名更靠得住。
为什么换个说法会差这么多
这不是模型的任性。今天的回答引擎不会照单处理你的问题:它把问题拆成好几个子问题并行发出去,再综合起来。按今年公开的分析,谷歌的 AI 模式对一个复杂问题会触发九到十一个,ChatGPT 是两到三个。改一个词 - 把「最好的」换成「便宜的」 - 整串子问题就变了,读的页面就变了,说出的名字也就变了。
有一处要老实交代,因为它差点让我们发出一个假数字。我们第一次自动统计得出:85% 到 94% 的公司只出现在一种意图里。把回答一条条重读之后,这个数字塌了:计数器把「Plombier 7」和「PLOMBIER 7」当成两家公司,还把建议里的片段(「必须出报价单」)当成了名字。剩下站得住的结论 - 没有公司出现在全部五种问法里、价格那一问没有任何人被点名 - 是手工核对过的。我们宁可发一个核对过的结果,也不发一个好看的结果。
明天早上做什么
- 别再只测一个问题。「Y 最好的 X」是最不具代表性的问法:恰恰是在这种问法下,助手最常用标准来回答,而不是给名字。
- 按意图去看你漏掉了什么。如果你做的是抢修,真正要紧的问题是「急」,不是「最好的」 - 而它有自己的一份赢家名单。
- 去待在那些能穿过所有问法的平台上:在我们里昂的测量里,某个点评名录五次里出现了四次。出现在那上面,就算没被点名,你也进了这条回答。
- 别指望赢下价格这个问题:在我们测的两座城市里,这一问没有点到任何一家从业者。把力气放在 AI 真的会报出公司名字的问法上。
两座城市、两个行当、十个问题:这是抽样,不是普查,而且助手的回答一天一个样 - 我们这周也量过,只有六分之一的名字能扛过四十八小时。但结构本身是清楚的:你的可见度不是一个数字,是一张地图。你可能在一个问题上排第一,在下一个问题上完全消失,而你这边什么都没变 - 变的只是客户把需求说出口的方式。