
AI不说出你的评分,而是把门槛定在4.5
在3,600条AI回答中,只有1条给出了商家的评分。Gemini有67次给顾客设了门槛:多为4.5星,常见50条评价。
67
条:Gemini的1,800条回答中,给出评分或评价数门槛的回答
简短回答:在四个国家的3,600条ChatGPT和Gemini回答中,只有1条给出了所点名商家的星级评分。但Gemini在67条回答中给了顾客一个门槛:把地图筛到4.5星,只保留至少有50条评价的商家。 ChatGPT只这样做过1次。这个门槛集中在法国和巴西,也集中在AI不点任何名字的行业:电工、水管工、供暖工、锁匠。助手不给你打分。它告诉你的顾客该排除哪种评分。
1
条:ChatGPT的1,800条回答中,做了同样事情的回答
4.5
在给出门槛的70处中,有50处的星级数值
它不替顾客读你的评价,而是告诉顾客该跳过哪些。
测量了什么
我们在2026年9月30日重读了四项研究:同样的买家问题("贝洛奥里藏特最好的电工""里昂的好水管工"),通过API在不开启网络搜索的情况下提给ChatGPT(gpt-4o-mini)和Gemini,分别在美国(2026年9月13日采集)、英国(7月31日)、法国(7月30日)和巴西(8月6日)。共3,600条回答,每个引擎1,800条。我们在每条回答中查找用数字写出的星级("4.8星""4.5/5")或评价数量("50条以上评价"),并阅读了找到的每一处。检测规则事先用英语、法语和葡萄牙语的真实说法测试过,也包括不应计入的说法("查看评价""9点到5点营业")。随后对每一处进行分类:官方等级(四星级酒店、米其林星,29条回答,已剔除)、对点名商家的评分,或给顾客的建议。门槛是设定下限的建议:"4.5及以上""至少50条评价"。
| 回答 | 给出门槛 | 占比 | 任何带数字的规则 | "评价多胜过满分" | |
|---|---|---|---|---|---|
| Gemini, 美国 | 436 | 2 | 0.5% | 3 | 0 |
| Gemini, 英国 | 488 | 10 | 2.0% | 11 | 0 |
| Gemini, 法国 | 462 | 25 | 5.4% | 42 | 9 |
| Gemini, 巴西 | 414 | 30 | 7.2% | 52 | 11 |
| ChatGPT,四国合计 | 1,800 | 1 | 0.1% | 5 | 0 |
门槛是4.5星,常常还要50条评价
当回答给出最低评分时,70处中有50处是4.5星。更高的4.8出现12次,主要在法国和巴西;满分5.0出现4次,全部在巴西。评价数量方面,最常给出的数字是50,共21处;巴西的回答定得更低,为10条或20条,共10处。另外Gemini有20条回答(全部来自法国或巴西)说的是同一条规则:200条评价、4.5分的商家比3条评价、5.0分的商家更可靠。少量评价上的满分被当作警示信号,而不是优势。
| 最低星级 | 处数 |
|---|---|
| 4.5 | 50 |
| 4.8 | 12 |
| 5.0 | 4 |
| 4.0 / 4.2 / 4.7 | 4 |
在不点名的地方,它递上一个筛选器
门槛的分布并不均匀。电工、水管工、供暖工、锁匠和燃气工占了给出门槛的68条回答中的47条;仅巴西电工就有13条。这些正是助手最常拒绝点名商家、转而把顾客引向平台的行业(对水管工来说,答案是一个平台)。筛选器取代了名字:"打开Google地图,在你所在的街区搜索,只保留评分超过4.5且有几十条评价的商家"。在美国几乎看不到这种做法:872条中只有3条。
如果你是商家,这意味着什么
按这条建议行事的顾客,会先看到你的评分,再看到你的名字。4.4星,或者12条评价、4.9分,无论回答怎么评价你,你都会被排除在顾客自己的名单之外。测量得出三点。评价数量和平均分一样重要:回答明确更看重200条评价的4.5分,而不是几条评价的5.0分,所以请每位满意的顾客留下评价,比守住满分更有价值。门槛是4.5,有用的问题是你离它还差多少,而不是你是否"评价不错"。还有一些回答让顾客去读最近的评价和一星评价,看商家有没有回复:没有回复的投诉,读到它的恰恰是AI送来的顾客。这些都不会让你被点名,只会让你在回答之后不被筛掉。
这项测量不能证明什么
- 这些是模型通过API、不开网络搜索时的回答,也是我们审计的提问方式。开启搜索后,应用可能显示带有真实评分的地图卡片,本测量看不到这些。
- 四项研究于2026年7月30日至9月13日之间采集,每个问题运行一次。模型此后已有变化,这里没有测量这种漂移。
- 给出门槛的68条回答是一个小样本:占Gemini回答的3.7%,每个行业和城市只有几条。按国家和引擎看,规律清楚;单个行业的数字则不然。
- 门槛、建议和等级的区分先按规则进行,再逐处阅读。处于边界的说法仍可能落在规则的另一侧;两次统计之间各国的数字变动了几条,排序没有变。
- 这里没有显示有多少顾客真的使用了这个筛选器。测量说的是助手建议怎么做,而不是顾客实际怎么做。
常见问题
ChatGPT或Gemini会把我的评分告诉顾客吗?
需要多高的评分,AI才会推荐我的商家?
这些数字从哪里来?
每日文章,邮件送达
每天最多一封邮件。一键退订。您的地址仅用于此。 隐私