
在10,105次推荐中,ChatGPT只提过一次保留意见
ChatGPT推荐商家10,105次,只提过一次保留意见:Kogi BBQ的长队。Gemini提了65次,大多关于价格和等待。
10,105段中1段
ChatGPT的推荐中,对商家附带保留意见的:Kogi BBQ的长队
简而言之:几乎从不。在四个国家,ChatGPT推荐具名商家的10,105段描述中,只有一次附带保留意见:洛杉矶的Kogi BBQ吸引了长队和忠实粉丝。Gemini在5,917段中提了65次,占1.1%。 而它的保留意见大多是受欢迎的代价:等待或排队(30次)、价格高(29次)。顾客投诉只出现两次,都针对伦敦同一家租赁中介。将近一半的情况下,保留意见在同一句话里附带理由:要等很久,但汉堡值得。
5,917段中65段
Gemini的推荐中附带保留意见的(1.1%):等待或排队30次,价格高29次
38段
称赞商家不推销多余服务:投诉变成了赞美
ChatGPT推荐时不说“但是”。
测量了什么
我们于2026年10月10日重读的四项研究:同样的购买者问题(“格拉斯哥的好牙医”“利兹最好的餐厅”),通过API、不开网页搜索,分别在美国(2026年9月13日)、英国(7月31日)、法国(7月30日)和巴西(8月6日)提给ChatGPT(gpt-4o-mini)和Gemini。3,600个回答被切成段落,保留了其中提到商家名称的16,022段。在每段中,我们寻找附在商家身上的保留意见:价格高("pricey"、"un peu plus cher"、"preços elevados")、等待或拥挤("expect a queue"、"réservez à l'avance")、投诉("mixed reviews"、"reclamações")、明确的缺点("Cons:"、"ponto negativo")。每个检测器都用必须捕捉和不得计入的说法测试过。阅读前我们剔除了一个假朋友:在巴西,"salgados"是面包店的咸味小吃,不是咸的价格。随后又撒了两张更宽的网,读完找到的全部256段。剔除190段:没有具名商家的一般建议、用了这个词的赞美、针对行业而非商家的保留意见,以及把等待短当作优点的描述。剩下66段。建议栏若点名商家则计入。
| 保留意见 | 段落 | 回答怎么说 |
|---|---|---|
| 等待或拥挤 | 30 | 芝加哥Au Cheval的长时间等待;提前数周预订(曼彻斯特的Mana、Dishoom) |
| 价格高 | 29 | 伦敦最贵的选择(Pimlico Plumbers) |
| 明确的缺点 | 5 | "Cons:",以及巴西的仅限聊天客服 |
| 顾客投诉 | 2 | 伦敦的Foxtons两次:常因强势的销售手法受到批评 |
| 至少一个 | 66 | 16,022段中 |
Gemini提醒你它很受欢迎,ChatGPT什么也不提醒
ChatGPT唯一的保留意见几乎算不上:Kogi BBQ吸引了长队和忠实粉丝。在其余10,104段中,它点名的商家都不带“但是”。 Gemini在1.1%的段落中附带保留意见,提醒的是受欢迎的代价:餐厅、面包店和沙龙的排队与预订,以及上门快的水管工或燃气工程师价格更高。它的65个保留意见中有30个在同一句话里附带理由(贵,但被视为质量标杆),另有6个列在优缺点清单里。真正的批评很少:伦敦的Foxtons两次,因为销售手法;巴西的QuintoAndar和Contabilizei,因为只用聊天服务。投诉多半以相反的形式出现:38段称赞修车厂、水管工或电工不推销不必要的工作,其中36段来自Gemini。按国家:英国25、美国19、巴西15、法国7。
| 引擎 | 段落 | 有保留意见 | 占比 |
|---|---|---|---|
| ChatGPT (gpt-4o-mini) | 10,105 | 1 | 0.01% |
| Gemini | 5,917 | 65 | 1.1% |
| 合计 | 16,022 | 66 | 0.4% |
谷歌认为有几条差评很正常
谷歌自己的指南描绘的是一幅不那么完美的图景。其Search Quality Rater Guidelines(2025年9月11日版,2026年10月10日查阅)第3.3.2节(顾客评价)告诉评估员:任何商店或商家都可能收到几条负面评价,这完全正常、在意料之中,而且评价的内容比数量或星级更重要。我们测量的回答几乎不包含这些。
对商家意味着什么
回答提醒的,是关于你的文字,而大多数是受欢迎的代价:排队、提前数周预订、价格更高。如果你是这样,就在助手之前说出来,并说明它换来了什么:Gemini在65个保留意见中有30个把理由放在保留意见旁边。公布即使要等也能进来的办法(预订链接、候位名单、免预约时段),如果价格高,写清它包含什么。这些都不能保证被点名,而不带“但是”的回答也不是评价:顾客仍然会读你的评价。
这项测量不能证明什么
- 这是模型通过API、不开网页搜索的回答。开启搜索的应用可能引用评价,这项测量看不到。
- 清单之外的说法会漏掉。我们撒了两张更宽的网并全部读过,所以合计是下限。对ChatGPT,这两张网没有找到其他保留意见。
- 建议栏若点名商家则计入。没有这条规则,Gemini的数字会更低;ChatGPT的不会变。
- 我们没有核实保留意见是否属实。
- 四项研究采集于2026年7月30日至9月13日,每个问题一次。
常见问题
ChatGPT会说它推荐的商家的坏话吗?
Gemini提醒什么?
这些数字从哪里来?
每日文章,邮件送达
每天最多一封邮件。一键退订。您的地址仅用于此。 隐私