跳到正文
Waseit
← 全部文章
AEOGEO

律师、水管工、牙医:ChatGPT 十次里有九次不点任何人的名

3780 条真实回答,18 个行业,三个国家。ChatGPT 在 43 % 的回答里拒绝说出企业名字 - 律师 92 %,水管工 91 %,面包店 0 %。Gemini 是 1 %,Perplexity 是 0 %。

2026年8月22日9 分钟读完
本文目录
  1. 拒绝的引擎只有一个,另外两个从不拒绝
  2. 而且分界线并不跟着监管走
  3. 它转而做了什么
  4. 广告这扇门也没有开
  5. 测量的陷阱 - 而且它也是我们的
  6. 周一早上可以做什么
  7. 局限,以及我们中途改掉的一个错误

8 月 10 日,OpenAI 更新了广告规则。变更记录里有一行注明四月,值得停下来看:「医疗、法律和金融建议类语境不再默认屏蔽广告」。换句话说,一段有人在找牙医的对话,现在可以承载广告了。

这就提出了一个对诊所、事务所或修理厂毫不抽象的问题:在同一段对话里,当没有人付钱时,助手会怎么回答?

回答所需的数据我们已经有了,而且不需要任何新的调用。我们的三项全国研究 - 法国 8 月 5 日、英国 7 月 31 日、巴西 8 月 6 日 - 合计 4092 条真实回答。只保留三个国家都存在的行业,就得到跨 18 个行业的 3780 条配对回答,39 座城市,3 个助手。变的只有行业,其余都配好了。这正是需要的实验设计。

拒绝的引擎只有一个,另外两个从不拒绝

我们在每条回答里寻找明确的拒绝:「I can't provide specific recommendations」「je ne peux pas fournir」「não posso recomendar」。每个引擎 1260 条回答中:

ChatGPT:43 % 明确拒绝。

Gemini:1 %。

Perplexity:0 %。

这不是语气上的差别。这是一个引擎在将近每两条回答里就有一条告诉客户它不会点任何人的名 - 而另外两个在点名。

而且分界线并不跟着监管走

我们本来是去找受监管职业与自由行业之间那条线的。它不存在。下面是 ChatGPT 的拒绝率,逐行业列出,每个行业 78 条回答:

  • 律师 92 %,会计师 92 %,电工 92 %,水管工 91 %,牙医 88 %。
  • 保险经纪 63 %,开锁 45 %。
  • 婚礼摄影 31 %,汽修 28 %,房产中介 23 %,驾校 19 %,营销代理 14 %,理发 10 %,美容 8 %,招聘公司 3 %。
  • 面包店 0 %,餐厅 0 %,酒店 0 %。

水管工在 91 %,紧挨着律师下面。驾校这种再受监管不过的行当,只有 19 %。分界线不是文凭:而是选错了你要付出什么。漏水、危险的电路、输掉的官司、报错的税、一颗牙。另一边是:一个普通的可颂。

选择越重,助手越不替你做。它点面包店的名毫不犹豫,却拒绝点水管工的名。

差距也横在国家之间,而且很宽:ChatGPT 拒绝的比例在法国是 31 %,巴西 46 %,英国 53 %。同一个产品,同一周,三条门槛。

它转而做了什么

拒绝不是沉默。在 ChatGPT 的 543 次拒绝中,60 % 提到一个名录或一个行业协会 - 黄页、律师协会、Doctolib、Checkatrade - 20 % 罗列挑选标准:核对专业方向、要一份报价、读读评价。

翻译给一家事务所听就是:在本该给你带来一位客户的问题上,助手的回答是把这位客户送去名录。赢下这段对话的是名录,而你在里面连名字都没出现。

广告这扇门也没有开

也许你会以为广告提供了出路。OpenAI 在 2026 年 8 月 10 日更新的文本,对本文的大多数读者来说说的恰恰相反。得逐字读。

法律服务

:「面向个人或企业提供法律咨询、代理或法律服务的广告不被允许。」能通过的只有一般性的法律教育。

健康服务

在美国境内对列明的类别逐案许可,其中包括牙科服务 - 「美国境外的健康服务广告通常被禁止」。

金融服务

:同样的结构,同样的一句话 - 美国境外通常被禁止。

把两项测量并排放。一位法国牙医:在免费回答里 85 % 被拒绝,又因为不是美国主体而没有投放广告的资格。一位巴西牙医:96 % 拒绝,同一扇关着的门。律师不论身在何处,十次里有九次被拒绝,而法律服务广告在任何地方都不被允许。

我们把话说实在,因为这才让结论成为有用的东西而不是指控:对于执业需要牌照的专业人士,拒绝指定某一位,是一个站得住的立场。OpenAI 的使用政策自 2025 年 10 月起就框定了需要资质的个性化建议。我们不揣测任何动机。我们记录的是一个状态 - 对这些行业,尤其在美国之外,通道两侧同时关闭。

测量的陷阱 - 而且它也是我们的

接下来这部分,应该让每一个购买 AI 可见度工具的人担心,包括我们的工具。

我们把那 543 次拒绝送进了自己的竞争对手抽取器。它从中抽出了 3099 个「竞争对手」,平均每条回答 5.7 个。没有任何一次拒绝返回零。

它留下的是什么名字?「Consultation initiale」15 次,「Certificações e Licenças」13 次,「Especializações」12 次,「Devis」12 次,「Qualifications et certifications」11 次。这些都是助手用来代替名字的那些建议的小标题。建立在这之上的报告,会告诉一位新加坡律师他有五个竞争对手,其中一个叫「初次咨询」。

当助手用建议而不是名字作答时,天真的测量就把建议数成了竞争对手。包括我们的 - 昨天我们公布了这个洞。

而在保险经纪这一行,少数熬过筛选的真名字又说了另一件事:Aon 14 次,Towergate 12 次,Hiscox 10 次,Marsh 10 次。全国性和全球性的经纪公司。街角那家代理从未出现 - 即便助手愿意点名,点的也是大的。

周一早上可以做什么

如果你的行业有后果,别再只用 ChatGPT 衡量你的可见度。

那里的零不代表你不可见:往往代表你这一行没有任何人被点名。去试 Gemini 和 Perplexity,它们会点名。

去它把人送去的地方。

十次拒绝里有六次提到名录或行业协会。你在协会名录、预约平台、行业名录上的条目 - 接住那位助手没送给你的客户的,正是它。

要求你的工具把原文给你看。

如果一份报告把「初次咨询」当成竞争对手摆给你,它数的是建议。要求读每个名字背后的原始回答 - 这是唯一造不了假的检查。

别为这些行业里「保证你在 ChatGPT 有位置」的承诺付钱。

在 92 % 的拒绝率下,卖的不是位置,是对位置的指望。

局限,以及我们中途改掉的一个错误

拒绝的识别是一份措辞清单,因而可能出错。我们用随机抽样双向核对过:标为拒绝的八条,八条都是。未标记的八条里,有两条是漏掉的拒绝 - 巴西葡萄牙语在「embora」之后用虚拟式(「embora eu não possa fornecer」),而我们的模式只找了直陈式。改正后用新的抽样复核:十条里十条正确。我们最初拿到的数字,受监管职业 62 %,因此是一个下限;正确的是 75 %。

其余照旧:这些回答来自 2026 年 7 月底和 8 月初,每个引擎一个模型,而回答会一天一变,我们在别处已经展示过。3780 条不是普查。但 92 % 与 0 % 之间的距离,不是噪音能填上的。