跳到正文
Waseit
← 全部文章
AEO测量

当你的名字没有大写字母:我们的工具在日本和韩国什么都没看见

2026 年 8 月 17 日在六个市场测的。在日语和韩语里,被提到的名字 100% 用当地文字书写 - 而我们的抽取器要求必须有一个拉丁大写字母。

2026年8月17日6 分钟读完
本文目录
  1. 我们查出来的关于自己的事
  2. 为什么这不只是代码的事
  3. 迪拜:同一座城里的两个市场
  4. 拿这个做什么
  5. 局限,以及一个还开着的口子

从昨天起,这个产品开始用日语、韩语、中文、阿拉伯语和西班牙语提问。今天早上,我们第一次测了这些市场。测量找到的第一个「对手」,是我们自己的工具。

做法还是这个系列的老规矩:六个市场(里昂、墨西哥城、东京、首尔、新加坡、迪拜),每个市场两个行当 - 这样差异就不能用「那个行当特殊」来解释 - 三个助手,每个问题问两遍,也就是 8 月 15 日那篇定下的噪声对照。一共七十二条回答。

我们查出来的关于自己的事

还没开始读回答,名字抽取在日语、韩语、中文和阿拉伯语上就返回了 - 而那些例子里名字一眼就能看见。原因就在我们分析器的一行:一个字符串要被当成公司名留下来,必须含有一个大写字母。

这是一条拉丁文字的规则。这四种文字根本没有大小写之分:日语、韩语、中文、阿拉伯语里压根不存在「大写字母」这回事。所以用这些文字写的公司名没有任何办法满足这个条件,全都被悄无声息地丢掉了。

一次日语检测,只看得见名字里带拉丁大写字母的那些对手。

我们当天上午就改了:一个来自无大小写文字的字符,现在顶替大写字母的作用;希伯来文和泰文也提前纳入;拉丁规则原封不动。锁住这处修改的测试是反着验过的 - 把旧规则放回去,四个测试立刻失败,每种文字一个。

为什么这不只是代码的事

把分析器修好之后,就「最好的面包店」这个问题,按市场和引擎得到的结果如下 - 被提到的名字里,用当地文字书写的占比:

东京:15/15、16/16、14/14。

三个助手报出来的全部是日文写的。

首尔:11/11、13/13、10/10。

一样,没有一个例外。

新加坡:3/10、8/16、13/15。

跟这座城市一样,是混合市场。

迪拜:0/10、12/16、9/16。

而头一个数字,是这一天最说明问题的。

在东京和首尔,我们的抽取器今天留下的东西,昨天全都看不见。不是「少算了」,是看不见。报告照样会正常显示出来 - 对手表格空着,分数就建在上面。

迪拜:同一座城里的两个市场

用阿拉伯语问迪拜最好的面包店,ChatGPT 报了十家。这十家里没有一家的名字是阿拉伯文:Ladurée、Paul、Baker & Spice、Le Pain Quotidien、Magnolia Bakery。同一个问题,Gemini 报的十六个里有十二个是阿拉伯文名字;Perplexity 十六个里有九个,其中包括 مخبز حبيب 和 مخبز الريف اللبناني。

一个只会读拉丁字母的工具,会把 ChatGPT 的名单整个看进去,把 Gemini 的名单看进去一部分,然后得出结论:迪拜的面包店就是 Ladurée。读取上的缺陷和市场上的事实,形状是一模一样的 - 不是用你的文字写的东西,就不会被算进去。

测量的其余部分印证了这个系列十天来的结论。ChatGPT 在韩语和法语里一家面包店都没报:它用反问来回答 - 「你喜欢哪种面包」「想找哪个区」。同一个问题,Gemini 在里昂报了十一家,在首尔也报了十一家。

拿这个做什么

问一下你的 AI 可见度工具,它读不读得懂你的文字。

在那天到来之前,这个问题听着很荒唐。我们的工具是由用拉丁字母写字的人做的,这一点在代码里显出来了。

非拉丁语言里的一个零,值得手工核一遍。

你自己去应用里用日语、韩语或阿拉伯语问一遍,再跟工具显示的对照。

在混合市场里,两种文字都要测。

在迪拜,阿拉伯文名单和拉丁文名单几乎不重合:那是两个场子,不是一个。

别只拿 ChatGPT 当尺子

- 在我们这六个市场里,它是报出公司名最少的引擎,有时候一个都不报。

局限,以及一个还开着的口子

六个市场、两个行当、一个上午、每个引擎一个模型:这是抽样,不是普查。我们没有核实每一家被提到的店是否真的存在 - 我们分类的是「被提到的东西」,不是去审这些店。

还有一个口子开着,不如就写在这里。那些把「建议」从「公司」里剔出去的过滤名单 - 「要一份书面报价」「核对执照」 - 是法语和英语的短语列表。它们覆盖不了新进来的这四种文字。所以上面这些计数,把真实的店铺和建议的碎片混在了一起。这不影响文字体系那一项的测量(日语的建议同样是用日语写的),但不允许把它们当成「公司数量」来读。下一件事就是这个,我们把它写出来,而不是藏起来。