652개 출처를 측정했습니다 - AI 어시스턴트는 질문의 언어에 따라 다른 페이지를 읽습니다
어제는 추천되는 브랜드가 언어에 따라 달라진다는 것. 오늘은 그것을 고르기 위해 읽은 페이지. 인용된 652개 도메인의 90 %가 단 하나의 언어에만 나타납니다.
이 글의 목차
짧은 답: 어시스턴트가 답변을 위해 참조하는 출처는 언어가 바뀌면 거의 완전히 달라집니다. 10개 언어에서 인용된 652개 도메인 가운데 589개, 즉 90 %가 단 하나의 언어에만 등장했습니다. 8개 언어 이상에서 인용된 도메인은 652개 중 정확히 1개입니다.
이는 어제 측정의 직접적인 후속입니다. 어제는 추천 목록이 언어에 따라 바뀐다는 것을 보여주었고, 독자에게 그다음으로 유일하게 중요한 질문을 남겼습니다 - 그래서 구체적으로 무엇을 해야 하는가. 답은 출처에 있습니다. 검색하는 엔진은 기억으로 추천하지 않습니다. 페이지를 읽고 거기서 이름을 뽑아냅니다. 그것이 존재한다는 사실보다 어떤 페이지인지 아는 편이 훨씬 유용합니다.
추천된 브랜드는 영어와 43-74 % 겹칩니다. 그것을 고르기 위해 읽은 출처는 2-9 %. 비슷한 답변이 거의 겹치지 않는 독서에서 나옵니다.
정확히 무엇을 측정했는가
두 측정을 나란히 읽을 수 있도록 설계는 어제와 한 글자도 다르지 않습니다. 전 세계적인 5개 분야 - CRM 소프트웨어, 러닝화, 온라인 결제, 호텔 예약, 웹 호스팅 -, 10개 언어, 3개 어시스턴트, 그리고 질문에는 어떤 나라도 언급하지 않습니다. 움직이는 변수는 언어 하나뿐입니다. 달라지는 것이 있다면 언어에서만 올 수 있습니다.
새로운 것은 기록 대상입니다. 답변의 본문이 아니라 엔진이 참조했다고 밝힌 URL을 기록했습니다. 150개 답변, 2026-08-24 수집.
첫 번째 결과: 세 엔진은 같은 게임을 하고 있지 않다
| 어시스턴트 | 출처를 인용한 답변 | 답변당 도메인 수 |
|---|---|---|
| Perplexity | 50 / 50 | 16.7 |
| Gemini | 31 / 50, 다만 URL은 가려짐 | 제목만 |
| ChatGPT (API, 검색 없음) | 0 / 50 | 0 |
API로 호출한 ChatGPT는 검색하지 않습니다. 단 한 페이지도 열지 않고 기억으로 답합니다. 이 0은 측정 실패가 아니라 결과 그 자체이며, '어시스턴트'라는 한 단어 아래 매우 다른 두 가지 방식이 공존한다는 사실을 상기시킵니다. 오늘 공개한 것은 아무것도 읽지 않는 답변에는 영향을 줄 수 없습니다.
Gemini는 검색하지만 주소를 감춥니다. 링크가 모두 내부 리디렉션 도메인을 가리킵니다. 이를 그대로 세면 모든 언어에서 구글이 1위 출처로 보이게 됩니다 - 사실이 아니라 형식이 만든 허상입니다. 그래서 제외하고 유일하게 쓸 수 있는 항목인 제목(도메인 이름이 담겨 있음)을 사용했습니다. 이는 간접 측정이며, 그렇게 다룹니다.
두 번째 결과: 독서 목록은 거의 겹치지 않는다
Perplexity에서 각 언어와 영어의 출처 중복률 - 두 언어의 전체 도메인 중 공통 도메인의 비율:
| 언어 | 인용된 도메인 | 영어와의 중복 | 국가 도메인 비율 |
|---|---|---|---|
| 영어 | 72 | - | 1 % |
| 독일어 | 82 | 5 % | 68 % |
| 폴란드어 | 84 | 3 % | 58 % |
| 포르투갈어 | 83 | 9 % | 51 % |
| 일본어 | 78 | 2 % | 50 % |
| 프랑스어 | 84 | 8 % | 38 % |
| 한국어 | 62 | 5 % | 29 % |
| 스페인어 | 84 | 8 % | 26 % |
| 중국어 | 67 | 7 % | 15 % |
| 아랍어 | 79 | 7 % | 8 % |
Gemini를 별도의 경로로 독립 측정해도 같은 자릿수가 나옵니다. 영어와의 중복 5-17 %, 279개 도메인의 82 %가 단일 언어에만 등장. 두 엔진, 두 가지 추출 방식, 같은 결론 - 그래서 공개할 수 있습니다.
오른쪽 열은 잠시 멈춰 볼 만합니다. 영어가 예외이지 표준이 아닙니다. 국가 도메인 비율이 영어는 1 %인데 독일어는 68 %, 폴란드어는 58 %입니다. 영어로 묻는 것은 국가 없는 웹에 묻는 것이고, 독일어로 묻는 것은 독일 웹에 묻는 것입니다.
세 번째 결과: 두 엔진끼리도 같은 페이지를 읽지 않는다
같은 언어, 같은 질문, 같은 날인데도 Perplexity와 Gemini가 공유하는 출처는 9-18 %에 불과합니다. 즉 언어 간 격차는 특수한 사례가 아니라 일반 법칙입니다. 어시스턴트에서의 당신의 존재를 결정하는 '페이지 목록'은 하나가 아닙니다. 엔진마다, 언어마다 따로 있습니다.
그 출처들은 구체적으로 어떤 사이트인가
흔히 떠올리는 국제 비교 사이트가 아닙니다. 어제 브랜드 격차가 가장 컸던 웹 호스팅 분야를 보면:
| 언어 | 인용된 출처 |
|---|---|
| 영어 | pcmag.com, hostingstep.com, websiteplanet.com, techradar.com |
| 독일어 | fuer-gruender.de, heise.de, websitewissen.com, hostinger.com |
| 폴란드어 | jakwybrachosting.pl, rankinghostingow24.pl, rankinghost.pl, hostingi.net |
| 일본어 | lolipop.jp, value-domain.com, assirobo.com, crepas.co.jp |
| 한국어 | temkit.kr, ko.wix.com, webhosting.gabia.com |
| 아랍어 | mouqarin.com, adviserhost.com, afddal.com, hostingarabi.com |
네 가지 유형이 반복되며, 그중 어느 것도 세계적인 디렉터리가 아닙니다. 단일 시장을 위해 만들어진 국내 비교 사이트, 해당 국가의 기술 매체(독일 heise.de, 프랑스 clubic.com, 스페인 xataka.com), 현지 게시 플랫폼(한국의 blog.naver.com과 brunch.co.kr, namu.wiki, 중국의 cnblogs.com), 그리고 포럼 - reddit.com은 전체 측정에서 가장 많이 인용된 도메인으로 10개 언어 중 7개에 등장하며, Perplexity와 Gemini 양쪽 모두에서 나타납니다. 한국어에서는 brunch.co.kr, blog.naver.com, namu.wiki가 상위를 차지했습니다.
통념을 흔드는 사례 하나. 폴란드어에서는 어시스턴트가 정치 뉴스 사이트의 금융 섹션에 실린 CRM 비교 기사를 인용했습니다. 잡음이 아니라, 국내에서 큰 독자층을 지닌 사이트에 실린 진짜 순위 기사입니다. 당신의 존재를 결정하는 페이지가 반드시 당신 업계의 페이지인 것은 아닙니다.
실행 방향을 바꾸는 숫자
834건의 인용 가운데 답변에 이름이 오른 기업의 자사 사이트를 가리키는 것은 86건. 열 건 중 아홉 건은 당신의 사이트가 아닌 곳에서 당신을 이야기합니다.
자사 사이트에 글을 써서 추천받게 되지는 않습니다. 자사 도메인이 최대 자산인 기존 검색 최적화와의 근본적인 차이입니다. 여기서 당신의 사이트는 다른 페이지들이 이미 말하고 있는 것을 확인해 주는 역할이지, 그것을 만들어내는 역할이 아닙니다.
여러 언어로 판매한다면 무엇을 뜻하는가
영어로 수행한 진단은 다른 시장을 측정하지 않습니다.
영어권이 아니라면 자국 시장조차 측정하지 못합니다. 공통 출처가 2-9 %라는 것은 다른 자료 뭉치에 다른 질문을 한 것과 같습니다.
대형 영어권 사이트에 인용되어도 전이되지 않습니다.
미국 순위표의 한 자리는, 출처의 절반이 .jp인 일본어 답변에서는 거의 무게가 없습니다.
목표는 국내에 있고, 목록은 짧습니다.
한 분야, 한 언어에서 어시스턴트가 읽는 것은 수십 개 도메인입니다. 특정 가능하며, 상당수는 어떤 글로벌 인지도 전략으로도 닿지 않을 작은 사이트들입니다.
번역하기 전에 확인하십시오.
러닝화에서는 추천 브랜드가 10개 언어에서 동일했습니다. 이 분야의 가시성 캠페인을 번역했다면 존재하지 않는 문제에 예산을 쓴 셈입니다.
검색하지 않는 엔진은 당신을 결코 읽지 않습니다.
기억으로 답하는 어시스턴트 앞에서는, 학습 시점에 이미 당신에 대해 무엇이 쓰여 있었는지만이 변수입니다. 더 느린 게임이며, 지금 공개해도 만회되지 않습니다.
이 측정의 한계
단서 없는 숫자는 결과가 아니므로 밝힙니다. 단 하루, 5개 분야, 10개 언어 - 한 장의 스냅숏입니다. 어시스턴트는 결정론적이지 않아서, 어제 측정에서는 같은 영어 프롬프트를 두 번 실행해도 62-76 %만 겹쳤습니다. Gemini의 출처는 읽을 수 있는 URL이 없어 제목으로 측정했고, 아랍어에서는 하나도 얻지 못했습니다. 마지막으로 우리가 측정한 것은 '읽힌 것'이지 '설득한 것'이 아닙니다. 인용된 페이지가 반드시 어떤 이름을 목록에 올린 그 페이지는 아닙니다. 이 둘은 다른 질문이며, 두 번째에 답했다고 주장하지 않습니다.
우리는 누구에게도 ChatGPT 답변에서의 자리를 약속하지 않습니다 - 정직하게 그렇게 할 수 있는 곳은 없습니다. 측정할 수 있는 것은 언어별·엔진별로 지금 어디에 있는지, 그리고 어시스턴트가 거기에 이르기까지 무엇을 읽었는지입니다.