147개의 이름이 나타났고 28개가 남았다: AI 인용의 대부분은 자리가 아니라 스쳐 지나감이다
동일한 질문을 3회, 5개 업종, 2개 엔진에서 실행. 인용된 이름 3개 중 2개는 단 한 번만 나타난다. 인용의 가치도 엔진에 따라 다르다 - Perplexity에서는 2번에 1번, Gemini에서는 20번에 1번만 자리가 된다.
19 %
인용된 이름 중 3회 실행 모두에서 유지된 비율 - 147개 중 28개
짧은 답: AI에 인용되는 것과 그곳에 자리를 갖는 것은 별개이며, 그 차이는 측정할 수 있다. 같은 질문을 3번 연속으로, 5개 업종, 2개 언어, 2개 엔진에 던졌다. 최소 한 번 나타난 기업명은 147개. 3번 모두에 나타난 것은 28개뿐. 98개 - 3개 중 2개 - 는 정확히 한 번만 등장했다. 자리가 아니라 스쳐 지나감이다.
5개
정제 후 추천 목록 길이의 중앙값
2번에 1번 vs 20번에 1번
인용이 안정된 자리일 확률 - Perplexity 대 Gemini
3회 실행에서 나타난 147개의 이름 중 28개가 남았다. 한 번만 나타난 98개는 자리가 아니었다. 스쳐 지나감이었다.
무엇을 측정했나
8월 23일 이후 모든 측정에서 써 온 동일한 기준 질문 - 「최고의 X는 무엇인가」- 을 3번 연속, 완전히 동일하게, 5개 글로벌 업종에서 영어와 프랑스어로 Perplexity와 Gemini에 던졌다. 요청한 실행 60회, API 오류 9회, 사용 가능 51회. 수집은 8월 29일 저녁.
업종-언어-엔진 조합마다 세 가지를 센다. 합집합(한 번이라도 나타난 모든 이름), 핵(3회 모두에 나타난 이름), 꼬리(정확히 한 번 나타난 이름). 핵만이 쌓아 올릴 수 있는 유일한 목록이고, 꼬리는 어떤 최적화도 겨냥할 수 없는 우연이다.
원본 수치와 정제 수치를 모두 공개한다. 우리의 추출기는 아직 기업명이 아닌 조각을 통과시키고, 조각 하나마다 가짜 자리가 생긴다. 정제 후 답변의 중앙값은 5개(원본은 8개) - Perplexity 7개, Gemini 4개, 영어 5개, 프랑스어 4개.
한 엔진은 핵을 만들고, 다른 엔진은 거의 못 만든다
| 조합 | 나타난 이름 | 핵 | 핵 비율 |
|---|---|---|---|
| 호텔 예약(en) - Perplexity | 8 | 8 | 100 % |
| 결제(en) - Perplexity | 8 | 7 | 88 % |
| 결제(fr) - Perplexity | 9 | 4 | 44 % |
| CRM(en) - Perplexity | 9 | 3 | 33 % |
| 호텔 예약(en) - Gemini | 13 | 2 | 15 % |
| CRM(en) - Gemini | 13 | 1 | 8 % |
| 결제(en) - Gemini | 14 | 0 | 0 % |
| 웹 호스팅(en) - Gemini | 12 | 0 | 0 % |
같은 업종, 같은 언어, 같은 날. 호텔 예약에서 Perplexity는 8개짜리 같은 목록을 세 번 돌려줬다 - 핵 100 %. 결제에서 Gemini는 3회 동안 14개의 이름을 띄우고 하나도 유지하지 않았다.
두 엔진이 모두 답한 7개 조합에서 셈은 분명하다. Perplexity에서는 나타난 47개 중 23개가 3회 모두 유지 - 2개에 1개. Gemini에서는 65개 중 3개 - 20개에 1개. 「Gemini 인용」과 「Perplexity 인용」은 같은 화폐가 아니며, 이를 말없이 합산하는 점수는 금화와 칩을 섞는 셈이다.
중앙값 조합에는 핵이 아예 없다
이 측정에서 가장 냉정한 숫자는 평균이 아니다. 조합별 핵의 중앙값은 0이다. 업종-언어-엔진 조합을 무작위로 고르면, 가장 가능성 높은 경우는 거기서 3회를 버티는 이름이 하나도 없는 것이다. 그 사이 5개의 이름이 한 번 지나가고 사라진다. 화요일에 「AI의 추천을 받았다」는 사실은 수요일에 대해 거의 아무것도 말해 주지 않는다.
수집 실패 3건은 모두 Perplexity 쪽에 몰려 있다.
프랑스어 호텔 예약과 두 언어의 웹 호스팅에는 Perplexity 실행이 하나도 없다(API 속도 제한). 따라서 엔진 대결은 둘 다 답한 7개 조합에서만 읽을 수 있고, 「2번에 1번」과 「20번에 1번」도 거기서 나온 숫자다.
러닝화 업종의 실패는 우리 자신의 것이다.
우리의 노이즈 필터는 숫자가 든 표기를 걸러낸다 - 그런데 모델명이 「Pegasus 41」, 「Clifton 10」이다. 이 업종의 목록은 정제 후 거의 비어 버린다. 비운 것은 필터이지 엔진이 아니다. 조용히 빼는 대신 그대로 공개한다.
3회 실행, 하룻저녁, 2개 엔진: 표본이지 전수조사가 아니다.
핵과 꼬리를 가르는 데는 3회면 충분하지만, 이름의 회전 속도를 재는 데는 부족하다. 다음 밤이나 다음 주가 같은 비율을 보인다는 보장도 없다.
이걸로 무엇을 할 것인가
목록이 아니라 핵을 노려라.
3회 중 1번 나타난 이름은 「AI에 자리가 있는」 것이 아니다. 한 번의 실행을 지나갔을 뿐이다. 인용을 축하하기 전에, 그것이 돌아오는지 물어라.
항상 어느 엔진인지 물어라.
같은 문장 - 「귀사가 인용되고 있습니다」- 이 Perplexity에서는 50 % 안정된 위치를, Gemini에서는 5 %짜리 추첨을 뜻한다. 엔진을 밝히지 않는 보고서는 아무것도 알려주지 않는다.
동일 조건으로, 시간을 두고 다시 측정하라.
자리와 스쳐 지나감을 구별하는 방법은 그것뿐이다 - 단 한 번의 실행은 구조적으로 그것을 할 수 없다. 우리의 모니터링이 3일마다 같은 질문을 반복하는 이유가 바로 그것이다.