Formulieren Sie die Frage um, und die Liste ändert sich
Zwei alltägliche Formulierungen derselben Frage an dieselbe KI, über 15 Branchen und 13 US-Städte. Nur 11 % der Namen bleiben gleich, und in 47 % der Fälle kommt kein einziger Name zweimal vor. Auf Marktebene bleiben jedoch 7 der 10 meistgenannten Unternehmen dieselben.
11 %
gemeinsame Namen bei zwei Formulierungen, gleiche KI
In diesem Artikel
Kurze Antwort: „Wer sind die besten Klempner in Chicago?" und „Liste die meistempfohlenen Klempner in Chicago auf und erkläre, warum" liefern nicht dieselbe Liste. Dieselbe KI, dieselbe Stadt, dieselbe Branche, zwei gewöhnliche Formulierungen: 11 % der Namen sind gemeinsam, und in 47 % der Vergleiche kommt kein Name zweimal vor. Das zuerst genannte Unternehmen stimmt in 18 % der Fälle überein.
47 %
der Vergleiche haben keinen einzigen Namen gemeinsam
7 von 10
meistgenannten Unternehmen überstehen die Umformulierung
Ein Audit mit einer einzigen Frage misst eine Formulierung, nicht Ihre Sichtbarkeit. Was die Umformulierung übersteht, ist kein Ranking, sondern wiederholte Präsenz.
Was wir gemessen haben
Die Daten stammen aus der Waseit-US-Studie vom 13. September 2026. Jede Zelle (eine Branche, eine Stadt) erhielt zwei Fragen, gestellt an ChatGPT und an Gemini. Die erste: „What are the best [Branche] in [Stadt]? Give me a list with your recommendations." Die zweite: „List the most recommended [Branche] in [Stadt] and explain why." Zwei gewöhnliche Arten, dasselbe zu fragen.
Wir behalten hier die 15 Branchen in den 13 Städten (Hotels, Restaurants und Bäckereien bleiben außen vor: ihr Name enthält oft den der Stadt). Das sind 780 Antworten, 195 je KI und je Formulierung. Für jede Zelle und jede KI vergleichen wir die Unternehmensliste der ersten Frage mit der der zweiten: 305 auswertbare Vergleiche, jene, in denen beide Formulierungen mindestens ein Unternehmen genannt haben.
Die Messung ist einfach: Welcher Anteil aller von beiden Formulierungen genannten Namen wird von beiden genannt? Verzeichnisse werden getrennt gezählt, und in die Listen gerutschte Ratgeber-Überschriften werden entfernt.
Die Formulierung verschiebt fast die ganze Liste
In den 305 Vergleichen nennen die beiden Formulierungen zusammen 3 108 verschiedene Unternehmensnamen. Nur 370, also 12 %, erscheinen in beiden. Im Mittel je Vergleich beträgt die Überschneidung 11 %. Und 143 der 305 Vergleiche teilen keinen einzigen Namen.
Das könnte ein Längeneffekt sein: Die zweite Frage verlangt eine Begründung, also verbraucht die KI Text fürs Erklären statt fürs Nennen. Wir haben die Messung wiederholt und nur die ersten drei Namen jeder Antwort behalten, vor jedem Abschneiden: Die Überschneidung liegt weiterhin bei 13 %, und 61 % der Vergleiche teilen in ihren Top drei keinen Namen. Das ist keine Kürzung, das sind andere Unternehmen.
Die KI wiegt schwerer als die Formulierung
Zum Vergleich haben wir dasselbe zwischen den beiden KI bei identischer Formulierung gemessen: Die Überschneidung fällt auf 2 %. Die KI zu wechseln verändert die Antwort noch stärker als sie umzuformulieren. Die Größenordnung ist jedoch dieselbe: In beiden Fällen bewegt sich der Großteil der Liste.
| Branche | Zwei Formulierungen, gleiche KI | Vergleiche ohne gemeinsamen Namen | Zwei KI, gleiche Formulierung |
|---|---|---|---|
| Personaldienstleister | 32 % | 6 von 24 | 9 % |
| Versicherungsmakler | 17 % | 7 von 25 | 3 % |
| Fahrschule | 17 % | 8 von 21 | 2 % |
| Friseursalon | 14 % | 2 von 17 | 2 % |
| Rechtsanwalt | 13 % | 6 von 15 | 0 % |
| Klempner | 12 % | 8 von 22 | 0 % |
| Marketingagentur | 11 % | 11 von 25 | 3 % |
| Kfz-Werkstatt | 11 % | 7 von 25 | 0 % |
| Steuerberater | 7 % | 15 von 24 | 3 % |
| Hochzeitsfotograf | 7 % | 13 von 25 | 0 % |
| Schlüsseldienst | 6 % | 12 von 19 | 0 % |
| Heizungs- und Klimatechnik | 4 % | 15 von 19 | 0 % |
| Immobilienmakler | 3 % | 12 von 16 | 1 % |
| Zahnarzt | 3 % | 10 von 12 | 1 % |
| Elektriker | 3 % | 11 von 16 | 2 % |
Die Personaldienstleistung ist die stabilste Branche: Ein Drittel der Namen übersteht die Umformulierung, und sie ist zugleich die einzige, in der sich die beiden KI überhaupt annähern (9 %). Am anderen Ende, bei Zahnärzten, Elektrikern, Immobilienmaklern und der Klimatechnik, liefert eine anders gestellte Frage praktisch eine andere Liste.
Was bleibt, sind die Namen, die oft wiederkehren
Die Schlussfolgerung wäre entmutigend, wenn sie hier endete. Sie endet nicht hier. Auf der Ebene des gesamten Marktes verschiebt die Umformulierung fast nichts: Von den 10 meistgenannten Unternehmen über alle Städte und Branchen hinweg sind 7 dieselben bei beiden Fragen. Robert Half, Aerotek, Kforce, Insight Global, Randstad USA, HUB International und A1 Driving School stehen in beiden Ranglisten.
Ein weiteres Zeichen der Stabilität: Der Anteil der Nennungen, die auf einen in mindestens drei Städten präsenten Namen entfallen, beträgt bei beiden Formulierungen 20 %. Die Frage ändert, wer in einer einzelnen Antwort auftaucht, nicht, wer oft auftaucht.
Eine einzelne Antwort ist eine Ziehung.
Sie hängt von der Formulierung, der KI und der Zelle ab.
Wiederholte Präsenz ist ein Signal.
Ein Name, der über mehrere Formulierungen und Städte wiederkehrt, verdankt nichts dem Zufall der Frage.
Ein Ranking gibt es nicht.
Es gibt nicht „die" KI-Antwort für Ihre Branche in Ihrer Stadt, es gibt eine Verteilung.
Die beiden Fragen lassen die KI nicht gleich sprechen
Die Frage nach der Begründung verkürzt die Listen. ChatGPT fällt von 7,2 auf 5,0 genannte Unternehmen je Antwort, Gemini von 4,1 auf 3,1. Der Anteil der Antworten, die mindestens ein Unternehmen nennen, bewegt sich kaum: 94 % und dann 90 % bei ChatGPT, 82 % und dann 84 % bei Gemini.
Bei Gemini erzeugt die zweite Frage oft eine Liste von Kriterien statt einer Liste von Unternehmen: Überschriften wie „independent brokers" oder „comprehensive service" erscheinen dort, wo die erste Frage Namen lieferte. Unsere Bereinigung entfernt den Großteil davon, nicht alles.
Was diese Messung nicht beweist
Zwei Formulierungen sind nicht alle Formulierungen.
Es sind die zwei, die wir stellen, keine Stichprobe dessen, was Ihre Kunden tippen. Der tatsächliche Abstand kann größer oder kleiner sein.
Die Antwortlänge wiegt bei einem Teil der Zahlen.
Wir begrenzen die Ausgabe auf 600 Token bei ChatGPT und 1 400 bei Gemini: 48 von 195 ChatGPT-Antworten und 54 von 195 Gemini-Antworten enden bei der zweiten Frage mitten im Satz. Die Namenszahlen je Antwort sind daher Untergrenzen. Die Überschneidung hält jedoch auch bei den ersten drei Namen.
Was Nutzer der App sehen.
Diese Antworten stammen aus den APIs; die App kann Websuche und andere Einstellungen hinzufügen.
Eine einzige Erhebung.
Ein Tag, der 13. September 2026. Wir messen hier weder die Schwankung von Tag zu Tag noch die zwischen zwei Durchläufen derselben Frage.
Eine perfekte Bereinigung.
Ratgeber-Überschriften werden per Regel entfernt; was durchrutscht, bläht die Zahl verschiedener Namen leicht auf, bei beiden Formulierungen.
Was das für Sie ändert
Beurteilen Sie Ihre Sichtbarkeit nicht anhand einer Frage.
Stellen Sie mehrere, in den Worten Ihrer Kunden, und sehen Sie, was wiederkehrt.
Feiern Sie kein einzelnes Auftauchen und erschrecken Sie nicht über ein einzelnes Fehlen.
Beides ist Rauschen.
In den instabilen Branchen
(Zahnarzt, Elektriker, Immobilien, Klimatechnik) zählen Sie die Auftritte über mehrere Formulierungen, bevor Sie irgendetwas schließen.
In den stabilen Branchen
(Personal, Versicherung, Fahrschule) ist ein wiederholtes Fehlen eine echte Diagnose.
Unser kostenloses Audit stellt ChatGPT und Gemini mehrere Fragen und zählt Auftritte statt eines Rangs. Nur so erhält man eine Zahl, die nicht davon abhängt, wie die Frage getippt wurde.