La même question posée autrement ne donne pas les mêmes entreprises : 31 % de recouvrement
« Les meilleurs X » et « lequel pour mon entreprise de 10 personnes » ne se recouvrent qu'à 31 %, contre 77 % quand on repose deux fois la même question.
Dans cet article
Réponse courte : changer le contexte d'achat dans la question change les entreprises recommandées, et bien plus fortement que le hasard de l'assistant. Reposez deux fois exactement la même question : les listes se recouvrent à 77 %. Demandez « lequel pour mon entreprise de dix personnes » plutôt que « quels sont les meilleurs » : 31 %.
L'écart est de 46 points sous le plancher de bruit. Autrement dit : la façon dont votre acheteur formule sa demande pèse plus lourd sur votre présence que tout ce que l'assistant fait varier tout seul d'un tirage à l'autre.
Un audit de visibilité qui n'interroge qu'une seule formulation ne mesure pas votre marché. Il en mesure un quart.
Pourquoi cette question, maintenant
Nous avons montré que la langue change la liste recommandée, que les sources lues changent avec elle, et que ces sources portent réellement la recommandation. Restait la variable dont l'entreprise se doute le moins, parce qu'elle ne la contrôle pas du tout : la manière dont son client formule sa demande.
Personne ne tape uniquement « meilleur CRM ». Un acheteur dit aussi « je dirige une petite structure », « lequel a le meilleur rapport qualité-prix », « je débute, lequel est le plus simple ». Ce sont quatre moments d'achat, pas quatre façons de dire la même chose.
Ce que nous avons mesuré, exactement
Cinq secteurs mondiaux, deux langues (anglais, français), deux assistants qui cherchent - Perplexity et Gemini. 120 tirages, aucun échec. La question de référence est reprise mot pour mot de nos mesures précédentes, ce qui permet de lire celle-ci avec les autres.
| Intention | Formulation |
|---|---|
| Référence | « Quels sont les meilleurs X ? » |
| Petite entreprise | « Je dirige une entreprise de 10 personnes. Quels X me recommandez-vous ? » |
| Prix | « Quels X offrent le meilleur rapport qualité-prix ? » |
| Débutant | « Je débute complètement. Quels X sont les plus simples à prendre en main ? » |
Le plancher de bruit, sans lequel l'article n'existerait pas
Un assistant n'est pas déterministe : reposez-lui la même question et il ne redonne pas la même liste. Comparer deux formulations sans savoir combien il se contredit tout seul reviendrait à publier du hasard et à l'appeler un résultat.
Nous avons donc tiré la question de référence trois fois par combinaison, ce qui donne 46 paires « même question, deux réponses ». Leur recouvrement moyen - 77 % - est le plancher. Tout écart entre intentions se lit contre lui, jamais dans l'absolu.
Le résultat
| Question posée | Recouvrement | Écart au bruit |
|---|---|---|
| La même, reposée (plancher) | 77 % | - |
| Meilleur rapport qualité-prix | 53 % | 24 points en dessous |
| Je débute | 40 % | 37 points en dessous |
| Entreprise de 10 personnes | 31 % | 46 points en dessous |
Les deux moteurs vont dans le même sens, séparément - c'est ce qui autorise à publier. Perplexity passe de 84 % de plancher à 39 % sur la question « petite entreprise » ; Gemini, de 68 % à 23 %. Les valeurs diffèrent, la direction et l'ampleur non.
Le cas qui rend la chose concrète
Sur la réservation d'hôtel, l'assistant se répète très bien : 86 % de recouvrement entre deux tirages de la même question. Ajoutez « je dirige une entreprise de dix personnes » et le recouvrement tombe à 0 %. Pas 30, pas 15 : zéro. Aucune entreprise en commun.
En regardant les noms, on comprend : la question de référence donne les plateformes grand public que tout le monde connaît. La question « entreprise de dix personnes » fait apparaître TravelPerk, Engine, Booking.com for Business - des acteurs du voyage d'affaires, absents de la première liste. Ce n'est pas un classement qui bouge, c'est un autre marché qui répond.
Ce n'est pas votre position qui change avec la question. C'est la liste des candidats.
Le même phénomène ailleurs : sur l'hébergement web en anglais, Namecheap et Wix n'apparaissent que sur les questions « petite entreprise », « prix » et « débutant ». Sur le CRM en français, HubSpot est absent de la liste de référence mais présent dès qu'on précise « petite entreprise » ou « je débute ».
L'hypothèse rivale, testée et écartée
Un résultat aussi net appelle une objection sérieuse, et nous nous la sommes faite : notre extracteur de noms laisse passer des fragments de conseil (« vérifiez les intégrations », « budget minimal »). Or une question sur le prix produit un vocabulaire de conseil différent d'une question pour débutant. Ce bruit pouvait fabriquer l'écart à lui tout seul.
Nous avons donc refait le calcul à quatre niveaux de nettoyage, du brut au plus sévère - en ne gardant que les noms qui reviennent dans plusieurs réponses, un vrai nom d'entreprise se répétant là où une tournure de conseil est unique. Le plancher de bruit monte, comme attendu, de 62 % à 79 %. L'écart, lui, reste compris entre 29 et 36 points dans les quatre cas. L'objection ne tient pas ; nous publions le calcul le plus sévère, pas le plus flatteur.
Ce qu'il faut en faire
Listez les questions de vos clients, pas votre catégorie.
« Meilleur logiciel de facturation » est une question de journaliste. Vos acheteurs disent « pour une association », « sans comptable », « pour facturer à l'étranger ». Ce sont ces phrases qu'il faut mesurer.
Un bon score sur une formulation ne se transpose pas.
46 points d'écart, cela veut dire qu'être recommandé sur la question générique ne prédit presque rien sur la question de votre segment réel.
Le contexte d'achat est un levier, pas seulement un risque.
Si vous êtes absent de la liste générique mais que votre segment a sa propre question, c'est là qu'il faut exister - et c'est une compétition beaucoup moins encombrée.
Faites dire à vos pages pour QUI vous êtes.
Les sources qui font entrer un nom sur la question « entreprise de dix personnes » sont celles qui parlent explicitement de ce cas. Une page qui ne dit pas à qui elle s'adresse ne peut pas être choisie pour un profil.
Les limites
Un secteur retiré de la mesure : les chaussures de running.
Les réponses y citent des modèles numérotés (« Ghost 16 », « Clifton 9 ») que notre extracteur écarte. Le secteur ressortait donc à 0 % partout - un artefact de notre filtre, pas un résultat. Le publier aurait été malhonnête.
Deux langues et deux moteurs.
Anglais et français ; Perplexity et Gemini. ChatGPT par l'API est exclu : nous avons mesuré qu'il ne cherche pas du tout, donc l'intention n'y joue pas le même rôle.
Un seul jour.
Ces mesures sont datées et les assistants bougent. C'est précisément pourquoi le plancher de bruit accompagne chaque chiffre.
Notre extracteur reste imparfait
, y compris après nettoyage : quelques tournures (« support technique », « PME françaises ») subsistent dans les ensembles. Un correctif est en cours. Nous le disons parce qu'un chiffre dont on cache le nettoyage n'est pas un chiffre.
Nous ne promettons à personne une place dans les réponses de ChatGPT - personne ne peut le faire honnêtement. Ce qui se mesure, c'est où vous en êtes, par langue, par moteur, et désormais par question posée.