Aller au contenu
Waseit
← Tous les articles
AEOGEO

La même question posée autrement ne donne pas les mêmes entreprises : 31 % de recouvrement

« Les meilleurs X » et « lequel pour mon entreprise de 10 personnes » ne se recouvrent qu'à 31 %, contre 77 % quand on repose deux fois la même question.

26 août 202610 min de lecture
Dans cet article
  1. Pourquoi cette question, maintenant
  2. Ce que nous avons mesuré, exactement
  3. Le plancher de bruit, sans lequel l'article n'existerait pas
  4. Le résultat
  5. Le cas qui rend la chose concrète
  6. L'hypothèse rivale, testée et écartée
  7. Ce qu'il faut en faire
  8. Les limites

Réponse courte : changer le contexte d'achat dans la question change les entreprises recommandées, et bien plus fortement que le hasard de l'assistant. Reposez deux fois exactement la même question : les listes se recouvrent à 77 %. Demandez « lequel pour mon entreprise de dix personnes » plutôt que « quels sont les meilleurs » : 31 %.

L'écart est de 46 points sous le plancher de bruit. Autrement dit : la façon dont votre acheteur formule sa demande pèse plus lourd sur votre présence que tout ce que l'assistant fait varier tout seul d'un tirage à l'autre.

Un audit de visibilité qui n'interroge qu'une seule formulation ne mesure pas votre marché. Il en mesure un quart.

Pourquoi cette question, maintenant

Nous avons montré que la langue change la liste recommandée, que les sources lues changent avec elle, et que ces sources portent réellement la recommandation. Restait la variable dont l'entreprise se doute le moins, parce qu'elle ne la contrôle pas du tout : la manière dont son client formule sa demande.

Personne ne tape uniquement « meilleur CRM ». Un acheteur dit aussi « je dirige une petite structure », « lequel a le meilleur rapport qualité-prix », « je débute, lequel est le plus simple ». Ce sont quatre moments d'achat, pas quatre façons de dire la même chose.

Ce que nous avons mesuré, exactement

Cinq secteurs mondiaux, deux langues (anglais, français), deux assistants qui cherchent - Perplexity et Gemini. 120 tirages, aucun échec. La question de référence est reprise mot pour mot de nos mesures précédentes, ce qui permet de lire celle-ci avec les autres.

Quatre moments d'achat, pas quatre paraphrases.
IntentionFormulation
Référence« Quels sont les meilleurs X ? »
Petite entreprise« Je dirige une entreprise de 10 personnes. Quels X me recommandez-vous ? »
Prix« Quels X offrent le meilleur rapport qualité-prix ? »
Débutant« Je débute complètement. Quels X sont les plus simples à prendre en main ? »

Le plancher de bruit, sans lequel l'article n'existerait pas

Un assistant n'est pas déterministe : reposez-lui la même question et il ne redonne pas la même liste. Comparer deux formulations sans savoir combien il se contredit tout seul reviendrait à publier du hasard et à l'appeler un résultat.

Nous avons donc tiré la question de référence trois fois par combinaison, ce qui donne 46 paires « même question, deux réponses ». Leur recouvrement moyen - 77 % - est le plancher. Tout écart entre intentions se lit contre lui, jamais dans l'absolu.

Le résultat

Recouvrement des listes recommandées avec la question de référence. Perplexity et Gemini, en et fr, 2026-08-26.
Question poséeRecouvrementÉcart au bruit
La même, reposée (plancher)77 %-
Meilleur rapport qualité-prix53 %24 points en dessous
Je débute40 %37 points en dessous
Entreprise de 10 personnes31 %46 points en dessous

Les deux moteurs vont dans le même sens, séparément - c'est ce qui autorise à publier. Perplexity passe de 84 % de plancher à 39 % sur la question « petite entreprise » ; Gemini, de 68 % à 23 %. Les valeurs diffèrent, la direction et l'ampleur non.

Le cas qui rend la chose concrète

Sur la réservation d'hôtel, l'assistant se répète très bien : 86 % de recouvrement entre deux tirages de la même question. Ajoutez « je dirige une entreprise de dix personnes » et le recouvrement tombe à 0 %. Pas 30, pas 15 : zéro. Aucune entreprise en commun.

En regardant les noms, on comprend : la question de référence donne les plateformes grand public que tout le monde connaît. La question « entreprise de dix personnes » fait apparaître TravelPerk, Engine, Booking.com for Business - des acteurs du voyage d'affaires, absents de la première liste. Ce n'est pas un classement qui bouge, c'est un autre marché qui répond.

Ce n'est pas votre position qui change avec la question. C'est la liste des candidats.

Le même phénomène ailleurs : sur l'hébergement web en anglais, Namecheap et Wix n'apparaissent que sur les questions « petite entreprise », « prix » et « débutant ». Sur le CRM en français, HubSpot est absent de la liste de référence mais présent dès qu'on précise « petite entreprise » ou « je débute ».

L'hypothèse rivale, testée et écartée

Un résultat aussi net appelle une objection sérieuse, et nous nous la sommes faite : notre extracteur de noms laisse passer des fragments de conseil (« vérifiez les intégrations », « budget minimal »). Or une question sur le prix produit un vocabulaire de conseil différent d'une question pour débutant. Ce bruit pouvait fabriquer l'écart à lui tout seul.

Nous avons donc refait le calcul à quatre niveaux de nettoyage, du brut au plus sévère - en ne gardant que les noms qui reviennent dans plusieurs réponses, un vrai nom d'entreprise se répétant là où une tournure de conseil est unique. Le plancher de bruit monte, comme attendu, de 62 % à 79 %. L'écart, lui, reste compris entre 29 et 36 points dans les quatre cas. L'objection ne tient pas ; nous publions le calcul le plus sévère, pas le plus flatteur.

Ce qu'il faut en faire

Listez les questions de vos clients, pas votre catégorie.

« Meilleur logiciel de facturation » est une question de journaliste. Vos acheteurs disent « pour une association », « sans comptable », « pour facturer à l'étranger ». Ce sont ces phrases qu'il faut mesurer.

Un bon score sur une formulation ne se transpose pas.

46 points d'écart, cela veut dire qu'être recommandé sur la question générique ne prédit presque rien sur la question de votre segment réel.

Le contexte d'achat est un levier, pas seulement un risque.

Si vous êtes absent de la liste générique mais que votre segment a sa propre question, c'est là qu'il faut exister - et c'est une compétition beaucoup moins encombrée.

Faites dire à vos pages pour QUI vous êtes.

Les sources qui font entrer un nom sur la question « entreprise de dix personnes » sont celles qui parlent explicitement de ce cas. Une page qui ne dit pas à qui elle s'adresse ne peut pas être choisie pour un profil.

Les limites

Un secteur retiré de la mesure : les chaussures de running.

Les réponses y citent des modèles numérotés (« Ghost 16 », « Clifton 9 ») que notre extracteur écarte. Le secteur ressortait donc à 0 % partout - un artefact de notre filtre, pas un résultat. Le publier aurait été malhonnête.

Deux langues et deux moteurs.

Anglais et français ; Perplexity et Gemini. ChatGPT par l'API est exclu : nous avons mesuré qu'il ne cherche pas du tout, donc l'intention n'y joue pas le même rôle.

Un seul jour.

Ces mesures sont datées et les assistants bougent. C'est précisément pourquoi le plancher de bruit accompagne chaque chiffre.

Notre extracteur reste imparfait

, y compris après nettoyage : quelques tournures (« support technique », « PME françaises ») subsistent dans les ensembles. Un correctif est en cours. Nous le disons parce qu'un chiffre dont on cache le nettoyage n'est pas un chiffre.

Nous ne promettons à personne une place dans les réponses de ChatGPT - personne ne peut le faire honnêtement. Ce qui se mesure, c'est où vous en êtes, par langue, par moteur, et désormais par question posée.

Questions fréquentes

La façon de poser la question change-t-elle les entreprises recommandées par une IA ?
Oui, fortement. Dans notre mesure du 26 août 2026 sur 120 tirages, reposer exactement la même question donne 77 % de recouvrement entre les listes. Demander « lequel pour mon entreprise de dix personnes » plutôt que « quels sont les meilleurs » fait tomber ce recouvrement à 31 %, soit 46 points sous le plancher de bruit.
Un bon résultat sur « les meilleurs X » garantit-il d'être recommandé aux petites entreprises ?
Non. C'est le principal enseignement de cette mesure : avec 46 points d'écart, être cité sur la question générique ne prédit presque rien sur la question d'un segment précis. Sur la réservation d'hôtel, le recouvrement entre les deux formulations est tombé à 0 % - aucune entreprise en commun.
Qu'est-ce qu'un plancher de bruit, et pourquoi le publier ?
Un assistant n'est pas déterministe : la même question posée deux fois ne donne pas la même liste. Le plancher de bruit est le recouvrement mesuré entre deux réponses à la question identique - 77 % ici, sur 46 paires. Sans lui, on ne peut pas savoir si un écart entre deux formulations est un vrai effet ou le hasard du jour.
Quelles questions dois-je mesurer pour ma visibilité dans les IA ?
Celles que vos clients posent réellement, avec leur contexte : leur taille d'entreprise, leur budget, leur niveau d'expertise. La question de catégorie générique - « meilleur logiciel de X » - ne représente qu'une partie de la demande, et notre mesure montre qu'elle prédit mal les autres.
Comment avez-vous vérifié que ce résultat n'est pas un artefact de mesure ?
En testant l'objection la plus sérieuse contre nous-mêmes : notre extracteur laisse passer des fragments de conseil, dont le vocabulaire varie avec l'intention. Nous avons refait le calcul à quatre niveaux de nettoyage. Le plancher monte de 62 % à 79 %, mais l'écart entre formulations reste compris entre 29 et 36 points dans les quatre cas.