Les recommandations des IA changent-elles d'un jour à l'autre ?
Re-mesuré ce matin : sur 81 noms cités par les IA le 6 août, 15 seulement réapparaissent le 8. Ce qui tient 48 heures, ce qui change, et pourquoi.
Dans cet article
Il y a tout juste un an, le 7 août 2025, OpenAI remplaçait du jour au lendemain le modèle par défaut de ChatGPT par GPT-5. Des millions d'utilisateurs ont vu le ton et le contenu des réponses changer d'un coup ; la protestation fut telle que l'ancien modèle a été rétabli pour les abonnés payants le 12 août. Puis rebelote : le 5 mai 2026, GPT-5.5 Instant est devenu le nouveau défaut. Deux fois en un an, le moteur sous l'assistant a changé - sans préavis pour les entreprises dont il cite, ou ne cite plus, le nom.
Fallait-il s'en inquiéter ? Nous avons préféré mesurer. Ce matin, 8 août 2026, nous avons re-posé mot pour mot les quatre questions du 6 août - les meilleurs plombiers à Bordeaux et à Lille, formulées comme un client les tape - aux trois mêmes assistants : ChatGPT, Gemini, Perplexity. Douze réponses re-collectées, comparées aux douze de jeudi. Réponse à la question du titre : oui, massivement. Sur 81 noms distincts cités jeudi, 15 seulement réapparaissent samedi - et deux de ces quinze sont des intitulés de section attrapés par le comptage, pas des entreprises. Une enseigne citée sur six a tenu 48 heures. C'est cette instabilité que l'AEO (Answer Engine Optimization : exister dans les réponses des assistants) doit d'abord regarder en face.
Qu'avons-nous mesuré ce matin, exactement ?
Le protocole tient en une phrase : mêmes questions, mêmes trois moteurs, mêmes modèles, à 48 heures d'écart, douze réponses de chaque côté, noms comptés par le même parseur que nos rapports - tout écart est donc un mouvement des réponses, pas de la méthode. Le détail par moteur est le vrai résultat. ChatGPT, interrogé par API sans recherche web : zéro nom conservé sur 26. Gemini : un seul sur 29 - Espace Aubade, une enseigne nationale de salle de bains. Perplexity, le seul des trois qui lit le web au moment de répondre : 12 noms conservés sur 28.
Le nom cité avec assurance jeudi n'est pas re-cité samedi - pas même par le moteur qui l'avait avancé.
Le cas le plus parlant : jeudi, ChatGPT nous avait recommandé « Plomberie Lille Services », avec des justifications assurées - un nom que nous n'avions pas réussi à rattacher à une entreprise identifiable, et que nous avions signalé comme non vérifié. Samedi, il ne le mentionne plus. Même son auteur ne se répète pas. Et ses refus non plus ne sont pas stables : trois questions sur quatre refusées jeudi, deux sur quatre samedi.
Pourquoi si peu de noms tiennent-ils ?
Parce que la stabilité n'est pas une propriété de « l'IA » : c'est une propriété de ses sources. ChatGPT répond de mémoire - il l'écrit lui-même dans sa réponse de samedi : « basés sur les avis et recommandations disponibles jusqu'à 2023 ». Une mémoire échantillonnée à chaque génération produit une liste différente à chaque tirage. Perplexity, lui, relit les annuaires au moment de la question : ses noms tiennent parce que Bilik, ThreeBestRated ou Travaux.com n'ont pas changé en 48 heures. Regardez d'ailleurs ce qui a survécu chez lui : d'abord les annuaires et plateformes eux-mêmes, puis les artisans qu'ils classent. La couche stable de votre visibilité IA, ce sont les sources écrites - pas la loterie d'une génération.
Ajoutez-y l'échelle du problème : quand le modèle par défaut change - 7 août 2025, 5 mai 2026 -, ce sont toutes les réponses de dizaines de millions d'utilisateurs qui se redistribuent le même jour. Votre score peut bouger sans que vous, vos concurrents ou vos clients n'ayez rien fait. Un instantané isolé, bon ou mauvais, ne dit donc presque rien ; ce qui parle, c'est la série - la fréquence à laquelle votre nom revient, mesure après mesure, et les sources qui le portent.
Que faire demain matin ?
- Ne tirez aucune conclusion d'une mesure unique - ni panique sur un zéro, ni triomphe sur un bon score. Re-mesurez à intervalle régulier : c'est la tendance qui a un sens, pas le point.
- Investissez la couche qui a tenu : les annuaires et plateformes que le moteur-qui-lit-le-web consulte. Dans notre mesure, les seuls noms d'artisans encore cités 48 heures plus tard venaient de là.
- Notez les dates de bascule des modèles (elles sont publiques). Si votre visibilité bouge un jour de changement de défaut, la cause est probablement au-dessus de vous - pas chez vous.
- Mesurez les trois moteurs séparément, gratuitement, en 60 secondes - puis re-mesurez le mois suivant. La comparaison est le produit, pas la photo.
L'honnêteté d'usage pour finir : quatre questions, douze réponses, deux villes, un métier - c'est un sondage, pas un recensement. Mais l'ordre de grandeur rejoint ce que nos trois études nationales montrent déjà (les moteurs ne s'accordent entre eux que sur 2 à 3 % des noms), et il est daté, publié, re-vérifiable. Une recommandation d'IA est un événement, pas un état. On ne gère pas un événement - on gère sa fréquence.