Ir al contenido
Waseit
← Todos los artículos
AEOGEO

La misma necesidad preguntada de otro modo devuelve otras empresas: 31 % de coincidencia

«Los mejores X» y «cuál para mi empresa de 10 personas» solo coinciden en un 31 %, frente al 77 % cuando se repite exactamente la misma pregunta.

26 de agosto de 202610 min de lectura
En este artículo
  1. Por qué esta pregunta, ahora
  2. Qué medimos, exactamente
  3. El suelo de ruido, sin el cual este artículo no existiría
  4. El resultado
  5. El caso que lo hace concreto
  6. La hipótesis rival, probada y descartada
  7. Qué hacer con esto
  8. Los límites

Respuesta corta: cambiar el contexto de compra dentro de la pregunta cambia las empresas recomendadas, y mucho más que el propio azar del asistente. Haga exactamente la misma pregunta dos veces: las listas coinciden en un 77 %. Pregunte «cuál para mi empresa de diez personas» en lugar de «cuáles son los mejores»: 31 %.

Son 46 puntos por debajo del suelo de ruido. Dicho de otro modo: cómo formula su comprador la necesidad pesa más en su presencia que todo lo que el asistente hace variar por su cuenta de una ejecución a otra.

Una auditoría de visibilidad que pregunta una sola formulación no mide su mercado. Mide una cuarta parte.

Por qué esta pregunta, ahora

Hemos mostrado que el idioma cambia la lista recomendada, que las fuentes leídas cambian con él, y que esas fuentes sostienen realmente la recomendación. Quedaba la variable de la que la empresa menos sospecha, porque no la controla en absoluto: la manera en que su cliente formula la petición.

Nadie escribe solo «mejor CRM». Un comprador también dice «llevo una estructura pequeña», «cuál tiene la mejor relación calidad-precio», «soy principiante, cuál es el más sencillo». Son cuatro momentos de compra, no cuatro formas de decir lo mismo.

Qué medimos, exactamente

Cinco sectores globales, dos idiomas (inglés, francés), dos asistentes que buscan - Perplexity y Gemini. 120 ejecuciones, cero fallos. La pregunta de referencia está tomada palabra por palabra de nuestras mediciones anteriores, lo que permite leer esta junto a las demás.

Cuatro momentos de compra, no cuatro paráfrasis.
IntenciónFormulación
Referencia«¿Cuáles son los mejores X?»
Pequeña empresa«Dirijo una empresa de 10 personas. ¿Qué X nos recomienda?»
Precio«¿Qué X ofrecen la mejor relación calidad-precio?»
Principiante«Soy completamente principiante. ¿Qué X son los más fáciles de empezar a usar?»

El suelo de ruido, sin el cual este artículo no existiría

Un asistente no es determinista: hágale la misma pregunta y no devuelve la misma lista. Comparar dos formulaciones sin saber cuánto se contradice a sí mismo sería publicar azar y llamarlo resultado.

Por eso ejecutamos la pregunta de referencia tres veces por combinación, lo que da 46 pares «misma pregunta, dos respuestas». Su coincidencia media - 77 % - es el suelo. Toda diferencia entre intenciones se lee contra él, nunca en absoluto.

El resultado

Coincidencia de las listas recomendadas con la pregunta de referencia. Perplexity y Gemini, en y fr, 2026-08-26.
Pregunta formuladaCoincidenciaDiferencia con el ruido
La misma, repetida (suelo)77 %-
Mejor relación calidad-precio53 %24 puntos por debajo
Soy principiante40 %37 puntos por debajo
Empresa de 10 personas31 %46 puntos por debajo

Los dos motores van en el mismo sentido, por separado - es lo que autoriza a publicar. Perplexity pasa de un suelo del 84 % al 39 % en la pregunta «pequeña empresa»; Gemini, del 68 % al 23 %. Los valores difieren; la dirección y la magnitud no.

El caso que lo hace concreto

En reserva de hoteles, el asistente se repite muy bien: 86 % de coincidencia entre dos ejecuciones de la misma pregunta. Añada «dirijo una empresa de diez personas» y la coincidencia cae al 0 %. No 30, no 15: cero. Ninguna empresa en común.

Mirar los nombres lo explica: la pregunta de referencia devuelve las plataformas de consumo que todo el mundo conoce. La pregunta «empresa de diez personas» hace aparecer TravelPerk, Engine, Booking.com for Business - actores del viaje corporativo, ausentes de la primera lista. No es un ranking que se mueve, es otro mercado el que responde.

No es su posición lo que cambia con la pregunta. Es la lista de candidatos.

El mismo patrón en otros sitios: en alojamiento web en inglés, Namecheap y Wix solo aparecen en las preguntas «pequeña empresa», «precio» y «principiante». En CRM en francés, HubSpot está ausente de la lista de referencia pero presente en cuanto se precisa «pequeña empresa» o «estoy empezando».

La hipótesis rival, probada y descartada

Un resultado tan nítido invita a una objeción seria, y nos la planteamos contra nosotros mismos: nuestro extractor de nombres deja pasar fragmentos de consejo («compruebe las integraciones», «presupuesto mínimo»). Y una pregunta sobre precio produce un vocabulario de consejo distinto al de una pregunta para principiantes. Ese ruido podía fabricar por sí solo toda la diferencia.

Rehicimos entonces el cálculo con cuatro niveles de limpieza, del bruto al más severo - conservando solo los nombres que se repiten en varias respuestas, ya que un nombre de empresa real se repite donde una expresión de consejo es única. El suelo de ruido sube, como se esperaba, del 62 % al 79 %. La diferencia se mantiene entre 29 y 36 puntos en los cuatro casos. La objeción no se sostiene; publicamos el cálculo más severo, no el más halagador.

Qué hacer con esto

Enumere las preguntas de sus clientes, no su categoría.

«Mejor software de facturación» es una pregunta de periodista. Sus compradores dicen «para una asociación», «sin contable», «para facturar al extranjero». Son esas frases las que hay que medir.

Una buena puntuación en una formulación no se transfiere.

46 puntos de diferencia significan que ser recomendado en la pregunta genérica no predice casi nada sobre la pregunta de su segmento real.

El contexto de compra es palanca, no solo riesgo.

Si está ausente de la lista genérica pero su segmento tiene su propia pregunta, ahí es donde hay que existir - y es una competencia mucho menos concurrida.

Haga que sus páginas digan PARA QUIÉN son.

Las fuentes que meten un nombre en la respuesta «empresa de diez personas» son las que hablan explícitamente de ese caso. Una página que no dice a quién se dirige no puede ser elegida para un perfil.

Los límites

Un sector retirado de la medición: las zapatillas de running.

Las respuestas citan modelos numerados («Ghost 16», «Clifton 9») que nuestro extractor descarta. El sector salía entonces al 0 % en todas partes - un artefacto de nuestro filtro, no un resultado. Publicarlo habría sido deshonesto.

Dos idiomas y dos motores.

Inglés y francés; Perplexity y Gemini. ChatGPT por la API queda excluido: medimos que no busca en absoluto, así que la intención no juega allí el mismo papel.

Un solo día.

Estas mediciones están fechadas y los asistentes se mueven. Por eso precisamente un suelo de ruido acompaña a cada cifra.

Nuestro extractor sigue siendo imperfecto

, incluso tras la limpieza: algunas expresiones («soporte técnico», «pymes francesas») sobreviven en los conjuntos. Hay una corrección en curso. Lo decimos porque una cifra cuya limpieza se oculta no es una cifra.

No prometemos a nadie un puesto en las respuestas de ChatGPT - nadie puede hacerlo honestamente. Lo que se mide es dónde está usted, por idioma, por motor, y ahora por pregunta formulada.

Preguntas frecuentes

¿La forma de formular la pregunta cambia las empresas que recomienda una IA?
Sí, con fuerza. En nuestra medición del 26 de agosto de 2026 sobre 120 ejecuciones, repetir exactamente la misma pregunta da un 77 % de coincidencia entre las listas. Preguntar «cuál para mi empresa de diez personas» en lugar de «cuáles son los mejores» hace caer esa coincidencia al 31 %, es decir 46 puntos por debajo del suelo de ruido.
¿Un buen resultado en «los mejores X» garantiza que me recomienden a las pequeñas empresas?
No. Es la principal lección de esta medición: con 46 puntos de diferencia, ser citado en la pregunta genérica no predice casi nada sobre la pregunta de un segmento concreto. En reserva de hoteles, la coincidencia entre ambas formulaciones cayó al 0 % - ninguna empresa en común.
¿Qué es un suelo de ruido y por qué publicarlo?
Un asistente no es determinista: la misma pregunta hecha dos veces no devuelve la misma lista. El suelo de ruido es la coincidencia medida entre dos respuestas a la pregunta idéntica - 77 % aquí, sobre 46 pares. Sin él no se puede saber si una diferencia entre dos formulaciones es un efecto real o el azar del día.
¿Qué preguntas debo medir para mi visibilidad en las IA?
Las que sus clientes hacen realmente, con su contexto: tamaño de empresa, presupuesto, nivel de conocimiento. La pregunta genérica de categoría - «mejor software de X» - solo cubre una parte de la demanda, y nuestra medición muestra que predice mal el resto.
¿Cómo comprobaron que este resultado no es un artefacto de medición?
Poniendo a prueba contra nosotros mismos la objeción más seria: nuestro extractor deja pasar fragmentos de consejo, cuyo vocabulario varía con la intención. Rehicimos el cálculo con cuatro niveles de limpieza. El suelo sube del 62 % al 79 %, pero la diferencia entre formulaciones se mantiene entre 29 y 36 puntos en los cuatro casos.