Por qué ChatGPT nunca da dos veces la misma respuesta (y cómo medir igualmente)
Haz dos veces la misma pregunta a ChatGPT y obtendrás dos respuestas distintas, a menudo con marcas distintas. No es un fallo: es cómo funciona el modelo. Las cinco causas, lo que significan para la visibilidad de tu marca y la única forma fiable de medir una presencia que varía.

ChatGPT nunca da dos veces la misma respuesta porque genera el texto eligiendo cada palabra entre varias posibles, y porque en modo búsqueda consulta la web de forma distinta cada vez. Para una marca, la consecuencia es directa: una captura en la que apareces, o no, no demuestra nada. El estudio de SparkToro muestra que ChatGPT y la IA de Google devuelven la misma lista de marcas menos de una vez de cada cien. Lo que sí se mantiene es la frecuencia con la que aparece una marca, y eso es lo que hay que medir.
Las cinco causas de la variación
1. La elección de las palabras
Un modelo de lenguaje no elige «la» palabra siguiente: calcula una probabilidad para cada palabra posible y escoge una, con una dosis de azar intencionada para que el texto suene natural. Una marca citada en segundo lugar en una respuesta puede no aparecer en la siguiente porque la frase tomó otro camino.
2. La búsqueda web, rehecha cada vez
Cuando ChatGPT busca en la web, reformula la pregunta en una o varias búsquedas. Según el estudio de Profound sobre 10.000 prompts (abril de 2026), el 91 % de esas búsquedas son únicas: casi nunca lanza dos veces la misma. Búsquedas distintas traen páginas distintas y, por tanto, marcas distintas. Lo explicamos en Query fan-out.
3. El contexto del usuario
Memoria de conversaciones, instrucciones personalizadas, historial de la conversación en curso y ubicación aproximada cambian la respuesta. Dos personas que hacen la misma pregunta no obtienen lo mismo.
4. El modelo utilizado
Según el plan y la carga, ChatGPT no siempre usa el mismo modelo, y las versiones cambian varias veces al año. Un modelo de razonamiento lanza más búsquedas que uno rápido y cita otras fuentes.
5. La formulación exacta
«Mejor empresa de reformas en Sevilla», «reformas Sevilla baratas» y «a quién llamo para reformar el baño en Sevilla» son tres preguntas distintas para el modelo.
Lo que midió el estudio de SparkToro
A finales de 2025, Rand Fishkin (SparkToro) y Patrick O’Donnell hicieron que cientos de voluntarios plantearan 12 preguntas de recomendación a ChatGPT, Claude y la IA de Google, en casi 3.000 ejecuciones. La misma lista de marcas se repitió menos de una vez de cada cien, y la misma lista en el mismo orden, menos de una vez de cada mil.
Pero el estudio también muestra lo que se mantiene: la frecuencia con la que una marca aparece en muchas respuestas es mucho más estable que su posición.
Olvida la «posición en ChatGPT» al estilo SEO: no se repite. La métrica útil es la tasa de cita — el porcentaje de respuestas en que apareces — medida sobre una muestra suficiente, y la cuota de voz frente a tus competidores en las mismas preguntas.
¿Cuántas respuestas hacen falta para medir?
Una tasa de cita es una proporción: su precisión depende del número de respuestas observadas. Este es el margen de error (intervalo de confianza del 95 %) de una tasa medida del 30 %:
| Respuestas observadas | Margen de error | Qué puedes concluir |
|---|---|---|
| 1 | ±90 puntos | Nada: es una anécdota |
| 5 | ±40 puntos | Solo presencias o ausencias muy marcadas |
| 10 | ±28 puntos | Un orden de magnitud |
| 30 | ±16 puntos | Compararte con un competidor claramente por delante o por detrás |
| 100 | ±9 puntos | Seguir una evolución de un mes a otro |
Tres reglas prácticas. Suma preguntas: 20 preguntas planteadas 5 veces dan 100 respuestas sobre un mismo tema. Repite donde hay incertidumbre: una pregunta en la que apareces una vez de cada dos merece más repeticiones que una en la que nunca apareces. Muestra el margen: una tasa sin margen de error aparenta una precisión que no tiene.
¿Cuántas veces se plantea cada pregunta y cuál es el margen de error de la cifra? Si la respuesta es «una vez al día» y «sin margen», buena parte de la evolución semanal que ves es ruido. Nos aplicamos la misma regla.
Cómo aparecer con más frecuencia
- Estar en varias fuentes independientes: comparativas, directorios de referencia, prensa. Cuantas más páginas te mencionen, más probable es que la búsqueda traiga alguna.
- Cubrir las variantes de la pregunta: precio, opiniones, comparación, casos de uso.
- Hacer tus páginas fáciles de citar: respuesta directa, datos con fuente — ver Cómo aparecer en ChatGPT.
¿Por qué ChatGPT da respuestas distintas a la misma pregunta?
Porque el modelo elige cada palabra entre varias posibles con una dosis de azar intencionada, y porque en modo búsqueda reformula la pregunta en búsquedas web casi siempre distintas. El contexto del usuario, el modelo utilizado y la formulación exacta también cambian la respuesta.
¿ChatGPT recomienda siempre las mismas marcas?
No. Según SparkToro (enero de 2026, casi 3.000 ejecuciones), ChatGPT y la IA de Google devuelven la misma lista de marcas menos de una vez de cada cien. La frecuencia con la que aparece cada marca sí es mucho más estable.
¿Cómo se mide la visibilidad en ChatGPT si las respuestas cambian?
Planteando un conjunto de preguntas reales varias veces cada una y calculando el porcentaje de respuestas en que aparece la marca (tasa de cita), con su margen de error. Con 10 respuestas, una tasa del 30 % tiene un margen de unos ±28 puntos; con 100, de unos ±9.
¿Tiene sentido la posición de una marca en ChatGPT?
Poco: el orden cambia en casi cada respuesta. La tasa de cita es la métrica principal; la posición media sobre muchas respuestas, como mucho, un indicador secundario.
Fuentes
Sobre el autor
Kelvin Rivera
Consultor SEO y GEO, fundador de MarquePhare
Consultor SEO y GEO. Acompaña a agencias en Francia, España y Andorra en su visibilidad orgánica, y mide cada mes lo que responden ChatGPT, Claude, Gemini y Perplexity — con metodología publicada, también cuando los resultados incomodan.
Sigue leyendo
Hemos analizado 48 respuestas reales de ChatGPT, Claude, Gemini y Perplexity a 12 preguntas sobre herramientas GEO en español, mercado España. El ranking del sector, lo que cambia según el motor, la metodología para reproducirlo — y nuestro propio resultado, publicado tal cual.
Todas las comparativas de herramientas GEO describen funciones. Aquí partimos de lo que las IA responden de verdad en español, y de las cinco preguntas que deciden — empezando por la que casi nadie hace: ¿en qué idioma y desde qué país se mide?