Fundamentos

Por qué ChatGPT nunca da dos veces la misma respuesta (y cómo medir igualmente)

Haz dos veces la misma pregunta a ChatGPT y obtendrás dos respuestas distintas, a menudo con marcas distintas. No es un fallo: es cómo funciona el modelo. Las cinco causas, lo que significan para la visibilidad de tu marca y la única forma fiable de medir una presencia que varía.

Kelvin Rivera· · actualizado el · 9 min
Una burbuja de diálogo de la que salen tres burbujas con contenidos distintos: una pregunta, respuestas diferentes

ChatGPT nunca da dos veces la misma respuesta porque genera el texto eligiendo cada palabra entre varias posibles, y porque en modo búsqueda consulta la web de forma distinta cada vez. Para una marca, la consecuencia es directa: una captura en la que apareces, o no, no demuestra nada. El estudio de SparkToro muestra que ChatGPT y la IA de Google devuelven la misma lista de marcas menos de una vez de cada cien. Lo que sí se mantiene es la frecuencia con la que aparece una marca, y eso es lo que hay que medir.

< 1 %
de probabilidad de obtener dos veces la misma lista de marcas
SparkToro, 2026
91 %
de las búsquedas que lanza ChatGPT son únicas
Profound, 2026
±28 pts
de margen de error en una tasa de cita del 30 % medida con 10 respuestas
cálculo, intervalo del 95 %

Las cinco causas de la variación

1. La elección de las palabras

Un modelo de lenguaje no elige «la» palabra siguiente: calcula una probabilidad para cada palabra posible y escoge una, con una dosis de azar intencionada para que el texto suene natural. Una marca citada en segundo lugar en una respuesta puede no aparecer en la siguiente porque la frase tomó otro camino.

2. La búsqueda web, rehecha cada vez

Cuando ChatGPT busca en la web, reformula la pregunta en una o varias búsquedas. Según el estudio de Profound sobre 10.000 prompts (abril de 2026), el 91 % de esas búsquedas son únicas: casi nunca lanza dos veces la misma. Búsquedas distintas traen páginas distintas y, por tanto, marcas distintas. Lo explicamos en Query fan-out.

3. El contexto del usuario

Memoria de conversaciones, instrucciones personalizadas, historial de la conversación en curso y ubicación aproximada cambian la respuesta. Dos personas que hacen la misma pregunta no obtienen lo mismo.

4. El modelo utilizado

Según el plan y la carga, ChatGPT no siempre usa el mismo modelo, y las versiones cambian varias veces al año. Un modelo de razonamiento lanza más búsquedas que uno rápido y cita otras fuentes.

5. La formulación exacta

«Mejor empresa de reformas en Sevilla», «reformas Sevilla baratas» y «a quién llamo para reformar el baño en Sevilla» son tres preguntas distintas para el modelo.

Lo que midió el estudio de SparkToro

A finales de 2025, Rand Fishkin (SparkToro) y Patrick O’Donnell hicieron que cientos de voluntarios plantearan 12 preguntas de recomendación a ChatGPT, Claude y la IA de Google, en casi 3.000 ejecuciones. La misma lista de marcas se repitió menos de una vez de cada cien, y la misma lista en el mismo orden, menos de una vez de cada mil.

Ilustración: cinco respuestas a la misma pregunta con listas de marcas distintas y, a la derecha, la frecuencia de cita de cada marca

Pero el estudio también muestra lo que se mantiene: la frecuencia con la que una marca aparece en muchas respuestas es mucho más estable que su posición.

La lección para el seguimiento

Olvida la «posición en ChatGPT» al estilo SEO: no se repite. La métrica útil es la tasa de cita — el porcentaje de respuestas en que apareces — medida sobre una muestra suficiente, y la cuota de voz frente a tus competidores en las mismas preguntas.

¿Cuántas respuestas hacen falta para medir?

Una tasa de cita es una proporción: su precisión depende del número de respuestas observadas. Este es el margen de error (intervalo de confianza del 95 %) de una tasa medida del 30 %:

Respuestas observadasMargen de errorQué puedes concluir
1±90 puntosNada: es una anécdota
5±40 puntosSolo presencias o ausencias muy marcadas
10±28 puntosUn orden de magnitud
30±16 puntosCompararte con un competidor claramente por delante o por detrás
100±9 puntosSeguir una evolución de un mes a otro
Margen de error de una tasa de cita del 30 % según el número de respuestas (aproximación normal, 95 %).

Tres reglas prácticas. Suma preguntas: 20 preguntas planteadas 5 veces dan 100 respuestas sobre un mismo tema. Repite donde hay incertidumbre: una pregunta en la que apareces una vez de cada dos merece más repeticiones que una en la que nunca apareces. Muestra el margen: una tasa sin margen de error aparenta una precisión que no tiene.

La pregunta que hay que hacer a cualquier herramienta

¿Cuántas veces se plantea cada pregunta y cuál es el margen de error de la cifra? Si la respuesta es «una vez al día» y «sin margen», buena parte de la evolución semanal que ves es ruido. Nos aplicamos la misma regla.

Cómo aparecer con más frecuencia

  • Estar en varias fuentes independientes: comparativas, directorios de referencia, prensa. Cuantas más páginas te mencionen, más probable es que la búsqueda traiga alguna.
  • Cubrir las variantes de la pregunta: precio, opiniones, comparación, casos de uso.
  • Hacer tus páginas fáciles de citar: respuesta directa, datos con fuente — ver Cómo aparecer en ChatGPT.
¿Por qué ChatGPT da respuestas distintas a la misma pregunta?

Porque el modelo elige cada palabra entre varias posibles con una dosis de azar intencionada, y porque en modo búsqueda reformula la pregunta en búsquedas web casi siempre distintas. El contexto del usuario, el modelo utilizado y la formulación exacta también cambian la respuesta.

¿ChatGPT recomienda siempre las mismas marcas?

No. Según SparkToro (enero de 2026, casi 3.000 ejecuciones), ChatGPT y la IA de Google devuelven la misma lista de marcas menos de una vez de cada cien. La frecuencia con la que aparece cada marca sí es mucho más estable.

¿Cómo se mide la visibilidad en ChatGPT si las respuestas cambian?

Planteando un conjunto de preguntas reales varias veces cada una y calculando el porcentaje de respuestas en que aparece la marca (tasa de cita), con su margen de error. Con 10 respuestas, una tasa del 30 % tiene un margen de unos ±28 puntos; con 100, de unos ±9.

¿Tiene sentido la posición de una marca en ChatGPT?

Poco: el orden cambia en casi cada respuesta. La tasa de cita es la métrica principal; la posición media sobre muchas respuestas, como mucho, un indicador secundario.

Fuentes

Sobre el autor

Kelvin Rivera

Consultor SEO y GEO, fundador de MarquePhare

Consultor SEO y GEO. Acompaña a agencias en Francia, España y Andorra en su visibilidad orgánica, y mide cada mes lo que responden ChatGPT, Claude, Gemini y Perplexity — con metodología publicada, también cuando los resultados incomodan.

Sigue leyendo