¿Por qué una IA nunca da dos veces la misma respuesta?
Publicado el
Porque cada vez, la IA reformula la pregunta de otra manera, inicia nuevas búsquedas y vuelve a elegir sus fuentes. El 15 de septiembre de 2026, planteamos preguntas a ChatGPT, Claude y Gemini, y luego las volvimos a plantear de forma idéntica aproximadamente una hora después: ninguna dio dos veces la misma lista de fuentes, y casi ninguna búsqueda se reformuló de manera idéntica. En la mediana, solo del 21 al 25% de las páginas citadas la primera vez volvieron a serlo. Por lo tanto, una captura de pantalla de una respuesta no dice casi nada sobre la visibilidad de una empresa.
¿Para qué tipo de pregunta? Todo depende de la pregunta. En una pregunta que nombra una marca o una fuente precisa, las respuestas varían menos, porque la IA buscará la misma fuente. En una pregunta abierta, varían mucho.
Lo que hemos medido entre dos respuestas
Hemos planteado nuestras preguntas sobre la visibilidad en las IA a ChatGPT, Claude y Gemini, y luego las hemos vuelto a plantear de forma idéntica aproximadamente una hora después. Ninguna de las tres IA ofreció dos veces la misma lista de fuentes, en ninguna pregunta. Casi ninguna búsqueda se escribió dos veces de la misma manera: el 3% en Claude y Gemini, menos del 1% en ChatGPT. La pregunta se reformula de nuevo en cada respuesta.
La proporción de páginas citadas la primera vez que se vuelven a citar la segunda es baja: un 21% de mediana en Claude, un 21% en Gemini, un 25% en ChatGPT. A nivel de sitios, es un poco más estable: un 26% en Claude, un 21% en Gemini y un 41% en ChatGPT, que vuelve con más frecuencia a los mismos editores. En el seguimiento repetido de otras preguntas, recopiladas por otra herramienta, medimos una estabilidad mayor en Gemini y Claude, recuperando entre el 50 y el 67% de las páginas citadas: la variabilidad depende mucho del tema.
Por qué cambia la respuesta
Se superponen tres mecanismos. En primer lugar, un modelo de lenguaje genera su texto eligiendo cada palabra entre varias posibles: dos respuestas a la misma pregunta nunca se escriben de manera idéntica. En segundo lugar, antes de responder, la IA realiza sus propias búsquedas y, al cambiar estas búsquedas, cambian las páginas encontradas. Por último, la propia web se mueve: algunas páginas se actualizan, otras se vuelven lentas o inaccesibles.
Este último punto se puede medir. Hemos medido dos veces la velocidad de las mismas páginas con doce minutos de diferencia: casi una de cada dos páginas había cambiado de tercio, de rápida a media o de media a lenta. Sin embargo, en ChatGPT, las páginas más lentas se citan aproximadamente la mitad de veces. La velocidad de una página es un estado del momento y, con ella, sus posibilidades de ser citada.
Lo que miden otros estudios
SparkToro hizo que un grupo de voluntarios planteara, en noviembre y diciembre de 2025, las mismas solicitudes de recomendación a ChatGPT, Claude y a las respuestas de IA de Google, con su configuración habitual. Conclusión: hay menos de una posibilidad entre cien de que ChatGPT o la IA de Google ofrezcan dos veces la misma lista de marcas, y aproximadamente una posibilidad entre mil de obtener dos listas en el mismo orden.
Rand Fishkin, quien dirigió el estudio, extrae una consecuencia para la medición: un «rango en la IA» no tiene sentido, mientras que un porcentaje de presencia tras numerosas ejecuciones de múltiples preguntas es una medida razonable. Es la misma conclusión que la de nuestras propias mediciones.
Lo que permanece estable a pesar de todo
No todo varía al mismo ritmo. Los grandes mecanismos de elección, por su parte, se repiten de una medición a otra: en ChatGPT, el peso del rango y de las fuentes nombradas; en Claude, el peso del consenso y de las páginas encontradas por varias búsquedas. Las páginas encontradas por la búsqueda también son un poco más estables que las páginas citadas.
Esto es lo que permite trabajar a pesar de la variabilidad: no se puede predecir la siguiente respuesta, pero se puede aumentar la probabilidad de ser elegido construyendo páginas que correspondan a estos mecanismos estables.
Lo que esto cambia para una empresa
Desconfíe de cualquier promesa de «posición» en una IA y de cualquier prueba basada en una sola respuesta. La visibilidad en las IA no se mide como una clasificación: se mide como una frecuencia, planteando numerosas preguntas, varias veces, a múltiples IA, y contabilizando la proporción de respuestas en las que aparece la empresa.
Por eso también FaireDuBruit no promete citaciones: lo que está garantizado es la presencia de páginas construidas para ser elegidas y el seguimiento de su lectura por parte de los robots de las IA. La citación sigue siendo una probabilidad, que se trabaja y se mide a lo largo del tiempo.
Lo que no sabemos
Nuestra comparación se basa en dos respuestas con aproximadamente una hora de diferencia, a través de la API de los modelos. En un período más largo, la variabilidad puede ser aún mayor. La estabilidad medida en el seguimiento de otra herramienta se refiere a otras preguntas y, en el caso de OpenAI, a otro modelo.
Fuentes
- SparkToro, Rand Fishkin — incoherencia de las recomendaciones de marcas por parte de las IA, .
- Mediciones de FaireDuBruit, del 4 al 16 de septiembre de 2026 — ver «Cómo medimos».
Preguntas relacionadas
- ¿Cómo eligen sus fuentes ChatGPT, Claude y Gemini?
- ¿Se puede garantizar ser citado por una IA?
- ¿Qué palabras utiliza una IA cuando busca?
- ¿En qué contexto se busca a mi empresa en las IA y dónde debo aparecer?
Todas las preguntas sobre la visibilidad en las IA · Nuestra oferta