Si hoy haces a ChatGPT la misma pregunta que hace tres meses, es posible que casi la mitad de las marcas de la respuesta ya no coincidan. No es una impresión ni significa que el modelo haya empeorado: las referencias de los motores generativos cambian. Las fuentes pueden variar lo suficiente como para alterar la lista de opciones que interviene en una decisión de compra. Durante una temporada seguimos el mismo conjunto de preguntas para medir la magnitud de esas fluctuaciones, identificar a quiénes afectan y comprobar si responden a algún patrón. La conclusión es clara: la volatilidad es mucho mayor de lo que creen la mayoría de las marcas, y observarla permite entender mejor su posición real ante la IA que una clasificación puntual.
¿Qué analizamos?
El método fue sencillo. Seleccionamos 40 preguntas habituales entre compradores B2B, como «mejor software de XX», «herramienta de XX» o «XX para qué equipo». Formulamos exactamente las mismas preguntas cada semana en ChatGPT, Perplexity y Gemini durante tres meses. En cada respuesta registramos qué marcas aparecían, qué URL se citaban y cuál ocupaba el primer lugar.
Controlar las variables era esencial para que el estudio fuera válido. Utilizamos las mismas cuentas y ubicaciones, y desactivamos la memoria personal y el historial de búsqueda. Así, los cambios procederían de los propios modelos y sus fuentes, no de nuestra actividad previa. También mantuvimos intacta la redacción de cada consulta: cambiar una sola palabra podría alterar el contenido y convertirla en una pregunta distinta, en lugar de permitir una comparación a lo largo del tiempo.
Tres meses después, las respuestas habían cambiado
Empecemos por el hallazgo menos intuitivo: la volatilidad no afecta solo a las consultas de nicho o poco frecuentes. Incluso en «mejor software de gestión de proyectos», cerca del 40% de las marcas citadas fueron sustituidas en tres meses. Una marca puede creer que conserva su posición cuando, en realidad, ya ha empezado a perderla.
- Entre el principio y el final del periodo, la coincidencia media fue de alrededor del 55%; en otras palabras, una de cada tres marcas citadas fue sustituida en una temporada.
- En aproximadamente un tercio de las preguntas, la marca situada en primer lugar cambió al menos una vez durante los tres meses.
- Perplexity fue el motor más dinámico por su elevada dependencia de los resultados de búsqueda inmediatos. ChatGPT mostró más estabilidad con las marcas consolidadas, aunque también registró cambios.
- En las consultas de cola larga y menor volumen, las listas cambiaron entre dos y tres veces más que en los temas populares.
- El contenido nuevo, bien estructurado y con definiciones claras, puede entrar en la lista de referencias entre dos y tres semanas después de publicarse.
La estabilidad de las citas refleja mejor la posición real de una marca que una clasificación aislada. Un artículo reciente puede impulsar temporalmente una posición; aparecer de forma estable significa que los modelos te reconocen repetidamente como una fuente fiable.— Tenten GEO Brand Radar tracking observation

¿Por qué una misma pregunta produce respuestas diferentes?
La volatilidad procede de varias capas de variación. En la base está la búsqueda: antes de responder, el modelo puede consultar resultados en tiempo real o recurrir a un índice cuyos contenidos se reordenan a diario. Entran páginas nuevas, otras pierden posiciones y cambia el material seleccionado. Otra capa corresponde a las actualizaciones del propio modelo: los proveedores ajustan cada pocas semanas sus ponderaciones y políticas de seguridad, de modo que una misma instrucción puede activar criterios de selección distintos. A ello se suma la aleatoriedad generativa; incluso si las dos primeras capas permanecieran intactas, seguiría habiendo pequeñas variaciones en la redacción y los ejemplos.
Hay otro factor fácil de pasar por alto: la competencia también se mueve. Si un competidor publica una comparativa bien estructurada y con definiciones claras, puede ocupar tu lugar en dos o tres semanas. Las respuestas de la IA no son listas definitivas, sino equilibrios que se recalculan de forma constante.
La volatilidad también sigue ciertos patrones
Dentro de este aparente desorden hay elementos previsibles. Las marcas reconocidas y respaldadas por fuentes externas fluctúan claramente menos. En cambio, las marcas cuya información solo aparece en sus propias páginas son las primeras en desaparecer cuando se reordenan las respuestas. Cuanto más clara sea la intención de búsqueda y más consensuada la respuesta, mayor será la estabilidad. Las consultas ambiguas, amplias o con muchas opciones tienden a variar más. Esto significa que una estructura de contenidos clara y la validación externa pueden acercar a una marca al extremo más estable de las citas.
¿Cómo debe responder una marca ante esta inestabilidad?
La respuesta menos eficaz consiste en consultar la IA todos los días y reaccionar con alarma cuando una página o una marca desaparece. Las listas diarias fluctúan, y tomar decisiones a partir de un único dato solo consume tiempo y recursos. Lo importante es ampliar el periodo de seguimiento y utilizar indicadores como la tasa de coincidencia y el volumen de citas para determinar si la visibilidad avanza hacia la estabilidad o registra una pérdida sostenida.
La dirección para ganar estabilidad es clara: presentar los temas centrales en párrafos precisos, cuantificados y contextualizados, para que los modelos puedan extraer la información sin ambigüedades; mantener señales de marca coherentes en varias fuentes fiables; y acumular referencias y corroboraciones de terceros que den a la IA múltiples razones para considerarte una fuente creíble. Eso es precisamente lo que hace Brand Radar de Tenten: supervisa de forma continua el historial de citas de una marca en distintos motores generativos y transforma las fluctuaciones de un solo día en tendencias útiles para tomar decisiones.
No puedes obligar a las respuestas de la IA a estabilizarse. Lo que sí puedes hacer es convertir tu marca en una fuente difícil de sustituir. Si quieres saber con qué estabilidad te citan y dónde están las brechas, puedes solicitar un diagnóstico GEO de 30 minutos. Analizaremos el historial de tu propia marca y revisaremos contigo los datos concretos.

