Si no apareces en las búsquedas con IA, quizá no sea porque tu contenido carezca de calidad, sino porque los rastreadores no pueden leer la página. Puede que robots.txt bloquee GPTBot, que el texto esté oculto en un bloque dependiente de JavaScript o que la página no tenga datos estructurados. Basta con que se cumpla una de estas tres condiciones para que, por mucho cuidado que hayas puesto en el artículo, este resulte invisible para el motor de IA. No hace falta esperar a que una auditoría completa de treinta días saque a la luz el problema: puedes comprobarlo por tu cuenta en cinco minutos y tres pasos.
Primero, una aclaración: los rastreadores de IA no son Googlebot
Cada motor de IA utiliza sus propios rastreadores para recopilar datos. Cada uno tiene un user-agent específico y se comporta de forma distinta a Googlebot. La diferencia fundamental es esta: para clasificar páginas, Googlebot está dispuesto a dedicar recursos a ejecutar su JavaScript; por razones de velocidad y coste, la mayoría de los rastreadores de IA se limitan al HTML original y apenas ejecutan JavaScript, si es que llegan a hacerlo. Por eso, que «Google indexe la página con normalidad» nunca equivale a que «ChatGPT, Perplexity y Claude puedan leerla». La revisión debe realizarse desde la perspectiva específica de un rastreador de IA, no con la antigua lista de comprobación de SEO.
Primer minuto: abre robots.txt y comprueba si bloquea los rastreadores de IA
Añade /robots.txt al final de tu dominio y abre la dirección directamente. Usa Ctrl+F para buscar los nombres que aparecen a continuación y comprueba si alguna directiva Disallow los bloquea o si ni siquiera se mencionan; por lo general, que no aparezcan significa que tienen acceso. En muchos sitios web, los rastreadores de IA están bloqueados «sin querer»: las reglas predeterminadas de un proveedor de seguridad, una CDN o algún complemento impiden el acceso a cualquier rastreador que no sea Googlebot y dejan fuera también a los motores de IA.
- GPTBot: rastreador que OpenAI utiliza para recopilar datos destinados al entrenamiento y la recuperación de información. Si lo bloqueas, ChatGPT no podrá acceder a tu contenido.
- OAI-SearchBot y ChatGPT-User: se utilizan, respectivamente, en las búsquedas de ChatGPT y para acceder a páginas en el momento en que los usuarios hacen una consulta.
- ClaudeBot: rastreador que Claude, de Anthropic, utiliza para recopilar y recuperar páginas web.
- PerplexityBot y Perplexity-User: Perplexity los utiliza para crear sus índices y leer páginas en el momento de la consulta.
- Google-Extended: controla si el contenido puede utilizarse en Gemini. Bloquearlo no afectará al posicionamiento general en Google, pero hará que desaparezcas de las respuestas de Gemini.
Minutos 2 y 3: desactiva JavaScript y comprueba si el contenido sigue ahí
Este paso responde a una sola pregunta: ¿el texto está realmente incluido en el HTML o depende del navegador para ejecutar JavaScript? La forma más rápida de averiguarlo es desactivar JavaScript en Chrome DevTools y volver a cargar la página. Otra opción aún más directa consiste en añadir view-source: delante de la URL, abrir el código fuente y usar Ctrl+F para buscar una frase completa del artículo. Si no encuentras el título, el texto o el precio, significa que ese contenido se renderiza en el front end y que un rastreador de IA limitado al HTML solo recibirá una estructura vacía. Piensa en la página como si se consultara únicamente en modo texto: la IA solo puede citar lo que ve el rastreador.

Minutos 4 y 5: comprueba si existe schema y si está bien implementado
Vuelve a utilizar view-source:, pero esta vez busca application/ld+json para comprobar si la página incluye datos estructurados y si el tipo utilizado es el adecuado. Una página de artículo debería incluir Article; una página corporativa, Organization; una página de preguntas y respuestas, FAQPage; y una página de producto, Product. Schema no mejora directamente el posicionamiento. Su función es permitir que la IA confirme con el menor esfuerzo posible tres aspectos: de qué trata la página, quién la ha escrito y si resulta fiable. Aquí hay una trampa frecuente: un schema incorrecto es peor que no tener ninguno. Si una página declara FAQPage, pero no muestra las preguntas y respuestas correspondientes, o si el autor, la fecha y el contenido de la etiqueta no coinciden con la página, la IA considerará que la información no es fiable y tendrá menos disposición a citarla.
Resumen en una página: lo que deberías comprobar en cinco minutos
- robots.txt: ninguna directiva Disallow bloquea los rastreadores de IA anteriores y tampoco existe un bloqueo general del sitio mediante User-agent: * y Disallow: /.
- Renderizado: después de desactivar JavaScript, el título, el cuerpo del texto y los datos clave —como el precio o las especificaciones— siguen siendo legibles en el HTML original.
- Schema: la página incluye el tipo de JSON-LD correspondiente, y el contenido marcado coincide con lo que aparece en pantalla; no es falso ni está desactualizado.
- Si superas las tres comprobaciones: la base de la rastreabilidad para IA es correcta; el siguiente paso consiste en optimizar el contenido y su estructura para facilitar las citas.
- Si no superas alguna de las comprobaciones: no te apresures a producir más contenido. Esa carencia es la que debes corregir ahora.
La rastreabilidad para IA es un requisito para poder ser citado, no un valor añadido. Si no superas ese umbral, la IA no podrá leer ni citar el contenido, por bueno que sea.— Tenten GEO Consulting Team
Si detectas varios problemas, ¿cuál debes corregir primero?
Las correcciones siguen un orden de prioridad claro. Primero debes retirar el bloqueo de robots.txt: modificar una sola línea puede restablecer el acceso, es el cambio de mayor impacto y normalmente surte efecto ese mismo día. En segundo lugar están los problemas de renderizado, porque suelen requerir la intervención del equipo de ingeniería para que el contenido clave se renderice en el servidor o, como mínimo, aparezca en el HTML original. El coste es mayor, pero determina directamente si la IA puede leer el texto. Schema se completa al final: sirve para rematar los fundamentos, no para pasar de cero a uno. Si sigues este orden, resolverás primero las carencias más graves con el menor esfuerzo posible.
Esta revisión de cinco minutos permite detectar la mayoría de las vulnerabilidades evidentes, pero no revela problemas más profundos: por ejemplo, que el servidor entregue al rastreador de IA un contenido distinto del que reciben los usuarios, que la estructura de los párrafos citables sea demasiado dispersa o que las entidades y señales de confianza no sean coherentes entre páginas. Si quieres saber dónde están las carencias en estas capas, puedes solicitar un diagnóstico GEO de 30 minutos. Aplicaremos el enfoque de auditoría GEO de Tenten para convertir tus problemas de rastreabilidad en una lista de acciones que puedas poner en marcha de inmediato.



