Inspector de Rastreadores de IA

Obtén cualquier URL como ChatGPT, Claude, Perplexity y Google. Mira exactamente qué bots de IA pueden leer tu página y cuáles están bloqueados.

Obtendremos tu URL como 13 diferentes bots de IA y motores de búsqueda.

Por qué es importante el Inspector de Rastreadores

Si bots de IA como ChatGPT, Claude y Perplexity están bloqueados y no pueden leer tu sitio web, tu contenido nunca será citado en las respuestas de IA. Los cortafuegos en la nube, el renderizado oculto en JavaScript o los archivos robots.txt demasiado estrictos pueden arruinar silenciosamente tu visibilidad en IA sin que se note en un navegador web normal. Nuestra herramienta obtiene tu URL a través de trece diferentes agentes de IA simultáneamente, revelando exactamente quién puede acceder a tu contenido y quién se queda fuera.

Cómo funciona

1

Analizamos tu robots.txt

Extraemos tu archivo robots.txt en vivo y lo analizamos exactamente como lo haría un rastreador real, probando el token de user-agent de cada bot contra tus reglas específicas. A menudo, lo que los webmasters creen que configuraron difiere de cómo los bots realmente lo interpretan.

2

Obtenemos tu página como cada bot

Enviamos solicitudes en vivo paralelas usando las cadenas exactas de user-agent de 11 principales rastreadores de IA, permitiéndote ver la respuesta exacta que tu servidor les devuelve.

Allowed
Blocked
3

Comparamos los resultados

Agregamos los códigos de estado HTTP, verificamos si se entregó contenido real y cruzamos la información con los permisos de robots.txt, brindándote una vista clara para identificar instantáneamente cualquier bot bloqueado.

Qué es lo que verifica

Estado HTTP por bot

Un 200 OK para un navegador humano podría ser un 403 Forbidden para un bot de IA debido a capas de seguridad. Exponemos estos fallos invisibles frente a frente.

Presencia de contenido real

Un estado 200 no es suficiente. Verificamos si el HTML realmente contiene texto legible (como H1s y párrafos), detectando fácilmente páginas en blanco solo de JavaScript o desafíos de bots de CDN.

Veredicto del Robots.txt

Evaluamos tus reglas de robots.txt en vivo frente a la ruta específica de tu URL para confirmar si a un agente de IA realmente se le permite rastrearla.

Tokens de solo entrenamiento

Tokens como Google-Extended rigen el uso del entrenamiento de datos en lugar del rastreo web activo. Reportamos sus directivas exactas directamente desde tu robots.txt.

Preguntas Frecuentes

Probamos 13 agentes clave. 11 reciben solicitudes en vivo (GPTBot, ChatGPT-User, OAI-SearchBot, ClaudeBot, Claude-User, PerplexityBot, Perplexity-User, Googlebot, Bingbot, Bytespider y Meta-ExternalAgent), mientras que 2 (Google-Extended, Applebot-Extended) se analizan puramente vía robots.txt ya que gobiernan reglas de entrenamiento de IA.
Esto generalmente sucede si tu página depende mucho del JavaScript del lado del cliente para renderizar texto (lo que algunos rastreadores no pueden ejecutar) o si un cortafuegos sirvió una página de desafío para bots. Ambos devuelven un estado de éxito 200, pero efectivamente ocultan tu contenido real de la IA.
Depende. Si el 403 es para bots de búsqueda o asistentes (como ChatGPT o Perplexity), sí—significa que no serás citado en respuestas de IA. Si bloqueaste a propósito a un recolector para que no tome tus datos para entrenamiento, un 403 significa que tus bloqueos de seguridad están funcionando correctamente.
Sí, estar bloqueado garantiza cero visibilidad para ese bot en específico. Sin embargo, si tu página es completamente accesible pero aún puntúa mal, el formato de tu contenido y tu estrategia de palabras clave pueden necesitar optimización.
Puedes volver a ejecutar esta herramienta inmediatamente para verificar tu nueva configuración. Sin embargo, el momento en que los rastreadores de IA reales decidan volver a visitar y reindexar tu sitio depende completamente de sus propios calendarios internos y no publicados.