Gratis · Análisis del lado del servidor
Inspector de indexabilidad y canonical
Pega una URL. La obtenemos de forma segura, comprobamos robots.txt, meta robots, X-Robots-Tag, rel=canonical y hreflang para un perfil de navegador o bot, y te explicamos cada bloqueo, conflicto y problema de canonical, sin afirmar nunca que un motor la indexará o la posicionará.
De un vistazo
- Rastrea la cadena de redirecciones, el estado final y la regla de robots.txt que coincide con tu ruta.
- Lee meta robots, X-Robots-Tag, canonical y hreflang para el navegador, Googlebot o Bingbot.
- Obtén un veredicto en lenguaje sencillo con la señal observada exacta y una solución práctica para cada hallazgo.
Qué significa esto
Las señales guían a los rastreadores, nunca garantizan la indexación
robots.txt, meta robots, X-Robots-Tag, rel=canonical y hreflang le indican a los rastreadores qué pueden obtener, qué URL tratar como canonical y dónde están los equivalentes en otros idiomas. Este inspector lee esas señales de la respuesta en bruto e informa de lo que dicen. Solo el motor de búsqueda decide qué rastrea, indexa, posiciona o selecciona en realidad.
¿Qué cambian los perfiles de navegador, Googlebot y Bingbot?
El perfil establece el User-Agent y qué reglas se aplican. Googlebot coincide con los grupos de robots.txt de Googlebot y sus directivas meta name="robots" más las X-Robots-Tag con ámbito googlebot; Bingbot coincide con las reglas y directivas de Bingbot/MSNBot; un navegador solo coincide con los grupos robots comodín. Los tres leen las mismas etiquetas rel="canonical" y hreflang.
¿Qué significan indexable, bloqueada, en conflicto y desconocida?
Indexable significa que ninguna señal observada detiene esta URL. Bloqueada significa que robots.txt o una directiva noindex lo impide explícitamente. En conflicto significa que las señales se contradicen entre sí; por ejemplo, robots.txt bloquea la página de modo que el rastreador nunca puede ver su noindex de meta name="robots", o un rel="canonical" apunta a una URL que a su vez es noindex. Desconocida significa que no se pudo confirmar una señal, como un robots.txt ilegible.
¿Esto me dice si Google ha indexado la página?
No. Solo lee señales de la página y de robots.txt: lo que un motor podría ver si la rastreara. Para el estado de indexación con autoridad del motor, usa la Inspección de URL de Google Search Console y Bing Webmaster Tools, a las que este informe enlaza.
¿Renderiza JavaScript?
No. Solo inspecciona la respuesta HTML en bruto. Las etiquetas canonical, robots o hreflang inyectadas por JavaScript del lado del cliente no se evalúan, y el informe lo indica.
¿Se almacenan las URL comprobadas?
No. El servidor obtiene tu URL, su robots.txt y, como mucho, un objetivo canonical en memoria porque las reglas CORS del navegador bloquean las comprobaciones directas. Las solicitudes se ejecutan con protecciones de red privada, DNS, tiempo de espera, redirecciones y tamaño de respuesta, y nada de lo que envías se guarda ni se incrusta en los enlaces para compartir.