Verificador de Indexabilidad

Verificar indexabilidad
Siguiente

Una página puede ser perfectamente buena pero invisible para la búsqueda porque una sola etiqueta dice “noindex” o robots.txt bloquea al rastreador. Pega una URL y este verificador evalúa cada señal que Google utiliza, robots.txt, meta robots, encabezado X-Robots-Tag, objetivo canónico, estado HTTP, y te dice si la página es indexable, por qué y qué cambiar si no lo es.

Cómo verificar la indexabilidad

  1. 1

    Ingresa una URL

    El verificador obtiene la URL como lo haría Googlebot.

  2. 2

    Resuelve redirecciones

    Se rastrea una cadena de saltos 301/302; la URL final es la que se evalúa.

  3. 3

    Lee cada señal de indexabilidad

    Reglas de robots.txt, meta robots, X-Robots-Tag, canónico, código de estado.

  4. 4

    Veredicto y razón

    Indexable / no indexable / parcial, con la señal exacta que causó el veredicto.

Señales de indexabilidad y su precedencia

Google evalúa un conjunto de señales en un orden específico; un solo negativo en la cadena es suficiente para bloquear la indexación.

Orden de evaluación de señales

  1. Estado HTTP: se requiere 2xx. Se siguen las cadenas 3xx; 4xx y 5xx terminan la indexación.
  2. robots.txt: si la URL está prohibida para Googlebot, la página nunca se rastrea, lo que significa que las etiquetas noindex en ella nunca se ven.
  3. Encabezado X-Robots-Tag: noindex en los encabezados de respuesta HTTP bloquea la indexación.
  4. Meta robots: <meta name="robots" content="noindex"> bloquea la indexación.
  5. Canónico: un canónico que apunta a otro lugar significa que Google indexa esa otra URL en su lugar.
  6. Calidad del contenido y detección de duplicados: Google puede omitir la indexación incluso sin directivas explícitas.

Errores comunes que esto detecta

Problema Causa
Sección completa no indexada Regla Disallow: en robots.txt
Página específica no indexada noindex en meta robots
Indexada con URL incorrecta Canónico apunta a otro lugar
Atascada en 5xx Error del servidor interrumpe el rastreo
Conflicto entre Disallow + noindex Robots.txt bloquea el rastreo, la etiqueta noindex nunca se lee
Filtraciones de staging a producción X-Robots-Tag: noindex sobrante de un entorno de prueba

La trampa de robots.txt + noindex

Si Disallow: una URL en robots.txt, Google nunca la rastrea, por lo que nunca ve ninguna etiqueta noindex. La URL aún puede aparecer en los resultados de búsqueda como una entrada “en blanco” con solo la URL y sin descripción. Para eliminar una URL del índice correctamente, permite el rastreo y usa noindex, luego bloquea el rastreo solo después de que Google la haya desindexado.

Pruebas desde la perspectiva de Googlebot

El verificador envía el agente de usuario de Googlebot, por lo que cualquier truco del lado del servidor “los rastreadores solo ven X” es visible. Siempre verifica las URLs de producción, no las de staging.

Preguntas frecuentes

Ser indexable solo significa que no hay un bloqueo técnico; no garantiza la indexación. Google también decide en función de la calidad percibida, contenido duplicado y presupuesto de rastreo. Usa la Inspección de URL de Search Console para una respuesta definitiva de Google mismo.

Generalmente solo meta robots (o X-Robots-Tag) es la respuesta correcta. Robots.txt bloquea el rastreo; meta robots bloquea la indexación. Para páginas que no deseas indexar, permite el rastreo para que Google pueda leer tu etiqueta noindex.

Google evalúa el destino final de una cadena de redirección. Un 301 de A a B significa que Google indexa finalmente B, no A. El verificador simula esto resolviendo todas las redirecciones antes de evaluar.

No. Las páginas que requieren autenticación no son indexables por definición. Si necesitas SEO para ellas, considera una versión de vista previa pública.

Herramientas relacionadas

Herramienta disponible en otros idiomas