Cómo usar esta herramienta

Comprobador de Meta Robots y X-Robots-Tag en Lote

Datos comprobadosMeta Robots

Cómo usar el comprobador de meta robots en lote

Volver a la herramienta

Cada URL se solicita una vez y se leen los dos lugares donde puede vivir una regla de indexación: la etiqueta meta robots en el head y la cabecera de respuesta X-Robots-Tag.

  1. 01

    Introduce las URL a comprobar

    El modo individual comprueba una dirección y se ejecuta con Intro. Cambia a Masivo para pegar una lista, una URL por línea, hasta 30 por ejecución. Las páginas que conviene pegar juntas son las que deberían diferir: una página de producto que debe indexarse junto a una de búsqueda que no, así una sola ejecución muestra las dos respuestas lado a lado.

  2. 02

    Elige el nivel de normalización de la URL

    Normalizar URL reescribe cada dirección antes de solicitarla. URL completa conserva la ruta y la consulta pero elimina los parámetros de seguimiento y el fragmento; Sin parámetros quita la cadena de consulta; Solo dominio conserva solo el dominio. Las reglas de indexación se fijan por plantilla, y la cadena de consulta es lo que distingue una página de búsqueda de su listado; si la eliminas, compruebas el listado en su lugar.

  3. 03

    Lee la columna Robots

    La columna muestra las cadenas de directivas tal como se declaran, una por línea, y no juzga nada. Una directiva que nombra a un solo rastreador se muestra con ese nombre detrás, por ejemplo [googlebot], porque una palabra dirigida a un solo rastreador significa menos. Una celda vacía significa que no se declaró nada, y no es un fallo: esa página es indexable y seguible.

  4. 04

    Inspecciona una fila y exporta los resultados

    Ver resume las directivas y marca cada una con su origen: [html] para la etiqueta meta, [header] para la cabecera. La etiqueta meta vive en una plantilla; la cabecera, en la configuración del servidor o del CDN. Una segunda marca señala una directiva que nombra a un solo rastreador; el veredicto solo la cuenta cuando User agent está puesto en ese rastreador. Copiar tabla copia las filas separadas por tabuladores; Exportar CSV las escribe en un archivo.

Cómo leer el informe de noindex y nofollow

Una fila se lee de izquierda a derecha: la dirección comprobada, dónde aterrizó, y la regla que esa página fija para los rastreadores.

Columnas de la tabla de resultados

URL
La dirección exactamente como se comprobó: tras la normalización, no siempre lo que escribiste.
URL resuelta
Dónde terminó la petición y con qué estado. Las redirecciones se siguen primero, y la regla se lee de esa página final.
Robots
Todas las cadenas de directivas que declara la página final, una por línea, sin cambios, cada una con el nombre del rastreador detrás cuando se dirige solo a uno. — significa que no se declaró ninguna.
Resultado
Si la fila terminó, sigue en curso o se detuvo por un error. No dice nada sobre la regla en sí.
Acciones
Ver abre el panel de detalle de esa fila; Reintentar aparece en su lugar cuando la solicitud nunca llegó a completarse.

Conclusiones del panel de detalle

Se permite indexar y seguir enlaces.
Se declaró algo y nada de ello bloquea nada: un index explícito, un follow, o directivas que solo dan forma al fragmento. El mismo resultado que no declarar nada, dicho en voz alta.
Sin directiva robots: por defecto es index, follow.
No se declaró nada, así que se aplica el valor por defecto: indexable y seguible. Correcto para la mayoría de las páginas.
nofollow: no se siguen los enlaces de esta página.
La página es indexable pero sus enlaces no transmiten nada. Rara vez es lo que quiere una página pública, y se hereda con facilidad de una plantilla pensada para otra cosa.
noindex: esta página no se indexará.
La página queda fuera del índice. Correcto para una página de búsqueda o de agradecimiento, y el error más caro en una página que querías posicionar. none también cuenta aquí: es la abreviatura de noindex más nofollow.
Las dos fuentes no coinciden: Google aplica la más estricta.
Una fuente bloquea la indexación y otra no. Google toma la más estricta, así que la página queda fuera; leer solo la fuente permisiva te dice lo contrario.
Nada de esto se aplica a todos los rastreadores: cada directiva de arriba nombra uno, y esas no se comprueban.
Todo lo que la página declara se dirige a un rastreador con nombre, así que no hay regla general que juzgar. Lee tú mismo las directivas listadas: una página abierta a todos menos a Googlebot sigue siendo una página que Google no indexará.
Las directivas que nombran un rastreador se muestran pero no se comprueban: el veredicto de arriba solo cubre las que se aplican a todos.
La página declara los dos tipos. El veredicto solo es cierto para las reglas generales, y las que nombran a alguien quedan encima sin juzgar: vale la pena leerlas cuando el rastreador nombrado es el que te importa.
Nada de esto se aplica a Googlebot Smartphone: cada directiva de arriba nombra a otro rastreador.
Ejecutaste como un rastreador con nombre y cada línea que declara la página nombra a otro. Nada aquí restringe al rastreador elegido; las líneas listadas son para otros.
El veredicto de arriba es para Googlebot Smartphone: las directivas que lo nombran cuentan, las que nombran a otros rastreadores no.
Aparece cuando ejecutas como un rastreador con nombre y la página nombra a algún rastreador. Las líneas que nombran al rastreador elegido se suman a las reglas generales en el veredicto; las que nombran a otros solo se listan.
Las directivas que cuentan para Googlebot Smartphone no coinciden: el veredicto de arriba sigue la más estricta.
Ejecutaste como un rastreador con nombre y las líneas que se le aplican no coinciden: una bloquea la indexación y otra no. El veredicto toma la más estricta. Google documenta que hace lo mismo; otros rastreadores publican sus propias reglas.

De dónde puede venir una directiva

[html]
Una etiqueta <meta name="robots"> en el head de la página. Arréglala en la plantilla que renderice ese head.
[header]
Una cabecera de respuesta X-Robots-Tag. La única forma de poner una regla en un archivo sin head, un PDF o una imagen, y fácil de olvidar porque el código fuente de la página nunca la muestra. Corrígela en la configuración del servidor o del CDN.
[googlebot] y otros nombres de rastreador
Una directiva dirigida a un solo rastreador: <meta name="googlebot">, o una línea X-Robots-Tag con el nombre de un rastreador como prefijo. Se lista con ese nombre, y solo se juzga cuando User agent está puesto en ese rastreador. Lee esas líneas tú mismo: una página bloqueada solo para Googlebot no posicionará.