Comprobador de Meta Robots y X-Robots-Tag en Lote
Datos comprobadosMeta Robots
Cómo usar el comprobador de meta robots en lote
Volver a la herramientaCada URL se solicita una vez y se leen los dos lugares donde puede vivir una regla de indexación: la etiqueta meta robots en el head y la cabecera de respuesta X-Robots-Tag.
- 01
Introduce las URL a comprobar
El modo individual comprueba una dirección y se ejecuta con Intro. Cambia a Masivo para pegar una lista, una URL por línea, hasta 30 por ejecución. Las páginas que conviene pegar juntas son las que deberían diferir: una página de producto que debe indexarse junto a una de búsqueda que no, así una sola ejecución muestra las dos respuestas lado a lado.
- 02
Elige el nivel de normalización de la URL
Normalizar URL reescribe cada dirección antes de solicitarla. URL completa conserva la ruta y la consulta pero elimina los parámetros de seguimiento y el fragmento; Sin parámetros quita la cadena de consulta; Solo dominio conserva solo el dominio. Las reglas de indexación se fijan por plantilla, y la cadena de consulta es lo que distingue una página de búsqueda de su listado; si la eliminas, compruebas el listado en su lugar.
- 03
Lee la columna Robots
La columna muestra las cadenas de directivas tal como se declaran, una por línea, y no juzga nada. Una directiva que nombra a un solo rastreador se muestra con ese nombre detrás, por ejemplo [googlebot], porque una palabra dirigida a un solo rastreador significa menos. Una celda vacía significa que no se declaró nada, y no es un fallo: esa página es indexable y seguible.
- 04
Inspecciona una fila y exporta los resultados
Ver resume las directivas y marca cada una con su origen: [html] para la etiqueta meta, [header] para la cabecera. La etiqueta meta vive en una plantilla; la cabecera, en la configuración del servidor o del CDN. Una segunda marca señala una directiva que nombra a un solo rastreador; el veredicto solo la cuenta cuando User agent está puesto en ese rastreador. Copiar tabla copia las filas separadas por tabuladores; Exportar CSV las escribe en un archivo.
Cómo leer el informe de noindex y nofollow
Una fila se lee de izquierda a derecha: la dirección comprobada, dónde aterrizó, y la regla que esa página fija para los rastreadores.
Columnas de la tabla de resultados
- URL
- La dirección exactamente como se comprobó: tras la normalización, no siempre lo que escribiste.
- URL resuelta
- Dónde terminó la petición y con qué estado. Las redirecciones se siguen primero, y la regla se lee de esa página final.
- Robots
- Todas las cadenas de directivas que declara la página final, una por línea, sin cambios, cada una con el nombre del rastreador detrás cuando se dirige solo a uno. — significa que no se declaró ninguna.
- Resultado
- Si la fila terminó, sigue en curso o se detuvo por un error. No dice nada sobre la regla en sí.
- Acciones
- Ver abre el panel de detalle de esa fila; Reintentar aparece en su lugar cuando la solicitud nunca llegó a completarse.
Conclusiones del panel de detalle
- Se permite indexar y seguir enlaces.
- Se declaró algo y nada de ello bloquea nada: un index explícito, un follow, o directivas que solo dan forma al fragmento. El mismo resultado que no declarar nada, dicho en voz alta.
- Sin directiva robots: por defecto es index, follow.
- No se declaró nada, así que se aplica el valor por defecto: indexable y seguible. Correcto para la mayoría de las páginas.
- nofollow: no se siguen los enlaces de esta página.
- La página es indexable pero sus enlaces no transmiten nada. Rara vez es lo que quiere una página pública, y se hereda con facilidad de una plantilla pensada para otra cosa.
- noindex: esta página no se indexará.
- La página queda fuera del índice. Correcto para una página de búsqueda o de agradecimiento, y el error más caro en una página que querías posicionar. none también cuenta aquí: es la abreviatura de noindex más nofollow.
- Las dos fuentes no coinciden: Google aplica la más estricta.
- Una fuente bloquea la indexación y otra no. Google toma la más estricta, así que la página queda fuera; leer solo la fuente permisiva te dice lo contrario.
- Nada de esto se aplica a todos los rastreadores: cada directiva de arriba nombra uno, y esas no se comprueban.
- Todo lo que la página declara se dirige a un rastreador con nombre, así que no hay regla general que juzgar. Lee tú mismo las directivas listadas: una página abierta a todos menos a Googlebot sigue siendo una página que Google no indexará.
- Las directivas que nombran un rastreador se muestran pero no se comprueban: el veredicto de arriba solo cubre las que se aplican a todos.
- La página declara los dos tipos. El veredicto solo es cierto para las reglas generales, y las que nombran a alguien quedan encima sin juzgar: vale la pena leerlas cuando el rastreador nombrado es el que te importa.
- Nada de esto se aplica a Googlebot Smartphone: cada directiva de arriba nombra a otro rastreador.
- Ejecutaste como un rastreador con nombre y cada línea que declara la página nombra a otro. Nada aquí restringe al rastreador elegido; las líneas listadas son para otros.
- El veredicto de arriba es para Googlebot Smartphone: las directivas que lo nombran cuentan, las que nombran a otros rastreadores no.
- Aparece cuando ejecutas como un rastreador con nombre y la página nombra a algún rastreador. Las líneas que nombran al rastreador elegido se suman a las reglas generales en el veredicto; las que nombran a otros solo se listan.
- Las directivas que cuentan para Googlebot Smartphone no coinciden: el veredicto de arriba sigue la más estricta.
- Ejecutaste como un rastreador con nombre y las líneas que se le aplican no coinciden: una bloquea la indexación y otra no. El veredicto toma la más estricta. Google documenta que hace lo mismo; otros rastreadores publican sus propias reglas.
De dónde puede venir una directiva
- [html]
- Una etiqueta <meta name="robots"> en el head de la página. Arréglala en la plantilla que renderice ese head.
- [header]
- Una cabecera de respuesta X-Robots-Tag. La única forma de poner una regla en un archivo sin head, un PDF o una imagen, y fácil de olvidar porque el código fuente de la página nunca la muestra. Corrígela en la configuración del servidor o del CDN.
- [googlebot] y otros nombres de rastreador
- Una directiva dirigida a un solo rastreador: <meta name="googlebot">, o una línea X-Robots-Tag con el nombre de un rastreador como prefijo. Se lista con ese nombre, y solo se juzga cuando User agent está puesto en ese rastreador. Lee esas líneas tú mismo: una página bloqueada solo para Googlebot no posicionará.