Acerca de las cabeceras Noindex
¿Qué es una cabecera noindex?
Una cabecera noindex es una instrucción para mantener una página fuera de los resultados de búsqueda, enviada con la respuesta HTTP en lugar de estar escrita en el HTML de la página. Hace lo mismo que una etiqueta meta noindex; simplemente llega por una vía diferente.
La cabecera que la contiene se llama X-Robots-Tag, y en la mayoría de la documentación verá que este nombre se utiliza indistintamente con el de cabeceras noindex. También puede incluir otras directivas, como nofollow o noarchive, pero noindex es la que tiene consecuencias que merece la pena comprobar.
Como la instrucción viaja en la respuesta, puede aplicarse a archivos que no tienen HTML en el que insertar una etiqueta meta: PDF, imágenes, hojas de cálculo y descargas. También es la forma de aplicar reglas a nivel del servidor a directorios completos de una sola vez.
¿Siguen siendo importantes las cabeceras noindex en 2026?
Son desproporcionadamente importantes porque son invisibles. Cualquiera que vea el código fuente de la página puede encontrar un noindex allí; en una cabecera no, y puede suprimir silenciosamente una página durante meses mientras todo el mundo inspecciona el HTML y no encuentra nada incorrecto.
También se configuran en el servidor o en la capa CDN, lo que significa que a menudo quedan completamente fuera del sistema de gestión de contenidos. La persona que está depurando una página que no se indexa con frecuencia no tiene acceso al lugar donde se encuentra la directiva.
Usados deliberadamente, siguen siendo la herramienta adecuada para archivos que no son HTML, una necesidad realmente habitual en sitios que publican documentos.
Cómo se relacionan las cabeceras noindex con la búsqueda mediante IA
Una cabecera noindex excluye el contenido de los índices exactamente del mismo modo que lo hace una etiqueta meta y, por tanto, también lo excluye del material en el que se basan las respuestas de la IA. En consecuencia, el coste de una cabecera accidental ha aumentado.
También se utiliza cada vez más para aplicar directivas específicas de IA a nivel de archivo, por lo que merece la pena entenderlo en lugar de tratarlo como un encabezado obsoleto que ya nadie configura.
En el caso concreto de los documentos, esto puede jugar a favor o en contra. Es mejor excluir aquí un PDF que preferiría que no se citara; un PDF que quiera que se encuentre no debería excluirse.
Buenas prácticas para los encabezados noindex
- Compruebe los encabezados de respuesta, no solo el HTML, cuando una página no se indexe.
- Utilícelos para archivos que no sean HTML, cuando una etiqueta meta no sea una opción.
- Mantenga las reglas del servidor acotadas. Una regla para todo un directorio puede afectar fácilmente a más elementos de los previstos.
- Asegúrate de que el encabezado no contradiga la metaetiqueta de la misma página.
- No combines un encabezado noindex con un bloqueo en robots.txt; una página bloqueada nunca se rastrea, por lo que el encabezado nunca se lee.
- Revísalo después de realizar cambios en la CDN o el alojamiento, ya que con frecuencia vuelven a introducir valores predeterminados.
Errores comunes
- Depurar un problema de indexación únicamente en el código fuente de la página, donde una directiva del encabezado es invisible.
- Aplicar una regla a un directorio que también contiene páginas que quieres que se indexen.
- Dejar un encabezado de la fase de pruebas después del lanzamiento, en el servidor en lugar de en el código.
- Dar por hecho que una CDN transmite los encabezados sin cambios cuando puede añadirlos o eliminarlos.
- Configurar una cabecera y una etiqueta meta que se contradicen y luego sorprenderse por cuál prevalece.
Qué comprueba esta herramienta
La herramienta inspecciona las cabeceras de respuesta HTTP de la página e indica si está presente una directiva noindex de X-Robots-Tag. Si encuentra una, lo indica como un error, ya que una página que estás probando es una página que quieres que se indexe.
Solo examina la respuesta. Un noindex incluido en el HTML de la página es una comprobación independiente, y merece la pena ejecutar ambas cuando una página no aparece en los resultados.
Qué hacer a continuación
Los problemas de indexación suelen deberse a una de estas tres instrucciones. Comprueba los
etiquetas meta noindex en el HTML de la página, revisa el archivo
robots.txt para detectar un bloqueo del rastreo que impida leer la página, y confirma que la página aparece en tu
Mapa del sitio XML.