Acerca de las metaetiquetas noindex
¿Qué es una etiqueta noindex?
Una etiqueta meta noindex indica a los motores de búsqueda que excluyan una página de sus resultados. A diferencia de un bloqueo en robots.txt, que impide que la página se rastree por completo, noindex requiere que la página se rastree y se lea, y, como resultado, se respeta de forma fiable.
Es el instrumento adecuado para las páginas que deben existir, pero no deberían aparecer en las búsquedas: páginas de agradecimiento, resultados de búsqueda internos, contenido de entornos de pruebas, versiones de impresión duplicadas y listados filtrados que, de otro modo, saturarían el índice.
Vale la pena ejecutar un comprobador de etiquetas noindex en cualquier página importante, porque este es uno de los pocos fallos técnicos que son a la vez invisibles y totales. La página parece perfecta, carga correctamente y, sencillamente, nunca aparece.
¿Sigue siendo importante noindex en 2026?
Su importancia radica sobre todo en detectar errores. Un noindex accidental es uno de los pocos errores que pueden eliminar por completo una página, una sección o un sitio entero de los resultados de búsqueda, y es fácil publicarlo por accidente cuando una configuración del entorno de staging llega a producción.
Usado deliberadamente, sigue siendo valioso. Mantener las páginas de poco valor fuera del índice concentra el esfuerzo de rastreo en las páginas que lo merecen, algo que cobra más importancia a medida que los sitios crecen.
La recuperación también es más lenta que el error. Eliminar un noindex no restaura una página de inmediato; es necesario volver a rastrearla, reevaluarla y reincorporarla, lo que puede tardar semanas.
Cómo se relaciona noindex con la búsqueda con IA
Una página excluida del índice generalmente queda excluida del conjunto de fuentes del que un modelo obtiene información, por lo que un noindex elimina una página tanto de las respuestas de IA como de los resultados de búsqueda.
Eso hace que un noindex accidental sea considerablemente más costoso que antes. Ya no elimina un canal de tráfico; elimina todos los canales que comienzan con un índice, incluidos aquellos que aún no has empezado a medir.
También vale la pena considerar lo contrario. Si hay páginas que realmente no quieres que se citen, noindex es un instrumento más directo y fiable que intentar controlarlo a nivel del rastreador.
Buenas prácticas para noindex
- Usa noindex en lugar de un bloqueo en robots.txt cuando el objetivo sea mantener una página fuera de los resultados.
- No combines ambos. Una página bloqueada nunca puede leerse, por lo que su noindex nunca se detecta.
- Compruébalo después de cada despliegue, especialmente cuando el entorno de staging y producción compartan la misma base de código.
- Deja que los enlaces de una página con noindex se puedan seguir, salvo que tengas un motivo específico para no hacerlo.
- Mantén las páginas con noindex fuera de tu sitemap XML; enviarlas transmite señales contradictorias.
- Elimínalo en cuanto una página esté lista para ser encontrada, ya que la recuperación no es inmediata.
Errores comunes
- Lanzar el sitio con el noindex de staging todavía activo, que es la variante más perjudicial de este error.
- Aplicarlo a todo el sitio mediante una configuración del plugin destinada a una sola página.
- Usar noindex en páginas que también quieres que posicionen, creyendo que gestiona el contenido duplicado; en ese caso, la herramienta adecuada es una etiqueta canonical.
- Bloquear una página en robots.txt y añadir noindex, de modo que la directiva nunca se lea.
- Olvidar que una directiva también puede llegar en la cabecera HTTP en lugar de en el HTML.
Qué comprueba esta herramienta
El comprobador de etiquetas noindex lee el HTML de la página e informa de si hay una directiva noindex presente en una etiqueta meta robots. Si encuentra una, lo indica como un fallo, partiendo de la base de que una página que estás comprobando es una página que quieres que se encuentre.
Solo examina el HTML. Una directiva enviada en su lugar en la cabecera de respuesta HTTP es una comprobación independiente, y conviene ejecutarla cuando una página no se indexa y el código fuente parece correcto.
Qué hacer a continuación
La indexación depende de que coincidan varias señales. Comprueba los
Cabeceras X-Robots-Tag por si la directiva llega en la respuesta en lugar de en el HTML, revisa tu
robots.txt para detectar un bloqueo del rastreo que impida leer la página, y confirma que la página aparece en tu
Mapa del sitio XML.