¿Qué es la etiqueta noindex?

Una etiqueta noindex es una regla que se agrega a una página, como metaetiqueta robots o como encabezado de respuesta HTTP X-Robots-Tag, para indicar a los buscadores que no incluyan esa página en los resultados de búsqueda. Cuando Google rastrea la página y ve la regla, la elimina por completo de sus resultados, aunque otros sitios enlacen a ella.


SEO

Más sobre la etiqueta noindex

Puedes agregar la metaetiqueta noindex a la sección `<head>` del HTML de una página, o enviar la misma regla en un encabezado de respuesta HTTP X-Robots-Tag. En ambos casos, el rastreador tiene que llegar a la página para poder ver la regla. Si un archivo robots.txt bloquea la página, el rastreador nunca ve la regla noindex y la página puede seguir apareciendo en los resultados de búsqueda, por ejemplo, cuando otras páginas enlazan a ella. Por eso, revisa tu robots.txt antes de confiar en noindex, no después.

Las etiquetas noindex son para páginas que tu sitio necesita, pero que no tienen razón de aparecer en el índice de un buscador ni en las páginas de resultados. Las páginas de agradecimiento, las de inicio de sesión del administrador y los archivos de autor son los ejemplos clásicos: tu sitio puede necesitarlas, pero nadie las va a buscar en Google.

Cómo agregar una etiqueta noindex

La versión de metaetiqueta es una sola línea dentro del `<head>` de la página:

`<meta name=”robots” content=”noindex”>`

Esta regla se aplica a los rastreadores que la admiten, incluido Google. Para archivos que no son HTML, como los PDF, no hay un `<head>` donde colocar una metaetiqueta, así que el servidor envía la misma instrucción como encabezado de respuesta HTTP: `X-Robots-Tag: noindex`.

En WordPress casi nunca escribes la etiqueta a mano: los plugins de SEO incluyen un ajuste por página que la genera por ti. Eso sí, ten cuidado con la versión para todo el sitio: la casilla de Ajustes → Lectura que pide a los buscadores no indexar tu sitio agrega una metaetiqueta noindex,nofollow a todas sus páginas (en WordPress 5.3 y versiones posteriores). Es útil mientras el sitio está en construcción, y un clásico accidente de lanzamiento cuando se queda activada. Desmárcala antes de publicar tu sitio.

Noindex no detiene el rastreo

Una etiqueta noindex controla la indexación, no el rastreo. De hecho, depende de él: el buscador tiene que visitar la página y leer la etiqueta antes de poder aplicar la regla. La documentación de Google sobre noindex explica lo que sigue: cuando Googlebot rastrea la página y extrae la regla, la página se elimina por completo de los resultados de Google, sin importar si otros sitios enlazan a ella.

Diagrama de flujo con los dos resultados posibles de una página con etiqueta noindex. Cuando robots.txt permite el rastreo, el rastreador lee la regla noindex y la página se elimina de los resultados de búsqueda; cuando robots.txt bloquea el rastreo, el rastreador nunca ve la etiqueta y la página puede seguir apareciendo en los resultados mediante enlaces desde otros sitios.

Noindex tampoco es una herramienta de privacidad. La página sigue publicada, así que cualquiera con la URL puede visitarla, igual que los bots que ignoran la regla. Solo la protección con contraseña restringe el acceso de verdad, y por eso Google la recomienda para el contenido que debe mantenerse privado.

Diferencias entre noindex, nofollow y robots.txt

Estos tres controles se confunden entre sí, pero hacen trabajos distintos:

  • Noindex mantiene fuera de los resultados de búsqueda una página que sí se puede rastrear. Los visitantes y los rastreadores todavía pueden llegar a ella.
  • Robots.txt administra el tráfico de los rastreadores. La documentación de robots.txt de Google aclara que no es un mecanismo para mantener una página web fuera de Google, porque una página bloqueada aún puede indexarse si otras páginas enlazan a ella.
  • El atributo nofollow se aplica a un enlace individual y les indica a los buscadores que no le transfieran autoridad. No elimina nada del índice.

La regla para decidir: usa noindex para páginas que deben existir pero no aparecer en los resultados de búsqueda. Usa robots.txt para que los rastreadores no pierdan tiempo en secciones que no les interesan, nunca para ocultar una página. Usa protección con contraseña para lo verdaderamente privado. Y si dos páginas están duplicadas, no le pongas noindex a la copia: define una URL canónica para que los buscadores sepan cuál versión mostrar.

Cómo comprobar que la etiqueta noindex funciona

La eliminación no es instantánea: Google primero tiene que volver a rastrear la página y ver la etiqueta, y ese nuevo rastreo puede tardar de unos días a varias semanas. Para confirmar que funcionó, abre la herramienta de inspección de URLs en Google Search Console: ahí verás si la regla noindex se detectó en el último rastreo. Desde la misma herramienta puedes solicitar un nuevo rastreo para acelerar el proceso, aunque Google no promete fechas.

Si la página sigue apareciendo semanas después, el culpable habitual es el que ya vimos: robots.txt está bloqueando la página y Google nunca vio la etiqueta. Corrige el bloqueo y solicita otro rastreo. ¿Apenas conoces Search Console? Nuestra guía para principiantes de Google Search Console cubre lo básico.

Frequently Asked Questions

¿Puedo poner la regla noindex en mi archivo robots.txt?

No. Google dejó de admitir la directiva no oficial noindex en robots.txt el 1 de septiembre de 2019. Su documentación ahora indica que robots.txt no es un mecanismo para mantener una página fuera de Google. Usa una metaetiqueta robots o un encabezado X-Robots-Tag.

¿Puedo combinar noindex con nofollow?

Sí. Una metaetiqueta robots acepta varias reglas separadas por comas. Con content="noindex,nofollow" la página queda fuera de los resultados de búsqueda y, además, les pides a los rastreadores que no sigan los enlaces que contiene.

¿Es mejor ponerle noindex a una página o eliminarla?

Noindex es para páginas que tus visitantes todavía necesitan, como la de confirmación de un pedido. Si ya nadie necesita la página, mejor elimínala. Una etiqueta noindex mantiene una página activa fuera de los resultados de búsqueda; no sustituye el borrado de contenido que ya no debería existir.

¿Puedo dejar fuera de Google solo una parte de una página?

La regla noindex es de todo o nada para la página. Para un control más fino, Google admite el atributo data-nosnippet en elementos HTML, que deja el texto marcado fuera de los fragmentos de los resultados mientras la página sigue indexada.

Oferta especial
Servicios profesionales de SEO
El equipo de DreamHost Pro Services te ayuda a mejorar tu posicionamiento y a que más personas te encuentren en internet. Déjanos encargarnos de la estrategia SEO para aumentar el tráfico de tu sitio web.