Glosario Daimatics · SEO técnico

Noindex: sacar páginas de Google sin perder las que venden

El noindex es la regla que pide a los buscadores que no muestren una página en los resultados. Se pone con una meta robots en el <head> o con la cabecera HTTP X-Robots-Tag, y Google solo lo ve si puede rastrear la página: si el robots.txt la bloquea, no lo lee nunca. Bien puesto, limpia la búsqueda; olvidado donde no toca, hace desaparecer páginas que venden.

Para quien lleva una web y quiere sacar páginas de Google sin hacer daño, o ha perdido tráfico y sospecha de un noindex.

Cómo decirle a Google «esta, no»Cuatro herramientas
Meta robotsEn el <head> de cada páginaSaca de la búsqueda
X-Robots-TagEn el servidor; también para PDFSaca de la búsqueda
robots.txtFrena el rastreo, no la indexaciónNo la saca
Herramienta de retirada de URLsEsconde la URL unos seis mesesTemporal

Según la documentación de Google

Cómo funciona

Dos maneras de ponerlo y una condición

Puede ir en el código, como una de las meta tags, o en la respuesta del servidor. Cuando Google lo encuentra, saca la página de los resultados aunque otras webs enlacen a ella.

En el código de la página

Meta robots

<meta name="robots" content="noindex"> dentro del <head>. Con name="googlebot", solo la cumple Google.

En la respuesta del servidor

X-Robots-Tag

La cabecera X-Robots-Tag: noindex. Es la vía para PDF, imágenes y vídeos, y en Apache o nginx se aplica de una vez a todo un tipo de archivo.

La condición: elaraña de Google tiene que entrar en la página para leer la regla. Si el robots.txt la bloquea, el noindex no se ve nunca y la URL puede seguir saliendo si otras páginas enlazan a ella. Y Google no admite el noindex dentro del robots.txt.

Elegir bien

Noindex, robots.txt, canonical o 404: depende de lo que quieras

Cada herramienta hace una cosa diferente.

Quiero que la página…UsaOjo con
No salga en Google, pero la gente la pueda usarNoindexSi el robots.txt la bloquea, Google no lo verá.
Cuente como variante de otra (orden, color, talla)CanonicalUn noindex la saca del todo: para duplicados, Google recomienda el canonical.
No se rastree: es una de miles de URL sin valorrobots.txtNo saca la página del índice: una URL bloqueada puede salir igualmente.
Deje de existir404 o 410Si tiene sustituta, mejor una redirección 301.
No la vea nadie sin permiso (pruebas, zona privada)ContraseñaEl noindex no protege: cualquiera con el enlace entra.
Desaparezca hoy de los resultadosHerramienta de retirada de URLsDura unos seis meses: después hace falta un noindex, una contraseña o un 404.
Cuándo conviene

Dónde sí que lo pondríamos

Si nadie lo tiene que encontrar desde Google, no hace falta que esté. Y Google avisa de que dejar indexado contenido de poca calidad puede afectar al posicionamiento de la web.

Candidatos habituales
Resultados de la búsqueda interna. Combinaciones sin fin de lo que ya tienes en otras páginas.
Carrito, cuenta, página de gracias y textos legales. Sirven a quien ya está en la web, no a quien busca.
Contenido fino que todavía no puedes mejorar. Categorías o etiquetas con una sola entrada y fichas vacías, mientras las llenas o las fusionas.
Entornos de pruebas, como refuerzo: lo que los protege es la contraseña.

Nuestro criterio: con miles de filtros de una tienda, Google recomienda el robots.txt y no el noindex, que le obliga a pedir cada URL para descartarla. Pero si ya salen en Google, el orden es noindex primero y bloqueo después.

Cuándo es un error

El noindex que te cuesta tráfico

El visitante no lo ve, y puede pasar mucho tiempo sin que nadie lo detecte.

Dónde suele esconderse
El de la web de pruebas. Se pone para que Google no indexe el borrador y puede viajar con la copia al publicar. Revísalo en cada lanzamiento y migración.
La casilla de visibilidad de WordPress. Desde la versión 5.3 escribe noindex, nofollow en todas las páginas; antes, lo hacía con el robots.txt.
La plantilla del plugin SEO. Rank Math y similares fijan un robots por defecto para cada tipo de contenido: un noindex en la plantilla llega de golpe a todos los productos o entradas sin ajuste propio.

La señal de alarma, según Google: si las páginas indexadas bajan sin que suban los errores, mira si has bloqueado alguna con el robots.txt, un noindex o un inicio de sesión.

Cómo se comprueba

Cómo saber si un noindex te ha sacado de Google

01

Mira el informe de indexación

En Search Console, el informe de indexación de páginas agrupa las URL que Google ha dejado fuera por un noindex. Si sale ahí una página que vende, ya tienes al culpable.

02

Inspecciona la URL

La inspección de URLs dice si la indexación está permitida y enseña el HTML que ha recibido Google. Ojo: si el robots.txt la bloquea, dirá que sí, porque no ha leído el noindex.

03

Prueba la versión publicada

La prueba en directo mira la página tal como es ahora. Si el noindex ya no está, solicita la indexación; para muchas URL, envía un sitemap.

04

Revisa toda la web

Un rastreador como Screaming Frog encuentra todas las URL con noindex y las bloqueadas por el robots.txt.

Comprobador

Pega la respuesta de una página y mira si Google la puede indexar

Aplica las reglas de Google a la dirección, las cabeceras, el código y el robots.txt que pongas.

Hace falta para comprobar el robots.txt.
En la terminal, curl -I seguido de la dirección.
En Chrome, Ctrl+U (en Mac, Cmd+Opción+U).
Está en /robots.txt, en la raíz del dominio.

Ejemplo ilustrativo. Todo pasa en tu navegador y no se envía nada. No ejecuta JavaScript ni ve el índice de Google: eso lo hace la inspección de URLs.

Para Google, la páginaEstá bloqueada

Google no puede entrar en ella y no leerá nunca el noindex: la URL puede seguir saliendo, sin descripción. Si la quieres fuera, desbloquéala.

Detalle

  • Código HTTP: 200
  • X-Robots-Tag: noindex
  • Regla del robots.txt que se aplica: Disallow: /search
Cuándo necesitas ayuda

Cuando el noindex ya no se resuelve solo

  • Search Console excluye por noindex páginas de servicio o de producto, y no sabes quién lo pone.
  • Has perdido tráfico después de una migración o de un cambio de tema.
  • Tienes que sacar de Google cientos de URL sin tocar las que venden.
  • El robots.txt, los noindex y los canonicals se contradicen y no sabes cuál manda.

En Daimatics, en una auditoría de SEO técnico, el noindex accidental y las páginas clave sin indexar se arreglan primero, con el robots.txt, los canonicals y los sitemaps.

Preguntas frecuentes

Dudas sobre el noindex

La regla

Primero, que Google pueda entrar; después, que lea el noindex. Si el robots.txt lo bloquea, no lo verá.

¿Qué es el noindex y para qué sirve?
Es una regla que pide a los buscadores que no muestren una página o un archivo en los resultados. Se pone en una meta robots en el head o en la cabecera HTTP X-Robots-Tag. Sirve para dejar fuera de Google páginas útiles solo para quien ya está en la web, como el carrito o la búsqueda interna, sin que dejen de funcionar.
¿Qué diferencia hay entre noindex y nofollow?
El noindex controla si la página aparece en Google; el nofollow, qué pasa con los enlaces. En la meta robots, nofollow pide a Google que no siga ningún enlace de la página; en un enlace concreto, indica que no quieres asociar tu web con ese destino. Se pueden combinar: noindex, nofollow, o none, que equivale a los dos.
¿Cómo pongo un noindex en WordPress?
Página a página, con el plugin SEO: Rank Math, por ejemplo, tiene un robots por defecto para cada tipo de contenido y deja cambiarlo en cada entrada. Para toda la web está la casilla de visibilidad de los Ajustes de lectura, que añade noindex, nofollow a todas las páginas: útil mientras la web se construye, peligrosa si nadie la desmarca.
¿Cómo pongo noindex en un PDF?
Un PDF no tiene head, así que el noindex va en la cabecera HTTP que envía el servidor: X-Robots-Tag: noindex. En Apache se puede poner en el .htaccess para todos los PDF de la web, y en nginx, en la configuración del sitio. Vale igual para imágenes y vídeos. Y el robots.txt no los tiene que bloquear, o Google no verá la cabecera.
¿Cuánto tarda Google en sacar una página con noindex?
Lo que tarde en volver a rastrearla, que según Google pueden ser meses, en función de la importancia de la página. Puedes solicitar el rastreo desde la inspección de URLs de Search Console. Si corre prisa, la herramienta de retirada de URLs la saca de los resultados en un día y durante unos seis meses, mientras el noindex hace el trabajo definitivo.
Escrito por David Nogués, fundador y CEO de Daimatics, con más de 20 años de trayectoria profesional en el ámbito digital. Actualizado el

Fuentes oficiales

Google Search Central

Ayuda de Search Console

WordPress y plugins