ClasesSEO
ES EN
Optimización de motores de búsqueda SEO

Meta robots: qué es la etiqueta noindex y cómo controlar qué indexa Google

9 min de lectura Read in English
Meta robots: qué es la etiqueta noindex y cómo controlar qué indexa Google
Tabla de contenidos

¿Crees que robots.txt sirve para sacar páginas de Google? Es el error de indexación más repetido: robots.txt bloquea el rastreo, no la indexación. La herramienta correcta para decidir qué entra en el índice, página por página, es la etiqueta meta robots con la directiva noindex.

Aquí verás qué es la etiqueta meta robots, qué directivas entiende Google en 2026, cómo usar noindex para quitar páginas de los resultados y cuándo conviene el X-Robots-Tag en lugar del HTML. También aclaramos el mito más caro del SEO técnico: noindex no funciona si la página está bloqueada en robots.txt.

Qué es la etiqueta meta robots y qué controla

La etiqueta meta robots es una instrucción en el HTML que dice a los buscadores si una página concreta debe aparecer en los resultados y cómo mostrarla. Funciona a nivel de documento, no de archivo ni de sitio:

<meta name="robots" content="noindex">

Es el complemento natural de robots.txt para controlar la indexación. Si quieres repasar la diferencia con el archivo y sus directivas, tienes la guía de cómo crear un robots.txt correcto.

Google no exige que la etiqueta viva en el head: respeta la instrucción aunque esté en el cuerpo de la página, y los atributos name y content no distinguen mayúsculas. Sirve para googlebot y googlebot-news como tokens de user-agent; otros valores se ignoran. En WordPress no hace falta tocar HTML: Yoast SEO permite activar el noindex desde Advanced.

Meta robots vs robots.txt en una frase

robots.txt decide si Google puede entrar a rastrear la página; meta robots decide si la página puede salir en resultados. Y un detalle que sorprende: noindex dentro de robots.txt no está soportado por Google. El archivo solo bloquea el crawling; nunca quita una URL del índice por sí solo.

Directivas meta robots que Google entiende (y cuáles ya no usa)

La etiqueta acepta varias reglas separadas por comas. Google documenta como válidas:

  • noindex: no mostrar la página en resultados.
  • nofollow: no seguir los enlaces de la página.
  • none: equivale a noindex, nofollow.
  • nosnippet: sin snippet de texto ni preview de vídeo (una imagen estática aún es posible).
  • max-snippet:[número]: máximo de caracteres del snippet; 0 equivale a nosnippet y -1 permite cualquier longitud.
  • max-image-preview:[none|standard|large]: tamaño máximo de la preview de imagen.
  • max-video-preview:[segundos]: duración máxima de la preview de vídeo.
  • noimageindex: no indexar las imágenes de la página.
  • indexifembedded: solo con noindex; permite indexar si el contenido va embebido en un iframe.
  • notranslate: no ofrecer traducción automática.
  • unavailable_after:[fecha]: dejar de mostrar la página tras una fecha (formato RFC 822).

Las reglas se combinan con comas o en varias meta tags con el mismo efecto:

<meta name="robots" content="noindex, nofollow">

Si dos reglas entran en conflicto, gana la más restrictiva: con max-snippet:50 más nosnippet, manda nosnippet.

Reglas históricas que ya no se usan (anti-mito)

noarchive quedó obsoleta porque Google eliminó el enlace de "caché"; nocache y nositelinkssearchbox tampoco se usan. La documentación oficial las agrupa como reglas históricas. No pierdas tiempo con ellas.

noindex: cómo quitar una página de Google paso a paso

Para quitar una página de los resultados, implementa noindex en una de dos capas: la meta tag en el HTML o la cabecera HTTP X-Robots-Tag. El efecto es el mismo; elige la cómoda para tu stack. Cuando Googlebot rastrea la URL y ve el noindex, la elimina por completo de los resultados aunque otros sitios la enlacen.

La condición crítica: la página no debe estar bloqueada en robots.txt. Si el archivo la bloquea, Googlebot nunca ve el noindex y la URL puede seguir apareciendo durante meses. Es la causa número uno de "puse noindex y sigue en Google".

Usa noindex cuando no tienes acceso root al servidor y necesitas control página por página: thank-you pages, logins, resultados de búsqueda interna, páginas finas o de baja calidad, landing pages de anuncios y staging.

Qué NO hacer con noindex

No lo uses para contenido duplicado: ahí la respuesta es el canonical, que consolida señales en vez de esconder. Si los duplicados son un problema recurrente, revisa el artículo sobre el impacto del contenido duplicado en el SEO. Tampoco lo mantengas por largo tiempo en páginas que deben pasar autoridad: Google deja de rastrearlas y sus enlaces dejan de transmitir link equity; "noindex, follow" no lo salva a largo plazo (John Mueller).

X-Robots-Tag: cuando el HTML no basta (PDFs, imágenes, vídeo)

El X-Robots-Tag es una cabecera HTTP que aplica las mismas reglas que la meta robots a cualquier recurso. Es imprescindible para lo que no puede llevar una meta tag dentro: PDFs, imágenes, vídeos y respuestas no HTML.

Se pueden enviar varias cabeceras o una lista separada por comas, opcionalmente por user-agent:

X-Robots-Tag: googlebot: nofollow
X-Robots-Tag: otherbot: noindex, nofollow

La implementación depende del servidor: en Apache, un bloque FilesMatch en .htaccess noindexea todos los PDFs sin tocar cada archivo; en nginx se hace en el bloque de location; muchos plugins de CMS exponen un campo para cabeceras. Controlas tipos de archivo enteros con una regla.

nofollow en meta robots vs rel="nofollow": la confusión clásica

Son dos cosas distintas que se mezclan constantemente. La directiva nofollow de meta robots significa "no sigas ningún enlace de esta página"; el atributo rel="nofollow" en un enlace concreto significa "no sigas este enlace".

Si tu problema es con enlaces puntuales, la solución es el rel nofollow, explicado en el artículo sobre cómo usar la etiqueta nofollow. El nofollow global de página se reserva para páginas que no quieres indexar ni rastrear del todo, normalmente junto a noindex.

Controla tu snippet (y tu contenido en IA): nosnippet, max-snippet y data-nosnippet

nosnippet evita el snippet de texto y la preview de vídeo (la miniatura estática puede aparecer si mejora la experiencia). max-snippet:0 equivale a nosnippet y max-snippet:-1 deja la longitud libre.

Novedad vigente (documentación oficial actualizada en 2026): nosnippet y max-snippet aplican a todas las superficies, incluidas la búsqueda web, Google Images, Discover, AI Overviews y AI Mode. Si aplicas estas reglas, Google no usa el contenido como entrada directa para generar esas respuestas de IA. Controlar el snippet es también controlar cómo tu contenido entra en la búsqueda con IA. Ojo con los límites: no es un "opt-out de entrenamiento" y no afecta a los datos estructurados que publicas, salvo el campo description de Article.

data-nosnippet para excluir solo partes

Para ocultar solo fragmentos existe el atributo data-nosnippet sobre un span, div o section:

<div data-nosnippet>Precio promocional válido solo hoy</div>

Ideal para precios, fechas y promociones. Si lo generas con JavaScript, añade el atributo al crear el elemento: Google puede leer el contenido antes o después del render.

Cómo comprobar que tu noindex funciona (y por qué la página puede seguir en Google)

Google debe rastrear la página para ver la etiqueta o la cabecera. Si la URL sigue en resultados, lo más probable es que aún no la haya recrawleado; en URLs poco importantes puede tardar meses.

El flujo recomendado vive en Search Console (contexto completo en la guía de cómo usar Google Search Console):

  1. Abre URL Inspection con la URL exacta.
  2. Revisa el HTML que recibió Googlebot: confirma que ve la meta robots con noindex.
  3. Usa "Solicitar indexación" para forzar el recrawl.
  4. Monitoriza Page Indexing: las páginas con noindex aparecen como "indexación no permitida por la etiqueta noindex".

La causa típica del fallo es la ya mencionada: robots.txt bloqueando la URL. Desbloquéala y espera el siguiente rastreo.

Urgencias y remoción temporal

La herramienta Removals de Search Console saca una URL rápido, pero el bloqueo dura unos seis meses y es temporal; sin noindex la página puede reaparecer. La vía permanente que recomienda Google es noindex (o 404/410) + recrawl.

Checklist: cuándo y cómo aplicar directivas de indexación

Antes de tocar nada, decide el objetivo de la URL:

  • ¿Que siga existiendo y rastreándose pero no salga en resultados? Noindex o X-Robots-Tag.
  • ¿Que no exista? 404 o 410.
  • ¿Es contenido duplicado? Canonical, no noindex: consolida, no esconde.

Al aplicar la directiva:

  • Verifica que la URL no esté bloqueada en robots.txt; si lo está, el noindex es invisible.
  • Usa la capa correcta: HTML para páginas, cabecera HTTP para PDFs, imágenes y vídeo.
  • Combina reglas con comas.
  • No uses noarchive ni nocache (obsoletas).
  • Prefiere data-nosnippet para secciones puntuales.
  • Confirma con URL Inspection y monitoriza Page Indexing.

Ejemplo real: una página de "gracias por registrarte" que aparece en Google y recibe visitas que no convierten. Con noindex y la URL desbloqueada, deja de competir en el siguiente recrawl y el presupuesto de rastreo deja de gastarse en URLs sin valor; el artículo sobre crawl budget explica ese ahorro en detalle.

Resumen: meta robots es la herramienta de indexación página por página, y saber dónde vive cada directiva - HTML, cabecera HTTP o robots.txt - evita los dos errores clásicos: creer que robots.txt noindexea y bloquear la URL que querías retirar. La especificación oficial de meta robots y X-Robots-Tag es la referencia canónica si quieres el detalle fino de cada regla.

Usamos cookies para mejorar tu experiencia y analizar el tráfico del sitio. Al continuar navegando aceptas su uso.

Privacidad