Guía de noindex para SEO
Noindex mantiene una página fuera de los resultados de búsqueda, pero solo si Google puede rastrearla. Conoce los dos métodos válidos, la trampa de robots.txt y cómo comprobar que funcionó.
Idiomas
Noindex es la directiva que mantiene una página fuera del índice y, por tanto, de los resultados de búsqueda. Se puede configurar de dos formas válidas: con la metaetiqueta robots (`<meta name="robots" content="noindex">`) o con la cabecera HTTP `X-Robots-Tag: noindex`, la única opción para archivos que no son HTML, como los PDF. El error principal consiste en bloquear la página en robots.txt: Google no puede rastrearla para leer la regla. Para retirar una página, permite el rastreo y sirve noindex. No pongas noindex en robots.txt, porque dejó de admitirse el 1 de septiembre de 2019. Si noindex y canonical conviven, comprueba la intención en lugar de tratarlo como un error automático. La retirada del índice solo ocurre después de un nuevo rastreo.
TL;DR — Noindex es la forma de decirle a Google “no pongas esta página en los resultados de búsqueda”. Lo añades como una pequeña etiqueta en el código de la página (o como una cabecera HTTP para archivos como PDFs). La única regla que confunde a todos: Google tiene que ser capaz de rastrear la página para ver la etiqueta — así que no la bloquees también en robots.txt, o todo falla silenciosamente.
Qué hace noindex
noindex mantiene una página fuera del índice de búsqueda. Si una página no está en el índice, no
puede aparecer en los resultados de búsqueda. Ese es todo su trabajo: no oculta la página
a los visitantes, no la hace cargar más rápido, y no transmite ni bloquea ningún
“jugo de enlaces” por sí mismo — solo mantiene la página fuera de los resultados de Google y Bing. Evidence for this claim Google's noindex rule prevents the page, media, or resource from appearing in Google Search results after Google sees the rule. Scope: Google Search; noindex is not an access-control or privacy mechanism. Confidence: high · Verified: Google Search Central: Block Search indexing with noindex
Lo usarías en páginas que existen para las personas pero no tienen razón para posicionarse: páginas de resultados de búsqueda internas, páginas de “gracias” después de un formulario, páginas de etiquetas o filtros con poco contenido, páginas de preparación o utilidad.
Las dos formas de añadirlo
Solo hay dos métodos válidos. Elige uno.
1. La metaetiqueta robots. Inserta esta línea en el <head> de la página:
<meta name="robots" content="noindex">Esa es la forma normal para una página HTML. La mayoría de los CMS (WordPress, Shopify, etc.) tienen una casilla que lo añade por ti — en muchos plugins de SEO es un interruptor de “desalentar a los motores de búsqueda para que no indexen esta página” en el editor de la página.
2. La cabecera HTTP X-Robots-Tag. Algunos archivos no tienen un <head> donde poner una etiqueta
— un PDF, una imagen, un vídeo. Para esos, envías la directiva en la cabecera de respuesta HTTP del servidor en su lugar:
X-Robots-Tag: noindexNo puedes verla en el código fuente de la página; se encuentra en las cabeceras de respuesta. Evidence for this claim Google supports noindex in an HTML robots meta tag or an X-Robots-Tag HTTP response header. Scope: Google Search delivery methods; the HTTP header is applicable to non-HTML resources as well as HTML. Confidence: high · Verified: Google Search Central: Robots meta tag and X-Robots-Tag specifications
El error que lo rompe
Este es el más importante, así que lo diré claramente: una página bloqueada en robots.txt
no puede ser noindexada.
Suena al revés, pero aquí está el porqué. robots.txt les dice a los motores de búsqueda que no rastreen
una página. La etiqueta noindex vive en la página. Si a Google se le dice que no
rastree la página, nunca la obtiene, así que nunca ve la etiqueta noindex — y la
página puede permanecer en el índice, a veces apareciendo como una URL desnuda sin descripción.
Así que la receta correcta para eliminar una página es lo contrario de lo que parece seguro:
- Asegúrate de que la página no esté bloqueada en
robots.txt(deja que Google la rastree). - Añade
noindex(la metaetiqueta o la cabecera). - Espera a que Google la vuelva a rastrear. La desindexación no es instantánea — ocurre la próxima vez que Google obtenga la página y vea la etiqueta.
Algunas comprobaciones más que la pestaña Avanzado cubre en detalle: no pongas noindex
dentro de tu archivo robots.txt (eso no funciona desde 2019), y revisa la
intención cuando noindex y canonical aparecen juntos. La combinación puede ser
intencional; un canonical que apunta a otro lugar es la advertencia más fuerte porque las dos
señales piden resultados diferentes.
¿Quieres los fragmentos de servidor exactos, el matiz de noindex,follow, la historia, y cómo
verificarlo en Google Search Console? Cambia a la pestaña Avanzado.
Ponte a prueba: noindex
Elige noindex solo cuando la eliminación sea el objetivo
Noindex, disallow, canonical, or nofollow?
Los tres fallos de noindex que debes comprobar primero
- Noindex más una regla disallow en robots.txt. El rastreador no puede obtener la URL y, por tanto, no puede descubrir la directiva de retirada. Desbloquea la URL, mantén noindex y permite un nuevo rastreo.
- Noindex más canonical. Una señal dice «retira esta página»; la otra pide a los motores que la consoliden con un duplicado preferido. Usa canonical para consolidar duplicados y noindex para una retirada real, no ambos.
Noindex:dentro de robots.txt. Google no admite esta regla. Usa la metaetiqueta robots o la cabecera de respuestaX-Robots-Tag.- Noindex y la URL todavía en el sitemap. La guía de Google recomienda enviar las URL canónicas que realmente quieres mostrar en los resultados; una URL con noindex no corresponde ahí. Mantenerla no anula la directiva
noindex, pero transmite una intención contradictoria y dificulta las auditorías posteriores. Retira del sitemap las URL con noindex cuando termines de seguir su eliminación.
Tampoco uses noindex como control de acceso. Cualquiera que conozca la URL puede seguir solicitando la página; protege el contenido privado mediante autenticación.
Corregir «Indexado, aunque bloqueado por robots.txt»
Este estado significa que el bloqueo de rastreo no garantizó la eliminación. Google puede conocer una URL a través de enlaces sin obtener su contenido, y el bloqueo le impide ver una directiva noindex en la página.
- Confirma que la URL debe retirarse, no solo rastrearse con menos frecuencia.
- Elimina la regla disallow de robots.txt que afecte al rastreador objetivo.
- Sirve
noindexen la cabecera del HTML o mediante una cabeceraX-Robots-Tag. - Comprueba la respuesta final después de las redirecciones y confirma que ninguna variante de la CDN o de la plantilla elimina la directiva.
- Usa la prueba en vivo de Inspección de URLs para demostrar que Google puede obtener la página y detectar noindex.
- Solicita un nuevo rastreo cuando corresponda y después supervisa el informe de Indexación de páginas.
- Solo plantéate volver a bloquear la URL tras su retirada si entiendes que el descubrimiento y el procesamiento futuros podrían quedar limitados otra vez.
Si el contenido es confidencial, detente aquí y añade autenticación en su lugar; ni robots.txt ni noindex son un mecanismo de seguridad.
Servir noindex para archivos no HTML
Ejemplo de Apache para respuestas PDF:
<FilesMatch "\.pdf$">
Header set X-Robots-Tag "noindex"
</FilesMatch>Ejemplo de Nginx:
location ~* \.pdf$ {
add_header X-Robots-Tag "noindex" always;
}Verifica un archivo representativo y sigue las redirecciones:
curl -sSIL https://example.com/file.pdf | grep -iE '^(HTTP/|location:|x-robots-tag:)'Limita estrictamente el alcance de las reglas del servidor y prueba tanto un PDF al que quieras aplicar noindex como una página HTML que deba seguir siendo indexable. Una regla amplia de ubicación o de coincidencia de archivos puede aplicar noindex por accidente a toda una familia de recursos o a una sección del sitio.
Monitorear noindex como un conjunto de URLs propio
Cobertura de implementación
Approved noindex URLs serving noindex ÷ all URLs in the approved noindex set
(traducción) «URL aprobadas para noindex que sirven noindex ÷ todas las URL del conjunto aprobado para noindex»
Mide la respuesta en vivo, no el campo del CMS. Segmenta los fallos por meta HTML,
X-Robots-Tag, destino de redirección y acceso de robots.txt.
Resultado del procesamiento
Sigue el conjunto aprobado en los distintos estados de Google Search Console: indexadas, “URL marked ‘noindex’” (traducción) «URL marcada con noindex», bloqueadas por robots.txt y pendientes de un nuevo rastreo. La evolución deseable es que haya menos URL aprobadas todavía indexadas y menos conflictos entre el bloqueo de rastreo y noindex después del despliegue.
Supervisa también el noindex accidental por separado: URL que deberían posicionarse pero sirven una directiva noindex o aparecen bajo el motivo correspondiente en el informe de Indexación de páginas. Usa tu propio inventario de URL y la referencia anterior al despliegue; no existe un porcentaje objetivo universal y justificable para la proporción de un sitio que debería llevar noindex.
TL;DR —
noindexelimina una página del índice mediante uno de dos métodos válidos: la metaetiqueta de robots (<meta name="robots" content="noindex">) o el encabezado HTTPX-Robots-Tag: noindex(requerido para archivos no HTML como PDFs). El detalle clave: una página bloqueada en robots.txt no puede ser noindexada — Google nunca la rastrea para ver la regla, “el rastreador nunca verá la reglanoindex,” y una URL enlazada puede permanecer indexada. Así que para eliminar una página, permite el rastreo y sirvenoindex. No pongas noindex en robots.txt (no compatible desde el 1 de septiembre de 2019), revisa noindex con un canonical que apunte a otro lugar como potencialmente conflictivo, y ten en cuenta que la desindexación solo ocurre después de un recrawl — la propia guía de Google dice que una página de baja prioridad puede tardar meses. Según un comentario de Mueller de 2017 (no política documentada),noindex,followa largo plazo tiende a comportarse comonoindex,nofollowuna vez que la página desaparece del índice. Verifica en GSC bajo «URL marcada como “noindex”».
Qué es noindex — control de índice, no control de rastreo
noindex es la directiva principal de control de indexación. Google la define en una sola frase: “Do not show this page, media, or resource in search results.” (traducción) «No mostrar esta página, contenido multimedia o recurso en los resultados de búsqueda». Cuando se respeta, el efecto es total: “When Googlebot crawls that page and extracts the tag or header, Google will drop that page entirely from Google Search results, regardless of whether other sites link to it.” (traducción) «Cuando Googlebot rastrea esa página y extrae la etiqueta o la cabecera, Google retira por completo la página de los resultados de la Búsqueda de Google, independientemente de que otros sitios enlacen con ella». Evidence for this claim Google's noindex rule prevents the page, media, or resource from appearing in Google Search results after Google sees the rule. Scope: Google Search; noindex is not an access-control or privacy mechanism. Confidence: high · Verified: Google Search Central: Block Search indexing with noindex
Ten presente una distinción, porque casi todos los errores de noindex provienen de confundirla: noindex controla la indexación; robots.txt controla el rastreo. Son etapas diferentes del proceso. Lo expresé así en mi guía de Ahrefs sobre cómo eliminar URLs: “Crawling is not the same thing as indexing. Even if Google is blocked from crawling pages, if there are any internal or external links to a page they can still index it.” (traducción) «Rastrear no es lo mismo que indexar. Incluso si Google está bloqueado para rastrear páginas, si hay enlaces internos o externos hacia una página, aún puede indexarla.» Esa frase es la razón de que exista el resto de este artículo.
Microsoft le da a la misma directiva una consecuencia adicional específica de Bing: el contenido marcado con noindex también se excluye del entrenamiento del modelo fundacional de Microsoft. El requisito previo sigue siendo importante: Bingbot debe poder rastrear y procesar la directiva a nivel de página. Por lo tanto, un bloqueo en robots.txt más noindex no es prueba de que se haya aplicado la desindexación o la exclusión del entrenamiento.
Los dos métodos válidos de entrega
Hay exactamente dos, y noindex en robots.txt no es uno de ellos (más sobre eso a continuación).
Método 1: la metaetiqueta robots. Para una página HTML, coloca esto en el <head>:
<meta name="robots" content="noindex">La instrucción de Google es textual: “To prevent all search engines that support the noindex rule from indexing a page on your site, place the following <meta> tag into the <head> section of your page.” (traducción) «Para evitar que todos los motores de búsqueda que admiten la regla noindex indexen una página de tu sitio, coloca la siguiente etiqueta <meta> en la sección <head> de tu página.» El valor robots se dirige a todos los rastreadores que admiten la regla; cambia a googlebot para dirigirte solo a Google (<meta name="googlebot" content="noindex">).
Método 2: la cabecera HTTP X-Robots-Tag. La misma directiva, enviada en la cabecera de respuesta en lugar del marcado:
X-Robots-Tag: noindexEsta es la única forma de aplicar noindex a recursos que no son HTML, porque no hay <head> para alojar una metaetiqueta. Google: “A response header can be used for non-HTML resources, such as PDFs, video files, and image files.” (traducción) «Se puede usar una cabecera de respuesta para recursos que no son HTML, como PDF, archivos de video y archivos de imagen.» Y de la especificación de robots: puedes usar X-Robots-Tag “for non-HTML files like image files where the usage of robots meta tags in HTML is not possible.” (traducción) «para archivos que no son HTML, como archivos de imagen, donde no es posible usar etiquetas meta de robots en HTML.» Evidence for this claim Google supports noindex in an HTML robots meta tag or an X-Robots-Tag HTTP response header. Scope: Google Search delivery methods; the HTTP header is applicable to non-HTML resources as well as HTML. Confidence: high · Verified: Google Search Central: Robots meta tag and X-Robots-Tag specifications
Una nota sobre la ubicación: coloca la metaetiqueta en el <head> — ese es el lugar estándar y más seguro, y es lo que muestra el tutorial de Google. La página de especificaciones de Google sí dice que “doesn’t enforce placement of meta robots in the HTML head and will respect robots meta tags in the body section of an HTML document as well,” (traducción) «no exige la ubicación de meta robots en el head de HTML y también respetará las metaetiquetas robots en la sección del cuerpo de un documento HTML», pero no confíes en eso como método principal; una etiqueta <meta> extraviada que algún CMS inyecta en el <body> puede aplicar noindex a una página por accidente, igual que una que pretendías añadir al <head>.
Como la cabecera se configura a nivel del servidor, varía según la pila. Dos ejemplos comunes para aplicar noindex a todos los PDF de un sitio:
Apache (.htaccess o vhost):
<FilesMatch "\.pdf$">
Header set X-Robots-Tag "noindex"
</FilesMatch>Nginx (bloque server/location):
location ~* \.pdf$ {
add_header X-Robots-Tag "noindex";
}El error número 1: noindex + un bloqueo en robots.txt
The same page contains a meta robots noindex directive. With crawling allowed, Google can fetch the page, see noindex, and remove the URL after processing. With crawling blocked in robots.txt, Google cannot see noindex and the linked URL may remain in results.
Este es el modo de fallo que más veo, así que aquí está el mecanismo completo. La etiqueta noindex vive en la página; Google tiene que obtener la página para leerla. Google establece el requisito directamente:
Google explica que, para que la regla
noindexsea eficaz, la página o el recurso no debe estar bloqueado por robots.txt y tiene que ser accesible para el rastreador. Si el rastreador no puede obtener la página, nunca verá la regla; aun así, la página puede aparecer en los resultados si otras páginas enlazan con ella. La cita literal y su traducción se conservan en la pestaña Citas de la fuente.
Dicho aún más directamente: “We have to crawl your page in order to see <meta> tags and HTTP headers.” (traducción) «Tenemos que rastrear tu página para ver las etiquetas <meta> y las cabeceras HTTP.» Sin rastreo, no hay regla.
robots.txt es la causa más habitual de que una página deje de ser rastreable, pero la redacción de Google abarca más situaciones. La frase “the crawler can’t access the page,” (traducción) «el rastreador no puede acceder a la página» incluye errores reiterados del servidor (5xx), tiempos de espera y una barrera de autenticación no intencionada. Cualquiera de estos problemas hace que noindex falle en silencio, igual que un bloqueo en robots.txt.
Así que el instinto de “bloquearlo en robots.txt y ponerle noindex, por si acaso” es
exactamente al revés: el bloqueo impide el rastreo, el rastreo es lo que revela el
noindex, y la página puede permanecer en el índice indefinidamente (a menudo como
una URL sin descripción). En Google Search Console esto aparece como el
estado “Indexada, aunque bloqueada por robots.txt” — una página que bloqueaste pero que
se indexó de todos modos porque algo enlaza a ella.
La solución: desbloquea la página en robots.txt, mantén noindex en ella y deja que
Google vuelva a rastrearla. Solo después de que la página haya desaparecido del índice — si entonces quieres
ahorrarte el rastreo por completo — es seguro añadir un disallow.
Ejemplo de despliegue real: el sitio de staging que no desaparecía
Un rediseño se lanza desde staging.example.com. Las plantillas de staging ya
contienen noindex, pero la lista de verificación del despliegue también añade:
User-agent: *
Disallow: /Eso parece dos capas de protección. En realidad es una trampa si Google ya
descubrió las URLs de staging a través de un enlace de QA compartido, un sitemap antiguo, un
ticket público o un enlace en contenido de producción copiado. El disallow impide el siguiente
rastreo, por lo que Google no puede confirmar el noindex; el nombre de host puede permanecer como resultados
débiles, solo con URL.
La secuencia de limpieza es: elimina el disallow, mantén noindex en cada
respuesta de staging, confirma que la respuesta en vivo es rastreable y expone la directiva, solicita
un nuevo rastreo para una muestra representativa y monitorea el nombre de host hasta que desaparezca.
Luego pon el entorno detrás de autenticación. La autenticación es el control de privacidad
durable; noindex es solo un control del índice de búsqueda.
noindex vs nofollow vs disallow
Tres directivas que la gente confunde constantemente. Operan en diferentes etapas:
noindex— control de índice. La página se rastrea, se mantiene fuera de los resultados. La definición de Google: “Do not show this page, media, or resource in search results.” (traducción) «No mostrar esta página, medio o recurso en los resultados de búsqueda.»nofollow— control de enlaces. Google: “Do not follow the links on this page.” (traducción) «No seguir los enlaces de esta página.» No dice nada sobre indexar la página en sí.disallow(robots.txt) — control de rastreo. Detiene la obtención por completo. No es un control de índice: una URL no permitida aún puede indexarse si está enlazada.
También existe none, que Google documenta como “Equivalent to noindex, nofollow.” (traducción) «Equivale a aplicar ambas directivas». Cuando las reglas de robots entran en conflicto, la especificación es clara: “In the case of conflicting robots rules, the more restrictive rule applies.” (traducción) «Cuando existen reglas de robots contradictorias, se aplica la más restrictiva». La tabla completa está en la pestaña Cheat Sheets.
Trata noindex con rel=canonical como una verificación de intención
Colocar noindex y rel="canonical" en la misma página no es automáticamente incorrecto, pero sí crea una configuración que conviene revisar con cuidado. Antes de tratarla como un error, determina qué resultado se pretende y comprueba que las dos señales respondan a esa intención: una pide consolidar señales y la otra excluir esta URL. Para elegir entre duplicados, usa la etiqueta rel="canonical". Google desaconseja expresamente emplear noindex para impedir la selección de una página preferida dentro de un mismo sitio, porque eso bloquearía por completo la página en la Búsqueda. El texto literal, acompañado de su versión española, se conserva en la pestaña Citas de la fuente. La advertencia se refiere específicamente a usar noindex para elegir qué duplicado será el preferido dentro de tu propio sitio; no afirma que ambas declaraciones sean técnicamente incompatibles en todos los casos. Una página que realmente estés retirando aún puede incluir una referencia a sí misma. Si esa referencia apunta a una URL diferente, revisa el caso con especial atención y confirma que tanto la exclusión como la consolidación sean intencionadas. Consolida duplicados con rel="canonical" y usa noindex solo cuando de verdad quieras retirar esta página de los resultados.
noindex,follow vs noindex,nofollow — la decadencia lenta
Un patrón habitual es noindex,follow: mantener la página fuera de los resultados y, a la vez, seguir sus enlaces para que la autoridad pueda circular, algo útil durante una migración o mientras una página está temporalmente retirada. La documentación oficial actual de Google no afirma que esta combinación se degrade de forma automática; permite combinar noindex con otras reglas, incluida la configuración deliberada de noindex,nofollow desde el primer día. La idea de que «se desvanece con el tiempo» procede de un encuentro para webmasters de 2017, en el que John Mueller explicó que un noindex prolongado tiende a tratarse en la práctica como noindex,nofollow: cuando Google concluye que la página no pertenece a la búsqueda y deja de procesarla, también deja de seguir sus enlaces. Es una observación profesional basada en la transcripción de un vídeo, no una política documentada de Google; tómala como orientación, no como garantía. La conclusión práctica se mantiene: noindex,follow sirve como estado transitorio, pero no como estrategia permanente para conservar autoridad. Corrige los enlaces subyacentes o retira la página.
¿Cuánto tarda noindex?
No es instantáneo. noindex solo se aplica después de que Google vuelve a rastrear y reprocesa la página — hasta entonces, la página puede permanecer indexada aunque la etiqueta esté activa. Google no se compromete a un plazo fijo, y su propia guía se inclina hacia “podría tardar un tiempo”, no “en cualquier momento”: “Depending on the importance of the page on the internet, it may take months for Googlebot to revisit a page.” (traducción) «Dependiendo de la importancia de la página en internet, Googlebot puede tardar meses en volver a visitar una página.» Una página de alto tráfico y con muchos enlaces podría volver a rastrearse en días; una de bajo valor y con pocos enlaces puede permanecer durante meses. Si necesitas que una página salga de los resultados urgentemente, la herramienta Removals de GSC es un paliativo (oculta la URL temporalmente mientras el noindex permanente hace su trabajo más lento). Para páginas realmente eliminadas, un 404/410 también las elimina: como escribí en mi guía de eliminación, “If you remove the page and serve either a 404 (not found) or 410 (gone) status code, then the page will be removed from the index shortly after the page is re-crawled.” (traducción) «Si eliminas la página y sirves un código de estado 404 (no encontrado) o 410 (eliminado), la página se eliminará del índice poco después de que se vuelva a rastrear.» El mismo tema en todas partes — ocurre en el re-rastreo.
noindex en robots.txt está obsoleto (desde el 1 de septiembre de 2019)
Todavía verás a gente sugerir una línea Noindex: en robots.txt. No lo hagas. Nunca fue una regla oficialmente compatible, y Google retiró incluso su manejo no oficial hace años. Del anuncio de Search Central de julio de 2019: “Since these rules were never documented by Google, naturally, their usage in relation to Googlebot is very low.” (traducción) «Dado que estas reglas nunca fueron documentadas por Google, naturalmente, su uso en relación con Googlebot es muy bajo.» Y la fecha: “we’re retiring all code that handles unsupported and unpublished rules (such as noindex) on September 1, 2019.” (traducción) «estamos retirando todo el código que maneja reglas no compatibles y no publicadas (como noindex) el 1 de septiembre de 2019.»
La misma publicación nombró las alternativas compatibles, y noindex a través de la metaetiqueta / cabecera encabezó la lista: “noindex in robots meta tags: Supported both in the HTTP response headers and in HTML, the noindex rule is the most effective way to remove URLs from the index when crawling is allowed.” (traducción) «noindex en metaetiquetas robots: Compatible tanto en las cabeceras de respuesta HTTP como en HTML, la regla noindex es la forma más efectiva de eliminar URLs del índice cuando el rastreo está permitido.» (También se enumeran: códigos de estado 404/410, protección con contraseña, disallow de robots.txt para la prevención del rastreo, y la herramienta de eliminación de Search Console.)
Cómo verificar noindex en Google Search Console
Dos comprobaciones:
- URL Inspection (Inspección de URLs). Inspecciona la URL y después selecciona Test live URL (traducción) «Probar URL publicada». La herramienta indica si la página puede indexarse y si Google detecta una directiva
noindex; es la forma más rápida de confirmar que la etiqueta se lee en la respuesta actual. - Informe de Indexación de páginas. Las páginas con noindex aparecen con el estado “URL marked ‘noindex’” (traducción) «URL marcada con noindex» en la sección Not indexed (traducción) «No indexadas». El texto de ayuda de Google dice: “When Google tried to index the page it encountered a ‘noindex’ directive and therefore did not index it.” (traducción) «Cuando Google intentó indexar la página, encontró una directiva noindex y, por tanto, no la indexó». Si querías que esa página estuviera indexada, ese es el problema: elimina la directiva.
Una nota terminológica para quien consulte documentación antigua: el informe Coverage anterior llamaba a este estado “Excluded by ‘noindex’ tag” (traducción) «Excluida por la etiqueta noindex». El informe actual de Indexación de páginas usa “URL marked ‘noindex’” (traducción) «URL marcada con noindex». Se trata del mismo estado con una etiqueta más reciente.
Lo que noindex no garantiza
Estas son algunas ventajas que a menudo se atribuyen a noindex, pero que la directiva no ofrece:
- Ahorro de presupuesto de rastreo. Google todavía tiene que obtener la página para ver la etiqueta —
noindexpor sí solo no reduce el rastreo. Si también quieres eso, añadedisallowenrobots.txt, pero solo después de que la página ya haya salido del índice (ver el error anterior para saber por qué hacerlo de entrada resulta contraproducente). - Eliminación instantánea. Cubierto arriba — ocurre en el re-rastreo, sin un cronograma fijo, y el propio Google dice que una página de baja prioridad puede tardar meses.
- Consolidación de duplicados. Para eso está
rel="canonical";noindexsolo elimina la página de la Búsqueda, no fusiona señales hacia otra URL. - Confidencialidad. La página sigue siendo solicitable públicamente por cualquiera que tenga la URL. Si algo realmente necesita ser privado, eso es un problema de autenticación, no un problema de directiva de búsqueda.
- Recuperación de posiciones si lo reviertes. Quitar
noindexno restaura las posiciones antiguas de una página — Google tiene que re-rastrear, re-evaluar y efectivamente volver a ganar su posición desde cero. - Mismo momento en todos los motores de búsqueda. Bing y otros motores ejecutan sus propios cronogramas de rastreo y re-rastreo independientemente de los de Google.
- Exclusión de todo uso no relacionado con la búsqueda de tu contenido.
noindexbloquea una página de la Búsqueda de Google en su totalidad — incluidas las funciones de IA de la propia Búsqueda (AI Overviews y similares se basan en páginas que están indexadas y son elegibles para mostrarse, por lo que una página con noindex también queda fuera de esas). Lo que no hace es controlar el ajuste separado de Google-Extended, que determina si tu contenido puede usarse para entrenar o fundamentar los modelos de IA generativa de Google fuera de la Búsqueda. Son dos controles diferentes para dos trabajos diferentes.
Dónde encaja noindex con todo lo demás
noindex es la herramienta adecuada cuando una página está en el índice pero no debería estarlo: resuelve una forma de inflación del índice causada por páginas con poco contenido, páginas utilitarias o duplicados aproximados sin valor para la búsqueda. Está estrechamente relacionado con la metaetiqueta robots y la cabecera X-Robots-Tag, que son sus dos métodos de entrega; con robots.txt y su directiva disallow, que controlan el rastreo y suelen confundirse con noindex; con la etiqueta canonical, que sirve para consolidar duplicados; y con las etapas generales de rastreo e indexación. Cuando distingues rastreo de indexación, noindex deja de ser misterioso: permite el rastreo, sirve la etiqueta y espera al siguiente rastreo.
Resumen de IA
Una versión condensada de la versión avanzada:
noindexsignifica mantener una página fuera del índice, es decir, fuera de los resultados de búsqueda. Google indica: “Do not show this page, media, or resource in search results.” (traducción) «No mostrar esta página, contenido multimedia o recurso en los resultados de búsqueda». Si se respeta, la página desaparece por completo “regardless of whether other sites link to it” (traducción) «independientemente de que otros sitios enlacen con ella».- Solo hay dos métodos válidos: la metaetiqueta robots (
<meta name="robots" content="noindex">) y la cabecera HTTPX-Robots-Tag: noindex. La cabecera es obligatoria para archivos que no son HTML, como PDF, imágenes y vídeos. - El error número uno: una página bloqueada en
robots.txtno puede retirarse con noindex. Google no la rastrea, así que “the crawler will never see thenoindexrule” (traducción) «el rastreador nunca verá la regla noindex», y una URL enlazada puede seguir indexada. Para retirar una página, permite el rastreo y sirvenoindex. noindex≠nofollow≠disallow: controlan, respectivamente, la indexación, los enlaces y el rastreo. Si hay un conflicto, se aplica la regla más restrictiva.- Revisa
noindexcuando conviva con unrel="canonical"que apunte a otra URL. Confirma que tanto la exclusión como la consolidación sean intencionadas. Usa canonical para los duplicados ynoindexsolo cuando la propia página deba quedar fuera de la Búsqueda. noindex,followpuede terminar comportándose comonoindex,nofollowa largo plazo, según un comentario de Mueller de 2017. No es una política documentada de Google, así que debe tratarse como orientación. Resulta razonable como estado temporal, no como plan permanente para conservar autoridad.- No es instantáneo: se aplica después de un nuevo rastreo. Google señala que puede tardar meses en volver a visitar una página de baja prioridad. Usa la herramienta Removals de GSC como medida urgente y temporal; los estados
404/410también retiran páginas después de un nuevo rastreo. noindexen robots.txt dejó de funcionar. Nunca tuvo soporte oficial y Google retiró su tratamiento el 1 de septiembre de 2019. Usa la metaetiqueta o la cabecera.- No proporciona ahorro de presupuesto de rastreo, confidencialidad, consolidación de duplicados, recuperación de posiciones al revertirlo ni exclusión del entrenamiento de modelos de Google. Google-Extended es el control independiente para ese último uso.
- Verifícalo en GSC: combina URL Inspection (Test live URL) con el informe de Indexación de páginas y busca “URL marked ‘noindex’” (traducción) «URL marcada con noindex». La etiqueta anterior era “Excluded by ‘noindex’ tag” (traducción) «Excluida por la etiqueta noindex».
Documentación oficial
Documentación de fuentes primarias de los motores de búsqueda.
- Bloquear la indexación en la Búsqueda con
noindex— el cómo hacerlo canónico: ambos métodos y el detalle de que debe seguir siendo rastreable. - Especificaciones de metaetiquetas robots — cada directiva (
noindex,nofollow,none),X-Robots-Tagy la regla de “la regla más restrictiva gana”. - Una nota sobre reglas no compatibles en robots.txt (julio de 2019) — por qué
noindexen robots.txt se retiró el 1 de septiembre de 2019 y qué usar en su lugar. - Consolidar URLs duplicadas — por qué usar
rel="canonical"(nonoindex) para la consolidación de duplicados. - Informe de Indexación de páginas — el estado “URL marcada como ‘noindex’” y cómo verificar.
Bing / Microsoft y sin dependencia del motor
- ¿Qué metaetiquetas robots admite Bing? — la compatibilidad de Bing con las etiquetas robots, incluido
noindex. - MDN —
<meta name="robots">— una referencia neutral y multiplataforma para la directiva.
Citas de la fuente
Declaraciones públicas de Google. Cada enlace es un enlace profundo que salta al pasaje citado en la página de origen.
Google — qué hace noindex y cómo configurarlo
- “Do not show this page, media, or resource in search results.” (traducción) «No mostrar esta página, contenido multimedia o recurso en los resultados de búsqueda» — documentación de Google Search Central, definición de
noindex. Ir a la cita - “To prevent all search engines that support the
noindexrule from indexing a page on your site, place the following<meta>tag into the<head>section of your page.” (traducción) «Para impedir que todos los motores de búsqueda compatibles con la reglanoindexindexen una página de tu sitio, coloca la siguiente etiqueta<meta>en la sección<head>de la página». Ir a la cita - “A response header can be used for non-HTML resources, such as PDFs, video files, and image files.” (traducción) «Se puede usar una cabecera de respuesta para recursos que no son HTML, como PDF, archivos de vídeo y archivos de imagen». Ir a la cita
- “When Googlebot crawls that page and extracts the tag or header, Google will drop that page entirely from Google Search results, regardless of whether other sites link to it.” (traducción) «Cuando Googlebot rastrea esa página y extrae la etiqueta o la cabecera, Google retira por completo la página de los resultados de la Búsqueda de Google, independientemente de que otros sitios enlacen con ella». Ir a la cita
Google — la trampa de robots.txt
- “For the
noindexrule to be effective, the page or resource must not be blocked by a robots.txt file, and it has to be otherwise accessible to the crawler. If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see thenoindexrule, and the page can still appear in search results, for example if other pages link to it.” (traducción) «Para que la reglanoindexsea eficaz, la página o el recurso no debe estar bloqueado por un archivo robots.txt y tiene que ser accesible para el rastreador. Si está bloqueado o el rastreador no puede acceder, este nunca verá la reglanoindex; la página puede seguir apareciendo en los resultados, por ejemplo, si otras páginas enlazan con ella». Ir a la cita - “We have to crawl your page in order to see
<meta>tags and HTTP headers.” (traducción) «Tenemos que rastrear tu página para poder ver las etiquetas<meta>y las cabeceras HTTP». Ir a la cita
Google — las otras directivas (para la comparación)
- “Do not follow the links on this page.” (traducción) «No seguir los enlaces de esta página» — definición de
nofollow. Ir a la cita - “In the case of conflicting robots rules, the more restrictive rule applies.” (traducción) «Cuando existen reglas de robots contradictorias, se aplica la más restrictiva». Ir a la cita
Google — no uses noindex para la canonicalización
- “We don’t recommend using
noindexto prevent selection of a canonical page within a single site, because it will completely block the page from Search.” (traducción) «No recomendamos usarnoindexpara impedir la selección de una página canónica dentro de un mismo sitio, porque bloqueará por completo la página en la Búsqueda». Ir a la cita
Google — noindex en robots.txt retirado (1 de septiembre de 2019)
- “Since these rules were never documented by Google, naturally, their usage in relation to Googlebot is very low.” (traducción) «Como Google nunca documentó estas reglas, su uso en relación con Googlebot es, lógicamente, muy reducido». Ir a la cita
- “we’re retiring all code that handles unsupported and unpublished rules (such as
noindex) on September 1, 2019.” (traducción) «retiraremos todo el código que trata reglas no admitidas y no publicadas, comonoindex, el 1 de septiembre de 2019». Ir a la cita - “the
noindexrule is the most effective way to remove URLs from the index when crawling is allowed.” (traducción) «la reglanoindexes la forma más eficaz de retirar URL del índice cuando se permite el rastreo». Ir a la cita
Google — verificándolo en Search Console
- “When Google tried to index the page it encountered a ‘noindex’ directive and therefore did not index it.” (traducción) «Cuando Google intentó indexar la página, encontró una directiva noindex y, por tanto, no la indexó» — informe de Indexación de páginas, estado “URL marked ‘noindex’” (traducción) «URL marcada con noindex». Ir a la cita
Patrick Stox — rastrear no es indexar (mi guía de Ahrefs sobre cómo retirar URL de Google)
- “Crawling is not the same thing as indexing. Even if Google is blocked from crawling pages, if there are any internal or external links to a page they can still index it.” (traducción) «Rastrear no es lo mismo que indexar. Aunque Google tenga bloqueado el rastreo de una página, puede indexarla si existen enlaces internos o externos hacia ella». Ir a la cita
- “If you remove the page and serve either a 404 (not found) or 410 (gone) status code, then the page will be removed from the index shortly after the page is re-crawled.” (traducción) «Si retiras la página y sirves un código de estado 404 (no encontrado) o 410 (eliminado), la página se retirará del índice poco después de que vuelva a rastrearse». Ir a la cita
noindex; confirma la redacción exacta en un navegador antes de tratarla como literal. El comportamiento a largo plazo noindex,follow → noindex,nofollow se atribuye a John Mueller a través de la cobertura de Search Engine Roundtable de un encuentro para webmasters de 2017. Está parafraseado, no citado, y debe contrastarse con la fuente antes de considerarlo definitivo. noindex vs disallow vs nofollow vs canonical — qué hace cada uno
| Control | ¿Detiene el rastreo? | ¿Detiene la indexación? | Para qué sirve | Advertencia clave |
|---|---|---|---|---|
noindex (metaetiqueta / cabecera) | No — la página debe permanecer rastreable | Sí | Eliminar una página del índice / de los resultados de búsqueda | Inútil si la página está bloqueada por robots.txt (el rastreador nunca la ve) |
disallow (robots.txt) | Sí | No | Mantener a los bots fuera de espacios de URL de bajo valor | No es una herramienta de desindexación — las URLs bloqueadas aún pueden indexarse si están enlazadas |
nofollow (meta / en enlaces) | No | No | Decirle a Google que no siga los enlaces de esta página | No dice nada sobre si la página en sí está indexada |
rel="canonical" | No | Consolida, no fuerza | Señalar la versión preferida de un duplicado | Una sugerencia, no una regla — la coexistencia con noindex es una advertencia de intención, especialmente cuando apunta a otro lugar |
Los dos métodos válidos de noindex
| Método | Sintaxis | Úsalo para |
|---|---|---|
| Metaetiqueta de robots | <meta name="robots" content="noindex"> en el <head> | Páginas HTML normales |
| Cabecera X-Robots-Tag | X-Robots-Tag: noindex en la respuesta HTTP | Archivos no HTML (PDF, imagen, vídeo) — y cualquier página donde establecer una cabecera sea más fácil que editar el marcado |
<meta name="googlebot" content="noindex"> se dirige únicamente a Google; robots se dirige a todos los motores que admiten la regla. noindex,nofollow —o none, que Google define como “Equivalent to noindex, nofollow” (traducción) «equivalente a aplicar ambas directivas»— aplica las dos a la vez.
No es un método válido: Noindex: dentro de robots.txt. Nunca fue soportado oficialmente;
retirado por Google el 1 de septiembre de 2019. No lo uses.
Cómo aplicar noindex a una página correctamente (y verificarlo)
Configúralo
- Elegido el método correcto: metaetiqueta robots para una página HTML, o
cabecera
X-Robots-Tag: noindexpara un PDF / imagen / vídeo. - Para HTML:
<meta name="robots" content="noindex">está en el<head>— la ubicación estándar y más segura (Google también respetará una metaetiqueta robots colocada en el<body>, pero no confíes en eso; también significa que una<meta>etiqueta suelta inyectada en el cuerpo puede desindexar una página por accidente). - La página no está bloqueada en
robots.txt— Google debe poder rastrearla para ver la directiva. - Si la página también lleva
rel="canonical", se han revisado su destino y el resultado de exclusión previsto; la combinación no se trata como un fallo automático. - Si quieres que los enlaces sigan fluyendo temporalmente, usaste
noindex,follow— sabiendo que se degrada anoindex,nofollowa largo plazo. - No confiaste en una línea
Noindex:enrobots.txt(no compatible desde el 1 de septiembre de 2019).
Verifica que funcionó
- Ejecutaste URL Inspection → Test live URL en Google Search Console y confirmaste que Google detecta la directiva
noindex. - Consultaste el informe de Indexación de páginas y localizaste la URL bajo “URL marked ‘noindex’” (traducción) «Google ha marcado la URL porque contiene noindex». En el informe anterior, el mismo motivo aparecía como “Excluded by ‘noindex’ tag” (traducción) «Google excluyó la URL por su etiqueta noindex».
- Diste tiempo al proceso: la retirada del índice solo ocurre después de un nuevo rastreo, por lo que la página no desaparece de inmediato.
- Si la URL debe desaparecer urgentemente, usaste la herramienta Removals de GSC como medida temporal junto con el
noindexpermanente. - Si una página sigue indexada después de aplicar noindex, comprobaste primero si también está bloqueada por robots.txt con el estado “Indexed, though blocked by robots.txt” (traducción) «Indexada, aunque bloqueada por robots.txt», la causa más habitual.
Registro de cambios
Actualizado el 22 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 28 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 19 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 19 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 18 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.