URL marcada como 'noindex' (estado de GSC)

Qué significa el estado "URL marcada como 'noindex'" en Google Search Console, y la variante "URL enviada marcada como 'noindex'" y el nombre heredado "Excluida por la etiqueta 'noindex'". Cuándo es intencional vs. un error, dónde vive el noindex (etiqueta meta vs. cabecera X-Robots-Tag), el conflicto con robots.txt, el noindex fantasma/CDN, y cómo corregirlo y validarlo.

Publicado por primera vez: 23 jun 2026 · Última actualización: 11 ago 2026 · Avanzado
Idiomas
1 señal de evidencia en esta página

"URL marcada como 'noindex'" es el estado de indexación de páginas de Google Search Console para una página que Google rastreó y encontró una directiva noindex (una etiqueta meta robots o una cabecera X-Robots-Tag), por lo que la mantuvo fuera del índice. Misma condición, varios nombres: el actual "URL marcada como 'noindex'", la redacción más precisa para sitemaps "URL enviada marcada como 'noindex'" que usan comúnmente los informes y herramientas, y el nombre heredado "Excluida por la etiqueta 'noindex'". Suele ser intencional y correcto: valida la lista de URLs antes de "arreglar" nada. La verdadera señal de alerta es una página con noindex que aún está en tu sitemap: el envío del sitemap es una sugerencia para Google, no una garantía, y las dos directivas se contradicen. Como el noindex depende del rastreo, no lo combines con una desautorización en robots.txt: Google no puede ver un noindex que no puede rastrear. Revisa dos lugares (la etiqueta meta y la cabecera X-Robots-Tag), depura el noindex fantasma/CDN con una obtención de Googlebot en vivo, luego elimina la directiva, valida la corrección y espera que el reprocesamiento tarde más de un día o dos.

TL;DR — “URL marcada como ‘noindex’” es el estado de Indexación de páginas de GSC para una página que Google rastreó y encontró un noindex en — etiqueta meta robots o cabecera X-Robots-Tag , y Google también respeta una etiqueta meta robots colocada en el cuerpo de la página, no solo en el <head>. Varios nombres, un mismo estado: el actual “URL marcada como ‘noindex’”, la redacción más precisa de sitemap “Submitted URL marked ‘noindex’” (traducción) «URL enviada marcada como “noindex”» que los informes y herramientas suelen usar, y el legado «Excluida por etiqueta “noindex”». Es distinto de bloqueada por robots.txt (nunca rastreada) y de “Rastreada — actualmente no indexada” (sin directiva). Normalmente es intencional — valida primero la lista de URLs. Una URL con noindex que sigue en tu sitemap es la señal real (el envío del sitemap es una pista, no una garantía). noindex es dependiente del rastreo: combínalo con una desautorización en robots.txt y Google no puede verlo, así que la página puede seguir indexada. Cuando las reglas entran en conflicto, Google aplica la más restrictiva. Comprueba dos fuentes (el HTML renderizado y la cabecera HTTP), depura un noindex fantasma/de CDN con una búsqueda en vivo de Googlebot (Inspección de URLs / Prueba de Resultados Enriquecidos), luego elimina la directiva, valida la corrección y espera que el reprocesamiento tarde más de un día o dos — Google dice que puede llegar a meses para páginas de menor prioridad.

Qué significa realmente el estado

El informe describe la directiva observada por Google, no por qué un CMS, plantilla o CDN la añadió. Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report Google debe poder rastrear la página para observar y aplicar noindex. Evidence for this claim Google supports noindex through a robots meta tag or X-Robots-Tag header and must crawl the page to observe it. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Block indexing with noindex

La definición de Google es precisa: cuando Google intentó indexar la página, se encontró con una directiva noindex y, por lo tanto, no la indexó. La palabra clave es encontró — Google tuvo que rastrear la página para ver la directiva. Así que este estado conlleva dos hechos a la vez: Google llegó a la página, y la página le dijo que no se indexara.

Evidence for this claim Google reports URL marked noindex when it encountered a noindex directive while trying to index the URL and therefore did not index it. Scope: verified Search Console properties Confidence: high · Verified: Page indexing report

Esa es toda la columna vertebral de precisión aquí, y es lo que separa este estado de sus vecinos:

  • Bloqueada por robots.txt → Google nunca tuvo permiso para rastrear, así que no leyó ningún contenido ni ninguna directiva.
  • “Rastreada — actualmente no indexada” → Google rastreó, no encontró ninguna directiva, y decidió no indexar de todos modos.
  • “URL marcada como ‘noindex’” → Google rastreó, encontró un noindex y lo obedeció.
Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report

Los tres nombres son una misma condición

Esto confunde a la gente porque la etiqueta ha cambiado con el tiempo y varía según cómo se encontró la URL:

  • “URL marcada como ‘noindex’” — la etiqueta actual y general en el informe de Indexación de páginas. Se encuentra bajo “No indexada” (antes “Excluida”). Esta es la redacción que usa y define la documentación actual del informe de Indexación de páginas de Google.
  • “URL enviada marcada como ‘noindex’” — la misma condición subyacente, pero para una URL que también está en un sitemap que enviaste. Esta es la redacción más precisa que los profesionales y las herramientas SEO de terceros suelen informar para esa combinación. La documentación de ayuda actual de Google no la define como un estado separado y distinto de “URL marcada como ‘noindex’”, así que trata la etiqueta exacta como dependiente del informe — pero la sustancia se mantiene independientemente de cómo la llame una herramienta determinada: un sitemap está pensado para listar las URLs que quieres en la Búsqueda (y enviar uno es una pista para Google, no una garantía de indexación), así que una URL con noindex que está en él es una contradicción que vale la pena resolver.
  • “Excluida por etiqueta ‘noindex’” — el nombre legado del informe “Cobertura de indexación” anterior a 2021. Sigue siendo la versión coloquial más buscada. La misma cosa subyacente.

Si has llegado aquí desde cualquiera de esos tres, estás en el mismo lugar.

¿Es un problema? La decisión entre intencional y accidental

No “arregles” esto por reflejo. El árbol de decisión:

  1. Obtén la lista de URLs afectadas (haz clic en el estado).
  2. ¿Son estas páginas que querías excluir? Páginas de agradecimiento, búsqueda interna, URLs de facetas/filtros, cuentas/administración, staging que no debería estar en vivo. → No se requiere acción. “No indexada” no es lo mismo que “rota”, y Google lo dice: estas URLs no han sido indexadas, pero no necesariamente debido a un error.
  3. ¿Hay una página que quieres indexar en esta lista? → Un noindex se filtró en ella. Encuéntralo y elimínalo.
  4. ¿La URL con noindex también está en tu sitemap enviado (a menudo aparece como “URL enviada marcada como ‘noindex’”)? → Resuelve la contradicción directamente: elimina el noindex (para indexarla) o elimina la URL de tu sitemap (para dejarla sin indexar). No dejes una URL con noindex en un sitemap: el envío del sitemap es una pista para Google sobre lo que quieres indexar, no una solicitud que anule la directiva de la propia página.

La razón por la que los competidores tratan esto como un puro “error a corregir” es que se saltan el paso 2. La mayoría de las veces, este estado es el sistema funcionando correctamente.

Dónde vive el noindex: metaetiqueta vs. cabecera X-Robots-Tag

Hay exactamente dos métodos de entrega, y debes revisar ambos porque se ven completamente diferentes:

  • Metaetiqueta robots<meta name="robots" content="noindex"> en el <head> de la página. Apunta a todos los rastreadores; <meta name="googlebot" content="noindex"> apunta solo a Google. Esta es la que puedes detectar en el HTML.
  • Cabecera HTTP X-Robots-TagX-Robots-Tag: noindex en las cabeceras de respuesta del servidor. Esta es la sigilosa. Se configura en el servidor, CMS o CDN, no en el código fuente de la página, por lo que “Ver código fuente” no la mostrará. El método de cabecera también es la única forma de aplicar noindex a archivos que no son HTML: una cabecera de respuesta puede usarse para recursos no HTML como PDFs, archivos de video y archivos de imagen, que no tienen <head> para contener una metaetiqueta.
Evidence for this claim Google supports noindex through a robots meta tag or an X-Robots-Tag HTTP response header; both have the same effect, and the response header supports non-HTML resources. Scope: HTML and non-HTML web resources Confidence: high · Verified: Block Search indexing with noindex

Cuando GSC dice noindex y juras que la página no lo tiene, la cabecera es el primer lugar donde mirar (la pestaña de la hoja de referencia los muestra uno al lado del otro).

Cómo encontrar la directiva en una página

  1. Ver código fuente / DOM renderizado — busca noindex. Revisa el <head> renderizado, no solo el código fuente crudo, ya que una etiqueta puede ser inyectada por JavaScript o un gestor de etiquetas. Tampoco te detengas en <head>: Google ha dicho que no aplica la ubicación de meta-robots y respeta una metaetiqueta robots encontrada en el <body> de la página también, por lo que una directiva inyectada más abajo en el documento sigue contando.
  2. Cabeceras de respuestacurl -I https://example.com/page/ (o Herramientas de desarrollador del navegador → Red → la solicitud del documento → Cabeceras de respuesta) y busca una línea X-Robots-Tag.
  3. URL Inspection (Inspección de URLs) (GSC)Probar URL en vivo — esto obtiene la página como Googlebot e informa el veredicto de indexación y la respuesta. Esta es la que detecta directivas servidas solo a Google.
  4. Rich Results Test (Prueba de resultados enriquecidos) — otra obtención real de Googlebot que devuelve la respuesta HTTP y una instantánea renderizada de exactamente lo que el servidor muestra a Google.
  5. Verifica reglas de robots en conflicto, no solo una etiqueta única. Si más de una directiva de robots se aplica a la página (por ejemplo, una plantilla establece index pero un plugin o cabecera añade noindex), Google aplica la regla más restrictiva — por lo que un noindex suelto en cualquier lugar gana incluso si otra regla dice index. No dejes de buscar una vez que hayas encontrado una directiva que parezca permisiva.

El conflicto de robots.txt (por qué disallow + noindex resulta contraproducente)

Este es el punto más confuso en todas las demás guías, así que quiero ser exacto. noindex depende del rastreo: Google tiene que poder obtener la página para leer la directiva. Google establece la regla claramente: para que la regla noindex sea efectiva, la página no debe estar bloqueada por un archivo robots.txt y debe ser accesible de otro modo para el rastreador; si está bloqueada o el rastreador no puede acceder a ella, el rastreador nunca verá el noindex, y la página aún puede aparecer en la búsqueda (por ejemplo, si otras páginas enlazan a ella).

Evidence for this claim Google must be allowed to crawl and otherwise access a URL to see and apply its noindex rule; a robots.txt block can hide the directive while the URL remains eligible to appear from other information. Scope: HTML and non-HTML web resources Confidence: high · Verified: Block Search indexing with noindex

He escrito sobre el lado opuesto de esto durante años. En mi artículo de Ahrefs sobre «Indexada aunque esté bloqueada por robots.txt», el punto central es “crawling and indexing are two different things” (traducción) «rastrear e indexar son dos cosas distintas»: “if you block a page from being crawled, Google may still index it.” (traducción) «si impides que una página se rastree, Google aún puede indexarla». Y específicamente sobre este conflicto: “Unless Google can crawl a page, they won’t see the noindex meta tag and may still index it because it has links.” (traducción) «A menos que Google pueda rastrear una página, no verá la metaetiqueta noindex y aún puede indexarla porque tiene enlaces». Así que la combinación contraproducente es noindex + desautorización en robots.txt: la desautorización oculta el noindex, y la página puede permanecer indexada mediante enlaces externos.

La secuencia correcta para eliminar realmente una página:

  1. Permite el rastreo y mantén el noindex en su lugar.
  2. Espera a que Google vuelva a rastrear, vea la directiva y elimine la página.
  3. Solo entonces, si quieres ahorrar presupuesto de rastreo, puedes desautorizarla en robots.txt — después de la desindexación, no antes.

Mi recomendación habitual, de ese mismo artículo, es “Just add a noindex meta robots tag and make sure to allow crawling — assuming it’s canonical.” (traducción) «Añade una metaetiqueta robots noindex y asegúrate de permitir el rastreo, siempre que sea la URL principal».

Noindex fantasma: caché de CDN y directivas solo para Googlebot

La versión más difícil de esto es el noindex “fantasma”: miras la página, no ves ningún noindex en ninguna parte, y GSC aún informa uno. John Mueller ha abordado exactamente esto — en los casos que ha visto, había un noindex real, a veces mostrado solo a Google, lo que puede ser muy difícil de depurar. (Señaló ese escenario cuando surgió; estoy parafraseando su punto en lugar de citarlo como una declaración formal).

Los sospechosos habituales — trátalos como hipótesis a verificar, no como causas confirmadas, hasta que la respuesta en vivo muestre realmente uno de ellos:

  • Un CDN o caché que sirve un encabezado X-Robots-Tag: noindex obsoleto que ya no está en tu configuración de origen.
  • Una directiva condicional según el agente de usuario — el servidor devuelve una página limpia a tu navegador y una con noindex a Googlebot.
  • Una fuga de plantilla de staging — un noindex destinado a un entorno de staging que llega a producción a través de una plantilla compartida.

El diagnóstico es el mismo en los tres casos: no confíes en “Ver código fuente” en tu propio navegador. Haz una obtención real de Googlebot — la Prueba de URL en vivo de Inspección de URLs o la Prueba de resultados enriquecidos — que te muestra la respuesta HTTP y la página renderizada exactamente como Google la recibe. Así es como detectas un servidor/CDN que te sirve una cosa a ti y otra al rastreador.

Cómo corregirlo y validarlo

Una vez que hayas confirmado que el noindex es un error:

  1. Elimina la directiva en su fuente real: la etiqueta meta en la plantilla, o el encabezado X-Robots-Tag en la configuración del servidor/CMS/CDN. Limpia cualquier caché de CDN/página para que la corrección se esté sirviendo realmente.
  2. Confirma con una búsqueda en vivo de Googlebot (Inspección de URLs → Probar URL en vivo) que la página ahora devuelve sin noindex y muestra “URL disponible para Google”.
  3. Solicita la indexación para URLs de alta prioridad y/o usa el botón Validar corrección del informe para pedirle a Google que vuelva a verificar todo el conjunto afectado.
  4. Espera. La desindexación y la reindexación no son instantáneas: Google tiene que volver a rastrear para ver el cambio primero, y la propia guía de Google dice que el tiempo de revisita depende de la importancia de la página y puede tardar considerablemente más de un día o dos (su documentación da “meses” como posibilidad para páginas de menor prioridad). Solicitar la indexación en una URL prioritaria es cómo le pides a Google que intente antes, no una forma de forzar un cronograma específico. No entres en pánico si el estado persiste durante el reprocesamiento.

Para el caso inverso — una página que quieres con noindex pero que está atascada en el índice porque también estaba bloqueada por robots.txt — desbloquea primero el rastreo para que Google pueda finalmente ver el noindex.

Dónde encaja esto

Este estado es un nodo en el informe Indexación de páginas de Google. La directiva de robots que hay detrás — noindex — se puede entregar como una etiqueta meta robots o un encabezado X-Robots-Tag, y la herramienta adecuada depende de si trabajas con archivos HTML o no HTML. Los estados vecinos (“Indexada, aunque bloqueada por robots.txt” y “Rastreada — actualmente no indexada”) describen estados diferentes y necesitan correcciones diferentes; mantenerlos claros es la mayor parte de la batalla.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.