Rastreadas: actualmente no indexadas
Qué significa _«Crawled – currently not indexed»_ _(traducción)_ «rastreada: actualmente no indexada» en Google Search Console: Google obtuvo la página pero decidió no indexarla; normalmente es una decisión sobre la calidad del contenido o del sitio. Cómo se diferencia de _«Discovered – currently not indexed,»_ _(traducción)_ «descubierta: actualmente no indexada»; cuándo vale la pena revisarla y cómo solucionarla.
Idiomas
1 señal de evidencia en esta página
- Herramienta activa relacionadaGoogle Index Checker
_«Crawled – currently not indexed»_ _(traducción)_ «rastreada: actualmente no indexada» es un estado de Indexación de páginas de Google Search Console: Google obtuvo la página pero decidió no indexarla. No hay un bloqueo de robots.txt, noindex ni una URL preferida que lo impida: es una decisión de selección de indexación, normalmente sobre la calidad del contenido, la duplicación o el contenido escaso, y a menudo sobre la calidad de todo el sitio más que sobre esa única página. Google indica que la página puede indexarse más adelante o no y que no es necesario volver a enviarla, por lo que volver a rastrear una URL sin cambios no ayudará. Es distinto de _«Discovered – currently not indexed,»_ _(traducción)_ «descubierta: actualmente no indexada», que es anterior al rastreo (programación/presupuesto de rastreo). Algunas páginas — filtros, parámetros, páginas de etiquetas o archivo con poco contenido — deben permanecer en este grupo; consolídalas o elimínalas en lugar de forzar su indexación. Para recuperar páginas que vale la pena recuperar: descarta noindex/robots.txt/URL preferida/error soft 404, luego mejora el contenido y la calidad general del sitio y fortalece el enlazado interno.
TL;DR — “Crawled – currently not indexed” (traducción) «rastreada: actualmente no indexada» en Google Search Console significa que Google sí visitó tu página, pero decidió no añadirla a su índice. No hay
noindex, bloqueo de robots ni etiqueta canónica en otro lugar que lo impida; esos tienen sus propios estados separados en Search Console. Lo que suele quedar es una cuestión de contenido o de calidad del sitio que vale la pena investigar, no un error. Google dice que no es necesario volver a enviar la URL; volver a rastrear la misma página no hará que cambie de opinión. Para que la página se incluya, tienes que hacer que tanto la página como tu sitio valgan más la pena indexarse.
Qué significa el estado
Cuando abres el informe de Indexación de páginas en Google Search Console (antes se llamaba Cobertura de indexación), Google agrupa tus URL según el motivo por el que están o no indexadas. «Rastreada: actualmente no indexada» significa una cosa específica: Googlebot recuperó la página, pero actualmente no está indexada. Evidence for this claim Google defines Crawled - currently not indexed as a page crawled by Google but not indexed, which may or may not be indexed later. Scope: Google Search Console Page Indexing status; it does not by itself prove a single root cause. Confidence: high · Verified: Google: Page indexing report
El estado describe el resultado, no una única causa probada. Comprueba la herramienta de inspección de URL antes de concluir si la calidad, la duplicación, la canonicalización, el renderizado u otro factor es responsable.
Por qué Google hace esto
El rastreo de una página no garantiza que se indexe. Google no indexa todo lo que encuentra: hace una valoración sobre si vale la pena conservar una página. Una vez que hayas descartado un bloqueo técnico, estos son los motivos más comunes por los que las páginas caen en este grupo: compruébalos como hipótesis para la página específica, no como una única causa garantizada:
- Contenido escaso — poco contenido único, o poco contenido útil.
- Duplicado o casi duplicado — demasiado similar a otras páginas (tuyas o de otra persona).
- Bajo valor o baja prioridad — Google no cree que la página aporte lo suficiente para merecer un espacio en el índice.
Y esta es la parte que la gente pasa por alto: a menudo no se trata de esa única página. Con frecuencia se trata de la calidad de tu sitio completo. Si el sitio en general parece de baja calidad, las páginas individuales también quedan atrapadas en ese juicio.
¿Es un problema?
No siempre. Algunas páginas están destinadas a quedar aquí: URL basura de filtros y parámetros de seguimiento, páginas de etiquetas o de archivo con poco contenido, variaciones casi duplicadas. De todos modos, no quieres que esas páginas se indexen. La mayoría de los sitios tienen un montón de páginas en este grupo y eso es normal.
Solo es un problema cuando una página que realmente quieres en la búsqueda —un artículo real, un producto, una página de servicio— está atascada en él.
No lo confundas con «descubierta: actualmente no indexada»
Estos dos estados se parecen y la gente los confunde constantemente. La diferencia es si Google llegó a obtener la página:
- Rastreada — actualmente no indexada = Google sí la obtuvo, revisó el contenido y decidió no indexarla.
- Descubierta — actualmente no indexada = Google sabe que la URL existe pero aún no la ha rastreado.
Así que «Rastreada» es una decisión de calidad que Google tomó después de ver la página, y «Descubierta» es una decisión de programación antes de haberla obtenido.
Qué lo soluciona realmente
Volver a enviar la URL no ayuda — Google dice literalmente que no hay necesidad de volver a enviarla. Evidence for this claim Google's status guidance says there is no need to resubmit a Crawled - currently not indexed URL for crawling. Scope: Resubmission guidance for this Search Console status. Confidence: high · Verified: Google: Page indexing report Presionar “Request indexing” una y otra vez en una página que no has cambiado no hace nada, porque la página no ha cambiado, así que la decisión de Google tampoco cambiará. Lo que marca la diferencia es hacer que la página (y el sitio) sea genuinamente mejor: contenido más sólido, menos páginas de contenido thin o duplicado, mejores enlaces internos.
¿Quieres la versión completa de diagnóstico y solución, el árbol de decisiones y lo que Google ha dicho realmente al respecto? Cambia a la pestaña Avanzado.
TL;DR — El estado «rastreada: actualmente no indexada» de Google Search Console significa que Google obtuvo la página y luego eligió no indexarla. Es una decisión de selección de indexación, no un bloqueo técnico: no hay
noindex, disallow en robots.txt, canonical hacia otra URL ni ningún error que lo impida. Las causas más comunes para revisar son calidad, valor, duplicación o contenido escaso, y con frecuencia es una evaluación de calidad de todo el sitio más que un problema de una sola página. Google afirma que la página puede o no indexarse más adelante y no es necesario volver a enviarla: volver a rastrear una URL sin cambios no cambia nada. Es distinto de “Discovered – currently not indexed,” (traducción) «descubierta: actualmente no indexada», que es una situación de programación/presupuesto de rastreo previa al rastreo. Algunas URL pertenecen a este grupo (filtros, parámetros, etiquetas con poco contenido, casi duplicados) y deberían consolidarse o eliminarse, no forzarse. Para recuperar las páginas que vale la pena recuperar: descartanoindex/robots.txt/canonical/error soft 404, luego mejora el contenido y la calidad general del sitio y fortalece el enlazado interno.
Qué es realmente el estado
Este es un estado del informe de Indexación de páginas de Google Search Console (anteriormente el informe de Cobertura de indexación). La definición de Google es exacta: “The page was crawled by Google but not indexed. It may or may not be indexed in the future; no need to resubmit this URL for crawling.” (traducción) «La página fue rastreada por Google, pero no fue indexada. Puede o no ser indexada en el futuro; no es necesario volver a enviar esta URL para su rastreo.» Evidence for this claim Google defines Crawled - currently not indexed as a page crawled by Google but not indexed, which may or may not be indexed later. Scope: Google Search Console Page Indexing status; it does not by itself prove a single root cause. Confidence: high · Verified: Google: Page indexing report
Lee esa línea con atención, porque toda decisión práctica se deriva de ella:
- «rastreada por Google, pero no indexada» — “crawled by Google but not indexed” (traducción) «rastreada por Google, pero no indexada» — La obtención se realizó correctamente. Esto no es un error de rastreo, un problema del servidor ni un bloqueo de robots. Google descargó la página y luego rechazó indexarla.
- «puede indexarse o no en el futuro» — “may or may not be indexed in the future” (traducción) «puede indexarse o no en el futuro» — Puede resolverse por sí solo, y también puede permanecer así indefinidamente. El estado no es permanente y no es una penalización.
- «no es necesario volver a enviar esta URL para su rastreo» — “no need to resubmit this URL for crawling” (traducción) «no es necesario volver a enviar esta URL para su rastreo» — y esta es la que más les cuesta aceptar a las personas. Evidence for this claim Google's status guidance says there is no need to resubmit a Crawled - currently not indexed URL for crawling. Scope: Resubmission guidance for this Search Console status. Confidence: high · Verified: Google: Page indexing report Como la causa es una decisión, no un fallo de obtención, volver a rastrear la misma URL sin cambios no logra nada. Validate Fix y Request Indexing en una página que no has modificado sustancialmente son clics desperdiciados.
Así que este es el más impulsado por la calidad de todos los motivos de “no indexada”. Cuando una página es
rastreada, pero no indexada, y no hay noindex, ni bloqueo de robots, ni etiqueta canónica
que apunte a otro lugar, y no hay ningún error, lo que queda es que Google juzgue la página —y
a menudo el sitio— como algo que no vale la pena indexar.
Rastreada frente a descubierta: actualmente no indexada
Esta es la distinción que veo confundida más que ninguna otra, así que vale la pena dejarla clara. Toda la diferencia está en si Google obtuvo la página:
| Rastreada — actualmente no indexada | Descubierta — actualmente no indexada | |
|---|---|---|
| ¿Google recuperó la página? | Sí — fue rastreada | No — Google conoce la URL pero aún no la ha rastreado |
| Cuándo ocurre la decisión | Después de ver el contenido | Antes de recuperarla |
| Causa raíz típica | Decisión de calidad / valor / prioridad sobre el contenido | Decisión de programación del rastreo / presupuesto de rastreo / carga del servidor |
| Qué corregir | Calidad del contenido y del sitio en general, contenido duplicado, páginas de contenido escaso | Rendimiento del sitio/servidor, enlazado interno, priorización del rastreo, reducción de la proliferación de URLs de bajo valor |
La redacción de Google para el estado hermano hace explícito el momento: la página descubierta “was found by Google, but not crawled yet.” (traducción) «fue encontrada por Google, pero aún no ha sido rastreada.» En la práctica, Google a menudo reprogramó el rastreo porque se esperaba que recuperarla en ese momento sobrecargara el sitio. Por lo tanto, «Rastreada» refleja una decisión de selección de indexación posterior al rastreo y «Descubierta» refleja una decisión de programación previa al rastreo. Si ves muchas páginas en descubierta, examina el rendimiento del servidor, el enlazado interno y la reducción de URL de bajo valor — no la calidad del contenido en la página individual.
Google knows the URL. On the Discovered currently not indexed branch, Google has not fetched it, the Last Crawl field is empty, and diagnosis focuses on crawl priority or capacity. On the highlighted Crawled currently not indexed branch, Google fetched the page but did not index it, the Last Crawl field has a date, and diagnosis focuses on index selection, page value, duplication, rendering, and conflicting signals.
© Patrick Stox LLC · CC BY 4.0 ·
¿Es un problema? Cuándo investigarlo y cuándo no
La respuesta honesta que la mayoría de las publicaciones omiten: una parte de las páginas que están en esta categoría es normal, y no todas vale la pena investigarlas. La indexación no está garantizada, y un sitio saludable tiene de forma rutinaria páginas que Google examinó y razonablemente descartó.
Páginas que deberían quedarse fuera — déjalas como están o, mejor aún, deja de generarlas:
- URL de navegación por facetas, filtros, ordenación y parámetros (
?color=,?sort=, identificadores de sesión): variantes casi infinitas de bajo valor. - Páginas de etiquetas, categorías y archivos con poco contenido que son principalmente una lista sin valor único.
- Páginas casi duplicadas: variaciones de plantilla, copias para impresión, contenido sindicado escaso.
Para estas, la medida correcta no es forzar la indexación, sino consolidarlas, mejorarlas
o eliminarlas (canonicalizarlas, redirigirlas, usar noindex o bloquear el patrón en el
origen). Forzar la entrada de páginas de bajo valor en el índice juega en tu contra: es exactamente el
tipo de saturación que reduce la evaluación de calidad de todo el sitio y que hizo que tus páginas buenas
llegaran aquí en primer lugar.
Páginas que vale la pena recuperar: una página real de artículo, producto o servicio que querías indexar y que está atascada aquí. Ese es un problema genuino, y el resto de esto trata sobre esas.
Una nota práctica más: los recuentos y las muestras de GSC se retrasan y pueden estar desactualizados. No te alarmes solo por el número bruto, y no asumas que una página todavía está en este grupo solo porque el informe lo diga; verifica puntualmente con la herramienta de inspección de URL.
Por qué Google rastrea pero no indexa
La selección de indexación se basa fundamentalmente en la calidad y el valor. Las causas que veo, aproximadamente en orden:
- Thin Content / contenido de baja calidad — la página no ofrece suficiente contenido único y útil para merecer un espacio.
- Contenido duplicado o casi duplicado — es demasiado similar a otras páginas, por lo que Google no ve ninguna razón para la indexación de otra copia.
- Falta de relevancia / demanda de búsqueda — realmente no se busca nada a lo que esta página responda de forma única.
- Calidad de todo el sitio — y este es el punto importante. La evaluación suele ser sobre el sitio web completo, no solo sobre el texto de la página.
Ese ángulo de todo el sitio es la parte que la gente subestima. Mejorar una página de forma aislada con frecuencia no ayudará si el sitio en general se percibe como de baja calidad — la dirección es elevar la calidad, la estructura y la profundidad de todo el sitio, no pulir una sola URL y volver a enviarla.
También hay factores técnicos y económicos que parecen corresponder a este estado, pero que
realmente no son el tema de calidad: un noindex accidental, un bloqueo de robots, una etiqueta canónica
que apunta a otro lugar, errores soft 404, poca autoridad, carga lenta y una arquitectura o un enlazado interno deficientes.
Descarta primero esos factores (el árbol de decisiones que aparece a continuación) — si la página está
técnicamente limpia, te queda una decisión de calidad/valor/prioridad.
Cómo diagnosticarlo
Evalúa la página en este orden antes de concluir “calidad”. Cada paso descarta una causa no relacionada con la calidad:
- ¿
noindex? — Comprueba el HTML renderizado y los encabezados HTTP en busca de unnoindexextraviado. Una página configurada comonoindexno debería estar aquí, pero las señales mixtas y los problemas de renderizado producen sorpresas. Descártalo. - ¿Bloqueo de robots? — ¿La URL está desautorizada en
robots.txt? (Una URL bloqueada normalmente se informa de manera diferente, pero compruébalo de todos modos, especialmente para los recursos de los que depende la página.) - ¿Canonicalización hacia otra URL? — ¿La página se canonicaliza hacia una URL diferente? Si es así, Google está tratando esa URL como la real — por diseño, no es un error.
- ¿Error soft 404 / error / renderizado vacío? — ¿La página renderiza contenido real y único para Googlebot, o devuelve contenido escaso/vacío (común en páginas con mucho JavaScript donde el contenido necesita JavaScript para aparecer)?
- ¿Ninguna de las anteriores? — Entonces es una decisión de calidad / valor / prioridad. Ahora arregla el contenido y la calidad del sitio, no la fontanería técnica.
Usa la herramienta de inspección de URL para comprobar cómo se rastrea y se renderiza la página en vivo, y para confirmar lo que Google ve realmente.
Informe vs. inspección en vivo — por qué pueden discrepar. El informe de Indexación de páginas muestra el último estado conocido por Google y puede retrasarse respecto del estado actual de la página; la prueba en vivo de la herramienta de inspección de URL muestra lo que está ocurriendo ahora mismo. Una discrepancia entre ambos no es automáticamente una señal de alarma — puede significar simplemente que el informe no se ha puesto al día. Pero la prueba en vivo no cubre todo lo que cubre el informe: el contenido duplicado y las condiciones de canonicalización específicamente no se evalúan en la prueba en vivo, por lo que un resultado limpio de la inspección en vivo no los descarta. Compara las fechas y el estado actual de la página antes de tratar cualquiera de las dos vistas como la última palabra.
Cómo solucionarlo
Una vez que hayas confirmado que se trata de una decisión de calidad sobre una página que realmente quieres que se indexe:
1. Mejora el contenido y la calidad general del sitio web. Haz que la página realmente valga la pena para la indexación — única, valiosa, profunda, claramente mejor que lo que ya está posicionado. Luego amplía la perspectiva: porque a menudo esta es una evaluación de todo el sitio, mejorar el contenido circundante y eliminar el peso muerto eleva la valoración de todo el sitio, que es lo que realmente saca a las páginas de este grupo.
2. Consolida o elimina las páginas de bajo valor. Contraintuitivamente, eliminar,
aplicar noindex o canonicalizar las URL de contenido escaso y duplicado puede ayudar a que tus páginas buenas
se indexen, al mejorar la señal de calidad general y no diluir el sitio con
basura. No intentes indexarlo todo.
3. Fortalece el enlazado interno y la arquitectura. Las páginas que están bien enlazadas desde páginas relevantes e indexadas envían una señal más fuerte de «esto importa» que las páginas huérfanas enterradas profundamente en el sitio. Asegúrate de que las páginas que quieres que se indexen sean accesibles y estén enlazadas desde lugares que cuentan.
4. Limpieza técnica. Elimina los noindex sueltos, corrige los bloqueos de robots que no deberían
estar ahí, corrige las etiquetas canónicas y resuelve los errores soft 404 y los errores del servidor — para que nada
técnico contradiga tu intención.
5. Después — y solo después — solicita un nuevo rastreo. Después de que hayas cambiado significativamente la página, usa la herramienta de inspección de url para solicitar la indexación. Hacer esto en una página sin cambios es lo que Google te dice explícitamente que no te molestes en hacer.
¿Se resolverá por sí solo y en cuánto tiempo?
No hay un plazo fijo. “May or may not be indexed in the future” (traducción) «Puede que se indexe o no en el futuro» es literal: las páginas sí se indexan a veces más tarde sin ninguna acción directa, especialmente a medida que la calidad general del sitio y los enlaces mejoran — y las páginas también permanecen aquí indefinidamente si nada cambia. La palanca no es el tiempo ni el reenvío; es si la página y el sitio se vuelven dignos de ser indexados. Si has hecho mejoras reales, dale a Google tiempo para volver a rastrear y reevaluar en lugar de insistir con Request Indexing.
Mitos comunes
Algunas cosas que este estado no es:
- “Just hit Request Indexing / Validate Fix until it works.” (traducción) «Simplemente pulsa Request Indexing / Validate Fix hasta que funcione». Google dice que no es necesario volver a enviarla; volver a rastrear una página sin cambios no cambia la decisión. Evidence for this claim Google's status guidance says there is no need to resubmit a Crawled - currently not indexed URL for crawling. Scope: Resubmission guidance for this Search Console status. Confidence: high · Verified: Google: Page indexing report
- “It’s a bug or a penalty.” (traducción) «Es un error o una penalización». No es ninguna de las dos cosas — es un resultado rutinario de selección de indexación y la mayoría de los sitios tienen páginas aquí.
- “Es puramente un problema de una sola página.” Con frecuencia es una calidad de todo el sitio, no solo del texto de esa página.
- “Más enlaces directos a la página la forzarán a entrar.” No puedes forzar la indexación. La autoridad ayuda a la calidad de todo el sitio, pero el valor escaso/duplicado es la verdadera palanca.
- “Cada URL de este grupo debe corregirse e indexarse.” Muchas deberían quedar fuera; perseguirlas todas desperdicia esfuerzo y puede diluir la calidad del sitio.
- “Añadirlo al sitemap lo soluciona.” Los sitemaps facilitan el descubrimiento, no la idoneidad para la indexación — y la página ya se había rastreado, así que el descubrimiento no era el problema.
Para tener una visión más amplia, este estado forma parte de la historia más amplia de cómo Google indexa lo que rastrea, y se encuentra junto a sus similares en el Page Indexing informe. Las correcciones aquí se superponen en gran medida con evitar la saturación del índice — la mayor parte del consejo de «no forzarlo» es en realidad gestión del inventario indexable.
Resumen de IA
Una versión condensada de la versión Advanced:
- Qué es. Un estado de Indexación de páginas de Google Search Console: Google rastreó (obtuvo) la página, pero eligió no indexarla. Definición de Google — «crawled by Google but not indexed… may or may not be indexed in the future; no need to resubmit.» (traducción) «rastreada por Google pero no indexada… puede o no ser indexada en el futuro; no es necesario volver a enviarla.»
- Es una decisión, no un error. No hay un
noindex, un bloqueo de robots ni una URL preferida hacia otra parte ni un fallo de obtención que lo impida. Google la revisó y la descartó. - Causas más comunes para revisar: calidad/valor. Contenido escaso, duplicado/casi duplicado, de bajo valor o de baja prioridad — y a menudo la calidad de todo el sitio, no solo esa página. Trata estas opciones como hipótesis para poner a prueba en la página específica, no como una única causa garantizada.
- Volver a enviar no funciona. Volver a rastrear una URL sin cambios no cambia nada; solo cambiar la página/el sitio cambia la decisión.
- Rastreada ≠ descubierta. «Rastreada» refleja una decisión de selección de indexación posterior al rastreo; «Descubierta» es una situación de programación/presupuesto de rastreo anterior al rastreo (Google aún no la ha obtenido).
- Algunas páginas pertenecen a este estado. Filtros, parámetros, etiquetas escasas, casi duplicados: consolídalos o elimínalos, no fuerces su indexación. Forzar la entrada de páginas de bajo valor es sobrecarga que perjudica la evaluación de calidad de todo el sitio.
- Diagnostica en orden:
noindex→ robots → URL preferida → error soft 404/renderizado vacío → si todo está limpio, es una decisión de calidad/valor/prioridad. Usa la herramienta de inspección de url. - Solución: mejora el contenido y la calidad general del sitio, consolida/elimina páginas de bajo valor, fortalece el enlazado interno, limpia las contradicciones técnicas — luego solicita un nuevo rastreo, solo después de cambios significativos.
- Plazo: no hay uno fijo. Puede resolverse por sí solo a medida que mejoran la calidad/los enlaces, o persistir indefinidamente. El informe puede ir retrasado respecto al estado actual de la página; compara las fechas con una herramienta de inspección de url en vivo y recuerda que la prueba en vivo tampoco verifica las condiciones de duplicación o de URL preferida, así que no trates ninguna de las dos vistas por sí sola como definitiva.
Documentación oficial
Documentación de fuentes primarias de los motores de búsqueda.
- Informe de Indexación de páginas — el informe en el que aparece este estado, con las definiciones textuales de “Crawled – currently not indexed” (traducción) «rastreada: actualmente no indexada» y del estado relacionado “Discovered – currently not indexed” (traducción) «descubierta: actualmente no indexada».
- Rastreo e indexación — el centro de referencia sobre cómo decide Google qué rastrear e indexar, y los controles (robots, etiquetas canónicas, noindex) que descartas al diagnosticar este estado.
- Guía detallada sobre cómo funciona la búsqueda de Google — el flujo de rastreo → indexación → servicio, y la afirmación de Google de que “not all pages make it through each stage.” (traducción) «no todas las páginas pasan por cada etapa».
- Bloquear la indexación de búsqueda con noindex — para las páginas que quieres mantener fuera (así puedes eliminar deliberadamente URLs de bajo valor en lugar de forzar su inclusión).
Bing / Microsoft
- Directrices de Bing Webmaster — Bing no usa esta etiqueta exacta, pero su orientación sobre contenido único y valioso, y sobre evitar páginas con contenido escaso o duplicado, es la misma palanca conceptual. (Confirma la URL actual en tu navegador.)
Citas de la fuente
Declaraciones oficiales sobre este estado. Las líneas del documento de ayuda de Google que aparecen a continuación están enlazadas directamente al pasaje de la página de origen.
Ayuda de Google Search Console — las definiciones
- “The page was crawled by Google but not indexed. It may or may not be indexed in the future; no need to resubmit this URL for crawling.” (traducción) «La página fue rastreada por Google pero no indexada. Puede que se indexe o no en el futuro; no es necesario volver a enviar esta URL para su rastreo.» — Ayuda de Google Search Console, Page Indexing report. Ir a la cita
- El estado hermano, para contrastar: “The page was found by Google, but not crawled yet…” (traducción) «La página fue encontrada por Google, pero aún no ha sido rastreada…» — el mismo documento. Ir a la cita
John Mueller, Google — es a nivel de todo el sitio, y no puedes forzarlo
En las horas de oficina de SEO de Google en inglés (28 de junio de 2021), en respuesta a una pregunta sobre «rastreada: actualmente no indexada», el planteamiento de John Mueller fue que no puedes forzar que las páginas se indexen, que es normal que Google no indexe todas las páginas de todos los sitios, y que el problema tiende a ser a nivel de todo el sitio en lugar de una página específica — así que la dirección es mejorar la estructura y la calidad generales del sitio.
Ha señalado lo mismo sobre qué significa “quality”: que Google no se refiere solo al texto de un artículo, sino a la calidad del sitio web en general —incluidos la maquetación y el diseño—.
Nota: las declaraciones de Mueller en las sesiones de horas de oficina se parafrasean aquí a partir de retransmisiones del sector (Search Engine Roundtable, JumpFly, Rank Math KB) en lugar de citarse textualmente — confirma la redacción exacta y las marcas de tiempo con las grabaciones de origen antes de tratar algo como una cita directa.Lista de verificación para diagnosticar y corregir una URL rastreada pero aún no indexada
Ejecuta esto en cualquier URL que realmente quieres indexar y que está atascada en este grupo:
Decide si perseguirla
- Confirma que esta es una página que realmente quieres indexar (no un filtro/parámetro/etiqueta de contenido escaso/ casi duplicada que debería quedarse fuera).
- Si debería quedarse fuera: consolida (canonical/301),
noindex, o deja de generar el patrón de URL — y sigue adelante.
Descarta las causas ajenas a la calidad (en orden)
- Que no haya un
noindexaccidental en el HTML renderizado ni en el encabezado HTTP. - Que no esté bloqueada por
robots.txt(la página y sus recursos críticos). - Que la URL canónica apunte a sí misma, no a una URL diferente.
- Que la página devuelva un
200real con contenido único — sin error soft 404, sin renderizado vacío (comprueba el HTML renderizado, especialmente en páginas con mucho JS). - Comprueba con la herramienta de inspección de URL cómo Google rastrea y renderiza la página publicada.
Si está limpia, trátala como calidad/valor
- El contenido de la página es genuinamente único, valioso y detallado (no es escaso ni casi duplicado).
- Se aborda la calidad general del sitio: las páginas escasas/duplicadas se consolidan o se eliminan, no solo se pule esta página.
- La página está bien enlazada internamente desde páginas relevantes e indexadas (no huérfana).
- Solo después de cambios significativos: solicita un nuevo rastreo mediante la herramienta de inspección de url.
No lo hagas
- No vuelvas a enviar ni uses «Validar corrección» repetidamente en una página sin cambios.
- No intentes forzar la entrada en el índice de todas las URL de este grupo.
- No te alarmes solo por el recuento de GSC: va con retraso; haz comprobaciones puntuales en vivo.
Los modelos mentales
1. Rastreada = una decisión, no un fallo. Nada técnico está bloqueando la página. Google la recuperó y eligió no indexarla. Antes de “arreglar” algo, interioriza que la palanca es el criterio de selección de indexación de Google, no tu servidor ni tu archivo robots.
2. El mapa de las etapas de rastreo: Descubierta → Rastreada → Indexada. «Descubierta: actualmente no indexada» está antes de la recuperación (programación/presupuesto de rastreo). «Rastreada: actualmente no indexada» está después de la recuperación (calidad/valor). Ubica la URL primero en este mapa — te indica si debes examinar la economía del servidor/rastreo (descubierta) o la calidad del contenido/sitio (rastreada).
3. En todo el sitio, no en una sola página. Trata esto como un veredicto sobre todo el sitio con tanta frecuencia como sobre una sola página. Pulir una sola URL y volver a enviarla rara vez funciona; mejorar la calidad general del sitio y eliminar el peso muerto es lo que hace que las páginas salgan del grupo.
4. Hay páginas que se supone que están aquí. La indexación no es un objetivo en sí misma. Los filtros, los parámetros, las etiquetas con poco contenido y los casi duplicados deberían estar sin indexar. La pregunta no es “¿cómo indexo esto?” sino “¿merece esta página un lugar en el índice?” — y con frecuencia la respuesta es no.
5. Cambia la página, no el botón de envío. Dado que la causa es una decisión, lo único que la cambia es cambiar los datos de entrada. Volver a rastrear bytes idénticos produce la misma decisión. Mejora, luego vuelve a rastrear — en ese orden.
Hoja de referencia: rastreada pero aún no indexada
Obtenida frente a descubierta — ambas aún sin indexar
| Obtenida pero no indexada | Descubierta pero aún no rastreada | |
|---|---|---|
| ¿Google recuperó la página? | Sí | No (aún no se ha rastreado) |
| La decisión es… | posterior al rastreo (calidad/valor) | previa al rastreo (programación/presupuesto de rastreo) |
| Observa… | calidad del contenido y del sitio, duplicación | rendimiento del servidor, enlaces internos, exceso de URL |
| ¿Ayuda volver a enviar? | No | No |
Árbol de decisiones (la página está rastreada pero aún no indexada)
| Comprobación | Si sí → | Si no → |
|---|---|---|
¿Tiene un noindex? | Elimínalo (si quieres que se indexe) | Siguiente |
| ¿Está bloqueada por robots.txt? | Desbloquéala | Siguiente |
| ¿La URL preferida apunta a otro lugar? | Es por diseño — Google indexa la preferida | Siguiente |
| ¿Error soft 404 / renderizado vacío? | Corrige la página para que devuelva contenido único real | Siguiente |
| ¿Todo limpio? | → Es una decisión de calidad/valor/prioridad: mejora el contenido y la calidad del sitio |
¿Deberías siquiera perseguir esta URL?
| Tipo de URL | Acción |
|---|---|
| URL de filtro / parámetro / ordenación / sesión | Déjala fuera — URL preferida/noindex/bloquea el patrón |
| Etiqueta / archivo / casi duplicado de contenido escaso | Consolida o elimina |
| Página real de artículo / producto / servicio que quieres posicionar | Diagnostica y mejora (más arriba) |
Datos rápidos
- La declaración de Google: «may or may not be indexed in the future; no need to resubmit.» (traducción) «puede o no indexarse en el futuro; no es necesario volver a enviar.»
- Volver a rastrear una URL sin cambios no cambia nada.
- A menudo es una lectura de calidad de todo el sitio, no un problema de una sola página.
- Los recuentos de GSC van con retraso — haz comprobaciones puntuales con la herramienta de inspección de URL, no confíes solo en el número.
¿Deberías intentar indexar esta URL?
Triage Crawled – currently not indexed
Errores que mantienen las páginas fuera
- Solicitar la indexación de nuevo sin cambiar nada. Google ya obtuvo la página. Mejora la razón para indexarla antes de pedir otro rastreo.
- Tratar el estado como un error de presupuesto de rastreo. La obtención ocurrió; la decisión es posterior. Investiga el contenido, la duplicación y la calidad del sitio.
- Intentar indexar todas las URL de filtros, etiquetas y archivos. Algunas páginas deberían permanecer excluidas. En su lugar, consolida o elimina el inventario de bajo valor.
- Hacer cambios cosméticos en la cantidad de palabras. Más texto no equivale automáticamente a más valor. Resuelve la superposición de intenciones y añade información que los usuarios no pueden obtener de la alternativa indexada.
- Diagnosticar solo la URL afectada. Las secciones grandes de bajo valor pueden dar forma a las señales de calidad a nivel del sitio. Revisa también las plantillas y los patrones de inventario.
Prompt: compara una página excluida con alternativas indexadas
Compare the excluded page with the supplied indexed pages for intent, unique information, evidence, and duplication. Identify what the excluded page adds that cannot be obtained from the alternatives. Recommend one of: keep and materially improve, merge and redirect, canonicalize, noindex, or remove. Explain the evidence for the choice. Do not recommend resubmission unless a meaningful change is made.
[PASTE PAGE TEXT, CANONICAL/NOINDEX/STATUS EVIDENCE, INTERNAL LINKS, AND COMPARISON PAGES]Prompt: encuentra patrones de bajo valor en todo el sitio
Group this Page Indexing export by template and URL pattern. For Crawled – currently not indexed URLs, distinguish intended exclusions from pages meant to rank. Rank patterns by affected valuable URLs, then list the sample checks needed before changing a template. Do not infer quality from word count alone.
[PASTE SANITIZED EXPORT WITH URL, TEMPLATE, STATUS, CANONICAL, SITEMAP, AND INTERNAL-LINK DATA] Marca las señales comunes de indexabilidad en el HTML guardado
Ejecuta esto en la consola de DevTools en la página en vivo:
({canonical: document.querySelector('link[rel="canonical"]')?.href || null, robots: document.querySelector('meta[name="robots" i]')?.content || null, title: document.title, textLength: document.body.innerText.trim().length, internalLinks: [...document.links].filter(a => a.hostname === location.hostname).length});El resultado detecta señales obvias; no puede indicarte la URL canónica seleccionada por Google ni la decisión de indexación.
Extrae las URL excluidas de un CSV para muestreo
Si el CSV exportado tiene una columna status, Python puede crear una muestra de revisión sin cambiar el archivo de origen:
import csv
with open("pages.csv", newline="", encoding="utf-8-sig") as f:
rows = [r for r in csv.DictReader(f) if r.get("status", "").strip() == "Crawled - currently not indexed"]
for row in rows[:100]:
print(row.get("url", ""))Ajusta el texto exacto del estado y los nombres de las columnas para que coincidan con la exportación.
Herramientas para el diagnóstico
- Comprobador de indexación de Google comprueba el estado observable, las señales de redirección, noindex y las URL preferidas, y luego te lleva a Search Console para conocer el estado real de Google.
- Comprobador de canónicas ayuda a detectar conflictos de URL preferida declarada y problemas de consolidación de duplicados.
- La Inspección de URL de Google Search Console muestra la prueba en vivo, el último rastreo, la URL preferida declarada por el usuario y la URL preferida seleccionada por Google para una URL de muestra.
- Las exportaciones de Indexación de páginas de Google Search Console ayudan a agrupar el estado por directorio y plantilla en lugar de tratar las URL una por una.
- Un rastreador junto con los registros del servidor comprueba el descubrimiento de enlaces internos, las señales renderizadas y si Googlebot volvió después de un cambio significativo.
Métricas para la recuperación de páginas excluidas
Tasa de indexación prevista
Métrica: URL indexadas divididas por las URL que realmente están destinadas a posicionarse. Qué te indica: si el inventario valioso está representado sin premiar el index bloat. Cómo obtenerla: clasifica las URL de sitemap canónicas por intención y luego crúzalas con el estado de indexación de Search Console. Punto de referencia / rango realista: establece una línea base a nivel de plantilla; el denominador debe excluir las URL que no deberían indexarse. Cadencia: mensual.
Recuento de exclusiones de URL valiosas
Métrica: páginas previstas para la búsqueda que están rastreadas pero aún no indexadas. Qué te indica: el tamaño y la concentración del problema real. Cómo obtenerla: exporta los datos de indexación de páginas y agrúpalos por plantilla o directorio. Punto de referencia / rango realista: tendencia a la baja después de correcciones significativas de plantilla o de contenido; no existe un objetivo universal de cero que se ajuste a todos los sitios cambiantes. Cadencia: mensual y después de lanzamientos importantes.
Recuperación después de un cambio significativo
Métrica: URLs valiosas afectadas que pasan a estar indexadas después de una corrección sustancial. Qué te indica: si la intervención abordó la selección en lugar de provocar simplemente otra recuperación. Cómo obtenerla: mantén una cohorte con fecha y vuelve a comprobar el estado y las impresiones. Punto de referencia / rango realista: compara cohortes por tipo de corrección; no inventes un plazo fijo de recuperación. Cadencia: en intervalos normales de nuevo rastreo/indexación hasta que la cohorte se estabilice.
Ponte a prueba: rastreada pero aún no indexada
Recursos que merecen tu tiempo
Mis artículos relacionados
- Qué significa «rastreada: actualmente no indexada» en Google Search Console — mi análisis en profundidad en Ahrefs sobre este estado exacto: la definición, la lista completa de causas y el proceso de corrección.
- La guía para principiantes sobre SEO técnico — dónde encaja la indexación en el panorama general.
Oficial
- Informe de Indexación de páginas (Google) — las definiciones textuales y el propio informe.
- Rastreo e indexación (Google) — los controles que descartas al diagnosticar esto.
De otras fuentes
- Cómo corregir el estado «rastreada: actualmente no indexada» de GSC (Search Engine Land) — un recorrido de Anna Crowe, con comentarios transmitidos de Mueller e Illyes sobre la selección de indexación y la calidad.
- «Rastreada: actualmente no indexada» posiblemente una señal de un problema de calidad de Google (Search Engine Roundtable) — la cobertura de Barry Schwartz de los comentarios de Mueller en la sesión de oficina de junio de 2021, según los cuales este estado refleja una evaluación de calidad de todo el sitio.
- ¿Es la calidad la razón por la que tus páginas se rastrean pero no se indexan? (JumpFly) — transmite la cita de Mueller de que “quality” (traducción) «calidad» significa el sitio web completo — incluidos la maquetación y el diseño — no solo el texto de los artículos.
- «Rastreada: actualmente no indexada»: significado y correcciones (SEOTesting) — recorrido práctico y patrones de corrección comunes de la comunidad de pruebas de SEO.
- «Rastreada: actualmente no indexada» (base de conocimientos de Rank Math) — incluye la cita de Mueller “you can’t force pages to be indexed … it’s more site-wide” (traducción) «no puedes forzar que las páginas se indexen … es más a nivel de todo el sitio» de la sesión de oficina del 28 de junio de 2021, con contexto.
- r/TechSEO — la comunidad para la depuración de rastreo/indexación.
Registro de cambios
Actualizado el 8 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 17 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.