Informe de indexación de páginas (GSC)
Cómo funciona el informe de indexación de páginas de Google Search Console, antes llamado Index Coverage: páginas indexadas y no indexadas, la columna Fuente, todos los estados, Validar corrección y el retraso del informe.
El informe de indexación de páginas, antes llamado Index Coverage y ahora identificado como Páginas en la sección Indexación de Google Search Console, muestra cuántas URL están indexadas o no y agrupa las no indexadas por motivo. Es un informe agregado de toda la propiedad; para una URL concreta se usa Inspección de URL. Una URL no indexada no es necesariamente un problema: los duplicados, noindex, robots.txt y las respuestas intencionales de página no encontrada pueden ser resultados correctos. Filtra por Fuente = Sitio web, trabaja la tabla de arriba abajo y usa Validar corrección para solicitar un nuevo rastreo. Los sitios con menos de 500 páginas probablemente no necesitan este informe.
Evidencia de esta afirmación The Page indexing report shows indexed and not-indexed pages known to Google and groups non-indexing by reason. Alcance: Current Page indexing report terminology and behavior. Confianza: alta · Verificado: Google Search Console: Page indexing report Evidencia de esta afirmación The Page indexing report is for site-wide patterns; URL Inspection provides the indexed and live-test details for an individual URL. Alcance: Current distinction between Page indexing and URL Inspection. Confianza: alta · Verificado: Google Search Console: URL Inspection toolTL;DR — El Page Indexing report en Google Search Console te indica cuántas de tus páginas ha indexado Google (puede mostrarlas en la búsqueda) frente a las no indexadas, y para las no indexadas te indica por qué. Antes se llamaba Index Coverage report. “Not indexed” (No indexada) suena alarmante, pero normalmente no lo es: se espera que muchas de esas URL queden fuera.
Qué es el Page Indexing report
Cuando abres Google Search Console y haces clic en Pages (Páginas) bajo Indexing (Indexación) en el menú de la izquierda, llegas al Page Indexing report. Google lo describe de forma sencilla: te permite “see which pages Google can find and index on your site, and learn about any indexing problems encountered.” (traducción) «ver qué páginas puede encontrar e indexar Google en tu sitio y conocer cualquier problema de indexación encontrado».
Divide todas las URL que Google conoce de tu sitio en dos grupos:
- Indexed (Indexada) — estas páginas pueden aparecer en Google Search.
- Not indexed (No indexada) — estas páginas no están en el índice, ya sea porque algo está roto o porque hay una razón perfectamente válida (la página es un duplicado, la bloqueaste, le indicaste a Google que no la indexara, etc.).
Debajo de eso, una tabla llamada “Why pages aren’t indexed” (Por qué las páginas no están indexadas) enumera los motivos y cuántas URL se incluyen en cada uno. Esa es la parte que realmente usas como base.
Por qué “no indexada” normalmente no es una crisis
Esto es lo que la mayoría pasa por alto la primera vez que abre este informe: no indexado no significa que algo esté roto. Google lo dice claramente en la ayuda del propio informe — “Not indexed is not necessarily bad.” (traducción) «No indexado no es necesariamente malo.» No deberías esperar que todas las URL de tu sitio se indexen. Páginas de etiquetas, versiones filtradas de un listado de productos, URL antiguas redirigidas, duplicados: que Google las deje fuera significa que el informe funciona correctamente.
Así que cuando veas un número grande de “no indexado”, no te alarmes. Lee qué motivos están detrás antes de cambiar nada.
Es la herramienta equivocada para comprobar una página
Esta es una visión general de todo tu sitio. Si quieres saber si una URL específica está indexada, este no es el informe para ello: usa la herramienta de inspección de url (la barra de búsqueda en la parte superior de Search Console). Google es explícito al respecto. El informe es para tendencias y agrupaciones; la inspección de url es para una página a la vez.
¿Lo necesitas siquiera?
Si tu sitio tiene menos de 500 páginas, Google afirma: “probably don’t need to use
this report” (traducción) «probablemente no necesites usar este informe» — una búsqueda site:yoursite.com en Google basta para comprobar puntualmente
qué está indexado. El informe resulta útil en sitios más grandes donde no puedes revisar todo
a simple vista.
¿Quieres la versión completa — cómo leer cada columna, qué significan los 16 estados, cómo funciona “Validate fix” (Validar corrección) y cómo diagnosticar una caída repentina de páginas indexadas? Cambia a la pestaña Advanced (Avanzado).
Evidencia de esta afirmación The Page indexing report shows indexed and not-indexed pages known to Google and groups non-indexing by reason. Alcance: Current Page indexing report terminology and behavior. Confianza: alta · Verificado: Google Search Console: Page indexing report Evidencia de esta afirmación The Page indexing report is for site-wide patterns; URL Inspection provides the indexed and live-test details for an individual URL. Alcance: Current distinction between Page indexing and URL Inspection. Confianza: alta · Verificado: Google Search Console: URL Inspection toolTL;DR — El Page Indexing report (anteriormente Index Coverage; “Pages” (“Páginas”) bajo “Indexing” (“Indexación”) en GSC) es una vista agregada de cada URL que Google conoce en tu propiedad, dividida en Indexed (indexadas) y Not indexed (no indexadas), con las URL no indexadas agrupadas por motivo en la tabla “Why pages aren’t indexed” (“Por qué las páginas no están indexadas”). No es para páginas individuales; para eso está URL Inspection (Inspección de URL). La mentalidad que importa: no estar indexado no es necesariamente malo — las páginas canónicas/duplicadas, noindex, robots y los errores 404 intencionales son resultados correctos; Google afirma que solo deberías esperar que se indexen tus páginas canónicas. Filtra por Source = Website (Fuente = Sitio web) para encontrar lo que puedes corregir, trabaja la tabla preordenada de arriba hacia abajo y usa Validate fix (Validar corrección) (~2 semanas, por lo general) para solicitar un nuevo rastreo. El informe va por detrás de la realidad. Los sitios con menos de 500 páginas probablemente no lo necesitan.
Qué es realmente el informe (y su nombre antiguo)
La definición en una línea de Google es la más clara: el informe te permite “see which pages Google can find and index on your site, and learn about any indexing problems encountered.” (traducción) «ver qué páginas puede encontrar e indexar Google en tu sitio, y conocer cualquier problema de indexación encontrado». Con más precisión, “shows the Google indexing status of all URLs that Google knows about in your property.” (traducción) «muestra el estado de indexación de Google de todas las URL que Google conoce en tu propiedad». Es un informe agregado, de toda la propiedad — no una herramienta por URL.
Si llevas más de un par de años haciendo SEO, conocías esto como el Index Coverage report. Google le cambió el nombre a Page indexing en 2022 (se muestra como “Pages” en la navegación izquierda), por lo que muchas guías antiguas — y la memoria muscular de muchas personas — todavía lo llaman “Coverage.” Es el mismo informe. Lo aclaro porque las personas que buscan el nombre antiguo necesitan saber que están en el lugar correcto. (El cambio de nombre se detectó por primera vez en una demostración de Google I/O 2022 y se implementó más tarde ese año; antes de eso, una actualización de calidad de los datos de enero de 2021 ya había reelaborado varios de los estados, por eso algunas capturas de pantalla antiguas no coincidirán con lo que ves hoy.)
Cómo leer el informe
La vista de resumen tiene algunas partes que vale la pena entender antes de empezar a hacer clic.
Indexed vs. Not indexed. Los dos totales que están encima del gráfico. Google señala que estos son “complete and accurate from Google’s perspective, but small discrepancies can occur for various reasons” (traducción) «completos y precisos desde la perspectiva de Google, pero pueden producirse pequeñas discrepancias por diversas razones» — así que no esperes que igualen perfectamente tu recuento de URL. Puedes hacer clic en “View data about indexed pages” para ver el recuento histórico de páginas indexadas y una muestra de hasta 1 000 URL indexadas.
La tabla “Why pages aren’t indexed”. Este es el corazón. La tabla “shows issues that prevented URLs from being indexed on your site,” (traducción) «muestra los problemas que impidieron que las URL se indexaran en tu sitio,» y está ordenada según lo que Google considera los problemas más importantes por abordar. Empieza por la parte superior — el orden ya es una lista de prioridades.
La columna Source (Origen) — tu filtro de correcciones. Cada problema tiene como origen Google o el sitio web, y la orientación de Google es directa: “The Source value in the table shows whether the source of the issue is Google or the website. In general, you can fix only issues where the source is listed as ‘Website’.” (traducción) «El valor Source (Origen) de la tabla muestra si el origen del problema es Google o el sitio web. En general, puedes corregir solo los problemas cuyo origen aparece como ‘Website’ (Sitio web).» Por tanto, Source = Website (Origen = Sitio web) más un estado de validación de “failed” o “not started” es tu verdadera lista de tareas. Los estados con origen en Google (por ejemplo, un duplicado que decidió consolidar) normalmente no son algo que te corresponda “corregir”.
La tabla “Improve page experience” (Mejorar la experiencia de la página). Una tabla independiente para “issues that didn’t prevent page indexing, but we recommend that you fix them.” (traducción) «problemas que no impidieron la indexación de la página, pero te recomendamos que los corrijas.» Son advertencias, no bloqueadores.
El filtro de sitemap. Encima del gráfico puedes limitar el informe a All known pages (Todas las páginas conocidas), All submitted pages (Todas las páginas enviadas), Unsubmitted pages only (Solo páginas no enviadas) o un specific sitemap (sitemap específico). (Nota: “A URL is considered to be submitted by a sitemap even if it was also discovered through some other mechanism.” (traducción) «Una URL se considera enviada por un sitemap incluso si también se descubrió mediante algún otro mecanismo.») Este filtro es realmente útil; hay más información sobre esto en la sección de validación.
Las listas de URL de ejemplo tienen un límite. Cuando abres un estado, la muestra de URL afectadas está “limited to 1,000 items, and isn’t guaranteed to show all URLs in a given status, even when less than 1,000 items.” (traducción) «limitada a 1 000 elementos y no garantiza mostrar todas las URL de un estado dado, incluso cuando hay menos de 1 000 elementos.» Trata los ejemplos como una muestra, no como una exportación completa de todo lo que hay en ese grupo.
Orden de triaje, si solo tienes diez minutos. Limita el informe al sitemap que representa tu inventario de URLs previsto, para que lo leas en función de las páginas que realmente quieres que se indexen. Primero examina los totales en busca de cualquier cambio inesperado — una caída o un pico es más urgente que un número estable. Filtra por Source = Website para los problemas en los que realmente puedes actuar. Dentro de esa lista filtrada, prioriza lo que afecte a una plantilla o patrón de URL crítico para el negocio por encima de un caso aislado. Luego corrige todo el patrón — no solo una URL — antes de validar.
Informe vs. URL Inspection — usa la herramienta correcta
La distinción práctica más importante de esta página. Google: “This report isn’t used to investigate the index status of specific pages. To find the index status of a specific page, use the URL Inspection tool.” (traducción) «Este informe no se usa para investigar el estado de indexación de páginas específicas. Para consultar el estado de indexación de una página específica, usa la herramienta de inspección de URL».
- Page Indexing report = tendencias agregadas, agrupadas por motivo, en toda la propiedad.
- URL Inspection = estado en vivo/indexado de una URL, la canónica que eligió Google y una opción “Test live URL”.
Cuando un estado te resulte confuso, toma una URL de muestra de ese estado e inspecciónala. Las dos herramientas están diseñadas para usarse juntas.
Una nota sobre el retraso — el informe va por detrás de la realidad
Este punto evita muchas falsas alarmas. El informe no se actualiza en tiempo real; refleja la última vez que Google rastreó cada URL, y los recuentos cambian cuando Google vuelve a rastrear (Google: “updates your instance count whenever it crawls a page with known issues, whether or not you explicitly requested fix validation” (traducción) «actualiza el recuento de instancias cada vez que rastrea una página con problemas conocidos, ya sea que hayas solicitado explícitamente la validación de la corrección o no»). John Mueller, de Google, ha descrito el informe de indexación como algo retrasado; su interpretación es que se trata más de una cuestión de tiempos: las URL aparecen en el informe y luego se indexan con el tiempo, por lo que el informe esencialmente está poniéndose al día con un estado que ya ha cambiado. No reacciones de forma exagerada ante un número que simplemente puede estar desactualizado.
Una limitación que vale la pena conocer antes de apoyarte en “Test live URL” de URL Inspection (Inspección de URLs) para zanjar una discusión: la prueba en vivo confirma si Google puede rastrear e indexar esa URL en este momento, pero no te indica qué URL canónica elegirá Google entre un conjunto de duplicados. La selección de la URL canónica es una decisión de indexación separada que se toma sobre los datos indexados, no algo que evalúe la prueba en vivo. En concreto, para los estados de canónica/duplicado, el resultado indexado en la herramienta de inspección de URL (no la prueba en vivo) es la señal en la que confiar, y aun así puede retrasarse respecto a tu último cambio.
Adónde ir a continuación — todos los estados, agrupados
La tabla “Why pages aren’t indexed” es el mapa hacia el resto de esta sección. Cada estado de abajo tiene su propio análisis detallado (también están en la barra lateral). Los he agrupado por lo que realmente está ocurriendo, porque la reacción correcta es completamente diferente según el grupo — algunos los corriges, otros los confirmas y los dejas como están.
No indexado: decisión de Google (a menudo no hay nada que corregir)
- Discovered – currently not indexed — Google encontró la URL pero todavía no la ha rastreado. Por lo general, es una señal de demanda de rastreo o de calidad del sitio, no un error de una sola página.
- Crawled – currently not indexed — Google rastreó la página y decidió no indexarla (aún). Un grupo grande aquí a menudo apunta a calidad o duplicación, en todo el sitio.
Bloqueado por ti (intencional: confirma que es deliberado)
- bloqueado por robots.txt — tu robots.txt le indicó a Google que no la rastreara.
- URL marked ‘noindex’ — Google encontró una directiva
noindexcuando intentó indexar la página.
Errores HTTP (estos por lo general los corriges)
- Blocked due to unauthorized request (401) — la página le pidió a Googlebot que se autenticara.
- Blocked due to access forbidden (403) — no se concedió acceso al rastreador.
- Blocked due to other 4xx issue — un 4xx que no es uno de los mencionados.
- Server error (5xx) — tu servidor devolvió un error de nivel 500 cuando se solicitó la página.
- error 404 — la URL devolvió un 404 cuando se solicitó.
Canónicas y duplicados (correcto en su mayoría; verifica la canónica elegida)
- Alternate page with proper canonical tag — esta página apunta correctamente a su canónica, que está indexada. Funciona según lo previsto.
- Duplicate without user-selected canonical — Google la agrupó como duplicado y eligió una página diferente como canónica, y nunca declaraste una.
- Duplicate, Google chose different canonical than user — declaraste una canónica, pero Google eligió una URL diferente. (Consulta canonicalización — la solución es alinear tus señales, no añadir una etiqueta más fuerte.)
Redirecciones (una es normal, otra es un error)
- Page with redirect — una URL no canónica que redirige a otra página. Esto es normal; lo que se indexa es el destino.
- Redirect error — una redirección rota: una cadena de redirecciones demasiado larga, un bucle de redirección, una URL de destino vacía o incorrecta, o una que supera la longitud máxima de URL. Este sí lo corriges.
Advertencias (indexadas, pero merecen atención)
- Indexed, though blocked by robots.txt — la página se indexó a pesar de tu
bloqueo de robots.txt (los enlaces hacia ella fueron suficientes). Google no puede leer su contenido ni ningún
noindexque hayas colocado allí — un problema clásico de rastreo frente a indexación. - Page indexed without content — indexada, pero Google no pudo leer contenido significativo (a menudo un problema de renderizado o similar al cloaking).
Estoy nombrando cada estado de la forma en que Google lo etiqueta para que los artículos por estado se enlacen automáticamente a medida que se publican. El tema recurrente: los grupos de canónica/duplicado, noindex, robots y 404 intencional suelen ser correctos — Google dice literalmente “You should not expect all URLs on your site to be indexed, only the canonical pages.” (traducción) «No deberías esperar que todas las URL de tu sitio se indexen, solo las páginas canónicas». Los grupos que realmente hay que perseguir son los errores HTTP, los errores de redirección, y los montones de “crawled/discovered not indexed” inesperadamente grandes.
Corrección y validación
Una vez que hayas corregido los problemas reales (Source = Website), indícale a Google que vuelva a comprobarlo:
- Corrige cada instancia del problema en tu sitio primero.
- Abre los detalles del problema y haz clic en “Validate fix”.
- No hagas clic de nuevo hasta que la validación tenga éxito o falle.
Tiempos: “Validation typically takes up to about two weeks, but in some cases can take much longer, so please be patient.” (traducción) «La validación normalmente tarda hasta unas dos semanas, pero en algunos casos puede tardar mucho más, así que ten paciencia». La solicitud pasa por estados (Not started → Started → Looking good → Passed, o Failed, o N/A si Google encontró el problema corregido por sí solo antes de que empezaras). No tienes estrictamente que hacer clic en validar en absoluto — Google puede detectar las correcciones por sí solo — pero la validación te da un resultado con seguimiento.
El truco de velocidad: valida con un subconjunto. Envía un sitemap de solo tus páginas más importantes, filtra el informe por ese sitemap y luego solicita la validación — Google señala “a validation request against a subset of your affected URLs can complete faster.” (traducción) «una solicitud de validación sobre un subconjunto de tus URL afectadas puede completarse más rápido».
Diagnóstico de caídas, picos y “más no indexadas que indexadas”
Algunos patrones que el propio Google señala y que busco primero:
- Las páginas indexadas cayeron sin que se muestren errores. Probablemente bloqueaste
páginas existentes — una nueva regla de robots.txt, un
noindexo un requisito de inicio de sesión. Busca un pico coincidente en un estado de página no indexada. - Más no indexadas que indexadas. Por lo general, una regla de robots.txt que bloquea una sección grande,
o una avalancha de duplicados procedentes de parámetros de filtro/orden (
?type=dress,?color=green,?sort=price). Se trata de un problema de navegación por facetas y canonicalización, más que de indexación. - Un pico repentino de errores. A menudo, un cambio de plantilla que introdujo un error en muchas URL, o un sitemap enviado lleno de URL bloqueadas o marcadas con noindex.
Algunas cosas que hay que tener claras
- Indexado ≠ posicionamiento. Indexado solo significa elegible para aparecer en la Búsqueda. Si se posiciona depende de la consulta y de muchos otros factores.
- El objetivo no es una cobertura del 100 %. Según Google, solo deberían indexarse tus páginas canónicas; un sitio saludable tiene muchas URL intencionalmente no indexadas.
- Validate fix no reindexa al instante. Pone en cola un nuevo rastreo de las URL afectadas conocidas; calcula ~2 semanas.
- Los datos de GSC tienen límites. Las listas de ejemplos tienen un límite de 1 000; los totales pueden variar ligeramente; y el informe se retrasa. (Mi propio estudio de datos de GSC — Las consultas anonimizadas representan casi la mitad del tráfico de GSC — es un buen recordatorio de que Search Console ofrece una visión potente, pero incompleta.)
Una nota breve sobre Bing
Bing no tiene un equivalente único de “Page Indexing”. La vista agregada más cercana es Site Explorer en Bing Webmaster Tools (explora tu sitio como un árbol de carpetas desglosado por páginas indexadas, con errores, con advertencias y excluidas), y URL Inspection en Bing cubre el caso de una sola URL. Usa Site Explorer para la vista general y URL Inspection para una sola página.
Esta página es el centro del Page Indexing report; los análisis detallados por estado se encuentran bajo ella. Para ver todo el proceso — descubrimiento, rastreo, renderizado, indexación y servicio — consulta el clúster Cómo funciona la búsqueda.
Resumen de IA
Una visión condensada de la versión avanzada:
- Qué es: el Page Indexing report de Google Search Console (anteriormente Index Coverage; “Pages” dentro de “Indexing”). Muestra el estado de indexación de cada URL que Google conoce en tu propiedad, dividido en Indexed y Not indexed.
- Es agregado, no por URL. Para una sola página, usa URL Inspection — Google dice que el informe “isn’t used to investigate the index status of specific pages.” (traducción) «no se usa para investigar el estado de indexación de páginas específicas».
- Not indexed no es necesariamente malo. Canónica/duplicado, noindex, robots, y los 404 intencionales son resultados correctos; Google dice que solo deberías esperar que tus páginas canónicas se indexen.
- La tabla “Why pages aren’t indexed” está preordenada por importancia — trabájala de arriba hacia abajo. Filtra por Source = Website para encontrar lo que realmente puedes arreglar (los problemas de origen de Google generalmente no son tuyos).
- 16 estados, agrupados: no indexados por decisión de Google (discovered/crawled – currently not indexed); bloqueados por ti (robots.txt, noindex); errores HTTP (401, 403, otros 4xx, 5xx, 404); canónica/duplicado (alternate, duplicate w/o canonical, Google chose different canonical); redirecciones (page with redirect = normal vs. redirect error = roto); advertencias (indexed though blocked by robots.txt, page indexed without content).
- Fix → Validate fix (~2 semanas típico). Truco de velocidad: filtra a un sitemap de tus páginas principales y valida el subconjunto.
- El informe va por detrás de la realidad — Mueller lo ha descrito como un informe que se pone al día con el tiempo. No reacciones de forma exagerada ante un número desactualizado.
- Diagnóstico: caída de indexadas + sin errores = bloqueaste algo; más no indexadas que indexadas = bloqueo de robots o duplicados de parámetros; pico de errores = cambio de plantilla o un sitemap defectuoso.
- Los sitios pequeños (<500 páginas) probablemente no lo necesitan — una búsqueda con
site:basta. - Bing: no hay equivalente directo — Site Explorer para la vista agregada, URL Inspection para una página.
Documentación oficial
Documentación de fuentes primarias de los motores de búsqueda.
- Page indexing report — Ayuda de Search Console: los grupos, la columna Source, todos los estados, el filtro de sitemap y el flujo de validación de correcciones.
- Mejoras de datos de Index Coverage (ene 2021) — la actualización de calidad de los datos que reelaboró varios estados (eliminó “crawl anomaly”, añadió “indexed without content”, cambió “submitted but blocked” a “indexed but blocked”).
- Herramienta de inspección de URL — el complemento por URL de este informe.
Bing / Microsoft
- Bing Webmaster Tools — Inspección de URL — la vista por URL de indexación/SEO/marcado de Bing.
- Bing Webmaster Tools — Site Explorer (Refreshed Webmaster Tools) — el equivalente agregado más cercano al informe Page Indexing de GSC.
Citas de la fuente
Declaraciones oficiales de Google. Cada enlace es un enlace profundo que salta al pasaje citado en la página de origen.
Google: qué es el informe y qué muestra
- “See which pages Google can find and index on your site, and learn about any indexing problems encountered.” (traducción) «Consulta qué páginas puede encontrar e indexar Google en tu sitio, y obtén información sobre cualquier problema de indexación que se haya encontrado.» — Ayuda de Search Console. Ir a la cita
- “The Page indexing report shows the Google indexing status of all URLs that Google knows about in your property.” (traducción) «El informe de indexación de páginas muestra el estado de indexación de Google de todas las URL que Google conoce en tu propiedad.» Ir a la cita
Google — informe vs. página individual, y quién puede solucionarlo
- “This report isn’t used to investigate the index status of specific pages. To find the index status of a specific page, use the URL Inspection tool.” (traducción) «Este informe no se usa para investigar el estado de indexación de páginas específicas. Para averiguar el estado de indexación de una página específica, usa la herramienta de inspección de URL.» Ir a la cita
- “The Source value in the table shows whether the source of the issue is Google or the website. In general, you can fix only issues where the source is listed as “Website”.” (traducción) «El valor Source de la tabla indica si el origen del problema es Google o el sitio web. En general, solo puedes corregir los problemas en los que el origen aparece como “Website”.» Ir a la cita
Google — “not indexed” no es necesariamente malo
- “Not indexed is not necessarily bad.” (traducción) «No estar indexado no es necesariamente malo.» Ir a la cita
- “You should not expect all URLs on your site to be indexed, only the canonical pages.” (traducción) «No deberías esperar que se indexen todas las URL de tu sitio, solo las páginas canónicas.» Ir a la cita
Google — quién lo necesita, tiempo de validación
- “If your site has fewer than 500 pages, you probably don’t need to use this report.” (traducción) «Si tu sitio tiene menos de 500 páginas, probablemente no necesites usar este informe.» Ir a la cita
- “Validation typically takes up to about two weeks, but in some cases can take much longer, so please be patient.” (traducción) «La validación normalmente tarda hasta unas dos semanas, pero en algunos casos puede tardar mucho más, así que ten paciencia.» Ir a la cita
Gary Illyes, Google — sobre “crawled – currently not indexed” y la calidad del sitio (SERP Conf 2024, difundido por Search Engine Journal)
- “And the general quality of the of the site, that can matter a lot of how many of these crawled but not indexed you see in search console. If the number of these URLs is very high that could hint at general quality issues.” (traducción) «Y la calidad general del sitio, eso puede importar mucho en cuántas de estas URL rastreadas pero no indexadas ves en Search Console. Si el número de estas URL es muy alto, eso podría indicar problemas de calidad general.» Leer la cobertura
John Mueller, Google — sobre el retraso del informe (difundido por Search Engine Journal)
- “It’s more a matter of timing, where URLs show up in the report and then get indexed over the time period…” (traducción) «Es más una cuestión de tiempos: las URL aparecen en el informe y después se indexan a lo largo del periodo…» Leer la cobertura
#:~:text= más largos se resuelven en tu navegador. Las frases de Illyes y
Mueller se citan a través de la cobertura del momento de Search Engine Journal
(las páginas de SEJ usan comillas tipográficas, por lo que los fragmentos de enlace profundo apuntan a subcadenas ASCII
más cortas) y deberían confirmarse con los originales antes de considerarlas
definitivas. La frase de Illyes “general quality” se atribuye a Gary Illyes, no a
Mueller. Uso del Page Indexing report — lista de verificación
Un proceso repetible para clasificar el informe en lugar de limitarte a mirarlo:
- Anota los totales de Indexed vs. Not indexed (indexadas frente a no indexadas) y la tendencia — ¿algo se está moviendo?
- Abre la tabla “Why pages aren’t indexed” (Por qué no se indexan las páginas) y trabájala de arriba hacia abajo (está preordenada por importancia).
- Centra tu atención en Source = Website (Fuente = Sitio web): esos son los problemas que puedes solucionar realmente.
- Para cada problema real, toma una URL de muestra y ejecútala en URL Inspection (Inspección de URLs) para confirmar qué está pasando en esa página.
- Separa los estados intencionales (noindex, robots-blocked, alternate w/ proper canonical, page with redirect) de los estados rotos (5xx, 404, redirect error, unexpected 4xx) — solo persigue los rotos.
- Para los estados de canonical/duplicate, verifica la canonical elegida por Google en URL Inspection (Inspección de URLs) antes de “corregir” algo (consulta canonicalización).
- Si crawled / discovered – currently not indexed es elevado, trátalo como una señal de calidad del sitio / demanda de rastreo, no como un error por página.
- Cruza una caída en las páginas indexadas con un aumento repentino en un estado de no indexado (puede que hayas bloqueado algo).
- Corrige todas las instancias, luego haz clic en Validate fix (Validar corrección) — y no vuelvas a hacer clic hasta que se resuelva.
- Para validar más rápido, filtra a un sitemap de tus páginas principales y valida ese subconjunto.
- Recuerda que el informe tiene retraso — dales a los cambios ~2 semanas antes de juzgarlos.
Los modelos mentales
1. Informe = agregado; URL Inspection (herramienta de inspección de URL) = una sola página. El Page Indexing report te muestra patrones en todo el sitio. URL Inspection (herramienta de inspección de URL) te dice la verdad sobre una URL (estado en vivo, canónica elegida, renderizado). Combínalos siempre: detecta un patrón en el informe y confirma la causa con la herramienta de inspección.
2. No indexada ≠ rota. La reacción predeterminada ante un número alto de páginas no indexadas debería ser «déjame leer las razones», no «déjame arreglarlo todo». Los casos de canónica/duplicado, noindex, robots y respuestas intencionales de página no encontrada son correctos. Google solo espera que tus páginas canónicas se indexen.
3. Source = Website es tu lista de tareas. La columna Source divide los problemas en «decisión de Google» y «tu decisión». Solo puedes actuar sobre los de Website. Filtrar por Source = Website (además de validation state failed/not started) convierte una tabla intimidante en una lista accionable.
4. El orden de clasificación es una lista de prioridades. Google ordena previamente la tabla «Why pages aren’t indexed» por importancia. No inventes tu propio orden — empieza por la parte superior y avanza hacia abajo.
5. Validate fix es una solicitud de nuevo rastreo, no un interruptor. Al hacer clic en esta opción, le pides a Google que vuelva a comprobar las URL afectadas conocidas; tarda ~2 semanas y puede fallar. El truco para acelerarlo es limitarlo a un sitemap de tus páginas más importantes.
6. El informe siempre va un poco atrasado. Refleja el último rastreo por URL y se actualiza al volver a rastrear. Considera cualquier lectura puntual como una instantánea atrasada, no como la verdad en vivo.
Page Indexing report — hoja de referencia
Los dos informes que la gente confunde
| Pregunta | Uso |
|---|---|
| ¿Cómo se indexa todo mi sitio y por qué no se indexan las páginas? | Page Indexing report |
| ¿Está indexada esta URL? ¿Qué canónica eligió Google? | URL Inspection (Inspección de URLs) |
Los 16 estados, agrupados
| Grupo | Estados | Reacción habitual |
|---|---|---|
| Elección de Google (no indexado) | Discovered – currently not indexed · Crawled – currently not indexed | Señal de calidad / demanda de rastreo; no es una corrección de una sola página |
| Bloqueado por ti | Blocked by robots.txt · URL marked ‘noindex’ | Confirma que es intencional |
| Errores HTTP | 401 · 403 · otros 4xx · 5xx · 404 | Corrígelos |
| Canónica & duplicados | Alternate page w/ proper canonical · Duplicate without user-selected canonical · Duplicate, Google chose different canonical than user | Mayormente correcto; verifica la canónica elegida |
| Redirecciones | Page with redirect (normal) · Redirect error (roto) | Corrige solo el error de redirección |
| Advertencias | Indexed, though blocked by robots.txt · Page indexed without content | Indexada, pero merece atención |
Datos rápidos
- Nombre antiguo: Index Coverage report (renombrado a Page indexing en 2022).
- Source = Website = los problemas que puedes corregir.
- Validate fix ≈ 2 semanas; limítalo a un sitemap pequeño para ir más rápido.
- Las listas de URL de ejemplo tienen un límite de 1 000; los totales pueden variar ligeramente; el informe va con retraso.
- Indexado ≠ posicionamiento — indexado solo significa que es elegible para aparecer.
- ¿<500 páginas? Probablemente no necesites este informe — usa una búsqueda con
site:.
Problemas comunes
Síntoma → causa probable → solución, para los patrones que realmente hacen que los usuarios vuelvan a este informe.
Se están indexando páginas de inicio de sesión, de acceso denegado o vacías de la aplicación
Ejemplo práctico: /account/invoices/123 está diseñado para requerir un inicio de sesión. Para un
rastreador sin iniciar sesión, devuelve 200 OK, una directiva robots normal que permite la indexación y una
estructura HTML con la marca cuyo contenido principal dice “Sign in to continue.” Los enlaces internos o
un sitemap antiguo exponen miles de URL de facturas. Google no está eludiendo el
inicio de sesión: está indexando la estructura 200 rastreable que la aplicación devolvió
deliberadamente.
Inspecciona varias URL sin iniciar sesión y compara el estado HTTP, la etiqueta canónica, las directivas robots
y el contenido principal renderizado. La solución suele ser a nivel de plantilla: requiere
autenticación antes de servir el recurso, devuelve el código de estado HTTP correcto (401, 403,
404 o 410) para el modelo de acceso previsto, elimina las URL de
los sitemaps y de la navegación rastreable, o sirve un noindex rastreable si la estructura pública
debe permanecer accesible. Verifica tanto la respuesta en vivo como el estado de indexación; corregir
una URL de muestra no demuestra que el patrón de ruta esté corregido.
Disminuyó el número de elementos indexados, no se muestran errores nuevos
- Síntoma: el total de “Indexed” disminuye entre visitas, pero la tabla “Why pages aren’t indexed” no muestra un pico coincidente en un estado de error.
- Causa probable: bloqueaste páginas que antes estaban indexadas: una nueva
regla disallow en
robots.txt, unnoindexincluido en una plantilla, o un requisito de inicio de sesión o muro de pago añadido a una sección del sitio. - Solución: comprueba si hay un pico coincidente en un estado no indexado y sin error (bloqueado por
robots.txt, noindex, o discovered/crawled – currently not indexed) en lugar de los
estados de error HTTP. Confirma en una URL de muestra con URL Inspection y comprueba las
directivas robots activas con el robots-txt-tester (
/tools/robots-txt-tester).
”Más páginas no indexadas que indexadas”
- Síntoma: el total de páginas no indexadas es mayor que el total de páginas indexadas, y no se trata de un sitio completamente nuevo.
- Causa probable: una regla de
robots.txtque bloquea una sección grande, o una avalancha de URL casi duplicadas procedentes de parámetros de filtro u ordenación (?color=green,?sort=price) que Google está agrupando en estados de “duplicate”. - Solución: comprueba el patrón de parámetros con las etiquetas canónicas mediante el
canonical-checker (
/tools/canonical-checker) y luego confirma que las URL afectadas realmente son duplicadas comparando directamente su contenido renderizado. Se trata de un problema de navegación por facetas y canonicalización disfrazado de problema de indexación, no de un error del informe.
Un pico repentino en un estado de error HTTP
- Síntoma: los recuentos de 401, 403, 404 o 5xx aumentan en muchas URL a la vez, normalmente después de un despliegue.
- Causa probable: un cambio de plantilla que rompió un componente compartido (comprobación de autenticación, regla de redirección, página de error), o un sitemap recién enviado lleno de URL que están bloqueadas, con Noindex o que ya no existen.
- Solución: extrae una muestra de las URL afectadas del detalle de estados y
vuelve a comprobar sus códigos de estado en vivo con http-status-checker
(
/tools/http-status-checker). Si procede del sitemap, audita el propio sitemap con sitemap-validator (/tools/sitemap-validator) antes de volver a enviarlo.
”Redirect error” (no el “Page with redirect” normal)
- Síntoma: el informe muestra Redirect error, distinto del estado esperado Page with redirect.
- Causa probable: una cadena de redirecciones demasiado larga, un bucle de redirección, una URL de destino vacía o mal formada, o una URL de destino que supera la longitud máxima de URL de Google.
- Solución: rastrea la secuencia real de saltos con redirect-chain-mapper
(
/tools/redirect-chain-mapper) y acórtala a un solo salto hacia la URL final.
”Validate fix” devuelve Failed
- Síntoma: corregiste el problema, hiciste clic en Validate fix y se resuelve como Failed en lugar de Passed.
- Causa probable: o bien la corrección no llegó realmente a todas las URL afectadas (una caché de CDN, un despliegue solo en staging o una corrección de plantilla que omitió algunos patrones de URL), o Google volvió a rastrear antes de que la corrección se propagara.
- Solución: comprueba puntualmente y de forma directa unas cuantas URL originalmente afectadas (ver el código fuente o una comprobación de estado HTTP/robots, no solo el renderizado del navegador) para confirmar que la corrección está activa en todas partes, luego vuelve a solicitar la validación — no necesitas esperar a que se reinicie el ciclo completo si se confirma que el problema subyacente está corregido.
Pruebas de validación
Prueba de que una corrección que hiciste cambió realmente la realidad subyacente del informe — no solo de que el informe dice que sí.
Confirma que el estado en vivo de una página bloqueada coincide con lo esperado
- Prueba para ejecutar: http-status-checker (
/tools/http-status-checker) ocurl -Icontra la URL afectada. - Resultado esperado: el código de estado que pretendías —
200si pretendías desbloquearla, o un301/404deliberado si pretendías eliminarla. - Interpretación del fallo: si todavía devuelve el error anterior (401/403/5xx), la corrección no se ha desplegado en todas partes (comprueba la caché de CDN, el balanceador de carga o el entorno).
- Ventana de monitorización: inmediata — el estado HTTP está en vivo, no tiene retraso.
- Activador de reversión: el estado no coincide con la intención después de purgar la caché y esperar unos minutos — revierte el cambio y vuelve a diagnosticar antes de tocar producción de nuevo.
Confirma que una corrección de robots.txt realmente desbloquea la URL
- Prueba que se debe ejecutar: robots-txt-tester (
/tools/robots-txt-tester) para la ruta de URL específica. - Resultado esperado: la herramienta de prueba informa que la URL está permitida para Googlebot.
- Interpretación de fallo: si sigue bloqueada, significa que la regla no se eliminó, una regla más específica sigue coincidiendo o se comprobó el robots.txt equivocado (staging frente a producción).
- Ventana de monitoreo: inmediata para el archivo en sí; permite un ciclo de rastreo normal (días, no horas) antes de esperar que se actualice el estado de GSC.
- Activador de reversión: la herramienta de prueba sigue mostrando la URL bloqueada después de confirmar que
editaste el
robots.txtactivo de producción; trátalo como no resuelto y continúa depurando.
Confirma que una corrección de canonicalización se resolvió como pretendías
- Prueba para ejecutar: canonical-checker (
/tools/canonical-checker) en la URL afectada, seguido de URL Inspection (Inspección de URLs) en GSC para la canónica seleccionada por Google. - Resultado esperado: la etiqueta
<link rel="canonical">coincide con la URL que quieres indexar, y URL Inspection (Inspección de URLs) muestra que Google coincide con tu canónica declarada. - Interpretación del fallo: si Google todavía muestra una “Google-selected canonical” (canónica seleccionada por Google) diferente de tu canónica declarada, tu corrección abordó la etiqueta, pero no las señales de duplicación subyacentes (los enlaces internos, las entradas del sitemap y las redirecciones todavía deben coincidir).
- Ventana de seguimiento: 2–4 semanas — la selección de la canónica es una de las señales más lentas en volver a estabilizarse.
- Activador de reversión: la canónica seleccionada por Google todavía no coincide con la tuya después de 4+ semanas y un ciclo de Validate fix (Validar corrección) — trata las señales subyacentes (no solo la etiqueta) como si siguieran en conflicto.
Confirmar que una corrección de redirección eliminó la cadena/bucle
- Prueba para ejecutar: redirect-chain-mapper (
/tools/redirect-chain-mapper) en la URL afectada. - Resultado esperado: un único salto directamente a la URL de destino final con un
200. - Interpretación del fallo: más de un salto, o un bucle de regreso a una URL anterior, significa que la regla de redirección no se consolidó; probablemente estés encadenando una regla nueva sobre una antigua en lugar de reemplazarla.
- Ventana de monitoreo: inmediata para la propia cadena; un ciclo de rastreo normal antes de que se actualice el estado de GSC.
- Activador de reversión: la cadena sigue teniendo más de un salto después de la corrección; revierte y consolida las reglas de redirección en el origen.
Confirma que la solicitud “Validate fix” realmente se aprobó
- Prueba para ejecutar: el botón Validate fix en el estado específico del informe Page Indexing report de GSC (limita el alcance a un sitemap de tus URL prioritarias para obtener una lectura más rápida).
- Resultado esperado: el estado de validación pasa a Passed (o N/A, lo que significa que Google confirmó la corrección de forma independiente).
- Interpretación del fallo: Failed significa que Google volvió a comprobar y aún encontró el problema en al menos algunas URL — retoma la corrección subyacente, no te limites a volver a hacer clic en Validate.
- Ventana de monitorización: “typically up to about two weeks,” (traducción) «normalmente hasta unas dos semanas», según Google — puede prolongarse.
- Activador de reversión: dos resultados Failed consecutivos en el mismo estado después de confirmar que la corrección subyacente está implementada — pasa a comprobar si la corrección realmente llega a todos los patrones de URL afectados, no solo a la muestra que probaste.
Cómo medir
Los KPI permanentes para vigilar este informe a lo largo del tiempo, no comprobaciones puntuales.
Recuento de páginas indexadas (tendencia, no una instantánea)
- Qué te indica: si la huella de páginas indexadas de tu sitio en Google está creciendo, se mantiene estable o está disminuyendo.
- Cómo obtenerlo: el total de “Indexed” en la parte superior del Page Indexing report, o el gráfico histórico debajo de “View data about indexed pages.”
- Punto de referencia / intervalo realista: no hay un número universal; depende completamente de cuántas URL quieres que estén indexadas (tu recuento de páginas canónicas), lo cual varía según el sitio. Compara la tendencia con tu propio recuento de URL canónicas en lugar de buscar una cobertura del 100 %; Google dice explícitamente que solo las páginas canónicas deberían indexarse.
- Cadencia: mensual, o inmediatamente después de un cambio grande de contenido o de estructura de URL.
Total de “Why pages aren’t indexed”, por Source = Website
- Qué te indica: el tamaño de tu lista de tareas real y ejecutable: los problemas que Google dice que tú (no Google) puedes solucionar.
- Cómo obtenerlo: filtra la tabla “Why pages aren’t indexed” por Source = Website y suma los recuentos de URL afectadas de los estados cuyo estado de validación sea “Failed” o “Not started”.
- Punto de referencia / intervalo realista: depende del tamaño y del historial del sitio; no hay un objetivo universal honesto. Establece tu propia línea base en tu próxima revisión completa de la tabla y luego haz un seguimiento de si ese número disminuye en comprobaciones sucesivas.
- Cadencia: mensual para la mayoría de los sitios; semanal durante una limpieza activa o después de una migración grande.
Recuento de códigos de estado de error HTTP (401/403/404/5xx)
- Qué te indica: si las páginas que esperas servir están realmente rotas para Googlebot — el grupo de estados que casi siempre vale la pena corregir.
- Cómo obtenerlo: las filas de cada estado del informe, cotejadas con
el http-status-checker (
/tools/http-status-checker) en una muestra de las URLs afectadas. - Referencia / rango realista: cero es el objetivo honesto para las URLs que pretendes mantener activas — cualquier recuento distinto de cero en páginas canónicas vale la pena investigarlo; un recuento distinto de cero en páginas ya eliminadas (errores 404 esperados) es normal y depende del ciclo de vida de tu contenido.
- Cadencia: compruébalo después de cada despliegue que toque el enrutamiento, la autenticación o las plantillas; de lo contrario, mensualmente.
Tasa de aprobación de Validate fix
- Qué te indica: si tus correcciones realmente se aplican en todas las URLs afectadas, o solo parcialmente.
- Cómo obtenerlo: registra el resultado de cada solicitud Validate fix (Passed / Failed / N/A) en la vista de detalle de estados a lo largo del tiempo.
- Referencia / rango realista: sin objetivo fijo — un patrón saludable es que la mayoría de las solicitudes se resuelvan como Passed o N/A en el primer intento. Los resultados Failed repetidos en el mismo estado son la señal que debes vigilar, no un porcentaje específico.
- Cadencia: por ciclo de corrección — vuelve a comprobar aproximadamente dos semanas después de cada solicitud Validate fix.
Herramientas
The Page Indexing report te indica qué cree Google que está mal; estas herramientas te ayudan a confirmar y corregir la causa subyacente.
Herramientas de este sitio
- gsc-workbench (
/tools/gsc-workbench) — trabaja con tus propios datos de GSC (a través de la API de Search Console) junto con los conceptos de esta página. - gsc-regex-tester (
/tools/gsc-regex-tester) — construye y prueba los filtros de regex que aceptan los informes Performance report y Page Indexing report de GSC, útil para aislar un patrón de URL detrás de un estado. - http-status-checker (
/tools/http-status-checker) — confirma el código de estado HTTP activo (401/403/404/5xx) detrás de un estado de error HTTP antes o después de una corrección. - redirect-checker (
/tools/redirect-checker) y redirect-chain-mapper (/tools/redirect-chain-mapper) — comprueba una única redirección o rastrea una cadena de redirecciones completa cuando veas Redirect error. - canonical-checker (
/tools/canonical-checker) — comprueba la etiqueta canónica declarada en una URL marcada en el grupo de canonicalización/duplicados. - robots-txt-tester (
/tools/robots-txt-tester) — verifica si una URL específica está realmente bloqueada antes de tratar bloqueado por robots.txt como intencional o un fallo. - sitemap-validator (
/tools/sitemap-validator) y xml-sitemap-generator (/tools/xml-sitemap-generator) — audita o reconstruye el sitemap que usarás para delimitar una solicitud de validación de corrección más rápida. - site-audit-lite (
/tools/site-audit-lite) — una comprobación de coherencia más amplia basada en el rastreo cuando un patrón de Page Indexing (gran aumento de errores, duplicación masiva) parece afectar a todo el sitio en lugar de estar aislado en unas pocas URL.
Herramientas de terceros
- Google Search Console — el propio Page Indexing report, además de URL Inspection (Inspección de URLs) para la vista complementaria de una sola URL que se menciona a lo largo de este artículo.
- Bing Webmaster Tools — Site Explorer (vista agregada) y URL Inspection (vista de una sola URL), los equivalentes más cercanos de Bing.
- Screaming Frog — rastrea tu propio sitio de la manera en que lo haría Googlebot para verificar de forma cruzada los códigos de estado, las redirecciones y las etiquetas canónicas a escala antes de confiar en una muestra de GSC.
Recursos que merecen tu tiempo
Mis artículos relacionados
- Cómo solucionar “Discovered - currently not indexed” — un análisis profundo de uno de los estados más malinterpretados en este informe.
- Cómo eliminar URLs de la búsqueda de Google (5 métodos) — se vincula con la parte de noindex / herramienta de eliminación del informe.
- Las consultas anonimizadas representan casi la mitad del tráfico de GSC — mi estudio de datos de GSC; un buen recordatorio de que Search Console es potente, pero incompleta.
- Guía de SEO técnico para principiantes — dónde encajan la indexación y GSC en el panorama general.
Mis ponencias
- Cómo funciona la búsqueda (SlideShare) — mi recorrido por el rastreo, el renderizado, la indexación y la clasificación, que es el contexto en el que se enmarca todo el Page Indexing report. (Se aplica mi descargo de responsabilidad habitual: “This is my understanding of systems… not going to be 100% complete or accurate.” (traducción) «Esta es mi comprensión de los sistemas… no va a ser 100 % completa ni precisa».)
Oficial
Desde la industria
- r/TechSEO — la comunidad para la depuración de la indexación y del informe de cobertura.
- Google explica los motivos de Crawled Not Indexed (Search Engine Journal) — cubre la explicación de Gary Illyes en SERP Conf 2024 sobre por qué unas cifras altas de “crawled not indexed” pueden indicar problemas de calidad en todo el sitio.
- Mueller, preguntado sobre el retraso en el informe de indexación de Google Search Console (Search Engine Journal) — John Mueller explica por qué el informe se retrasa y no debería provocar una reacción excesiva.
- El informe de cobertura de Google Search Console cambia de nombre a Pages Report (Search Engine Roundtable) — la primera observación de Barry Schwartz del cambio de nombre de Index Coverage a Page indexing en Google I/O 2022.
- Mejoras en los datos de Index Coverage (Google Search Central Blog) — la actualización de enero de 2021 que eliminó “crawl anomaly”, añadió “indexed without content” y reelaboró varios estados — explica por qué las capturas de pantalla antiguas no coinciden con el informe actual.
- Ayuda de Google Search Console — Page indexing report — la referencia oficial principal: categorías, la columna Source, todos los estados, el filtro de sitemap y el flujo de Validate fix.
Cuestionario
Pon a prueba lo que recuerdas sobre cómo leer el Page Indexing report.
Registro de cambios
Actualizado el 1 sept 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 28 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 18 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.