Página indexada sin contenido

Qué significa el estado «Página indexada sin contenido» de Google Search Console —la página está en el índice, pero Googlebot no pudo leerla— y cómo diagnosticarlo. A menudo se debe a un bloqueo del servidor o CDN, no solo a JavaScript.

Publicado por primera vez: 23 jun 2026 · Última actualización: 13 ago 2026 · Avanzado
Idiomas
2 señales de evidencia en esta página

«Página indexada sin contenido» es un estado del informe Indexación de páginas de Google Search Console: la URL está en el índice de Google, pero Googlebot no pudo leer contenido útil. La documentación de Google cita como posibles causas el encubrimiento o un formato no indexable y aclara que no equivale a un bloqueo de la página mediante robots.txt. Tampoco es lo mismo que Rastreada/Descubierta: actualmente sin indexar. Aunque suele suponerse que es un problema de JavaScript, en un caso de enero de 2026 John Mueller señaló un bloqueo de bajo nivel del servidor o CDN, a menudo basado en IP y dirigido a Googlebot, que no puede reproducirse con curl ni con un rastreador externo. Otras posibilidades son el encubrimiento, un renderizado vacío, contenido que exige interacción o un formato no compatible. Diagnostique primero los datos indexados de Ver página rastreada en Inspección de URLs. Una prueba en directo válida no demuestra que el estado se haya resuelto. Añadir más texto no arregla una página que Google no puede leer.

TL;DR — «Página indexada sin contenido» indica que la URL está en el índice, pero Googlebot no pudo leer contenido útil. No equivale a «Rastreada/Descubierta: actualmente sin indexar» ni a un bloqueo de página mediante robots.txt. Aunque se suele culpar a JavaScript, en un caso de enero de 2026 Mueller apuntó a un bloqueo de bajo nivel del servidor o CDN, a menudo basado en IP y dirigido a Googlebot, imposible de reproducir con curl o un rastreador externo. Otras ramas son el encubrimiento, un renderizado vacío, contenido condicionado a clics o un formato no compatible. Diagnostique con los datos indexados de Ver página rastreada; una prueba en directo «válida» no demuestra que el estado se haya resuelto.

Qué dice realmente la documentación de Google

La documentación del informe Indexación de páginas es breve: el estado “Page indexed without content” (traducción) «Página indexada sin contenido» indica que la página está en el índice, pero Google no pudo leer el contenido. Como ejemplos cita que se haya encubierto para Google o que use un formato que Google no puede indexar, y recomienda inspeccionar la URL y revisar los detalles de cobertura. Evidence for this claim Google defines Page indexed without content as indexed even though Google could not read the content, citing cloaking or unsupported formats as examples. Scope: Google Search Console Page Indexing status; other diagnoses require inspection. Confidence: high · Verified: Google: Page indexing report Consulte las pestañas Documentación oficial y Citas para ver el texto literal y los enlaces directos.

Conviene precisar dos aspectos que muchas guías mezclan:

  • Google dice «no pudo leer el contenido»; no describe un «objeto vacío» interno que almacene. «Entrada vacía» es solo una abreviatura del efecto visible, no un mecanismo documentado.
  • Este estado no equivale a un disallow de robots.txt para la página, que tiene su propio motivo. robots.txt puede intervenir indirectamente si bloquea un recurso crítico —JS o CSS necesario— y deja vacío el renderizado.
Evidence for this claim Google explicitly says Page indexed without content is not a case of robots.txt blocking; a page-level disallow belongs to the separate robots reason even though critical resource blocks can still impair rendering. Scope: verified Search Console properties Confidence: high · Verified: Page indexing report

Mantenga clara esa diferencia para no confundirlo con estados «sin indexar» ni con un bloqueo de robots.

No dé por hecho que es JavaScript

Esta es la corrección más importante del artículo.

Muchas guías tratan «indexada sin contenido» como un problema de renderizado o JavaScript. John Mueller cuestionó esa idea en un caso concreto de r/TechSEO: una página de inicio cayó aproximadamente de la posición 1 a la 15 tras aparecer este estado. Explicó que normalmente significa que el servidor o CDN impide que Google reciba contenido y que no está relacionado con JavaScript. Añadió que suele ser un bloqueo de bajo nivel, a veces basado en la IP de Googlebot, por lo que resulta casi imposible probarlo fuera de Search Console. El entorno afectado era, según el relato, Webflow con Cloudflare. (Se parafrasea una observación transmitida por terceros, no una cita verificada; es un caso documentado, no una estadística de frecuencia.)

El «normalmente» de Mueller describe ese intercambio, no un orden universal. La documentación de Google tampoco clasifica las causas; solo menciona encubrimiento y formato no compatible. Recorra estas ramas según la evidencia y deje que la respuesta recibida por Googlebot determine la correcta:

  • Respuesta del servidor, CDN o WAF: la capa de red deja a Googlebot sin contenido, a menudo según la IP y sin señales externas. Es la causa documentada por Mueller.
  • Entrega específica por cliente (encubrimiento): Googlebot recibe contenido distinto o vacío. Puede ser encubrimiento intencional —una infracción que exige intención manipuladora— o una diferencia accidental de configuración; esta última es un fallo de entrega, no una infracción demostrada.
  • Formato o analizador: la respuesta no usa un formato indexable o el encabezado Content-Type no coincide con el contenido.
  • Fallo de renderizado o recursos: JavaScript falla, agota el tiempo o depende de un recurso bloqueado y deja vacío el HTML renderizado.
  • Contenido tras una interacción: solo aparece después de un clic o desplazamiento.
  • Salida realmente vacía: la página no genera nada.

JavaScript es una rama que debe comprobarse, no la explicación predeterminada ni una causa con prioridad fija sin pruebas propias.

Por qué puede perjudicar el posicionamiento

En el caso citado, el propietario afirmó que la página cayó aproximadamente de la posición 1 a la 15. Es un relato individual, no una estadística verificada, pero es un resultado plausible si Google conserva una versión ilegible de una página que antes posicionaba. Investigue pronto este estado cuando afecte a una URL importante.

El bloqueo del servidor o CDN en detalle

Esta causa recibe poca atención porque cuesta verla. Una regla antibots o WAF, una lista de IP permitidas, un límite agresivo de solicitudes o un ajuste de seguridad actualizado puede considerar abusivo a Googlebot y devolver un cuerpo vacío, un desafío o un estado distinto de 200, pero solo a las IP de Googlebot. El equipo y los rastreadores externos acceden desde IP normales y ven la página real.

Esa es la trampa: no puede reproducir con curl ni con un rastreador de escritorio un bloqueo de Googlebot basado en IP. No usan sus rangos. Las herramientas de Search Console, que obtienen la página como Google, son la referencia fiable.

Si lo sospecha, verifique qué solicitudes pertenecen realmente a Googlebot mediante DNS inverso y directo o los rangos publicados. Revise después la gestión de bots de la CDN, las reglas de firewall/WAF, listas de IP y límites de solicitudes. La pestaña Scripts incluye los comandos.

Antes de cambiar nada, correlacione la respuesta indexada de Ver página rastreada con los registros de eventos de CDN/WAF y del servidor de origen en la misma ventana. Busque el identificador de solicitud, la categoría del cliente y la regla o límite que denegó la petición. Cambie solo la ruta, categoría o regla más específica que haya confirmado, tras una revisión de seguridad. Permitir de forma general todos los rangos de Google no es una práctica segura respaldada por las fuentes y amplía la superficie de ataque. Después, confirme en los registros que Googlebot recibe una respuesta completa y vuelva a revisar el informe tras un rastreo posterior. Google no publica un calendario fijo: hay que seguir comprobando, no esperar a un “check back on day X,” (traducción) «vuelva a comprobar el día X».

La causa de renderizado o JavaScript (cuando es JS)

Cuando el problema sí es el renderizado, Google rastrea el HTML inicial y luego un Chromium sin interfaz ejecuta JavaScript. Solo puede indexar lo que termina en el HTML renderizado. Si el contenido se genera en el cliente y el proceso falla, agota el tiempo o depende de una solicitud que Google no realiza, el resultado puede quedar vacío.

Un caso importante es el contenido condicionado a una interacción. Como expliqué en mi guía de SEO para JavaScript, los elementos que solo cargan tras un clic son problemáticos: Google no hace clic. Lo mismo ocurre con contenido que aparece al desplazarse o tras otra acción. Si el contenido principal exige un toque, suponga que Google no lo tiene.

La solución habitual es renderizar en el servidor o prerenderizar, garantizar que el contenido esté en el HTML renderizado y exponer la navegación mediante enlaces reales <a href> en vez de controladores que solo responden a clics. Véase SEO para JavaScript.

Diagnóstico: Inspección de URLs es la clave

El diagnóstico esencial es Inspección de URLs, pero usa dos fuentes distintas. Google separa los datos indexados —lo visto en el último rastreo de indexación— de una prueba en directo —una obtención actual de Google-InspectionTool—. No responden a la misma pregunta:

Datos indexadosPrueba en directo
Qué muestraHTML renderizado, respuesta HTTP y recursos del último rastreo indexadoSi Google-InspectionTool puede acceder ahora, más una captura nueva
¿Hay captura?No en la vista indexadaSí; solo en la prueba en directo
¿Puede probar este estado?Es el registro descrito por el estadoNo; Google excluye expresamente «Página indexada sin contenido»
¿«Válida» significa resuelta?N/ANo; solo significa que el comprobador accede ahora, no que esté indexada ni haya desaparecido el estado

El flujo correcto es:

  1. Ver página rastreada (datos indexados). Lea el HTML renderizado, la respuesta HTTP y los recursos asociados. La falta de algunos campos también aporta pistas.
  2. Compare con su navegador. Si el renderizado indexado está vacío pero la página publicada está completa, hay un bloqueo o una entrega específica por cliente, no falta de texto.
  3. Ejecute Probar URL publicada e interprétela bien. No confirma directamente que este estado se haya borrado. Un fallo de acceso sí es evidencia; «válida» significa «accesible ahora», no «resuelta». Evidence for this claim URL Inspection can show Google's indexed/crawled information and supports a live test for the current accessible version. Scope: Google Search Console URL Inspection; live test results can differ from the indexed version. Confidence: high · Verified: Google: URL Inspection tool
  4. Lea la respuesta y los recursos. Un estado distinto de 200, un desafío o recursos críticos bloqueados apuntan a la causa.

Como los bloqueos por IP no aparecen desde fuera, no confíe en curl ni en un rastreador externo para dar la página por correcta. Search Console obtiene como Google y, para este estado, necesita los datos indexados además de la prueba actual.

Cómo distinguir las causas

Referencia rápida de estados y causas que suelen confundirse:

Si ve…Significa…No es este estado porque…
Disallow de robots.txt para la páginaLa URL está bloqueada para el rastreo; es otro motivoGoogle lo excluye expresamente de este estado
Recurso crítico JS/CSS bloqueado por robots.txtLa página puede rastrearse, pero no un recurso necesarioEs una causa de renderizado; desbloquee el recurso
Respuesta 401 o 403Motivos propios de Indexación de páginasSon estados distintos
Barrera del navegador que devuelve 200Diferencia entre la sesión del usuario y la solicitud de GoogleNo hubo 401/403 real; diagnostique entrega específica por cliente
Contenido distinto intencional para manipularEncubrimiento e infracción de spamExige intención; una respuesta vacía accidental es un fallo de configuración
Tipo no compatible o Content-Type incorrectoProblema de formato o analizadorGoogle se guía principalmente por el encabezado, no por la extensión

Mitos que debe abandonar

  • «Añada 600 palabras y se arreglará». Si Google no recibió contenido, añadir texto que no puede leer no cambia nada.
  • «Es JavaScript». A veces, pero Mueller apuntó normalmente a un bloqueo de servidor o CDN. No empiece por esa suposición.
  • «Puedo reproducirlo con curl». No si el bloqueo depende de la IP de Googlebot.
  • «Es igual que Rastreada/Descubierta: sin indexar». No; esas URL no están indexadas y esta sí.
  • «Basta con solicitar la indexación». Sin corregir el bloqueo o renderizado, solo volverá a confirmar una página vacía.

Después de corregirlo

Cuando Ver página rastreada vuelva a mostrar contenido real, use Validar corrección o Solicitar indexación para promover otro rastreo y compruebe que el renderizado contiene el contenido. Validar sin corregir solo provoca otro fallo.

Dónde encaja este estado

Es un estado del informe Indexación de páginas, dentro de la fase general de indexación de Google —rastrear → renderizar → indexar → servir—. Los estados «sin indexar», duplicados/canónicos y bloqueos/errores fallan en puntos distintos. Para la mecánica de JavaScript, consulte renderizado y SEO para JavaScript; para el conjunto, el centro del informe Indexación de páginas.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.