Demanda de rastreo
El lado del «deseo» del presupuesto de rastreo: lo que hace que Google quiera rastrear tus páginas (popularidad, obsolescencia, inventario percibido), cómo la demanda se encuentra con la capacidad de carga del host y por qué no puedes forzarla.
Idiomas
La demanda de rastreo es el lado del «deseo» del presupuesto de rastreo: cuánto quiere rastrear un motor de búsqueda un sitio o URL, a diferencia de la rapidez con que puede hacerlo (eso es frecuencia de rastreo/capacidad). Google señala la popularidad (enlaces/PageRank), la obsolescencia (con qué frecuencia cambia una página) y el inventario percibido (cuántas URL cree Google que existen, incluida la basura — «el factor que más puedes controlar positivamente») como factores generales importantes de la demanda, no como una fórmula cerrada de tres elementos; Google también apunta al tamaño del sitio, la frecuencia de actualización, la calidad de la página y cómo se compara un sitio con otros similares. Las migraciones web aumentan temporalmente la demanda. La carga del host actúa como un límite sobre la demanda efectiva, no como un impulsor — mi síntesis: la demanda establece el orden de prioridad de las URL, y la capacidad decide hasta qué punto de esa cola llega Googlebot. No puedes establecer la demanda directamente: mueves sus factores consiguiendo enlaces, manteniendo el contenido genuinamente actualizado y reduciendo el inventario de URL basura para que las señales de calidad retroalimenten el programador de rastreo. En realidad, Google intenta rastrear menos en general mientras dirige la demanda con mayor precisión, por lo que el objetivo real nunca fue el volumen, sino la priorización correcta. La mayoría de los sitios nunca necesitan gestionar esto.
TL;DR — El presupuesto de rastreo tiene dos lados: la rapidez con la que un motor de búsqueda puede obtener tus páginas (frecuencia de rastreo) y cuánto quiere hacerlo (demanda de rastreo). La demanda de rastreo es el lado del «querer». Google quiere rastrear más una página cuando es popular (muchos enlaces), cuando cambia a menudo y cuando Google considera que el sitio merece su tiempo. No puedes presionar un botón para aumentar la demanda; la ganas con enlaces, frescura genuina y no enterrando tus buenas páginas bajo una pila de URL basura.
Qué es la demanda de rastreo
Cuando las personas dicen «presupuesto de rastreo», en realidad están hablando de dos cosas separadas comprimidas entre sí. Una es la capacidad de tu servidor para soportar el rastreo: qué tan rápido y cuántas páginas a la vez. Esa es la frecuencia de rastreo y se trata en su propia página. La otra es cuánto quiere rastrearte realmente el motor de búsqueda en primer lugar. Esa es la demanda de rastreo, el tema de aquí.
Piénsalo como oferta y demanda. La frecuencia de rastreo es la oferta: cuánto rastreo puede soportar tu sitio. La demanda de rastreo es la demanda: cuánto quiere hacer Google. Evidence for this claim Google describes crawl demand as one of the two main elements of crawl budget, alongside crawl capacity limit. Scope: Google Search crawling. Confidence: high · Verified: Google: Large site crawl budget guide
Qué hace que Google quiera rastrear una página
Google señala un puñado de factores significativos, no una lista de verificación exhaustiva. Los tres que explica con mayor profundidad:
- Popularidad. Las páginas con más enlaces apuntando a ellas se rastrean con más frecuencia, por lo que Google mantiene fresca su copia.
- Obsolescencia / frescura. Si una página cambia mucho, Google quiere comprobarla con más frecuencia. Si nunca cambia, Google aprende a comprobarla menos.
- Cuántas URLs cree Google que tienes. Si tu sitio está lleno de URLs basura, duplicadas o de bajo valor, Google desperdicia su rastreo en ellas en lugar de en tus páginas reales. Este es el factor que más controlas. Evidence for this claim Google's crawl-demand guidance discusses perceived inventory, popularity, and staleness. Scope: These inputs influence crawling but do not provide a user-controlled demand setting. Confidence: high · Verified: Google: Large site crawl budget guide
Google también nombra algunos factores a nivel de sitio que dan forma a la demanda junto con esos tres: el tamaño de tu sitio, la frecuencia con la que lo actualizas, la calidad de las páginas y cómo se compara tu sitio con otros que cubren un terreno similar. No trates “popularidad, obsolescencia, inventario percibido” como una fórmula completa — son las palancas más grandes y más prácticas, no la lista completa.
También hay un factor temporal: si mueves tu sitio a un nuevo dominio, Google tiene que volver a rastrear todo para procesarlo con las nuevas URLs, por lo que la demanda se dispara durante un tiempo.
Por qué no puedes simplemente “aumentar la demanda de rastreo”
No hay un dial para ello — igual que no hay un botón para hacer que Google rastree más rápido. Publicar diez publicaciones al día no lo logrará si nadie las enlaza y no son genuinamente útiles. Las cosas que realmente funcionan son lentas y reales: consigue enlaces, mantén el contenido genuinamente fresco y limpia las URLs basura para que el rastreo de Google llegue a las páginas que importan.
Y esta es la sorpresa: el objetivo ni siquiera es más rastreo. Que te rastreen mucho no hace que te posiciones más alto. Lo que quieres no es más demanda, sino que la demanda que tienes apunte a las páginas correctas.
¿Quieres la versión más detallada —cómo interactúan la demanda y la capacidad de tu servidor, cómo la calidad del sitio retroalimenta el programador de rastreo y cómo distinguir un problema de demanda de un problema de capacidad—? Cambia a la pestaña Avanzado.
Evidence for this claim Google says Googlebot demand varies by site size, update frequency, page quality, and relevance compared with other sites; significant general demand factors are perceived inventory, popularity, and staleness. Scope: large or rapidly changing websites Confidence: high · Verified: Optimize your crawl budgetTL;DR — La demanda de rastreo es el lado del querer del presupuesto de rastreo; la frecuencia de rastreo/capacidad es el lado del poder. Google señala la popularidad (enlaces / PageRank), la obsolescencia (con qué frecuencia cambia una página) y el inventario percibido (cuántas URL cree Google que existen, incluida la basura — “the factor you can positively control the most” (traducción) «el factor que más puedes controlar positivamente») como factores generales significativos de la demanda — no una fórmula cerrada; el tamaño del sitio, la frecuencia de actualización, la calidad de la página y la relevancia comparativa también influyen. Las migraciones web aumentan temporalmente la demanda. Mi síntesis para integrarlo: la demanda establece el orden de prioridad de las URL; la capacidad de carga del host decide hasta qué punto de esa cola llega Googlebot — Google no documenta esto como un algoritmo literal, pero es el modelo que encaja con la evidencia. Un servidor en buen estado no fabrica demanda, y la demanda alta aún puede verse limitada por la capacidad. No puedes establecer la demanda directamente — las únicas palancas son sus entradas, y el programador aumenta la demanda cuando mejoran las señales de calidad de la indexación. Mientras tanto, Google está intentando activamente rastrear menos mientras enruta la demanda con mayor precisión, por lo que el objetivo real nunca fue el volumen — es la priorización correcta. La mayoría de los sitios nunca necesita gestionar nada de esto.
La demanda de rastreo es el «querer», la frecuencia de rastreo es el «poder»
Google es explícito en que el presupuesto de rastreo tiene dos mitades: la cantidad de tiempo y recursos que Google dedica a rastrear un sitio _“is determined by two main elements: crawl capacity limit and crawl demand.” (traducción) «está determinada por dos elementos principales: el límite de capacidad de rastreo y la demanda de rastreo.» La forma en que lo planteo en mi guía de presupuesto de rastreo de Ahrefs: el presupuesto de rastreo está _“made up crawl demand which is how many pages a search engine wants to crawl on your site and crawl rate which is how fast they can crawl.” (traducción) «compuesto por la demanda de rastreo, que es cuántas páginas quiere rastrear un motor de búsqueda en tu sitio, y la frecuencia de rastreo, que es qué tan rápido puede rastrear.» La demanda es el querer; la frecuencia es el poder. Evidence for this claim Google describes crawl demand as one of the two main elements of crawl budget, alongside crawl capacity limit. Scope: Google Search crawling. Confidence: high · Verified: Google: Large site crawl budget guide
Esta página trata solo sobre el querer. El lado del poder — el límite de
capacidad de rastreo, el control deslizante de frecuencia de GSC que se eliminó en
enero de 2024, cómo las respuestas 5xx/429 ralentizan a Googlebot y la
cuadrícula manual de Crawl Control de Bing — se encuentra en la página de
frecuencia de rastreo. No voy a volver a derivarlo aquí; cuando ambos
interactúan, enlazaré a esa página.
Los tres factores de demanda
La orientación actual de Google califica el inventario percibido, la popularidad y la falta de actualización como factores generales significativos que impulsan cuánto quiere rastrear; no los presenta como una fórmula exhaustiva y cerrada. La misma orientación también menciona el tamaño del sitio, la frecuencia con la que se actualiza, la calidad de la página y cómo se compara con sitios similares como factores que Googlebot pondera. Los tres siguientes son los que Google explica con mayor profundidad y los que puedes abordar directamente. Evidence for this claim Google's crawl-demand guidance discusses perceived inventory, popularity, and staleness. Scope: These inputs influence crawling but do not provide a user-controlled demand setting. Confidence: high · Verified: Google: Large site crawl budget guide
Crawl demand orders URLs using popularity, genuine change, and the perceived value of the site's URL inventory. Crawl capacity, based on server response speed, stability, and errors, determines how far Googlebot can proceed through that ordered queue. Faster infrastructure raises the capacity ceiling but does not create demand for low-priority URLs.
© Patrick Stox LLC · CC BY 4.0 ·
Popularidad
“URLs that are more popular on the Internet tend to be crawled more often to keep them fresher in our systems.” (traducción) «Las URL que son más populares en Internet tienden a rastrearse con más frecuencia para mantenerlas más actualizadas en nuestros sistemas.» Más enlaces y más PageRank que apuntan a una URL son una señal de demanda: por eso tu página de inicio se rastrea constantemente y una página profunda y sin enlaces apenas se rastrea. Como explico en mi guía sobre presupuesto de rastreo, “Popular pages, or those with more links and PageRank, will generally receive priority over other pages.” (traducción) «Las páginas populares, o aquellas con más enlaces y PageRank, generalmente recibirán prioridad sobre otras páginas.» Los enlaces internos también cuentan aquí: una página a la que no enlaza nada (una página huérfana) casi no tiene demanda a su favor.
Falta de actualización
“Our systems want to recrawl documents frequently enough to pick up any changes.” (traducción) «Nuestros sistemas quieren volver a rastrear los documentos con la frecuencia suficiente para detectar cualquier cambio.» Google aprende el ritmo de cada página. Una página que cambia constantemente obtiene nuevos rastreos frecuentes; una página que nunca cambia se comprueba cada vez menos. En mi guía sobre presupuesto de rastreo describo el retroceso que Google aplica a una página estática: “if they crawl a page and see no changes after a day, they may wait three days before crawling again, ten days the next time, 30 days, 100 days, etc.” (traducción) «si rastrean una página y no ven cambios después de un día, pueden esperar tres días antes de volver a rastrear, diez días la próxima vez, 30 días, 100 días, etc.» Esa cadencia de nuevos rastreos por URL es en realidad una cuestión de frecuencia de rastreo — allí cubro la mecánica — pero la fuerza subyacente es la demanda, y específicamente la falta de actualización.
Inventario percibido (el que más controlas)
Esta es la palanca principal. Google: “Without guidance from you, Google tries to crawl all or most of the URLs that it knows about on your site. If many of these URLs are duplicates, or you don’t want them crawled for some other reason (removed, unimportant, and so on), this wastes a lot of Google crawling time on your site. This is the factor that you can positively control the most.” (traducción) «Sin orientación por tu parte, Google intenta rastrear todas o la mayoría de las URL que conoce en tu sitio. Si muchas de estas URL son duplicadas, o no quieres que se rastreen por alguna otra razón (eliminadas, poco importantes, etc.), esto desperdicia mucho tiempo de rastreo de Google en tu sitio. Este es el factor que puedes controlar positivamente en mayor medida.»
Evidence for this claim Google calls perceived inventory the crawl-demand factor site owners can positively control the most; duplicate, removed, and unimportant known URLs can waste crawling time. Scope: large or rapidly changing websites Confidence: high · Verified: Optimize your crawl budgetLa parte sutil es lo que hace a la demanda, no solo a la capacidad. Es fácil pensar que las URL basura “desperdician presupuesto de rastreo” — gastar recuperaciones en copias en lugar de contenido nuevo. Cierto. Pero también hay un efecto del lado de la demanda: un sitio cuyo inventario conocible está compuesto principalmente por duplicados de bajo valor y proliferación de parámetros parece, para Google, un sitio de menor valor para rastrear. Reducir el inventario percibido no solo libera capacidad; con el tiempo concentra la demanda en las URL que la merecen. La navegación por facetas, los ID de sesión, los espacios de calendario infinitos y otras spider traps son los clásicos infladores de inventario — y los clásicos supresores de demanda.
Migraciones de sitio y otros picos de demanda
Un factor de demanda no está relacionado con una sola URL: “Additionally, site-wide events like site moves may trigger an increase in crawl demand in order to reprocess the content under the new URLs.” (traducción) «Además, los eventos que afectan a todo el sitio, como las migraciones de sitio, pueden provocar un aumento en la demanda de rastreo para volver a procesar el contenido bajo las nuevas URL.» Si haces una migración de dominio o un cambio de plataforma importante y observas que Googlebot te impacta mucho más de lo habitual durante unas semanas, eso es esperable: Google tiene que volver a obtener y volver a procesar todo bajo las nuevas direcciones. Es un pico temporal, no una nueva línea base, y es un evento de demanda que las guías de la competencia casi nunca mencionan, a pesar de que aparece textualmente en la propia documentación de Google.
Evidence for this claim Google says site-wide events such as site moves may temporarily increase crawl demand so content can be reprocessed under new URLs. Scope: large or rapidly changing websites Confidence: high · Verified: Optimize your crawl budgetCómo interactúan la demanda y la carga del host: orden de la cola vs. puerta de capacidad
Aquí tienes un modelo mental que hace que todo el tema encaje —y quiero ser transparente al decir que es mi síntesis, no algo que Google documente como un algoritmo literal. Se basa en una sesión de preguntas y respuestas de Gary Illyes, citada aquí a través de la cobertura de Search Engine Roundtable: la carga del host _“sets a bucket of URLs in importance order and GoogleBot will crawl in that order based on the schedule the host load decided. If Google thinks your server can handle it, it will crawl the whole bucket, if not, it will stop.” (traducción) «establece un cubo de URL en orden de importancia y Googlebot rastreará en ese orden según la programación que la carga del host decidió. Si Google considera que tu servidor puede manejarlo, rastreará el cubo completo; si no, se detendrá.» Cabe destacar que, según esa misma sesión de preguntas y respuestas, la carga del host registra la importancia de tus páginas, no la cantidad bruta de URL que tienes ni cuántas quieres que se rastreen. Esa página bloquea la obtención automatizada, por lo que no he podido reconfirmar la redacción exacta directamente con la fuente en vivo en esta revisión; trata esto como una paráfrasis bien corroborada, no como una cita textual de fuente primaria.
Lee eso con atención y se desprende una relación —de nuevo, así es como conecto las piezas, no un mecanismo que Google haya detallado de principio a fin:
- La demanda establece el orden. El “bucket of URLs in importance order” es la demanda de rastreo: la popularidad y la falta de actualización deciden qué URL se ubican en los primeros puestos de la cola.
- La capacidad determina hasta dónde llega Google. La carga del host / la frecuencia de rastreo decide qué tan profundo dentro de ese cubo ordenado rastrea realmente Googlebot en un día determinado. _“If your server can handle it, it crawls the whole bucket; if not, it stops.” (traducción) «Si tu servidor puede manejarlo, rastrea el cubo completo; si no, se detiene.»
Por lo tanto, ambos no se limitan a multiplicarse entre sí — desempeñan funciones diferentes. Un servidor saludable y rápido no fabrica demanda (solo eleva el límite de cuánta de tu demanda existente llega a materializarse), y una demanda alta todavía puede verse limitada por la capacidad (un servidor lento o propenso a errores detiene a Googlebot a mitad de la cola sin importar cuánto quiera rastrear). Por eso, “I bought a faster server and Google still isn’t crawling my new pages” (traducción) «Compré un servidor más rápido y Google sigue sin rastrear mis nuevas páginas» es un resultado tan común y frustrante: la capacidad nunca fue la limitación — lo era la demanda.
No puedes establecer la demanda directamente — pero el planificador escucha
Respuesta corta: no estableces la demanda directamente. La ganas, indirectamente, mediante enlaces reales y mejoras reales de calidad que aparecen en las señales de indexación — nada más la mueve.
No hay una solicitud de “rastrear más” para la demanda, al igual que no la hay para la frecuencia de rastreo. Pero la demanda es dinámica, y Google ha sido inusualmente sincero sobre cómo se mueve. Gary Illyes: “If you want to increase how much we crawl, then you somehow have to convince search that your stuff is worth fetching, which is basically what the scheduler is listening to.” (traducción) «Si quieres aumentar cuánto rastreamos, entonces de alguna manera tienes que convencer a la búsqueda de que tu contenido vale la pena obtener, que es básicamente lo que el planificador está escuchando.» Y el bucle de retroalimentación es casi en tiempo real: “Scheduling is very dynamic. As soon as we get the signals back from search indexing that the quality of the content has increased across this many URLs, we would just start turning up demand.” (traducción) «La planificación es muy dinámica. En cuanto recibimos las señales de vuelta de la indexación de búsqueda de que la calidad del contenido ha aumentado en esta cantidad de URLs, simplemente empezaríamos a aumentar la demanda.» La otra cara también: “If search demand goes down, then that also correlates to the crawl limit going down.” (traducción) «Si la demanda de búsqueda baja, entonces eso también se correlaciona con que el límite de rastreo baje.» (Volví a comprobar estas tres líneas con la cobertura de Search Engine Journal en esta pasada y coinciden textualmente; todavía no he localizado el audio/transcripción del propio podcast de Google para confirmarlas como fuente primaria, así que considéralas citas secundarias bien corroboradas.)
Eso replantea “cómo aumento la demanda de rastreo” alejándolo de los trucos. Las marcas de tiempo falsas de lastmod,
los pings de sitemap y el volumen de publicación no convencen al planificador.
Las dos cosas que sí lo hacen son las dos cosas difíciles: popularidad real (enlaces) y
mejoras de calidad reales que aparecen en las señales de indexación y retroalimentan al
planificador. Todo lo demás es teatro.
Google está intentando rastrear menos, no más
El ángulo más novedoso aquí, y uno que las guías antiguas pasan por alto por completo: el objetivo declarado por el propio Google es reducir el volumen de rastreo total, no aumentarlo. En una publicación de LinkedIn de abril de 2024, Illyes escribió: “My mission this year is to figure out how to crawl even less, and have fewer bytes on wire.” (traducción) «Mi misión este año es averiguar cómo rastrear aún menos, y tener menos bytes en la red». Rechazó la idea de que Google había recortado el rastreo — “we’re crawling roughly as much as before, however scheduling got more intelligent” (traducción) «estamos rastreando aproximadamente tanto como antes, sin embargo la programación se volvió más inteligente» — y presentó el objetivo como una ganancia compartida: “Decreasing crawling without sacrificing crawl-quality would benefit everyone.” (traducción) «Disminuir el rastreo sin sacrificar la calidad del rastreo beneficiaría a todos». Los mecanismos que señaló fueron un mejor almacenamiento en caché, el uso compartido de caché entre agentes de usuario (user-agent) y menos bytes transferidos, no «rastrea más mi sitio».
La conclusión: la demanda de rastreo nunca fue algo que maximizar. Google está optimizando activamente para menos rastreo total con una calidad de rastreo igual o mejor, dirigiendo la demanda que sí tiene hacia URLs con más probabilidades de merecerla. Tu objetivo no es más demanda — es la correcta priorización de la demanda que has ganado.
¿Tienes siquiera un problema de demanda?
La mayoría de los sitios no lo hacen, y no deberían dedicar ni un minuto a esto. La propia desescalada de Google se aplica plenamente a la demanda:
- “If your site doesn’t have a large number of pages that change rapidly, or if your pages seem to be crawled the same day that they are published, you don’t need to read this guide.” (traducción) «Si tu sitio no tiene un gran número de páginas que cambian rápidamente, o si tus páginas parecen rastrearse el mismo día en que se publican, no necesitas leer esta guía.» John Mueller ha sido igualmente directo sobre la escala: según la cobertura que Search Engine Roundtable hizo de su tuit, 100 000 URL normalmente no son suficientes para afectar al presupuesto de rastreo, ya que eso equivale a muy por debajo de un rastreo por minuto durante tres meses.
Si eres lo bastante grande como para que te importe, aquí tienes el diagnóstico que separa un problema de demanda de uno de capacidad, con una advertencia previa: produce una hipótesis para probar, no un diagnóstico. Consulta el Crawl Stats report de GSC y los registros de tu servidor. Si el Host status está en buen estado y el tiempo de respuesta promedio es adecuado, pero un conjunto de URL apenas se rastrea —y están atascadas en “Discovered – currently not indexed”—, ese patrón es evidencia que apunta hacia la demanda, no una prueba de ello. Crawl Stats muestra la actividad de rastreo (una vista del lado de la capacidad), no una puntuación de demanda; no existe en ningún lugar una «puntuación de demanda de rastreo» pública por sitio, así que siempre estás infiriendo la demanda a partir de la actividad más el estado de indexación, nunca leyéndola en un panel.
Antes de actuar partiendo de «es un problema de demanda», descarta otras causas que producen el mismo síntoma de servidor saludable pero sin rastreo: Google puede no haber descubierto aún las URL (sin ruta de acceso, sin entrada en el sitemap), el renderizado puede estar ocultando el contenido que Googlebot necesita ver, la canonicalización puede dirigir a Google a otro lugar por completo, los problemas reales de calidad (contenido escaso, duplicado o de bajo valor) pueden hacer que una página se rastree, pero quede deliberadamente fuera del índice, y la propia selección de indexación de Google puede dejar fuera una página incluso cuando el rastreo y la calidad están bien. Solo después de comprobar que esos factores no lo explican, «baja demanda» se convierte en la explicación provisional —e incluso entonces, trátala como la hipótesis mejor respaldada, no como una causa confirmada. Un hardware más rápido no solucionará un problema genuino de demanda; la solución está en los factores de demanda: enlaces a esas páginas, razones genuinas para volver a rastrearlas y menos inventario basura que las ahogue.
Para obtener datos de rastreo reales por URL, el análisis de registros es la respuesta. Destacaré una herramienta actual sobre la que puedo hablar de primera mano en la pestaña Herramientas.
Demanda de rastreo vs. frecuencia de rastreo vs. presupuesto de rastreo vs. frecuencia de rastreo
Mantén clara la familia:
- Demanda de rastreo — cuánto quiere rastrear Google (popularidad + obsolescencia + inventario percibido). Esta página.
- Frecuencia de rastreo — qué tan rápido puede (capacidad / carga del host). Su propia página.
- Presupuesto de rastreo — los dos juntos: _“the number of URLs Googlebot can and wants to crawl.” (traducción) «el número de URLs que Googlebot puede y quiere rastrear».
- Frecuencia de rastreo — con qué frecuencia se vuelve a rastrear una URL determinada, lo cual es un resultado de la demanda (principalmente obsolescencia).
Bing no usa el término “crawl demand” (demanda de rastreo) — reformula todo como eficiencia de rastreo: Fabrice Canel la define como “how often we crawl and discover new and fresh content per page crawled,” (traducción) «con qué frecuencia rastreamos y descubrimos contenido nuevo y fresco por página rastreada», y la filosofía de Bing es la reducción de inventario como prioridad, el equivalente en el lado de la demanda del inventario percibido. IndexNow es la forma de Bing de señalar eventos de cambio relevantes para la demanda en lugar de esperar a que el planificador infiera la obsolescencia — pero ten en cuenta que Google no usa IndexNow, por lo que no moverá la demanda de Google.
Evidence for this claim Google's crawl-demand guidance discusses perceived inventory, popularity, and staleness. Scope: These inputs influence crawling but do not provide a user-controlled demand setting. Confidence: high · Verified: Google: Large site crawl budget guideResumen de IA
Una visión condensada de la versión avanzada:
- Demanda de rastreo = el lado del deseo del presupuesto de rastreo; la frecuencia de rastreo/capacidad es el lado del poder. El presupuesto es “the number of URLs Googlebot can and wants to crawl.” (traducción) «el número de URLs que Googlebot puede y quiere rastrear».
- Factores de demanda significativos — no una fórmula cerrada: popularidad (enlaces / PageRank), obsolescencia (con qué frecuencia cambia una página) y inventario percibido (cuántas URLs cree Google que existen — incluida la basura; “the factor you can positively control the most” (traducción) «el factor que puedes controlar positivamente en mayor medida»), además del tamaño del sitio, la frecuencia de actualización, la calidad de la página y la relevancia comparativa.
- Las migraciones web aumentan temporalmente la demanda mientras Google vuelve a procesar el contenido bajo nuevas URLs.
- Modelo de demanda vs. capacidad (mi síntesis, no un algoritmo documentado de Google): la demanda establece el orden de prioridad de las URLs; la capacidad de carga del host decide hasta qué punto de esa cola llega Googlebot. Un servidor rápido no crea demanda; la demanda alta puede seguir estando limitada por la capacidad.
- No puedes establecer la demanda directamente. El planificador “turns up demand” (traducción) «aumenta la demanda» cuando mejoran las señales de calidad
de la indexación — así que las únicas palancas reales son conseguir enlaces y
hacer mejoras genuinas de calidad y actualización. Los
lastmodfalsos, los pings de sitemap y el volumen de publicación no la mueven. - Google está intentando rastrear menos, no más (Illyes: “crawl even less… fewer bytes on wire” (traducción) «rastrear aún menos… menos bytes en la red»), enrutando la demanda con mayor precisión. El objetivo es la priorización correcta, no el volumen.
- Diagnostica demanda vs. capacidad: Host status saludable + bajo volumen de rastreo + estar atascado en “Discovered – currently not indexed” es una hipótesis de demanda, no una prueba — descarta primero las causas de descubrimiento, renderizado, canonicalización y selección de indexación. No existe una “puntuación de demanda de rastreo” pública.
- Bing lo replantea como eficiencia de rastreo; IndexNow señala cambios a Bing (no a Google). La mayoría de los sitios nunca necesitan gestionar esto.
Documentación oficial
Documentación de fuentes primarias de los motores de búsqueda.
- Optimiza tu presupuesto de rastreo — la fuente que define la demanda de rastreo, sus tres entradas (popularidad, obsolescencia, inventario percibido) y los picos de demanda por migración web.
- Gestión del presupuesto de rastreo — la división capacidad/demanda, con la mecánica de capacidad de rastreo con la que se encuentra la demanda.
- Qué significa el presupuesto de rastreo para Googlebot (2017) — la publicación original de Gary Illyes que define el presupuesto de rastreo como lo que Googlebot “can and wants to crawl,” (traducción) «puede y quiere rastrear», y las categorías de URL de bajo valor que suprimen la demanda efectiva.
- Mitos y hechos sobre el rastreo — confirma que la frecuencia de rastreo no es una señal de posicionamiento y que la salud del servidor, no el deseo, establece el techo de capacidad.
- Serie de diciembre sobre rastreo (2024) — Googlebot, almacenamiento en caché HTTP, navegación por facetas y la mentalidad de eficiencia detrás de rastrear menos.
Bing / Microsoft
- Serie Bingbot: Maximizar la eficiencia de rastreo — El enfoque de Bing sobre la “eficiencia de rastreo”, su análogo del lado de la demanda.
- Serie Bingbot: Optimizar la frecuencia de rastreo — La perspectiva de Bing sobre la cadencia de nuevo rastreo impulsada por la frecuencia con la que cambia el contenido (su análogo de “obsolescencia”).
- IndexNow / indexnow.org — señala las URL modificadas a Bing y a otros (no a Google) en lugar de esperar a la obsolescencia inferida.
Citas de la fuente
Declaraciones oficiales de Google y Bing. Cada enlace es un enlace profundo que salta al fragmento citado en la página de origen.
Google — la definición de la demanda y sus entradas
- _“The amount of time and resources that Google devotes to crawling a site is commonly called the site’s crawl budget and it’s determined by two main elements: crawl capacity limit and crawl demand.” (traducción) «La cantidad de tiempo y recursos que Google dedica al rastreo de un sitio se denomina comúnmente presupuesto de rastreo del sitio y está determinada por dos elementos principales: el límite de capacidad de rastreo y la demanda de rastreo.» — Large Site Owner’s Guide to Managing Crawl Budget. Ir a la cita
- _“Each crawler has its own ‘demand’ when it comes to crawling the web.” (traducción) «Cada rastreador tiene su propia ‘demanda’ cuando se trata de rastrear la web.» Ir a la cita
- _“URLs that are more popular on the Internet tend to be crawled more often to keep them fresher in our systems.” (traducción) «Las URL que son más populares en Internet tienden a rastrearse con más frecuencia para mantenerlas más actualizadas en nuestros sistemas.» (popularidad) Ir a la cita
- _“Our systems want to recrawl documents frequently enough to pick up any changes.” (traducción) «Nuestros sistemas quieren volver a rastrear los documentos con la frecuencia suficiente para detectar cualquier cambio.» (obsolescencia) Ir a la cita
Google — inventario percibido y migraciones web
- “If many of these URLs are duplicates, or you don’t want them crawled for some other reason (removed, unimportant, and so on), this wastes a lot of Google crawling time on your site. This is the factor that you can positively control the most.” (traducción) «Si muchas de estas URL están duplicadas, o no quieres que se rastreen por alguna otra razón (eliminadas, poco importantes, etc.), esto desperdicia mucho tiempo de rastreo de Google en tu sitio. Este es el factor que más puedes controlar positivamente.» Ir a la cita
- “Additionally, site-wide events like site moves may trigger an increase in crawl demand in order to reprocess the content under the new URLs.” (traducción) «Además, los eventos que afectan a todo el sitio, como las migraciones web, pueden provocar un aumento en la demanda de rastreo para volver a procesar el contenido bajo las nuevas URL.» Ir a la cita
- “If your site doesn’t have a large number of pages that change rapidly, or if your pages seem to be crawled the same day that they are published, you don’t need to read this guide.” (traducción) «Si tu sitio no tiene una gran cantidad de páginas que cambian rápidamente, o si tus páginas parecen rastrearse el mismo día en que se publican, no necesitas leer esta guía.» Ir a la cita
Gary Illyes, Google — cómo se mueve realmente la demanda (a través de la cobertura de Search Engine Journal sobre su aparición en un pódcast)
- “If you want to increase how much we crawl, then you somehow have to convince search that your stuff is worth fetching, which is basically what the scheduler is listening to.” (traducción) «Si quieres aumentar cuánto rastreamos, entonces de alguna manera tienes que convencer a la búsqueda de que tu contenido vale la pena ser recuperado, que es básicamente lo que el planificador está escuchando.» Leer la cobertura
- “Scheduling is very dynamic. As soon as we get the signals back from search indexing that the quality of the content has increased across this many URLs, we would just start turning up demand.” (traducción) «Cuando la indexación devuelve señales de mayor calidad para tantas URL, el programador empieza a elevar la demanda: la planificación es muy dinámica.» Leer la cobertura
- “If search demand goes down, then that also correlates to the crawl limit going down.” (traducción) «Si la demanda de búsqueda baja, entonces eso también se correlaciona con que el límite de rastreo baje.» Leer la cobertura
Gary Illyes, Google — la misión “crawl even less” (LinkedIn, abril de 2024 — fuente primaria, verificado textualmente)
- “My mission this year is to figure out how to crawl even less, and have fewer bytes on wire.” (traducción) «Su propósito para este año, según escribió, era encontrar la forma de rastrear aún menos y enviar menos bytes». Leer la publicación
- “we’re crawling roughly as much as before, however scheduling got more intelligent” (traducción) «estamos rastreando aproximadamente tanto como antes, aunque la programación se volvió más inteligente» y “Decreasing crawling without sacrificing crawl-quality would benefit everyone.” (traducción) «Reducir el rastreo sin sacrificar la calidad del rastreo beneficiaría a todos». Leer la publicación
Bing / Microsoft — eficiencia de rastreo (el equivalente del lado de la demanda)
- “The crawl efficiency is how often we crawl and discover new and fresh content per page crawled.” (traducción) «La eficiencia de rastreo es la frecuencia con la que rastreamos y descubrimos contenido nuevo y fresco por página rastreada». — Fabrice Canel. Ir a la cita
¿Es un problema de demanda de rastreo — y debería importarte?
Trabaja de arriba hacia abajo. La mayoría de los sitios salen pronto con “déjalo así.”
Mitos y errores sobre la demanda de rastreo
Las confusiones que llevan a las personas por el camino equivocado.
**“La demanda de rastreo y el presupuesto de rastreo son lo mismo.” Por qué es incorrecto: la demanda es uno de los dos componentes; el presupuesto es la capacidad × la demanda en conjunto — “the number of URLs Googlebot can and wants to crawl.” (traducción) «el número de URL que Googlebot puede y quiere rastrear». En su lugar: mantén el vocabulario claro. El presupuesto es el resultado; la demanda y la capacidad son sus dos entradas. Un problema de presupuesto es siempre en realidad un problema de demanda, un problema de capacidad o ambos.
“Un servidor más rápido aumenta la demanda de rastreo.” Por qué es incorrecto: la velocidad del servidor solo eleva el techo de capacidad. Permite que Google materialice más de la demanda que ya tienes; no hace que Google quiera rastrear más. La demanda se establece por la popularidad, la falta de actualización y el inventario percibido — ninguno de estos factores se ve afectado por tu hardware. En su lugar, haz: si un servidor en buen estado aún no consigue que tus páginas se rastreen, deja de comprar hardware y trabaja los factores de demanda (enlaces, actualización, menos inventario basura).
“Publicar con más frecuencia aumenta la demanda.” Por qué es incorrecto: el volumen de publicación sin importancia o cambio genuinos no convence al planificador. Diez publicaciones ligeras al día a las que nadie enlaza no mueven nada. En su lugar, haz: publica cosas que consigan enlaces y cambien/mejoren de verdad — eso es lo que alimenta las señales de calidad que el planificador escucha. (Este también es un punto de frecuencia de rastreo; hay más detalles allí.)
“Bloquear URL basura en robots.txt redirige instantáneamente esa demanda a mis páginas buenas.” Por qué es incorrecto: reducir el inventario percibido ayuda a que la demanda se concentre con el tiempo a medida que Google reevalúa el sitio — pero no es una reasignación instantánea. Google no destinará automáticamente el rastreo liberado a tus páginas buenas en el momento en que bloquees el contenido basura. En su lugar, haz: reduce el inventario basura para obtener el beneficio de concentración a largo plazo y ten paciencia. Es una tendencia, no un interruptor.
“Existe una puntuación de demanda de rastreo que puedo consultar en Search Console.” Por qué es incorrecto: no existe una puntuación pública de demanda por sitio. Crawl Stats muestra la actividad de rastreo —un informe del lado de la capacidad—, no una métrica de demanda. Haz en su lugar: infiere la demanda a partir de la actividad más el estado de indexación (p. ej., host en buen estado + bajo volumen de rastreo + “Discovered – currently not indexed” = una señal de demanda). Usa los datos de registro para obtener evidencia real por URL.
“IndexNow o los pings de sitemap aumentan la demanda de rastreo de Google.”
Por qué es incorrecto: Google no usa IndexNow e ignora changefreq/priority
en los sitemaps. Hacer ping a Google no hace que quiera rastrearte más.
Haz en su lugar: usa IndexNow para Bing y otros motores participantes. Para Google, un
lastmod preciso le ayuda a programar, pero las palancas de la demanda siguen siendo los enlaces, la frescura
y el inventario.
“Más rastreo siempre es mejor —para mí y para Google.” Por qué es incorrecto: que te rastreen más no mejora las posiciones, y el propio Google está tratando de rastrear menos (“My mission this year is to figure out how to crawl even less, and have fewer bytes on wire” (traducción) «El objetivo que describió era descubrir cómo rastrear todavía menos y reducir los bytes transmitidos») mientras dirige la demanda con mayor precisión. Haz en su lugar: procura una priorización correcta, no un volumen bruto. El objetivo es que la demanda que tengas llegue a las URL correctas.
Runbook: “Google no está rastreando mis páginas importantes y mi servidor está bien”
Una ruta lineal para el propietario de un sitio grande que sospecha de un problema de demanda. Detente en cuanto un paso lo resuelva.
-
Confirma que tu sitio es lo suficientemente grande como para que importe. Si las páginas normalmente se rastrean el día en que se publican, o el sitio tiene un tamaño normal, detente — no tienes un problema de demanda de rastreo. Este runbook es para sitios con más de 1 M de páginas o que cambian rápidamente, o sitios con una gran pila de “Discovered – currently not indexed”.
-
Descarta primero la capacidad. Abre Crawl Stats de GSC. Comprueba el Host status y el tiempo de respuesta promedio durante los últimos 90 días. Si ves picos de
5xx/tiempo de espera o tiempos de respuesta en aumento, se trata de un problema de capacidad — soluciona el estado de salud del servidor (consulta la página de frecuencia de rastreo) y vuelve a ejecutar este runbook después. Si el servidor parece saludable, continúa. -
Obtén evidencia real por URL a partir de los registros. Obtén los registros del servidor (o un feed de analítica de bots) para el conjunto de URL afectadas. Confirma el patrón: las solicitudes reales de Googlebot son escasas o ausentes en las páginas que te importan, mientras que las URL basura o con parámetros están consumiendo las solicitudes. Las solicitudes escasas en páginas con un servidor saludable son una hipótesis de demanda, no una causa confirmada todavía — antes de decantarte por “demanda”, descarta las causas similares: que Google no haya descubierto la URL, un fallo de renderizado que oculte el contenido, una canonicalización que apunte a otra página, problemas reales de calidad o de contenido duplicado, y las propias decisiones de selección de indexación de Google. Comprueba la herramienta de inspección de URL de Search Console y la vista de HTML renderizado para cada URL.
-
Comprueba la inflación del inventario percibido. Cuenta cuántas URL de bajo valor Google podría estar descubriendo: combinaciones de navegación por facetas, ID de sesión, parámetros de orden/filtro, calendarios/espacios infinitos, duplicados en el sitio. Si estos superan con creces tus páginas reales, es probable que la demanda se esté dispersando entre basura.
-
Recorta el inventario basura. Reduce el espacio de URL de bajo valor desde el origen (gestión de parámetros, disallow en
robots.txtde espacios infinitos, corrección de spider traps, consolidación de duplicados mediante canonicalización). Espera una concentración con el tiempo, no una reasignación instantánea. -
Trabaja la entrada de popularidad. Añade enlaces internos desde páginas fuertes a las páginas poco rastreadas (elimina las huérfanas) y consigue enlaces externos. La popularidad es un impulsor principal de la demanda.
-
Trabaja la entrada de calidad/frescura. Mejora y actualiza genuinamente las páginas para que las señales que devuelve la indexación le digan al programador que “aumente la demanda.” Un
lastmodpreciso ayuda a Google a programar; la frescura falsa no lo hace. -
Dale tiempo y luego vuelve a medir. Vuelve a comprobar Crawl Stats y los registros después de que Google haya tenido tiempo para reevaluar. Los cambios de demanda son graduales. Si ahora las páginas se rastrean y se indexan, listo. Si no, vuelve a evaluar si realmente vale la pena rastrearlas — a veces la respuesta honesta es que no, y las páginas de contenido escaso no deberían forzarse en el índice.
Lista de verificación de demanda de rastreo
Diagnostica: ¿es demanda o capacidad?
- Confirma que el sitio es realmente lo bastante grande o cambiante como para prestarle atención (de lo contrario, detente).
- Crawl Stats de GSC: host status saludable, tiempo de respuesta promedio estable, sin
picos de
5xx/timeout. - Revisa los registros del servidor (o analítica de bots) para verificar hits reales de Googlebot por URL.
- Identifica el patrón: servidor saludable + bajo volumen de rastreo en páginas buenas + “Discovered – currently not indexed” = una hipótesis de demanda, no una prueba — y no un problema de capacidad.
- Descarta los casos similares antes de culpar a la demanda: problemas de descubrimiento, renderizado, canonicalización, calidad/duplicación y selección de indexación.
Trabaja los factores de demanda (no hay un ajuste directo)
- Popularidad: las páginas importantes tienen enlaces internos que apuntan a ellas (sin páginas huérfanas); la creación de enlaces externos está en marcha donde importa.
- Antigüedad/frescura: las páginas que deberían volver a rastrearse con frecuencia se
actualizan realmente;
lastmodes preciso (no falsificado). - Inventario percibido: los espacios de navegación por facetas, parámetros, ID de sesión y URL infinitas están controlados; los spider traps están corregidos; los duplicados están consolidados.
Comprobaciones de realidad
- No esperar que un servidor más rápido aumente la demanda (solo eleva el techo de capacidad).
- No esperar que la directiva disallow de robots.txt para el contenido basura redirija instantáneamente la demanda a páginas buenas (se concentra con el tiempo).
- No confiar en los pings de IndexNow/sitemap para mover la demanda de Google (Google ignora
IndexNow y
changefreq/priority). - Después de una migración web, tratar el pico de rastreo temporal como algo esperado, no como un problema.
- Recordar que más rastreo no es el objetivo — la priorización correcta sí lo es; el volumen de rastreo no es un factor de posicionamiento.
Demanda de rastreo — hoja de referencia
Las dos caras del presupuesto de rastreo
| Demanda de rastreo (esta página) | Frecuencia de rastreo / capacidad | |
|---|---|---|
| Qué es | Cuánto quiere rastrear Google | Qué tan rápido puede |
| Factores | Popularidad, falta de actualización, inventario percibido (+ migraciones web) | Estado del servidor / carga del host |
| Función en la cola | Establece el orden de las URL (importancia) | Establece hasta dónde llega Google |
| Tu palanca | Enlaces, frescura real, eliminar inventario basura | Servidor más rápido/saludable |
| ¿Control directo? | No | No |
Los tres factores de demanda más accionables (Google menciona estos, además del tamaño del sitio, la frecuencia de actualización, la calidad de la página y la relevancia comparativa como factores generales significativos — no una fórmula cerrada)
| Entrada | Qué lo aumenta | Qué no es |
|---|---|---|
| Popularidad | Más enlaces / PageRank (internos + externos) | No es el volumen de publicación |
| Desactualización | Cambio genuino y frecuente del contenido | No es un lastmod falso |
| Inventario percibido | Menos URL basura/duplicadas (reducirlo ayuda) | No es un servidor más rápido |
Datos rápidos
- Presupuesto de rastreo = “the number of URLs Googlebot can and wants to crawl.” (traducción) «el número de URL que Googlebot puede y quiere rastrear.»
- El inventario percibido es “the factor you can positively control the most.” (traducción) «el factor que más puedes controlar de manera positiva.»
- Las migraciones web aumentan temporalmente la demanda (reprocesamiento bajo nuevas URL).
- La demanda establece el orden de prioridad; la capacidad de carga del host decide hasta qué profundidad Google rastrea — un servidor saludable no crea demanda.
- El planificador “turns up demand” (traducción) «aumenta la demanda» cuando mejoran las señales de calidad de indexación — esa es la única palanca real además de los enlaces.
- El objetivo de Google es rastrear menos en general, no más (Illyes, 2024). El volumen de rastreo no es un factor de posicionamiento.
- No hay una “puntuación de demanda de rastreo” pública — Crawl Stats muestra la actividad (lado de la capacidad).
- Bing no tiene el término “demanda de rastreo” — es eficiencia de rastreo; IndexNow señala cambios a Bing, no a Google.
Herramientas para diagnosticar la demanda de rastreo
No hay un “medidor de demanda”, por lo que diagnosticar la demanda significa leer la actividad de rastreo y compararla con lo que sabes sobre las páginas.
- Google Search Console — Crawl Stats report — solicitudes de rastreo totales a lo largo del tiempo, host status, tiempo de respuesta promedio y desgloses por código de respuesta, tipo de archivo, propósito y tipo de Googlebot. Léelo como una vista de capacidad: host status saludable + bajo volumen de rastreo en páginas buenas es tu señal de demanda.
- GSC — Page indexing report — el grupo “Discovered – currently not indexed” es la huella clásica de un déficit de demanda (Google conoce las URL, pero no le importan lo suficiente como para rastrearlas todavía).
- Inspección de URL (GSC) — comprueba cuándo se rastreó por última vez una URL específica y si está indexada; útil para confirmar la historia de demanda de una sola página.
- Análisis de archivos de registro del servidor — la verdad absoluta de los accesos reales de Googlebot por URL: qué URL recuperan realmente los bots, con qué frecuencia y dónde se está desperdiciando el rastreo en inventario basura. (Consulta log file analysis.)
- Ahrefs Bot Analytics — una herramienta que puedo describir de primera mano. Como la describí cuando la lanzamos: “Have y’all checked out Bot Analytics in Ahrefs yet? We released a new tool that shows how bots crawl your website. Bot Analytics collects data server-side via Cloudflare integration.” (traducción) «¿Ya han probado Bot Analytics en Ahrefs? Lanzamos una nueva herramienta que muestra cómo los bots rastrean tu sitio web. Bot Analytics recopila datos del lado del servidor mediante la integración con Cloudflare.» Muestra cada bot que rastrea tu sitio y las páginas que visita en 12 categorías — exactamente la verdad absoluta por URL y por bot que necesitas para contrastar con la realidad la historia de Google sobre «inventario percibido» y «popularidad». El propio planteamiento de Ahrefs del problema que resuelve: “uncontrolled bot traffic wastes crawl budget — bots crawling 404 pages or low-value URLs aren’t crawling the pages you need indexed,” (traducción) «el tráfico de bots no controlado desperdicia el presupuesto de rastreo — los bots que rastrean páginas 404 o URL de bajo valor no están rastreando las páginas que necesitas indexar», y cita la estimación de que más de la mitad de todo el tráfico de rastreadores es esfuerzo desperdiciado.
- Ahrefs Site Audit / Screaming Frog SEO Spider — simula un rastreo para detectar la proliferación de parámetros, los duplicados y los patrones similares a trampas que inflan el inventario percibido y suprimen la demanda.
El marco importancia × cambio × inventario
Usa tres preguntas para explicar los cambios en la demanda de rastreo:
- Importancia: ¿las señales internas o externas hicieron que la URL fuera más o menos importante?
- Cambio: ¿la página cambió de manera significativa y las señales veraces del sitemap lo comunicaron?
- Inventario: ¿se expandió el conjunto conocido por el rastreador de duplicados, parámetros o URL de bajo valor?
La salud del host es el techo, no un cuarto insumo de demanda. Si los registros muestran errores o tiempos de espera agotados, diagnostica la capacidad de rastreo por separado. Si el servidor está saludable pero las URL valiosas pierden cuota de rastreo, trabaja la importancia, el cambio y el inventario en ese orden.
Compara la cuota de rastreo por directorio
Este pipeline de shell resume las solicitudes de rastreadores verificados por el primer directorio de la ruta de la URL en un registro de acceso común:
awk 'BEGIN{IGNORECASE=1} /Googlebot/ {split($7,p,"/"); print "/" p[2] "/"}' access.log | sort | uniq -c | sort -nrEn PowerShell:
Select-String .\access.log -Pattern 'Googlebot' | ForEach-Object { if ($_.Line -match '"(?:GET|HEAD)\s+https?://[^/]+/([^/?\s]*)|"(?:GET|HEAD)\s+/([^/?\s]*)') { '/' + (($Matches[1],$Matches[2] | Where-Object { $_ })[0]) + '/' } } | Group-Object | Sort-Object Count -DescendingCompara ventanas de la misma duración antes y después de un cambio. Que un directorio gane cuota es una pista sobre la asignación del planificador, no una prueba de mayor calidad o de mejores posiciones.
Métricas para la demanda de rastreo
Cuota de rastreo de plantillas valiosas
Métrica: solicitudes de rastreadores a plantillas importantes divididas entre solicitudes de rastreadores verificados. Qué te indica: si la demanda está llegando al inventario que te importa. Cómo obtenerla: clasifica las URL del registro de acceso por plantilla. Punto de referencia / rango realista: define la combinación deseada a partir de tu propio inventario valioso y la cadencia de actualización; no existe un porcentaje universal. Cadencia: semanal para sitios grandes y cambiantes, mensual en caso contrario.
Retraso de rerastreo después de cambios significativos
Métrica: tiempo desde una actualización real de la página hasta la siguiente solicitud verificada del rastreador. Qué te indica: si el planificador reconoce la importancia de la página y su patrón de cambios. Cómo extraerla: cruza las marcas de tiempo de despliegue o de contenido con los registros de acceso. Referencia / rango realista: línea base por plantilla; las páginas de noticias y las páginas de referencia estables no deberían compartir un objetivo. Cadencia: mensual.
Proporción de inventario de bajo valor
Métrica: URL conocidas y rastreadas con parámetros, duplicadas, vacías o con error soft 404, en relación con las URL útiles. Qué te indica: si el inventario percibido está diluyendo la atención. Cómo extraerla: combina exportaciones de rastreo, sitemaps, reglas de indexabilidad y registros. Referencia / rango realista: tendencia a la baja desde la línea base del sitio sin bloquear los recursos necesarios. Cadencia: mensual y después de cambios en la navegación por facetas o en la plataforma.
Recursos que merecen tu tiempo
Mis artículos relacionados
- ¿Cuándo deberías preocuparte por el presupuesto de rastreo? — donde planteo el presupuesto de rastreo como la demanda («cuántas páginas quiere rastrear un motor de búsqueda») más la frecuencia, y abarco la popularidad, el retroceso por contenido obsoleto y quién realmente necesita prestarle atención.
- ¿Qué es Googlebot y cómo funciona? — cómo Googlebot decide qué y cuánto rastrear.
- Guía para principiantes de SEO técnico — dónde encajan el rastreo y el presupuesto de rastreo en el panorama general.
Mis ponencias
- Cómo funciona la búsqueda (SlideShare) — mi recorrido por el rastreo, incluidos los factores de demanda (PageRank, frescura, tiempo desde el último rastreo, cambios importantes en el sitio) y la diapositiva separada sobre capacidad/carga del host. (Descargo de responsabilidad permanente: _“This is my understanding of systems… not going to be 100% complete or accurate.” (traducción) «Esta es mi comprensión de los sistemas… no va a ser 100 % completa ni precisa.»)
Desde la industria
- Prioridades de rastreo de Google: conclusiones de Gary Illyes (Search Engine Journal) — las citas “convince search your stuff is worth fetching,” (traducción) «convence a la búsqueda de que tu contenido vale la pena recuperarse», “turning up demand,” (traducción) «aumentar la demanda» y “search demand goes down” (traducción) «la demanda de búsqueda baja» sobre cómo se mueve realmente la demanda.
- Gary Illyes sobre rastrear aún menos (LinkedIn, abril de 2024) — la fuente principal de “crawl even less… fewer bytes on wire” (traducción) «rastrear aún menos… menos bytes en la red» y “scheduling got more intelligent.” (traducción) «la programación se volvió más inteligente.»
- Google tiene dos tipos de rastreo: descubrimiento y actualización (Search Engine Journal) — John Mueller sobre los rastreos de descubrimiento frente a los de actualización; la cadencia de actualización es un resultado puro de la demanda.
- Gary Illyes de Google sobre presupuesto de rastreo, programación y carga del host (Search Engine Roundtable) — el enfoque de carga del host de “bucket of URLs in importance order” (traducción) «cubo de URL en orden de importancia» (parafraseado en este artículo; la página bloquea la recuperación automatizada — confírmalo en la página en vivo).
- Google: 100k URL no afectarán el presupuesto de rastreo (Search Engine Roundtable) — la comprobación intuitiva de escala de John Mueller (parafraseada aquí; confírmala en la página en vivo).
- ¿Qué es el presupuesto de rastreo? Cómo funciona + consejos de optimización (Search Engine Land) — una megaguía sólida sobre el presupuesto de rastreo; contexto útil sobre los tres factores de demanda.
- Ahrefs Bot Analytics — la página del producto con el enfoque de “uncontrolled bot traffic wastes crawl budget” (traducción) «el tráfico de bots no controlado desperdicia el presupuesto de rastreo» y “over half… wasted effort” (traducción) «más de la mitad… esfuerzo desperdiciado» para diagnosticar la demanda frente a la capacidad a partir de datos reales de bots.
Ponte a prueba: demanda de rastreo
Cinco preguntas rápidas sobre el lado del “deseo” del presupuesto de rastreo. Elige una respuesta para cada una, luego comprueba.
Registro de cambios
Actualizado el 8 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 17 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.