Frecuencia de rastreo

La rapidez con la que los motores de búsqueda obtienen tus páginas — qué es la frecuencia de rastreo, por qué Google retiró el control deslizante de frecuencia de Search Console, cómo ralentizar a Googlebot de forma segura hoy, por qué no puedes forzar un aumento y en qué difiere el Crawl Control manual de Bing.

Publicado por primera vez: 22 jun 2026 · Última actualización: 8 ago 2026 · Avanzado
Idiomas

La frecuencia de rastreo es la rapidez con la que un rastreador obtiene páginas de tu servidor: el lado de la oferta del presupuesto de rastreo (el lado de la demanda es cuánto quiere rastrear el motor). Google ahora la establece automáticamente según el estado de tu servidor: el control deslizante manual de frecuencia de Search Console se eliminó el 8 de enero de 2024. Para ralentizar a Googlebot hoy, envías señales mediante códigos de estado HTTP: devuelve 500/503/429 durante uno o dos días, nunca 403/404, y la directiva crawl-delay es ignorada por Google. No puedes solicitar un aumento permanente; lo mejoras indirectamente con un servidor más rápido, sitemaps limpios y menos URL desperdiciadas. Bing todavía ofrece una cuadrícula manual de Crawl Control. La frecuencia de rastreo no es un factor de posicionamiento, y la mayoría de los sitios nunca necesitan gestionarla.

TL;DR — La frecuencia de rastreo es el lado de la oferta del presupuesto de rastreo: la velocidad con la que un rastreador obtiene páginas, establecida por lo que Google denomina límite de capacidad de rastreo (conexiones paralelas

  • retraso entre las solicitudes de obtención). Es automática y reacciona al estado de salud del servidor; el control deslizante manual de Google Search Console se eliminó el 8 de enero de 2024. Para ralentizar a Googlebot ahora, envía señales mediante HTTP: 500/503/429 durante 1–2 días como máximo, nunca 401/403/404, y Google ignora la directiva crawl-delay (Bing la respeta). No puedes solicitar un aumento; mejórala de forma indirecta. Bing todavía tiene una cuadrícula manual de Crawl Control. La frecuencia de rastreo no es un factor de posicionamiento, y la mayoría de los sitios nunca necesitan tocarla.

Qué es realmente la frecuencia de rastreo

La frecuencia de rastreo es la velocidad con la que un rastreador obtiene páginas de tu servidor: la cantidad de solicitudes simultáneas que realiza y el retraso entre ellas. El nombre que le da Google es límite de capacidad de rastreo: “the maximum number of simultaneous parallel connections that Google can use to crawl a site, as well as the time delay between fetches.” (traducción) «el número máximo de conexiones paralelas simultáneas que Google puede usar para rastrear un sitio, así como el retraso entre las solicitudes de obtención.» Evidence for this claim Google defines crawl capacity using simultaneous connections and the delay between fetches, adjusted according to site responses. Scope: Google crawler capacity, not a ranking factor. Confidence: high · Verified: Google: Large site crawl budget guide

Es una mitad del presupuesto de rastreo. Como lo expreso en mi guía de presupuesto de rastreo de Ahrefs, el presupuesto de rastreo se divide en “crawl demand which is how many pages a search engine wants to crawl on your site and crawl rate which is how fast they can crawl.” (traducción) «la demanda de rastreo, que es cuántas páginas quiere rastrear un motor de búsqueda en tu sitio, y la frecuencia de rastreo, que es qué tan rápido puede rastrear». La frecuencia de rastreo es el lado de la oferta (qué tan rápido les permites rastrear); la demanda de rastreo es el lado de la demanda (cuánto quieren rastrear). El presupuesto de rastreo es donde ambos se encuentran — y las posiciones quedan completamente fuera de ese bucle.

En mi presentación How Search Works describo el límite de frecuencia de rastreo simplemente como lo que tu sitio puede soportar — está determinado por la estabilidad de tu servidor y la salud del rastreo, las respuestas lentas, los errores 5xx (de servidor) y las respuestas 429 (Too Many Requests). Google reduce el rastreo cuando tu servidor empieza a tener problemas porque no quiere provocar la caída de tu sitio. Un detalle que la gente pasa por alto: todos los Googlebots comparten un único grupo de rastreo — los bots de búsqueda, imágenes, anuncios, etc., todos consumen de la misma frecuencia. Así que un rastreo descontrolado de un tipo de recurso consume el rastreo de todo lo demás.

Crawl rate is the capacity gate. It can constrain demand, but increasing capacity does not manufacture demand or rankings. Fuente: Google Search Central

Crawl demand orders URLs using popularity, genuine change, and useful inventory. Crawl capacity is shaped by server response speed, stability, and errors. The capacity gate determines how far Googlebot proceeds through the ordered queue. A faster, healthier server can raise the ceiling, but it does not create crawl demand and is not a ranking signal.

© Patrick Stox LLC · CC BY 4.0 ·

Qué establece la frecuencia de rastreo

El límite de capacidad es automático y reacciona a tu servidor en tiempo real. Google: “If the site responds quickly for a while, the limit goes up, meaning more connections can be used to crawl. If the site slows down or responds with server errors, the limit goes down and Google crawls less.” (traducción) «Si el sitio responde rápidamente durante un tiempo, el límite sube, lo que significa que se pueden usar más conexiones para rastrear. Si el sitio se ralentiza o responde con errores de servidor, el límite baja y Google rastrea menos.»

Hay una segunda palanca que no controlas: los recursos propios de Google. “Google has a lot of machines, but not infinite machines. We still need to make choices with the resources that we have.” (traducción) «Google tiene muchas máquinas, pero no máquinas infinitas. Aún necesitamos tomar decisiones con los recursos que tenemos.» Por lo tanto, la salud de tu servidor establece el techo que Google está dispuesto a usar, pero la capacidad propia de Google y la demanda de rastreo de tu sitio deciden cuánto de ese techo se usa realmente.

El documento de mitos confirma que la relación con la salud del servidor funciona en ambos sentidos: “A speedy site is a sign of healthy servers, so it can get more content over the same number of connections,” (traducción) «Un sitio rápido es una señal de servidores saludables, por lo que puede obtener más contenido con el mismo número de conexiones», mientras que “a significant number of 5xx HTTP response status codes (server errors) or connection timeouts signal the opposite, and crawling slows down.” (traducción) «un número significativo de códigos de estado HTTP 5xx (errores del servidor) o tiempos de espera de conexión señalan lo contrario, y el rastreo se ralentiza».

¿La frecuencia de rastreo afecta el posicionamiento? No.

Desmonta esto primero, porque impulsa mucho esfuerzo equivocado. El rastreo es necesario para aparecer en la búsqueda, pero no es una señal de posicionamiento. Google es explícito: “Improving your crawl rate won’t necessarily lead to better positions in Google Search results.” (traducción) «Mejorar tu frecuencia de rastreo no necesariamente conducirá a mejores posiciones en los resultados de Google Search.» Un rastreo más rápido o más frecuente te consigue un descubrimiento y una indexación más recientes, no posiciones más altas. La frecuencia de rastreo es una cuestión de eficiencia y de salud del servidor — y punto.

Evidence for this claim Improving crawl rate does not itself improve ranking positions; crawling is necessary for eligibility but is not a ranking signal. Scope: websites Confidence: high · Verified: Myths and facts about crawling

Cómo reducir la frecuencia de rastreo de Googlebot

En orden, desde la solución real hasta la palanca de emergencia:

1. Arregla el servidor (la solución real). Aceléralo o añade recursos. Dado que el límite de capacidad hace seguimiento del tiempo de respuesta y de los errores, un servidor más saludable es la forma duradera de mantener el rastreo en un rango cómodo, y es la que no pone en riesgo tu indexación.

2. La palanca de emergencia — 500/503/429. Google: _“return 500, 503, or 429 HTTP response status code instead of 200 to the crawl requests.” (traducción) «devuelve un código de estado HTTP 500, 503 o 429 en lugar de 200 a las solicitudes de rastreo». Sus rastreadores _“treat the 429 status code as a signal that the server is overloaded,” (traducción) «tratan el código de estado 429 como una señal de que el servidor está sobrecargado», y _“5xx and 429 server errors prompt Google’s crawlers to temporarily slow down with crawling.” (traducción) «los errores del servidor 5xx y 429 hacen que los rastreadores de Google reduzcan temporalmente el rastreo». Gary Illyes expresó la velocidad de esto en términos concretos: _“if the server persistently returns HTTP 500 status codes for a range of URLs, Googlebot will automatically, and almost immediately slow down crawling.” (traducción) «si el servidor devuelve de forma persistente códigos de estado HTTP 500 para un rango de URL, Googlebot reducirá automáticamente, y casi de inmediato, el rastreo». Prefiere 429 cuando puedas — significa explícitamente «demasiadas solicitudes» y puede incluir un encabezado Retry-After.

El inconveniente es que esto es estrictamente temporal. Google: _“We don’t recommend that you do this for a long period of time (meaning, longer than 1-2 days).” (traducción) «No recomendamos que hagas esto durante un periodo largo (es decir, más de 1-2 días)». Si lo dejas activado, el costo es real — si esos códigos persisten en la misma URL durante varios días, _“the URL may be dropped from Google’s index” (traducción) «la URL puede eliminarse del índice de Google» y, para Google Ads, _“your campaigns may be cancelled or paused, and your ads may not serve.” (traducción) «tus campañas pueden cancelarse o pausarse, y tus anuncios pueden no mostrarse».

3. Lo que NO debes hacer. No uses 4xx para limitar el rastreo. “The 4xx status codes, except 429, have no effect on crawl rate,” (traducción) «Los códigos de estado 4xx, excepto 429, no tienen efecto sobre la frecuencia de rastreo», y Google dice claramente “Don’t use 401 and 403 status codes for limiting the crawl rate.” (traducción) «No uses los códigos de estado 401 y 403 para limitar la frecuencia de rastreo». En una publicación dedicada de 2023 sobre personas que hacen exactamente esto, Google escribió: “Over the last few months we noticed an uptick in website owners and some content delivery networks (CDNs) attempting to use 404 and other 4xx client errors (but not 429) to attempt to reduce Googlebot’s crawl rate. The short version of this blog post is: please don’t do that…” (traducción) «Durante los últimos meses hemos notado un aumento de propietarios de sitios web y algunas redes de entrega de contenido (CDN) que intentan usar 404 y otros errores de cliente 4xx (pero no 429) para intentar reducir la frecuencia de rastreo de Googlebot. La versión corta de esta publicación de blog es: por favor, no hagas eso…». Y no recurras a la directiva crawl-delay de robots.txt: “The non-standard ‘crawl-delay’ robots.txt rule is not processed by Google’s crawlers.” (traducción) «La regla no estándar ‘crawl-delay’ de robots.txt no es procesada por los rastreadores de Google».

Evidence for this claim Google's crawlers do not process the non-standard crawl-delay robots.txt rule. Scope: websites Confidence: high · Verified: Myths and facts about crawling

4. La solicitud no urgente. Para un problema continuo que no es una emergencia, puedes “file a special request to report a problem with unusually high crawl rate, mentioning the optimal rate for your site.” (traducción) «presentar una solicitud especial para informar de un problema con una frecuencia de rastreo inusualmente alta, mencionando la frecuencia óptima para tu sitio». Es lento y solo va en una dirección (ver abajo).

¿Puedes aumentar la frecuencia de rastreo? No — no directamente.

No existe un aumento manual. Google: _“You cannot request an increase in crawl rate, and it may take several days for the request to be evaluated and fulfilled.” (traducción) «No puedes solicitar un aumento de la frecuencia de rastreo, y pueden pasar varios días antes de que la solicitud se evalúe y se cumpla.» Lo que puedes hacer es mejorarla indirectamente. En mi guía de presupuesto de rastreo, las palancas que realmente mueven la eficiencia de rastreo son: acelera tu servidor / añade recursos; mantén las páginas importantes en sitemaps limpios; elimina el contenido duplicado; consigue más enlaces (externos e internos); corrige los enlaces con redirecciones; usa GET en lugar de POST donde sea posible; y usa la Indexing API cuando cumplas los requisitos. Ten en cuenta que “a speedy site… can get more content over the same number of connections” (traducción) «Un sitio rápido… puede obtener más contenido a través del mismo número de conexiones» — por lo que la salud del servidor es la palanca que aparece tanto del lado de la reducción como del aumento.

Cómo controlar la frecuencia de rastreo de Bingbot

Este es el marcado contraste entre motores. Donde Google retiró el control manual, Bing lo mantuvo. Bing Webmaster Tools tiene Crawl Control (en Configuration): una cuadrícula hora por hora donde cada hora muestra bloques que representan la velocidad de rastreo — más bloques significan un rastreo más rápido, menos bloques significan uno más lento. Puedes elegir un ajuste preestablecido basado en tus horas pico del negocio, o elegir “Custom” y dibujar tu propio patrón a lo largo del día. Bing también sigue respetando la directiva crawl-delay en robots.txt — la directiva exacta que Google ignora. Así que la regla general para dos motores: para Google, envías señales a través de las respuestas del servidor; para Bing, tienes un control real.

¿Qué pasó con la herramienta de frecuencia de rastreo de Search Console?

La cronología, porque muchos consejos todavía hacen referencia a una herramienta que ya no existe:

  • dic 2008 — Google introduce el control de frecuencia de rastreo para usuarios en Webmaster Tools.
  • feb 2023 — Google publica “don’t use 403s or 404s for rate limiting.” (traducción) «no uses 403 ni 404 para la limitación de frecuencia».
  • 24 nov 2023 — Google anuncia la descontinuación de Crawl Rate Limiter Tool. El razonamiento de Illyes: “with the improvements we’ve made to our crawling logic and other tools available to publishers, its usefulness has dissipated.” (traducción) «con las mejoras que hemos hecho a nuestra lógica de rastreo y a otras herramientas disponibles para los editores, su utilidad se ha disipado». La herramienta antigua era lenta y apenas se usaba — tenía “a much slower effect” (traducción) «un efecto mucho más lento» y “would have taken over a day for the new limits to be applied on crawling,” (traducción) «habría tardado más de un día en que los nuevos límites se aplicaran al rastreo,» y se usaba “rarely,” (traducción) «rara vez,» y quienes lo hacían “in many cases set the crawling speed to the bare minimum.” (traducción) «en muchos casos configuraban la velocidad de rastreo al mínimo absoluto».
  • 8 ene 2024 — la herramienta se elimina. Evidence for this claim Google deprecated the Search Console crawl-rate limiter and removed it on January 8, 2024. Scope: Google Search Console's legacy crawl-rate limiter. Confidence: high · Verified: Google: Crawl rate limiter deprecation Google también redujo el mínimo: “With the deprecation of the crawl limiter tool, we’re also setting the minimum crawling speed to a lower rate, comparable to the old crawl rate limits.” (traducción) «Con la descontinuación de la herramienta de limitación de rastreo, también estamos estableciendo la velocidad mínima de rastreo en una frecuencia más baja, comparable a los antiguos límites de frecuencia de rastreo».

La consecuencia práctica: el antiguo control deslizante manual tenía un retraso de más de 24 horas de todos modos; el enfoque actual de señales del servidor (5xx/429) ralentiza a Googlebot casi inmediatamente, lo cual es estrictamente mejor para una emergencia real.

Cómo supervisar la frecuencia de rastreo

El Crawl Stats report de GSC es tu ventana a lo que Google está haciendo realmente: total de solicitudes de rastreo a lo largo del tiempo, tamaño total de descarga, tiempo de respuesta promedio y una vista de host status de la disponibilidad de tu sitio para Google durante los últimos ~90 días, además de un desglose por código de respuesta, tipo de archivo, propósito de rastreo y tipo de Googlebot. Vigila el tiempo de respuesta promedio y las señales de host status: un tiempo de respuesta en aumento o una oleada de 5xx es exactamente lo que hace que Googlebot te limite, así que este informe es donde verás una ralentización autoinfligida antes de salir a buscar una. En Bing, Crawl Control y la información de rastreo en Bing Webmaster Tools son los equivalentes.

Frecuencia de rastreo vs presupuesto de rastreo vs frecuencia de rastreo

Ten claros estos conceptos:

  • Frecuencia de rastreo = qué tan rápido (oferta / capacidad).
  • Demanda de rastreo = cuánto quieren (popularidad + obsolescencia).
  • Presupuesto de rastreo = la interacción de ambos — “the amount of time and resources a search engine allows for crawling a website.” (traducción) «la cantidad de tiempo y recursos que un motor de búsqueda permite para el rastreo de un sitio web.»
  • Frecuencia de rastreo = con qué frecuencia se vuelve a rastrear una página determinada, lo que es principalmente una cuestión de demanda de rastreo (popularidad y lo fresca u obsoleta que sea la página).

Y la parte tranquilizadora, que es mi postura habitual: la mayoría de los sitios no tienen que preocuparse por nada de esto. “Most sites don’t need to worry about crawl budget, but there are few cases where you may want to take a look” (traducción) «La mayoría de los sitios no tienen que preocuparse por el presupuesto de rastreo, pero hay pocos casos en los que puede que quieras echar un vistazo» — sitios más nuevos con muchas páginas, sitios muy grandes o que cambian rápidamente, y sitios con un montón de URL «Discovered – currently not indexed» en GSC. Si ese no es tu caso, deja en paz la frecuencia de rastreo y deja que la automatización de Google haga su trabajo.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.