Directiva crawl-delay

La directiva crawl-delay de robots.txt — qué hace, por qué Google dejó de respetarla en 2019 y Yandex la eliminó en 2018, cómo Bing todavía interpreta el valor, qué otros rastreadores la respetan y qué usar en su lugar.

Publicado por primera vez: 27 jun 2026 · Última actualización: 8 ago 2026 · Avanzado
Idiomas
1 señal de evidencia en esta página

La directiva crawl-delay es una directiva no estándar de robots.txt que pide a los bots esperar entre solicitudes para reducir la carga del servidor. Google la ignora desde el 1 de septiembre de 2019; para ralentizar a Googlebot, usa respuestas temporales 429/503 o corrige la capacidad del servidor. La guía actual de Bing Webmaster documenta valores de 1 a 20 segundos. Yandex eliminó el soporte el 22 de febrero de 2018 y ahora usa una configuración de frecuencia de rastreo dentro de Yandex Webmaster. Consulta la documentación de cada rastreador antes de confiar en este campo no estándar.

TL;DR — Crawl-delay era una directiva no oficial de robots.txt para ralentizar rastreadores; nunca estuvo en el estándar formal (RFC 9309). Google la retiró el 1 de septiembre de 2019 y no la procesa explícitamente — ralentiza a Googlebot con 429/503 (1-2 días como máximo) o corrigiendo el servidor, no con crawl-delay. La guía actual de Bing documenta valores de 1 a 20 segundos. Yandex dejó de admitirla el 22 de febrero de 2018 — allí tampoco se respeta; Yandex ahora usa una configuración de frecuencia de rastreo dentro de Yandex Webmaster. Muchos rastreadores SEO (AhrefsBot, Semrush) y algunos bots de IA (ClaudeBot) también la respetan, lo cual es el único caso de uso real que queda: controlar bots que no son de Google, Bing ni Yandex.

Evidence for this claim Google does not support or process the non-standard crawl-delay robots.txt field. Scope: Google crawlers; other crawlers may support the field. Confidence: high · Verified: Google: robots.txt specifications

Por qué existe la directiva crawl-delay

Crawl-delay es un mecanismo de limitación. La idea es sencilla: un rastreador agresivo que obtiene páginas una tras otra puede ejercer una carga real sobre un servidor, especialmente uno pequeño o lento. Crawl-delay era la palanca de cortesía — una forma de pedirle a un bot que hiciera una pausa de unos segundos entre solicitudes para que tu servidor pudiera mantener el ritmo. Se encuentra en robots.txt dentro de un grupo de User-agent, el mismo lugar donde van las líneas disallow y allow. (Para ver el archivo completo, consulta robots-txt.)

El problema es que nunca se estandarizó. El Robots Exclusion Protocol finalmente se formalizó como RFC 9309 en 2022, y la directiva crawl-delay no está en él. Siempre fue una extensión no oficial que diferentes rastreadores decidieron implementar —o no— e interpretaron a su manera. Esa inconsistencia es exactamente la razón por la que Google se alejó de ella.

Google la retiró el 1 de septiembre de 2019

El 2 de julio de 2019, Gary Illyes publicó Una nota sobre reglas no admitidas en robots.txt en Google Search Central. Google estaba publicando como código abierto su analizador de robots.txt y, como parte de ello, retirando todo el código que manejaba reglas que nunca formaron parte del borrador de internet —específicamente noindex, nofollow y la directiva crawl-delay. La retirada entró en vigor el 1 de septiembre de 2019.

El razonamiento de Google: estas reglas no estaban documentadas, no eran oficiales y se interpretaban de manera inconsistente entre los rastreadores, lo que creaba ambigüedad. La documentación actual de robots.txt ahora es explícita: Google admite cuatro campos (user-agent, allow, disallow y sitemap), y la documentación dice:

  • “other fields such as crawl-delay aren’t supported.” (traducción) «otros campos como crawl-delay no se admiten». La página Mitos y hechos sobre el rastreo de Google lo repite:
  • “The non-standard ‘crawl-delay’ robots.txt rule is not processed by Google’s crawlers.” (traducción) «La regla no estándar ‘crawl-delay’ de robots.txt no es procesada por los rastreadores de Google». Evidence for this claim Google does not support or process the non-standard crawl-delay robots.txt field. Scope: Google crawlers; other crawlers may support the field. Confidence: high · Verified: Google: robots.txt specifications

Vale la pena tener claro el alcance: se ignora sin importar en qué grupo de agente de usuario (user-agent) lo coloques. Un bloque User-agent: Googlebot con una línea Crawl-delay se ignora igual que uno bajo User-agent: *.

Qué usar en su lugar para Google

La frecuencia de rastreo de Google ahora es totalmente automática, ajustada a la salud de tu servidor — y el antiguo control deslizante manual de frecuencia de rastreo en Search Console se eliminó el 8 de enero de 2024 (anunciado el noviembre anterior). Así que cuando realmente necesites que Googlebot reduzca el ritmo, tienes tres palancas:

  1. Arregla el servidor. La verdadera solución. Si tu servidor puede soportar la carga, no necesitas limitar nada.
  2. Devuelve 429, 500 o 503 para emergencias. La documentación de Google Reducir la frecuencia de rastreo de Googlebot dice:
    • “return 500, 503, or 429 HTTP response status code instead of 200 to the crawl requests.” (traducción) «devuelve el código de estado HTTP 500, 503 o 429 en lugar de 200 a las solicitudes de rastreo.» Googlebot los interpreta como:
    • “slow down” (traducción) «ralentiza» casi de inmediato. La regla estricta:
    • “We don’t recommend that you do this for a long period of time (meaning, longer than 1-2 days).” (traducción) «No recomendamos que hagas esto durante un período prolongado (es decir, más de 1-2 días).» Los 5xx sostenidos conllevan el riesgo de que se eliminen páginas (y de que Google Ads se pause). Evidence for this claim Google recommends temporarily returning 500, 503, or 429 to reduce crawl rate and warns against doing so for longer than one or two days. Scope: Temporary Googlebot overload response, not routine crawl management. Confidence: high · Verified: Google: Reduce Googlebot crawl rate
  3. Presenta una solicitud de reducción de frecuencia de rastreo a través de Search Console para un problema persistente. Es lenta y solo reduce, nunca aumenta.

Una trampa que evitar: no uses 401, 403 ni 404 para limitar la frecuencia de rastreo. Según la guía de códigos de estado HTTP de Google, “the 4xx status codes, except 429, have no effect on crawl rate,” (traducción) «los códigos de estado 4xx, excepto 429, no tienen efecto sobre la frecuencia de rastreo», y no deberías “use 401 and 403 status codes for limiting the crawl rate.” (traducción) «usar los códigos de estado 401 y 403 para limitar la frecuencia de rastreo».

Esta es también la razón por la que, en mi guía de frecuencia de rastreo, trato la directiva crawl-delay como lo que no conviene usar para Google — consulta ese artículo para ver el manual completo de aceleración / desaceleración.

Bing documenta un rango de 1 a 20 segundos

Guía actual de Bing Webmaster documenta valores de la directiva crawl-delay de 1–20 segundos. Eso no convierte este campo en un estándar portable: Google lo ignora y cualquier otro rastreador necesita su propia confirmación documentada.

Yandex dejó de admitirla en 2018

Yandex antes respetaba la directiva crawl-delay como un número mínimo literal de segundos entre solicitudes — esa es la versión del dato que aún verás repetida en la mayoría de los blogs de SEO. Está desactualizada. La documentación actual del propio Yandex es explícita: Evidence for this claim Yandex stopped honoring the Crawl-delay directive on February 22, 2018, and now recommends setting crawl rate inside Yandex Webmaster instead. Scope: Yandex's crawler only; does not apply to Google, Bing, or other crawlers. Confidence: high · Verified: Yandex Webmaster: The Crawl-delay directive

  • “From February 22, 2018, Yandex doesn’t take into account the Crawl-delay directive.” (traducción) «Desde el 22 de febrero de 2018, Yandex no tiene en cuenta la directiva Crawl-delay.» Para configurar la rapidez con la que los bots de Yandex rastrean tu sitio ahora, usa la configuración de frecuencia de rastreo dentro de Yandex Webmaster directamente — no robots.txt. Así que, hasta hoy, la tabla de puntuación honesta es: Bing respeta la directiva crawl-delay dentro de su rango documentado, Google nunca lo hizo y Yandex lo hacía, pero dejó de hacerlo en 2018.

Otros rastreadores: herramientas de SEO y bots de IA

Muchos rastreadores que no son de motores de búsqueda y se comportan correctamente respetan la directiva crawl-delay como una cortesía:

  • Tanto AhrefsBot como el bot de Semrush lo respetan.
  • Los rastreadores de IA son un público más reciente. El ClaudeBot de Anthropic está documentado como compatible con la directiva crawl-delay no estándar. Otros (GPTBot, Perplexity) deberían verificarse con su propia documentación publicada en lugar de asumirse.

El patrón: los rastreadores más pequeños, orientados al cumplimiento o con mentalidad de cortesía tienden a respetar la directiva crawl-delay; los principales motores de búsqueda han pasado en gran medida a señales internas (Google) o a herramientas manuales más completas (Bing). Y nada de esto obliga a los verdaderos actores malintencionados: los scrapers que ignoran por completo robots.txt también ignorarán tu directiva crawl-delay.

El caso de uso que queda

¿Entonces la directiva crawl-delay está muerta? No exactamente. Es inútil para Google, redundante en el mejor de los casos para Bing (usa Crawl Control), pero en realidad es la forma más sencilla de pedir a la amplia franja intermedia —herramientas de SEO, bots de IA y otros rastreadores menores que la respetan— que reduzcan el ritmo. Si el bot de una herramienta específica está sobrecargando tu servidor, un grupo User-agent: específico con una directiva crawl-delay es una primera medida razonable:

User-agent: SomeBot
Crawl-delay: 10

Solo recuerda que es una solicitud, no una garantía, y que se aplica por host y por grupo de agente de usuario (user-agent), como todo lo demás en robots.txt. Para obtener una visión más amplia de la eficiencia —lo que realmente te cuestan los bots y quién necesita prestar atención—, consulta crawl-budget.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.