Délai d’exploration

Fonctionnement de la directive crawl-delay dans robots.txt, abandon par Google et Yandex, prise en charge par Bing et solutions adaptées pour ralentir les robots.

Première publication : 27 juin 2026 · Dernière mise à jour : 11 août 2026 · Advanced
Langues
1 indice probant sur cette page

Crawl-delay est une directive robots.txt non standard qui demande aux robots d’attendre entre leurs requêtes. Google l’ignore depuis le 1er septembre 2019 ; pour ralentir Googlebot, corrigez le serveur ou renvoyez temporairement 429 ou 503. Bing documente des valeurs de 1 à 20 secondes. Yandex a abandonné la directive le 22 février 2018 et utilise un réglage dans Yandex Webmaster. Vérifiez toujours la documentation propre à chaque robot avant d’utiliser cette extension.

En bref — Crawl-delay était une directive robots.txt non officielle destinée à ralentir les robots ; elle n’a jamais appartenu à la norme RFC 9309. Google l’a retirée le 1er septembre 2019 et ne la traite pas : ralentissez Googlebot avec 429/503 pendant un ou deux jours au maximum ou corrigez le serveur. Bing documente actuellement des valeurs de 1 à 20 secondes. Yandex a cessé de la prendre en charge le 22 février 2018 et utilise désormais un réglage dans Yandex Webmaster. Plusieurs robots SEO et d’IA, dont AhrefsBot, Semrush et ClaudeBot, la respectent encore : son usage restant concerne surtout les robots autres que Google, Bing et Yandex.

Evidence for this claim Google does not support or process the non-standard crawl-delay robots.txt field. Scope: Google crawlers; other crawlers may support the field. Confidence: high · Verified: Google: robots.txt specifications

Pourquoi crawl-delay existe

Crawl-delay est un limiteur : un robot agressif qui enchaîne les pages peut charger fortement un petit serveur. La directive permettait de demander une pause entre les requêtes. Elle se place dans un groupe User-agent: de robots.txt, à côté de disallow et allow.

Cette extension n’a jamais été normalisée. Le protocole d’exclusion des robots a été formalisé en 2022 par la RFC 9309, sans crawl-delay. Chaque robot pouvait donc l’interpréter ou l’ignorer, incohérence qui a conduit Google à l’abandonner.

Google l’a retirée le 1er septembre 2019

Le 2 juillet 2019, Gary Illyes publie une note sur les règles non prises en charge dans robots.txt. En ouvrant le code de son analyseur, Google retire les règles absentes du projet de norme : noindex, nofollow et crawl-delay. La suppression prend effet le 1er septembre 2019.

Ces règles non documentées étaient interprétées différemment selon les robots. La documentation actuelle limite Google à quatre champs : user-agent, allow, disallow et sitemap. Elle précise : “other fields such as crawl-delay aren’t supported.” (traduction) « les autres champs, tels que crawl-delay, ne sont pas pris en charge ». La page Mythes et réalités de l’exploration confirme : “The non-standard ‘crawl-delay’ robots.txt rule is not processed by Google’s crawlers.” (traduction) « La règle non standard crawl-delay n’est pas traitée par les robots de Google. » Evidence for this claim Google does not support or process the non-standard crawl-delay robots.txt field. Scope: Google crawlers; other crawlers may support the field. Confidence: high · Verified: Google: robots.txt specifications

La directive est ignorée quel que soit le groupe d’agent utilisateur : sous User-agent: Googlebot comme sous User-agent: *.

Qu’utiliser à la place pour Google

La cadence de Google est désormais automatique et adaptée à la santé du serveur. L’ancien curseur manuel de Search Console a été retiré le 8 janvier 2024. Trois leviers subsistent :

  1. Corriger le serveur, solution réelle et durable.
  2. Renvoyer 429, 500 ou 503 en urgence. La documentation Réduire la fréquence d’exploration demande de “return 500, 503, or 429 HTTP response status code instead of 200 to the crawl requests.” (traduction) « renvoyer 500, 503 ou 429 plutôt que 200 aux requêtes ». Google ajoute : “We don’t recommend that you do this for a long period of time (meaning, longer than 1-2 days).” (traduction) « Nous déconseillons de le faire plus d’un ou deux jours ». Des 5xx prolongés risquent de désindexer des pages. Evidence for this claim Google recommends temporarily returning 500, 503, or 429 to reduce crawl rate and warns against doing so for longer than one or two days. Scope: Temporary Googlebot overload response, not routine crawl management. Confidence: high · Verified: Google: Reduce Googlebot crawl rate
  3. Envoyer une demande de réduction dans Search Console pour un problème persistant. Elle est lente et ne peut qu’abaisser la cadence.

N’utilisez pas 401, 403 ou 404. Selon le guide des statuts HTTP, “the 4xx status codes, except 429, have no effect on crawl rate,” (traduction) « les statuts 4xx, sauf 429, n’affectent pas la cadence », et 401 ou 403 ne doivent pas servir à la limiter.

C’est pourquoi mon guide sur la fréquence d’exploration présente crawl-delay comme la méthode à ne pas employer pour Google.

Bing documente une plage de 1 à 20 secondes

La documentation Bing actuelle indique des valeurs de 1 à 20 secondes. Cette règle reste propre à Bing et ne constitue pas une norme portable.

Yandex l’a abandonnée en 2018

Yandex interprétait autrefois la valeur comme un nombre minimal de secondes. Son aide actuelle indique exactement : “From February 22, 2018, Yandex doesn’t take into account the Crawl-delay directive.” (traduction) « Depuis le 22 février 2018, Yandex ne tient plus compte de Crawl-delay. » Evidence for this claim Yandex stopped honoring the Crawl-delay directive on February 22, 2018, and now recommends setting crawl rate inside Yandex Webmaster instead. Scope: Yandex's crawler only; does not apply to Google, Bing, or other crawlers. Confidence: high · Verified: Yandex Webmaster: The Crawl-delay directive La cadence se règle désormais dans Yandex Webmaster, pas dans robots.txt. Bing respecte encore la directive, Google ne l’a jamais prise en charge et Yandex l’a abandonnée.

Autres robots : outils SEO et IA

De nombreux robots bien conçus respectent encore cette demande :

  • AhrefsBot et le robot de Semrush la prennent en charge.
  • Parmi les robots d’IA, ClaudeBot d’Anthropic documente cette extension. Vérifiez GPTBot et Perplexity dans leurs propres documents au lieu de supposer leur comportement.

Les robots plus petits ou attentifs à la conformité la respectent davantage ; les grands moteurs utilisent leurs signaux internes ou des outils manuels. Les scrapers qui ignorent robots.txt ignoreront aussi crawl-delay.

Le cas d’usage restant

La directive est inutile pour Google et secondaire pour Bing, mais reste un moyen simple de demander aux outils SEO, robots d’IA et autres robots mineurs de ralentir. Pour un robot précis, utilisez un groupe ciblé :

User-agent: SomeBot
Crawl-delay: 10

N’oubliez pas qu’il s’agit d’une demande et non d’une garantie, limitée à l’hôte et au groupe User-agent. Pour évaluer le coût réel des robots, consultez crawl-budget.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.