تأخير الزحف

توجيه crawl-delay في robots.txt — ما الذي يفعله، ولماذا توقفت Google عن احترامه في 2019 وأسقطته Yandex في 2018، وكيف تفسر Bing القيمة، وما الزواحف الأخرى التي تحترمه، وما الذي تستخدمه بدلًا منه.

نُشر أول مرة: 27 يونيو 2026 · آخر تحديث: 22 أغسطس 2026 · Advanced
اللغات
دليل واحد في هذه الصفحة

crawl-delay توجيه غير قياسي في robots.txt يطلب من الزواحف الانتظار بين عمليات الجلب لتخفيف حمل الخادم. تجاهلته Google منذ 1 سبتمبر 2019؛ ولإبطاء Googlebot استخدم استجابات 429/503 المؤقتة أو أصلح سعة الخادم. توثق إرشادات Bing الحالية قيمًا من 1 إلى 20 ثانية. أسقطت Yandex دعمه في 22 فبراير 2018 وتستخدم الآن إعدادًا لمعدل الزحف داخل Yandex Webmaster. تحقق من وثائق كل زاحف قبل الاعتماد على هذا الحقل غير القياسي.

الخلاصة — كان Crawl-delay توجيهًا غير رسمي في robots.txt لخنق الروبوتات، ولم يكن قط جزءًا من المعيار الرسمي (RFC 9309). أوقفت Google العمل به في 1 سبتمبر 2019 ولا تعالجه صراحة؛ ولإبطاء Googlebot استخدم 429/503 (ليوم أو يومين كحد أقصى) أو أصلح الخادم، لا crawl-delay. توثق إرشادات Bing الحالية قيمًا من 1 إلى 20 ثانية. وأسقطت Yandex دعمه في 22 فبراير 2018، ولذلك لا تحترمه أيضًا؛ وتستخدم الآن إعدادًا لمعدل الزحف داخل Yandex Webmaster. وتحترمه كذلك زواحف SEO كثيرة (AhrefsBot وSemrush) وبعض روبوتات الذكاء الاصطناعي (ClaudeBot). وهذه هي حالة الاستخدام الحقيقية الوحيدة المتبقية: التحكم في الروبوتات غير التابعة لـGoogle وBing وYandex.

Evidence for this claim Google does not support or process the non-standard crawl-delay robots.txt field. Scope: Google crawlers; other crawlers may support the field. Confidence: high · Verified: Google: robots.txt specifications

لماذا يوجد هذا التوجيه؟

Crawl-delay أداة خنق. والفكرة واضحة: يمكن لزاحف عدواني يجلب الصفحات واحدة تلو الأخرى أن يفرض حملًا حقيقيًا على الخادم، ولا سيما إذا كان صغيرًا أو بطيئًا. كان Crawl-delay وسيلة للمجاملة؛ أي طريقة تطلب بها من الروبوت التوقف بضع ثوانٍ بين الطلبات كي يتمكن خادمك من مواكبتها. يوجد في robots.txt داخل مجموعة User-agent، في الموضع نفسه الذي توجد فيه سطور disallow وallow. (للاطلاع على الملف كاملًا، راجع robots-txt.)

لكن المشكلة أنه لم يُوحَّد قط. أُضفي الطابع الرسمي أخيرًا على بروتوكول استبعاد الروبوتات في RFC 9309 عام 2022، ولا يتضمن crawl-delay. فقد كان دائمًا امتدادًا غير رسمي تختار الزواحف المختلفة تطبيقه أو عدم تطبيقه، وتفسره كل منها بطريقتها. وهذا التباين هو بالضبط سبب تخلّي Google عنه.

أوقفت Google التوجيه في 1 سبتمبر 2019

في 2 يوليو 2019، نشر Gary Illyes مقال ملاحظة حول القواعد غير المدعومة في robots.txt على Google Search Central. كانت Google تفتح مصدر محلل robots.txt الخاص بها، وكجزء من ذلك أوقفت كل الشفرة التي تتعامل مع قواعد لم تكن قط جزءًا من مسودة الإنترنت، وتحديدًا noindex وnofollow وcrawl-delay. ودخل الإيقاف حيز التنفيذ في 1 سبتمبر 2019.

كان منطق Google أن هذه القواعد غير موثقة وغير رسمية، وأن الزواحف تفسرها بصورة غير متسقة، مما خلق التباسًا. وأصبحت وثائق robots.txt الحالية صريحة: تدعم Google أربعة حقول (user-agent وallow وdisallow وsitemap)، وتقول الوثائق إن “other fields such as crawl-delay aren’t supported.” (ترجمة) «الحقول الأخرى مثل crawl-delay غير مدعومة». وتكرر صفحة خرافات وحقائق حول الزحف ذلك: “The non-standard ‘crawl-delay’ robots.txt rule is not processed by Google’s crawlers.” (ترجمة) «قاعدة robots.txt غير القياسية crawl-delay لا تعالجها زواحف Google». Evidence for this claim Google does not support or process the non-standard crawl-delay robots.txt field. Scope: Google crawlers; other crawlers may support the field. Confidence: high · Verified: Google: robots.txt specifications

ويجدر توضيح النطاق: تتجاهله Google بصرف النظر عن مجموعة user-agent التي تضعه فيها. فكتلة User-agent: Googlebot التي تتضمن سطر Crawl-delay تُتجاهل تمامًا مثل سطر موجود تحت User-agent: *.

ما الذي تستخدمه بدلًا منه؟

أصبح معدل زحف Google آليًا بالكامل الآن، ويُضبط وفق صحة خادمك. كما أزيل شريط ضبط معدل الزحف اليدوي في 8 يناير 2024 من Search Console (بعد الإعلان عن ذلك في نوفمبر السابق). لذلك عندما تحتاج حقًا إلى أن يتراجع Googlebot، فلديك ثلاث وسائل:

  1. أصلح الخادم. هذا هو الحل الحقيقي. فإذا كان خادمك يتحمل الحمل، فلن تحتاج إلى خنق أي شيء.
  2. أعد 429 أو 500 أو 503 في حالات الطوارئ. تقول وثائق Google حول تقليل معدل زحف Googlebot إن عليك “return 500, 503, or 429 HTTP response status code instead of 200 to the crawl requests.” (ترجمة) «أعِد رمز حالة استجابة HTTP بقيمة 500 أو 503 أو 429 بدلًا من 200 لطلبات الزحف». ويفهم Googlebot ذلك بوصفه طلبًا بالإبطاء بصورة شبه فورية. والقاعدة الصارمة هي: “We don’t recommend that you do this for a long period of time (meaning, longer than 1-2 days).” (ترجمة) «لا نوصي بفعل ذلك مدة طويلة (أي أكثر من يوم أو يومين)». فاستمرار 5xx يعرّض الصفحات للإسقاط (وقد يوقف Google Ads). Evidence for this claim Google recommends temporarily returning 500, 503, or 429 to reduce crawl rate and warns against doing so for longer than one or two days. Scope: Temporary Googlebot overload response, not routine crawl management. Confidence: high · Verified: Google: Reduce Googlebot crawl rate
  3. قدّم طلبًا لتقليل معدل الزحف عبر Search Console إذا كانت المشكلة مستمرة. فهو بطيء، ولا يمكنه إلا خفض المعدل، لا رفعه.

هناك فخ يجب تجنبه: لا تستخدم 401 أو 403 أو 404 للخنق. فوفق دليل رموز حالة HTTP من Google، “the 4xx status codes, except 429, have no effect on crawl rate,” (ترجمة) «رموز الحالة 4xx، باستثناء 429، لا تؤثر في معدل الزحف»، كما يجب ألا “use 401 and 403 status codes for limiting the crawl rate.” (ترجمة) «لا تستخدم رمزي الحالة 401 و403 للحد من معدل الزحف».

ولهذا أيضًا أتعامل في دليل معدل الزحف مع crawl-delay بوصفه الشيء الذي لا ينبغي استخدامه مع Google — راجع المقالة لخطة تسريع أو إبطاء الزحف كاملة.

Bing: من 1 إلى 20 ثانية

توثق إرشادات Bing Webmaster الحالية قيم crawl-delay من 1 إلى 20 ثانية. ولا يجعل ذلك الحقل معيارًا قابلًا للنقل: فـGoogle تتجاهله، وكل زاحف آخر يحتاج إلى تأكيد موثق خاص به.

أسقطت Yandex التوجيه في 2018

كانت Yandex تحترم crawl-delay بوصفه حدًا أدنى حرفيًا لعدد الثواني بين الطلبات، وهذه هي المعلومة التي ما زلت تراها مكررة في معظم مدونات SEO، لكنها قديمة. فوثائق Yandex الحالية صريحة: “From February 22, 2018, Yandex doesn’t take into account the Crawl-delay directive.” (ترجمة) «منذ 22 فبراير 2018، لا تأخذ Yandex توجيه Crawl-delay في الحسبان». Evidence for this claim Yandex stopped honoring the Crawl-delay directive on February 22, 2018, and now recommends setting crawl rate inside Yandex Webmaster instead. Scope: Yandex's crawler only; does not apply to Google, Bing, or other crawlers. Confidence: high · Verified: Yandex Webmaster: The Crawl-delay directive ولتحديد سرعة زحف روبوتات Yandex لموقعك الآن، استخدم إعداد معدل الزحف داخل Yandex Webmaster مباشرة، لا robots.txt. لذلك فالتقييم الدقيق اليوم هو: تحترم Bing crawl-delay ضمن نطاقها الموثق، ولم تدعمه Google رسميًا قط ثم أوقفت معالجته، وكانت Yandex تحترمه لكنها توقفت في 2018.

الزواحف الأخرى: أدوات SEO وروبوتات الذكاء الاصطناعي

تحترم زواحف كثيرة حسنة السلوك وغير تابعة لمحركات البحث crawl-delay على سبيل المجاملة:

  • يحترمه كل من AhrefsBot وروبوت Semrush.
  • تمثل زواحف الذكاء الاصطناعي جمهورًا أحدث. وتوثق Anthropic دعم ClaudeBot لتوجيه crawl-delay غير القياسي. أما الروبوتات الأخرى (GPTBot وPerplexity)، فيجب الرجوع إلى وثائقها المنشورة بدل افتراض دعمها.

النمط هو أن الزواحف الأصغر أو التي تركز على الامتثال والمجاملة تميل إلى احترام crawl-delay، بينما انتقلت محركات البحث الكبرى غالبًا إلى الإشارات الداخلية (Google) أو الأدوات اليدوية الأغنى (Bing). ولا يُلزم أي من ذلك الجهات السيئة؛ فأدوات الاستخراج التي تتجاهل robots.txt تمامًا ستتجاهل crawl-delay أيضًا.

ما حالة الاستخدام المتبقية؟

هل مات crawl-delay إذن؟ ليس تمامًا. فهو عديم الفائدة مع Google، وزائد عن الحاجة في أفضل الأحوال مع Bing (استخدم Crawl Control)، لكنه أبسط طريقة فعلًا لطلب الإبطاء من الفئة الوسطى الواسعة: أدوات SEO وروبوتات الذكاء الاصطناعي والزواحف الأصغر التي تحترمه. إذا كان روبوت أداة بعينها يرهق خادمك، فمجموعة User-agent: مستهدفة تتضمن crawl-delay خطوة أولى معقولة:

User-agent: SomeBot
Crawl-delay: 10

تذكر فقط أنه طلب لا ضمان، وأن نطاقه يتحدد بحسب المضيف ومجموعة user-agent مثل كل شيء آخر في robots.txt. وللصورة الأشمل عن الكفاءة، وما تكلفه الروبوتات فعليًا ومن يحتاج إلى الاهتمام، راجع crawl-budget.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.