تقرير إحصاءات الزحف

كيفية قراءة تقرير إحصاءات الزحف في Google Search Console — إجمالي الطلبات وحجم التنزيل ووقت الاستجابة والتقسيمات حسب الاستجابة ونوع الملف ونوع Googlebot والغرض.

نُشر أول مرة: 23 يونيو 2026 · آخر تحديث: 11 أغسطس 2026 · Advanced
اللغات

يعرض تقرير إحصاءات الزحف (Search Console ← Settings ← Crawl stats) كيفية زحف Google إلى موقعك خلال آخر 90 يومًا: إجمالي طلبات الزحف، وإجمالي حجم التنزيل، ومتوسط وقت الاستجابة، إلى جانب التقسيمات حسب رمز الاستجابة ونوع الملف ونوع Googlebot والغرض (Discovery مقابل Refresh). ولا يتاح إلا للخصائص على مستوى الجذر — خاصية نطاق أو خاصية بادئة URL مثبتة عند جذر الموقع — لا خصائص المجلدات الفرعية. وبالنسبة إلى معظم المواقع، ليس لوحة لتحسين ميزانية الزحف، بل نظام إنذار مبكر لسلامة الخادم. تؤدي زيادة أوقات الاستجابة أو أخطاء 5xx إلى تراجع Google، ويمكن أن يوقف استمرار تعذر robots.txt الزحف مؤقتًا. وهو أقرب ما تقدمه GSC إلى بيانات السجلات، لكنه يغطي زواحف Google وحدها ولا يضمن اشتماله على كل طلب.

الخلاصة — يعرض Crawl Stats (Settings ← Crawl stats، للخصائص على مستوى الجذر فقط — Domain أو بادئة URL عند الجذر) إجمالي طلبات الزحف وإجمالي حجم التنزيل ومتوسط وقت الاستجابة خلال نحو 90 يومًا، إلى جانب التقسيمات حسب الاستجابة ونوع الملف ونوع Googlebot والغرض (Discovery مقابل Refresh). اقرأه كمراقب لسلامة الخادم، لا لوحة تفاخر بميزانية الزحف: ارتفاع وقت الاستجابة أو أخطاء 5xx يدفع Google إلى تقليل سعة الزحف، ويمكن لفشل robots.txt المستمر إيقاف الزحف مؤقتًا. إنه أقرب ما تقدمه GSC إلى بيانات السجلات، لكنه يغطي زواحف Google وحدها ولا يضمن اكتمال كل الطلبات — ولجميع الروبوتات والمستخدمين والسجل الكامل، ما زلت تحتاج إلى سجلات الخادم. تقصر Google إرشادات ميزانية الزحف على المواقع الكبيرة كثيرة التغيير؛ وفي خبرتي، نادرًا ما تهم معظم المواقع الأصغر.

Evidence for this claim The Crawl Stats report shows Googlebot request totals, download size, response time, host status, and request breakdowns. Scope: Current Search Console Crawl Stats report. Confidence: high · Verified: Google Search Console: Crawl Stats report Evidence for this claim Google says crawl-budget management is mainly relevant to very large or rapidly changing sites; most sites can rely on normal crawling. Scope: Google's current crawl-budget guidance. Confidence: high · Verified: Google Search Central: Crawl budget management

ماهيته ومكانه

صياغة Google مباشرة: “The Crawl Stats report shows you statistics about Google’s crawling history on your website.” (ترجمة) «يعرض لك تقرير إحصاءات الزحف إحصاءات عن سجل زحف Google إلى موقعك الإلكتروني». تصل إليه ضمن Settings ← Crawl stats — لا من الشريط الجانبي الرئيسي للتقارير، وهذا يربك كثيرين.

أكبر سبب منفرد لاعتقاد الناس أن التقرير «مفقود» أو «معطل» هو أن Google تعرضه فقط للخصائص على مستوى الجذر. وبتعبيرها: “This report is available only for root-level properties.” (ترجمة) «هذا التقرير متاح فقط للخصائص على مستوى الجذر». يشمل ذلك خاصية Domain وخاصية بادئة URL المثبتة عند جذر الموقع (مثل https:// example.com)؛ ولا يقتصر على خصائص Domain الخالية من البروتوكول. إذا أثبتَّ خاصية بادئة URL محددة بمجلد أو مسار فرعي، فأعد إثباتها عند مستوى الجذر وسيظهر التقرير. لا مشكلة في موقعك.

Evidence for this claim Crawl Stats is available for root-level properties, including a Domain property or a URL-prefix property at a host root; saying it requires a Domain property or a property without a protocol is too narrow. Scope: root-level properties Confidence: high · Verified: Crawl Stats report

هل ينبغي أن تهتم؟ إعادة تأطير ميزانية الزحف

لا تحتاج معظم المواقع إلى تحسين ميزانية الزحف، والقيمة الحقيقية للتقرير هي مراقبة السلامة لا ضبط الميزانية. تقصر Google إرشاداتها على المواقع الكبيرة (أكثر من مليون صفحة فريدة) والمواقع المتوسطة أو الأكبر (أكثر من 10k صفحة تتغير يوميًا). ودون ذلك، فهذا أداة تشخيص لا مشروعًا.

وتصف Google التقرير نفسه بأنه مصمم للمستخدمين المتقدمين، وتقول إن المواقع التي تقل عن نحو 1 000 صفحة لا تحتاج عمومًا إلى الخوض في هذا المستوى من التفاصيل — وهو حد أصغر من إرشادات ميزانية الزحف أعلاه. أما قاعدتي العملية فأوسع: بالنسبة إلى معظم المواقع دون نحو 10 000 صفحة، لن أقضي وقتًا طويلًا في ميزانية الزحف. تعامل مع ذلك بوصفه حكمًا مهنيًا لا حدًا رسميًا.

يتحكم في معدل الزحف أمران يعملان معًا — حد سعة الزحف وطلب الزحف. السعة هي ما يستطيع خادمك تحمله. وتعرّف Google حد السعة بأنه “The maximum number of simultaneous parallel connections that Google can use to crawl a site, as well as the time delay between fetches.” (ترجمة) «الحد الأقصى لعدد الاتصالات المتوازية المتزامنة التي يمكن أن تستخدمها Google للزحف إلى موقع، إضافة إلى التأخير الزمني بين عمليات الجلب». أما الطلب فهو مقدار ما تريد Google زحفه، وتدفعه عوامل مثل الشعبية والتقادم. ويظهر أثر الاثنين في التقرير. (المزيد عن المفهوم في ميزانية الزحف.)

هناك تفاصيل نطاق تستحق معرفتها قبل قراءة الأرقام: يعد التقرير عنوان URL الفعلي الذي طلبه Googlebot بدل العنوان الأساسي الذي يصل إليه، ويعد الطلبات المكررة وكل قفزة إعادة توجيه على الخادم على حدة (أما عمليات إعادة التوجيه من جهة العميل فلا تُعد هنا كاستجابات إعادة توجيه). وهو محدد بالخاصية أو المضيف الذي تعرضه — وقد يقل أو يزيد تمثيل الموارد على نطاقات أخرى، وأحيانًا النطاقات النظيرة أو الفرعية، بحسب نوع الخاصية. ووفق وثائق Google نفسها، يعكس التقرير معظم طلبات الزحف لكنه قد يحذف بعضها، لذلك فإن اختلافًا صغيرًا عن سجلات خادمك متوقع وليس خللًا.

هذا أقرب ما تقدمه Search Console إلى بيانات ملفات السجل — لكنه خاص بزواحف Google ومجمّع وغير مضمون الاكتمال لكل طلب. إذا أردت زيارات جميع الروبوتات والمستخدمين، أو سجلًا كاملًا مضمونًا، فأنت تحتاج إلى سجلات الخادم. تعامل مع Crawl Stats بوصفه النظرة المجانية الأولى قبل الاستثمار في تحليل السجلات.

المقاييس الثلاثة الرئيسية

اقرأها كاتجاهات لا أهداف:

  • إجمالي طلبات الزحف“The total number of crawl requests issued for URLs on your site, whether successful or not.” (ترجمة) «إجمالي عدد طلبات الزحف المرسلة لعناوين URL على موقعك، سواء نجحت أم لا». يُعد كل طلب، بما فيه الطلبات التي أخفقت.
  • إجمالي حجم التنزيل“Total number of bytes downloaded from your site during crawling, for the specified time period.” (ترجمة) «إجمالي عدد وحدات البايت المنزّلة من موقعك أثناء الزحف خلال الفترة الزمنية المحددة».
  • متوسط وقت الاستجابة“Average response time for all resources fetched from your site during the specified time period.” (ترجمة) «متوسط وقت الاستجابة لجميع الموارد التي جُلبت من موقعك خلال الفترة الزمنية المحددة». وهو في الواقع مؤشر لسلامة الخادم. الارتفاع المستمر إنذار أداء، وقد تستجيب Google بخفض حد سعة الزحف — لذا يكون ضرر SEO غير مباشر (زحف أقل وأبطأ)، ومنفصلًا عن أي عامل ترتيب متعلق بسرعة الصفحة.

التقسيم: حسب الاستجابة

يعرض هذا الجدول، بتعبير Google، “the responses that Google received when crawling your site, grouped by response type, as a percentage of all crawl responses.” (ترجمة) «الاستجابات التي تلقتها Google عند الزحف إلى موقعك، مجمعة حسب نوع الاستجابة كنسبة من جميع استجابات الزحف». وتشمل الأنواع OK (200)، وMoved permanently (301)، وMoved temporarily (302)، وNot found (404)، وServer error (5XX)، وrobots.txt not available.

هكذا أقرأ كل نمط:

  • ينبغي أن تمثل 200 الغالبية الكبرى. لا تنشر Google نسبة مستهدفة محددة، لذا قارن ذلك بخط أساس موقعك وراقب التحولات المستمرة بدل مطاردة رقم دقيق.
  • كثرة 404 ليست قاتلة لكنها تشير إلى هدر الزحف — أي إنفاق Google طلبات على عناوين URL غير موجودة.
  • كثرة 301 تشير إلى سلاسل إعادة توجيه أو روابط داخلية لا تزال تشير إلى عناوين قديمة. أصلح الروابط لتشير إلى الوجهة النهائية.
  • ارتفاع 5xx هو النمط الأشد ضررًا في التقرير. يخفق خادمك تحت حمل الزحف، فينخفض حد السعة ويقل الزحف. ويمكن لاستمرار 5xx أن يخنق زحف Google بشدة.
  • ينبغي ألا تظهر robots.txt not available بصورة مستمرة وذات دلالة. لا تنشر Google نسبة مستهدفة ثابتة، لكن الحصة المستمرة تعني أنها عجزت دوريًا عن جلب robots.txt. وهذا مهم لأن استمرار التعذر يجعل Google توقف الزحف مؤقتًا بحذر بدل التخمين. (لمعرفة ما يتحكم فيه robots.txt وما لا يتحكم فيه، راجع robots.txt.)

التقسيم: حسب نوع الملف

تجمع Google الزحف حسب نوع الملف — HTML والصور وJavaScript وCSS وJSON وPDF وغيرها. هذه قرينة تشخيصية لا دليل على الهدر وحدها؛ فالمقدار الطبيعي من زحف JS أو CSS أو الصور أو JSON يعتمد على بناء موقعك (يحتاج التطبيق الثقيل بـJS بصورة مشروعة إلى زحف موارد أكثر من موقع HTML ثابت). تستحق حصة JS/CSS/الصور المرتفعة مقارنة بخط أساسك، أو التي تقفز فجأة، التحقيق فيها باعتبارها عبئًا محتملًا لموارد التصيير. وقد تكشف أنواع الملفات غير المتوقعة مصيدة زحف — فضاء لا نهائي أو شبه لا نهائي من عناوين URL يولّد صفحات عديمة القيمة.

التقسيم: حسب نوع Googlebot

يقسم هذا الزحف بحسب Googlebot الذي نفذ الجلب — smartphone وdesktop والصور والفيديو وتحميل موارد الصفحة وAdsBot. لا توثق Google مزيجًا مطلوبًا، لكن في زحف mobile-first يتصدر Smartphone عادةً لدى معظم المواقع. والملف الذي يهيمن عليه desktop أو الحجم غير المتوقع من Image أو AdsBot قرينة تستحق التحقيق لا مخالفة في ذاتها — فقد يعني أن Google لا تعامل موقعك باعتباره mobile-first، أو أن زحف الإعلانات أو الصور يستهلك من الميزانية التي تفضل إنفاقها على المحتوى، أو ببساطة أن لموقعك احتياجات موارد غير معتادة.

التقسيم: حسب الغرض — Discovery مقابل Refresh

فئتان تعرفهما Google من سجل الزحف السابق وحده — ولا تخبرك التسميتان وحدهما إن كان المزيج سليمًا:

  • Discovery“The URL requested was never crawled by Google before.” (ترجمة) «لم تزحف Google من قبل إلى عنوان URL المطلوب».
  • Refresh“A recrawl of a known page.” (ترجمة) «إعادة زحف إلى صفحة معروفة».

ارتفاع Discovery متوقع أثناء إطلاق أو ترحيل (تعثر Google على عناوينك الجديدة)؛ لكن الارتفاع نفسه مشكلة إن كان مصدره فضاء لا نهائي أو عناوين ذات معلمات — فهذه ميزانية زحف تُنفق على نفايات. والمزيج الثقيل بـRefresh طبيعي لموقع راسخ لا ينشر كثيرًا من المحتوى الجديد. قارن أيًا منهما بخط أساسك وما تعرف أنه تغير، لا بنسبة «سليمة» ثابتة.

Host status — الكتلة الأكثر قابلية للتنفيذ

يلخص Host status ما إذا واجهت Google مشكلات توافر عند محاولة الزحف إليك، ضمن ثلاثة فحوص فرعية: جلب robots.txt وحل DNS والاتصال بالخادم. حالة المضيف الحمراء من أكثر الإشارات قابلية للتنفيذ — وهي تعني عادة أن Google حُجبت أو جرى تقييدها على مستوى البنية التحتية قبل الوصول إلى المحتوى خلال تلك النافذة. لكنها تنبيه مجمّع، وليست دليلًا على تأثر كل عنوان URL أو استمرار المشكلة الآن — افحص الخط الزمني وأكد الحالة الحالية (جلب مباشر أو URL Inspection أو سجلاتك) قبل اعتبارها محلولة. ومع ذلك، اجعل الحالة الحمراء أول ما تتحقق منه. (لها معالجة مستقلة ضمن Host status.)

قراءة الارتفاعات والانخفاضات

الآلية التي ينبغي استيعابها: ينعكس سلوك خادمك على مقدار زحف Google. إذا استجاب الموقع بسرعة وموثوقية، يمكن أن يرتفع حد السعة؛ وإذا تباطأ أو بدأ يعيد أخطاء خادم، ينخفض الحد. لذلك:

  • ارتفاع وقت الاستجابة ← قد ينخفض حد السعة ← يقل الزحف.
  • اندفاع 5xx ← ينخفض حد السعة ← يقل الزحف؛ وإذا استمر يمكن أن يخنقك بشدة.
  • تعذر robots.txt ← إذا استمر التعذر، توقف Google الزحف مؤقتًا بحذر.

لا يمثل أي من ذلك عقوبة ترتيب. الضرر غير مباشر: إذا لم تُزحف الصفحات وتُفهرس، فلا يمكنها الترتيب أصلًا — لكن الزحف الإضافي لا يرفع الترتيب أيضًا. (راجع مفهوم ميزانية الزحف للنموذج الكامل الذي يجمع السعة والطلب.)

Crawl Stats مقابل سجلات الخادم

Crawl Stats هو أقرب ما تصل إليه GSC من السجلات، لكن الفجوات مهمة:

تقرير Crawl Statsسجلات الخادم
من يغطيهزواحف Google وحدهاجميع الروبوتات وجميع المستخدمين
مستوى التفصيلمجمّع؛ قد يحذف بعض الطلباتكل طلب منفرد
مدة الاحتفاظنحو 90 يومًاما تقرر الاحتفاظ به
تفاصيل كل URLلانعم
التكلفةمجاني في GSCالتخزين + جهد التحليل

إذا تجاوزت احتياجاتك Crawl Stats — احتجت بيانات لكل URL أو روبوتات غير Google أو سجلًا أطول — فقد حان الانتقال إلى تحليل ملفات السجل. يخبرك Crawl Stats بأن شيئًا ما غير سليم؛ وتخبرك السجلات بالمكان الدقيق.

صلته ببقية الزحف

تقرير Crawl Stats هو نافذتك على الزحف بعد وقوعه. أما جانب الفهرسة مما يحدث لاحقًا، فتقرير Page Indexing هو الرفيق — يعرض Crawl Stats ما جلبته Google، ويعرض Page Indexing ما دخل الفهرس. ويمثل Host status الظاهر داخل التقرير إشارة البنية التحتية التي تستحق البدء بها.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.