محظور بواسطة robots.txt (حالة GSC)

ماذا تعني حالة «محظور بواسطة robots.txt» في تقرير فهرسة الصفحات في Google Search Console — عنوان URL مستبعد من الفهرسة لأن robots.txt منع الزحف إليه. غالبًا يكون ذلك مقصودًا. يوضح هذا الدليل الفرق عن «مفهرسة رغم حجبها»، وتعارض noindex مع المنع، وكيف تصلح الحالة إذا كان الحجب خطأ.

نُشر أول مرة: 23 يونيو 2026 · آخر تحديث: 22 أغسطس 2026 · Advanced
اللغات
دليل واحد في هذه الصفحة

تعني حالة «محظور بواسطة robots.txt» في تقرير فهرسة الصفحات في GSC أن Google وجدت العنوان لكنها لم تزحف إليه لأن robots.txt يمنعه، ولذلك لا يكون مفهرسًا في هذه الحالة. تكون الحالة مقصودة وسليمة غالبًا؛ إذ يتحكم robots.txt في الزحف لا الفهرسة، ولذلك ليس المنع أداة لإزالة الفهرسة. وهي شقيقة لتحذير «مفهرسة رغم حجبها بواسطة robots.txt»، الذي يمثل النتيجة المعاكسة: فهرست Google عنوانًا محجوبًا رغم ذلك، غالبًا عبر الروابط. والمأزق الأكبر هو تعارض noindex مع المنع: لا تستطيع Google الزحف إلى صفحة ممنوعة، فلا ترى noindex. لإزالة صفحة، اسمح بالزحف وقدّم noindex. لا «تصلح» هذه الحالة إلا إذا حجبت شيئًا كنت تريد فهرسته فعلًا.

TL;DR — «محظور بواسطة robots.txt» هو استبعاد في فهرسة الصفحات: اكتشفت Google العنوان لكنها لم تزحف إليه لأن robots.txt يمنعه، ولذلك لا يكون مفهرسًا في هذه الحالة. يكون ذلك مقصودًا وغير ضار عادةً — إذ يحكم robots.txt الزحف لا الفهرسة، ولذلك لا يمثل المنع أداة لإزالة الفهرسة. لا تخلطه مع تحذير “Indexed, though blocked by robots.txt” (الترجمة العربية) «مفهرسة رغم حجبها بواسطة robots.txt» (فقد فهرست Google العنوان المحجوب رغم ذلك، غالبًا عبر روابط واردة). الخطأ الكلاسيكي هو جمع disallow مع noindex: لا تستطيع Google الزحف إلى الصفحة، فلا ترى noindex، وقد تبقى الصفحة مفهرسة. لإزالة صفحة، اسمح بالزحف وقدّم noindex. اعتبر الحالة خطأً فقط عندما حجبت عنوانًا كنت تريد فهرسته فعلًا.

ماذا يبلّغ التصنيف فعليًا

في تقرير فهرسة الصفحات في Search Console، تمثل حالة «محظور بواسطة robots.txt» حالة مستبعدة، لا خطأ ولا تحذيرًا. وصياغة Google نفسها واضحة: تقول إن الصفحة “was blocked by your site’s robots.txt file,” (الترجمة العربية) «حُجبت بواسطة ملف robots.txt الخاص بموقعك»، وتضيف Google القيد المهم “does not guarantee that the page won’t be indexed through some other means.” (الترجمة العربية) «ولا يضمن ذلك ألا تُفهرس الصفحة بوسيلة أخرى». Evidence for this claim Google reports Blocked by robots.txt when crawling is disallowed and warns that this does not guarantee the URL cannot be indexed by other means. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report يلخص هذا القيد الموضوع كله في سطر واحد — انظر أدناه.

آليًا: تعرف Googlebot أن العنوان موجود (عثرت عليه عبر رابط أو خريطة موقع أو سجل سابق)، وحاولت احترام قواعدك، وواجهت قاعدة Disallow مطابقة، فتوقفت. يعني عدم الجلب عدم وجود محتوى للفهرسة، ولذلك يستقر العنوان في فئة الاستبعاد هذه. هذه هي النتيجة المتوقعة للمنع — ومعظم العناوين هنا يفترض أن تكون هنا.

الزحف ليس فهرسة — لماذا لا يزيل المنع الفهرسة

تصف Google ملف robots.txt بأنه أداة للتحكم في الوصول أثناء الزحف، لا وسيلة موثوقة للإزالة. Evidence for this claim Google says robots.txt manages crawler access and is not a mechanism for keeping a page out of Google. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: robots.txt introduction

هذا هو محور الدقة في الحالة كلها. إن robots.txt أداة للتحكم في الزحف. وتوضح Google أنه “is not a mechanism for keeping a web page out of Google.” (الترجمة العربية) «ليس آلية لإبقاء صفحة ويب خارج Google.» يمنع حجب العنوان جلبه؛ لكنه لا يزيل العنوان من الفهرس، وليس أداة لإزالة الفهرسة.

كما كتبت في مقالي على Ahrefs عن الحالة الشقيقة: “crawling and indexing are two different things.” (الترجمة العربية) «الزحف والفهرسة شيئان مختلفان.» قد ينتهي الأمر بصفحة حجبتها إلى الفهرسة إذا ربطت بها صفحات أخرى — لا تستطيع Google رؤية المحتوى، ولا تستطيع رؤية noindex الذي حاولت وضعه أيضًا. وهذا يقود إلى أكثر الأخطاء شيوعًا عند الوصول إلى هذا التقرير.

«محظور بواسطة robots.txt» مقابل «مفهرسة رغم حجبها بواسطة robots.txt»

يُخلط بين الحالتين باستمرار، مع أنهما السبب نفسه والنتيجة المعاكسة:

محظور بواسطة robots.txtمفهرسة رغم حجبها بواسطة robots.txt
فئة التقريرمستبعدة (غير مفهرسة)تحذير (مفهرسة)
ما الذي حدثعثرت Google على العنوان ولم تزحف إليه، فلا تفهرسهفهرست Google العنوان رغم أنها لم تزحف إليه
السببنجح المنع ولم تُجبر أي إشارة على الفهرسةنجح المنع، لكن الروابط/الإشارات فهرسته رغم ذلك
هل هي مشكلة عادةً؟لا — غالبًا مقصودةيعتمد — غالبًا لا مشكلة في عناوين الخدمات

إذا كنت تنظر إلى نسخة التحذير — عنوان URL محجوب فُهرس رغم ذلك ويظهر كرابط مجرد بلا وصف — فهذه حالة الفهرسة رغم الحجب، ولها معالجة مستقلة. يتناول هذا المقال الاستبعاد البسيط: محجوب، وغير مفهرس.

بالنسبة إلى عناوين الخدمات، لا تكون «الفهرسة رغم ذلك» مدعاة للقلق غالبًا. قال John Mueller لمالك موقع ظهرت لديه عناوين WooCommerce من نوع ?add-to-cart= في حالة الفهرسة رغم الحجب إنك لا تحتاج إلى فهرسة هذه العناوين، وإن حجبها بواسطة robots.txt مناسب، وإن ظهورها «مفهرسة» وهي محجوبة لا يرجح أن يجعلها تظهر في البحث إلا إذا أجرى شخص استعلامًا شديد التحديد عن تلك العناوين — وهو ما لا يفعله المستخدمون الحقيقيون.

تعارض noindex + disallow (الإصلاح الأول الذي ينقلب عليك)

هذه هي الحيلة الخادعة. يريد شخص اختفاء صفحة، فيضع لها Disallow في robots.txt ويضيف وسم noindex — حزامًا وحمالتين. لا ينجح ذلك، لأن التوجيهين يناقضان بعضهما.

تذكر Google القاعدة مباشرة: “For the noindex rule to be effective, the page or resource must not be blocked by a robots.txt file, and it has to be otherwise accessible to the crawler.” (الترجمة العربية) «لكي تكون قاعدة noindex فعالة، يجب ألا يكون الملف أو المورد محجوبًا بواسطة ملف robots.txt، وأن يكون متاحًا للزاحف بطريقة أخرى.» فإذا مُنعت الصفحة، لا تزحف Google إليها ولا ترى noindex، وقد تبقى مفهرسة. وكما كتبت في مقالي عن «مفهرسة رغم حجبها بواسطة robots.txt»: ما لم تستطع Google الزحف إلى صفحة، فلن ترى وسم noindex وقد تظل تفهرسها لأن لها روابط.

إذًا، تسلسل إزالة الفهرسة عكس ما يلجأ إليه الناس عادةً:

  1. اسمح بالزحف إلى العنوان (أزل Disallow).
  2. قدّم noindex (وسم robots للصفحة أو ترويسة X-Robots-Tag) ودع Google تعيد الزحف لرؤيته.
  3. اترك الصفحة قابلة للزحف مع بقاء noindex بعد إسقاطها من الفهرس. ليست إعادة حجبها لاحقًا «خطوة إنهاء» آمنة — فإذا منعت العنوان مجددًا فقد تفقد Google رؤية قاعدة noindex في الزحف التالي، وقد تُفهرس صفحة محجوبة لكنها مرتبطة بسبب روابط صفحات أخرى؛ وهي نتيجة «مفهرسة رغم حجبها» التي كنت تحاول تجنبها. وإذا كانت ميزانية الزحف على الصفحة المحذوفة مصدر قلق حقيقي، فهذه حالة للمصادقة أو الحذف (404/410) — لا للعودة إلى robots.txt.

لعمليات الإزالة العاجلة، تكون أداة عمليات الإزالة في Search Console، أو حماية كلمة المرور، أو حذف الصفحة ببساطة (إرجاع 404/410) طرقًا أسرع.

كيف تعثر على القاعدة التي تحجب العنوان

ثلاث أدوات، لكل واحدة وظيفة مختلفة — لا تتوقع أن تؤدي إحداها عمل الأخريين:

  • فحص عنوان URL (GSC). الصق العنوان المحدد. يخبرك ما إذا كان محجوبًا حاليًا، وهو أسرع فحص لكل عنوان.
  • تقرير robots.txt (GSC). تقرير مراقبة على مستوى خاصية النطاق — وليس أداة اختبار قابلة للتحرير — يعرض ملفات robots.txt التي عثرت عليها Google لمضيفيك الرئيسيين، ووقت آخر جلب، وحالة الجلب، وأي تحذيرات تحليل، إضافةً إلى إجراء «طلب إعادة الزحف» بعد تغيير الملف. يخبرك بأن Google تستطيع رؤية الملف؛ ولا يختبر عناوين URL الفردية وفقه.
  • مدقق robots.txt أو محلل robots.txt مفتوح المصدر من Google. لمعرفة أي سطر يطابق عنوانًا معينًا، مرره عبر مدقق — إذ تفوز القاعدة الأطول والأكثر تحديدًا (ويمكن لقاعدة Allow تجاوز Disallow أوسع).
Evidence for this claim The current Search Console robots.txt report shows fetched files, history, fetch status, and parsing issues and can request a file recrawl; for a specific URL Google points to URL Inspection, a validator, or its open-source robots library rather than an editable legacy GSC tester. Scope: robots.txt diagnosis Confidence: high · Verified: Unblock a page blocked by robots.txt

بعد العثور على السطر المخالف، يعتمد الإصلاح على مكان وجود ملف robots.txt. إذا كنت تتحكم في الملف مباشرةً فأزل القاعدة أو صححها (وانتبه إلى الصياغة). وإذا كنت على منصة مستضافة مثل Wix أو Shopify أو Squarespace، فقد تحتاج إلى اتباع وثائق المزوّد الخاصة لتغييرها، لأن بعض المنصات تدير robots.txt نيابةً عنك.

تجربتي الخاصة: ماذا يحدث عندما تحجب صفحة كنت تريد فهرستها

السؤال المفيد فعلًا هو: إذا حجبت بالخطأ صفحة ينبغي أن تتصدر، فما حجم الضرر؟ أجريت الاختبار مباشرةً. في 30 يناير 2023 حجبت صفحتين كانتا تتصدران فعليًا — «Top Bing Searches» و«Top YouTube Searches» — باستخدام robots.txt وتتبعت ما حدث.

كان الضرر حقيقيًا لكنه أصغر مما توقعت. خسرنا موضعًا هنا أو هناك (انزلقت بعض الكلمات موضعًا أو موضعين، بل تحسن بعضها)، وخسرنا كل المقتطفات المميزة لتلك الصفحات أثناء حجبها — ثم عادت بعد رفع الحجب. تدهور ظهور النتائج أيضًا: عرضت Google عبارة «no information is available for this page» (الترجمة العربية) «لا تتوفر معلومات لهذه الصفحة» بدل الوصف التعريفي، وفقدنا عناويننا المخصصة. ولأن القائمة بدت أسوأ، انخفضت النقرات أكثر من مرات الظهور — فتضررت نسبة النقر إلى الظهور.

كان ملخصي وقتها: “We lost a position here or there and all of the featured snippets for the pages. I expected a lot more impact, but the world didn’t end.” (الترجمة العربية) «خسرنا موضعًا هنا أو هناك وجميع المقتطفات المميزة للصفحات. توقعت أثرًا أكبر بكثير، لكن العالم لم ينتهِ.» وما زلت أؤيد الخلاصة: لا تحجب الصفحات التي تريد فهرستها. سيؤلم ذلك. ليس بالقدر الذي قد تتخيله — لكنه سيؤلم. هذا هو الإطار الذهني الصحيح للتقرير. إذا كان كل ما في فئة «محظور بواسطة robots.txt» شيئًا قصدت حجبه، فأنت بخير. وإذا كانت صفحة تهمك موجودة فيها، فأخرجها.

ملاحظة عن نطاق التجربة: كانت الصفحتان تتصدران النتائج ومفهرستين أصلًا قبل حجبـهما، لذلك قست ما يحدث عندما تنتقل صفحة مفهرسة إلى حالة «مفهرسة رغم حجبها» — لا ما يحدث لعنوان لم يُفهرس قط ويجلس ببساطة في فئة الاستبعاد هذه. إذا لم يكن عنوان هنا مفهرسًا من البداية، فإن رفع الحجب يتيح لـGoogle الزحف إليه ودراسته بصورة طبيعية؛ ولا توجد مقتطفات مميزة أو سجل نسبة نقر إلى ظهور يمكن فقده، لأنه لم يكن موجودًا.

شجرة القرار

  • هل قصدت حجبه؟ ← اتركه. إنه يعمل كما صُمم.
  • لا — تريد فهرسته؟ ← أزل قاعدة robots.txt أو خففها، ثم اطلب الفهرسة.
  • تريد إخراجه من Google؟ ← لا تستخدم المنع. اسمح بالزحف + noindex (أو أداة عمليات الإزالة/الحذف)، ثم اتركه قابلًا للزحف — فقد يخفي إعادة حجبـه لاحقًا قاعدة noindex مجددًا.
  • إنه عنوان محجوب فُهرس رغم ذلك؟ ← هذه حالة الفهرسة رغم الحجب، وليست هذه الحالة — عالجها في المقال الخاص بها.
  • تحتوي الصفحة على محتوى حساس أو خاص؟ ← robots.txt ليس أداة تحكم في الوصول؛ إنه طلب يمكن للروبوتات تجاهله. استخدم المصادقة أو حماية كلمة المرور، لا المنع.

مبدأ الزحف مقابل الفهرسة عام، بالمناسبة: تحترم Bing ملف robots.txt للزحف بالطريقة نفسها، كما أن إزالة عنوان من Bing تستخدم أداة حظر العناوين لديها أو noindex على صفحة قابلة للزحف — لا منعًا مجردًا.

للاطلاع على الملف نفسه — الصياغة، والبدائل، ومكان وجوده، وما يستطيع فعله وما لا يستطيع — راجع دليل robots.txt. ولمعرفة كيفية اتخاذ قرارات الفهرسة في المراحل السابقة، راجع محور الفهرسة.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.