الحظر بسبب الوصول الممنوع (403)

ما معنى حالة «الحظر بسبب الوصول الممنوع (403)» في تقرير فهرسة الصفحات في Google Search Console، ولماذا يحصل Googlebot على 403 بينما لا يحصل عليه متصفحك، وكيف تختلف عن 401، وكيف تشخّصها وتصلحها وتتحقق من الإصلاح.

نُشر أول مرة: 23 يونيو 2026 · آخر تحديث: 22 أغسطس 2026 · Advanced
اللغات
عدد الأدلة في هذه الصفحة: 2

تعني حالة «الحظر بسبب الوصول الممنوع (403)» في تقرير فهرسة الصفحات في GSC أن Googlebot زحف عنوان URL وأعاد خادمك HTTP 403. لن تفهرس Google الصفحة، وتزيلها إن كانت مفهرسة. تصف مساعدة فهرسة الصفحات لدى Google 403 بأنها بيانات اعتماد قُدمت ثم رُفضت — وهذه صياغة تقرير Google لا التعريف الكامل؛ إذ يعرّف RFC 9110 403 على نحو أوسع وقد لا تتعلق الحالة ببيانات الاعتماد. إذا كان العنوان عامًا وقابلًا للفهرسة، فتعامل مع 403 كمشكلة ينبغي اكتشافها؛ وإذا كان خاصًا عمدًا فقد تكون 403 تؤدي وظيفتها — أصلح إشارات الاكتشاف بدلًا من ذلك. وبالنسبة إلى العناوين العامة، يُبلّغ كثيرًا عن جدار حماية أو CDN أو WAF بوصفه السبب، وهو ما يفسر تحميل الصفحة عندك وعودة 403 لدى Google. تتعامل Google مع 401 و403 بالطريقة نفسها للفهرسة، وتقول لا تستخدم أيًا منهما للحد من الزحف — استخدم 429 أو 503. تحقق من Googlebot الحقيقي (DNS عكسي/نطاقات IP المنشورة/فئة العميل الصحيحة) قبل السماح، وقيد أي استثناء، ثم أكد 200 عبر URL Inspection وValidate Fix.

الخلاصة — تعني 403 في تقرير فهرسة الصفحات أن Googlebot تلقى HTTP 403 لعنوان URL، لذلك لن تفهرسه Google (وتزيله إن كان مفهرسًا). تصف مساعدة فهرسة الصفحات لدى Google حالة 403 على أنها بيانات اعتماد قُدمت ثم رُفضت — وهذه صياغة التقرير لدى Google، لا التعريف الكامل لـHTTP؛ إذ يعرّف RFC 9110 حالة 403 على نحو أوسع بأنها «فهم الطلب ثم رفضه»، مع بيانات اعتماد أو من دونها، لذلك تعامل صياغة Google معاملة الإرشاد لا البرهان على سوء الإعداد. قرر أولًا هل ينبغي أن يكون عنوان URL عامًا وقابلًا للفهرسة أصلًا — فبالنسبة إلى العناوين العامة، يُبلّغ كثيرًا عن جدار حماية/CDN/WAF يحظر Googlebot دون قصد، وهو ما يفسر تحميل الصفحة عندك وعودة 403 لدى Google؛ لكن 403 على عنوان يفترض أن يبقى خاصًا قد تعمل كما صُممت. تتعامل Google مع 401 و403 بالطريقة نفسها للفهرسة، وتقول صراحةً لا تستخدم 401/403 للحد من معدل الزحف — استخدم 429 (أو 503). تحقق من Googlebot الحقيقي (reverse DNS / نطاقات IP المنشورة / فئة العميل الصحيحة) قبل السماح، وقيد أي استثناء بالمسار والقاعدة المحددين، ثم أكد 200 عبر URL Inspection → Test live URL وشغّل Validate Fix.

ماذا تقول Google فعلًا عن 403 — وماذا يقول HTTP فعلًا؟

تبلغ التسمية عن الاستجابة المرصودة، لا عن WAF أو CDN أو قاعدة الوصول المحددة التي سببتها. Evidence for this claim The Page Indexing report identifies URLs where Google encountered a forbidden-access response. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report وتأتي نتيجة الفهرسة من معالجة Google العامة لأخطاء 4xx. Evidence for this claim Google treats 4xx responses other than 429 as if the content does not exist for indexing. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: HTTP status codes

تصف وثائق تقرير فهرسة الصفحات لدى Google الحالة هكذا: يعني HTTP 403 أن user agent قدم بيانات اعتماد لكنه لم يُمنح الوصول — لكن Googlebot لا يقدم بيانات اعتماد أبدًا، ولذلك تقول Google إن خادمك يعيد الخطأ على نحو غير صحيح. لن تُفهرس الصفحة. وإذا أردت فهرستها، فإصلاح Google هو إما السماح للمستخدمين غير المسجلين أو السماح صراحةً بطلبات Googlebot بلا مصادقة.

هذه صياغة وثيقة المساعدة لدى Google، لكنها ليست تعريف HTTP الكامل. يعرّف RFC 9110 حالة 403 على نحو أوسع: فهم الخادم الطلب ورفض تنفيذه. وقد تكون بيانات الاعتماد جزءًا من السبب — لكن RFC تصرح بأن الطلب قد يكون محظورًا لأسباب لا علاقة لها ببيانات الاعتماد إطلاقًا: سياسة، أو قاعدة تحكم في الوصول، أو قرار أمني من edge، أو أي سبب يختاره مالك الخادم. لذلك ليست الخلاصة المفيدة «كل 403 إلى Googlebot يعني قاعدة معطلة بالتعريف»، بل «اكتشف هل يفترض أن يكون هذا العنوان قابلًا للوصول، ثم اعثر على القاعدة الدقيقة التي أعادت 403». وفي صفحة يفترض أن تكون عامة وقابلة للفهرسة، تكون 403 إلى Googlebot غالبًا شيئًا يجب إصلاحه. أما الصفحة الخاصة أو المحظورة عمدًا، فقد تكون 403 قرار وصول صحيحًا وعاملًا — وتكون المشكلة عادة أن Google ما كان ينبغي أن تكتشف عنوان URL أصلًا (انظر فحص النية أدناه)، لا أن الجدار الناري خاطئ.

مهما كانت الحالة، توضح وثائق Google المنفصلة لحالات HTTP نتيجة الفهرسة بصرامة: لا تستخدم محتوى عناوين URL التي تعيد رموز 4xx، وتُعامل جميع أخطاء 4xx باستثناء 429 بالطريقة نفسها (يبلغ الزاحف النظام التالي بأن المحتوى غير موجود)، كما أن مسار الفهرسة يزيل عنوان URL من الفهرس إذا كان مفهرسًا سابقًا. Evidence for this claim Google treats 4xx responses other than 429 as if the content does not exist for indexing. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: HTTP status codes

قرر ما الذي يفترض أن يفعله عنوان URL قبل إصلاح أي شيء

لا تحتاج كل صفوف هذا التقرير إلى الإصلاح نفسه. صنّف عنوان URL ضمن أربع مجموعات أولًا:

  1. عام ومقصود فهرسته. 403 غير مقصودة — اعمل عبر حلقة التشخيص ← الإصلاح ← التحقق أدناه.
  2. عام لكن غير مقصود فهرسته. لا تلجأ إلى robots.txt لحل ذلك — فحظر robots.txt حاجز زحف منفصل له سبب «blocked by robots.txt» في فهرسة الصفحات؛ ولا ينتج HTTP 403 الذي يبلغ عنه هذا الصف. أرسل الاستجابة العادية 200 واستخدم توجيه noindex (أو إعادة توجيه/إزالة صحيحة) بدلًا منه.
  3. خاص أو محظور عمدًا. قد تكون 403 نتيجة صحيحة مقصودة لمورد لا ينبغي للطالب الوصول إليه. وإذا ظهرت في هذا التقرير، فالمشكلة العملية عادة أن العنوان قابل للاكتشاف — في خريطة موقعك أو روابطك الداخلية أو غير ذلك — لا أن قاعدة الوصول خاطئة. نظّف إشارة الاكتشاف بدل فتح الباب.
  4. عنوان لا ينبغي أن يوجد، أو لا تريد تأكيد وجوده. اختر الاستجابة وفق سياسة أمان التطبيق، لا وفق اختصار SEO — فكل من 403 (أو 404 إذا كنت لا تريد تأكيد وجود العنوان) يمكن أن يكون مشروعًا هنا. Evidence for this claim A robots.txt disallow is a separate crawl gate and Page indexing reason; it does not itself generate the HTTP 403 response required for the Blocked due to access forbidden (403) reason. Scope: verified Search Console properties Confidence: high · Verified: Page indexing report

كل ما يلي يفترض الحالة الأولى: عنوان URL تريد فعلًا زحفه وفهرسته.

403 مقابل 401 — كيف تميزهما؟

هاتان حالتان شقيقتان في التقرير، وتطمس معظم الشروحات الفرق بينهما بقاعدة عامة («403 = لا توجد بيانات اعتماد مطلوبة، 401 = جدار تسجيل دخول») لا يمكن الاعتماد عليها وحدها — فقد تعيد طبقة مصادقة مهيأة خطأً 403 أيضًا، وتضعه في هذا الصف. الاستجابة نفسها هي الإشارة الحقيقية:

  • 401 (غير مصرح به) — وفق RFC 9110، يعني 401 تحديدًا افتقاد بيانات اعتماد مصادقة صالحة، ويجب أن تحمل الاستجابة ترويسة تحدي WWW-Authenticate (مصادقة HTTP أو جدار تسجيل دخول). لقد أُبلغت Google بأنها تحتاج إلى المصادقة ولم تستطع ذلك.
  • 403 (الوصول ممنوع) — رفض أوسع. يعرّفه RFC 9110 بأنه “the server understood the request but refuses to fulfill it,” (الترجمة العربية) «فهم الخادم الطلب لكنه يرفض تنفيذه»، مع بيانات اعتماد أو من دونها. عمليًا، يكون هذا الصف غالبًا حجبًا من جدار حماية/CDN/WAF أو قاعدة أمان، لكنه قد يكون أيضًا تطبيقًا يعيد 403 بسبب فحص مصادقة معطل، أو محدد معدل، أو قرار تحكم في الوصول مقصودًا. Evidence for this claim A 401 response means valid authentication credentials are missing and must include a WWW-Authenticate challenge; a 403 is a refusal that can occur with or without credentials. Scope: 401 and 403 responses Confidence: high · Verified: RFC 9110: HTTP Semantics

لكي تميز بينهما في عنوان URL معين، افحص الحالة والترويسات المعادة — هل تحمل الاستجابة ترويسة WWW-Authenticate؟ — بدل افتراض الآلية من تسمية التقرير وحدها. النتيجة واحدة (لا فهرسة) وغالبًا ما يتداخل الإصلاح (السماح لـGooglebot المتحقق منه أو فتح المحتوى للمستخدمين المجهولين)، لذلك طبّق حلقة التشخيص نفسها على أي من الصفين بعد معرفة ما تراه.

ماذا تفعل 403 بالفهرسة؟

تترتب ثلاثة أشياء بعد حصول Googlebot على 403:

  1. يُتجاهل المحتوى. لا تستخدم Google محتوى عناوين URL ذات رموز 4xx، لذلك لا يمكن فهرسة شيء من الصفحة.
  2. يُزال العنوان إذا كان مفهرسًا. قد تزيل 403 صفحة كانت تتصدر النتائج سابقًا — فالمشكلة ليست «لن تُضاف» فقط، بل «ستسقط».
  3. ينخفض تكرار الزحف. تزحف Google إلى عناوين URL ذات 4xx تدريجيًا مرات أقل مع الوقت، لذلك تُزار 403 طويلة الأمد أقل وتتعافى أبطأ بعد إصلاحها.

لماذا يحصل Googlebot على 403 بينما لا يحصل عليه متصفحك؟

هذا هو السؤال الذي يدور بالناس في حلقات. تُحمّل الصفحة في متصفحك، إذن يبدو أن المحتوى سليم — لكن Google تبلغ عن 403. والتفسير المرجح أن متصفحك وGooglebot يرسلان طلبات مختلفة جدًا، وقد تشغل قاعدة إدارة روبوتات مبنية لإيقاف أدوات الكشط للزاحف بينما تخدم البشر طبيعيًا — لكن تعامل مع ذلك على أنه فرضية تحتاج إلى تأكيد لا نتيجة محسومة، لأن السمة المهمة تختلف من موقع إلى آخر:

  • يرسل متصفحك cookies وuser-agent حقيقيًا لمتصفح ويمكنه حل تحدي JavaScript أو CAPTCHA؛ أما طلب Googlebot فعادة لا يحمل ذلك — لا cookies، وuser-agent لزاحف، ولا يستطيع حل تحدٍّ تفاعلي (مع أن Google-InspectionTool يصير JavaScript فعلًا ويبلغ عن الناتج المصيّر، لذلك ليست عبارة “Googlebot has no JavaScript” (الترجمة العربية) «Googlebot لا يملك JavaScript» دقيقة لكل جزء).
  • وبعيدًا عن اختلافات العميل، قد يختلف الطلبان أيضًا في عنوان IP/الفئة المصدرية، والجغرافيا، والطريقة، وreferrer، وحالة الذاكرة المؤقتة، والقاعدة التي أطلقت الحجب — وقد يكون أي واحد منها هو المحفز الحقيقي.

لا تخمّن أي سمة سببت الحجب. قارن سجلات edge وorigin الدقيقة لطلب محجوب فعلي بسجل زيارة متصفح عادية — معرّف القاعدة نفسه، وترويسات الاستجابة، والطريقة، وUA، وعنوان IP المصدر وفئته المتحققة، والجغرافيا، وcookies، وreferrer، وحالة الذاكرة المؤقتة، ونتيجة التحدي — وغيّر سمة واحدة كل مرة حتى تجد ما يقلب الاستجابة. هكذا تؤكد أن 403 انتقائية بدل افتراض ذلك.

الأسباب الشائعة

  • إدارة روبوتات CDN/WAF. قد تتحدى Cloudflare (Bot Fight Mode / Super Bot Fight Mode وBrowser Integrity Check وManaged Challenge) أو Akamai أو Imperva/Incapsula أو Sucuri أو AWS WAF العملاء غير المتصفحين، بما في ذلك Googlebot، أو تعيد لهم 403. بالنسبة إلى عناوين URL العامة، هذا أحد الأسباب التي يُبلّغ عنها كثيرًا، وغالبًا ما يكون غير مقصود — مع عدم وجود رقم مستقل متحقق منه يحدد نسبة الحالات التي يفسرها.
  • جدار خادم/قواعد أمان. قد تعتبر mod_security أو OWASP CRS أو fail2ban أو الجدران النارية على مستوى المضيف نمط Googlebot مسيئًا.
  • قواعد user-agent أو referrer أو hotlink. قواعد تعيد 403 لأي طلب يفتقد user-agent أو referrer شبيهًا بالمتصفح.
  • حجب جغرافي أو IP. استبعاد نطاقات IP التي يزحف منها Googlebot (يزحف Googlebot أساسًا من عناوين IP أمريكية)، بحيث يلتقطه حجب بلد دون ضجيج.
  • جدران تسجيل الدخول أو بيانات الاعتماد. طلب cookies أو تسجيل دخول لرؤية محتوى يفترض أن يكون عامًا — وهذا يتداخل مع حالة 401.
  • قواعد تحديد معدل تعيد 403 بعد N طلبات. لا تفعل ذلك — انظر أدناه.

لا تستخدم 403 لخنق Googlebot

هذه هي الممارسة المضادة التي تستحق التسمية. يعيد أشخاص (وبعض شبكات CDN) حالات 403 أو404 لإبطاء Googlebot وتقليل حمل الخادم. وقد أوضحت Google أن ذلك لا يعمل ولا ينبغي فعله: لا تستخدم رمزي الحالة 401 و403 للحد من معدل الزحف. لا أثر لهما في معدل الزحف — بل يزيلان الصفحة من الفهرس. وإذا كنت تحتاج حقًا إلى تراجع Googlebot، فأعد 429 (أو خطأ 5xx مثل 503)؛ فهذه الرموز تقرؤها Google باعتبارها «تمهل»، ويكون أثرها مؤقتًا لا دائمًا.

كيف تشخّص الحالة

  1. URL Inspection → Test live URL. مرر عنوان URL متأثرًا عبر Search Console واستخدم Test live URL للتأكد من أن Google تتلقى 403 حاليًا (لا تقريرًا قديمًا). وتذكر أن هذا الاختبار هو Google-InspectionTool، أي عميل Google محدد — ونجاح الاختبار يعني أن InspectionTool عبر في تلك اللحظة، لا أن Googlebot المجدول سيسلك مسار WAF أو الجغرافيا أو الذاكرة المؤقتة أو تحديد المعدل نفسه في زحفه التالي.
  2. أعد الإنتاج كـGooglebot. لا تختبر من متصفحك المعتاد — اجلب عنوان URL مع user-agent الخاص بـGooglebot، ويفضل من خارج شبكتك ومن أكثر من منطقة (تزحف Google غالبًا من عناوين IP أمريكية، لكنها قد تنتقل إلى دول أخرى إذا حُجبت طلبات الولايات المتحدة، لذلك لا يثبت نجاح منطقة واحدة الوصول العالمي)، لتشغيل القاعدة نفسها. (الأوامر في علامة Scripts.)
  3. اقرأ سجلات CDN/WAF/الجدار الناري. اعثر على القاعدة الدقيقة التي أطلقت على طلب Googlebot — وقارن ترويسات الاستجابة ومعرّف القاعدة والمحفز (user-agent أو IP أو التحدي أو تحديد المعدل) بسجل زيارة المتصفح العادية بدل افتراض السمة التي سببت الحجب.
  4. تحقق من Googlebot الحقيقي وفئته. قبل السماح لأي شيء، أكد أن الطلبات Googlebot فعلًا عبر DNS عكسي ثم أمامي أو نطاقات IP المنشورة لدى Google، وافحص أي عميل Google أنشأ الطلب — فـGooglebot العادي والزواحف الخاصة وجالبات المستخدم (مثل Google-InspectionTool) تستخدم أقنعة مضيف وقوائم IP مختلفة، وقد يجعل التحقق مقابل القائمة الخطأ طلبًا حقيقيًا يبدو منتحلًا.

كيف تصلح الحالة

  • قيد استثناءً ضيقًا لـGooglebot المتحقق منه في WAF/الجدار الناري — عبر الهوية المتحققة (DNS عكسي ثم أمامي، مع مطابقة فئة العميل الصحيحة) أو نطاقات IP الحالية المنشورة لزواحف Google، لا عبر الثقة بسلسلة user-agent وحدها. أبقِ الاستثناء ضيقًا: للمسارات المحددة التي تحتاجه وللقاعدة المحددة التي تحجب، مع إبقاء ضوابط الأمان الأخرى وحدود المعدل والتسجيل، وتعيين تاريخ انتهاء/مراجعة حتى لا تبقى قائمة سماح قديمة بعد زوال سببها. اطلب من مزود CDN/الجدار تأكيد السماح لـGooglebot، وأتمت فحص قواعد الحجب مقابل الشبكات الفرعية الحالية المنشورة من Google حتى لا تعيد ترقية نطاق IP مستقبلية الحجب دون ملاحظة.
  • افتح المحتوى العام للمستخدمين المجهولين. إذا جاءت 403 من متطلب تسجيل دخول/cookie على محتوى يفترض أن يكون عامًا، فأزل المتطلب (وهذا أيضًا الإصلاح المشترك مع حالة 401 الشقيقة).
  • استبدل تحديد معدل 403 بـ429. إذا أعادت قاعدة 403 بعد حد من الطلبات، فغيّرها لتعيد 429 (أو 503) حتى تقرأ Google «تمهل» بدل «ابتعد».

تحقق من الإصلاح وأعد الفهرسة

بمجرد إصلاح القاعدة، ينبغي أن يعيد عنوان URL الاستجابة 200. ثم:

  1. URL Inspection → Test live URL للتأكد من أن الاستجابة الحية تعيد الآن 200.
  2. اطلب الفهرسة لعناوين URL ذات الأولوية، و/أو انقر Validate Fix على صف «Blocked due to access forbidden (403)» في تقرير فهرسة الصفحات.
  3. تحدث إعادة الفهرسة تلقائيًا بعد أن تعيد Google زحف استجابة 200 — ولا يوجد ضمان رسمي لسرعتها بالضبط، وما زال على العنوان اجتياز زحف عادي قبل أن يعود. لا تحتاج إلى تشغيل أي شيء يدويًا بعد إزالة الحجب وتأكيد الاستجابة السليمة ومنح Google وقتًا لإعادة الزحف. Evidence for this claim The Page Indexing report identifies URLs where Google encountered a forbidden-access response. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report

لمعرفة الصورة الأوسع لأسباب عدم الفهرسة التي تظهر هنا وطريقة تجميع التقرير لها، راجع نظرة عامة على تقرير فهرسة الصفحات؛ أما الحالة الشقيقة، «Blocked due to unauthorized request (401)»، فهي نسخة 401 من المشكلة نفسها.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.