URL محدد بـ 'noindex' (حالة GSC)

ما معنى حالة "URL محدد بـ 'noindex'" في Google Search Console — والنسخة "URL المقدم محدد بـ 'noindex'" والاسم القديم "مستبعد بواسطة وسم 'noindex'". متى يكون مقصودًا مقابل خطأ، وأين يوجد noindex (وسم meta مقابل ترويسة X-Robots-Tag)، وتعارض robots.txt، وnoindex الوهمي/CDN، وكيفية الإصلاح والتحقق.

نُشر أول مرة: 23 يونيو 2026 · آخر تحديث: 6 أغسطس 2026 · Advanced
اللغات
دليل واحد في هذه الصفحة

"URL محدد بـ 'noindex'" هو حالة فهرسة الصفحات في Google Search Console لصفحة زحف إليها Google ووجد فيها توجيه noindex (وسم meta robots أو ترويسة X-Robots-Tag)، لذلك أبقاها خارج الفهرس. نفس الحالة، أسماء متعددة: الحالية "URL محدد بـ 'noindex'"، والصيغة الأوضح الخاصة بالموقع المُرسل "URL المقدم محدد بـ 'noindex'" التي تستخدمها التقارير والأدوات بشكل شائع، والاسم القديم "مستبعد بواسطة وسم 'noindex'". عادةً ما يكون مقصودًا ولا بأس به — تحقق من قائمة عناوين URL قبل "إصلاح" أي شيء. العلم الأحمر الحقيقي هو صفحة noindex لا تزال موجودة في خريطة موقعك — إرسال خريطة الموقع هو تلميح لـ Google، وليس ضمانًا، والتوجيهان يتعارضان. نظرًا لأن noindex يعتمد على الزحف، لا تقم بإقرانه مع منع robots.txt — لا يمكن لـ Google رؤية noindex لا يمكنه الزحف إليه. تحقق من مكانين (وسم meta وترويسة X-Robots-Tag)، وصحح noindex الوهمي/CDN باستخدام جلب Googlebot المباشر، ثم أزل التوجيه، وتحقق من الإصلاح، وتوقع أن تستغرق إعادة المعالجة أكثر من يوم أو يومين.

TL;DR — “URL marked ‘noindex’” هي حالة فهرسة الصفحات في GSC لصفحة قام Google بالزحف إليها ووجد noindex عليها — وسم robots meta أو ترويسة X-Robots-Tag، ويكرّم Google أيضًا وسم robots meta الموضوع في جسم الصفحة، وليس فقط في <head>. أسماء متعددة، حالة واحدة: الحالية “URL marked ‘noindex’،” والصياغة الأكثر دقة المقدمة عبر خريطة الموقع “Submitted URL marked ‘noindex’” التي تستخدمها التقارير والأدوات بشكل شائع، والاسم القديم “Excluded by ‘noindex’ tag.” وهي مختلفة عن المحجوبة عبر robots.txt (لم يتم الزحف إليها أبدًا) وعن “Crawled — currently not indexed” (بدون توجيه). عادةً ما تكون مقصودة — تحقق من قائمة العناوين أولاً. عنوان URL بدون فهرسة لا يزال موجودًا في خريطة موقعك هو المؤشر الحقيقي (إرسال خريطة الموقع هو تلميح، وليس ضمانًا). noindex يعتمد على الزحف: اقرنه بمنع robots.txt ولن يتمكن Google من رؤيته، لذا قد تبقى الصفحة مفهرسة. عندما تتعارض القواعد، يطبق Google القاعدة الأكثر تقييدًا. تحقق من مصدرين (HTML المعروض وترويسة HTTP)، وصحح noindex الوهمي/من CDN باستخدام جلب Googlebot المباشر (URL Inspection / Rich Results Test)، ثم أزل التوجيه، وValidate Fix، وتوقع أن تستغرق إعادة المعالجة أكثر من يوم أو يومين — يقول Google إنها قد تمتد لأشهر للصفحات ذات الأولوية المنخفضة.

ما الذي تعنيه الحالة فعليًا

يصف التقرير التوجيه الذي لاحظه Google، وليس سبب إضافته بواسطة CMS أو قالب أو CDN . Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report يجب أن يكون Google قادرًا على الزحف إلى الصفحة لملاحظة وتطبيق noindex. Evidence for this claim Google supports noindex through a robots meta tag or X-Robots-Tag header and must crawl the page to observe it. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Block indexing with noindex

تعريف Google نفسه دقيق: عندما حاول Google فهرسة الصفحة، واجه توجيه noindex وبالتالي لم يقم بفهرستها. الكلمة المفتاحية هي واجه — كان على Google الزحف إلى الصفحة لرؤية التوجيه. لذا تحمل هذه الحالة حقيقتين في آن واحد: وصل Google إلى الصفحة، وأخبرته الصفحة ألا تتم فهرستها.

Evidence for this claim Google reports URL marked noindex when it encountered a noindex directive while trying to index the URL and therefore did not index it. Scope: verified Search Console properties Confidence: high · Verified: Page indexing report

هذا هو العمود الفقري للدقة هنا، وهو ما يميز هذه الحالة عن جاراتها:

  • محجوبة عبر robots.txt → لم يُسمح لـ Google بالزحف أبدًا، لذا لم يقرأ أي محتوى أو أي توجيه.
  • “Crawled — currently not indexed” → زحف Google، ولم يجد أي توجيه، واختار عدم الفهرسة على أي حال.
  • “URL marked ‘noindex’” → زحف Google، ووجد noindex، وأطاعه.
Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report

الأسماء الثلاثة هي حالة واحدة

هذا يربك الناس لأن التسمية تغيرت بمرور الوقت وتختلف بناءً على كيفية العثور على العنوان:

  • “URL marked ‘noindex’” — التسمية الحالية العامة في تقرير فهرسة الصفحات (Page Indexing). توجد تحت “Not indexed” (سابقًا “Excluded”). هذه هي الصياغة التي تستخدمها وتعرفها وثائق تقرير فهرسة الصفحات الحالية من Google.
  • “Submitted URL marked ‘noindex’” — نفس الحالة الأساسية، ولكن لعنوان موجود أيضًا في خريطة موقع قدمتها. هذه هي الصياغة الأكثر دقة التي يبلغ عنها الممارسون وأدوات SEO التابعة لجهات خارجية عادةً لهذا المزيج. لا توضح وثائق مساعدة Google الحالية هذا كحالة منفصلة عن “URL marked ‘noindex’،” لذا تعامل مع التسمية الدقيقة على أنها تعتمد على التقرير — لكن الجوهر يظل صحيحًا بغض النظر عما تسميه أداة معينة إياه: خريطة الموقع تهدف إلى سرد العناوين التي تريدها في البحث (وإرسال واحدة هو تلميح لـ Google، وليس ضمانًا للفهرسة)، لذا عنوان بدون فهرسة موجود فيها هو تناقض يستحق الحل.
  • “Excluded by ‘noindex’ tag” — الاسم القديم من تقرير “Index Coverage” قبل 2021. لا يزال النسخة العامية الأكثر بحثًا. نفس الشيء الأساسي.

إذا وصلت إلى هنا من أي من هذه الثلاثة، فأنت في نفس المكان.

هل هي مشكلة؟ قرار المقصود مقابل العرضي

لا تقم “بإصلاح” هذا بشكل انعكاسي. شجرة القرار:

  1. اسحب قائمة عناوين URL المتأثرة (انقر على الحالة).
  2. هل هذه الصفحات كنت تقصد استبعادها؟ صفحات الشكر، البحث الداخلي، عناوين URL الخاصة بالتصفية/الفلاتر، الحساب/الإدارة، بيئة التدريج التي لا ينبغي أن تكون مباشرة. → لا حاجة لإجراء. “غير مفهرس” ليس مثل “معطل”، وجوجل تقول ذلك صراحةً: هذه العناوين لم تتم فهرستها، ولكن ليس بالضرورة بسبب خطأ.
  3. هل توجد صفحة تريد فهرستها في هذه القائمة؟ → تسرب وسم noindex إليها. ابحث عنه وأزله.
  4. هل عنوان URL غير المفهرس موجود أيضًا في خريطة الموقع التي أرسلتها (غالبًا يظهر كـ “العنوان المُرسل مُعلَّم بـ ‘noindex’”)؟ → حل التناقض مباشرةً: أزل noindex (لفهرسته) أو أزل العنوان من خريطة الموقع (لإبقائه غير مفهرس). لا تترك عنوان URL غير مفهرس في خريطة الموقع — إرسال خريطة الموقع هو تلميح لجوجل حول ما تريد فهرسته، وليس طلبًا يتجاوز توجيه الصفحة نفسه.

السبب في أن المنافسين يتعاملون مع هذا كـ”خطأ يجب إصلاحه” هو أنهم يتخطون الخطوة 2. في معظم الأحيان، هذه الحالة هي النظام يعمل بشكل صحيح.

أين يوجد noindex: وسم meta مقابل ترويسة X-Robots-Tag

هناك طريقتان للتسليم بالضبط، وعليك فحص كلتيهما لأنهما تبدوان مختلفتين تمامًا:

  • وسم Meta robots<meta name="robots" content="noindex"> في <head> الخاص بالصفحة. يستهدف جميع برامج الزحف؛ <meta name="googlebot" content="noindex"> يستهدف جوجل فقط. هذا هو الذي يمكنك رصده في HTML.
  • ترويسة HTTP X-Robots-TagX-Robots-Tag: noindex في ترويسات استجابة الخادم. هذه هي الخفية. يتم تعيينها في إعدادات الخادم أو CMS أو CDN، وليس في مصدر الصفحة، لذا فإن “عرض المصدر” لن يُظهرها. طريقة الترويسة هي أيضًا الطريقة الوحيدة لتعطيل فهرسة ملفات غير HTML — يمكن استخدام ترويسة استجابة لـ موارد غير HTML مثل ملفات PDF وملفات الفيديو وملفات الصور، التي لا تحتوي على <head> لاحتواء وسم meta.
Evidence for this claim Google supports noindex through a robots meta tag or an X-Robots-Tag HTTP response header; both have the same effect, and the response header supports non-HTML resources. Scope: HTML and non-HTML web resources Confidence: high · Verified: Block Search indexing with noindex

عندما يقول GSC إن هناك noindex وتقسم أن الصفحة لا تحتوي عليه، فإن الترويسة هي أول مكان للبحث (تبويب ورقة الغش يعرضهما جنبًا إلى جنب).

كيفية العثور على التوجيه في صفحة

  1. عرض المصدر / DOM المعروض — ابحث عن noindex. تحقق من <head> المعروض، وليس فقط المصدر الخام، حيث يمكن حقن وسم بواسطة JavaScript أو مدير الوسوم. لا تتوقف عند <head> أيضًا: لقد قالت جوجل إنها لا تفرض موضع meta-robots وتحترم وسم robots meta الموجود في <body> الخاص بالصفحة أيضًا، لذا فإن التوجيه المحقون في مكان أدنى من المستند لا يزال يُحتسب.
  2. ترويسات الاستجابةcurl -I https://example.com/page/ (أو أدوات مطور المتصفح → الشبكة → طلب المستند → ترويسات الاستجابة) وابحث عن سطر X-Robots-Tag.
  3. فحص عنوان URL (GSC)اختبار عنوان URL المباشر — هذا يجلب الصفحة كما يفعل Googlebot ويُبلغ عن حكم الفهرسة والاستجابة. هذا هو الذي يلتقط التوجيهات المُقدمة لجوجل فقط.
  4. اختبار النتائج الغنية — جلب حقيقي آخر من Googlebot يُرجع استجابة HTTP ولقطة معروضة بالضبط لما يعرضه الخادم لجوجل.
  5. تحقق من تعارض قواعد robots، وليس مجرد وسم واحد. إذا كان هناك أكثر من توجيه robots واحد ينطبق على الصفحة (مثلًا، قالب يحدد index لكن إضافة أو ترويسة تضيف noindex)، تطبق جوجل القاعدة الأكثر تقييدًا — لذا فإن noindex عشوائي في أي مكان يفوز حتى لو كانت قاعدة أخرى تقول index. لا تتوقف عن البحث بمجرد العثور على توجيه واحد يبدو متساهلًا.

تعارض robots.txt (لماذا يؤدي disallow + noindex إلى نتائج عكسية)

هذه هي النقطة الأكثر إرباكًا في كل دليل آخر، لذا أريدها دقيقة. noindex يعتمد على الزحف: يجب أن يتمكن Google من جلب الصفحة لقراءة التوجيه. توضح Google القاعدة بوضوح — لكي يكون توجيه noindex فعالاً، يجب ألا تكون الصفحة محظورة بواسطة ملف robots.txt ويجب أن تكون متاحة بخلاف ذلك للزاحف؛ إذا كانت محظورة أو لم يتمكن الزاحف من الوصول إليها، فلن يرى الزاحف أبدًا noindex، ويمكن أن تظل الصفحة تظهر في البحث (على سبيل المثال، إذا كانت صفحات أخرى ترتبط بها).

Evidence for this claim Google must be allowed to crawl and otherwise access a URL to see and apply its noindex rule; a robots.txt block can hide the directive while the URL remains eligible to appear from other information. Scope: HTML and non-HTML web resources Confidence: high · Verified: Block Search indexing with noindex

لقد كتبت عن الجانب الآخر من هذا لسنوات. في مقالتي على Ahrefs حول “Indexed, though blocked by robots.txt” (ترجمة) «مفهرس، رغم حظره بواسطة robots.txt»، النقطة الأساسية هي أن “crawling and indexing are two different things” (ترجمة) «الزحف والفهرسة شيئان مختلفان» — “if you block a page from being crawled, Google may still index it.” (ترجمة) «إذا حظرت صفحة من الزحف، فقد يظل Google يفهرسها.» وبشكل خاص حول هذا التعارض: “Unless Google can crawl a page, they won’t see the noindex meta tag and may still index it because it has links.” (ترجمة) «ما لم يتمكن Google من زحف صفحة، فلن يرى علامة noindex الوصفية وقد يستمر في فهرستها لأنها تحتوي على روابط.» لذا فإن التركيبة المدمرة للذات هي noindex + robots.txt disallow: الـ disallow يخفي الـ noindex، ويمكن أن تظل الصفحة مفهرسة عبر الروابط الخارجية.

التسلسل الصحيح لإزالة صفحة فعليًا:

  1. اسمح بالزحف وأبقِ noindex في مكانه.
  2. انتظر حتى يعيد Google الزحف، ويرى التوجيه، ويزيل الصفحة.
  3. فقط بعد ذلك، إذا كنت تريد توفير ميزانية الزحف، يمكنك منعها في robots.txt — بعد إلغاء الفهرسة، وليس قبلها.

توصيتي الدائمة، من نفس المقال: “Just add a noindex meta robots tag and make sure to allow crawling — assuming it’s canonical.” (ترجمة) «فقط أضف علامة noindex meta robots وتأكد من السماح بالزحف — بافتراض أنها canonical.»

noindex الوهمي: ذاكرة التخزين المؤقت لـ CDN وتوجيهات خاصة بـ Googlebot

أصعب نسخة من هذا هي noindex “الوهمي”: تنظر إلى الصفحة، ولا ترى أي noindex في أي مكان، ومع ذلك يبلغ GSC عن واحد. لقد تناول John Mueller هذا الأمر بالضبط — في الحالات التي رآها، كان هناك فعلاً noindex حقيقي، يُعرض أحيانًا فقط لـ Google، مما قد يكون من الصعب جدًا تصحيحه. (لاحظ هذا السيناريو عندما ظهر؛ أنا أعيد صياغة وجهة نظره بدلاً من اقتباسها كبيان رسمي.)

المشتبه بهم المعتادون — تعامل مع هذه كفرضيات للتحقق، وليس أسبابًا مؤكدة، حتى يُظهر الاستجابة الحية واحدًا منها فعليًا:

  • CDN أو ذاكرة تخزين مؤقت تقدم رأس X-Robots-Tag: noindex قديمًا لم يعد موجودًا في إعدادات المصدر لديك.
  • توجيه مشروط بوكيل المستخدم — يعيد الخادم صفحة نظيفة إلى متصفحك وصفحة noindex إلى Googlebot.
  • تسريب قالب/بيئة تجريبية — noindex مخصص لبيئة تجريبية يتم شحنه إلى الإنتاج عبر قالب مشترك.

التشخيص هو نفسه في الحالات الثلاث: لا تثق في “View Source” في متصفحك الخاص. قم بـ جلب Googlebot حقيقيTest live URL في URL Inspection أو Rich Results Test — والذي يُظهر لك استجابة HTTP والصفحة المعروضة تمامًا كما يستقبلها Google. هكذا تكتشف خادمًا/CDN يقدم شيئًا لك وشيئًا آخر للزاحف.

كيفية إصلاحه والتحقق منه

بمجرد تأكيد أن noindex خطأ:

  1. أزل التوجيه من مصدره الحقيقي — وسم الميتا في القالب، أو ترويسة X-Robots-Tag في إعدادات الخادم/نظام إدارة المحتوى/شبكة توصيل المحتوى. امسح أي ذاكرة تخزين مؤقت لشبكة توصيل المحتوى/الصفحة حتى يتم تقديم الإصلاح فعليًا.
  2. تأكد من خلال جلب مباشر من Googlebot (فحص عنوان URL → اختبار عنوان URL المباشر) أن الصفحة الآن لا تُرجع أي noindex وتُظهر “URL متاح لـ Google.”
  3. اطلب الفهرسة لعناوين URL ذات الأولوية العالية، و/أو استخدم زر التحقق من الإصلاح في التقرير لإخبار Google بإعادة فحص المجموعة المتأثرة بالكامل.
  4. انتظر. إلغاء الفهرسة وإعادة الفهرسة ليسا فوريين — يجب على Google إعادة الزحف لرؤية التغيير أولاً، وإرشادات Google الخاصة هي أن توقيت إعادة الزيارة يعتمد على أهمية الصفحة ويمكن أن يستغرق وقتًا أطول بكثير من يوم أو يومين (توثق “أشهر” كاحتمال للصفحات ذات الأولوية المنخفضة). طلب الفهرسة على عنوان URL ذي أولوية هو كيف تطلب من Google المحاولة عاجلاً، وليس وسيلة لفرض جدول زمني محدد. لا داعي للذعر إذا استمرت الحالة أثناء إعادة المعالجة.

بالنسبة للعكس — صفحة تريد أن تكون noindexed لكنها عالقة في الفهرس لأنها كانت محجوبة أيضًا بواسطة robots.txt — قم بإلغاء حظر الزحف أولاً حتى يتمكن Google من رؤية noindex أخيرًا.

أين يقع هذا

هذه الحالة هي عقدة واحدة في تقرير فهرسة الصفحات من Google. التوجيه الخاص بالروبوتات خلفها — noindex — يمكن تسليمه كوسم ميتا robots أو ترويسة X-Robots-Tag، والأداة الصحيحة تعتمد على ما إذا كنت تعمل مع ملفات HTML أو غير HTML. الحالات المجاورة (“مفهرس، على الرغم من حجبه بواسطة robots.txt” و”تم الزحف — غير مفهرس حاليًا”) تصف حالات مختلفة و تحتاج إلى إصلاحات مختلفة؛ إبقاؤها واضحة هو معظم المعركة.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.