URL محدد بـ 'noindex' (حالة GSC)
ما معنى حالة "URL محدد بـ 'noindex'" في Google Search Console — والنسخة "URL المقدم محدد بـ 'noindex'" والاسم القديم "مستبعد بواسطة وسم 'noindex'". متى يكون مقصودًا مقابل خطأ، وأين يوجد noindex (وسم meta مقابل ترويسة X-Robots-Tag)، وتعارض robots.txt، وnoindex الوهمي/CDN، وكيفية الإصلاح والتحقق.
اللغات
دليل واحد في هذه الصفحة
- أداة مباشرة ذات صلةGoogle Index Checker
"URL محدد بـ 'noindex'" هو حالة فهرسة الصفحات في Google Search Console لصفحة زحف إليها Google ووجد فيها توجيه noindex (وسم meta robots أو ترويسة X-Robots-Tag)، لذلك أبقاها خارج الفهرس. نفس الحالة، أسماء متعددة: الحالية "URL محدد بـ 'noindex'"، والصيغة الأوضح الخاصة بالموقع المُرسل "URL المقدم محدد بـ 'noindex'" التي تستخدمها التقارير والأدوات بشكل شائع، والاسم القديم "مستبعد بواسطة وسم 'noindex'". عادةً ما يكون مقصودًا ولا بأس به — تحقق من قائمة عناوين URL قبل "إصلاح" أي شيء. العلم الأحمر الحقيقي هو صفحة noindex لا تزال موجودة في خريطة موقعك — إرسال خريطة الموقع هو تلميح لـ Google، وليس ضمانًا، والتوجيهان يتعارضان. نظرًا لأن noindex يعتمد على الزحف، لا تقم بإقرانه مع منع robots.txt — لا يمكن لـ Google رؤية noindex لا يمكنه الزحف إليه. تحقق من مكانين (وسم meta وترويسة X-Robots-Tag)، وصحح noindex الوهمي/CDN باستخدام جلب Googlebot المباشر، ثم أزل التوجيه، وتحقق من الإصلاح، وتوقع أن تستغرق إعادة المعالجة أكثر من يوم أو يومين.
Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing reportالخلاصة — “URL marked ‘noindex’” في Google Search Console تعني أن Google نظر إلى صفحتك، ورأى تعليمة
noindexعليها، وأبقاها خارج نتائج البحث عن قصد. في معظم الأحيان يكون ذلك مقصودًا — فهناك الكثير من الصفحات التي يجب أن تكون noindexed. الموقف الذي يجب أن تقلق بشأنه فعليًا هو صفحة وضعتها في sitemap (تطلب من Google فهرستها) وتقول أيضًا لا تفهرس — بعض التقارير تسمي هذا “Submitted URL marked ‘noindex’”. انظر إلى قائمة الصفحات المتأثرة: إذا كانت جميعها صفحات كنت تنوي إخفاءها، فأنت انتهيت.
ما الذي تخبرك به هذه الحالة
هذا التصنيف يعني أن Google واجه تعليمة noindex أثناء معالجة الصفحة. Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report يدعم Google تعليمة noindex في عنصر robots meta أو رأس استجابة X-Robots-Tag. Evidence for this claim Google supports noindex through a robots meta tag or X-Robots-Tag header and must crawl the page to observe it. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Block indexing with noindex
عندما تفتح تقرير Page Indexing في Search Console وترى صفًا باسم
“URL marked ‘noindex’”، إليك ما حدث: زار Google (زحف إلى) الصفحة، ووجد تعليمة noindex عليها، وقرر عدم وضعها في نتائج البحث. هذا كل شيء. الصفحة ليست معطلة — فعل Google بالضبط ما طلبته منه الصفحة.
تعليمة noindex هي تعليمة صغيرة تقول “لا تعرض هذه الصفحة في البحث.” وهي موجودة في أحد مكانين:
- سطر في كود الصفحة (وسم meta robots)، أو
- إعداد في استجابة الخادم للصفحة (رأس X-Robots-Tag) — هذا لا يمكنك رؤيته بمجرد النظر إلى الصفحة.
هل هذا سيء؟ عادة لا
الكلمة التي تخيف الناس هي “Not indexed” (القسم الذي يقع تحته هذا الحال). تبدو وكأنها خطأ. عادة ليست كذلك. هناك الكثير من الصفحات التي يجب إبقاؤها خارج البحث:
- صفحات الشكر / تأكيد الطلب
- نتائج البحث الداخلي
- صفحات تسجيل الدخول والحساب والإدارة
- إصدارات مفلترة أو مرتبة من قائمة
إذا كانت الصفحات في هذه القائمة هي تلك التي كنت تنوي إخفاءها، فاتركها وشأنها. لا يوجد شيء لإصلاحه.
عندما تحتاج إلى التصرف
حالتان:
- صفحة تريدها في Google موجودة في هذه القائمة. شيء ما وضع تعليمة
noindexعلى صفحة يجب أن تظهر في نتائج البحث. هذا خطأ يجب تتبعه. - ترى “Submitted URL marked ‘noindex’” (صياغة مختلفة قليلاً وأكثر حدة تستخدمها بعض التقارير والأدوات). في كلتا الحالتين، الجوهر هو نفسه: لقد أرسلت الصفحة في sitemap الخاص بك — والذي يهدف إلى سرد الصفحات التي تريدها في البحث — ولكن الصفحة تقول أيضًا “لا تفهرس.” هذان الأمران يتناقضان مع بعضهما البعض. إما أن تزيل تعليمة
noindex(إذا كنت تريد فهرستها) أو تزيل عنوان URL من sitemap الخاص بك (إذا كنت لا تريد ذلك).
الالتباس في الاسم
قد تتذكر هذا أيضًا باسم “Excluded by ‘noindex’ tag.” هذا مجرد الاسم الأقدم لنفس الشيء من تقرير Google السابق. لذا ثلاثة تصنيفات — “URL marked ‘noindex’,” و”Submitted URL marked ‘noindex’,” و”Excluded by ‘noindex’ tag” — كلها تصف حالة واحدة: وجد Google تعليمة noindex.
فخ واحد يجب معرفته
الغريزة الشائعة هي أيضًا حظر الصفحة في robots.txt لإبقائها “حقًا” خارج البحث. لا تفعل ذلك. حظر الزحف يمنع Google من قراءة الصفحة تمامًا — مما يعني أنه لا يمكنه رؤية تعليمة noindex الخاصة بك أيضًا. بشكل غير بديهي، يمكن أن تبقى الصفحة في البحث. لإزالة صفحة، دع Google يزحف إليها واحتفظ بتعليمة noindex عليها.
هل تريد النسخة التشخيصية الكاملة — اكتشاف وسم meta مقابل رأس، noindex من phantom/CDN، وتدفق الإصلاح والتحقق — انتقل إلى علامة التبويب Advanced.
TL;DR — “URL marked ‘noindex’” هي حالة فهرسة الصفحات في GSC لصفحة قام Google بالزحف إليها ووجد
noindexعليها — وسم robots meta أو ترويسة X-Robots-Tag، ويكرّم Google أيضًا وسم robots meta الموضوع في جسم الصفحة، وليس فقط في<head>. أسماء متعددة، حالة واحدة: الحالية “URL marked ‘noindex’،” والصياغة الأكثر دقة المقدمة عبر خريطة الموقع “Submitted URL marked ‘noindex’” التي تستخدمها التقارير والأدوات بشكل شائع، والاسم القديم “Excluded by ‘noindex’ tag.” وهي مختلفة عن المحجوبة عبر robots.txt (لم يتم الزحف إليها أبدًا) وعن “Crawled — currently not indexed” (بدون توجيه). عادةً ما تكون مقصودة — تحقق من قائمة العناوين أولاً. عنوان URL بدون فهرسة لا يزال موجودًا في خريطة موقعك هو المؤشر الحقيقي (إرسال خريطة الموقع هو تلميح، وليس ضمانًا).noindexيعتمد على الزحف: اقرنه بمنع robots.txt ولن يتمكن Google من رؤيته، لذا قد تبقى الصفحة مفهرسة. عندما تتعارض القواعد، يطبق Google القاعدة الأكثر تقييدًا. تحقق من مصدرين (HTML المعروض وترويسة HTTP)، وصحح noindex الوهمي/من CDN باستخدام جلب Googlebot المباشر (URL Inspection / Rich Results Test)، ثم أزل التوجيه، وValidate Fix، وتوقع أن تستغرق إعادة المعالجة أكثر من يوم أو يومين — يقول Google إنها قد تمتد لأشهر للصفحات ذات الأولوية المنخفضة.
ما الذي تعنيه الحالة فعليًا
يصف التقرير التوجيه الذي لاحظه Google، وليس سبب إضافته بواسطة CMS أو قالب أو CDN . Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report يجب أن يكون Google قادرًا على الزحف إلى الصفحة لملاحظة وتطبيق noindex. Evidence for this claim Google supports noindex through a robots meta tag or X-Robots-Tag header and must crawl the page to observe it. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Block indexing with noindex
تعريف Google نفسه دقيق: عندما حاول Google فهرسة الصفحة،
واجه توجيه noindex وبالتالي لم يقم بفهرستها. الكلمة المفتاحية هي
واجه — كان على Google الزحف إلى الصفحة لرؤية التوجيه. لذا تحمل هذه
الحالة حقيقتين في آن واحد: وصل Google إلى الصفحة، وأخبرته الصفحة ألا
تتم فهرستها.
هذا هو العمود الفقري للدقة هنا، وهو ما يميز هذه الحالة عن جاراتها:
- محجوبة عبر robots.txt → لم يُسمح لـ Google بالزحف أبدًا، لذا لم يقرأ أي محتوى أو أي توجيه.
- “Crawled — currently not indexed” → زحف Google، ولم يجد أي توجيه، واختار عدم الفهرسة على أي حال.
- “URL marked ‘noindex’” → زحف Google، ووجد
noindex، وأطاعه.
الأسماء الثلاثة هي حالة واحدة
هذا يربك الناس لأن التسمية تغيرت بمرور الوقت وتختلف بناءً على كيفية العثور على العنوان:
- “URL marked ‘noindex’” — التسمية الحالية العامة في تقرير فهرسة الصفحات (Page Indexing). توجد تحت “Not indexed” (سابقًا “Excluded”). هذه هي الصياغة التي تستخدمها وتعرفها وثائق تقرير فهرسة الصفحات الحالية من Google.
- “Submitted URL marked ‘noindex’” — نفس الحالة الأساسية، ولكن لعنوان موجود أيضًا في خريطة موقع قدمتها. هذه هي الصياغة الأكثر دقة التي يبلغ عنها الممارسون وأدوات SEO التابعة لجهات خارجية عادةً لهذا المزيج. لا توضح وثائق مساعدة Google الحالية هذا كحالة منفصلة عن “URL marked ‘noindex’،” لذا تعامل مع التسمية الدقيقة على أنها تعتمد على التقرير — لكن الجوهر يظل صحيحًا بغض النظر عما تسميه أداة معينة إياه: خريطة الموقع تهدف إلى سرد العناوين التي تريدها في البحث (وإرسال واحدة هو تلميح لـ Google، وليس ضمانًا للفهرسة)، لذا عنوان بدون فهرسة موجود فيها هو تناقض يستحق الحل.
- “Excluded by ‘noindex’ tag” — الاسم القديم من تقرير “Index Coverage” قبل 2021. لا يزال النسخة العامية الأكثر بحثًا. نفس الشيء الأساسي.
إذا وصلت إلى هنا من أي من هذه الثلاثة، فأنت في نفس المكان.
هل هي مشكلة؟ قرار المقصود مقابل العرضي
لا تقم “بإصلاح” هذا بشكل انعكاسي. شجرة القرار:
- اسحب قائمة عناوين URL المتأثرة (انقر على الحالة).
- هل هذه الصفحات كنت تقصد استبعادها؟ صفحات الشكر، البحث الداخلي، عناوين URL الخاصة بالتصفية/الفلاتر، الحساب/الإدارة، بيئة التدريج التي لا ينبغي أن تكون مباشرة. → لا حاجة لإجراء. “غير مفهرس” ليس مثل “معطل”، وجوجل تقول ذلك صراحةً: هذه العناوين لم تتم فهرستها، ولكن ليس بالضرورة بسبب خطأ.
- هل توجد صفحة تريد فهرستها في هذه القائمة؟ → تسرب وسم
noindexإليها. ابحث عنه وأزله. - هل عنوان URL غير المفهرس موجود أيضًا في خريطة الموقع التي أرسلتها (غالبًا
يظهر كـ “العنوان المُرسل مُعلَّم بـ ‘noindex’”)؟ → حل التناقض
مباشرةً: أزل
noindex(لفهرسته) أو أزل العنوان من خريطة الموقع (لإبقائه غير مفهرس). لا تترك عنوان URL غير مفهرس في خريطة الموقع — إرسال خريطة الموقع هو تلميح لجوجل حول ما تريد فهرسته، وليس طلبًا يتجاوز توجيه الصفحة نفسه.
السبب في أن المنافسين يتعاملون مع هذا كـ”خطأ يجب إصلاحه” هو أنهم يتخطون الخطوة 2. في معظم الأحيان، هذه الحالة هي النظام يعمل بشكل صحيح.
أين يوجد noindex: وسم meta مقابل ترويسة X-Robots-Tag
هناك طريقتان للتسليم بالضبط، وعليك فحص كلتيهما لأنهما تبدوان مختلفتين تمامًا:
- وسم Meta robots —
<meta name="robots" content="noindex">في<head>الخاص بالصفحة. يستهدف جميع برامج الزحف؛<meta name="googlebot" content="noindex">يستهدف جوجل فقط. هذا هو الذي يمكنك رصده في HTML. - ترويسة HTTP X-Robots-Tag —
X-Robots-Tag: noindexفي ترويسات استجابة الخادم. هذه هي الخفية. يتم تعيينها في إعدادات الخادم أو CMS أو CDN، وليس في مصدر الصفحة، لذا فإن “عرض المصدر” لن يُظهرها. طريقة الترويسة هي أيضًا الطريقة الوحيدة لتعطيل فهرسة ملفات غير HTML — يمكن استخدام ترويسة استجابة لـ موارد غير HTML مثل ملفات PDF وملفات الفيديو وملفات الصور، التي لا تحتوي على<head>لاحتواء وسم meta.
عندما يقول GSC إن هناك noindex وتقسم أن الصفحة لا تحتوي عليه، فإن الترويسة هي أول مكان للبحث (تبويب ورقة الغش يعرضهما جنبًا إلى جنب).
كيفية العثور على التوجيه في صفحة
- عرض المصدر / DOM المعروض — ابحث عن
noindex. تحقق من<head>المعروض، وليس فقط المصدر الخام، حيث يمكن حقن وسم بواسطة JavaScript أو مدير الوسوم. لا تتوقف عند<head>أيضًا: لقد قالت جوجل إنها لا تفرض موضع meta-robots وتحترم وسم robots meta الموجود في<body>الخاص بالصفحة أيضًا، لذا فإن التوجيه المحقون في مكان أدنى من المستند لا يزال يُحتسب. - ترويسات الاستجابة —
curl -I https://example.com/page/(أو أدوات مطور المتصفح → الشبكة → طلب المستند → ترويسات الاستجابة) وابحث عن سطرX-Robots-Tag. - فحص عنوان URL (GSC) → اختبار عنوان URL المباشر — هذا يجلب الصفحة كما يفعل Googlebot ويُبلغ عن حكم الفهرسة والاستجابة. هذا هو الذي يلتقط التوجيهات المُقدمة لجوجل فقط.
- اختبار النتائج الغنية — جلب حقيقي آخر من Googlebot يُرجع استجابة HTTP ولقطة معروضة بالضبط لما يعرضه الخادم لجوجل.
- تحقق من تعارض قواعد robots، وليس مجرد وسم واحد. إذا كان هناك أكثر من
توجيه robots واحد ينطبق على الصفحة (مثلًا، قالب يحدد
indexلكن إضافة أو ترويسة تضيفnoindex)، تطبق جوجل القاعدة الأكثر تقييدًا — لذا فإنnoindexعشوائي في أي مكان يفوز حتى لو كانت قاعدة أخرى تقولindex. لا تتوقف عن البحث بمجرد العثور على توجيه واحد يبدو متساهلًا.
تعارض robots.txt (لماذا يؤدي disallow + noindex إلى نتائج عكسية)
هذه هي النقطة الأكثر إرباكًا في كل دليل آخر، لذا أريدها دقيقة.
noindex يعتمد على الزحف: يجب أن يتمكن Google من جلب الصفحة لقراءة التوجيه.
توضح Google القاعدة بوضوح — لكي يكون توجيه noindex فعالاً، يجب ألا تكون الصفحة محظورة بواسطة ملف robots.txt ويجب أن تكون متاحة بخلاف ذلك للزاحف؛ إذا كانت محظورة أو لم يتمكن الزاحف من الوصول إليها، فلن يرى الزاحف أبدًا noindex، ويمكن أن تظل الصفحة تظهر في البحث (على سبيل المثال، إذا كانت صفحات أخرى ترتبط بها).
لقد كتبت عن الجانب الآخر من هذا لسنوات. في مقالتي على Ahrefs حول “Indexed, though blocked by robots.txt” (ترجمة) «مفهرس، رغم حظره بواسطة robots.txt»، النقطة الأساسية هي أن “crawling and indexing are two different things” (ترجمة) «الزحف والفهرسة شيئان مختلفان» — “if you block a page from being crawled, Google may still index it.” (ترجمة) «إذا حظرت صفحة من الزحف، فقد يظل Google يفهرسها.» وبشكل خاص حول هذا التعارض: “Unless Google can crawl a page, they won’t see the noindex meta tag and may still index it because it has links.” (ترجمة) «ما لم يتمكن Google من زحف صفحة، فلن يرى علامة noindex الوصفية وقد يستمر في فهرستها لأنها تحتوي على روابط.» لذا فإن التركيبة المدمرة للذات هي noindex + robots.txt disallow: الـ disallow يخفي الـ noindex، ويمكن أن تظل الصفحة مفهرسة عبر الروابط الخارجية.
التسلسل الصحيح لإزالة صفحة فعليًا:
- اسمح بالزحف وأبقِ
noindexفي مكانه. - انتظر حتى يعيد Google الزحف، ويرى التوجيه، ويزيل الصفحة.
- فقط بعد ذلك، إذا كنت تريد توفير ميزانية الزحف، يمكنك منعها في robots.txt — بعد إلغاء الفهرسة، وليس قبلها.
توصيتي الدائمة، من نفس المقال: “Just add a noindex meta robots tag and make sure to allow crawling — assuming it’s canonical.” (ترجمة) «فقط أضف علامة noindex meta robots وتأكد من السماح بالزحف — بافتراض أنها canonical.»
noindex الوهمي: ذاكرة التخزين المؤقت لـ CDN وتوجيهات خاصة بـ Googlebot
أصعب نسخة من هذا هي noindex “الوهمي”: تنظر إلى الصفحة، ولا ترى أي noindex في أي مكان، ومع ذلك يبلغ GSC عن واحد. لقد تناول John Mueller هذا الأمر بالضبط — في الحالات التي رآها، كان هناك فعلاً noindex حقيقي، يُعرض أحيانًا فقط لـ Google، مما قد يكون من الصعب جدًا تصحيحه. (لاحظ هذا السيناريو عندما ظهر؛ أنا أعيد صياغة وجهة نظره بدلاً من اقتباسها كبيان رسمي.)
المشتبه بهم المعتادون — تعامل مع هذه كفرضيات للتحقق، وليس أسبابًا مؤكدة، حتى يُظهر الاستجابة الحية واحدًا منها فعليًا:
- CDN أو ذاكرة تخزين مؤقت تقدم رأس
X-Robots-Tag: noindexقديمًا لم يعد موجودًا في إعدادات المصدر لديك. - توجيه مشروط بوكيل المستخدم — يعيد الخادم صفحة نظيفة إلى متصفحك وصفحة noindex إلى Googlebot.
- تسريب قالب/بيئة تجريبية — noindex مخصص لبيئة تجريبية يتم شحنه إلى الإنتاج عبر قالب مشترك.
التشخيص هو نفسه في الحالات الثلاث: لا تثق في “View Source” في متصفحك الخاص. قم بـ جلب Googlebot حقيقي — Test live URL في URL Inspection أو Rich Results Test — والذي يُظهر لك استجابة HTTP والصفحة المعروضة تمامًا كما يستقبلها Google. هكذا تكتشف خادمًا/CDN يقدم شيئًا لك وشيئًا آخر للزاحف.
كيفية إصلاحه والتحقق منه
بمجرد تأكيد أن noindex خطأ:
- أزل التوجيه من مصدره الحقيقي — وسم الميتا في القالب، أو
ترويسة
X-Robots-Tagفي إعدادات الخادم/نظام إدارة المحتوى/شبكة توصيل المحتوى. امسح أي ذاكرة تخزين مؤقت لشبكة توصيل المحتوى/الصفحة حتى يتم تقديم الإصلاح فعليًا. - تأكد من خلال جلب مباشر من Googlebot (فحص عنوان URL → اختبار عنوان URL المباشر) أن الصفحة الآن لا تُرجع أي noindex وتُظهر “URL متاح لـ Google.”
- اطلب الفهرسة لعناوين URL ذات الأولوية العالية، و/أو استخدم زر التحقق من الإصلاح في التقرير لإخبار Google بإعادة فحص المجموعة المتأثرة بالكامل.
- انتظر. إلغاء الفهرسة وإعادة الفهرسة ليسا فوريين — يجب على Google إعادة الزحف لرؤية التغيير أولاً، وإرشادات Google الخاصة هي أن توقيت إعادة الزيارة يعتمد على أهمية الصفحة ويمكن أن يستغرق وقتًا أطول بكثير من يوم أو يومين (توثق “أشهر” كاحتمال للصفحات ذات الأولوية المنخفضة). طلب الفهرسة على عنوان URL ذي أولوية هو كيف تطلب من Google المحاولة عاجلاً، وليس وسيلة لفرض جدول زمني محدد. لا داعي للذعر إذا استمرت الحالة أثناء إعادة المعالجة.
بالنسبة للعكس — صفحة تريد أن تكون noindexed لكنها عالقة في الفهرس
لأنها كانت محجوبة أيضًا بواسطة robots.txt — قم بإلغاء حظر الزحف أولاً حتى يتمكن Google من
رؤية noindex أخيرًا.
أين يقع هذا
هذه الحالة هي عقدة واحدة في تقرير فهرسة الصفحات من Google. التوجيه
الخاص بالروبوتات خلفها — noindex — يمكن تسليمه كوسم ميتا robots أو
ترويسة X-Robots-Tag، والأداة الصحيحة تعتمد على ما إذا كنت تعمل مع
ملفات HTML أو غير HTML. الحالات المجاورة (“مفهرس، على الرغم من حجبه بواسطة
robots.txt” و”تم الزحف — غير مفهرس حاليًا”) تصف حالات مختلفة و
تحتاج إلى إصلاحات مختلفة؛ إبقاؤها واضحة هو معظم المعركة.
ملخص الذكاء الاصطناعي
نظرة مختصرة على النسخة المتقدمة:
- المعنى: “URL محدد بـ ‘noindex’” هو حالة فهرسة الصفحات في GSC لصفحة
زحف إليها Google ووجد عليها
noindex— لذلك أبقاها خارج الفهرس عن قصد. كان على Google زحف الصفحة لرؤية التوجيه، وهو يحترم هذا التوجيه سواء كان في<head>أو في جسم الصفحة. - أسماء متعددة، حالة واحدة: الحالية “URL محدد بـ ‘noindex’”، والصياغة الأكثر دقة المرتبطة بخريطة الموقع “URL المقدمة محددة بـ ‘noindex’” التي تستخدمها التقارير والأدوات بشكل شائع، والصياغة القديمة “مستبعد بواسطة وسم ‘noindex’.”
- مختلف عن الحالات المجاورة: المحظور بواسطة robots.txt = لم يتم الزحف إليه أبدًا؛ “تم الزحف — غير مفهرس حاليًا” = تم الزحف، بدون توجيه؛ هذه الحالة = تم الزحف، وُجد noindex، وتم الامتثال له.
- عادةً مقصود. تحقق من قائمة URLs أولاً. صفحات الشكر، البحث الداخلي، الفلاتر، الإدارة = جيد، لا حاجة لإجراء. تصرف فقط إذا كانت صفحة تريد فهرستها موجودة في القائمة — أو إذا كان الـ URL محددًا بـ noindex لكنه لا يزال موجودًا في خريطة الموقع (تناقض، لأن إرسال خريطة الموقع هو تلميح لما تريد فهرسته، وليس ضمانًا): أزل noindex أو أزله من خريطة الموقع.
- طريقتان للتسليم: وسم meta robots في أي مكان في HTML المعروض
(وليس فقط في
<head>)، أو ترويسة HTTP X-Robots-Tag (الطريقة الوحيدة للملفات غير HTML مثل PDFs، والطريقة الخفية — غير موجودة في مصدر الصفحة). تحقق من كليهما، وتذكر أنه عندما تتعارض قواعد robots متعددة، يطبق Google القاعدة الأكثر تقييدًا. - تعارض robots.txt:
noindexيعتمد على الزحف. منع الزحف + noindex يأتي بنتيجة عكسية — لا يمكن لـ Google رؤية noindex لا يمكنه الزحف إليه، لذا يمكن أن تبقى الصفحة مفهرسة عبر الروابط. لإزالة صفحة: اسمح بالزحف + أبقِ noindex، ثم يمكنك اختياريًا منع الزحف بعد إلغاء الفهرسة. - noindex وهمي: المالك لا يرى أيًا، لكن Google يرى — عادةً CDN/ذاكرة تخزين مؤقت تقدم ترويسة قديمة، أو توجيه خاص بـ Googlebot فقط، أو تسريب من بيئة تجريبية/قالب (تعامل مع هذه كفرضيات للتأكيد، وليس أسبابًا مفترضة). صحيح باستخدام جلب Googlebot حقيقي (اختبار مباشر لفحص URL / اختبار النتائج المنسقة)، وليس عرض المصدر.
- إصلاح ← تحقق: أزل التوجيه من مصدره، امسح ذاكرات التخزين المؤقت، تأكد عبر جلب Googlebot مباشر، اطلب الفهرسة / تحقق من الإصلاح، ثم انتظر — إرشادات Google الخاصة تقول إن إعادة المعالجة تعتمد على أهمية الصفحة ويمكن أن تستغرق وقتًا أطول بكثير من يوم أو يومين، حتى أشهر للصفحات ذات الأولوية المنخفضة.
الوثائق الرسمية
وثائق من المصادر الأساسية من محركات البحث.
- تقرير فهرسة الصفحات — التقرير الذي يعيش فيه هذا الحالة؛ يحدد “URL محدد بـ ‘noindex’” و*“Indexed, though blocked by robots.txt”* (ترجمة) «مفهرس، على الرغم من حظره بواسطة robots.txt» (نصه الحالي لا يوضح بشكل منفصل “URL المقدم محدد بـ ‘noindex’” كاسم حالة متميز، على الرغم من أن التناقض الأساسي في خريطة الموقع الذي يصفه حقيقي).
- حظر فهرسة البحث باستخدام noindex — ما يفعله
noindex، وطرق علامة meta مقابل رأس X-Robots-Tag، والقاعدة المعتمدة على الزحف (الصفحة المحظورة لا ترى أبدًا noindex)، وملاحظة Google الخاصة بأن إعادة زيارة صفحة بعد تغيير قد تستغرق أشهرًا اعتمادًا على أهميتها. - مواصفات علامة Robots meta وdata-nosnippet وX-Robots-Tag — كيفية حل قواعد robots المتعارضة (القاعدة الأكثر تقييدًا تفوز) وتأكيد أن Google تحترم أيضًا علامة robots meta الموضوعة في جسم الصفحة، وليس فقط في
<head>. - مقدمة إلى robots.txt — لماذا يتحكم robots.txt في الزحف، وليس الفهرسة، ولماذا ليس أداة لإلغاء الفهرسة.
- أداة فحص URL — “اختبار URL المباشر” يجلب الصفحة كـ Googlebot، وهي الطريقة لاكتشاف التوجيهات المقدمة فقط إلى Google.
- بناء وإرسال خريطة موقع — يجب أن تدرج خرائط المواقع عناوين URL التي تريدها في البحث، وإرسال واحدة هو تلميح إلى Google، وليس ضمانًا للزحف أو الفهرسة.
Bing / Microsoft
- أدوات مشرفي المواقع من Bing — المساعدة والإرشادات — يكرم Bing علامة robots
<meta name="robots" content="noindex">ورأسX-Robots-Tagبنفس الطريقة؛ تعرض تقارير الفهرس الخاصة به الصفحات غير المفهرسة بشكل مشابه. (أولوية أقل لهذه الحالة الخاصة بـ Google.)
اقتباسات من المصدر
تصريحات رسمية من Google، بالإضافة إلى كتاباتي الخاصة حول تعارض robots.txt. كل رابط هو رابط عميق يقفز إلى المقطع المقتبس في صفحة المصدر.
Google — ماذا تعني الحالة
- “When Google tried to index the page it encountered a ‘noindex’ directive and therefore did not index it.” (ترجمة) «عندما حاول Google فهرسة الصفحة، واجه توجيه ‘noindex’ وبالتالي لم يقم بفهرستها.» — مساعدة Google Search Console (تقرير فهرسة الصفحات). الانتقال إلى الاقتباس
Google — noindex يعتمد على الزحف
- “For the noindex rule to be effective, the page or resource must not be blocked by a robots.txt file, and it has to be otherwise accessible to the crawler. If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see the noindex rule, and the page can still appear in search results, for example if other pages link to it.” (ترجمة) «لكي تكون قاعدة noindex فعالة، يجب ألا تكون الصفحة أو المورد محظورًا بواسطة ملف robots.txt، ويجب أن يكون الوصول إليه ممكنًا للزاحف. إذا كانت الصفحة محظورة بواسطة ملف robots.txt أو لم يتمكن الزاحف من الوصول إلى الصفحة، فلن يرى الزاحف أبدًا قاعدة noindex، ويمكن أن تظل الصفحة تظهر في نتائج البحث، على سبيل المثال إذا كانت صفحات أخرى ترتبط بها.» — وثائق Google Search Central (حظر فهرسة البحث باستخدام noindex). الانتقال إلى الاقتباس
- “Depending on the importance of the page on the internet, it may take months for Googlebot to revisit a page.” (ترجمة) «اعتمادًا على أهمية الصفحة على الإنترنت، قد يستغرق الأمر أشهرًا حتى يعيد Googlebot زيارة الصفحة.» — وثائق Google Search Central (حظر فهرسة البحث باستخدام noindex)، حول المدة التي قد تستغرقها إعادة المعالجة بعد تغيير noindex. قراءة المقال
Google — القواعد المتعارضة وأين يمكن أن يعيش التوجيه
- “Google Search doesn’t enforce placement of meta robots in the HTML head and will respect robots meta tags in the body section of an HTML document as well.” (ترجمة) «لا يفرض بحث Google وضع meta robots في رأس HTML وسيحترم علامات meta robots في قسم الجسم من مستند HTML أيضًا.» — وثائق Google Search Central (مواصفات Robots meta tag وdata-nosnippet وX-Robots-Tag). اقرأ المقال
- “In the case of conflicting robots rules, the more restrictive rule applies.” (ترجمة) «في حالة تعارض قواعد robots، تنطبق القاعدة الأكثر تقييدًا.» — وثائق Google Search Central (نفس المواصفات). اقرأ المقال
Patrick Stox (Ahrefs) — تعارض robots.txt
- “If you block a page from being crawled, Google may still index it because crawling and indexing are two different things.” (ترجمة) «إذا قمت بحظر صفحة من الزحف، فقد يستمر Google في فهرستها لأن الزحف والفهرسة شيئان مختلفان.» — أنا، “Indexed, though blocked by robots.txt” (ترجمة) «مفهرس، رغم حظره بواسطة robots.txt»، في مقال Can Be More Than A Robots.txt Block (Ahrefs). انتقل إلى الاقتباس
- “Unless Google can crawl a page, they won’t see the noindex meta tag and may still index it because it has links.” (ترجمة) «ما لم يتمكن Google من زحف صفحة، فلن يرى علامة noindex الوصفية وقد يستمر في فهرستها لأنها تحتوي على روابط.» — أنا (نفس المقال). اقرأ المقال
- “Just add a noindex meta robots tag and make sure to allow crawling—assuming it’s canonical.” (ترجمة) «فقط أضف علامة noindex meta robots وتأكد من السماح بالزحف—بافتراض أنها canonical.» — أنا (نفس المقال). اقرأ المقال
قائمة فحص معالجة “URL marked ‘noindex’”
اعمل من الأعلى إلى الأسفل — معظم هذه تنتهي عند الخطوة 2 بـ “لا حاجة لإجراء.”
- افتح قائمة عناوين URL المتأثرة في تقرير Page Indexing (انقر على صف الحالة).
- قرر ما إذا كان مقصودًا أم عرضيًا: هل هذه الصفحات التي قصدت استبعادها (شكرًا، بحث داخلي، جوانب، إدارة، staging)؟ إذا كان الجواب نعم → انتهيت.
- هل عنوان URL موجود أيضًا في خريطة موقعك المقدمة (غالبًا ما يظهر كـ
“Submitted URL marked ‘noindex’”)؟ حل التناقض: أزل
noindex(للفهرسة) أو أزل عنوان URL من خريطة الموقع (لإبقائه خارجًا). - للصفحات التي يجب فهرستها، ابحث عن التوجيه في كلا المكانين:
-
<head>المعروض لـ<meta name="robots" ... noindex>(تحقق من DOM المعروض، وليس فقط View Source). - ترويسات الاستجابة لـ
X-Robots-Tag: noindex(curl -Iأو DevTools → Network).
-
- أكد ما يراه Googlebot باستخدام URL Inspection → Test live URL (أو Rich Results Test) — يلتقط التوجيهات الخاصة بـ Googlebot فقط / المقدمة عبر CDN.
- تحقق من تعارض robots.txt: عنوان URL ليس أيضًا ممنوعًا (المنع يخفي noindex ويمكن أن يترك الصفحة مفهرسة).
- أزل التوجيه من مصدره الحقيقي (قالب / خادم / CMS / CDN)، ثم امسح أي CDN أو ذاكرة تخزين مؤقت للصفحة.
- أعد الاختبار المباشر أن الصفحة الآن لا تُرجع noindex.
- اطلب الفهرسة و/أو اضغط Validate Fix؛ ثم انتظر — توقيت إعادة الزحف ليس ثابتًا. يقول Google إنه يعتمد على أهمية الصفحة ويمكن أن يستغرق وقتًا أطول بكثير من يوم أو يومين، حتى أشهر للصفحات ذات الأولوية المنخفضة.
أوراق الغش
الأسماء الثلاثة — نفس الحالة
| التسمية التي رأيتها | متى تظهر | الخطورة |
|---|---|---|
| URL marked ‘noindex’ | زحف Google إلى الصفحة ووجد noindex | معلومات (ضمن “غير مفهرس”) — غالبًا مقصود |
| Submitted URL marked ‘noindex’ | نفس الحالة، لكن عنوان URL كان في خريطة موقع مقدمة | غالبًا يظهر كصف بمستوى خطأ — بغض النظر عن التسمية، تناقض يجب حله |
| Excluded by ‘noindex’ tag | اسم قديم (قبل تقرير تغطية الفهرسة لعام 2021) | نفس “URL marked ‘noindex’” |
موضع noindex: وسم meta أم ترويسة X-Robots-Tag
| وسم meta robots | ترويسة X-Robots-Tag | |
|---|---|---|
| الشكل | <meta name="robots" content="noindex"> | X-Robots-Tag: noindex |
| المكان | داخل <head> للصفحة (HTML) | ترويسات استجابة HTTP |
| ظاهر في عرض المصدر؟ | نعم (إذا لم يكن محقونًا عبر JavaScript) | لا — تحقق عبر curl -I / أدوات المطور |
| يُعيّن بواسطة | قالب / نظام إدارة المحتوى / محرر الصفحة | الخادم / نظام إدارة المحتوى / إعدادات CDN |
| يعمل لغير HTML (PDF، صورة، فيديو)؟ | لا (لا يوجد <head>) | نعم |
| استهداف محرك واحد؟ | name="googlebot" إلخ. | X-Robots-Tag: googlebot: noindex |
كيف يختلف هذا الحال عن الحالات المجاورة
| الحالة | تم الزحف؟ | تم العثور على توجيه؟ | المعنى |
|---|---|---|---|
| URL marked ‘noindex’ | نعم | noindex | امتثل Google لتوجيه noindex الخاص بك |
| Indexed, though blocked by robots.txt | لا | غير متاح (لا يمكن قراءته) | محظور من الزحف لكنه مفهرس عبر الروابط |
| Crawled — currently not indexed | نعم | لا يوجد | لا توجيه؛ اختار Google ببساطة عدم الفهرسة |
شجرة قرار: مقصود أم عرضي
| السؤال | إذا نعم | إذا لا |
|---|---|---|
| هل هذه الصفحات كنت تقصد استبعادها؟ | لا إجراء | انزل ↓ |
| هل هي نسخة الخطأ “Submitted”؟ | أزل noindex أو أزلها من خريطة الموقع | انزل ↓ |
| هل تريد فهرسة هذه الصفحة؟ | ابحث عن noindex وأزله، ثم تحقق من الإصلاح | اتركها (وأزلها من خريطة الموقع إذا كانت موجودة) |
النماذج الذهنية
1. تم الزحف ورؤيته. هذه الحالة موجودة فقط لأن Google زحف إلى الصفحة وقرأ توجيهًا. هذه الحقيقة الواحدة تميزها عن المحظورة بواسطة robots.txt (لم يتم الزحف إليها أبدًا) وعن “Crawled — currently not indexed” (تم الزحف، لا توجيه). حدد أيًا من الثلاثة أنت فيه قبل أن تلمس أي شيء.
2. “غير مفهرس” ≠ معطل. الافتراض الافتراضي يجب أن يكون مقصودًا، وليس خطأً. تحقق من قائمة عناوين URL أولاً؛ في معظم الأحيان الإجراء الصحيح هو عدم فعل أي شيء. التركيبة الوحيدة التي تستحق معاملة عاجلة هي عنوان URL به noindex موجود أيضًا في خريطة موقعك المقدمة — لأن خريطة الموقع تهدف إلى سرد ما تريد فهرسته (الإرسال هو مجرد تلميح لـ Google، وليس ضمانًا)، وعنوان URL في خريطة الموقع مع noindex يتناقض مع ذلك.
3. مصدران، تحقق دائمًا من كليهما.
noindex إما وسم meta (داخل <head> المعروض) أو ترويسة X-Robots-Tag
(في استجابة HTTP). الترويسة غير مرئية في عرض المصدر، لذا “ليس لدي noindex” عادةً تعني “لم أتحقق من الترويسة.” تحقق من كليهما، في كل مرة.
4. يعتمد على الزحف — لا تقم أبدًا بإقران noindex مع منع الزحف. يجب أن يزحف Google إلى الصفحة ليرى noindex. منع الزحف في robots.txt يجعل noindex غير مرئي، تاركًا الصفحة قابلة للفهرسة عبر الروابط. لإزالة صفحة: اسمح بالزحف + أبقِ noindex، انتظر إلغاء الفهرسة، ثم يمكنك اختياريًا منع الزحف.
5. ثق برؤية Googlebot، وليس رؤية متصفحك. بالنسبة لـ noindex الوهمي (لا ترى أيًا، لكن GSC يرى واحدًا)، عرض المصدر في متصفحك هو الأداة الخاطئة. يمكن لـ CDN أو ذاكرة تخزين مؤقت أو قاعدة وكيل مستخدم أن تُظهر لـ Googlebot شيئًا مختلفًا. شخّص باستخدام جلب Googlebot حقيقي — الاختبار المباشر في URL Inspection أو Rich Results Test — الذي يُظهر الاستجابة الدقيقة التي يتلقاها Google.
دليل التنفيذ: لقد رأيت للتو حالة “marked ‘noindex’”
اقرأ هذا من الأعلى إلى الأسفل في أول مرة تصادف فيها إحدى هذه الحالات. تفرع عند كل “إذا رأيت” — معظم المسارات تنتهي مبكرًا.
1. افتح تقرير فهرسة الصفحات وانقر على صف الحالة. لاحظ أي من التسميات الثلاثة هو: “URL marked ‘noindex’” أو “Submitted URL marked ‘noindex’” أو التسمية القديمة “Excluded by ‘noindex’ tag”. اسحب القائمة الكاملة لعناوين URL المتأثرة — لا تحكم من العدد وحده.
2. امسح قائمة عناوين URL للتعرف على شكلها. إذا رأيت في الغالب صفحات شكر، أو بحثًا داخليًا، أو عناوين URL للفلاتر/الأوجه، أو صفحات إدارية/حسابات — فهذه صفحات تريد عادةً إبقاءها خارج الفهرس. → توقف هنا. لا حاجة لأي إجراء؛ هذا هو النظام يعمل كما هو مقصود.
3. إذا رأيت عنوان URL تريد فعلاً أن يظهر في نتائج البحث، اعزله.
شخص ما أو شيء ما وضع noindex على صفحة يجب أن تكون قابلة للفهرسة. انتقل إلى الخطوة 4 لمعرفة مصدر ذلك.
4. إذا كانت التسمية “Submitted URL marked ‘noindex’” — أو لاحظت فقط أن عنوان URL
مُعلَّم بـ noindex وهو أيضًا في خريطة موقعك — تعامل معه كأمر عاجل.
إرسال خريطة الموقع يُقصد به الإشارة إلى عناوين URL التي تريدها في البحث (تتعامل Google معها كتلميح، وليس كضمان)، لذا فإن وجود noindex على نفس عنوان URL هو تناقض مباشر، وتُظهره العديد من التقارير والأدوات كصف بمستوى خطأ لهذا السبب بالضبط. قرر أي الجانبين صحيح — تريد فهرسته (أزل noindex) أو لا تريده (أزله من خريطة الموقع) — وحل التناقض في نفس اليوم الذي تجده فيه.
5. حدد موقع التوجيه.
افحص <head> المعروض بحثًا عن وسم <meta name="robots" content="noindex">، ثم افحص ترويسات الاستجابة (curl -I أو DevTools → Network) بحثًا عن X-Robots-Tag: noindex. إذا لم يُظهر أي منهما شيئًا وما زال GSC يبلغ عن واحد، فمن المحتمل أن لديك noindex وهمي — انتقل إلى الخطوة 6.
6. إذا كان عرض المصدر نظيفًا ولكن GSC ما زال يقول noindex، فلا تثق بمتصفحك. قم بجلب مباشر من Googlebot (URL Inspection → Test live URL، أو Rich Results Test). ابحث عن CDN/ذاكرة تخزين مؤقت تقدم ترويسة قديمة، أو توجيهًا مشروطًا بوكيل المستخدم، أو قالبًا تجريبيًا يتسرب إلى الإنتاج.
7. إذا كان عنوان URL محظورًا أيضًا في robots.txt، أصلح ذلك أولاً.
الحظر يخفي noindex عن Google تمامًا، لذا لن يسري أي شيء تفعله بـ noindex حتى يُسمح بالزحف مرة أخرى. أزل الحظر (أو انتظر حتى يُرفع) قبل المتابعة.
8. أزل التوجيه من مصدره الحقيقي — القالب، إعداد الخادم، حقل CMS، أو قاعدة حافة CDN — وامسح أي ذاكرة تخزين مؤقت تقف أمامه.
9. أعد التحقق بجلب مباشر من Googlebot أن الصفحة لم تعد تُرجع noindex، ثم استخدم Request Indexing لعناوين URL ذات الأولوية و/أو Validate Fix للمجموعة المتأثرة بأكملها.
10. انتظر وأعد الفحص. إعادة الزحف وإعادة الفهرسة ليست فورية، ولا يوجد وقت استجابة ثابت — إرشادات Google نفسها تقول إن توقيت إعادة الزيارة يعتمد على أهمية الصفحة ويمكن أن يمتد لأشهر للصفحات ذات الأولوية المنخفضة، وليس أيامًا فقط. Request Indexing يطلب من Google المحاولة عاجلاً؛ لا يضمن جدولًا زمنيًا. وإذا حظرت الصفحة في الخطوة 7 فقط لتوفير ميزانية الزحف بعد الإزالة، فهذه هي الحالة الوحيدة التي يكون فيها الحظر بعد noindex صحيحًا.
البرامج النصية والمقتطفات
افحص ترويسات الاستجابة (macOS/Linux، shell) — الطريقة الوحيدة لرؤية X-Robots-Tag، لأنه لا يظهر أبدًا في عرض المصدر:
curl -sI -A "Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)" "https://example.com/page/" | grep -i "x-robots-tag\|^HTTP"افحص ترويسات الاستجابة (Windows، PowerShell) — نفس الفحص، بدون الحاجة إلى curl:
$r = Invoke-WebRequest -Uri "https://example.com/page/" -UserAgent "Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)" -UseBasicParsing
$r.Headers["X-Robots-Tag"]
$r.StatusCodeابحث عن وسم meta robots في DOM المعروض (وحدة تحكم DevTools) — الصق في لوحة Console على الصفحة الحية؛ يلتقط الوسوم المحقونة بواسطة مدير الوسوم التي قد يفوتها عرض المصدر الخام:
[...document.querySelectorAll('meta[name="robots"], meta[name="googlebot"]')].map(m => m.outerHTML)Bookmarklet — تحقق من وسم meta robots للصفحة الحالية بنقرة واحدة. احفظه كإشارة مرجعية مع هذا كعنوان URL، ثم انقر عليه على أي صفحة تدققها:
javascript:(function(){var m=[...document.querySelectorAll('meta[name="robots"],meta[name="googlebot"]')].map(function(x){return x.outerHTML}).join('\n')||'No meta robots tag found in DOM';alert(m);})();Regex — استخرج noindex من تصدير HTML مجمع. إذا كنت تبحث في مجموعة من ملفات مصدر الصفحة المحفوظة أو تصدير زحف عن قيم content="...noindex..."، فإن هذا يلتقط سمة content الكاملة حتى تتمكن من رؤية ما إذا كان noindex مقترنًا بشيء آخر (مثل nofollow أو noarchive):
<meta\s+name=["'](?:robots|googlebot)["']\s+content=["']([^"']*)["']مجموعة الالتقاط (([^"']*)) هي قائمة التوجيهات الكاملة — تحقق منها بحثًا عن noindex تحديدًا بدلاً من افتراض أن التطابق يعني noindex، لأن نفس الوسم يمكن أن يحمل noarchive أو توجيهات أخرى بدونه.
أدوات لهذه المهمة
أدوات هذا الموقع
- فاحص فهرسة Google — يجلب عنوان URL كـ Googlebot ويبلغ عن إشارات قابلية الفهرسة الملاحظة: الحالة، وإعادة التوجيه، وتوجيهات noindex (وسم meta وترويسة)، وتلميحات canonical، كل ذلك في تمريرة واحدة. من الواضح أنه لا يمكنه رؤية حالة فهرس Google الفعلية — فقط Search Console يمكنه ذلك — لكنه أسرع طريقة للتحقق من مجموعة noindex + canonical + الحالة قبل أن تذهب إلى GSC.
- فاحص ترويسات HTTP — ترويسات الاستجابة الخام لعنوان URL، بما في ذلك
X-Robots-Tag. استخدم هذا عندما تحتاج تحديدًا إلى تأكيد noindex قائم على الترويسة (أو تأكيد اختفائه بعد الإصلاح)، بشكل منفصل عن أي شيء في HTML الصفحة. - مختبر robots.txt — يتحقق مما إذا كان عنوان URL معينًا محظورًا لوكيل مستخدم معين. شغّل هذا كلما كنت تشخّص noindex لا يبدو أنه يعمل — منع الوصول على نفس عنوان URL هو السبب الكلاسيكي.
أدوات الطرف الثالث
- Google Search Console — تقرير فهرسة الصفحات (حيث توجد هذه الحالة)، وتقرير خريطة الموقع (لبديل “Submitted”)، وURL Inspection → Test live URL، الأداة الوحيدة التي تعرض لك جلب Googlebot ونتيجته في الوقت الفعلي.
- Rich Results Test — جلب Googlebot حي آخر؛ مفيد كقراءة ثانية على استجابة HTTP ولقطة الصفحة المعروضة عندما تتعقب noindex وهميًا أو مخدومًا عبر CDN.
اختبارات التحقق
شغّل هذه الاختبارات بعد إزالة noindex لم تكن تريده، أو بعد حل تناقض “Submitted URL marked ‘noindex’”.
الاختبار 1: الترويسة لم تعد ترسل X-Robots-Tag: noindex
- الاختبار الذي يجب تشغيله:
curl -Iعلى عنوان URL (أو فاحص ترويسات HTTP) وافحص ترويسات الاستجابة. - النتيجة المتوقعة: لا توجد ترويسة
X-Robots-Tag، أو واحدة بدونnoindexفيها. - تفسير الفشل: التوجيه ما زال يُقدَّم — تحقق من إعدادات الخادم/CMS مرة أخرى، وامسح أي ذاكرة تخزين مؤقت لـ CDN أو حافة قد تقدم استجابة قديمة.
- نافذة المراقبة: فورية — هذا جلب حي، وليس إشارة تعتمد على الزحف.
- مشغل التراجع: غير قابل للتطبيق (هذا الاختبار لا يغير شيئًا)؛ أعد التشغيل بعد كل تغيير في الإعدادات أو الذاكرة المؤقتة حتى ينجح.
الاختبار 2: الصفحة المعروضة لا تحتوي على meta robots noindex
- الاختبار الذي يجب تشغيله: فاحص فهرسة Google أو فحص DevTools/عرض المصدر للـ
<head>المعروض. - النتيجة المتوقعة: لا يوجد
<meta name="robots" content="noindex">(أو بديلgooglebot) في DOM المعروض. - تفسير الفشل: قالب أو مدير وسوم أو حقن JS ما زال يضيف الوسم — تحقق من DOM المعروض، وليس فقط المصدر الخام.
- نافذة المراقبة: فورية.
- مشغل التراجع: غير قابل للتطبيق؛ أعد التشغيل بعد كل تغيير في القالب/الإعدادات.
الاختبار 3: جلب Googlebot الحي يؤكد أن الصفحة قابلة للفهرسة
- الاختبار الذي يجب تشغيله: GSC URL Inspection → Test live URL.
- النتيجة المتوقعة: “URL is available to Google” بدون الإشارة إلى noindex في نتيجة الاختبار الحي.
- تفسير الفشل: Googlebot يرى شيئًا لا يراه متصفحك — تحقق من توجيه مشروط بوكيل المستخدم أو قاعدة CDN تقدم لـ Google استجابة مختلفة عن التي تحصل عليها.
- نافذة المراقبة: فورية لنتيجة الاختبار الحي نفسها.
- مشغل التراجع: إذا كان الاختبار الحي ما زال يظهر noindex بعد تغيير الإعدادات وتنظيف الذاكرة المؤقتة، تعامل مع الإصلاح على أنه غير مفعّل بعد واستمر في التصحيح قبل طلب الفهرسة.
الاختبار 4: عنوان URL غير محظور أيضًا بواسطة robots.txt
- الاختبار المطلوب تشغيله: مختبر robots.txt على نفس الرابط.
- النتيجة المتوقعة: مسموح لـ Googlebot.
- تفسير الفشل: وجود قاعدة disallow يخفي أي حالة noindex موجودة — لا يمكن لـ Google إعادة الزحف لرؤية إصلاحك. قم بإزالة قاعدة disallow أولاً.
- نافذة المراقبة: فورية.
- مشغل التراجع: غير قابل للتطبيق؛ يجب أن ينجح هذا الاختبار قبل أن تكون الاختبارات الأخرى ذات معنى لصفحة تريد فهرستها.
الاختبار 5: تقرير فهرسة الصفحات يزيل الحالة
- الاختبار المطلوب تشغيله: تقرير فهرسة الصفحات في GSC، بعد النقر على Validate Fix على المجموعة المتأثرة (أو Request Indexing لرابط ذي أولوية واحدة).
- النتيجة المتوقعة: ينتقل الرابط من “URL marked ‘noindex’” / “Submitted URL marked ‘noindex’” إلى “Indexed” (أو الحالة المقصودة) في التقرير.
- تفسير الفشل: لا يزال في انتظار إعادة الزحف، أو أن التوجيه لا يزال موجودًا في مكان لم تتحقق منه (أعد تشغيل الاختبارات 1–3).
- نافذة المراقبة: متغيرة، وليست ثابتة — يعمل التحقق في الخلفية وفقًا لجدول إعادة الزحف الخاص بـ Google. توثق Google أن توقيت إعادة الزيارة يعتمد على أهمية الصفحة وقد يستغرق وقتًا أطول بكثير من بضعة أيام، حتى أشهر للصفحات ذات الأولوية المنخفضة؛ لا تعتبر التحديث البطيء فشلًا بحد ذاته.
- مشغل التراجع: إذا لم يتحرك التحقق بعد انتظار طويل حقًا (وكانت الاختبارات 1–4 جميعها ناجحة)، أعد التحقق من الاختبارات 1–4 بالترتيب بدلاً من إعادة إرسال نفس الإصلاح.
اختبار
خمسة أسئلة للتحقق مما تمكنت فعليًا من استيعابه من هذه المقالة.
سجل التغييرات
تم التحديث في 6 أغسطس 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 6 أغسطس 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 6 أغسطس 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 18 يوليو 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.