توجيه Noindex
يبقي Noindex الصفحة خارج نتائج البحث، ولكن فقط إذا استطاع Google الزحف إليها. تعرّف إلى الطريقتين الصحيحتين، وفخ robots.txt، وكيفية التحقق من نجاحه.
اللغات
Noindex هو التوجيه الذي يبقي الصفحة خارج الفهرس فلا تظهر في نتائج البحث. توجد طريقتان صحيحتان لتعيينه: وسم robots meta (`<meta name="robots" content="noindex">`) وترويسة HTTP المسماة `X-Robots-Tag: noindex`، وهي الخيار الوحيد للملفات غير HTML مثل PDF. الخطأ الأكبر هو أن الصفحة المحظورة في robots.txt لا يمكن تطبيق noindex عليها لأن Google لا يزحف إليها ليرى القاعدة؛ ولإزالة صفحة يجب السماح بالزحف إليها وتقديم noindex. لا تضع noindex في robots.txt (غير مدعوم منذ 1 سبتمبر 2019)، وإذا اجتمع noindex وcanonical فتعامل مع ذلك كفحص للقصد لا كخطأ تلقائي، وتذكر أن إلغاء الفهرسة لا يحدث إلا بعد إعادة الزحف.
باختصار — توجيه Noindex هو الطريقة التي تقول بها لـ Google: «لا تضع هذه الصفحة في نتائج البحث». تضيفه كوسم صغير في شفرة الصفحة (أو كترويسة HTTP لملفات مثل PDF). والقاعدة التي توقع الجميع في الخطأ هي أن Google يجب أن يكون قادرًا على الزحف إلى الصفحة كي يرى الوسم؛ لذلك لا تحظرها أيضًا في robots.txt، وإلا يفشل الأمر كله بصمت.
ما الذي يفعله noindex؟
يبقي noindex الصفحة خارج فهرس البحث. وإذا لم تكن الصفحة في الفهرس، فلن
تظهر في نتائج البحث. هذه هي مهمته كاملة: فهو لا يخفي الصفحة عن الزوار، ولا
يجعلها أسرع تحميلًا، ولا يمرر أو يمنع «قيمة الروابط» في حد ذاته؛ بل يبقي الصفحة
خارج نتائج Google وBing فحسب. Evidence for this claim Google's noindex rule prevents the page, media, or resource from appearing in Google Search results after Google sees the rule. Scope: Google Search; noindex is not an access-control or privacy mechanism. Confidence: high · Verified: Google Search Central: Block Search indexing with noindex
تستخدمه للصفحات الموجودة لخدمة الناس لكنها لا ينبغي أن تنافس في الترتيب: صفحات نتائج البحث الداخلي، وصفحات «شكرًا لك» بعد إرسال نموذج، وصفحات الوسوم أو الفلاتر ضعيفة المحتوى، وصفحات التجهيز أو الأدوات المساعدة.
الطريقتان لإضافته
لا توجد سوى طريقتين صحيحتين. اختر إحداهما.
1. وسم robots meta. ضع السطر التالي داخل <head> في الصفحة:
<meta name="robots" content="noindex">هذه هي الطريقة المعتادة لصفحة HTML. وتوفر معظم أنظمة إدارة المحتوى (مثل WordPress وShopify) مربع اختيار يضيفه نيابةً عنك؛ ففي كثير من إضافات SEO يكون خيارًا في محرر الصفحة بمعنى «ثنِ محركات البحث عن فهرسة هذه الصفحة».
2. ترويسة HTTP المسماة X-Robots-Tag. بعض الملفات لا تحتوي على <head>
لوضع وسم فيه، مثل PDF أو صورة أو فيديو. لهذه الملفات ترسل التوجيه في ترويسة
استجابة HTTP من الخادم بدلًا من ذلك:
X-Robots-Tag: noindexلن ترى هذه الترويسة في مصدر الصفحة؛ فهي موجودة في ترويسات الاستجابة. Evidence for this claim Google supports noindex in an HTML robots meta tag or an X-Robots-Tag HTTP response header. Scope: Google Search delivery methods; the HTTP header is applicable to non-HTML resources as well as HTML. Confidence: high · Verified: Google Search Central: Robots meta tag and X-Robots-Tag specifications
الخطأ الذي يعطل noindex
هذا هو الخطأ الأكبر، لذا سأقوله بوضوح: لا يمكن تطبيق noindex على صفحة محظورة
في robots.txt.
قد يبدو ذلك معكوسًا، لكن السبب بسيط. يخبر robots.txt محركات البحث بألا تزحف
إلى الصفحة، بينما يوجد وسم noindex داخل الصفحة. فإذا مُنع Google من الزحف
إليها فلن يجلبها، وبالتالي لن يرى الوسم؛ وقد تبقى الصفحة في الفهرس، وأحيانًا
تظهر كرابط URL مجرد بلا وصف.
لذلك فإن الوصفة الصحيحة لإزالة صفحة هي عكس ما قد يبدو أكثر أمانًا:
- تأكد من أن الصفحة غير محظورة في
robots.txt(اسمح لـ Google بالزحف إليها). - أضف
noindex(وسم meta أو الترويسة). - انتظر إعادة زحف Google. إلغاء الفهرسة ليس فوريًا؛ بل يحدث في المرة التالية التي يجلب فيها Google الصفحة ويرى التوجيه.
هناك فحوص أخرى تغطيها علامة تبويب متقدم بالكامل: لا تضع noindex
داخل ملف robots.txt (فهذا لم يعد يعمل منذ 2019)، وراجع القصد عندما يظهر
noindex وcanonical معًا. قد يكون الجمع مقصودًا؛ لكن canonical الذي يشير إلى
عنوان آخر هو التحذير الأقوى لأن الإشارتين تطلبان نتيجتين مختلفتين.
هل تريد أمثلة الخادم الدقيقة، وتفصيل noindex,follow، والخلفية التاريخية،
وطريقة التحقق في Google Search Console؟ انتقل إلى علامة تبويب متقدم.
اختبر نفسك: noindex
اختر noindex فقط عندما يكون هدفك الإزالة
Noindex, disallow, canonical, or nofollow?
أول أربعة إخفاقات يجب فحصها في noindex
- noindex مع منع robots.txt. لا يستطيع الزاحف جلب عنوان URL، فلا يكتشف توجيه الإزالة. أزل الحظر، وأبقِ noindex، واسمح بإعادة الزحف.
- noindex مع canonical. تطلب إحدى الإشارتين «إزالة هذه الصفحة»، بينما تطلب الأخرى من المحركات دمجها مع نسخة مكررة مفضلة. استخدم canonical لدمج النسخ المكررة وnoindex للإزالة الحقيقية، وليس كليهما للغرض نفسه.
Noindex:داخل robots.txt. ليست قاعدة يدعمها Google. استخدم وسم robots meta أو ترويسة الاستجابةX-Robots-Tag.- noindex مع إبقاء URL في خريطة الموقع. توصي إرشادات Google بإرسال عناوين
URL الأساسية التي تريد ظهورها في البحث؛ ولا مكان لعنوان noindex هناك. لن
يتجاوز بقاؤه توجيه
noindex، لكنه يرسل إشارة متعارضة عن قصدك وقد يربك من يراجع خريطة الموقع لاحقًا. احذف عناوين noindex منها بعد انتهاء متابعة الإزالة.
تجنب أيضًا استخدام noindex للتحكم في الوصول. تظل الصفحة متاحة للعامة عند طلبها؛ لذا احمِ المحتوى الخاص بالمصادقة.
إصلاح حالة “Indexed, though blocked by robots.txt”
تعني هذه الحالة أن حظر الزحف لم يضمن الإزالة. قد يعرف Google عنوان URL من الروابط دون جلب محتواه، بينما يمنعه الحظر من رؤية توجيه noindex في الصفحة.
- تأكد من أن المطلوب إزالة URL، لا مجرد تقليل وتيرة الزحف إليه.
- أزل قاعدة المنع ذات الصلة في robots.txt للزاحف المستهدف.
- قدم
noindexفي رأس HTML أو كترويسةX-Robots-Tag. - افحص الاستجابة النهائية بعد عمليات إعادة التوجيه، وتأكد من عدم إزالة التوجيه في نسخة يرسلها CDN أو قالب مختلف.
- استخدم الاختبار المباشر في URL Inspection لإثبات أن Google يستطيع الجلب ويرى noindex.
- اطلب إعادة الزحف إن كان ذلك مناسبًا، ثم راقب تقرير Page Indexing.
- لا تفكر في إعادة الحظر بعد الإزالة إلا إذا كنت تفهم أن الاكتشاف والمعالجة مستقبلًا قد يصبحان محدودين من جديد.
إذا كان المحتوى سريًا، فتوقف هنا وأضف المصادقة؛ فلا robots.txt ولا noindex آلية أمنية.
تقديم noindex للملفات غير HTML
مثال Apache لاستجابات PDF:
<FilesMatch "\.pdf$">
Header set X-Robots-Tag "noindex"
</FilesMatch>مثال Nginx:
location ~* \.pdf$ {
add_header X-Robots-Tag "noindex" always;
}تحقق من ملف ممثل واتبع عمليات إعادة التوجيه:
curl -sSIL https://example.com/file.pdf | grep -iE '^(HTTP/|location:|x-robots-tag:)'ضيّق نطاق قواعد الخادم، واختبر ملف PDF مقصودًا وصفحة HTML ينبغي أن تبقى قابلة للفهرسة. قد تؤدي قاعدة واسعة للموقع أو لنمط الملفات إلى تطبيق noindex بالخطأ على عائلة كاملة من الأصول أو على قسم كامل من الموقع.
راقب noindex باعتباره مجموعة عناوين URL مملوكة
تغطية النشر
Approved noindex URLs serving noindex ÷ all URLs in the approved noindex set
قِس الاستجابة الحية، لا حقل CMS. وقسّم الإخفاقات حسب وسم HTML meta، وترويسة
X-Robots-Tag، ووجهة إعادة التوجيه، وإتاحة الزحف في robots.txt.
نتيجة المعالجة
تتبّع المجموعة المعتمدة عبر حالات Google Search Console: مفهرسة، و“URL marked ‘noindex’”، ومحظورة بواسطة robots.txt، ولم يُعد الزحف إليها بعد. الاتجاه المفيد هو انخفاض عناوين URL المعتمدة التي ما زالت مفهرسة، وانخفاض تعارضات حظر الزحف مع noindex بعد النشر.
تتبّع أيضًا noindex غير المقصود على نحو منفصل: عناوين URL المراد ترتيبها لكنها تقدم التوجيه أو تظهر تحت سبب noindex في تقرير Page Indexing. استخدم خط أساس قبل النشر ومخزون URL الخاصين بك؛ فلا توجد نسبة عالمية يمكن الدفاع عنها للمقدار الذي ينبغي تطبيق noindex عليه في أي موقع.
باختصار — يزيل
noindexالصفحة من الفهرس بإحدى طريقتين صحيحتين: وسم robots meta (<meta name="robots" content="noindex">) أو ترويسة HTTP المسماةX-Robots-Tag: noindex(وهي مطلوبة للملفات غير HTML مثل PDF). والمشكلة الجوهرية أن الصفحة المحظورة في robots.txt لا يمكن تطبيق noindex عليها؛ إذ لا يزحف Google إليها ليرى القاعدة: “the crawler will never see thenoindexrule,” (ترجمة) «لن يرى الزاحف قاعدة noindex أبدًا»، وقد يبقى URL المرتبط مفهرسًا. لذلك، لإزالة صفحة: اسمح بالزحف وقدمnoindex. لا تضع noindex في robots.txt (غير مدعوم منذ 1 سبتمبر 2019)، وراجع noindex مع canonical يشير إلى عنوان آخر بوصفه تعارضًا محتملًا، واعلم أن الإزالة لا تحدث إلا بعد إعادة الزحف؛ فوفق إرشادات Google قد تستغرق صفحة منخفضة الأولوية أشهرًا. وبحسب تعليق Mueller في 2017 (وليس سياسة موثقة)، يميلnoindex,followطويل الأمد إلى التصرف مثلnoindex,nofollowبعد خروج الصفحة من الفهرس. تحقق في GSC ضمن “URL marked ‘noindex’.”
ما هو noindex: تحكم في الفهرسة لا في الزحف
noindex هو التوجيه الأساسي للتحكم في الفهرسة. ويعرّف Google القاعدة في
سطر واحد: “Do not show this page, media, or resource in search results.” (ترجمة) «لا تعرض هذه الصفحة أو الوسائط أو المورد في نتائج البحث» وعندما
يُحترم يكون أثره كاملًا: “When Googlebot crawls that page and extracts the tag
or header, Google will drop that page entirely from Google Search results,
regardless of whether other sites link to it.” (ترجمة) «عندما يزحف Googlebot إلى الصفحة ويستخرج الوسم أو الترويسة، يزيل Google الصفحة تمامًا من نتائج بحثه بغض النظر عن وجود روابط إليها من مواقع أخرى» Evidence for this claim Google's noindex rule prevents the page, media, or resource from appearing in Google Search results after Google sees the rule. Scope: Google Search; noindex is not an access-control or privacy mechanism. Confidence: high · Verified: Google Search Central: Block Search indexing with noindex
أبقِ فارقًا واحدًا حاضرًا في ذهنك، لأن معظم أخطاء noindex تأتي من طمسه:
يتحكم noindex في الفهرسة، بينما يتحكم robots.txt في الزحف. فهما مرحلتان
مختلفتان في المسار. وقد صغت ذلك في دليلي لدى Ahrefs عن إزالة عناوين URL:
“Crawling is not the same thing as indexing. Even if Google is blocked from
crawling pages, if there are any internal or external links to a page they can
still index it.” (ترجمة) «الزحف ليس هو الفهرسة. حتى إذا مُنع Google من الزحف إلى الصفحات، فقد يظل قادرًا على فهرسة صفحة عندما توجد إليها روابط داخلية أو خارجية» وهذه الجملة هي سبب وجود بقية المقال.
تمنح Microsoft التوجيه نفسه أثرًا إضافيًا خاصًا بـ Bing: فالمحتوى الموسوم
noindex يُستبعد أيضًا من تدريب نماذج Microsoft الأساسية. ويبقى الشرط السابق مهمًا؛
إذ يجب السماح لـ Bingbot بالزحف إلى التوجيه على مستوى الصفحة ومعالجته. لذلك فإن
حظر robots.txt مع noindex لا يثبت تطبيق إلغاء الفهرسة أو الانسحاب من التدريب.
طريقتا التقديم الصحيحتان
هما طريقتان بالضبط، وليست كتابة noindex في robots.txt إحداهما (سيأتي
المزيد عن ذلك أدناه).
الطريقة 1: وسم robots meta. لصفحة HTML، ضعه داخل <head>:
<meta name="robots" content="noindex">تعليمات Google حرفية: “To prevent all search engines that support the
noindex rule from indexing a page on your site, place the following <meta> tag
into the <head> section of your page.” (ترجمة) «لمنع جميع محركات البحث التي تدعم قاعدة noindex من فهرسة صفحة في موقعك، ضع وسم meta التالي داخل قسم head من صفحتك» وتستهدف قيمة robots جميع الزواحف الداعمة؛ واستبدلها بـ
googlebot لاستهداف Google وحده (<meta name="googlebot" content="noindex">).
الطريقة 2: ترويسة HTTP المسماة X-Robots-Tag. التوجيه نفسه، لكنه يُرسل في ترويسة الاستجابة بدلًا من ترميز الصفحة:
X-Robots-Tag: noindexهذه هي الطريقة الوحيدة لتطبيق noindex على موارد غير HTML، لأنها لا تحتوي
على <head> يستضيف وسم meta. يقول Google: “A response header can be used for
non-HTML resources, such as PDFs, video files, and image files.” (ترجمة) «يمكن استخدام ترويسة استجابة للموارد غير HTML، مثل ملفات PDF والفيديو والصور»
وتقول مواصفات robots إن X-Robots-Tag تصلح “for non-HTML files like image files
where the usage of robots meta tags in HTML is not possible.” (ترجمة) «للملفات غير HTML، مثل ملفات الصور، حيث لا يمكن استخدام وسوم robots meta في HTML»
ملاحظة عن الموضع: ضع وسم meta في <head>؛ فهذا الموضع القياسي والأكثر أمانًا
وهو ما تعرضه إرشادات Google. ومع ذلك تقول صفحة المواصفات إن Google “doesn’t
enforce placement of meta robots in the HTML head and will respect robots meta
tags in the body section of an HTML document as well,” (ترجمة) «لا يفرض وضع robots meta داخل رأس HTML، ويحترم هذه الوسوم أيضًا في قسم body من مستند HTML» لكن لا تعتمد على ذلك كطريقتك الأساسية؛ فقد يؤدي وسم <meta> شارد يحقنه
CMS في <body> إلى تطبيق noindex على صفحة بالخطأ بسهولة تساوي وسمًا قصدت وضعه في <head>.
نظرًا إلى ضبط الترويسة على مستوى الخادم، تختلف الطريقة حسب الحزمة التقنية. فيما يلي مثالان شائعان لتطبيق noindex على كل ملف PDF في الموقع:
Apache (في .htaccess أو المضيف الافتراضي):
<FilesMatch "\.pdf$">
Header set X-Robots-Tag "noindex"
</FilesMatch>Nginx (داخل كتلة server أو location):
location ~* \.pdf$ {
add_header X-Robots-Tag "noindex";
}الخطأ الأول: noindex مع حظر robots.txt
The same page contains a meta robots noindex directive. With crawling allowed, Google can fetch the page, see noindex, and remove the URL after processing. With crawling blocked in robots.txt, Google cannot see noindex and the linked URL may remain in results.
هذه أكثر حالات الإخفاق التي أراها، لذا إليك الآلية كاملة. يوجد وسم noindex
على الصفحة، ويجب على Google جلب الصفحة لقراءته. ويوضح Google الشرط مباشرة:
يقول Google: “For the
noindexrule to be effective, the page or resource must not be blocked by a robots.txt file, and it has to be otherwise accessible to the crawler. If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see thenoindexrule, and the page can still appear in search results, for example if other pages link to it.” (ترجمة) «لكي تكون قاعدة noindex فعالة، يجب ألا تكون الصفحة أو المورد محظورًا بملف robots.txt، ويجب أن تكون متاحة للزاحف من الجوانب الأخرى. وإذا حظر الملف الصفحة أو تعذر على الزاحف الوصول إليها، فلن يرى القاعدة أبدًا وقد تظل الصفحة ظاهرة في نتائج البحث، مثلًا إذا ربطت بها صفحات أخرى.»
وبصياغة أشد مباشرة: “We have to crawl your page in order to see <meta> tags
and HTTP headers.” (ترجمة) «علينا الزحف إلى صفحتك كي نرى وسوم meta وترويسات HTTP» لا زحف، لا قاعدة.
robots.txt هو أكثر أسباب تعذر الزحف شيوعًا، لكن صياغة Google أوسع؛ فهي تذكر
أيضًا تعذر وصول الزاحف، ويشمل ذلك أخطاء الخادم المتكررة (5xx)، والمهلات، وحاجز
مصادقة غير مقصود أمام الصفحة. وكل ذلك يعطل noindex بصمت بالطريقة نفسها.
لذلك فإن غريزة «احظرها في robots.txt وأضف noindex احتياطًا» معكوسة تمامًا؛
إذ يمنع الحظر الزحف، والزحف هو ما يكشف noindex، وقد تبقى الصفحة في الفهرس إلى
أجل غير مسمى (وغالبًا كرابط بلا وصف). ويظهر ذلك في Google Search Console بحالة
“Indexed, though blocked by robots.txt”: صفحة حظرتها لكنها فُهرست لأن شيئًا ما يربط بها.
الإصلاح: أزل حظر الصفحة من robots.txt، وأبقِ noindex عليها، ودع Google
يعيد الزحف. وبعد خروج الصفحة من الفهرس فقط، إذا أردت توفير الزحف بالكامل،
يمكنك عندها إضافة disallow بأمان.
مثال نشر عملي: موقع التجهيز الذي لم يختفِ
أُطلق تصميم جديد من staging.example.com. تحتوي قوالب التجهيز أصلًا على
noindex، لكن قائمة تحقق النشر تضيف أيضًا:
User-agent: *
Disallow: /قد يبدو ذلك طبقتين من الحماية، لكنه فخ إذا كان Google قد اكتشف عناوين URL
الخاصة بالتجهيز عبر رابط QA مشترك، أو خريطة موقع قديمة، أو تذكرة عامة، أو رابط
في محتوى نُسخ إلى الإنتاج. يمنع disallow الزحف التالي، فلا يستطيع Google تأكيد
noindex؛ وقد يبقى اسم المضيف ظاهرًا في نتائج ضعيفة لا تعرض سوى URL.
تسلسل التنظيف هو: أزل disallow، وأبقِ noindex في كل استجابة من بيئة التجهيز،
وتأكد من أن الاستجابة الحية قابلة للزحف وتكشف التوجيه، واطلب إعادة الزحف لعينة
ممثلة، وراقب اسم المضيف حتى يختفي. ثم ضع البيئة خلف المصادقة. المصادقة هي حماية
الخصوصية الدائمة؛ أما noindex فليس سوى تحكم في فهرس البحث.
الفرق بين noindex وnofollow وdisallow
ثلاثة توجيهات يخلط الناس بينها باستمرار، لكنها تعمل في مراحل مختلفة:
noindex: تحكم في الفهرسة. يُزحف إلى الصفحة وتُستبعد من النتائج. تعريف Google: “Do not show this page, media, or resource in search results.” (ترجمة) «لا تعرض هذه الصفحة أو الوسائط أو المورد في نتائج البحث»nofollow: تحكم في الروابط. يقول Google: “Do not follow the links on this page.” (ترجمة) «لا تتبع الروابط في هذه الصفحة» ولا يقول شيئًا عن فهرسة الصفحة نفسها.disallow(في robots.txt): تحكم في الزحف. يوقف الجلب بالكامل، لكنه ليس تحكمًا في الفهرسة؛ فقد يُفهرس URL محظور إذا أشارت إليه روابط.
هناك أيضًا none الذي يصفه Google بأنه “Equivalent to noindex, nofollow.” (ترجمة) «مكافئ لـ noindex, nofollow» وعند تعارض التوجيهات تنص المواصفات
بوضوح: “In the case of conflicting robots rules, the more restrictive rule
applies.” (ترجمة) «عند تعارض قواعد robots، تُطبق القاعدة الأكثر تقييدًا»
(يوجد الجدول الكامل في علامة تبويب أوراق الغش.)
تعامل مع noindex وrel=canonical باعتبارهما فحصًا للقصد
ليس وضع noindex وrel="canonical" في الصفحة نفسها خطأً تلقائيًا، لكنه
ينشئ إعدادًا يستحق المراجعة: يطلب canonical من Google دمج الإشارات، بينما يطلب
noindex استبعاد هذا URL. وللاختيار بين النسخ المكررة استخدم وسم canonical؛
إذ يحذر Google تحديدًا من استخدام noindex لهذا الغرض: “We don’t recommend using
noindex to prevent selection of a canonical page within a single site, because it
will completely block the page from Search.” (ترجمة) «لا نوصي باستخدام noindex لمنع اختيار صفحة أساسية داخل موقع واحد، لأنه سيحجب الصفحة تمامًا عن البحث» انتبه إلى النطاق: يحذر Google من استخدام noindex لاختيار النسخة
المكررة التي تفوز كعنوان canonical داخل موقعك، ولا يدعي استحالة اجتماعهما تقنيًا
في صفحة (فالصفحة التي توقفها فعلًا قد تظل تحمل canonical ذاتي المرجع). ويستحق
canonical الذي يشير إلى URL مختلف أشد تحذير: تأكد من قصد الاستبعاد والدمج معًا.
استخدم canonical لدمج المكررات، وnoindex فقط عندما تريد حقًا إخراج الصفحة من النتائج.
noindex,follow مقابل noindex,nofollow: التلاشي البطيء
من الأنماط الشائعة noindex,follow: إبقاء الصفحة خارج النتائج مع الاستمرار في
اتباع روابطها كي تتدفق القيمة من خلالها (وهو مفيد أثناء ترحيل أو استبعاد مؤقت).
لا تصف وثائق Google الرسمية الحالية تحوله تلقائيًا؛ بل تسمح صراحة بجمع noindex
مع قواعد أخرى، بما في ذلك ضبط noindex,nofollow عمدًا منذ اليوم الأول. ويستند
ادعاء «يتلاشى بمرور الوقت» إلى جلسة لمشرفي المواقع عام 2017 قال فيها John
Mueller إن noindex طويل الأمد يميل عمليًا إلى المعاملة مثل
noindex,nofollow: فعندما يقرر Google أن الصفحة لا تنتمي إلى البحث ويحذفها
تمامًا، يتوقف أيضًا عن اتباع روابطها لأنه توقف عن معالجة الصفحة. هذه ملاحظة
ممارس من نص فيديو وليست سياسة Google موثقة؛ فتعامل معها بوصفها اتجاهًا لا
ضمانًا. والخلاصة العملية ثابتة: يصلح noindex,follow لفترة انتقالية، لكن لا
تعتمد عليه استراتيجية دائمة لقيمة الروابط؛ أصلح الروابط الأساسية أو أزل الصفحة.
كم يستغرق noindex؟
ليس فوريًا. لا يُطبق noindex إلا بعد أن يعيد Google الزحف إلى الصفحة
ومعالجتها؛ وحتى ذلك الحين قد تبقى مفهرسة رغم وجود الوسم. لا يلتزم Google
بنافذة ثابتة، وتميل إرشاداته إلى «قد يستغرق الأمر وقتًا» لا «خلال أيام»:
“Depending on the importance of the page on the internet, it may take months
for Googlebot to revisit a page.” (ترجمة) «بحسب أهمية الصفحة على الإنترنت، قد يستغرق Googlebot أشهرًا كي يعاود زيارتها» قد يُعاد الزحف خلال أيام إلى
صفحة كثيرة الزيارات والروابط، بينما قد تنتظر صفحة قليلة القيمة والروابط أشهرًا.
إذا احتجت إخراجها بسرعة، فأداة Removals في GSC حل مؤقت يخفي URL بينما يؤدي
noindex الدائم عمله الأبطأ. وللصفحات التي اختفت فعلًا، يزيلها 404/410 أيضًا؛
فكما كتبت في دليل الإزالة:
“If you remove the page and serve either a 404 (not found) or 410 (gone) status
code, then the page will be removed from the index shortly after the page is
re-crawled.” (ترجمة) «إذا أزلت الصفحة وقدمت حالة 404 (غير موجود) أو 410 (محذوف)، فستُزال من الفهرس بعد وقت قصير من إعادة الزحف إليها» الفكرة واحدة:
يحدث الأمر بعد إعادة الزحف.
مات noindex في robots.txt منذ 1 سبتمبر 2019
ستظل ترى من يقترح سطر Noindex: في robots.txt. لا تستخدمه. لم يكن قاعدة
مدعومة رسميًا، وقد أوقف Google حتى معالجته غير الرسمية منذ سنوات. جاء في إعلان
Search Central في يوليو 2019: “Since these rules were never documented by
Google, naturally, their usage in relation to Googlebot is very low.” (ترجمة) «نظرًا إلى أن Google لم يوثق هذه القواعد قط، فمن الطبيعي أن يكون استخدامها مع Googlebot منخفضًا جدًا» وعن التاريخ: “we’re retiring all code
that handles unsupported and unpublished rules (such as noindex) on September
1, 2019.” (ترجمة) «سنوقف كل الشفرة التي تعالج القواعد غير المدعومة وغير المنشورة، مثل noindex، في 1 سبتمبر 2019»
سمّى المنشور نفسه البدائل المدعومة، وتصدرها noindex عبر وسم meta أو الترويسة:
“noindex in robots meta tags: Supported both in the HTTP response headers and in
HTML, the noindex rule is the most effective way to remove URLs from the index
when crawling is allowed.” (ترجمة) «يدعم noindex في وسوم robots meta داخل ترويسات استجابة HTTP وداخل HTML، وهو أكثر الطرق فعالية لإزالة عناوين URL من الفهرس عندما يكون الزحف مسموحًا» وذُكرت أيضًا حالات 404/410، والحماية
بكلمة مرور، وdisallow لمنع الزحف، وأداة الإزالة في Search Console.
كيفية التحقق من noindex في Google Search Console
استخدم فحصين:
- URL Inspection. مرر URL عبر Inspect ثم اختر Test live URL. سيخبرك
هل الصفحة قابلة للفهرسة وهل يرى Google توجيه
noindex؛ وهذه أسرع طريقة لتأكيد قراءة الوسم في الصفحة الحية. - تقرير Page Indexing. تُدرج صفحات noindex تحت حالة “URL marked ‘noindex’” في قسم Not indexed. ويقول نص مساعدة Google: “When Google tried to index the page it encountered a ‘noindex’ directive and therefore did not index it.” (ترجمة) «عندما حاول Google فهرسة الصفحة واجه توجيه noindex، ولذلك لم يفهرسها» إذا كنت تريد فهرسة الصفحة، فهذا هو الخلل؛ أزل التوجيه.
ملاحظة عن التسمية لمن يبحث في شروحات قديمة: كان تقرير Coverage القديم يسميها “Excluded by ‘noindex’ tag.” أما تقرير Page Indexing الحالي فيستخدم “URL marked ‘noindex’”؛ الحالة نفسها بتسمية أحدث.
ما الذي لا يضمنه noindex؟
يفترض الناس أن noindex يمنحهم أشياء لا يمنحها في الواقع، ومنها:
- توفير ميزانية الزحف. لا يزال على Google جلب الصفحة لرؤية الوسم؛ فلا يقلل
noindexوحده الزحف. إذا أردت ذلك أيضًا، فأضفdisallowإلىrobots.txt، لكن بعد خروج الصفحة من الفهرس فقط، لأن تقديمه مسبقًا يأتي بنتيجة عكسية. - الإزالة الفورية. تحدث بعد إعادة الزحف، بلا جدول زمني ثابت، وقد يقول Google إن الصفحة منخفضة الأولوية تستغرق أشهرًا.
- دمج النسخ المكررة. هذه مهمة
rel="canonical"؛ أماnoindexفيزيل الصفحة من البحث ولا يدمج إشاراتها مع URL آخر. - السرية. تظل الصفحة متاحة للعامة لأي شخص يملك URL. وما يحتاج إلى خصوصية يحتاج إلى مصادقة، لا إلى توجيه بحث.
- استعادة الترتيب إذا عكسته. لا تعيد إزالة
noindexترتيب الصفحة القديم؛ بل يجب على Google إعادة الزحف والتقييم، وعلى الصفحة أن تكسب موضعها من جديد. - توقيت متطابق بين محركات البحث. يدير Bing وغيره جداول زحف وإعادة زحف مستقلة.
- الاستبعاد من كل استخدام غير بحثي للمحتوى. يمنع
noindexالصفحة من بحث Google ككل، بما في ذلك ميزات البحث المدعومة بالذكاء الاصطناعي؛ فالصفحة غير المفهرسة ليست مؤهلة للظهور فيها. لكنه لا يتحكم في إعداد Google-Extended المنفصل، الذي يحكم استخدام المحتوى لتدريب نماذج Google التوليدية أو إسنادها خارج البحث. هذان تحكمان مختلفان لمهمتين مختلفتين.
موضع noindex بين عناصر المنظومة الأخرى
noindex هو الأداة المناسبة عندما تكون صفحة في الفهرس ولا ينبغي أن تكون فيه؛
أي علاج أحد أشكال تضخم الفهرس، مثل الصفحات الضعيفة أو المساعدة أو الشبيهة
بالمكررة التي لا قيمة بحثية لها. ويجاوره وسم robots meta وترويسة X-Robots-Tag
(طريقتا تقديمه)، وrobots.txt مع توجيه disallow (تحكم الزحف الذي يختلط به)، ووسم
canonical (المخصص لدمج المكررات لا noindex)، ومرحلتَا الزحف والفهرسة الأوسع.
افهم الفرق بين الزحف والفهرسة، ولن يبقى noindex غامضًا: اسمح بالزحف، وقدم
الوسم، وانتظر إعادة الزحف.
ملخص الذكاء الاصطناعي
خلاصة مركزة من نسخة متقدم:
noindexيعني إبقاء الصفحة خارج الفهرس ونتائج البحث. يقول Google: “Do not show this page, media, or resource in search results.” (ترجمة) «لا تعرض هذه الصفحة أو الوسائط أو المورد في نتائج البحث» وعند احترامه تُزال الصفحة تمامًا «بغض النظر عن وجود روابط إليها من مواقع أخرى».- طريقتان صحيحتان فقط: وسم robots meta
(
<meta name="robots" content="noindex">) وترويسة HTTP المسماةX-Robots-Tag: noindex. والترويسة مطلوبة للملفات غير HTML. - الخطأ الأول: لا يمكن تطبيق noindex على صفحة محظورة في
robots.txt؛ فلن يرى الزاحف القاعدة وقد يبقى URL المرتبط مفهرسًا. للإزالة: اسمح بالزحف وقدم noindex. noindex≠nofollow≠disallow: تحكم في الفهرسة مقابل الروابط مقابل الزحف. وتفوز القاعدة الأكثر تقييدًا عند التعارض.- راجع
noindexمعrel="canonical"يشير إلى عنوان آخر، وتأكد من قصد الاستبعاد والدمج معًا. استخدم canonical للمكررات، وnoindex للاستبعاد. - قد يتلاشى
noindex,followإلىnoindex,nofollowبمرور الوقت وفق تعليق Mueller في 2017؛ وهذه ليست سياسة موثقة، فتعامل معها كاتجاه وحالة مؤقتة. - ليس فوريًا: يُطبق بعد إعادة الزحف، وقد تستغرق صفحة منخفضة الأولوية أشهرًا.
استخدم Removals في GSC حلًا عاجلًا مؤقتًا؛ وتزيل
404/410الصفحات بعد الزحف. - مات noindex داخل robots.txt: لم يُدعم رسميًا وأُوقف في 1 سبتمبر 2019.
- لا يمنحك توفير ميزانية الزحف، أو السرية، أو دمج المكررات، أو استعادة الترتيب عند العكس، أو الانسحاب من تدريب نماذج Google (له Google-Extended).
- تحقق في GSC: URL Inspection مع Test live URL، وتقرير Page Indexing تحت “URL marked ‘noindex’” (التسمية القديمة: “Excluded by ‘noindex’ tag”).
الوثائق الرسمية
وثائق المصادر الأساسية من محركات البحث.
- حظر الفهرسة في البحث باستخدام
noindex: الدليل الأساسي للطريقتين وضرورة إبقاء الصفحة قابلة للزحف. - مواصفات وسوم Robots Meta: جميع التوجيهات (
noindexوnofollowوnone)، وX-Robots-Tag، وقاعدة «تفوز القاعدة الأكثر تقييدًا». - ملاحظة عن القواعد غير المدعومة في robots.txt (يوليو 2019): سبب إيقاف noindex في robots.txt في 1 سبتمبر 2019 والبدائل الصحيحة.
- دمج عناوين URL المكررة: لماذا يُستخدم
rel="canonical"، لاnoindex، لدمج المكررات. - تقرير Page Indexing: حالة “URL marked ‘noindex’” وطريقة التحقق.
Bing / Microsoft ومراجع مستقلة عن المحرك
- ما وسوم robots meta التي يدعمها Bing؟: دعم Bing لوسوم robots، ومنها
noindex. - MDN:
<meta name="robots">: مرجع محايد متعدد المحركات للتوجيه.
اقتباسات من المصدر
تصريحات رسمية من Google. كل رابط عميق ينتقل إلى المقطع المقتبس في صفحة المصدر.
Google: ما الذي يفعله noindex وكيفية ضبطه
- “Do not show this page, media, or resource in search results.” (ترجمة) «لا تعرض هذه الصفحة أو الوسائط أو المورد في نتائج البحث» — وثائق Google Search Central (تعريف
noindex). انتقل إلى الاقتباس - “To prevent all search engines that support the
noindexrule from indexing a page on your site, place the following<meta>tag into the<head>section of your page.” (ترجمة) «لمنع جميع محركات البحث التي تدعم قاعدة noindex من فهرسة صفحة في موقعك، ضع وسم meta التالي داخل قسم head من صفحتك» انتقل إلى الاقتباس - “A response header can be used for non-HTML resources, such as PDFs, video files, and image files.” (ترجمة) «يمكن استخدام ترويسة استجابة للموارد غير HTML، مثل ملفات PDF والفيديو والصور» انتقل إلى الاقتباس
- “When Googlebot crawls that page and extracts the tag or header, Google will drop that page entirely from Google Search results, regardless of whether other sites link to it.” (ترجمة) «عندما يزحف Googlebot إلى الصفحة ويستخرج الوسم أو الترويسة، يزيل Google الصفحة تمامًا من نتائج بحثه بغض النظر عن وجود روابط إليها من مواقع أخرى» انتقل إلى الاقتباس
Google: فخ robots.txt
- “For the
noindexrule to be effective, the page or resource must not be blocked by a robots.txt file, and it has to be otherwise accessible to the crawler. If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see thenoindexrule, and the page can still appear in search results, for example if other pages link to it.” (ترجمة) «كي تكون قاعدة noindex فعالة، يجب ألا تكون الصفحة أو المورد محظورًا بملف robots.txt وأن تكون متاحة للزاحف. وإذا حظر الملف الصفحة أو تعذر على الزاحف الوصول إليها، فلن يرى القاعدة أبدًا وقد تظل الصفحة ظاهرة في نتائج البحث، مثلًا إذا ربطت بها صفحات أخرى» انتقل إلى الاقتباس - “We have to crawl your page in order to see
<meta>tags and HTTP headers.” (ترجمة) «علينا الزحف إلى صفحتك كي نرى وسوم meta وترويسات HTTP» انتقل إلى الاقتباس
Google: التوجيهات الأخرى للمقارنة
- “Do not follow the links on this page.” (ترجمة) «لا تتبع الروابط في هذه الصفحة» — تعريف
nofollow. انتقل إلى الاقتباس - “In the case of conflicting robots rules, the more restrictive rule applies.” (ترجمة) «عند تعارض قواعد robots، تُطبق القاعدة الأكثر تقييدًا» انتقل إلى الاقتباس
Google: لا تستخدم noindex لاختيار canonical
- “We don’t recommend using
noindexto prevent selection of a canonical page within a single site, because it will completely block the page from Search.” (ترجمة) «لا نوصي باستخدام noindex لمنع اختيار صفحة أساسية داخل موقع واحد، لأنه سيحجب الصفحة تمامًا عن البحث» انتقل إلى الاقتباس
Google: إيقاف noindex في robots.txt (1 سبتمبر 2019)
- “Since these rules were never documented by Google, naturally, their usage in relation to Googlebot is very low.” (ترجمة) «نظرًا إلى أن Google لم يوثق هذه القواعد قط، فمن الطبيعي أن يكون استخدامها مع Googlebot منخفضًا جدًا» انتقل إلى الاقتباس
- “we’re retiring all code that handles unsupported and unpublished rules (such as
noindex) on September 1, 2019.” (ترجمة) «سنوقف كل الشفرة التي تعالج القواعد غير المدعومة وغير المنشورة، مثل noindex، في 1 سبتمبر 2019» انتقل إلى الاقتباس - “the
noindexrule is the most effective way to remove URLs from the index when crawling is allowed.” (ترجمة) «قاعدة noindex هي أكثر الطرق فعالية لإزالة عناوين URL من الفهرس عندما يكون الزحف مسموحًا» انتقل إلى الاقتباس
Google: التحقق في Search Console
- “When Google tried to index the page it encountered a ‘noindex’ directive and therefore did not index it.” (ترجمة) «عندما حاول Google فهرسة الصفحة واجه توجيه noindex، ولذلك لم يفهرسها» — تقرير Page Indexing (حالة “URL marked ‘noindex’”). انتقل إلى الاقتباس
Patrick Stox: الزحف ليس الفهرسة (دليلي لدى Ahrefs بعنوان “Remove URLs From Google”)
- “Crawling is not the same thing as indexing. Even if Google is blocked from crawling pages, if there are any internal or external links to a page they can still index it.” (ترجمة) «الزحف ليس هو الفهرسة. حتى إذا مُنع Google من الزحف إلى الصفحات، فقد يظل قادرًا على فهرسة صفحة عندما توجد إليها روابط داخلية أو خارجية» انتقل إلى الاقتباس
- “If you remove the page and serve either a 404 (not found) or 410 (gone) status code, then the page will be removed from the index shortly after the page is re-crawled.” (ترجمة) «إذا أزلت الصفحة وقدمت حالة 404 (غير موجود) أو 410 (محذوف)، فستُزال من الفهرس بعد وقت قصير من إعادة الزحف إليها» انتقل إلى الاقتباس
noindex بصياغتي بدلًا من اقتباسه. تحقق من النص الدقيق في متصفح قبل اعتباره حرفيًا. أما نقطة التحول طويل الأمد من noindex,follow إلى noindex,nofollow فمنقولة عن John Mueller عبر تغطية Search Engine Roundtable لجلسة مشرفي مواقع في 2017؛ وقد أعدت صياغتها بدل اقتباسها، وينبغي الرجوع إلى المصدر قبل اعتبارها نهائية. noindex مقابل disallow وnofollow وcanonical: وظيفة كل منها
| التحكم | يوقف الزحف؟ | يوقف الفهرسة؟ | الغرض منه | أهم تنبيه |
|---|---|---|---|---|
noindex (وسم meta / ترويسة) | لا؛ يجب أن تبقى الصفحة قابلة للزحف | نعم | إزالة صفحة من الفهرس / نتائج البحث | عديم الفائدة إذا حظرتها robots.txt، لأن الزاحف لا يراه |
disallow (robots.txt) | نعم | لا | إبعاد الزواحف عن مساحات URL منخفضة القيمة | ليس أداة لإلغاء الفهرسة؛ فقد تُفهرس عناوين محظورة إذا أشارت إليها روابط |
nofollow (في meta / الروابط) | لا | لا | إخبار Google بألا يتبع روابط الصفحة | لا يقول شيئًا عن فهرسة الصفحة نفسها |
rel="canonical" | لا | يدمج ولا يفرض | الإشارة إلى النسخة المفضلة من مكرر | تلميح لا قاعدة؛ واجتماعه مع noindex تحذير يستلزم فحص القصد، خصوصًا إذا أشار إلى عنوان آخر |
طريقتا noindex الصحيحتان
| الطريقة | الصياغة | استخدمها من أجل |
|---|---|---|
| وسم Robots meta | <meta name="robots" content="noindex"> داخل <head> | صفحات HTML العادية |
| ترويسة X-Robots-Tag | X-Robots-Tag: noindex في استجابة HTTP | الملفات غير HTML (PDF والصور والفيديو)؛ وأي صفحة يكون ضبط الترويسة فيها أسهل من تعديل الترميز |
يستهدف <meta name="googlebot" content="noindex"> محرك Google وحده، بينما
تستهدف robots كل محرك يدعم القاعدة. وينفذ noindex,nofollow (أو none،
الذي يسميه Google “Equivalent to noindex, nofollow” (ترجمة) «مكافئ لـ noindex, nofollow» ) الوظيفتين معًا.
ليست طريقة صحيحة: كتابة Noindex: داخل robots.txt. لم تُدعم رسميًا
قط، وأوقفها Google في 1 سبتمبر 2019. لا تستخدمها.
كيفية تطبيق noindex على صفحة بصورة صحيحة والتحقق منه
الإعداد
- اخترت الطريقة الصحيحة: وسم robots meta لصفحة HTML، أو ترويسة
X-Robots-Tag: noindexلملف PDF أو صورة أو فيديو. - في HTML: يوجد
<meta name="robots" content="noindex">داخل<head>، وهو الموضع القياسي والأكثر أمانًا. سيحترم Google الوسم في<body>أيضًا، لكن لا تعتمد على ذلك؛ إذ قد يطبق وسم<meta>شارد في الجسم noindex بالخطأ. - الصفحة غير محظورة في
robots.txt؛ إذ يجب أن يستطيع Google الزحف إليها. - إذا حملت الصفحة
rel="canonical"أيضًا، فقد روجعت وجهته ونتيجة الاستبعاد المقصودة، ولم يُعامل الجمع بوصفه إخفاقًا تلقائيًا. - إذا أردت استمرار تدفق الروابط مؤقتًا، استخدمت
noindex,followمع العلم بأنه يتلاشى إلىnoindex,nofollowعلى المدى الطويل. - لم تعتمد على سطر
Noindex:داخلrobots.txt(غير مدعوم منذ 1 سبتمبر 2019).
التحقق من النجاح
- شغّلت URL Inspection → Test live URL في Google Search Console وتأكدت
من أن Google يرى توجيه
noindex. - فحصت تقرير Page Indexing، وظهر URL تحت “URL marked ‘noindex’” (التسمية القديمة: “Excluded by ‘noindex’ tag”).
- منحت العملية وقتًا؛ فإلغاء الفهرسة لا يحدث إلا بعد إعادة الزحف، لذلك لن تختفي الصفحة من النتائج فورًا.
- إذا لزم اختفاؤها بسرعة، استخدمت أداة Removals في GSC حلًا مؤقتًا
إلى جانب
noindexالدائم. - إذا ظلت الصفحة مفهرسة بعد إضافة noindex، فحصت أولًا هل حظرتها robots.txt أيضًا (حالة “Indexed, though blocked by robots.txt”)؛ فهذا السبب الأول.
سجل التغييرات
تم التحديث في 10 أغسطس 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 28 يوليو 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 19 يوليو 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 19 يوليو 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 18 يوليو 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.