توجيه Noindex

يبقي Noindex الصفحة خارج نتائج البحث، ولكن فقط إذا استطاع Google الزحف إليها. تعرّف إلى الطريقتين الصحيحتين، وفخ robots.txt، وكيفية التحقق من نجاحه.

نُشر أول مرة: 23 يونيو 2026 · آخر تحديث: 10 أغسطس 2026 · Advanced
اللغات

Noindex هو التوجيه الذي يبقي الصفحة خارج الفهرس فلا تظهر في نتائج البحث. توجد طريقتان صحيحتان لتعيينه: وسم robots meta (`<meta name="robots" content="noindex">`) وترويسة HTTP المسماة `X-Robots-Tag: noindex`، وهي الخيار الوحيد للملفات غير HTML مثل PDF. الخطأ الأكبر هو أن الصفحة المحظورة في robots.txt لا يمكن تطبيق noindex عليها لأن Google لا يزحف إليها ليرى القاعدة؛ ولإزالة صفحة يجب السماح بالزحف إليها وتقديم noindex. لا تضع noindex في robots.txt (غير مدعوم منذ 1 سبتمبر 2019)، وإذا اجتمع noindex وcanonical فتعامل مع ذلك كفحص للقصد لا كخطأ تلقائي، وتذكر أن إلغاء الفهرسة لا يحدث إلا بعد إعادة الزحف.

باختصار — يزيل noindex الصفحة من الفهرس بإحدى طريقتين صحيحتين: وسم robots meta (<meta name="robots" content="noindex">) أو ترويسة HTTP المسماة X-Robots-Tag: noindex (وهي مطلوبة للملفات غير HTML مثل PDF). والمشكلة الجوهرية أن الصفحة المحظورة في robots.txt لا يمكن تطبيق noindex عليها؛ إذ لا يزحف Google إليها ليرى القاعدة: “the crawler will never see the noindex rule,” (ترجمة) «لن يرى الزاحف قاعدة noindex أبدًا»، وقد يبقى URL المرتبط مفهرسًا. لذلك، لإزالة صفحة: اسمح بالزحف وقدم noindex. لا تضع noindex في robots.txt (غير مدعوم منذ 1 سبتمبر 2019)، وراجع noindex مع canonical يشير إلى عنوان آخر بوصفه تعارضًا محتملًا، واعلم أن الإزالة لا تحدث إلا بعد إعادة الزحف؛ فوفق إرشادات Google قد تستغرق صفحة منخفضة الأولوية أشهرًا. وبحسب تعليق Mueller في 2017 (وليس سياسة موثقة)، يميل noindex,follow طويل الأمد إلى التصرف مثل noindex,nofollow بعد خروج الصفحة من الفهرس. تحقق في GSC ضمن “URL marked ‘noindex’.”

ما هو noindex: تحكم في الفهرسة لا في الزحف

noindex هو التوجيه الأساسي للتحكم في الفهرسة. ويعرّف Google القاعدة في سطر واحد: “Do not show this page, media, or resource in search results.” (ترجمة) «لا تعرض هذه الصفحة أو الوسائط أو المورد في نتائج البحث» وعندما يُحترم يكون أثره كاملًا: “When Googlebot crawls that page and extracts the tag or header, Google will drop that page entirely from Google Search results, regardless of whether other sites link to it.” (ترجمة) «عندما يزحف Googlebot إلى الصفحة ويستخرج الوسم أو الترويسة، يزيل Google الصفحة تمامًا من نتائج بحثه بغض النظر عن وجود روابط إليها من مواقع أخرى» Evidence for this claim Google's noindex rule prevents the page, media, or resource from appearing in Google Search results after Google sees the rule. Scope: Google Search; noindex is not an access-control or privacy mechanism. Confidence: high · Verified: Google Search Central: Block Search indexing with noindex

أبقِ فارقًا واحدًا حاضرًا في ذهنك، لأن معظم أخطاء noindex تأتي من طمسه: يتحكم noindex في الفهرسة، بينما يتحكم robots.txt في الزحف. فهما مرحلتان مختلفتان في المسار. وقد صغت ذلك في دليلي لدى Ahrefs عن إزالة عناوين URL: “Crawling is not the same thing as indexing. Even if Google is blocked from crawling pages, if there are any internal or external links to a page they can still index it.” (ترجمة) «الزحف ليس هو الفهرسة. حتى إذا مُنع Google من الزحف إلى الصفحات، فقد يظل قادرًا على فهرسة صفحة عندما توجد إليها روابط داخلية أو خارجية» وهذه الجملة هي سبب وجود بقية المقال.

تمنح Microsoft التوجيه نفسه أثرًا إضافيًا خاصًا بـ Bing: فالمحتوى الموسوم noindex يُستبعد أيضًا من تدريب نماذج Microsoft الأساسية. ويبقى الشرط السابق مهمًا؛ إذ يجب السماح لـ Bingbot بالزحف إلى التوجيه على مستوى الصفحة ومعالجته. لذلك فإن حظر robots.txt مع noindex لا يثبت تطبيق إلغاء الفهرسة أو الانسحاب من التدريب.

Evidence for this claim Microsoft says content marked noindex is not included in the Bing index and is not used to train its generative AI foundation models. Scope: Bing and Microsoft foundation-model use; Bingbot must be able to crawl and process the directive before the outcome can be inferred. Confidence: high · Verified: Bing Webmaster Blog: New controls for Bing Chat

طريقتا التقديم الصحيحتان

هما طريقتان بالضبط، وليست كتابة noindex في robots.txt إحداهما (سيأتي المزيد عن ذلك أدناه).

الطريقة 1: وسم robots meta. لصفحة HTML، ضعه داخل <head>:

<meta name="robots" content="noindex">

تعليمات Google حرفية: “To prevent all search engines that support the noindex rule from indexing a page on your site, place the following <meta> tag into the <head> section of your page.” (ترجمة) «لمنع جميع محركات البحث التي تدعم قاعدة noindex من فهرسة صفحة في موقعك، ضع وسم meta التالي داخل قسم head من صفحتك» وتستهدف قيمة robots جميع الزواحف الداعمة؛ واستبدلها بـ googlebot لاستهداف Google وحده (<meta name="googlebot" content="noindex">).

الطريقة 2: ترويسة HTTP المسماة X-Robots-Tag. التوجيه نفسه، لكنه يُرسل في ترويسة الاستجابة بدلًا من ترميز الصفحة:

X-Robots-Tag: noindex

هذه هي الطريقة الوحيدة لتطبيق noindex على موارد غير HTML، لأنها لا تحتوي على <head> يستضيف وسم meta. يقول Google: “A response header can be used for non-HTML resources, such as PDFs, video files, and image files.” (ترجمة) «يمكن استخدام ترويسة استجابة للموارد غير HTML، مثل ملفات PDF والفيديو والصور» وتقول مواصفات robots إن X-Robots-Tag تصلح “for non-HTML files like image files where the usage of robots meta tags in HTML is not possible.” (ترجمة) «للملفات غير HTML، مثل ملفات الصور، حيث لا يمكن استخدام وسوم robots meta في HTML»

Evidence for this claim Google supports noindex in an HTML robots meta tag or an X-Robots-Tag HTTP response header. Scope: Google Search delivery methods; the HTTP header is applicable to non-HTML resources as well as HTML. Confidence: high · Verified: Google Search Central: Robots meta tag and X-Robots-Tag specifications

ملاحظة عن الموضع: ضع وسم meta في <head>؛ فهذا الموضع القياسي والأكثر أمانًا وهو ما تعرضه إرشادات Google. ومع ذلك تقول صفحة المواصفات إن Google “doesn’t enforce placement of meta robots in the HTML head and will respect robots meta tags in the body section of an HTML document as well,” (ترجمة) «لا يفرض وضع robots meta داخل رأس HTML، ويحترم هذه الوسوم أيضًا في قسم body من مستند HTML» لكن لا تعتمد على ذلك كطريقتك الأساسية؛ فقد يؤدي وسم <meta> شارد يحقنه CMS في <body> إلى تطبيق noindex على صفحة بالخطأ بسهولة تساوي وسمًا قصدت وضعه في <head>.

نظرًا إلى ضبط الترويسة على مستوى الخادم، تختلف الطريقة حسب الحزمة التقنية. فيما يلي مثالان شائعان لتطبيق noindex على كل ملف PDF في الموقع:

Apache (في .htaccess أو المضيف الافتراضي):

<FilesMatch "\.pdf$">
  Header set X-Robots-Tag "noindex"
</FilesMatch>

Nginx (داخل كتلة server أو location):

location ~* \.pdf$ {
  add_header X-Robots-Tag "noindex";
}

الخطأ الأول: noindex مع حظر robots.txt

Noindex is crawl-then-obey: keep the URL fetchable long enough for the directive to be processed.

The same page contains a meta robots noindex directive. With crawling allowed, Google can fetch the page, see noindex, and remove the URL after processing. With crawling blocked in robots.txt, Google cannot see noindex and the linked URL may remain in results.

هذه أكثر حالات الإخفاق التي أراها، لذا إليك الآلية كاملة. يوجد وسم noindex على الصفحة، ويجب على Google جلب الصفحة لقراءته. ويوضح Google الشرط مباشرة:

يقول Google: “For the noindex rule to be effective, the page or resource must not be blocked by a robots.txt file, and it has to be otherwise accessible to the crawler. If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see the noindex rule, and the page can still appear in search results, for example if other pages link to it.” (ترجمة) «لكي تكون قاعدة noindex فعالة، يجب ألا تكون الصفحة أو المورد محظورًا بملف robots.txt، ويجب أن تكون متاحة للزاحف من الجوانب الأخرى. وإذا حظر الملف الصفحة أو تعذر على الزاحف الوصول إليها، فلن يرى القاعدة أبدًا وقد تظل الصفحة ظاهرة في نتائج البحث، مثلًا إذا ربطت بها صفحات أخرى.»

وبصياغة أشد مباشرة: “We have to crawl your page in order to see <meta> tags and HTTP headers.” (ترجمة) «علينا الزحف إلى صفحتك كي نرى وسوم meta وترويسات HTTP» لا زحف، لا قاعدة.

robots.txt هو أكثر أسباب تعذر الزحف شيوعًا، لكن صياغة Google أوسع؛ فهي تذكر أيضًا تعذر وصول الزاحف، ويشمل ذلك أخطاء الخادم المتكررة (5xx)، والمهلات، وحاجز مصادقة غير مقصود أمام الصفحة. وكل ذلك يعطل noindex بصمت بالطريقة نفسها.

لذلك فإن غريزة «احظرها في robots.txt وأضف noindex احتياطًا» معكوسة تمامًا؛ إذ يمنع الحظر الزحف، والزحف هو ما يكشف noindex، وقد تبقى الصفحة في الفهرس إلى أجل غير مسمى (وغالبًا كرابط بلا وصف). ويظهر ذلك في Google Search Console بحالة “Indexed, though blocked by robots.txt”: صفحة حظرتها لكنها فُهرست لأن شيئًا ما يربط بها.

الإصلاح: أزل حظر الصفحة من robots.txt، وأبقِ noindex عليها، ودع Google يعيد الزحف. وبعد خروج الصفحة من الفهرس فقط، إذا أردت توفير الزحف بالكامل، يمكنك عندها إضافة disallow بأمان.

مثال نشر عملي: موقع التجهيز الذي لم يختفِ

أُطلق تصميم جديد من staging.example.com. تحتوي قوالب التجهيز أصلًا على noindex، لكن قائمة تحقق النشر تضيف أيضًا:

User-agent: *
Disallow: /

قد يبدو ذلك طبقتين من الحماية، لكنه فخ إذا كان Google قد اكتشف عناوين URL الخاصة بالتجهيز عبر رابط QA مشترك، أو خريطة موقع قديمة، أو تذكرة عامة، أو رابط في محتوى نُسخ إلى الإنتاج. يمنع disallow الزحف التالي، فلا يستطيع Google تأكيد noindex؛ وقد يبقى اسم المضيف ظاهرًا في نتائج ضعيفة لا تعرض سوى URL.

تسلسل التنظيف هو: أزل disallow، وأبقِ noindex في كل استجابة من بيئة التجهيز، وتأكد من أن الاستجابة الحية قابلة للزحف وتكشف التوجيه، واطلب إعادة الزحف لعينة ممثلة، وراقب اسم المضيف حتى يختفي. ثم ضع البيئة خلف المصادقة. المصادقة هي حماية الخصوصية الدائمة؛ أما noindex فليس سوى تحكم في فهرس البحث.

الفرق بين noindex وnofollow وdisallow

ثلاثة توجيهات يخلط الناس بينها باستمرار، لكنها تعمل في مراحل مختلفة:

  • noindex: تحكم في الفهرسة. يُزحف إلى الصفحة وتُستبعد من النتائج. تعريف Google: “Do not show this page, media, or resource in search results.” (ترجمة) «لا تعرض هذه الصفحة أو الوسائط أو المورد في نتائج البحث»
  • nofollow: تحكم في الروابط. يقول Google: “Do not follow the links on this page.” (ترجمة) «لا تتبع الروابط في هذه الصفحة» ولا يقول شيئًا عن فهرسة الصفحة نفسها.
  • disallow (في robots.txt): تحكم في الزحف. يوقف الجلب بالكامل، لكنه ليس تحكمًا في الفهرسة؛ فقد يُفهرس URL محظور إذا أشارت إليه روابط.

هناك أيضًا none الذي يصفه Google بأنه “Equivalent to noindex, nofollow.” (ترجمة) «مكافئ لـ noindex, nofollow» وعند تعارض التوجيهات تنص المواصفات بوضوح: “In the case of conflicting robots rules, the more restrictive rule applies.” (ترجمة) «عند تعارض قواعد robots، تُطبق القاعدة الأكثر تقييدًا» (يوجد الجدول الكامل في علامة تبويب أوراق الغش.)

تعامل مع noindex وrel=canonical باعتبارهما فحصًا للقصد

ليس وضع noindex وrel="canonical" في الصفحة نفسها خطأً تلقائيًا، لكنه ينشئ إعدادًا يستحق المراجعة: يطلب canonical من Google دمج الإشارات، بينما يطلب noindex استبعاد هذا URL. وللاختيار بين النسخ المكررة استخدم وسم canonical؛ إذ يحذر Google تحديدًا من استخدام noindex لهذا الغرض: “We don’t recommend using noindex to prevent selection of a canonical page within a single site, because it will completely block the page from Search.” (ترجمة) «لا نوصي باستخدام noindex لمنع اختيار صفحة أساسية داخل موقع واحد، لأنه سيحجب الصفحة تمامًا عن البحث» انتبه إلى النطاق: يحذر Google من استخدام noindex لاختيار النسخة المكررة التي تفوز كعنوان canonical داخل موقعك، ولا يدعي استحالة اجتماعهما تقنيًا في صفحة (فالصفحة التي توقفها فعلًا قد تظل تحمل canonical ذاتي المرجع). ويستحق canonical الذي يشير إلى URL مختلف أشد تحذير: تأكد من قصد الاستبعاد والدمج معًا. استخدم canonical لدمج المكررات، وnoindex فقط عندما تريد حقًا إخراج الصفحة من النتائج.

noindex,follow مقابل noindex,nofollow: التلاشي البطيء

من الأنماط الشائعة noindex,follow: إبقاء الصفحة خارج النتائج مع الاستمرار في اتباع روابطها كي تتدفق القيمة من خلالها (وهو مفيد أثناء ترحيل أو استبعاد مؤقت). لا تصف وثائق Google الرسمية الحالية تحوله تلقائيًا؛ بل تسمح صراحة بجمع noindex مع قواعد أخرى، بما في ذلك ضبط noindex,nofollow عمدًا منذ اليوم الأول. ويستند ادعاء «يتلاشى بمرور الوقت» إلى جلسة لمشرفي المواقع عام 2017 قال فيها John Mueller إن noindex طويل الأمد يميل عمليًا إلى المعاملة مثل noindex,nofollow: فعندما يقرر Google أن الصفحة لا تنتمي إلى البحث ويحذفها تمامًا، يتوقف أيضًا عن اتباع روابطها لأنه توقف عن معالجة الصفحة. هذه ملاحظة ممارس من نص فيديو وليست سياسة Google موثقة؛ فتعامل معها بوصفها اتجاهًا لا ضمانًا. والخلاصة العملية ثابتة: يصلح noindex,follow لفترة انتقالية، لكن لا تعتمد عليه استراتيجية دائمة لقيمة الروابط؛ أصلح الروابط الأساسية أو أزل الصفحة.

كم يستغرق noindex؟

ليس فوريًا. لا يُطبق noindex إلا بعد أن يعيد Google الزحف إلى الصفحة ومعالجتها؛ وحتى ذلك الحين قد تبقى مفهرسة رغم وجود الوسم. لا يلتزم Google بنافذة ثابتة، وتميل إرشاداته إلى «قد يستغرق الأمر وقتًا» لا «خلال أيام»: “Depending on the importance of the page on the internet, it may take months for Googlebot to revisit a page.” (ترجمة) «بحسب أهمية الصفحة على الإنترنت، قد يستغرق Googlebot أشهرًا كي يعاود زيارتها» قد يُعاد الزحف خلال أيام إلى صفحة كثيرة الزيارات والروابط، بينما قد تنتظر صفحة قليلة القيمة والروابط أشهرًا. إذا احتجت إخراجها بسرعة، فأداة Removals في GSC حل مؤقت يخفي URL بينما يؤدي noindex الدائم عمله الأبطأ. وللصفحات التي اختفت فعلًا، يزيلها 404/410 أيضًا؛ فكما كتبت في دليل الإزالة: “If you remove the page and serve either a 404 (not found) or 410 (gone) status code, then the page will be removed from the index shortly after the page is re-crawled.” (ترجمة) «إذا أزلت الصفحة وقدمت حالة 404 (غير موجود) أو 410 (محذوف)، فستُزال من الفهرس بعد وقت قصير من إعادة الزحف إليها» الفكرة واحدة: يحدث الأمر بعد إعادة الزحف.

مات noindex في robots.txt منذ 1 سبتمبر 2019

ستظل ترى من يقترح سطر Noindex: في robots.txt. لا تستخدمه. لم يكن قاعدة مدعومة رسميًا، وقد أوقف Google حتى معالجته غير الرسمية منذ سنوات. جاء في إعلان Search Central في يوليو 2019: “Since these rules were never documented by Google, naturally, their usage in relation to Googlebot is very low.” (ترجمة) «نظرًا إلى أن Google لم يوثق هذه القواعد قط، فمن الطبيعي أن يكون استخدامها مع Googlebot منخفضًا جدًا» وعن التاريخ: “we’re retiring all code that handles unsupported and unpublished rules (such as noindex) on September 1, 2019.” (ترجمة) «سنوقف كل الشفرة التي تعالج القواعد غير المدعومة وغير المنشورة، مثل noindex، في 1 سبتمبر 2019»

سمّى المنشور نفسه البدائل المدعومة، وتصدرها noindex عبر وسم meta أو الترويسة: noindex in robots meta tags: Supported both in the HTTP response headers and in HTML, the noindex rule is the most effective way to remove URLs from the index when crawling is allowed.” (ترجمة) «يدعم noindex في وسوم robots meta داخل ترويسات استجابة HTTP وداخل HTML، وهو أكثر الطرق فعالية لإزالة عناوين URL من الفهرس عندما يكون الزحف مسموحًا» وذُكرت أيضًا حالات 404/410، والحماية بكلمة مرور، وdisallow لمنع الزحف، وأداة الإزالة في Search Console.

كيفية التحقق من noindex في Google Search Console

استخدم فحصين:

  • URL Inspection. مرر URL عبر Inspect ثم اختر Test live URL. سيخبرك هل الصفحة قابلة للفهرسة وهل يرى Google توجيه noindex؛ وهذه أسرع طريقة لتأكيد قراءة الوسم في الصفحة الحية.
  • تقرير Page Indexing. تُدرج صفحات noindex تحت حالة “URL marked ‘noindex’” في قسم Not indexed. ويقول نص مساعدة Google: “When Google tried to index the page it encountered a ‘noindex’ directive and therefore did not index it.” (ترجمة) «عندما حاول Google فهرسة الصفحة واجه توجيه noindex، ولذلك لم يفهرسها» إذا كنت تريد فهرسة الصفحة، فهذا هو الخلل؛ أزل التوجيه.

ملاحظة عن التسمية لمن يبحث في شروحات قديمة: كان تقرير Coverage القديم يسميها “Excluded by ‘noindex’ tag.” أما تقرير Page Indexing الحالي فيستخدم “URL marked ‘noindex’”؛ الحالة نفسها بتسمية أحدث.

ما الذي لا يضمنه noindex؟

يفترض الناس أن noindex يمنحهم أشياء لا يمنحها في الواقع، ومنها:

  • توفير ميزانية الزحف. لا يزال على Google جلب الصفحة لرؤية الوسم؛ فلا يقلل noindex وحده الزحف. إذا أردت ذلك أيضًا، فأضف disallow إلى robots.txt، لكن بعد خروج الصفحة من الفهرس فقط، لأن تقديمه مسبقًا يأتي بنتيجة عكسية.
  • الإزالة الفورية. تحدث بعد إعادة الزحف، بلا جدول زمني ثابت، وقد يقول Google إن الصفحة منخفضة الأولوية تستغرق أشهرًا.
  • دمج النسخ المكررة. هذه مهمة rel="canonical"؛ أما noindex فيزيل الصفحة من البحث ولا يدمج إشاراتها مع URL آخر.
  • السرية. تظل الصفحة متاحة للعامة لأي شخص يملك URL. وما يحتاج إلى خصوصية يحتاج إلى مصادقة، لا إلى توجيه بحث.
  • استعادة الترتيب إذا عكسته. لا تعيد إزالة noindex ترتيب الصفحة القديم؛ بل يجب على Google إعادة الزحف والتقييم، وعلى الصفحة أن تكسب موضعها من جديد.
  • توقيت متطابق بين محركات البحث. يدير Bing وغيره جداول زحف وإعادة زحف مستقلة.
  • الاستبعاد من كل استخدام غير بحثي للمحتوى. يمنع noindex الصفحة من بحث Google ككل، بما في ذلك ميزات البحث المدعومة بالذكاء الاصطناعي؛ فالصفحة غير المفهرسة ليست مؤهلة للظهور فيها. لكنه لا يتحكم في إعداد Google-Extended المنفصل، الذي يحكم استخدام المحتوى لتدريب نماذج Google التوليدية أو إسنادها خارج البحث. هذان تحكمان مختلفان لمهمتين مختلفتين.

موضع noindex بين عناصر المنظومة الأخرى

noindex هو الأداة المناسبة عندما تكون صفحة في الفهرس ولا ينبغي أن تكون فيه؛ أي علاج أحد أشكال تضخم الفهرس، مثل الصفحات الضعيفة أو المساعدة أو الشبيهة بالمكررة التي لا قيمة بحثية لها. ويجاوره وسم robots meta وترويسة X-Robots-Tag (طريقتا تقديمه)، وrobots.txt مع توجيه disallow (تحكم الزحف الذي يختلط به)، ووسم canonical (المخصص لدمج المكررات لا noindex)، ومرحلتَا الزحف والفهرسة الأوسع. افهم الفرق بين الزحف والفهرسة، ولن يبقى noindex غامضًا: اسمح بالزحف، وقدم الوسم، وانتظر إعادة الزحف.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.