وسم Meta Robots
يضبط وسم meta robots كيفية فهرسة الصفحة وعرضها — بما يشمل كل توجيه، وقاعدة «الزحف ثم الامتثال»، وحل التعارضات، والفرق بين وسم meta وترويسة X-Robots-Tag.
اللغات
دليل واحد في هذه الصفحة
- أداة مباشرة ذات صلةHTTP Header Checker
يوضح وسم robots meta — أي <meta name="robots" content="noindex"> داخل <head> — لمحركات البحث كيفية فهرسة صفحة واحدة وعرضها. والقاعدة التي تُفسد كل شيء عند تجاهلها هي «الزحف ثم الامتثال»: فالصفحة المحظورة في robots.txt لا تُجلب، ولذلك لا يُرى توجيه noindex فيها. وعند غياب الوسم يكون الإعداد الافتراضي index, follow. وتُحسم القواعد المتعارضة لصالح الأكثر تقييدًا؛ وعند تعارض وسم باسم googlebot مع وسم robots العام، يطبّق Googlebot مجموع القواعد السلبية. هذا الوسم مخصص لـ HTML فقط — استخدم ترويسة X-Robots-Tag مع ملفات PDF والصور وغيرها من الموارد غير المكتوبة بـ HTML.
TL;DR — وسم robots meta هو سطر HTML تضعه داخل
<head>في الصفحة لتخبر محركات البحث بكيفية التعامل مع هذه الصفحة تحديدًا — وغالبًا ما يكون<meta name="robots" content="noindex">لإبقائها خارج نتائج البحث. لكن هناك نقطة توقع كثيرين في الخطأ: يجب أن تتمكن Google من الزحف إلى الصفحة كي تقرأ الوسم. فإذا حظرت الصفحة أيضًا فيrobots.txt، فلن ترى Google الوسم، وقد تبقى الصفحة في نتائج البحث. وعند غياب الوسم تمامًا، يكون الإعداد الافتراضي «فهرسة الصفحة واتباع الروابط».
ما وسم robots meta؟
وسم robots meta عنصر HTML صغير يوجد داخل <head> في الصفحة:
<meta name="robots" content="noindex">وهو يخبر محركات البحث بكيفية التعامل مع هذه الصفحة تحديدًا — هل تعرضها
في النتائج، وهل تتبع الروابط الموجودة فيها، وهل تعرض مقتطفًا منها، وغير ذلك.
ويعني الجزء name="robots" «جميع محركات البحث التي تقرأ هذا الوسم». ويمكنك
استبداله باسم زاحف، مثل name="googlebot"، لمخاطبة محرك واحد فقط.
إذا لم يوجد وسم robots meta في الصفحة، فالإعداد الافتراضي هو index, follow — أي عرض
الصفحة في البحث واتباع روابطها. لذلك لا تحتاج إلى الوسم إلا عندما تريد تغيير
هذا الإعداد الافتراضي. Evidence for this claim For Google, the default robots meta behavior is index, follow when no restrictive rule is present. Scope: Google-supported robots meta rules; other crawlers publish their own support and defaults. Confidence: high · Verified: Google Search Central: Robots meta tag specifications
أهم قاعدة: لا تحظر الصفحة التي تحاول تطبيق noindex عليها
هذا أكثر خطأ أراه شيوعًا. يريد الناس إخراج صفحة من Google، فيفعلون الأمرين معًا:
- يضيفون
noindexإلى الصفحة، و - يحظرون الصفحة في
robots.txt.
الخطوة الثانية تُبطل الأولى. فحظر عنوان URL في robots.txt يقول لـ Google:
«لا تجلب هذه الصفحة أصلًا». لذلك لا تنزّلها Google ولا تقرأ noindex، وقد
تبقى الصفحة في الفهرس. والحل هو إبقاء الصفحة قابلة للزحف وترك Google تقرأ
noindex. Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications
فكّر فيهما بوصفهما مهمتين مختلفتين:
robots.txtيتحكم في الزحف — أي ما إذا كانت الروبوتات ستجلب الصفحة أصلًا.- وسم robots meta يتحكم في الفهرسة والعرض — أي ما يحدث بعد جلب الصفحة.
لا يمكن استخدام أحدهما بدل الآخر، ولا ينبغي جمعهما على عنوان URL واحد عندما يكون هدفك إزالة الصفحة من البحث.
The same page contains a meta robots noindex directive. In the first path, crawling is allowed, so the crawler fetches the page, reads noindex, and can remove the URL from results after processing. In the second path, robots.txt blocks crawling, so the crawler cannot fetch the page or see noindex, and the URL may remain in results. Crawl control and index control are separate jobs.
© Patrick Stox LLC · CC BY 4.0 ·
التوجيهات الشائعة
فيما يلي التوجيهات التي ستستخدمها فعلًا:
noindex— إبقاء هذه الصفحة خارج نتائج البحث.nofollow— عدم اتباع الروابط في هذه الصفحة. (وهذا يختلف عن وضعrel="nofollow"على رابط واحد؛ فهذا التوجيه ينطبق على كل الروابط في الصفحة.)none— اختصار لـnoindex, nofollow.nosnippet— عدم عرض مقتطف نصي لهذه الصفحة في النتائج.
يمكنك الجمع بينها بفاصلة: <meta name="robots" content="noindex, nofollow">.
بعض المحاذير بوضوح
noindexلا يجعل الصفحة خاصة. تظل الصفحة عامة وقابلة للزحف — لكنها لا تظهر في البحث. وللخصوصية الحقيقية، استخدم تسجيل الدخول.noindexلا يوفر ميزانية الزحف. فلا يزال على Google جلب الصفحة كي ترى الوسم.- لا يمكنك إضافة وسم
<meta>إلى ملف PDF أو صورة — إذ لا يوجد<head>في HTML. ولهذا توجد ترويسة HTTP المسماة X-Robots-Tag (وسنشرحها أكثر في النسخة المتقدمة). - لا توجد مدة زمنية ثابتة لخروج صفحة تحمل
noindexمن Google. تقول Google إن إعادة الزحف إلى صفحة منخفضة الأولوية ومعالجتها قد تستغرق أشهرًا — فلا تعد العميل بمدة «أسبوعين إلى أربعة أسابيع».
هل تريد القائمة الكاملة للتوجيهات، وكيف تحل Google القواعد المتعارضة، والحالة
الخاصة بـ googlebot مقابل robots، وتفاصيل ترويسة X-Robots-Tag؟ انتقل إلى
علامة التبويب متقدم.
اختبر نفسك: توجيهات robots meta
اختر وسيلة التحكم حسب النتيجة المطلوبة
Which robots control should I use?
وسائل تحكم robots التي تفشل في أداء الغرض منها
- الجمع بين
noindexوحظر في robots.txt. يمنع الحظر الزاحف من رؤية توجيه الإزالة. - استخدام
disallowبوصفه ضمانًا لإلغاء الفهرسة. فهو يوقف الجلب، لكن قد يظل عنوان URL المرتبط به مفهرسًا بلا محتوى الصفحة. - افتراض أن وسم robots meta الموضوع داخل body سيُتجاهل بصمت. تقول Google
إنها تحترم وسم robots meta داخل body، ولذلك يظل القالب الذي يحقنه هناك فعالًا
لديها — لكن التزم بوضعه داخل
<head>، لأنه الموضع الوحيد الذي يُضمن أن الزواحف وأدوات التحقق الأخرى تتوقعه. - استخدام رمز اسم زاحف لا تقرؤه Google (مثل
name="bingbot") وافتراض أنه يحدد نطاق القاعدة لدى Google أيضًا. لا تتعرف Google إلا علىgooglebotوgooglebot-news؛ وتتجاهل تمامًا أي قيمة أخرى للاسم. - استخدام وسم meta من HTML مع ملف PDF. قدّم
X-Robots-Tagفي استجابة HTTP للملفات غير المكتوبة بـ HTML. - معاملة
nofollowكأنهnoindex. التحكم في الروابط لا يزيل الصفحة الحالية من النتائج. - نشر وسوم عامة وخاصة بزاحف من دون حساب مجموعها. راجع كل توجيهات
robotsوgooglebotوالترويسات معًا؛ فقد تبقى القاعدة المقيّدة في موضع ثانٍ. - استخدام قواعد robots لحفظ السرية. يمكن لأي شخص طلب عنوان URL عام أو قراءة
robots.txt؛ والمحتوى السري يحتاج إلى مصادقة.
انشر noindex بأمان
- تأكدت من أن النتيجة المقصودة هي الإزالة من البحث — لا تقليل الزحف، أو دمج الصفحات عبر canonical، أو التحكم في الوصول.
- استخدمت
<meta name="robots" content="noindex">مع HTML أو ترويسة الاستجابةX-Robots-Tag: noindexمع مورد غير مكتوب بـ HTML. - أبقيت عنوان URL قابلًا للزحف والوصول من الزاحف المستهدف.
- أزلت التوجيهات المتعارضة في القالب ونظام إدارة المحتوى وCDN والتوجيهات الخاصة بالزواحف.
- فحصت head بعد العرض والاستجابة الفعلية، لا قالب المصدر فقط.
- اختبرت عنوان URL الأساسي والمتغيرات أو عمليات إعادة التوجيه المهمة.
- سجلت مجموعة عناوين URL المتأثرة ووقت النشر للمقارنة لاحقًا.
- تحققت من القاعدة في URL Inspection وراقبت تقرير Page Indexing بعد إعادة الزحف.
- استخدمت المصادقة بدلًا من ذلك إذا كان المحتوى يجب أن يظل خاصًا.
افحص meta والترويسات وإمكانية الزحف
استبدل عنوان URL في تدقيق الصدفة هذا:
url="https://example.com/page/"
curl -sSI "$url" | grep -iE '^(HTTP/|x-robots-tag:|location:)'
curl -sS "$url" | grep -oiE '<meta[^>]+name=["'"'](robots|googlebot)["'"'][^>]*>'
curl -sS "https://example.com/robots.txt"في وحدة تحكم DevTools، احصر كل وسوم robots التي جرى تحليلها بدل التوقف عند أول تطابق:
console.table([...document.querySelectorAll('meta[name]')]
.filter((meta) => /^(robots|googlebot|bingbot)$/i.test(meta.name))
.map((meta) => ({ crawler: meta.name, content: meta.content })));لا تظهر الترويسات في DOM، لذلك قارن نتيجة وحدة التحكم بالاستجابة الفعلية. واتبع عمليات إعادة التوجيه أيضًا: فوجود توجيه في استجابة وسيطة لا يثبت أن الوجهة تقدم القاعدة نفسها.
اختبر كل طبقة على حدة
- أداة فحص ترويسات HTTP — افحص الحالة وعمليات إعادة التوجيه
وكل ترويسة
X-Robots-Tagفعلية، بما في ذلك ملفات PDF. - أداة اختبار Robots.txt — تحقق مما إذا كان مسموحًا للزاحف المستهدف بجلب عنوان URL، ومن ثم اكتشاف توجيه robots.
استخدم الأداتين معًا عند تشخيص عنوان URL مفهرس يستعصي حله. فاستجابة noindex الصحيحة لا تفيد إذا منع robots.txt جلبها، كما أن السماح بالزحف لا يثبت أن الصفحة تقدم noindex فعلًا.
أثبت أن التوجيه يعمل بعد النشر
الاختبار 1 — التسليم الفعلي
- الفرضية: كل عنوان URL مقصود يقدم قاعدة
noindexفعالة واحدة. - الطريقة: خذ عينة من مجموعة عناوين URL، واتبع عمليات إعادة التوجيه، وافحص وسوم meta بعد العرض إلى جانب ترويسات الاستجابة.
- شرط النجاح: تكون الاستجابة النهائية قابلة للزحف وتعرض
noindexللزاحف المقصود من دون مسار تسليم متعارض. - شرط الفشل: تغيّر عملية إعادة توجيه أو ترويسة CDN أو وسم خاص بزاحف القاعدة.
- الإجراء التالي: أصلح الطبقة المسؤولة وكرر الاختبار على العينة نفسها.
الاختبار 2 — معالجة محرك البحث
- الفرضية: تستطيع Google الزحف إلى الصفحة وقد عالجت قاعدة الإزالة.
- الطريقة: شغّل الاختبار المباشر في URL Inspection، ثم راقب تقرير Page Indexing بعد إعادة الزحف.
- شرط النجاح: يكتشف الاختبار المباشر noindex ويصبح عنوان URL غير مفهرس لهذا السبب.
- شرط الفشل: يكون عنوان URL محظورًا، أو يغيب التوجيه، أو تستمر حالة الفهرس القديمة من دون زحف جديد.
- الإجراء التالي: أعد إتاحة الزحف أو اطلب إعادة الزحف؛ ولا تضف disallow.
قِس النية، لا معيارًا عامًا
تغطية noindex المقصودة
URLs serving the intended noindex ÷ URLs in the approved noindex set
كوّن المقام من قائمة الإزالة الخاصة بك، ثم قارن عمليات الزحف قبل النشر وبعده. والهدف هو التغطية الكاملة لتلك المجموعة المعتمدة — لا نسبة معيارية للقطاع.
تعارضات التحكم في الفهرسة غير المقصودة
تتبع أعداد عناوين URL التي يُقصد تطبيق noindex عليها لكنها لا تزال مفهرسة، أو محظورة في robots.txt، أو تقدم قواعد meta/ترويسات متعارضة. وقسّم النتائج حسب القالب وقاعدة CDN ونوع الملف حتى لا يختبئ عيب تنفيذي واحد داخل إجمالي الموقع.
استخدم تقرير Page Indexing وURL Inspection في Google Search Console دليلًا على المعالجة، مع إدراك أن إلغاء الفهرسة يعتمد على إعادة الزحف. واحتفظ بالعدد السابق للتغيير وتاريخ النشر؛ وإلا فلن يكون لانخفاض الإجمالي خط أساس موثوق.
Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specificationsTL;DR — يتحكم
<meta name="robots" content="…">داخل<head>في كيفية فهرسة صفحة واحدة وعرضها؛ وعند غياب الوسم يكون الإعداد الافتراضيindex, follow. إنه نظام الزحف ثم الامتثال: “these settings can be read and followed only if crawlers are allowed to access the pages” (ترجمة) لا يمكن قراءة هذه الإعدادات واتباعها إلا إذا سُمح للزواحف بالوصول إلى الصفحات — ولذلك لا تُجلب صفحة محظورة فيrobots.txtولا يُرىnoindexفيها (ولدي بيانات مباشرة عن الوجه الآخر لهذه الآلية). وتُحسم القواعد المتعارضة لصالح الأكثر تقييدًا؛ وعند اجتماع وسمgooglebotمع وسمrobotsالعام، يطبّق Googlebot مجموع القواعد السلبية. الوسم خاص بـ HTML — استخدم ترويسة X-Robots-Tag مع الموارد غير المكتوبة بـ HTML وعلى نطاق واسع. ولا تقرأ Google سوى رمزين مسميين للزواحف:googlebotوgooglebot-news، وتتجاهل كل قيمة أخرى، ومنها رموز محركات أخرى مثلbingbot.
ما هو الوسم، وأين يوضع، وما الإعداد الافتراضي؟
يتيح لك وسم robots meta، بحسب تعبير Google، “use a granular, page-specific
approach to controlling how an individual HTML page should be indexed and served
to users in Google Search results.” (ترجمة) استخدام نهج دقيق خاص بكل صفحة للتحكم
في كيفية فهرسة صفحة HTML منفردة وعرضها للمستخدمين في نتائج بحث Google. والموضع
التقليدي المتوافق على نطاق واسع هو <head>:
<meta name="robots" content="noindex, nofollow">وضع الوسم في head هو قاعدة التأليف التي تتوقعها كل المحركات، لكن Google توضح
أنه ليس شرطًا صارمًا في بحث Google تحديدًا: “Google Search doesn’t enforce placement
of meta robots in the HTML head and will respect robots meta tags in the body section
of an HTML document as well.” (ترجمة) لا يفرض بحث Google وضع robots meta داخل
رأس HTML، وسيحترم أيضًا وسوم robots meta الموجودة في قسم body من مستند HTML.
تعامل مع ذلك كتسامح من Google، لا كنصيحة قابلة للتعميم — واكتب الوسم داخل
<head> كي تقرأه بصورة صحيحة كل الزواحف وأدوات التحقق التي تتوقع الموضع القياسي.
سمة name تحدد الجمهور، وهنا تبالغ معظم الأدلة في وصف دعم Google.
يخاطب name="robots" كل زاحف يقرأ الوسم. وما عدا ذلك، تدعم Google رمزين فقط
مسميين للزواحف وتتجاهل كل قيمة أخرى: “Google supports two user agent tokens in
the robots meta tag; other values are ignored: googlebot for all text results,
and googlebot-news for news results.” (ترجمة) تدعم Google رمزين لوكيل المستخدم
في وسم robots meta، وتتجاهل القيم الأخرى: googlebot لكل النتائج النصية،
وgooglebot-news لنتائج الأخبار. لذلك فإن وسمًا باسم name="bingbot" ليس
وسيلة تحكم موثقة لدى Google — يقرأ Bing رمزه وفق قواعده، لكن Google تتجاوز أي
قيمة name لا تتعرف عليها. ولا تميز Google حالة الأحرف في سمتي name وcontent،
ولا في أسماء ترويسات X-Robots-Tag وقيمها.
عند غياب وسم robots meta، يكون الإعداد الافتراضي
index, follow (وهو توجيه all الذي تقول Google إنه “has no effect if explicitly
listed” (ترجمة) لا يكون له أثر إذا ذُكر صراحةً). Evidence for this claim For Google, the default robots meta behavior is index, follow when no restrictive rule is present. Scope: Google-supported robots meta rules; other crawlers publish their own support and defaults. Confidence: high · Verified: Google Search Central: Robots meta tag specifications ولا تحتاج إلى الوسم إلا لتغيير هذا الإعداد.
يمكنك الجمع بين القواعد بطريقتين: بفصلها بفواصل داخل وسم واحد (noindex, nofollow)،
أو باستخدام عدة وسوم <meta>. تقول Google إنه يمكنك “create a multi-rule instruction by
combining robots meta tag rules with commas or by using multiple meta tags.”
(ترجمة) إنشاء تعليمة متعددة القواعد بجمع قواعد وسم robots meta بفواصل أو باستخدام
عدة وسوم meta.
القاعدة التي تُفسد كل شيء: يجب أن تزحف Google إلى الصفحة كي ترى الوسم
هذه هي خلاصة المقال كله. يعمل وسم robots meta وفق مبدأ الزحف ثم الامتثال. يجب أن تجلب Google الصفحة كي تقرأ الوسم — ولذلك فإن أي شيء يمنع الجلب يمنع تطبيق الوسم أصلًا. وهذا نص المواصفة:
Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications“Keep in mind that these settings can be read and followed only if crawlers are allowed to access the pages that include these settings.” (ترجمة) تذكّر أنه لا يمكن قراءة هذه الإعدادات واتباعها إلا إذا سُمح للزواحف بالوصول إلى الصفحات التي تتضمنها.
وهذه هي النتيجة كما وردت صراحةً:
“If a page is disallowed from crawling through the robots.txt file, then any information about indexing or serving rules will not be found and will therefore be ignored.” (ترجمة) إذا مُنع الزحف إلى صفحة عبر ملف robots.txt، فلن يُعثر على أي معلومات عن قواعد الفهرسة أو العرض، ولذلك ستُتجاهل.
لذلك فإن الخطأ التقليدي — Disallow في robots.txt مع noindex على عنوان
URL نفسه — يُبطل noindex بصمت. فلا تزحف Google إلى الصفحة، ولا ترى الوسم،
وقد يظل عنوان URL في الفهرس (غالبًا كنتيجة مجردة بلا مقتطف إذا كان هناك رابط
يشير إليه). وتقول وثيقة Google المصاحبة «حظر فهرسة البحث» الشيء نفسه بعبارة
أوضح: لكي تعمل قاعدة noindex، فإن الصفحة “must not be blocked by a robots.txt
file… If the page is blocked by a robots.txt file or the crawler can’t access the
page, the crawler will never see the noindex rule, and the page can still appear
in search results.” (ترجمة) يجب ألا تكون محظورة بملف robots.txt… وإذا حظرها
ملف robots.txt أو تعذر على الزاحف الوصول إليها، فلن يرى الزاحف قاعدة noindex
أبدًا، وقد تظل الصفحة ظاهرة في نتائج البحث.
لقد شاهدت الوجه الآخر لهذه الآلية يحدث في بيانات حقيقية. ففي تجربتي
قصة حظر صفحتين مرتفعتي الترتيب باستخدام Robots.txt،
حظرت عمدًا صفحتين كانتا تظهران في نتائج البحث عبر robots.txt. ولأن Google لم
تعد تستطيع الزحف إليهما، لم تستطع تحديث أي معلومات عنهما — وظلت الصفحتان
في ترتيب قريب من السابق: “We lost a position here or there and all of the
featured snippets for the pages.” (ترجمة) خسرنا مركزًا هنا أو هناك، وخسرنا
كل المقتطفات المميزة للصفحتين. وكان استنتاجي: “Accidentally blocking pages
(that Google already ranks) from being crawled using robots.txt probably isn’t
going to have much impact on your rankings, and they will likely still show in the
search results.” (ترجمة) من غير المرجح أن يؤثر كثيرًا في ترتيبك أن تحظر بالخطأ
عبر robots.txt زحف صفحات ترتبها Google بالفعل، ومن المرجح أن تظل ظاهرة في نتائج
البحث. وهذا هو الوجه نفسه لمشكلة noindex — فعنوان URL المحظور يتجمد. الحظر
لا يعني الإزالة. وإذا أردت أن تختفي الصفحة فعلًا، فأنت تحتاج إلى noindex
قابل للزحف، وهذا هو الغرض الكامل من الوسم.
هذا هو الحد الذي أوضحته علنًا بين اختصاص كل أداة. عندما سُئلت هل ينبغي أن تضيف
Google دعم noindex إلى robots.txt، قلت: “Google was clear they want robots.txt
for crawl control only.” (ترجمة) كانت Google واضحة في أنها تريد robots.txt للتحكم
في الزحف فقط. الزحف هو وظيفة robots.txt، والفهرسة وظيفة وسم meta (أو
الترويسة). ولا تتداخل الوظيفتان، كما أن توجيه noindex في robots.txt لم يكن
مدعومًا رسميًا قط — وقد أوقفت Google تحليله في 1 سبتمبر 2019.
كل توجيهات robots meta (المرجع)
قيم Google المدعومة، مع أوصافها الحرفية من المواصفة:
الفهرسة
all— “There are no restrictions for indexing or serving. This rule is the default value and has no effect if explicitly listed.” (ترجمة) لا توجد قيود على الفهرسة أو العرض. هذه القاعدة هي القيمة الافتراضية ولا يكون لها أثر إذا ذُكرت صراحةً.noindex— “Do not show this page, media, or resource in search results.” (ترجمة) لا تعرض هذه الصفحة أو الوسائط أو المورد في نتائج البحث.none— “Equivalent tonoindex, nofollow.” (ترجمة) مكافئ لـnoindex, nofollow.indexifembedded— “Google is allowed to index the content of a page if it’s embedded in another page through iframes or similar HTML tags, in spite of anoindexrule.” (ترجمة) يُسمح لـ Google بفهرسة محتوى صفحة إذا كان مضمنًا في صفحة أخرى عبر iframe أو وسوم HTML مشابهة، رغم وجود قاعدةnoindex. (وهذا هو التوجيه الوحيد الذي يتجاوزnoindexللمحتوى المضمّن.)
الروابط
nofollow— “Do not follow the links on this page.” (ترجمة) لا تتبع الروابط في هذه الصفحة. وهذا توجيه على مستوى الصفحة — بنطاق مختلف عنrel="nofollow"الموضوع على رابط واحد.
العرض والمقتطفات
nosnippet— “Do not show a text snippet or video preview in the search results for this page.” (ترجمة) لا تعرض مقتطفًا نصيًا أو معاينة فيديو لهذه الصفحة في نتائج البحث. ونطاقه أوسع من المقتطف النصي التقليدي: تقول Google إنه «applies to all forms of search results (at Google: web search, Google Images, Discover, AI Overviews, AI Mode) and will also prevent the content from being used as a direct input for AI Overviews and AI Mode.» (ترجمة) ينطبق على جميع أشكال نتائج البحث لدى Google، وسيمنع أيضًا استخدام المحتوى مدخلًا مباشرًا في AI Overviews وAI Mode.max-snippet:[number]— “Use a maximum of [number] characters as a textual snippet for this search result.” (ترجمة) استخدم حدًا أقصى قدره [number] حرفًا للمقتطف النصي في نتيجة البحث هذه. وله النطاق الموسع نفسه مثلnosnippet؛ فهو «applies to all forms of search results (such as Google web search, Google Images, Discover, Assistant, AI Overviews, AI Mode) and will also limit how much of the content may be used as a direct input for AI Overviews and AI Mode.» (ترجمة) ينطبق على جميع أشكال نتائج البحث، ويحد أيضًا مقدار المحتوى الذي يمكن استخدامه مدخلًا مباشرًا في AI Overviews وAI Mode. وهذا تحكم في أهلية الإدخال المباشر لميزات بحث Google المعتمدة على الذكاء الاصطناعي — وليس إلغاء اشتراك عامًا في تدريب نماذج الذكاء الاصطناعي. فإبعاد المحتوى عن تدريب النماذج (مثل Google-Extended) أو عن وسيلة التحكم المنفصلة على مستوى الخاصية للذكاء الاصطناعي التوليدي في Search Console نظامان مختلفان بنطاقين مختلفين؛ فلا تعتبرnosnippetأوmax-snippetشاملين لأي منهما.max-image-preview:[setting]— “Set the maximum size of an image preview for this page in search results.” (ترجمة) اضبط الحجم الأقصى لمعاينة صورة هذه الصفحة في نتائج البحث. والإعدادات هيnoneأوstandardأوlarge(“A larger image preview, up to the width of the viewport, may be shown.” (ترجمة) قد تُعرض معاينة صورة أكبر تصل إلى عرض إطار العرض.).max-video-preview:[number]— “Use a maximum of [number] seconds as a video snippet for videos on this page in search results.” (ترجمة) استخدم حدًا أقصى قدره [number] ثانية كمقتطف فيديو لمقاطع هذه الصفحة في نتائج البحث.notranslate— “Don’t offer translation of this page in search results.” (ترجمة) لا تعرض ترجمة لهذه الصفحة في نتائج البحث.noimageindex— “Do not index images on this page.” (ترجمة) لا تفهرس الصور الموجودة في هذه الصفحة.unavailable_after:[date/time]— “Do not show this page in search results after the specified date/time.” (ترجمة) لا تعرض هذه الصفحة في نتائج البحث بعد التاريخ/الوقت المحدد.
تاريخية — لم تعد وسائل تحكم فعالة لدى Google
لا تزال بعض التوجيهات تتكرر في الأدلة القديمة، لكن Google تقول إنها لم تعد تستخدمها. فلا تضفها متوقعًا أن تفعل شيئًا:
noarchive— “Thenoarchiverule is no longer used by Google Search to control whether a cached link is shown in search results, as the cached link feature no longer exists.” (ترجمة) لم يعد بحث Google يستخدم قاعدةnoarchiveللتحكم في عرض رابط مخزن مؤقتًا في نتائج البحث، إذ لم تعد ميزة الرابط المخزن مؤقتًا موجودة.nocache(مرادف استخدمته بعض المحركات لـnoarchive) — “Thenocacherule isn’t used by Google Search.” (ترجمة) لا يستخدم بحث Google قاعدةnocache.nositelinkssearchbox— “Thenositelinkssearchboxrule is no longer used by Google Search to control whether the sitelink search box is shown for a given page, as the feature no longer exists.” (ترجمة) لم يعد بحث Google يستخدم قاعدةnositelinkssearchboxللتحكم في إظهار مربع بحث روابط أقسام الموقع لصفحة معينة، إذ لم تعد الميزة موجودة.
على مستوى الفقرة (لا داخل وسم meta)
توجد وسيلة تحكم واحدة داخل الصفحة، هي سمة data-nosnippet. تقول Google إنه
يمكنك “designate textual parts of an HTML page not to be used as a snippet… on
span, div, and section elements.” (ترجمة) تحديد أجزاء نصية من صفحة HTML
حتى لا تُستخدم كمقتطف… على عناصر span وdiv وsection. وكل ما في وسم meta
ينطبق على الصفحة كلها؛ أما nosnippet / data-nosnippet فهو وسيلتك لمنع مقطع
واحد من الظهور في المقتطف من دون المساس ببقية الصفحة.
جمع التوجيهات وحل التعارضات
تحكم قاعدتان ما يحدث عندما تتعارض التوجيهات.
1. القاعدة الأكثر تقييدًا هي التي تسود. “In the case of conflicting robots rules,
the more restrictive rule applies. For example, if a page has both max-snippet:50
and nosnippet rules, the nosnippet rule will apply.” (ترجمة) عند تعارض قواعد
robots تُطبّق القاعدة الأكثر تقييدًا. فإذا كانت في الصفحة قاعدتا max-snippet:50
وnosnippet، تُطبّق nosnippet. فـ nosnippet أكثر صرامة من حد 50 حرفًا،
ولذلك تكون هي النتيجة.
2. googlebot مقابل robots — مجموع القواعد السلبية. هنا تخطئ معظم الأدلة.
فالوسم المسمى googlebot لا يستبدل ببساطة وسم robots العام — وعند التداخل
يطبّق Googlebot اتحاد القيود. تقول Google: “For situations where multiple
crawlers are specified along with different rules, the search engine will use the
sum of the negative rules.” (ترجمة) في الحالات التي تُحدد فيها زواحف متعددة
مع قواعد مختلفة، سيستخدم محرك البحث مجموع القواعد السلبية. وهذا مثالها العملي:
<meta name="robots" content="nofollow">
<meta name="googlebot" content="noindex">“The page containing these meta tags will be interpreted as having a noindex, nofollow rule when crawled by Googlebot.” (ترجمة) ستُفسر الصفحة التي تحتوي
هذه الوسوم على أنها تحمل قاعدة noindex, nofollow عندما يزحف إليها Googlebot.
فيجتمع nofollow من robots مع noindex من googlebot ليصبحا
noindex, nofollow لدى Googlebot. (وحين يضبط وسم googlebot ووسم robots
التوجيه نفسه بصورة مختلفة، يكون الوسم المسمى بالزاحف هو المطبق على ذلك الزاحف.)
وسم robots meta مقابل X-Robots-Tag (ترويسة HTTP)
وسم robots meta خاص بـ HTML — فهو يحتاج إلى <head>. وأي شيء غير مكتوب
بـ HTML يستخدم X-Robots-Tag التي تقدم مجموعة القواعد نفسها تمامًا في ترويسة
استجابة HTTP. تقول Google: “The X-Robots-Tag can be used as an element of the
HTTP header response for a given URL. Any rule that can be used in a robots meta
tag can also be specified as an X-Robots-Tag.” (ترجمة) يمكن استخدام
X-Robots-Tag عنصرًا في استجابة ترويسة HTTP لعنوان URL معين، ويمكن أيضًا تحديد
أي قاعدة تصلح في وسم robots meta بوصفها X-Robots-Tag. وهذا سبب وجودها:
“You can use the X-Robots-Tag for non-HTML files like image files where the
usage of robots meta tags in HTML is not possible.” (ترجمة) يمكنك استخدام
X-Robots-Tag للملفات غير المكتوبة بـ HTML مثل الصور، حيث يتعذر استخدام وسوم
robots meta في HTML.
إذن:
- ملف PDF أو صورة أو مورد آخر غير مكتوب بـ HTML؟ لا يمكنك إضافة وسم
<meta>— استخدم الترويسة، مثلX-Robots-Tag: noindex. - أدلة أو أنماط كاملة؟ تُضبط الترويسة على مستوى الخادم أو CDN، ولذلك يمكن تطبيقها على مسارات كاملة بقاعدة إعداد واحدة.
- محرك واحد؟ يمكن للترويسة استهداف زاحف أيضًا:
X-Robots-Tag: googlebot: noindex, nofollow، ويمكن جمع عدة ترويسات X-Robots-Tag في استجابة واحدة.
القواعد نفسها بآليتي تسليم: وسم meta لصفحات HTML، والترويسة لكل ما عدا ذلك وللتطبيق على نطاق واسع.
ما التوجيهات التي يدعمها Bing والمحركات الأخرى؟
لا تفترض أن مجموعة التوجيهات عالمية — فهي ليست كذلك. يدعم Bing قواعد الفهرسة
والعرض الأساسية: noindex وnofollow وnoarchive (ومرادفها nocache)
وnosnippet، ويحترم X-Robots-Tag للموارد غير المكتوبة بـ HTML. لكنه لا يدعم
اختصار none، ولذلك اكتب noindex, nofollow صراحةً لضمان التوافق بين المحركات.
أما عائلة التحكم في المقتطفات والمعاينات — max-snippet وmax-image-preview
وmax-video-preview — إلى جانب noimageindex وnotranslate وindexifembedded
وunavailable_after، فهي عمليًا خاصة بـ Google. وعند الشك، اكتب التوجيهات
كاملة وتعامل مع وسائل max-* بوصفها ميزات Google.
الأخطاء الشائعة (وكيفية إصلاحها)
Disallowمعnoindexعلى عنوان URL نفسه. لن يُرىnoindex. الحل: أبقِ الصفحة قابلة للزحف، واكتفِ بـnoindex.noindexمعrel=canonicalيشير إلى موضع آخر. إشارتان متعارضتان — فأنت تقول لـ Google «أسقط هذه الصفحة» و«ادمجها في صفحة أخرى» معًا. اختر واحدة. (المزيد في تحديد العنوان الأساسي.)- انتقال
noindexشامل لبيئة الاختبار إلى الإنتاج. إلغاء كارثي لفهرسة الموقع كله. افحص ذلك قبل الإطلاق. - حقن
noindexبواسطة JavaScript من جهة العميل فقط. يجب أن تعرض Google الصفحة كي تراه، وإذا اختلف HTML المعروض عما تتوقعه اختلف السلوك أيضًا. فضّل الوسم في HTML الخام أو الترويسة. (راجع العرض.) - توقع أن يحترم Bing توجيهات Google فقط (
noneوعائلةmax-*). - توقع أن يؤدي توجيه robots وظيفة لا يملكها. لا تضمن قاعدة
noindexأوnosnippetوحدها توفير ميزانية الزحف، أو السرية، أو تغير الترتيب، أو تطابق السلوك بين المحركات، أو موعد إزالة محدد، أو الاستبعاد من كل أسطح الذكاء الاصطناعي والبحث — فلكل نتيجة وسيلة تحكم مختلفة (المصادقة للسرية، وrobots.txtللزحف، ووثائق كل محرك للتوافق، وSearch Console أو Google-Extended للنطاقات الخاصة بالذكاء الاصطناعي). ولا تعطي Google موعدًا ثابتًا لخروج صفحة تحملnoindex؛ فهذا يعتمد على أولوية إعادة الزحف وقد «يستغرق أشهرًا» لصفحة أقل أهمية.
لوضع ذلك في الصورة الأكبر: تمثل robots.txt والزحف جانب التحكم في الزحف؛ وتمثل noindex والفهرسة جانب التحكم في الفهرسة؛ أما nosnippet / data-nosnippet وmax-snippet وmax-image-preview فهي وسائل التحكم في العرض عندما تريد إبقاء الصفحة مفهرسة مع ضبط شكل ظهورها. وX-Robots-Tag هي النظير في ترويسة HTTP للوسم نفسه مع الموارد غير المكتوبة بـ HTML.
ملخص الذكاء الاصطناعي
خلاصة مكثفة للنسخة المتقدمة:
- وسم robots meta — أي
<meta name="robots" content="…">داخل<head>— يتحكم في كيفية فهرسة صفحة HTML واحدة وعرضها. وعند غياب الوسم يكون الإعداد الافتراضيindex, follow. - إنه نظام الزحف ثم الامتثال. يجب أن تزحف Google إلى الصفحة كي تقرأ الوسم:
“these settings can be read and followed only if crawlers are allowed to access the
pages.” (ترجمة) لا يمكن قراءة هذه الإعدادات واتباعها إلا إذا سُمح للزواحف
بالوصول إلى الصفحات. ولذلك فإن عنوان URL المحظور في robots.txt لا يُرى
noindexفيه — وهذا هو الخطأ التقليدي. وتثبت تجربة الصفحات المحظورة التي أجراها Patrick الآلية: ظلت الصفحات المحظورة مفهرسة وحافظت غالبًا على ترتيبها. الحظر لا يعني الإزالة. - robots.txt = التحكم في الزحف؛ ووسم meta (أو X-Robots-Tag) = التحكم في الفهرسة
والعرض. لا يحل أحدهما محل الآخر. وأُوقف
noindexفي robots.txt في 1 سبتمبر 2019. - التوجيهات: الفهرسة (
noindexوnoneوindexifembedded)، والروابط (nofollowعلى مستوى الصفحة)، والعرض (nosnippetوmax-snippetوmax-image-previewوmax-video-previewوnotranslateوnoimageindexوunavailable_after)، إضافة إلى سمةdata-nosnippetعلى مستوى الفقرة. أماnoarchiveوnocacheوnositelinkssearchboxفتوجيهات تاريخية تقول Google إنها لم تعد تستخدمها. - تتحكم
nosnippetوmax-snippetأيضًا في AI Overviews وAI Mode — تقول Google إنهما يحددان ما إذا كان يمكن استخدام محتوى الصفحة مدخلًا مباشرًا لهاتين الميزتين، لا للمقتطف النصي التقليدي فحسب. وهذا ليس إلغاء اشتراك عامًا في تدريب الذكاء الاصطناعي؛ فـ Google-Extended ووسيلة التحكم المنفصلة في الذكاء الاصطناعي التوليدي للبحث نظامان مختلفان. - تُحسم التعارضات لصالح الأكثر تقييدًا (
nosnippetتتغلب علىmax-snippet:50). وعند اجتماع وسمgooglebotووسمrobotsالعام، يطبق Googlebot مجموع القواعد السلبية —robots: nofollow+googlebot: noindexينتجانnoindex, nofollow. ولا تتعرف Google إلا على رمزي الاسمgooglebotوgooglebot-news؛ وتتجاهل القيم الأخرى مثلbingbot. - الموضع التقليدي لوسم meta هو
<head>فقط (وتتسامح Google أيضًا مع وضعه في body، لكن ذلك خاص بها وغير قابل للتعميم)؛ وتحمل X-Robots-Tag القواعد نفسها في ترويسة HTTP لملفات PDF والصور والموارد غير المكتوبة بـ HTML والأدلة الكاملة. - عبر المحركات: يدعم Bing
noindexوnofollowوnoarchive(nocache) وnosnippet، لكنه لا يدعمnone؛ وعائلةmax-*خاصة عمليًا بـ Google — فاكتب التوجيهات كاملة. - لا ضمانات: لا يعد توجيه robots وحده بتوفير ميزانية الزحف، أو السرية، أو
تغير الترتيب، أو التطابق بين المحركات، أو موعد إزالة ثابت — ولا تحدد Google
إطارًا زمنيًا لتطبيق
noindex.
الوثائق الرسمية
وثائق المصادر الأولية من محركات البحث.
- مواصفات وسم robots meta وdata-nosnippet وX-Robots-Tag — المواصفة المرجعية: كل التوجيهات، وجمع القواعد، وحل التعارضات، واتحاد
googlebotوrobots، وترويسة X-Robots-Tag. ابدأ من هنا. - حظر فهرسة البحث باستخدام noindex — كيفية عمل
noindex، وآليتا التسليم (وسم meta والترويسة)، والاعتماد على الزحف بلغة واضحة. - مقدمة إلى robots.txt — النظير الذي يتحكم في الزحف، حتى لا تخلط بين الوظيفتين.
- الزحف والفهرسة — المركز الخاص بـ robots وخرائط الموقع وتحديد العنوان الأساسي ووسائل التحكم في الزحف.
Bing / Microsoft
- وسوم robots meta والسمات التي يدعمها Bing — توجيهات Bing المدعومة (أكد القائمة الدقيقة في الصفحة الفعلية؛ فهي معروضة بواسطة JavaScript).
مرجع
- MDN —
<meta name="robots">— مرجع للتوجيهات عبر المحركات، بما في ذلك المحركات التي تستخدمnoarchiveوnocache.
اقتباسات من المصدر
تصريحات مسجلة من Google. كل رابط عميق ينقلك إلى المقطع المقتبس في صفحة المصدر.
Google — ماهية الوسم والإعداد الافتراضي
- “The robots
metatag lets you use a granular, page-specific approach to controlling how an individual HTML page should be indexed and served to users in Google Search results.” (ترجمة) يتيح لك وسم robotsmetaاستخدام نهج دقيق خاص بكل صفحة للتحكم في كيفية فهرسة صفحة HTML منفردة وعرضها للمستخدمين في نتائج بحث Google. — وثائق Google Search Central. انتقل إلى الاقتباس
Google — الاعتماد على الزحف ثم الامتثال
- “Keep in mind that these settings can be read and followed only if crawlers are allowed to access the pages that include these settings.” (ترجمة) لا تُقرأ هذه الإعدادات ولا تُتبع ما لم يكن مسموحًا للزواحف بالوصول إلى الصفحات التي تحتويها. انتقل إلى الاقتباس
- “If a page is disallowed from crawling through the robots.txt file, then any information about indexing or serving rules will not be found and will therefore be ignored.” (ترجمة) إذا مُنع الزحف إلى صفحة عبر ملف robots.txt، فلن يُعثر على أي معلومات عن قواعد الفهرسة أو العرض، ولذلك ستُتجاهل. انتقل إلى الاقتباس
- “For the
noindexrule to be effective, the page or resource must not be blocked by a robots.txt file, and it has to be otherwise accessible to the crawler.” (ترجمة) لكي تكون قاعدةnoindexفعالة، يجب ألا تُحظر الصفحة أو المورد بملف robots.txt، ويجب أن يكونا متاحين للزاحف من الجوانب الأخرى. — Google، «حظر فهرسة البحث باستخدام noindex». انتقل إلى الاقتباس
Google — التوجيهات (الأوصاف الحرفية)
- “Do not show this page, media, or resource in search results.” (ترجمة) لا تعرض هذه الصفحة أو الوسائط أو المورد في نتائج البحث. —
noindex. انتقل إلى الاقتباس - “Equivalent to
noindex, nofollow.” (ترجمة) مكافئ لـnoindex, nofollow. —none. انتقل إلى الاقتباس - “Do not show a text snippet or video preview in the search results for this page.” (ترجمة) لا تعرض مقتطفًا نصيًا أو معاينة فيديو في نتائج البحث لهذه الصفحة. —
nosnippet. انتقل إلى الاقتباس - “Google is allowed to index the content of a page if it’s embedded in another page through iframes or similar HTML tags, in spite of a
noindexrule.” (ترجمة) يُسمح لـ Google بفهرسة محتوى صفحة إذا كان مضمنًا في صفحة أخرى عبر iframe أو وسوم HTML مشابهة، رغم وجود قاعدةnoindex. —indexifembedded. انتقل إلى الاقتباس - “A larger image preview, up to the width of the viewport, may be shown.” (ترجمة) قد تُعرض معاينة صورة أكبر تصل إلى عرض إطار العرض. —
max-image-preview:large. انتقل إلى الاقتباس - “Do not index images on this page.” (ترجمة) لا تفهرس الصور الموجودة في هذه الصفحة. —
noimageindex. انتقل إلى الاقتباس - “You can designate textual parts of an HTML page not to be used as a snippet.” (ترجمة) يمكنك تحديد أجزاء نصية من صفحة HTML حتى لا تُستخدم كمقتطف. —
data-nosnippet. انتقل إلى الاقتباس
Google — جمع القواعد وحل التعارضات
- “You can create a multi-rule instruction by combining robots
metatag rules with commas or by using multiplemetatags.” (ترجمة) يمكنك إنشاء تعليمة متعددة القواعد بجمع قواعد وسم robotsmetaبفواصل أو باستخدام عدة وسومmeta. انتقل إلى الاقتباس - “In the case of conflicting robots rules, the more restrictive rule applies. For example, if a page has both
max-snippet:50andnosnippetrules, thenosnippetrule will apply.” (ترجمة) إذا تعارضت قواعد robots، تُنفّذ القاعدة الأشد. فحين تجمع الصفحة بينmax-snippet:50وnosnippet، تكونnosnippetهي النافذة. انتقل إلى الاقتباس - “For situations where multiple crawlers are specified along with different rules, the search engine will use the sum of the negative rules.” (ترجمة) في الحالات التي تُحدد فيها زواحف متعددة مع قواعد مختلفة، سيستخدم محرك البحث مجموع القواعد السلبية. انتقل إلى الاقتباس
Google — الموضع ورموز الزواحف وحساسية حالة الأحرف
- “Google Search doesn’t enforce placement of meta robots in the HTML head and will respect robots meta tags in the body section of an HTML document as well.” (ترجمة) لا يفرض بحث Google وضع robots meta داخل رأس HTML، وسيحترم أيضًا وسوم robots meta الموجودة في قسم body من مستند HTML. انتقل إلى الاقتباس
- “Google supports two user agent tokens in the robots
metatag; other values are ignored.” (ترجمة) تدعم Google رمزين لوكيل المستخدم في وسم robotsmeta، وتتجاهل القيم الأخرى. انتقل إلى الاقتباس - “Both the
nameand thecontentattributes are case-insensitive.” (ترجمة) لا تميز سمتاnameوcontentحالة الأحرف. انتقل إلى الاقتباس
Google — noarchive والتوجيهات التاريخية الأخرى
- “The
noarchiverule is no longer used by Google Search to control whether a cached link is shown in search results, as the cached link feature no longer exists.” (ترجمة) لم يعد بحث Google يستخدم قاعدةnoarchiveللتحكم في عرض رابط مخزن مؤقتًا في نتائج البحث، إذ لم تعد ميزة الرابط المخزن مؤقتًا موجودة. انتقل إلى الاقتباس - “The
nocacherule isn’t used by Google Search.” (ترجمة) لا يستخدم بحث Google قاعدةnocache. انتقل إلى الاقتباس
Google — يمتد تأثير nosnippet وmax-snippet إلى AI Overviews وAI Mode
- «[nosnippet] applies to all forms of search results (at Google: web search, Google Images, Discover, AI Overviews, AI Mode) and will also prevent the content from being used as a direct input for AI Overviews and AI Mode.» (ترجمة) ينطبق [nosnippet] على جميع أشكال نتائج البحث لدى Google، وسيمنع أيضًا استخدام المحتوى مدخلًا مباشرًا في AI Overviews وAI Mode. انتقل إلى الاقتباس
- «[max-snippet] applies to all forms of search results (such as Google web search, Google Images, Discover, Assistant, AI Overviews, AI Mode) and will also limit how much of the content may be used as a direct input for AI Overviews and AI Mode.» (ترجمة) ينطبق [max-snippet] على جميع أشكال نتائج البحث، وسيحد أيضًا مقدار المحتوى الذي يمكن استخدامه مدخلًا مباشرًا في AI Overviews وAI Mode. انتقل إلى الاقتباس
Google — لا إطار زمني ثابت لتطبيق noindex
- “If a page is still appearing in results, it’s probably because we haven’t crawled the page since you added the
noindexrule. Depending on the importance of the page on the internet, it may take months for Googlebot to revisit a page.” (ترجمة) إذا كانت الصفحة لا تزال ظاهرة في النتائج، فربما يرجع ذلك إلى أننا لم نزحف إليها منذ إضافة قاعدةnoindex. وبحسب أهمية الصفحة على الإنترنت، قد يستغرق Googlebot أشهرًا للعودة إليها. — Google، «حظر فهرسة البحث باستخدام noindex». انتقل إلى الاقتباس
Google — X-Robots-Tag
- “The
X-Robots-Tagcan be used as an element of the HTTP header response for a given URL. Any rule that can be used in a robotsmetatag can also be specified as anX-Robots-Tag.” (ترجمة) يمكن تضمينX-Robots-Tagفي ترويسة استجابة HTTP لعنوان URL محدد، كما يمكن التعبير عبرها عن كل قاعدة متاحة في وسم robotsmeta. انتقل إلى الاقتباس - “You can use the
X-Robots-Tagfor non-HTML files like image files where the usage of robotsmetatags in HTML is not possible.” (ترجمة) يمكنك استخدامX-Robots-Tagللملفات غير المكتوبة بـ HTML مثل الصور، حيث يتعذر استخدام وسوم robotsmetaفي HTML. انتقل إلى الاقتباس
Patrick Stox — robots.txt للتحكم في الزحف فقط
- “Google was clear they want robots.txt for crawl control only. The biggest downside will probably be all the people who accidentally take their entire site out of the index.”
(ترجمة) كانت Google واضحة في أنها تريد robots.txt للتحكم في الزحف فقط. ومن المرجح أن يكون أكبر ضرر هو أن يخرج أشخاص كثيرون مواقعهم بالكامل من الفهرس بالخطأ.
— Patrick Stox، ردًا على سؤال هل ينبغي أن تضيف Google
noindexإلى robots.txt، في Search Engine Land. انتقل إلى الاقتباس
Patrick Stox — حظر صفحات مرتبة باستخدام robots.txt (إثبات الفرق بين الزحف والفهرسة)
- “Accidentally blocking pages (that Google already ranks) from being crawled using robots.txt probably isn’t going to have much impact on your rankings, and they will likely still show in the search results.” (ترجمة) من غير المرجح أن يؤثر كثيرًا في ترتيبك أن تحظر بالخطأ عبر robots.txt زحف صفحات ترتبها Google بالفعل، ومن المرجح أن تظل ظاهرة في نتائج البحث. انتقل إلى الاقتباس
- “We lost a position here or there and all of the featured snippets for the pages.” (ترجمة) خسرنا مركزًا هنا أو هناك، وخسرنا كل المقتطفات المميزة للصفحتين. انتقل إلى الاقتباس
كل توجيهات robots meta — ورقة مرجعية سريعة
المجموعة الكاملة لقيم content التي تدعمها Google، ووظيفة كل قيمة، والإعداد الافتراضي.
| التوجيه | وظيفته | افتراضي؟ |
|---|---|---|
all | لا قيود على الفهرسة أو العرض — الإعداد الافتراضي الضمني | نعم (عند غياب الوسم) |
index | السماح بظهور الصفحة في نتائج البحث (الافتراضي؛ ونادرًا ما يُكتب) | ضمني |
noindex | إبقاء هذه الصفحة/الوسائط/المورد خارج نتائج البحث | لا |
follow | اتباع الروابط في هذه الصفحة (الافتراضي؛ ونادرًا ما يُكتب) | ضمني |
nofollow | عدم اتباع أي روابط في هذه الصفحة (على مستوى الصفحة) | لا |
none | اختصار لـ noindex, nofollow (لا يدعمه Bing) | لا |
nosnippet | عدم عرض مقتطف نصي أو معاينة فيديو؛ ويمنع أيضًا استخدام الصفحة مدخلًا مباشرًا في AI Overviews/AI Mode | لا |
max-snippet:[n] | تقييد المقتطف النصي عند [n] حرفًا (0 = لا شيء، -1 = بلا حد)؛ ويحد أيضًا ما يمكن إدخاله مباشرة في AI Overviews/AI Mode | لا |
max-image-preview:[setting] | تقييد حجم معاينة الصورة: none / standard / large | لا |
max-video-preview:[n] | تقييد معاينة الفيديو عند [n] ثانية (0 = لا شيء، -1 = بلا حد) | لا |
notranslate | عدم عرض ترجمة لهذه الصفحة في النتائج | لا |
noimageindex | عدم فهرسة الصور الموجودة في هذه الصفحة | لا |
unavailable_after:[date/time] | إسقاط الصفحة من النتائج بعد التاريخ/الوقت المحدد | لا |
indexifembedded | السماح بفهرسة المحتوى المضمّن عبر iframe حتى مع noindex | لا |
تاريخية — لم تعد Google تستخدمها:
| التوجيه | الحالة |
|---|---|
noarchive | لم يعد مستخدمًا — لم تعد ميزة الرابط المخزن مؤقتًا التي كان يتحكم فيها موجودة |
nocache | لا يستخدمه بحث Google (عاملته بعض المحركات مرادفًا لـ noarchive) |
nositelinkssearchbox | لم يعد مستخدمًا — لم تعد ميزة مربع بحث روابط أقسام الموقع التي كان يتحكم فيها موجودة |
على مستوى الفقرة (سمة HTML، لا قيمة content):
| السمة | وظيفتها | أين؟ |
|---|---|---|
data-nosnippet | إبقاء مقطع محدد خارج المقتطف | على span وdiv وsection |
الصياغة
<!-- one tag, comma-separated -->
<meta name="robots" content="noindex, nofollow">
<!-- target one engine -->
<meta name="googlebot" content="noindex">
<!-- the HTTP-header equivalent, for non-HTML / at scale -->
X-Robots-Tag: noindex
X-Robots-Tag: googlebot: noindex, nofollowحقائق سريعة
- غياب الوسم تمامًا ← الإعداد الافتراضي
index, follow. none=noindex, nofollow— لكن Bing لا يدعمnone؛ فاكتبها كاملة.max-*وnoimageindexوnotranslateوindexifembeddedوunavailable_afterتوجيهات خاصة عمليًا بـ Google.- الوسم خاص بـ HTML؛ وتحمل ترويسة
X-Robots-Tagالقواعد نفسها لملفات PDF والصور والأدلة الكاملة. - تقرأ Google رمزين فقط لاسم الزاحف:
googlebotوgooglebot-news، وتتجاهل كل شيء آخر، بما فيه رموز المحركات الأخرى مثلbingbot. - وضع الوسم في head هو القاعدة المتوافقة، لكن Google تحترم تحديدًا وسم robots
meta الموضوع داخل
<body>أيضًا. - لا تميز Google حالة الأحرف في
nameوcontentوقيمX-Robots-Tag.
النماذج الذهنية
1. الزحف ثم الامتثال — لا يعمل الوسم إلا إذا أمكن جلب الصفحة.
يجب أن تزحف Google إلى الصفحة كي تقرأ الوسم. وكل ما يحظر الجلب (منع في
robots.txt أو مصادقة أو خطأ في الخادم) يعني أن الوسم لن يُرى أبدًا. لذلك
تأكد من أن عنوان URL قابل للزحف قبل أن تثق في noindex. والنتيجة الملازمة:
لا تستخدم Disallow مطلقًا مع عنوان URL تحاول تطبيق noindex عليه.
2. ثلاث أدوات، وثلاث وظائف — لا تخلط بينها.
robots.txt= التحكم في الزحف (هل تجلب الروبوتات الصفحة؟).- وسم robots meta / X-Robots-Tag = التحكم في الفهرسة والعرض (ما الذي يحدث بعد جلبها؟).
- المصادقة = السرية (فالصفحة التي تحمل
noindexتظل عامة). طابق الوظيفة بالأداة. والخطأ الأشهر هو استخدامrobots.txtلمحاولة إلغاء الفهرسة — فهذه وظيفة وسم meta.
3. قاعدة القرار لإزالة صفحة.
هل تريدها خارج البحث؟ أبقها قابلة للزحف وأضف noindex — ولا تحظرها
أيضًا في robots.txt، ولا تجعلها canonical لعنوان URL مختلف. هل تريد أن
تتجاوز الروبوتات مساحة كاملة (ولا يهمك أمر الفهرسة)؟ استخدم disallow في
robots.txt. ولا يمكن استخدام أحدهما بدل الآخر.
4. حل التعارضات — الأكثر تقييدًا هو الذي يسود.
عندما تتعارض القواعد، تُطبق الأشد (nosnippet تتغلب على max-snippet:50).
لا تحاول الالتفاف على ذلك بتركيبات ذكية؛ وافترض أن أضيق قاعدة هي التي ستُطبق.
5. googlebot مقابل robots — مجموع السلبيات، لا الاستبدال.
عند التداخل، يجمع Googlebot القيود من وسم robots العام والوسم المسمى
googlebot بدل اختيار أحدهما. robots: nofollow + googlebot: noindex ←
يحصل Googlebot على noindex, nofollow. (ويتقدم الوسم المسمى بزاحف بالفعل
على الوسم العام حين يضبطان التوجيه نفسه بصورة مختلفة — لكن قاعدة الاتحاد هي
التي ينبغي تذكرها.)
6. صفحة HTML ← وسم meta؛ وكل ما عداها ← ترويسة.
إذا كان المورد يحتوي <head>، فاستخدم وسم <meta>. وإذا كان ملف PDF أو صورة
أو أي ملف غير مكتوب بـ HTML، أو كنت تحتاج إلى تغطية دليل كامل، فاستخدم ترويسة
X-Robots-Tag — مجموعة القواعد نفسها، وآلية تسليم مختلفة.
سجل التغييرات
تم التحديث في 22 أغسطس 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 9 أغسطس 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.