كيفية إزالة الصفحات من فهرس Google

دليل قائم على شجرة قرار لإزالة الفهرسة باستخدام noindex أو 404/410 أو أداة الإزالة أو الحماية بكلمة مرور أو canonical، وشرح لماذا لا يزيل robots.txt الصفحات.

نُشر أول مرة: 3 يوليو 2026 · آخر تحديث: 20 أغسطس 2026 · Advanced
اللغات
دليل واحد في هذه الصفحة

تعتمد إزالة صفحة من نتائج Google على ملكيتها وكون الإزالة مؤقتة أو دائمة وبقاء المحتوى. لا يزيل robots.txt الصفحات، بل يمنع الزحف، وقد يحول دون رؤية noindex. استخدم noindex مع السماح بالزحف، أو 404/410 للحذف، أو الحماية بكلمة مرور، أو canonical للمكررات، وأداة الإزالة للطوارئ المؤقتة. أما الصور فهي استثناء يمكن إزالته عبر Googlebot-Image في robots.txt.

الخلاصة — لا توجد لإزالة الفهرسة أداة واحدة؛ فالاختيار يتوقف على الملكية، وعلى كون الإزالة مؤقتة أو دائمة، وعلى بقاء المحتوى. القاعدة الأساسية: لا يزيل Disallow في robots.txt صفحة من الفهرس، بل يمنع الزحف، وقد تُفهرس الصفحة عبر الروابط، كما لا تستطيع Google رؤية noindex في صفحة لا تزحف إليها. والجمع بينهما يأتي بنتيجة عكسية. أداة الإزالة في GSC حل طوارئ مؤقت لنحو ستة أشهر ويجب إقرانها بوسيلة دائمة: noindex أو 404/410 أو الحماية بكلمة مرور أو canonical للمكررات. أما الصور فـrobots.txt وسيلة Google المعتمدة لإزالتها. ولغير مالك الصفحة مساران: تحديث المحتوى القديم للمحتوى الزائل أو المتغير، وأداة إزالة المعلومات الشخصية للحالات الحساسة. لا تعمل الوسائل الدائمة فورًا؛ بل تنتظر إعادة الزحف.

ما المقصود فعلًا بإزالة الفهرسة، وما الذي لا تعنيه؟

لا يوجد زر «حذف من Google». إزالة الفهرسة مهمة تتحدد وفق الحالة: هل تملك الصفحة، وهل تريد إزالتها مؤقتًا أم دائمًا، وهل ينبغي أن يبقى المحتوى متاحًا للمستخدمين؟ عندما تحسم هذه الأسئلة الثلاثة يتضح الخيار الصحيح غالبًا.

ومن المفيد فصل مسارين منذ البداية:

  • مسار الطوارئ — تحتاج إلى إخفاء شيء سريعًا، مثل عنوان URL متسرب أو معلومات شخصية مكشوفة. تمنحك أداة الإزالة إن كنت تملك الموقع، أو أداة تحديث المحتوى القديم إن لم تكن تملكه، وقتًا للتصرف.
  • المسار الدائم — الحل الفعلي: noindex أو الحذف بـ404/410 أو الحماية بكلمة مرور أو canonical. يجب تطبيقه أثناء خطوة الطوارئ أو بعدها مباشرة لأن أدوات الطوارئ تنتهي صلاحيتها.

الخرافة الأساسية: لا يزيل robots.txt الصفحات من Google

A noindex rule can work only when the crawler is allowed to fetch the page and see it. المصدر: Google Search Central

Both paths start with a page that contains a noindex directive. When crawling is allowed, the crawler fetches the page, reads noindex, and can remove the URL from results after processing. When robots.txt blocks crawling, the crawler cannot see noindex, so the URL may remain in search results.

© Patrick Stox LLC · CC BY 4.0 ·

هذه هي الفكرة التي يحمل عليها الموضوع كله، لذلك تستحق أكبر قدر من الشرح.

الزحف والفهرسة نظامان مختلفان

robots.txt توجيه للزحف، وnoindex توجيه للفهرسة. النظامان منفصلان: تستطيع Google فهرسة عنوان URL لم تزحف إليه إذا اكتشفته عبر الروابط، ولا تستطيع رؤية noindex في عنوان مُنع الزحف إليه. Evidence for this claim Blocking crawling with robots.txt is not a reliable way to remove a URL from Google Search. Scope: Google Search; a blocked URL can still be indexed without content when Google discovers it elsewhere. Confidence: high · Verified: Google Search Central: Introduction to robots.txt

تقول وثائق Google عن noindex حرفيًا: “If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see the noindex rule, and the page can still appear in search results, for example if other pages link to it.” (الترجمة العربية) «إذا حجبت الصفحة بملف robots.txt أو تعذر على الزاحف الوصول إليها، فلن يرى قاعدة noindex مطلقًا، وقد تظل الصفحة تظهر في نتائج البحث، مثلًا إذا ربطت إليها صفحات أخرى». والسبب: “We have to crawl your page in order to see <meta> tags and HTTP headers.” (الترجمة العربية) «يجب أن نزحف إلى صفحتك كي نرى وسوم <meta> وترويسات HTTP».

وقد شرحت الفكرة نفسها بكلماتي في مقال Indexed, though blocked by robots.txt: إذا منعت الزحف إلى الصفحة، فقد تظل Google تفهرسها بسبب الروابط؛ وما لم تستطع الزحف إليها فلن ترى وسم noindex وقد تفهرسها.

ما تقوله وثائق Google عن الإزالة حرفيًا

وثيقة Google “Remove a page hosted on your site from Google”، أي «إزالة صفحة مستضافة على موقعك من Google»، واضحة: تسرد للإزالة الدائمة تحديث المحتوى أو إزالته، أو الحماية بكلمة مرور، أو إضافة noindex، ثم تقول مباشرة: “Don’t use robots.txt as a way to block your page.” (الترجمة العربية) «لا تستخدم robots.txt وسيلةً لحجب صفحتك».

«مفهرسة رغم حظرها في robots.txt» — عَرَض Search Console

إذا جربت نهج robots.txt فربما رأيت حالة Search Console “Indexed, though blocked by robots.txt.” (الترجمة العربية) «مفهرسة رغم حظرها في robots.txt». تصف العبارة عنوان URL فهرسته Google، غالبًا بعد اكتشافه عبر الروابط، مع أنه محظور من الزحف. وفي مقالي على Ahrefs شرحت أربعة أسباب محتملة: حظر زحف حقيقي، أو حظر متقطع/مخزن مؤقتًا، أو حظر خاص بوكيل مستخدم، أو حظر قائم على عنوان IP. لذلك شخّص السبب ولا تفترضه. وتحقق من نص الواجهة الحالي في موقع Search Console حي قبل اقتباسه، إذ قد تعدله Google.

لماذا يؤدي الجمع بين Disallow في robots.txt وnoindex إلى نتيجة عكسية؟

هذا أكثر الإخفاقات التي يصنعها أصحاب المواقع بأنفسهم. إذا أضفت noindex وDisallow في robots.txt معًا، ضمنت ألا يعمل noindex. تقول وثائق robots meta tag حرفيًا: “If a page is disallowed from crawling through the robots.txt file, then any information about indexing or serving rules will not be found and will therefore be ignored. If indexing or serving rules must be followed, the URLs containing those rules cannot be disallowed from crawling.” (الترجمة العربية) «إذا مُنع الزحف إلى صفحة عبر robots.txt، فلن يُعثر على معلومات قواعد الفهرسة أو العرض، ولذلك ستُتجاهل. وإذا كان يجب اتباع هذه القواعد، فلا يجوز منع الزحف إلى عناوين URL التي تحتويها».

القاعدة العملية: إن أردت إزالة صفحة، فاتركها قابلة للزحف وأضف noindex. لا تفكر في حجبها في robots.txt إلا بعد التأكد من خروجها، وحتى عندئذ لا يمنع robots.txt عودتها إلى الفهرس عبر الروابط.

لمحة تاريخية: إيقاف noindex في robots.txt عام 2019

كان هناك توجيه غير رسمي noindex: داخل robots.txt. لم يكن معيارًا رسميًا وكان دعمه متفاوتًا، ثم أوقفت Google التعامل معه. جاء في ملاحظة Google عن القواعد غير المدعومة على لسان Gary Illyes في يوليو 2019: “we’re retiring all code that handles unsupported and unpublished rules (such as noindex) on September 1, 2019.” (الترجمة العربية) «سنوقف كل الشفرة التي تتعامل مع القواعد غير المدعومة وغير المنشورة، مثل noindex، في 1 سبتمبر 2019». وقد قلت في تغطيتي على Ahrefs إن Google دعمت هذا التوجيه بصورة غير رسمية ثم أزالته رسميًا. ووصفه Gary بعبارة “sticks out like a nun in a mosh pit.” (الترجمة العربية) «يبدو نشازًا واضحًا كراهبة وسط ساحة رقص صاخبة» في تعليقه المنقول.

الإزالة الطارئة: أداة الإزالة في Search Console

عندما يلزم إخفاء شيء الآن، تكون أداة الإزالة هي الوسيلة السريعة. تقول Google: “For quick removals, use the Removals tool to remove a page hosted on your site from Google’s search results within a day.” (الترجمة العربية) «للإزالة السريعة، استخدم أداة الإزالة لحذف صفحة مستضافة على موقعك من نتائج بحث Google خلال يوم». وأكد John Mueller للمالكين الذين أثبتوا الملكية أنها “it works very quickly”. (الترجمة العربية) «تعمل بسرعة كبيرة».

لكنها إجراء طوارئ لا حل، والوثائق واضحة بشأن قيدين:

  • إنها مؤقتة. “Requests made in the Removals tool last for about 6 months.” (الترجمة العربية) «تستمر الطلبات المقدمة في أداة الإزالة نحو ستة أشهر». وتقول مساعدة Search Console: “A successful request lasts only about six months.” (الترجمة العربية) «يستمر الطلب الناجح نحو ستة أشهر فقط». Evidence for this claim Search Console's Removals tool temporarily blocks a URL from Google Search and is not a permanent removal method. Scope: Google Search Console verified properties; permanent removal requires a separate lasting method. Confidence: high · Verified: Google Search Console Help: Removals tool and SafeSearch Reporting Tool
  • لا توقف الزحف ولا تزيل شيئًا فعليًا. “Blocking a URL does not prevent Google from crawling your page, only from showing it in Search results.” (الترجمة العربية) «حجب عنوان URL لا يمنع Google من الزحف إلى صفحتك، بل يمنع عرضه في نتائج البحث فقط».

من دون وسيلة دائمة موازية قد تعود الصفحة عند انتهاء النافذة. استخدم أداة الإزالة لشراء الوقت، ثم طبق noindex أو احذف الصفحة أو احمها بكلمة مرور خلال تلك المدة.

الأداة المقابلة لدى Bing

لدى Bing أداة Block URLs موازية، ونص واجهتها المؤكد هو: “This feature allows you to block a URL from appearing in the Bing search results. This block will remain in place for maximum of 90 days. If the URL still returns a 200 OK code when visited by our crawler after 90 days, it will reappear in our search results.” (الترجمة العربية) «تتيح لك هذه الميزة منع ظهور عنوان URL في نتائج Bing. ويظل الحظر مدة أقصاها 90 يومًا. فإذا استمر العنوان في إرجاع 200 OK عند زيارة زاحفنا بعد 90 يومًا، فسيظهر مجددًا في النتائج». ويحذرك Bing قبل انتهاء الحظر بثمانية أيام، ويمكن تجديد حظر العنوان بلا حد. وقد لخّصت المقارنة بأن أثر Google المؤقت يقارب ستة أشهر، وأثر Bing ثلاثة أشهر، أي 90 يومًا. أما صفحة Bing للمساعدة في الإزالة الدائمة فهي تطبيق يعرض المحتوى عبر JavaScript ولم أستطع استخراج نصها حرفيًا؛ لذلك يظل اقتراح IndexNow أدناه إعادة صياغة.

الوسيلة الدائمة الأولى — noindex عبر meta أو X-Robots-Tag

يعد noindex أكثر الوسائل فاعلية لإزالة عنوان URL من الفهرس عندما يكون الزحف مسموحًا. فهو يطلب من محركات البحث عدم إدراج الصفحة مع إبقائها حية للمستخدمين والزوار المباشرين. وكما قلت: يطلب وسم meta robots بقيمة noindex أو ترويسة X-Robots-Tag من محركات البحث إزالة الصفحة من الفهرس.

له تطبيقان:

  • وسم meta في <head> ضمن HTML: <meta name="robots" content="noindex">.
  • ترويسة HTTP باسم X-Robots-Tag — للملفات غير HTML مثل PDF التي لا تحتوي على <head>. تقول Google: “Any rule that can be used in a robots meta tag can also be specified as an X-Robots-Tag.” (الترجمة العربية) «يمكن تحديد أي قاعدة تصلح في وسم robots meta أيضًا عبر X-Robots-Tag».

الشرط الذي يتسبب في معظم الأخطاء: يجب أن تظل الصفحة قابلة للزحف. إذا حُجبت في robots.txt فلن ترى Google الوسم. ويقدم نموذج Mueller ذي الخطوتين عبر Search Engine Journal إطارًا واضحًا: تأكد أولًا من قدرة Google على الوصول إلى الصفحة، ثم أضف noindex.

استخدمها عندما: ينبغي أن تظل الصفحة حية للمستخدمين أو للوصول المباشر أو بعد تسجيل الدخول، لكن لا ينبغي أن تظهر في البحث؛ مثل صفحات الشكر ونتائج البحث الداخلية والنسخ المفلترة أو ذات الأوجه وصفحات الأرشيف منخفضة القيمة.

الوسيلة الدائمة الثانية — حذف المحتوى (404/410)

إذا كان يجب ألا يبقى المحتوى، فاحذفه وأرجع 404 (Not Found) أو 410 (Gone). تقول Google إن الرمزين “mean that the page does not exist, which will drop such URLs from Google’s index once they’re crawled and processed.” (الترجمة العربية) «يعنيان أن الصفحة غير موجودة، ما يؤدي إلى إسقاط هذه العناوين من فهرس Google بعد الزحف إليها ومعالجتها». وبكلماتي: تخرج الصفحة من الفهرس بعد وقت قصير من إعادة الزحف.

404 أم 410: كلاهما يعمل. تشير 410 بوضوح أكبر قليلًا إلى أن الصفحة أزيلت نهائيًا وقد تكون أسرع قليلًا، لكن الفارق العملي صغير؛ راجع مقارنة 404-vs-410. ولا يمكنك إبقاء الصفحة حية للمستخدمين مع إرجاع 410؛ فإذا كانوا يحتاجون إليها فاستخدم noindex.

استخدمها عندما: يكون المحتوى متوقفًا فعلًا ولا يحتاج إليه أحد.

الوسيلة الدائمة الثالثة — الحماية بكلمة مرور أو جدار تسجيل الدخول

وضع الصفحة خلف المصادقة هو الإزالة الأكثر إحكامًا. تقول Google: “Password-protect your page. Limiting access to your page enables the right users to view your page, while preventing Googlebot and other web crawlers from accessing it.” (الترجمة العربية) «احم صفحتك بكلمة مرور. يتيح تقييد الوصول للمستخدمين المناسبين رؤيتها، ويمنع Googlebot وغيره من زواحف الويب من الوصول إليها». ويذكر منشور 2019 أن إخفاء الصفحة خلف تسجيل الدخول يزيلها عمومًا من الفهرس، إلا مع ترميز الاشتراكات أو جدران الدفع.

ميزتان لهذه الوسيلة: تحجب كل الزواحف في كل محركات البحث، ولا تستطيع الروابط تجاوزها كما يحدث مع robots.txt. لكن ثمنها أنها تحجب أيضًا كل مستخدم لا يملك بيانات اعتماد؛ لذا تناسب المحتوى الخاص فعلًا، لا الصفحات العامة.

استخدمها عندما: يكون المحتوى حساسًا أو خاصًا ولا ينبغي أن يراه إلا المستخدمون المسجلون.

التوحيد عبر canonical — مرتبط بالإزالة لكنه ليس إزالة

وسم canonical ليس أداة إزالة، والخلط بينهما يسبب ضررًا. فاختيار canonical هو توحيد: عندما توجد عناوين URL مكررة أو شبه مكررة، يخبر rel="canonical" Google بالنسخة الممثلة ويجمع إشارات الترتيب فيها. ويظل العنوانان حيين وقابلين للزحف.

الأهم أن Google تنصح تحديدًا بعدم استخدام noindex لإدارة اختيار canonical بين المكررات داخل موقع واحد: “We don’t recommend using noindex to prevent selection of a canonical page within a single site, because it will completely block the page from Search.” (الترجمة العربية) «لا نوصي باستخدام noindex لمنع اختيار صفحة أساسية داخل موقع واحد، لأنه سيحجب الصفحة تمامًا من البحث». فإذا كانت المشكلة عنوانين للمحتوى نفسه وتريد إبقاء أحدهما فاستخدم canonical؛ وإذا كان يجب ألا تظهر الصفحة أصلًا فاستخدم noindex.

استخدمها عندما: توجد عناوين مكررة فعلًا وتريد جمع الإشارات في واحد منها، لا بديلًا من noindex لصفحة لا تريد فهرستها.

إزالة الصور تحديدًا — الاستثناء من الخرافة

في حالة الصور ينقلب حكم robots.txt: فهو وسيلة Google المعتمدة فعلًا للإزالة. تقول وثائق إزالة الصور: “To prevent images from your site appearing in Google’s search results, add a robots.txt file to the root of the site that hosts the image.” (الترجمة العربية) «لمنع ظهور صور موقعك في نتائج Google، أضف ملف robots.txt إلى جذر الموقع الذي يستضيف الصورة». المثال:

User-agent: Googlebot-Image
Disallow: /images/dogs.jpg

لماذا ينجح ذلك مع الصور ويفشل مع الصفحات؟ لأن فهرسة صور Google تعتمد أساسًا على الزحف إلى ملف الصورة نفسه، وهو ما يحجبه robots.txt مباشرة، بينما قد تُفهرس صفحة ويب عادية من اكتشاف الروابط وحده. لذلك تخص الخرافة الصفحات لا الصور. استخدم وكيل المستخدم Googlebot-Image لإزالة الصورة من صور Google، أو Googlebot العام لإزالتها من كل واجهات Google.

توجد أيضًا وسيلة X-Robots-Tag للصور: “Alternatively, you can remove images hosted on your site from Google’s search results by adding the noindex X-Robots-Tag to the HTTP response headers of the images you want to remove” (الترجمة العربية) «يمكنك بدلًا من ذلك إزالة الصور المستضافة على موقعك من نتائج Google بإضافة X-Robots-Tag بقيمة noindex إلى ترويسات استجابة HTTP للصور». لكن يجب عندها السماح بالزحف إلى عناوين الصور كي يقرأ Googlebot القاعدة. وتقول Google إن للطريقتين الأثر نفسه، فلا داعي للجمع بينهما.

إذا لم تكن تملك الصفحة — أداتان لمشكلتين مختلفتين

يفترض كل ما سبق أنك تتحكم في الصفحة. إذا لم تكن تملكها، تقسم Google المسار وفق نوع المشكلة، واختيار المسار الخطأ يهدر وقت الطوارئ.

محتوى الصفحة قديم أو أزيل، لكن نسخة Google لم تلحق بالتغيير. استخدم أداة تحديث المحتوى القديم. تقول Google: “Use the Refresh Outdated Content tool to have Google update search results for pages or images that no longer exist, or pages that have deleted important (sensitive or critical) content.” (الترجمة العربية) «استخدم أداة تحديث المحتوى القديم كي تحدّث Google نتائج الصفحات أو الصور التي لم تعد موجودة، أو الصفحات التي حذفت محتوى مهمًا حساسًا أو حرجًا». لا تعمل الأداة إلا إذا كان المحتوى قد اختفى أو تغير كثيرًا على الصفحة الحية؛ ولا تجبر المالك على إزالة محتوى يريد إبقاءه. وتتطلب تسجيل الدخول لا إثبات ملكية Search Console.

المشكلة معلومات شخصية أو حساسة، وقد تظل الصفحة حية. توجه إرشادات Google هذه الحالة إلى مسار مختلف. ففي مربع “if you don’t own the page” (الترجمة العربية) «إذا لم تكن تملك الصفحة»، تقول الوثيقة حرفيًا: “If you don’t own the page, see Remove your personal information from Google instead.” (الترجمة العربية) «إذا كانت الصفحة لغيرك، فراجع بدلًا من ذلك أداة إزالة معلوماتك الشخصية من Google». وتصل العبارة إلى أداة إزالة معلوماتك الشخصية من Google. إنها أداة منفصلة لطلبات مثل نشر البيانات الشخصية أو كشف وثائق الهوية أو المعلومات المالية أو الصور الصريحة دون موافقة. وهذا هو المسار الأول عندما تكون المعلومات المعروضة عنك، لا مجرد معلومات قديمة. يستند ذلك إلى النسخة الحية من وثيقة Google المؤرخة 2025-12-10 في تذييلها؛ أعد التحقق لأن طريقة عرض المسارين قد تتغير.

أما إن كان المحتوى قديمًا أو أزيل بالفعل ولم تكن المسألة معلومات شخصية، فتظل أداة تحديث المحتوى القديم هي المسار الصحيح لغير المالك.

إطار القرار — أي وسيلة لأي حالة؟

حالتكاستخدملا تستخدم
تبقى الصفحة للمستخدمين لا للبحثnoindex مع السماح بالزحفrobots.txt
المحتوى متوقف ويجب ألا يبقى404 أو 410noindex
خاص ولا يراه إلا المسجلونالحماية بكلمة مرورnoindex وحده
عنوانان مكرران حقيقيان أو أكثر، أبق واحدًاrel="canonical"noindex
طوارئ وتملك الصفحةأداة الإزالة ← ثم وسيلة دائمةrobots.txt
محتوى قديم أو مزال ولا تملك الصفحةأداة تحديث المحتوى القديمأي شيء آخر
معلومات شخصية أو حساسة ولا تملك الصفحةأداة «إزالة معلوماتك الشخصية من Google»تحديث المحتوى القديم
إزالة صورةrobots.txt مع Disallow لـGooglebot-Imageعادات noindex الخاصة بالصفحات

راجع تبويب Decision Trees لجولة تفاعلية في القرار.

كم تستغرق إزالة الفهرسة فعلًا؟

لا تعمل أي وسيلة دائمة فورًا؛ إذ تنتظر كلها إعادة زحف Google لرؤية التغيير، سواء وسم noindex أو حالة 404/410. لهذا توجد أداة الإزالة: إنها الوسيلة السريعة الوحيدة فعلًا، خلال يوم وفق وثائق Google، ولذلك تناسب الطوارئ رغم كونها مؤقتة. إذا ظلت صفحة أضفت إليها noindex ظاهرة، فتقول Google إن السبب “probably because we haven’t crawled the page since you added the noindex rule.” (الترجمة العربية) «ربما لأننا لم نزحف إلى الصفحة منذ إضافة قاعدة noindex». ويمكن لطلب الفهرسة أو إعادة الزحف في فحص عنوان URL تسريع الأمر.

موضع هذا الدليل من الموضوع

هذه الصفحة مركز عملي يربط مجموعة الفهرسة. ولتفاصيل التوجيهات راجع الأدلة الخاصة بـnoindex وmeta-robots وx-robots-tag وrobots-txt وremovals-tool وcanonicalization ورمزي 404-vs-410 و410-gone. وللمسار الكامل من الاكتشاف إلى الزحف والعرض والفهرسة وتقديم النتائج راجع مجموعة كيف يعمل البحث. وإذا ترك حظر robots.txt صفحة مفهرسة، فمقال Indexed, though blocked by robots.txt هو رفيق التشخيص المباشر.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.