صفحة مفهرسة بلا محتوى

ما معنى حالة "Page indexed without content" في Google Search Console — الصفحة موجودة في فهرس Google لكن Googlebot لم يتمكن من قراءتها — وكيفية تشخيصها. وغالبًا يكون السبب حظرًا من الخادم أو CDN، لا مجرد مشكلة JavaScript.

نُشر أول مرة: 23 يونيو 2026 · آخر تحديث: 10 أغسطس 2026 · Advanced
اللغات
عدد الأدلة في هذه الصفحة: 2

تعني "Page indexed without content" أن عنوان URL موجود في فهرس Google، لكن Googlebot لم يتمكن من قراءة محتوى صالح للاستخدام. وتذكر وثائق Google إظهار محتوى مختلف أو تنسيقًا غير قابل للفهرسة كسببين محتملين، وتوضح أن هذه ليست حالة حظر الصفحة عبر robots.txt. وهي تختلف عن Crawled — currently not indexed وعن Discovered — currently not indexed، حيث لا تكون الصفحة مفهرسة أصلًا. وفي حالة من يناير 2026 قال John Mueller إن السبب عادةً حظر منخفض المستوى من الخادم أو CDN يستند كثيرًا إلى عنوان IP ويستهدف Googlebot، ولا يمكن إعادة إنتاجه باستخدام curl أو زاحف خارجي. وتشمل الأسباب الأخرى إظهار محتوى مختلف أو تصييرًا فارغًا أو محتوى مشروطًا بالنقر أو تنسيقًا غير مدعوم؛ افحصها كفروع يقودها الدليل لا كترتيب ثابت. ابدأ ببيانات View Crawled Page المفهرسة في أداة فحص عنوان URL، وتذكر أن الاختبار المباشر لا يعيد فحص هذه الحالة مباشرةً وأن النتيجة الصالحة لا تضمن الفهرسة. وإذا كان العرض المفهرس فارغًا بينما الصفحة سليمة في متصفحك، فاشتبه في حظر يستهدف Googlebot أو تقديم خاص بالعميل. إضافة كلمات لا تصلح صفحة لا يستطيع Google قراءتها.

الخلاصة — تعني “Page indexed without content” أن عنوان URL موجود في فهرس Google لكن Googlebot لم يتمكن من قراءة أي محتوى صالح للاستخدام — بخلاف «تم الزحف إليها — غير مفهرسة حاليًا» أو «تم اكتشافها — غير مفهرسة حاليًا»، حيث لا تكون الصفحات مفهرسة أصلًا، وبخلاف حظر الصفحة عبر robots.txt، الذي له سبب مستقل. الافتراض المعتاد هو فشل JavaScript؛ لكن في حالة من يناير 2026 أخبر Mueller مستخدمًا أن السبب عادةً حظر منخفض المستوى من الخادم أو CDN، يستند كثيرًا إلى عنوان IP ويستهدف Googlebot، ولا يمكن إعادة إنتاجه باستخدام curl أو زاحف تابع لجهة خارجية. وتشمل الأسباب المحتملة الأخرى: إظهار محتوى مختلف، أو تصييرًا فارغًا، أو محتوى مشروطًا بالنقر، أو تنسيقًا غير مدعوم — افحصها كفروع يقودها الدليل، لا كترتيب ثابت. شخّص المشكلة عبر View Crawled Page لبيانات الفهرسة في أداة فحص عنوان URL، مع تذكر أن Google يدرج هذه الحالة صراحةً ضمن ما لا يستطيع الاختبار المباشر إعادة فحصه، وأن النتيجة “الصالحة” لا تثبت زوال الحالة.

ما الذي تقوله وثائق Google فعليًا؟

وثائق تقرير فهرسة الصفحات لدى Google موجزة بشأن هذه الحالة: الصفحة موجودة في الفهرس، لكن Google لم يتمكن لسبب ما من قراءة المحتوى. وتذكر الوثائق أن الصفحة قد تقدم محتوى مختلفًا إلى Google، أو تكون بتنسيق لا يستطيع Google فهرسته — والإجراء الموصى به هو فحص عنوان URL ومراجعة تفاصيل التغطية. Evidence for this claim Google defines Page indexed without content as indexed even though Google could not read the content, citing cloaking or unsupported formats as examples. Scope: Google Search Console Page Indexing status; other diagnoses require inspection. Confidence: high · Verified: Google: Page indexing report (راجع تبويبي الوثائق الرسمية والاقتباسات للنص الحرفي والروابط العميقة.)

هناك نقطتان تستحقان الدقة، لأن الأدلة التي تتناول هذا المصطلح تطمس الفرق بينهما عادةً:

  • تقول صياغة Google إنه “تعذر قراءة المحتوى” — ولا تصف كائنًا فارغًا داخليًا يخزنه Google. اعتبر “سجلًا فارغًا” اختصارًا للأثر الذي يراه القارئ، لا آلية موثقة.
  • هذه الحالة ليست صراحةً حظرًا على مستوى الصفحة عبر robots.txt — فلذلك سبب منفصل في التقرير. وتظهر صلة robots.txt هنا بصورة غير مباشرة: قد يؤدي حظر مورد حرج (ملف JS أو CSS تحتاج إليه الصفحة للتصيير) إلى تصيير فارغ، وهذا سبب في فرع التصيير، لا سبب robots.txt نفسه.
Evidence for this claim Google explicitly says Page indexed without content is not a case of robots.txt blocking; a page-level disallow belongs to the separate robots reason even though critical resource blocks can still impair rendering. Scope: verified Search Console properties Confidence: high · Verified: Page indexing report

إذا حافظت على هذا الفرق فلن تخلط بينها وبين حالات “غير مفهرسة أصلًا” أو مع حظر robots.txt.

لا تفترض أن السبب هو JavaScript

هذا أهم تصحيح في المقال كله، لذا سأبدأ به.

تتعامل الاستجابة التلقائية — ومعظم الأدلة المتصدرة لهذا المصطلح — مع “indexed without content” على أنها مشكلة تصيير أو JavaScript. لكن John Mueller اعترض على ذلك في حالة محددة. وردًا على مستخدم في r/TechSEO على Reddit هبطت صفحته الرئيسية تقريبًا من المركز 1 إلى 15 بعد ظهور الحالة، قال إن هذا يعني عادةً أن الخادم أو CDN يمنع Google من تلقي أي محتوى، وأن الأمر لا يتعلق بـJavaScript. وأضاف أنه غالبًا حظر منخفض المستوى نسبيًا، يستند أحيانًا إلى عنوان IP الخاص بـGooglebot — ما يجعل اختباره من خارج أدوات Search Console مستحيلًا عمليًا. وقيل إن الإعداد المتأثر كان Webflow على Cloudflare، وهو مثال واقعي مفيد على قدرة الإعدادات الافتراضية في CDN أو حماية البوتات على حرمان Googlebot من المحتوى بصمت. (أنا أعيد صياغة ملاحظة منقولة من Reddit ولا أقتبسها — تعامل مع هذا الإطار باعتباره خلاصة حالة موثقة واحدة، لا إحصاءً مقاسًا لتكرار كل سبب.)

هذا هو التصحيح الذي ينبغي استيعابه: كلمة “عادةً” لدى Mueller تصف ما رآه في تلك المحادثة الواحدة، لا ترتيبًا عالميًا للأسباب. ولا ترتب وثائق Google الأسباب أيضًا — بل تذكر إظهار محتوى مختلف والتنسيق غير المدعوم كاحتمالين. لذلك، بدل قائمة ثابتة من 1 إلى 5، مرّ على الفروع التالية وفق الأدلة ودع ما تلقاه Googlebot فعليًا يوجهك إلى الفرع الصحيح:

  • استجابة الخادم / CDN / WAF — شيء في طبقة الشبكة يحرم Googlebot من المحتوى (غالبًا حسب عنوان IP وغالبًا غير مرئي من الخارج). وهذا سبب وثّقه Mueller.
  • تقديم خاص بالعميل (إظهار محتوى مختلف) — يتلقى Googlebot محتوى مختلفًا أو فارغًا مقارنة بالمستخدمين. قد يكون ذلك إخفاءً متعمدًا (انتهاكًا لسياسة الرسائل غير المرغوب فيها يتطلب نية التلاعب بالترتيب) أو فرق إعدادات غير مقصود — فلا تسمِّ النسخة العرضية “cloaking” كما لو كانت انتهاكًا للسياسة؛ بل سمِّها خللًا في التقديم.
  • مشكلة تنسيق / محلل — الاستجابة ليست بتنسيق يفهرسه Google، أو أن ترويسة Content-Type لا تطابق المحتوى الفعلي.
  • فشل التصيير / الموارد — تصيير JavaScript يفشل أو تنتهي مهلته أو يعتمد على مورد محظور، فيترك HTML المصيّر فارغًا.
  • محتوى مشروط بالتفاعل — لا يظهر المحتوى إلا بعد نقرة أو تمرير لا ينفذه Google.
  • مخرج فارغ حقًا — الصفحة تُصيّر فعلًا بلا شيء.

JavaScript فرع واحد ينبغي فحصه — وليس الافتراض المسبق، ولا يحتل تلقائيًا مرتبة أعلى أو أدنى من غيره دون دليل من فحصك.

لماذا قد تكلفك هذه الحالة ترتيبك؟

من المهم توضيح الإلحاح: في الحالة المبلغ عنها قال مالك الموقع إن صفحته هبطت من نحو المركز 1 إلى 15 — وهي رواية مستخدم واحد لا إحصائية محققة مستقلة، لكنها نتيجة معقولة إذا كان Google يحتفظ بنسخة غير مقروءة من صفحة كانت تتصدر النتائج. ليست هذه حالة تجميلية في التقرير يمكن تجاهلها — فإذا ظهرت على صفحة مهمة، فتعامل معها كمشكلة تستحق التحقيق سريعًا.

تفاصيل حظر الخادم أو CDN

سبب ضعف تغطية هذا الاحتمال هو صعوبة رؤيته. فقد تقرر قاعدة لحماية البوتات أو WAF، أو قائمة سماح لعناوين IP، أو تحديد معدل صارم، أو إعداد أمان افتراضي تحدّث تلقائيًا، أن Googlebot حركة مسيئة؛ فتُرجع جسمًا فارغًا أو صفحة تحدٍ أو حالة غير 200 — لكن لعناوين IP الخاصة بـGooglebot فقط. أما أنت وفريقك وزاحف الجهة الخارجية فتصلون من عناوين IP عادية وترون الصفحة الحقيقية.

هذا هو الفخ: لا يمكنك إعادة إنتاج حظر Googlebot المستند إلى IP باستخدام curl أو زاحف مكتبي. فهذه الأدوات لا تأتي من نطاقات IP الخاصة بـGooglebot. والمكان الوحيد الذي يمكنك فيه رؤية ما تلقاه Googlebot بثقة هو أدوات اختبار Search Console التي تجلب الصفحة بصفتها Google.

إذا اشتبهت في ذلك، فتحقق أولًا مما إذا كانت الطلبات من Googlebot حقًا (DNS عكسي ثم أمامي، أو نطاقات IP المنشورة من Google)، ثم راجع إدارة البوتات في CDN وقواعد الجدار الناري/WAF وقوائم السماح لعناوين IP وحدود المعدل بحثًا عن أي شيء يحظر تلك النطاقات. يحتوي تبويب النصوص البرمجية على أوامر التحقق.

قبل تغيير أي شيء، اربط الأدلة بدل التخمين: استخرج استجابة View Crawled Page المفهرسة وسجلات أحداث CDN/WAF وسجلات خادم الأصل للفترة الزمنية نفسها، وابحث عن معرف الطلب وفئة العميل والقاعدة أو حد المعدل الذي رفض الطلب. ثم غيّر فقط أضيق مسار أو فئة عميل أو قاعدة تأكدت من مسؤوليتها — وبعد مراجعة أمنية قبل النشر. لا تدعم المصادر التي راجعناها السماح الشامل بكل نطاقات IP المنشورة من Google كخيار افتراضي آمن؛ فهذا يوسع سطح الهجوم لعطل سببه عادةً قاعدة واحدة سيئة الإعداد. بعد التغيير، راقب في سجلاتك طلبات Googlebot المؤكدة وهي تعيد استجابة كاملة، ثم أعد فحص تقرير الفهرسة بعد زحف لاحق — لا ينشر Google جدولًا ثابتًا لإعادة الزحف، لذا المطلوب “keep checking,” (ترجمة) «استمر في الفحص»، لا “check back on day X,” (ترجمة) «عد في اليوم X».

سبب التصيير / JavaScript (عندما يكون JS هو السبب فعلًا)

عندما يكون السبب هو التصيير فعلًا، تكون الآلية واضحة: يزحف Google إلى HTML الخام، ثم يصيّر Chromium بلا واجهة الصفحة ويشغّل JavaScript. ولا يستطيع Google فهرسة إلا ما ينتهي في HTML المصيّر. فإذا كان محتواك يُصيّر لدى العميل وفشل التصيير أو وقع خطأ أو انتهت المهلة أو اعتمد على طلب لا ينفذه Google، فقد يعود HTML المصيّر فارغًا — فتحصل على indexed without content.

حالة محددة تستحق التنبيه: المحتوى المشروط بالتفاعل. سبق أن كتبت في دليلي إلى JavaScript SEO أن العناصر التي لا تحمّل المحتوى إلا عند النقر مشكلة — فـGoogle لا ينقر، ولذلك لا يرى هذا المحتوى. وينطبق الأمر نفسه على المحتوى الذي لا يظهر إلا عند التمرير أو بعد إجراء من المستخدم. فإذا كان المحتوى الرئيسي يحتاج إلى نقرة كي يوجد، فافترض أن Google لا يملكه.

إصلاح سبب JS هو مسار التصيير المعتاد — التصيير من جانب الخادم أو التصيير المسبق، وضمان وجود المحتوى في HTML المصيّر، وإتاحة التنقل عبر روابط <a href> حقيقية بدل معالجات النقر فقط. (التفصيل الكامل في JavaScript SEO.)

التشخيص: أداة فحص عنوان URL هي الأساس

هناك تشخيص واحد مهم هنا، وهو فحص عنوان URL — لكنه يعتمد على مصدرين مختلفين للبيانات، والخلط بينهما يقود إلى استنتاجات خاطئة. يفصل Google بين بيانات الفهرسة (ما رآه آخر زحف للفهرسة) والاختبار المباشر (جلب Google-InspectionTool لعنوان URL الآن)، وهما لا يجيبان عن السؤال نفسه:

بيانات الفهرسةالاختبار المباشر
ما الذي يعرضه؟HTML المصيّر واستجابة HTTP وموارد الصفحة من آخر زحف فهرسة لدى Google — وهو السجل وراء الحالة التي تراهاما إذا كان Google-InspectionTool يستطيع الوصول إلى الصفحة الآن، إضافة إلى لقطة شاشة حديثة
هل تتوفر لقطة شاشة؟لا، في العرض المفهرسنعم — لقطات الشاشة خاصة بالاختبار المباشر
هل يستطيع اختبار هذه الحالة؟هذا هو السجل الذي تصفه الحالةلا — يدرج Google صراحةً “Page indexed without content” ضمن الحالات التي لا يستطيع الاختبار المباشر إعادة فحصها مباشرة
هل تعني النتيجة “الصالحة” أن المشكلة أُصلحت؟لا ينطبقلا — النتيجة الصالحة تعني فقط أن أداة Google تستطيع الوصول إلى الصفحة حاليًا، لا أنها مفهرسة أو أن الحالة زالت

إذًا، سير العمل الفعلي هو:

  1. افتح View Crawled Page (بيانات الفهرسة). اقرأ HTML المصيّر واستجابة HTTP وموارد الصفحة المرتبطة بالحالة — فهذا ما تلقاه زحف الفهرسة لدى Googlebot فعلًا. قد يختلف توفر كل جزء حسب الحالة؛ وإذا غابت بعض الحقول، فهذا بحد ذاته دليل تشخيصي (فالاستجابة المحظورة أو غير 200 تعرض غالبًا أقل من التصيير الطبيعي).
  2. قارنها بمتصفحك. إذا كان التصيير المفهرس فارغًا أو منزوعًا بينما الصفحة المباشرة كاملة في متصفحك، فأنت أمام حظر أو تقديم خاص بالعميل، لا نقص محتوى.
  3. شغّل Test Live URL على أي حال، لكن اقرأ نتيجته على نحو صحيح. لن يؤكد مباشرةً زوال هذه الحالة، لكنه مفيد: إذا فشل الاختبار المباشر نفسه أو أشار إلى مشكلة وصول فهذه أدلة حقيقية؛ وإذا عاد “صالحًا”، فافهمها بمعنى “يمكن الوصول إليه الآن” لا “أُصلح”. Evidence for this claim URL Inspection can show Google's indexed/crawled information and supports a live test for the current accessible version. Scope: Google Search Console URL Inspection; live test results can differ from the indexed version. Confidence: high · Verified: Google: URL Inspection tool
  4. اقرأ الاستجابة والموارد. تشير حالة غير 200 أو صفحة تحدٍ/اعتراض أو موارد حرجة محظورة (JS/CSS تحتاج إليها الصفحة) إلى السبب.

لأن الحظر المستند إلى IP لن يظهر من الخارج، لا تثق في curl خارجي أو زاحف لإثبات سلامة الصفحة — فأدوات Search Console هي الوحيدة التي تجلب بصفتها Google، وحتى هي تحتاج إلى بيانات الفهرسة لا الاختبار المباشر وحده لتفسير هذه الحالة.

التمييز بين الأسباب

مرجع سريع للحالات والأسباب التي يخلط الناس بينها وبين هذه الحالة:

إذا رأيت…فهذا يعني…وليست هذه الحالة لأن…
حظر الصفحة عبر robots.txtعنوان URL نفسه محظور من الزحف — سبب منفصل في التقريرتستبعد وثائق Google صراحةً حظر الصفحة عبر robots.txt من هذه الحالة
مورد حرج محظور (JS/CSS) عبر robots.txtيمكن الزحف إلى الصفحة، لكن موردًا تحتاج إليه للتصيير محظورهذا سبب ضمن فرع التصيير، لا سبب robots.txt نفسه — أصلحه بإلغاء حظر المورد
استجابة 401 أو 403سببان حقيقيان مستقلان في تقرير فهرسة الصفحاتحالتان منفصلتان في التقرير، وليستا هذه الحالة
حاجز خاص بالمتصفح (جدار ملفات تعريف ارتباط، بوابة موافقة، قاعدة جغرافية، تسجيل دخول) يعيد 200فرق بين ما تراه جلسة المتصفح وما يراه طلب Googleلم تُعد 401/403 حقيقية، لذا لن تظهر ضمن هذين السببين — شخّصها كتقديم خاص بالعميل
محتوى مختلف عمدًا للبوتات والمستخدمين بقصد التلاعب بالترتيبCloaking وفق سياسة Google للرسائل غير المرغوب فيها — انتهاك للسياسةيتطلب نية تلاعب؛ الاستجابة الفارغة العرضية لـGooglebot خلل إعدادات وليست دليلًا على انتهاك
نوع ملف غير مدعوم أو ترويسة Content-Type خاطئةمشكلة تنسيق/محلليحدد Google نوع الملف أساسًا من ترويسة الاستجابة، لا الامتداد وحده

خرافات ينبغي التخلي عنها

  • “أضف 600 كلمة وستُصلح تلقائيًا.” عدد الكلمات مشكلة محتوى رقيق أو جودة. وإذا لم يتلق Google أي محتوى، فلن يغير إضافة كلمات إلى صفحة لا يستطيع قراءتها شيئًا.
  • “إنها مشكلة JavaScript.” أحيانًا — لكن وفق Mueller تكون عادةً حظر خادم/CDN، لا JavaScript. فلا تبدأ من هناك.
  • “يمكنني إعادة إنتاجها باستخدام curl.” ليس إذا كان الحظر على Googlebot قائمًا على IP.
  • “إنها مثل «تم الزحف إليها — غير مفهرسة حاليًا» و«تم اكتشافها — غير مفهرسة حاليًا».” لا — فهاتان الصفحتان غير مفهرستين أصلًا، بينما هذه مفهرسة.
  • “اضغط Request Indexing فقط.” إعادة الفهرسة من دون إصلاح الحظر أو التصيير الأساسي لا تفعل سوى تأكيد صفحة فارغة مجددًا.

بعد إصلاح المشكلة

بعد أن يعرض View Crawled Page محتوى حقيقيًا من جديد، استخدم مسار Validate Fix في التقرير و/أو Request Indexing لطلب إعادة الزحف، ثم أعد الفحص للتأكد من أن التصيير يحتوي الآن على محتواك. فالتحقق دون إصلاح سيرتد.

موضع هذه الحالة في الصورة الكبرى

هذه حالة واحدة في تقرير فهرسة الصفحات، داخل مرحلة الفهرسة الأوسع لدى Google (الزحف ← التصيير ← الفهرسة ← العرض). وتفشل الحالات المجاورة في التقرير — زوج “غير مفهرسة حاليًا”، وحالات التكرار/الصفحة الأساسية، وحالات الحظر/الأخطاء — عند نقاط مختلفة من المسار. لمعرفة آليات التصيير وراء سبب JS، راجع التصيير و JavaScript SEO؛ ولمعرفة التقرير كله، راجع مركز تقرير فهرسة الصفحات.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.