تحسين محركات البحث في Sitecore
كيفية تحسين ظهور موقع Sitecore في نتائج البحث — الفرق الجوهري بين XP وXM Cloud، وما الذي يقدمه SXA وما لا يقدمه، والفخاخ الخاصة بالمنصة: ملف robots.txt الافتراضي الذي يحظر كل برامج الزحف، والأسماء البديلة التي تنشئ محتوى مكررًا باستجابة HTTP 200، والبيانات الوصفية التي لا ترث القيم الافتراضية لأن الحقل الفارغ لا يساوي NULL.
اللغات
Sitecore منصة تجارب رقمية للمؤسسات تكاد لا توفر وظائف SEO جاهزة، ويختلف خطا منتجاتها جذريًا. Sitecore XP نظام .NET تقليدي يُصيّر الصفحات على الخادم؛ أما XM Cloud، الذي تسميه وثائق Sitecore الحالية SitecoreAI، فهو SaaS بلا واجهة حيث تتحكم واجهة Next.js الأمامية، عبر JSS المنشور الآن باسم Content SDK، في HTML وتدير SEO عبر واجهات بيانات Next.js الوصفية. يضيف SXA الأساسيات مثل خريطة الموقع وإدارة robots.txt وحقول البيانات الوصفية، لكن كل شيء يحتاج إلى إعداد. وتوجد ثلاثة فخاخ خاصة بـSitecore: يحظر robots.txt الافتراضي كل برامج الزحف إذا تُرك الحقل فارغًا؛ وتخدم الأسماء البديلة العنوانين باستجابة HTTP 200 فتُنشئ محتوى مكررًا حقيقيًا؛ ولا ترث حقول البيانات الوصفية الفارغة Standard Values ما لم يُفعّل Reset Blank، لأن الفراغ لا يساوي NULL. وعلى نطاق المؤسسات تصبح الحوكمة — قالب SEO أساسي وقواعد تحقق وضبط البيئات — بأهمية أي إعداد منفرد.
Evidence for this claim The article's described sitecore-seo capabilities must be evaluated against the platform's current documentation rather than assumed to be search-engine behavior. Scope: Platform-specific capability documentation. Confidence: high · Verified: Sitecore: SEO Evidence for this claim Regardless of platform, Google needs crawlable URLs, accessible rendered content, descriptive metadata, and valid search directives. Scope: Google requirements independent of platform. Confidence: high · Verified: Google Search Central: SEO Starter Guideالخلاصة — Sitecore نظام CMS ضخم للمؤسسات، وهو لا يتولى SEO نيابةً عنك. فالأساسيات التي يحتاج إليها كل موقع — عناوين الصفحات والأوصاف وخريطة الموقع وملف robots.txt سليم — تحتاج إلى إعداد، وفي Sitecore فخاخ قد تحظر الموقع كله بصمت أو تنشئ صفحات مكررة. ومعرفة وجودها هي معظم المعركة.
ما هو Sitecore
Sitecore منصة تجارب رقمية، أي نظام CMS كبير للمؤسسات تستخدمه الشركات الكبرى لتشغيل مواقع معقدة فيها تخصيص ولغات متعددة ومواقع كثيرة ضمن تثبيت واحد. وله شكلان رئيسيان، والفرق بينهما مهم جدًا لـSEO:
- Sitecore XP (Experience Platform) — النمط التقليدي الأقدم. مبني على .NET ويصيّر الصفحات على الخادم، لذلك ترى محركات البحث عادةً HTML مكتملًا.
- XM Cloud — النسخة السحابية الحديثة. يخزن Sitecore المحتوى، وتسحبه واجهة أمامية منفصلة، مبنية غالبًا على Next.js، لتبني الصفحات الفعلية. وتُدار SEO في تطبيق الواجهة الأمامية، لا داخل Sitecore.
أهم ما ينبغي معرفته
لا يمنحك Sitecore كثيرًا من وظائف SEO الجاهزة. توجد إضافة اسمها SXA (Sitecore Experience Accelerator) توفر الأساسيات — خريطة موقع والتحكم في robots.txt وحقول البيانات الوصفية — لكنك، أو مطوروك، تظل مطالبًا بإعدادها كلها. ومن دون SXA يجب إضافة حتى الأمور الأساسية، مثل حقل الوصف التعريفي، يدويًا.
ثلاثة فخاخ ينبغي مراقبتها
لدى Sitecore بعض الخصائص التي تفاجئ الفرق:
- ملف robots.txt الذي يحظر الجميع. إذا تُرك حقل robots في إعدادات Sitecore فارغًا، فلا يقدم النظام ملفًا فارغًا متساهلًا، بل ملفًا يحظر كل محركات البحث. الفراغ هنا لا يعني «السماح للجميع».
- الأسماء البديلة التي تكرر الصفحات. يتيح Sitecore إعطاء الصفحة عنوان URL ثانيًا (alias). ويعيد العنوانان استجابة 200 OK عادية بلا تحويل، فتظهر نسختان حيتان للمحتوى نفسه، أي محتوى مكرر.
- الحقول الفارغة التي لا تستعيد القيم الافتراضية. يستطيع Sitecore تعيين قيمة افتراضية للحقل (Standard Value)، لكن إذا مسح المؤلف الحقل يبقى فارغًا بدل الرجوع إلى القيمة الافتراضية. والنتيجة صفحات بعناوين وأوصاف فارغة.
هل تريد النسخة التقنية — كيف تعمل SEO فعلًا على XP مقارنةً بـXM Cloud، ومسار بيانات Next.js الوصفية، وhreflang، وحوكمة المؤسسات؟ انتقل إلى علامة التبويب Advanced.
Evidence for this claim The article's described sitecore-seo capabilities must be evaluated against the platform's current documentation rather than assumed to be search-engine behavior. Scope: Platform-specific capability documentation. Confidence: high · Verified: Sitecore: SEO Evidence for this claim Regardless of platform, Google needs crawlable URLs, accessible rendered content, descriptive metadata, and valid search directives. Scope: Google requirements independent of platform. Confidence: high · Verified: Google Search Central: SEO Starter Guideالخلاصة — يكاد Sitecore لا يوفر وظائف SEO جاهزة؛ يضيف SXA الأساسيات لكنه يحتاج إلى إعداد. ويختلف المنتجان تمامًا: XP نظام .NET مصيّر على الخادم، فتتلقى برامج الزحف HTML مكتملًا ويحدث التخصيص على الخادم؛ أما XM Cloud فبلا واجهة، وتتحكم واجهة Next.js الأمامية في HTML وتُدار SEO بواجهات Next.js مثل
generateMetadataوMetadataRoute، مع تفضيل SSG وISR. ومن فخاخ المنصة أن robots.txt الافتراضي يحظر كل برامج الزحف عندما يكون الحقل فارغًا؛ وأن الأسماء البديلة تعيد HTTP 200 على العنوانين من دون canonical افتراضي؛ وأن الحقول الفارغة لا ترث Standard Values إلا مع تفعيل Reset Blank، لأن الفراغ لا يساوي NULL. وعلى نطاق المؤسسات تصبح الحوكمة هي العمل الحقيقي. (ملاحظة تسمية: تسمي وثائق Sitecore الحالية منتج XM Cloud باسم SitecoreAI؛ ولم تتغير البنية الموضحة أدناه.)
منصتان ونموذجان مختلفان تمامًا لـSEO
أهم ما يجب تحديده قبل لمس أي شيء هو: أي Sitecore تستخدم؟ اسم المنتج واحد، لكن آليات SEO مختلفة.
- Sitecore XP (Experience Platform). نظام .NET تقليدي مصيّر على الخادم عبر Razor/MVC، ويُنشر محليًا أو في سحابة مُدارة. يتلقى Googlebot عادةً HTML مكتملًا. وتُدار SEO داخل Sitecore، في القوالب وStandard Values ومسارات الطلبات.
- XM Cloud. خدمة SaaS بلا واجهة. يخزن Sitecore المحتوى ويعرضه عبر GraphQL (Experience Edge)، ثم تصيّر واجهة مستقلة — غالبًا Next.js مبنية باستخدام Sitecore JSS (JavaScript Services) — ملف HTML. توجد SEO في طبقة تطبيق Next.js: يحمل Sitecore المحتوى، ويتحكم Next.js في المخرجات.
ملاحظة عند الرجوع إلى وثائق Sitecore: اعتبارًا من منتصف 2026 أعاد الموقع تسمية منتج SaaS القابل للتركيب من XM Cloud إلى SitecoreAI؛ وتحول مسارات doc.sitecore.com/xmc/... وdevelopers.sitecore.com/learn/accelerate/xm-cloud/... القديمة إلى مسارات .../sai/.../sitecoreai/.... ولم تتغير البنية: Experience Edge وGraphQL وواجهة Next.js منفصلة. لكن حزمة الواجهة الأمامية تُنشر الآن باسم Content SDK بدل JSS، وسترى SitecoreAI في الصور والقوائم الحالية. أبقيت XM Cloud لأنه المصطلح الذي يبحث عنه معظم الممارسين وتعمل به التطبيقات القائمة.
في الحالتين يظل خط الأساس واحدًا. قال Marcel من Fishtank عام 2018: “Sitecore ships with virtually no SEO functionality (with the exception of SXA which includes some basics).” (ترجمة) «يأتي Sitecore من دون وظائف SEO تقريبًا، باستثناء SXA الذي يتضمن بعض الأساسيات». وما زال هذا التصور صحيحًا. فـSXA هو الطبقة التي توفر وحدة خريطة الموقع وإدارة robots.txt في شجرة المحتوى وحقول بيانات وصفية موحدة. ومن دونه يكون كل ذلك تطويرًا مخصصًا.
هذه بيئة SEO للمؤسسات بامتياز. تتضمن تطبيقات Sitecore مطورين وشركاء حلول متخصصين، وكما كتبت عن مواقع المؤسسات عمومًا، “the more likely you are to run into multiple tech stacks,” (ترجمة) «يزداد احتمال مواجهتك لحزم تقنية متعددة»، إلى جانب الأنظمة القديمة وتوزع الملكية بين الأقسام. لذلك يكون إصلاح مشكلة SEO في Sitecore غالبًا تغييرًا في قالب أو تجاوزًا لمسار يملكه مطور، لا إعدادًا تقلبه بنفسك.
البيانات الوصفية وفخ الفراغ مقارنةً بـNULL
توجد حقول SEO، مثل عنوان الصفحة والوصف التعريفي ووسوم Open Graph، في قوالب بيانات الصفحة. والنمط السليم هو قالب SEO أساسي ترثه كل قوالب الصفحات كي توجد الحقول في كل مكان. ويذكر Ken Gray من Konabos الفجوة الافتراضية مباشرةً: “out-of-the-box, Sitecore’s data templates might not include some of the Meta Data fields.” (ترجمة) «قد لا تتضمن قوالب بيانات Sitecore بعض حقول البيانات الوصفية افتراضيًا».
تتيح Standard Values تعيين قيم افتراضية معقولة لهذه الحقول، مثل الرمز $name احتياطًا للعنوان. لكن هنا يظهر فخ Sitecore الذي ينتج بيانات وصفية مفقودة على نطاق واسع. تقول وثائق Sitecore: “If the value of a field is NULL, the item contains the standard value for that field as defined in the data template for that item.” (ترجمة) «إذا كانت قيمة الحقل NULL، يحتوي العنصر على القيمة القياسية لذلك الحقل كما حُددت في قالب بيانات العنصر». لكن الحقل الفارغ ليس NULL. عندما يمسح مؤلف المحتوى وصفًا تعريفيًا يصبح الحقل فارغًا، ولا يرجع إلى Standard Value إلا إذا فُعّل Reset Blank. فتظهر صفحات فيها <meta name="description" content=""> بدل القيمة الافتراضية، وقد يعني ذلك آلاف الأوصاف الفارغة.
الحل من شقين: فعّل Reset Blank في حقول البيانات الوصفية التي تحتاج إلى قيمة احتياطية، وأضف قواعد تحقق تفرض عناوين وأوصافًا غير فارغة وضمن حدود الطول.
إدارة عناوين URL وفخ الأسماء البديلة
ينشئ Sitecore عناوين URL من مسار شجرة المحتوى افتراضيًا؛ وتأتي العناوين النظيفة من إعدادات SXA أو محللات عناصر مخصصة.
الفخ هو الأسماء البديلة للعناصر، أي عناوين URL إضافية تلحقها بأي عنصر. وثّق Dheer Rajpoot أنه “no redirect (no 301 or 302 HTTP status code) happens when you are using aliases in Sitecore,” (ترجمة) «لا يحدث أي تحويل، لا 301 ولا 302، عند استخدام الأسماء البديلة في Sitecore»، ولذلك “multiple URLs will be created for a single page URL.” (ترجمة) «تُنشأ عناوين URL متعددة لصفحة واحدة». يعيد العنوان الأساسي والبديل HTTP 200 بالمحتوى نفسه، أي محتوى مكرر حقيقي، ولا يصدر Sitecore وسم canonical تلقائيًا لحله.
لديك حلان بمستوى الحوكمة:
- تجاوز
AliasResolverفي مسارHttpRequestلحقن وسم canonical يشير إلى العنوان الحقيقي، أو - عدّل مسار الاسم البديل ليصدر تحويل 301 بدل خدمته مباشرةً.
أوصي بالثاني: تعامل مع الأسماء البديلة بوصفها تحويلات لا عناوين وصول بديلة. وتنطبق نصيحة Ken Gray عمومًا: “use Sitecore’s canonical link management to specify the preferred version of a URL” (ترجمة) «استخدم إدارة روابط canonical في Sitecore لتحديد النسخة المفضلة من عنوان URL»، لكن تحويل 301 أنظف للأسماء البديلة.
خرائط الموقع
في SXA اضبط خريطة الموقع من site/Settings → Search Engines Sitemap → Sitemap Mode. يوجد وضعان مهمان: Stored in cache، وهو الافتراضي ويتجدد ديناميكيًا ويلائم المواقع كثيرة التحديث أو المستضافة على Azure؛ وStored in file، وهو ملف ثابت يلائم المواقع الكبيرة قليلة التغيير. يضيف SXA عنوان الخريطة إلى robots.txt تلقائيًا وتوجد الخريطة في /sitemap.xml. ومن الإخفاقات الشائعة أن غياب TargetHostName يجعل الخريطة تعيد 404.
في XM Cloud + Next.js أنشئ الخريطة برمجيًا باستخدام MetadataRoute.Sitemap واستعلم من Experience Edge عبر GraphQL كي تستبعد العناوين غير القابلة للفهرسة في طبقة التطبيق. وتشير إرشادات Sitecore إلى أن “Next.js offers built-in sitemap and robots.txt generation.” (ترجمة) «يوفر Next.js إنشاءً مدمجًا لخريطة الموقع وrobots.txt».
Robots.txt — الإعداد الافتراضي الذي يحظر الجميع
هذا فخ Sitecore الأعلى أثرًا. في SXA يُضبط robots.txt داخل شجرة المحتوى في حقل Robots ضمن Settings، ويجب إعادة نشر الموقع بعد التغيير. وتقول وثائق Sitecore صراحةً: “If no rules are added, the system writes: ‘User-agent: * Disallow: /’” (ترجمة) «إذا لم تُضف قواعد، يكتب النظام: User-agent: * Disallow: /»، وهذا يحظر كل برامج الزحف. لا يعني الحقل الفارغ ملف robots.txt متساهلًا؛ بل يجب تعيين:
User-agent: *
Allow: /في معظم المنصات يعني غياب robots.txt «ازحف إلى كل شيء». أما في Sitecore فقد يعني العكس، لذلك يجب التحقق من ملف الإنتاج قبل الإطلاق. وفي XM Cloud + Next.js استخدم MetadataRoute.Robots. ويجب أن تحظر مثيلات CM وبيئات QA والتجهيز كل الزحف دائمًا؛ وحده مثيل CD في الإنتاج ينبغي أن يكون قابلًا للزحف.
تعدد اللغات وhreflang والمواقع المتعددة
يخزن Sitecore نسخ اللغات بوصفها إصدارات للعنصر نفسه، لا عناصر مستقلة. ومع الرجوع اللغوي على مستوى العنصر أو الحقل، مثل سلسلة es-MX → es-ES → en، قد يُخدم المحتوى نفسه في عناوين لغات متعددة، ما ينشئ تكرارًا ما لم يوضح hreflang العلاقة. ولا يُنشأ hreflang تلقائيًا في Sitecore القياسي؛ يجب إضافته إلى القوالب، مع أن SXA يستطيع توليده عند ضبطه، باستخدام عناوين مطلقة ومراجع ثنائية الاتجاه وx-default. قال John Mueller، كما نقله Jakub Koba: “TBH hreflang is one of the most complex aspects of SEO (if not the most complex one).” (ترجمة) «بصراحة، hreflang من أعقد جوانب SEO، إن لم يكن أعقدها». فلا تستخف به.
يدعم Sitecore أيضًا المواقع المتعددة ضمن تثبيت واحد، وأحيانًا بمحتوى مشترك. يحتاج المحتوى المشترك عبر حدود المواقع إلى استراتيجية canonical مقصودة، ويحتاج كل موقع إلى خريطة وrobots.txt خاصين به. وهذا مثال على تعقيد الملكية الموزعة والبنية المشتركة الذي ذكرته في SEO التقني للمؤسسات: “Sometimes different people are responsible for different sections of the website or even different pages, which can make internal linking time-consuming.” (ترجمة) «أحيانًا يكون أشخاص مختلفون مسؤولين عن أقسام مختلفة أو حتى صفحات مختلفة، ما يجعل الربط الداخلي مستهلكًا للوقت».
استراتيجية التصيير بلا واجهة في XM Cloud
هناك فرق في ملكية الطبقات يربك الفرق: لدى بيئات XM Cloud مضيف تحرير ومضيف تصيير، وهما ليسا الشيء نفسه. توضح وثائق Sitecore أن مضيف التحرير موجود فقط لتجربة WYSIWYG داخل Page Builder/Design Studio، وأنه “is not set up or scaled for serving live traffic,” (ترجمة) «غير معد أو موسع لخدمة الحركة الحية»، ولا يرى إلا حركة داخلية للمؤلفين. أما مضيف التصيير فهو تطبيق Next.js العام المستضاف على Vercel أو Netlify أو Azure، ويستهلك محتوى Experience Edge ويتوسع لخدمة الزوار. لا تصل برامج الزحف إلا إلى مضيف التصيير؛ ولا ينبغي أن تتمكن محركات البحث من بلوغ مضيف التحرير أصلًا.
في XM Cloud يكون وضع التصيير المختار في Next.js هو قرار SEO. ويلخص Akshay Sura من Konabos الخيارات الأربعة:
| الاستراتيجية | الأثر في SEO |
|---|---|
| SSG (ثابت) | الأفضل — “SSG pre-renders HTML at build time… Search engines can easily crawl the pre-rendered HTML.” (ترجمة) «يصيّر SSG ملف HTML مسبقًا وقت البناء، ويمكن لمحركات البحث الزحف إليه بسهولة» |
| ISR (إعادة توليد ثابتة تدريجية) | جيد — أداء ثابت مع تحديث في الخلفية؛ موصى به للمحتوى واسع النطاق |
| SSR (تصيير على الخادم) | جيد — “Fully rendered HTML is ready for search engines to index.” (ترجمة) «يكون HTML المصيّر بالكامل جاهزًا لفهرسة محركات البحث» |
| CSR (تصيير لدى العميل) | الأسوأ — “Search engines may struggle with indexing JavaScript-rendered content.” (ترجمة) «قد تواجه محركات البحث صعوبة في فهرسة المحتوى المصيّر بـJavaScript» |
التوصية هي SSG أو ISR للمحتوى الحرج لـSEO، وقصر CSR على الواجهات التفاعلية. تُضبط البيانات الوصفية عبر generateMetadata. ويذكر David Austin من Fishtank: “All fetch calls within generateMetadata are memoized, meaning identical URLs are only fetched once across the application, preventing redundant requests.” (ترجمة) «تُحفظ كل طلبات الجلب داخل generateMetadata، فلا تُجلب العناوين المتطابقة إلا مرة واحدة». ويقول Sebastián Aliaga: “The dynamic approach is the better method for Sitecore Headless as you’ll be able to take what’s part of the page’s layout data and incorporate it.” (ترجمة) «النهج الديناميكي أفضل لـSitecore بلا واجهة لأنه يتيح دمج بيانات تخطيط الصفحة».
التخصيص — لا تستخدم الإخفاء
تخصيص Sitecore مهم لـSEO. في XP يحدث التصيير على الخادم، لذلك يرى Googlebot التجربة الافتراضية غير المخصصة؛ تأكد أنها كاملة ومحسنة لا ضعيفة. وفي XM Cloud قد يخفي تخصيص JSS لدى العميل المحتوى عن برامج الزحف التي لا تنفذ JavaScript؛ فصيّر النسخة الافتراضية مسبقًا عبر SSR أو خصص عند الحافة.
القاعدة الصارمة في كليهما: لا تقدم محتوى مختلفًا لبرامج الزحف والمستخدمين؛ فهذا إخفاء ومخالفة للإرشادات. لا تخصص H1 الأساسي أو الأسئلة الشائعة أو البيانات المنظمة بقواعد لدى العميل. يجب أن يضيف التخصيص إلى المحتوى الأساسي، لا أن يستبدله.
البيانات المنظمة
استخدم JSON-LD داخل <script type="application/ld+json">. في XP صيّره من حقول القالب في عرض Razor أو عبر مسار؛ وفي XM Cloud نمذج حقول schema في القوالب واجلبها عبر GraphQL وصيّرها في مكوّن Next.js. أعط الأولوية لـFAQPage وHowTo وProduct وArticle وBreadcrumbList. ويمكن النشر عبر مدير وسوم — تقول Martha van Berkel من Schema App إن الفرق “typically use JavaScript to deploy Schema Markup to Sitecore… both efficient and scalable” (ترجمة) «تستخدم عادةً JavaScript لنشر Schema Markup في Sitecore، وهو نهج كفء وقابل للتوسع» — لكن الحقن لدى العميل قد لا تراه برامج زحف AI، لذا فضّل JSON-LD على الخادم. ويلخص Peter Lambrou من Codehouse الفائدة: “Add schema markup to the page HTML to make your search results appear more attractive.” (ترجمة) «أضف ترميز schema إلى HTML الصفحة لجعل نتائج البحث أكثر جاذبية».
حوكمة المؤسسات — موضع العمل الحقيقي
بعيدًا عن الإعدادات المنفردة، تحدد الحوكمة نتيجة SEO في تثبيت Sitecore كبير. قلت سابقًا إن مواقع المؤسسات هي موضع تألق SEO التقني لأن “enterprise sites can have complex infrastructures and a lot of legacy systems in place” (ترجمة) «قد تمتلك مواقع المؤسسات بنى معقدة وكثيرًا من الأنظمة القديمة»، وإن “I doubt there’s a major website that is technically perfect.” (ترجمة) «أشك في وجود موقع كبير مثالي تقنيًا». وتشمل عناصر الحوكمة المتكررة في Sitecore:
- تضخم القوالب. قوالب متعددة للغرض نفسه مع حقول SEO مختلفة أو مفقودة. دققها وافرض قالب SEO أساسيًا ترثه كل قوالب الصفحات.
- التحقق من البيانات الوصفية. اجمع Reset Blank مع تحقق الحقول كي لا ينشر المؤلفون عناوين أو أوصافًا فارغة أو أطول من اللازم.
- حوكمة الأسماء البديلة. لا يُنشأ اسم بديل إلا مع تجاوز canonical أو بوصفه أحد تحويلات 301s.
- ضبط البيئات. احظر CM وQA والتجهيز، واسمح بالإنتاج صراحةً وتحقق منه.
- ميزانية الزحف على نطاق واسع. قد تضخم المرشحات ونسخ اللغات والمعلمات فضاء العناوين؛ نسّق الخرائط واضبط robots وnoindex بعناية. راجع ميزانية الزحف.
ملخص AI
خلاصة مكثفة للنسخة المتقدمة:
- منصتان ونموذجان لـSEO. XP نظام .NET مصيّر على الخادم وتُدار SEO داخله؛ أما XM Cloud فهو SaaS بلا واجهة تتحكم فيه واجهة Next.js، عبر JSS المنشور الآن باسم Content SDK، في HTML وواجهات البيانات الوصفية. وتسميه الوثائق الحالية SitecoreAI.
- مضيف التحرير لا يساوي مضيف التصيير. الأول داخلي للتحرير ولا يخدم الحركة الحية؛ والثاني تطبيق Next.js العام الذي تصل إليه برامج الزحف عبر Vercel أو Netlify أو Azure وExperience Edge.
- لا شيء تقريبًا جاهز. يضيف SXA خريطة الموقع وإدارة robots.txt وحقول البيانات الوصفية، لكن كلها تحتاج إلى إعداد.
- فخ robots.txt: يجعل الحقل الفارغ Sitecore يخرج
User-agent: * / Disallow: /ويحظر الجميع؛ عيّنAllow: /وأعد النشر. - فخ الاسم البديل: يعيد العنوانان HTTP 200 بلا تحويل أو canonical تلقائي؛ أصلحه بتجاوز canonical أو تحويل 301.
- فخ البيانات الوصفية: الفراغ لا يساوي NULL، ولا يرث Standard Value إلا مع Reset Blank؛ أضف قواعد تحقق.
- التصيير: يُوصى بـSSG/ISR، وSSR مقبول، وCSR الأسوأ. استخدم
generateMetadataوMetadataRoute. - لا تُخفِ المحتوى: لا تخصص H1 أو FAQ أو schema لبرامج الزحف؛ اجعل النسخة الافتراضية كاملة.
- الحوكمة هي العمل الحقيقي: قالب SEO أساسي، والتحقق من البيانات الوصفية، وسياسة الأسماء البديلة، وضبط البيئات، وتنظيم ميزانية الزحف.
الوثائق الرسمية
وثائق المصادر الأولية من Sitecore وإرشادات Google العامة ذات الصلة.
Sitecore
- تحسين محركات البحث — XM Cloud / SitecoreAI — خريطة الموقع ورموز اللغات وrobots.txt والتحويلات وتحسين الصور؛ يصدر العنوان الآن تحويل 308 إلى مسار
.../sai/.../sitecoreai/.... - ضبط robots.txt — SitecoreAI — مصدر سلوك الحظر الافتراضي وموقع الحقل وضرورة إعادة النشر.
- ضبط خريطة موقع — SXA — أوضاع التخزين وخصائص الخريطة وفخ TargetHostName الذي يعيد 404.
- Standard Values لحقول قوالب البيانات — نموذج وراثة NULL مقارنةً بالفراغ.
- البيئة ومضيفا التحرير والتصيير — SitecoreAI — الفصل بين المضيف الداخلي والعام.
- تحسين SEO على الصفحة — Accelerate Cookbook — قائمة Sitecore للعناوين والنص البديل والتحويلات والمحتوى المختلط.
- تحسين المحتوى للذكاء الاصطناعي — إرشادات SSR وSSG وISR والتأليف بالمكونات وschema.
Google (إرشادات عامة منطبقة)
- أساسيات JavaScript SEO — ذات صلة بتصيير XM Cloud.
- الزحف والفهرسة — robots والخرائط وcanonical وضبط الزحف.
اقتباسات من المصادر
تصريحات موثقة من وثائق Sitecore وممارسين متخصصين.
وثائق Sitecore — الحظر الافتراضي
- “If no rules are added, the system writes: ‘User-agent: * Disallow: /’” (ترجمة) «إذا لم تُضف قواعد، يكتب النظام User-agent: * Disallow: /» — وثائق Sitecore.
- “If the value of a field is NULL, the item contains the standard value for that field as defined in the data template for that item.” (ترجمة) «إذا كانت قيمة الحقل NULL، يرث العنصر القيمة القياسية المحددة في قالب بياناته» — وثائق Sitecore. والفخ أن الفراغ لا يساوي NULL.
خط الأساس — غياب وظائف SEO تقريبًا
- “Sitecore ships with virtually no SEO functionality (with the exception of SXA which includes some basics).” (ترجمة) «يأتي Sitecore من دون وظائف SEO تقريبًا، باستثناء بعض أساسيات SXA» — Marcel، Fishtank (أغسطس 2018).
- “out-of-the-box, Sitecore’s data templates might not include some of the Meta Data fields.” (ترجمة) «قد تفتقد القوالب بعض حقول البيانات الوصفية افتراضيًا» / “Use Sitecore’s canonical link management to specify the preferred version of a URL.” (ترجمة) «استخدم إدارة canonical لتحديد النسخة المفضلة» — Ken Gray، Konabos (يناير 2024).
الأسماء البديلة والمحتوى المكرر
- “no redirect (no 301 or 302 HTTP status code) happens when you are using aliases in Sitecore” (ترجمة) «لا يحدث تحويل 301 أو 302 عند استخدام الأسماء البديلة» / “multiple URLs will be created for a single page URL.” (ترجمة) «تُنشأ عناوين متعددة لصفحة واحدة» — Dheer Rajpoot، BugDebugZone (يوليو 2014).
التصيير بلا واجهة (XM Cloud + Next.js)
- “SSG pre-renders HTML at build time, creating static files that can be served from a CDN.” (ترجمة) «يصيّر SSG HTML وقت البناء» / “Search engines can easily crawl the pre-rendered HTML.” (ترجمة) «يمكن لمحركات البحث الزحف إلى HTML المصيّر مسبقًا» / “Fully rendered HTML is ready for search engines to index.” (ترجمة) «HTML المصيّر بالكامل جاهز للفهرسة» / “Search engines may struggle with indexing JavaScript-rendered content.” (ترجمة) «قد يصعب فهرسة المحتوى المصيّر بـJavaScript» — Akshay Sura، Konabos (فبراير 2025).
- “All fetch calls within
generateMetadataare memoized, meaning identical URLs are only fetched once across the application, preventing redundant requests.” (ترجمة) «تُحفظ طلبات الجلب في generateMetadata ولا تُجلب العناوين المتطابقة إلا مرة» / “metadata is one of those things we tend to leave to the bitter end.” (ترجمة) «غالبًا نؤجل البيانات الوصفية حتى النهاية» — David Austin، Fishtank (أكتوبر 2023). - “The dynamic approach is the better method for Sitecore Headless as you’ll be able to take what’s part of the page’s layout data and incorporate it.” (ترجمة) «النهج الديناميكي أفضل لـSitecore بلا واجهة لأنه يدمج بيانات تخطيط الصفحة» — Sebastián Aliaga، DEV (يونيو 2024).
تعدد اللغات وschema
- “TBH hreflang is one of the most complex aspects of SEO (if not the most complex one).” (ترجمة) «hreflang من أعقد جوانب SEO إن لم يكن أعقدها» — John Mueller، نقله Jakub Koba، kogifi (يونيو 2025).
- “we typically use JavaScript to deploy Schema Markup to Sitecore. This method is both efficient and scalable…” (ترجمة) «نستخدم عادةً JavaScript لنشر Schema Markup في Sitecore، وهو كفء وقابل للتوسع» — Martha van Berkel، Schema App.
- “Add schema markup to the page HTML to make your search results appear more attractive.” (ترجمة) «أضف schema إلى HTML لجعل نتائج البحث أكثر جاذبية» — Peter Lambrou، Codehouse (ديسمبر 2022).
سياق المؤسسات (كتابتي)
- “Enterprise sites can have complex infrastructures and a lot of legacy systems in place.” (ترجمة) «قد تمتلك مواقع المؤسسات بنى معقدة وأنظمة قديمة كثيرة» / “I doubt there’s a major website that is technically perfect.” (ترجمة) «أشك في وجود موقع كبير مثالي تقنيًا» — Ahrefs.
قائمة إطلاق وتدقيق SEO في Sitecore
نفّذها قبل الإطلاق وعلى أي موقع Sitecore ترثه:
أساسيات الزحف والفهرسة
- ملف robots.txt في الإنتاج صريح (
User-agent: * / Allow: /)؛ تأكد أن الحقل ليس فارغًا وأعد النشر. - تحظر بيئات CM وQA والتجهيز كل برامج الزحف.
- تعمل
/sitemap.xmlفي SXA أوMetadataRoute.Sitemapفي Next.js، ويمنعTargetHostNameاستجابة 404. - لا تسرد الخريطة إلا عناوين canonical قابلة للفهرسة.
البيانات الوصفية
- يوجد قالب SEO أساسي ترثه كل قوالب الصفحات.
- فُعّل Reset Blank للحقول التي ينبغي أن ترث Standard Values.
- تفرض قواعد التحقق عناوين وأوصافًا غير فارغة وضمن حدود الطول.
العناوين والتكرار
- تتحول الأسماء البديلة بـ301 أو تحمل تجاوز canonical؛ لا عنوانان بـHTTP 200 للمحتوى نفسه.
- تُضبط وسوم canonical خصوصًا للمحتوى المشترك بين المواقع.
- يُفرض اتساق www والشرطة الختامية وبادئة اللغة.
تعدد اللغات
- يُطبق hreflang بعناوين مطلقة واتجاهين و
x-default. - لا يكرر الرجوع اللغوي المحتوى بصمت عبر عناوين اللغات.
XM Cloud فقط
- يُصيّر المحتوى المهم عبر SSG/ISR/SSR لا CSR.
- تُضبط البيانات عبر
generateMetadataويُصيّر JSON-LD على الخادم. - لا يُخفى H1 أو FAQ أو schema وراء تخصيص لدى العميل.
إطار حوكمة SEO في Sitecore
يتوسع SEO عندما تمر كل صفحة عبر الضوابط الخمسة نفسها بدل الاعتماد على المؤلفين أو إصلاحات المكونات المنفردة.
- قالب SEO أساسي: ترث كل القوالب حقول العنوان والوصف وcanonical والشبكات الاجتماعية والفهرسة؛ وغيابه عيب إصدار.
- التحقق من البيانات الوصفية: توفر Standard Values القيم الاحتياطية، ويعالج Reset Blank الحقول الممسوحة، وتمنع القواعد القيم الفارغة أو غير الصالحة.
- حوكمة الأسماء البديلة: يتحول كل اسم دائمًا إلى العنصر canonical أو يحمل تطبيق canonical صريحًا؛ عنوانان بـHTTP 200 ليسا افتراضًا مقبولًا.
- ضبط البيئات: يسمح الإنتاج بالزحف صراحةً وتحظره CM وQA والتجهيز، وتُفحص استجابة robots بعد كل نشر يمس الإعداد.
- تنظيم سطح الزحف: لا تحتوي الخرائط إلا عناوين canonical قابلة للفهرسة، وتُراجع اللغات والمحتوى المشترك والمرشحات والمعلمات كمصادر تضخم.
في XP طبّق الضوابط في القوالب وStandard Values والمسارات وSXA. وفي XM Cloud طبّق الحوكمة نفسها في Next.js عبر generateMetadata وMetadataRoute وJSON-LD على الخادم واستعلامات Experience Edge.
ورقة Sitecore SEO المختصرة
موضع التحكم في XP مقارنةً بـXM Cloud
| Sitecore XP | XM Cloud | |
|---|---|---|
| البنية | .NET تقليدي مصيّر على الخادم | SaaS بلا واجهة + Next.js (JSS) |
| ما تراه برامج الزحف | HTML خادم مكتمل | مخرجات وضع التصيير |
| موضع إدارة SEO | القوالب وStandard Values والمسارات | واجهات بيانات Next.js الوصفية |
| البيانات الوصفية | حقول القوالب | generateMetadata |
| الخريطة/robots | وحدات SXA | MetadataRoute.Sitemap / .Robots |
| التخصيص | على الخادم | خطر لدى العميل؛ استخدم SSR/الحافة |
الفخاخ الثلاثة
| الفخ | النتيجة | الإصلاح |
|---|---|---|
| حقل robots فارغ | يخرج Disallow: / ويحظر الجميع | عيّن Allow: / وأعد النشر |
| اسم بديل | يعيد العنوانان HTTP 200 | حوّل الاسم بـ301 أو احقن canonical |
| حقل بيانات فارغ | لا يرث Standard Value | فعّل Reset Blank والتحقق |
ترتيب أوضاع التصيير لـSEO
- SSG الأفضل؛ مصيّر مسبقًا ويُخدم من CDN.
- ISR ممتاز؛ ثابت مع تحديث في الخلفية.
- SSR جيد؛ مصيّر بالكامل لكل طلب.
- CSR تجنبه للمحتوى القابل للفهرسة.
أولوية schema: FAQPage وHowTo وProduct وArticle وBreadcrumbList، مع JSON-LD على الخادم لأن برامج زحف AI قد تفوت حقن مدير الوسوم.
إخفاقات Sitecore SEO الشائعة
اختفاء موقع الإنتاج خلف حظر زحف
العَرَض: يحتوي /robots.txt الحي User-agent: * وDisallow: / أو يبلغ الزاحف عن حظر شامل.
السبب المرجح: تُرك حقل robots فارغًا ونُشر؛ والفراغ غير متساهل هنا.
الإصلاح: عيّن قاعدة سماح صريحة، وأعد النشر، واجلب /robots.txt الحي ثانيةً، مع إبقاء CM وQA والتجهيز محظورة.
ظهور الاسم البديل والعنصر canonical كصفحتين
العَرَض: يعيد عنوانان HTTP 200 بالمحتوى نفسه ولا يتحول الاسم البديل.
السبب المرجح: يخدم محلل الأسماء البديلة المسار مباشرةً ولا يضيف canonical تلقائيًا.
الإصلاح: اجعل المسار يعيد 301 إلى العنصر canonical، أو أضف تجاوز canonical عند ضرورة بقاء الاسم. النتيجة المفضلة عنوان 200 واحد وتحويل دائم واحد.
عناوين أو أوصاف منشورة فارغة
العَرَض: البيانات المصيّرة فارغة رغم وجود Standard Values.
السبب المرجح: مسح المؤلف الحقل فصار فارغًا لا NULL؛ ولا تستبدله Standard Values دون Reset Blank.
الإصلاح: فعّل Reset Blank وأضف تحققًا وأعد ضبط العناصر ونشرها، ثم تحقق من المصدر المصيّر.
خريطة SXA تعيد 404
العَرَض: لا تعمل /sitemap.xml رغم تفعيل وضع الخريطة.
السبب المرجح: TargetHostName مفقود أو تعريف الموقع يشير إلى مضيف خاطئ.
الإصلاح: اضبط المضيف الصحيح وامسح الذاكرة المؤقتة عند الحاجة ثم اطلب /sitemap.xml على مضيف الإنتاج.
أثبت سلامة تغيير robots.txt في Sitecore
اجلب استجابة الإنتاج المنشورة
الاختبار: بعد التعديل وإعادة النشر، اطلب /robots.txt الحي مباشرةً.
النتيجة المتوقعة: يحتوي الإنتاج قواعد السماح والحظر المقصودة ولا يرجع إلى Disallow: / شامل.
تفسير الفشل: عُدّل عنصر خاطئ أو لم يُنشر التغيير أو تُخدم نسخة مخزنة أو افتراضية.
نافذة المراقبة: فور النشر وتحديث الذاكرة المؤقتة.
محفز التراجع: استعد آخر قيمة سليمة فورًا إذا حظر الإنتاج الجميع أو حذف حماية مطلوبة.
تحقق من فصل البيئات
الاختبار: اجلب /robots.txt على CM وQA والتجهيز ومضيف الإنتاج.
النتيجة المتوقعة: تحظر البيئات غير الإنتاجية الزحف، ولا يُزحف إلا إلى الإنتاج المقصود.
تفسير الفشل: جرت مشاركة عنصر robots أو هدف النشر أو ضبط المضيف خطأً.
نافذة المراقبة: فور التغيير وبعد ترقية البيئة.
محفز التراجع: تراجع إذا أصبحت بيئة غير إنتاجية قابلة للزحف أو ورث الإنتاج حظرها الشامل.
أكد السلوك الذي يراه الزاحف
الاختبار: استخدم URL Inspection في Search Console على عنوان إنتاج ممثل بعد تصحيح robots.
النتيجة المتوقعة: يجلب الاختبار الصفحة ويحتوي HTML المصيّر البيانات والمحتوى المتوقعين.
تفسير الفشل: ما زال تحكم آخر أو مصادقة أو ملف robots مخزن يحظر Google.
نافذة المراقبة: نفّذ الاختبار فورًا وانتظر دورة الزحف المعتادة قبل الحكم على التقرير.
محفز التراجع: تراجع عن تغييرات الوصول إذا ظل Google محظورًا مع انفتاح الطلبات العامة.
أدوات Sitecore SEO
داخل Sitecore
- SXA — يوفر خريطة الموقع وإدارة robots.txt وحقول البيانات الوصفية الموحدة.
- قواعد تحقق حقول Content Editor — تمنع نشر عناوين وأوصاف فارغة أو طويلة.
MetadataRoute/generateMetadataفي Next.js — خرائط وrobots وبيانات صفحات مدفوعة بالشيفرة من Experience Edge عبر GraphQL.
التحقق في محركات البحث
- Google Search Console — الفهرسة وHTML المصيّر وخرائط الموقع وتقرير Page Indexing.
- Bing Webmaster Tools — تحقق وإرسال مستقلان، ومهم في المواقع بلا واجهة لأن Bing أبطأ في تصيير JS.
التدقيق والزحف
- Ahrefs Site Audit وScreaming Frog SEO Spider — لاكتشاف التكرار والبيانات الفارغة وسلاسل التحويل والعناوين المحظورة على نطاق واسع.
- Google Lighthouse — توصي به Sitecore لفحوص السرعة والصفحة.
موارد تستحق وقتك
كتاباتي ذات الصلة
- Enterprise SEO — قيود الموارد والتعقيد التنظيمي والربط الداخلي على نطاق المؤسسات.
- مواقع المؤسسات هي موضع تألق SEO التقني — الأنظمة القديمة والحزم المتعددة والملكية الموزعة وcanonical.
محاضراتي
- How Search Works — الزحف والتصيير والفهرسة والترتيب؛ قسم التصيير هو الأهم لـSitecore بلا واجهة. وينطبق إخلاء مسؤوليتي: “This is my understanding of systems… not going to be 100% complete or accurate.” (ترجمة) «هذا فهمي للأنظمة، ولن يكون كاملًا أو دقيقًا 100%».
من المجال
- أفضل ممارسات SEO في Sitecore — البيانات الوصفية وcanonical.
- Master Rendering in Next.js with Sitecore XM Cloud — مقارنة SSG وSSR وISR وCSR.
- Optimizing Metadata and SEO in Next.js — مسار
generateMetadata. - أفضل ممارسات Sitecore SEO — خط أساس غياب الوظائف الجاهزة.
- Impact of Sitecore Aliases on SEO — آلية التكرار بالأسماء البديلة.
- How to Customize Multilingual Features — اللغات والرجوع وhreflang.
- 10 نصائح SEO لموقع Sitecore — نصائح عملية ومنها schema.
اختبر نفسك: Sitecore SEO
خمسة أسئلة سريعة عن فخاخ Sitecore والفروق بين المنصتين. اختر إجابة ثم تحقق منها.
سجل التغييرات
تم التحديث في 22 أغسطس 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 11 أغسطس 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 19 يوليو 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.