زاحف Baiduspider
ما هو Baiduspider — متغيرات زاحف Baidu وسلاسل user-agent، وامتثال robots.txt (واستثناء cpro/ads)، والتحقق العكسي من DNS، وضعف تصيير JavaScript، والتحكم في الزحف عبر Ziyuan.
اللغات
دليل واحد في هذه الصفحة
- أداة مباشرة ذات صلةDNS Checker
Baiduspider هو زاحف الويب لدى Baidu — النظير الخاص بالسوق الصينية لـGooglebot، والروبوت الذي يكتشف الصفحات ويجلبها ويفهرسها لبحث Baidu داخل الصين القارية. ويشغّل متغيرات مسماة تتشارك عائلة رمز Baiduspider (للصور والفيديو والأخبار والإشارات المرجعية وcpro وads)، إضافة إلى متغير JavaScript باسم Baiduspider-render توثقه Baidu بالصينية فقط. وتتحقق منه عبر DNS ثنائي الاتجاه إلى *.baidu.com أو *.baidu.jp (إذ يمكن انتحال user-agent)، وتحذر الأسئلة الشائعة لدى Baidu نفسها من المنتحلين. وتقول أسئلة Baidu الشائعة إنه يلتزم robots.txt التزامًا صارمًا — مع استثناء مسمى: يعمل Baiduspider-cpro وBaiduspider-ads بموجب اتفاقيات تجارية ويتجاهلان ذلك. وأكبر قيوده العملية مقارنةً بـGooglebot هي ضعف تصيير JavaScript، لذا يكون HTML المصيّر من الخادم هو الافتراضي الآمن. وتحكم في معدل زحفه عبر منصة موارد بحث Baidu (Ziyuan).
Evidence for this claim Baiduspider is Baidu Search's crawler and Baidu's Search Resource Platform is the authoritative place to verify current crawler guidance. Scope: Current official Baidu webmaster platform; user-agent text alone is not authentication. Confidence: medium · Verified: Baidu Search Resource Platform Evidence for this claim Crawler access directives use the standardized robots.txt protocol, but engine-specific support and verification should be checked against Baidu's current documentation. Scope: Robots Exclusion Protocol baseline, distinct from undocumented Baidu-specific behavior. Confidence: high · Verified: IETF RFC 9309: Robots Exclusion Protocolالخلاصة — Baiduspider هو زاحف الويب لدى Baidu — الروبوت الذي يزور صفحاتك وينزّلها لبحث Baidu. وإذا كانت الصين القارية سوقًا مهمة، فمكان Baiduspider في مراقبة الزحف لديك. افحص وثائق مشرفي المواقع الحالية لدى Baidu قبل الاعتماد على سلوك خاص بالمحرك، خصوصًا في تصيير JavaScript وضوابط الزحف.
ما هو Baiduspider؟
لا يعمل Google داخل الصين القارية. أما Baidu فيعمل — وهو محرك البحث الذي يستخدمه معظم الناس هناك، وBaiduspider هو زاحفه. عندما يزور Baiduspider موقعك، يتبع الروابط ويقرأ خريطة موقعك وينزّل صفحاتك، ثم يمررها لبناء فهرس Baidu — قاعدة البيانات التي يسحب منها Baidu النتائج عندما يبحث شخص ما. وإذا لم يستطع Baiduspider الوصول إلى صفحة وقراءتها، فلن تظهر تلك الصفحة في Baidu.
وبكلمات Baidu نفسها (من الأسئلة الشائعة الرسمية بالإنجليزية): “Baiduspider is Baidu search engine program which is used to visit pages on the internet and build information into Baidu index. This enables users to locate your site when they perform a search.” (ترجمة) «Baiduspider برنامج محرك بحث Baidu، يُستخدم لزيارة الصفحات على الإنترنت وبناء المعلومات في فهرس Baidu. وهذا يمكّن المستخدمين من العثور على موقعك عندما يجرون بحثًا». وهذه هي المهمة نفسها التي يؤديها Googlebot لدى Google وBingbot لدى Bing.
لماذا قد يهمك؟
لا يهم Baiduspider حقًا إلا إذا أردت أن يعثر عليك الناس داخل الصين القارية. فما زالت Baidu تتصدر هناك بينما يكاد Google لا يظهر — لذلك يحتاج الموقع الموجه إلى الصين (أو الموقع العالمي ذي الجمهور الصيني) إلى Baiduspider بالطريقة نفسها التي يحتاج بها الموقع الغربي إلى Googlebot. وإذا لم تقدم خدمات لعملاء في الصين إطلاقًا، فـBaiduspider مجرد روبوت آخر يضرب خادمك، وتختار بعض المواقع حجبه لتوفير الموارد.
المشكلة: Baiduspider ضعيف مع JavaScript
هذه هي النقطة الكبرى. يشغّل Googlebot إصدارًا حديثًا من Chrome ويقرأ معظم المواقع الثقيلة بـJavaScript بصورة جيدة. أما Baiduspider فلا يفعل — إذ تُفيد تقارير واسعة بأنه ضعيف في تشغيل JavaScript. وإذا لم يظهر محتواك أو روابطك المهمة إلا بعد تشغيل JavaScript، فقد لا يراها Baidu أبدًا، حتى لو كانت الصفحة نفسها تحتل ترتيبًا جيدًا في Google. والحركة الآمنة للموقع الموجه إلى الصين هي التأكد من وجود المحتوى الحقيقي في HTML العادي الذي يعود قبل تشغيل أي JavaScript.
كيف تساعد Baiduspider (أو توقفه)؟
- للسماح له بالدخول: اربط صفحاتك المهمة، وأرسل خريطة موقع في منصة موارد بحث Baidu (نسخة Baidu من Search Console)، ولا تحجب تلك الصفحات بالخطأ في
robots.txt. - لإبقائه خارج أجزاء من موقعك: استخدم
robots.txt— تقول Baidu إنه يتبع القواعد القياسية هناك. - لإبطائه: تضم منصة موارد بحث Baidu مساحة لتكرار الزحف، حيث يمكنك رؤية مقدار زحف Baiduspider ووضع حد له.
هل تريد النسخة التقنية — سلاسل user-agent الدقيقة، وكيف تتحقق من Baiduspider الحقيقي، وخصائص robots.txt الغريبة، وضوابط تكرار الزحف؟ انتقل إلى علامة التبويب Advanced.
Evidence for this claim Baiduspider is Baidu Search's crawler and Baidu's Search Resource Platform is the authoritative place to verify current crawler guidance. Scope: Current official Baidu webmaster platform; user-agent text alone is not authentication. Confidence: medium · Verified: Baidu Search Resource Platform Evidence for this claim Crawler access directives use the standardized robots.txt protocol, but engine-specific support and verification should be checked against Baidu's current documentation. Scope: Robots Exclusion Protocol baseline, distinct from undocumented Baidu-specific behavior. Confidence: high · Verified: IETF RFC 9309: Robots Exclusion Protocolالخلاصة — Baiduspider هو زاحف Baidu — Googlebot السوق الصينية. ويشغّل متغيرات مسماة تتشارك عائلة الرمز
Baiduspider(للحاسوب والهاتف عمومًا، إضافة إلى-imageو-videoو-newsو-favoو-cproو-ads) ومتغير JavaScript باسمBaiduspider-renderتوثقه Baidu باللغة الصينية فقط. وتتحقق منه عبر DNS ثنائي الاتجاه إلى*.baidu.com/*.baidu.jp— إذ تحذر الأسئلة الشائعة لدى Baidu من المنتحلين. وتقول Baidu إنه “strictly complies with robots.txt protocol” (ترجمة) «يلتزم التزامًا صارمًا ببروتوكول robots.txt»، مع استثناء مسمى: يعملBaiduspider-cproوBaiduspider-adsبموجب اتفاقيات تجارية وقد يتبعان قواعد وصول مختلفة؛ كما أنها لا توثقcrawl-delayغير القياسي بوصفه وسيلة تحكم موثوقة. ولأن سلوك التصيير قد يتغير، فإن HTML المصيّر من الخادم هو الافتراضي المحافظ للمحتوى الحرج. تحقق من الضوابط الحالية في منصة موارد بحث Baidu (Ziyuan).
ما هو Baiduspider فعلًا؟
Baiduspider (百度蜘蛛) هو الزاحف الذي تديره Baidu، محرك البحث المهيمن داخل الصين القارية، حيث يتعذر الوصول إلى Google إلى حد كبير خلف جدار الحماية العظيم. وتتمثل مهمته في خط الأنابيب المعتاد: زحف ← فهرسة ← عرض؛ يكتشف عناوين URL، ويجلب الصفحات، ويبني الفهرس الذي يستمد منه بحث Baidu نتائجه. والأسئلة الشائعة الرسمية بالإنجليزية لدى Baidu، “FAQs of Baiduspider” على help.baidu.com، هي الجزء النادر من الوثائق الأولية باللغة الإنجليزية هنا، ومنها تأتي معظم الاقتباسات المباشرة أدناه.
اللامساواة التي تؤطر كل شيء هي أن Baidu مهمة محليًا لا عالميًا. فقد وضعت لقطة الصين لدى StatCounter في يونيو 2026 حصة Baidu عند 47,44%، وBing عند 23,24%، وHaosou عند 14,02%، وSogou عند 2,62%، وGoogle عند 2,28% فقط (StatCounter، حصة محركات البحث في الصين). تعامل مع ذلك بوصفه لقطة لا ثابتًا — فأرقام StatCounter الصينية تتأرجح بصورة ملحوظة من شهر إلى آخر بحسب مزيج الأجهزة والمنهجية (وقد أُبلغ عن Baidu في نطاق يقارب 40% إلى 65% عبر لقطات مختلفة في 2025–2026) ، لذا أعد فحص الرقم الحي بدل اقتباس شهر واحد إلى الأبد. والخلاصة تصح في كل الأحوال: تتصدر Baidu داخل الصين بينما يتصدر Google بقية العالم، ولهذا يُعامل تحسين Baiduspider كتخصص مستقل في SEO الدولي لا كفكرة لاحقة لـGooglebot. وتغطي بوابة SEO الخاص بكل سوق في موقعنا موضع Baidu إلى جانب Yandex وNaver والمحركات الإقليمية الأخرى.
سلاسل user-agent ومتغيرات الزحف
تسمي الأسئلة الشائعة الإنجليزية لدى Baidu متغيرات الزاحف مباشرةً. وقد أُعيد إنتاجها حرفيًا (ونعم، يكرر نص Baidu نفسه “Baiduspider” للحاسوب والهاتف بدل إعطاء سلسلتين مميزتين):
الاسم | User-agent بحث الحاسوب | Baiduspider بحث الهاتف | Baiduspider بحث الصور | Baiduspider-image بحث الفيديو | Baiduspider-video بحث الأخبار | Baiduspider-news إشارة Baidu المرجعية | Baiduspider-favo Baidu Union | Baiduspider-cpro البحث التجاري | Baiduspider-ads بحث آخر | Baiduspider
إذن فالمتغيرات المسماة رسميًا في الأسئلة الشائعة الإنجليزية هي Baiduspider-image و-video و-news و-favo (إشارة مرجعية)، و**-cpro** (زاحف شبكة «الاتحاد»/الإعلانات)، و**-ads** (البحث التجاري) — وكلها تتشارك رمز العائلة Baiduspider. أما سلسلة user-agent العامة الحرفية للحاسوب، الواردة في موقع Baidu نفسه، فهي:
Mozilla/5.0 (compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html)يُضمّن UA الهاتف Baiduspider/2.0 داخل سلسلة Android WebKit. ويشير كل متغير معلن إلى عنوان URL المرجعي نفسه http://www.baidu.com/search/spider.html — وهو نظير Baidu للعنوان google.com/bot.html الخاص بـGooglebot.
Baiduspider-render — متغير JavaScript الذي توثقه Baidu بالصينية فقط
إليك تفصيلة دقيقة تستحق التصحيح، لأن كثيرًا من الكتابات تخطئ فيها: جدول الأسئلة الشائعة الإنجليزية أعلاه لا يسرد متغيرًا باسم «Baiduspider-render»، ما دفع بعض الأدلة إلى اعتباره مجرد حكاية من طرف ثالث. لكنه ليس كذلك. توثق Baidu Baiduspider-render رسميًا — لكن في صفحة أكاديمية Ziyuan باللغة الصينية بعنوان “【官方说法】只需两步,正确识别百度蜘蛛(User-Agent)” (أي: “[Official statement] Two steps to correctly identify Baiduspider” (ترجمة) «[بيان رسمي] خطوتان للتعرف الصحيح إلى Baiduspider»). وتقسم الصفحة سلاسل UA إلى ثلاث قنوات — 移动 (الهاتف) ، وPC، و小程序 (البرنامج المصغر) — وتسرد UA بديلًا للتصيير إلى جانب السلسلة العادية:
Mozilla/5.0 (compatible; Baiduspider-render/2.0; +http://www.baidu.com/search/spider.html)مع سلسلة هاتف مطابقة ومتغير للبرامج المصغرة (Baiduspider-render/2.0;Smartapp). لذا فإن Baiduspider-render موثق رسميًا — لكن بالصينية فقط، وغائب عن الأسئلة الشائعة الإنجليزية. وما لا تنشره Baidu هو مواصفة لما يفعله «-render» بصورة مختلفة فعلًا؛ فعلى خلاف Google، لا توثق Baidu قدرات تصيير JavaScript لديها. ومن هذه الفجوة يأتي التحفظ بشأن تصيير JS أدناه.
كيف تتحقق من Baiduspider (ولا تقع في روبوت منتحل)؟
يمكن انتحال سلسلة user-agent بسهولة — إذ يستطيع أي شخص إرسال طلب يقول إنه Baiduspider. وتحذر الأسئلة الشائعة لدى Baidu نفسها من ذلك تحديدًا، واصفةً “spammers or other trouble makers who pretend to be Baiduspider” (ترجمة) «مرسلي البريد المزعج أو مثيري المتاعب الآخرين الذين يتظاهرون بأنهم Baiduspider»، وتوصي بالتحقق عبر DNS لا عبر السلسلة. ومن الأسئلة الشائعة، حرفيًا:
We recommend using reverse DNS lookup to verify Baiduspider. Verification methods are different under linux/windows/os environments. (ترجمة) «نوصي باستخدام بحث DNS العكسي للتحقق من Baiduspider. وتختلف طرق التحقق في بيئات Linux وWindows وmacOS.»
وتعطي أوامر لكل نظام تشغيل — host في Linux، وnslookup في Windows، وdig -x في macOS — مع أمثلة عملية، والقاعدة المهمة هي:
The hostname of Baiduspider is .baidu.com or .baidu.jp. Others are fake hostnames. (ترجمة) «اسم المضيف الخاص بـBaiduspider هو .baidu.com أو .baidu.jp. وما عدا ذلك أسماء مضيفين زائفة.»
النطاقان *.baidu.com و*.baidu.jp هما التفصيلة التي ينبغي تذكرها — إذ يزحف Baidu من مساحة DNS عكسية .com وأخرى .jp، ولذلك يمكن أن ينتهي اسم مضيف Baiduspider الشرعي بأي منهما. بل إن أحد أمثلة Baidu العملية نفسها يُحل إلى BaiduMobaider-119-63-195-254.crawl.baidu.jp — لاحظ «BaiduMobaider» لا «Baiduspider» في اسم المضيف؛ إنها غرابة حقيقية في وثائق Baidu وليست خطأ ينبغي تصحيحه بصمت.
توضح الأسئلة الشائعة الإنجليزية لدى Baidu نصف البحث العكسي فقط في نثرها، لكن صفحة أكاديمية Ziyuan الصينية أكثر صراحة: فهي تسمي العملية كلها “双向DNS解析认证” (مصادقة تحليل DNS ثنائي الاتجاه) وتقسمها إلى “第一步:DNS反查IP” (الخطوة الأولى: البحث العكسي عن IP) و”第二步:对域名运行正向DNS查找” (الخطوة الثانية: تشغيل بحث DNS أمامي على اسم المضيف). وهذه هي الطريقة الكاملة الصحيحة — ابحث عكسيًا عن IP لتؤكد اسم مضيف *.baidu.com/*.baidu.jp، ثم ابحث أماميًا عن اسم المضيف وتأكد من عودته إلى IP نفسه. إنها الطريقة ذات الخطوتين نفسها التي تستخدمها للتحقق من Googlebot أو Bingbot — والأوامر موجودة في علامة التبويب Scripts.
Baiduspider وrobots.txt
تقدم Baidu في أسئلتها الشائعة ادعاء امتثال قويًا وقابلًا للاقتباس على نحو غير معتاد:
Baidu strictly complies with robots.txt protocol. (ترجمة) «تلتزم Baidu التزامًا صارمًا ببروتوكول robots.txt.»
وتدعم ضوابط قياسية متوقعة. فبحسب مادة أكاديمية Ziyuan لدى Baidu، يدعم Baiduspider مطابقة أحرف البدل باستخدام * و$ في مسارات robots.txt (بالتكافؤ مع Google وBing)، ويطبق مطابقة مسارات حساسة لحالة الأحرف بصورة دقيقة. ويمكنك وضع قواعد لكل user-agent — إذ تقدم الأسئلة الشائعة لدى Baidu أمثلة عملية، منها مثال يحجب كل شيء عن Baiduspider العام لكنه يسمح لزاحف الصور بالدخول إلى /image/:
User-agent: Baiduspider
Disallow: /
User-agent: Baiduspider-image
Allow: /image/(وتشير Baidu أيضًا إلى أن Baiduspider-video لا يدعم هذه القواعد حاليًا.)
الاستثناء المسمى من «الامتثال الصارم»
المفارقة المهمة هي أن Baidu تدعي الامتثال الصارم لكنها توثق استثناءً رسميًا مسمى. يعمل Baiduspider-cpro (زاحف شبكة الإعلانات) وBaiduspider-ads (البحث التجاري) بموجب اتفاقيات تجارية منفصلة ويتجاهلان robots.txt عن قصد. ومن الأسئلة الشائعة، حرفيًا: “Baiduspider-cpro will not work on the records set by robots.txt” (ترجمة) «لن يعمل Baiduspider-cpro على السجلات التي يضعها robots.txt»، وينطبق الأمر نفسه على -ads. لذلك فالصياغة الصادقة ليست «Baidu لا تحترم robots.txt دائمًا» المبهمة التي تراها في مواقع التجميع — بل إن زواحف Baidu القياسية تمتثل، مع زاحفي إعلانات معفيين تعاقديًا بوصفهما الاستثناء الموثق الملموس.
وهناك نقطة منفصلة أضيق يسهل خلطها: لا يحترم Baiduspider توجيه crawl-delay غير القياسي. وقد وثقت Abby Hamilton من Search Engine Journal ذلك في الدليل الحديث لـRobots.txt (نوفمبر 2024) — إذ يسرد جدول مقارنة الزواحف «Baidu | Baiduspider | No» لدعم crawl-delay (بينما YandexBot لدى Yandex مسجل «Yes»). وهذه دعوى مختلفة عن امتثال Allow/Disallow القياسي، ومن المهم إبقاؤها مستقيمة حتى لا تناقض ادعاء Baidu الخاص عن robots.txt.
مثال حقيقي: robots.txt الخاص بـbaidu.com
تطبق Baidu تقسيم robots.txt على نطاقها هي. وتمنح robots.txt الحي زاحف Baiduspider الخاص بها قائمة حظر أقصر مما تمنحه لـGooglebot وMSNBot وSogou وYoudao (إذ تحصل تلك الزواحف إضافةً على حظر /shifen/ و/homepage/ و/cpro) ، وتحجب كل شيء (Disallow: /) لأي user-agent غير مسمى افتراضيًا:
User-agent: Baiduspider
Disallow: /baidu
Disallow: /s?
Disallow: /ulink?
Disallow: /link?
Disallow: /home/news/data/
Disallow: /bhتوجد تفصيلة تشغيلية في الأسئلة الشائعة تستحق المعرفة عند تعديل القواعد: إذا شددت robots.txt بعد أن فهرست Baidu موقعًا بالفعل، “it usually takes 48 hours for the updated robots.txt to take effect.” (ترجمة) «يستغرق تطبيق robots.txt المحدّث عادةً 48 ساعة».
هل يصيّر Baiduspider JavaScript؟
هذه أكبر قيود Baiduspider العملية مقارنةً بـGooglebot، ومن المهم التفريق بين الرسمي وغير الرسمي. فالأسئلة الشائعة الإنجليزية لدى Baidu لا تتناول تصيير JavaScript إطلاقًا — ولا توجد مواصفة للقدرة كما تنشر Google لـGooglebot. وما لدينا بدلًا من ذلك هو اختبارات صناعية متسقة. وقد صاغ Dan Taylor الأمر بوضوح في مقارنة Google مقابل Baidu من Search Engine Journal (مارس 2021): “Baidu is notoriously bad when it comes to crawling JavaScript, so make sure that all your important content and links are served in plain HTML on both the mobile and desktop versions of your website.” (ترجمة) «تشتهر Baidu بسوءها في زحف JavaScript، لذا تأكد من تقديم كل محتواك وروابطك المهمة في HTML عادي على إصداري موقعك للهاتف والحاسوب.»
وهذا يتفق مع موقف هذا الموقع القائم أصلًا. فتغطيتنا لـSEO في Contentful تلاحظ أن Bing وYandex وBaidu “may not index [client-side-rendered JS] at all,” (ترجمة) «قد لا تفهرس [client-side-rendered JS] على الإطلاق»، وأن التصيير الديناميكي تقنية Google عامة مهجورة. ضع الزواحف الثلاثة الكبيرة على طيف: ينفذ Googlebot تصييرًا كاملًا عبر Chromium دائم التحديث، وينفذ Bingbot تصييرًا متينًا عبر Chromium/Edge، وBaiduspider هو الأضعف بينها في JavaScript — مع كون HTML العادي المصيّر من الخادم هو الحل الآمن عالميًا بينها كلها.
الإرشاد العملي للموقع الموجه إلى الصين هو جعل التصيير من الخادم أو HTML الثابت افتراضيًا، حتى يوجد المحتوى والروابط والبيانات الوصفية الحرجة في الاستجابة الأولية قبل تشغيل أي JavaScript. تعامل مع المحتوى الذي لا يظهر إلا من جهة العميل بوصفه خطر فهرسة خاصًا بـBaidu، بصرف النظر عن ترتيبه الجيد في Google. وقدّم SSR بوصفه أفضل ممارسة متفقًا عليها في المجال هنا — لا توصية رسمية من Baidu، لأنه لا يوجد تصريح أولي من Baidu عن تصيير JS يمكن الاستشهاد به.
التحكم في تكرار زحف Baiduspider
تقدم Baidu تكرار الزحف بوصفه معدّلًا ذاتيًا خوارزميًا، لا شيئًا تضبطه مباشرةً. ومن الأسئلة الشائعة، حرفيًا:
In order to ensure the search results cover most of your pages, Baiduspider must keep the crawling at a certain level. We have been trying our best to avoid increasing the loading to your servers, and to adjust the frequency based on combined factors, such as your server’s capability, your site’s quality and the update frequency of your site. (ترجمة) «لضمان أن تغطي نتائج البحث معظم صفحاتك، يجب أن يحافظ Baiduspider على الزحف عند مستوى معين. وقد بذلنا قصارى جهدنا لتجنب زيادة الحمل على خوادمك، ولضبط التكرار استنادًا إلى عوامل مجتمعة مثل قدرة خادمك وجودة موقعك وتكرار تحديثه.»
هذه هي منطق قدرة الخادم مع الطلب نفسه الذي تصفه Google وBing. وتسمي الأسئلة الشائعة نموذج ملاحظات (webmaster.baidu.com/feedback/index) بوصفه وسيلة رسمية للإبلاغ عن الزحف المفرط — “If you find any unreasonable access from Baiduspider, please inform us.” (ترجمة) «إذا وجدت وصولًا غير معقول من Baiduspider، فأبلغنا.»
وعلى مستوى المنتج، فإن منصة موارد بحث Baidu (百度搜索资源平台، على ziyuan.baidu.com — وهي وحدة التحكم التي كانت تسمى تاريخيًا «أدوات مشرفي المواقع من Baidu») هي نظير Baidu لـGoogle Search Console وBing Webmaster Tools. ويؤكد دليلها اليدوي وجود مساحة منتج «抓取频次» (تكرار الزحف) يمكن لأصحاب المواقع فيها رؤية معدل زحف Baiduspider ووضع حد له مباشرةً، إلى جانب أدوات robots وتشخيص الزحف. تعامل مع نموذج الملاحظات بوصفه مسار التصعيد الرسمي في وثائق Baidu الإنجليزية، ولوحة تكرار الزحف في Ziyuan بوصفها أداة التحكم العملية على مستوى الواجهة. (مسار القائمة الدقيق داخل المنتج خلف حساب Ziyuan مسجل الدخول، لذا أكد الواجهة الحالية هناك قبل اقتباس خطوات محددة.)
hreflang وإشارات Google القياسية الأخرى
لا تنتقل الإشارات القياسية في Google كلها إلى Baidu — وهذه نتيجة من الصناعة والممارسين، لا شيئًا توثقه أي من الشركتين. فـوثائق Google عن النسخ المترجمة محصورة بالكامل في بحث Google ولا تدعي شيئًا عن احترام Baidu أو Bing أو Yandex لـhreflang. ويقول دليل hreflang في هذا الموقع بوضوح: Baidu لا تدعم hreflang إطلاقًا — والحل الاحتياطي هو ضبط content-language و<html lang> بدقة كي تقرأ Baidu لغة الصفحة على الأقل. وهذا يضاف إلى عملي في hreflang المحصور في Google (دليل Ahrefs عن وسوم hreflang ودراسة 374 756 نطاقًا ، وكلاهما يناقش تنفيذ Google فقط) ولا يناقضه.
لا ثقافة ممثلين بالإنجليزية — لماذا الأسئلة الشائعة ذات قيمة استثنائية؟
أحد الأمور التي تميز منظومة Baidu فعلًا هو أنها، بخلاف Google (Gary Illyes وJohn Mueller) وBing (Fabrice Canel) وYandex، لا تملك ثقافة علنية مرئية للأسئلة والأجوبة مع ممثلين باللغة الإنجليزية. فلا يوجد متحدث مسمى يشارك مجتمع SEO نقاشاته ذهابًا وإيابًا. وأوضح صوت رسمي لـBaidu بالإنجليزية هو الأسئلة الشائعة المؤسسية غير الموقعة في help.baidu.com. ولهذا تكتسب تلك الأسئلة — وصفحات أكاديمية Ziyuan الصينية التي تقف خلفها — قيمة كبيرة: فمعظم المعرفة التشغيلية عن Baiduspider في عالم SEO الناطق بالإنجليزية تأتي من اختبارات الممارسين (تحليل سجلات الخادم، وتمارين التحقق من DNS، ومحاولات robots.txt وخطئها) لا من تعليقات ممثلين رسميين. وقد لخص Michael Bonfils الدرس الأوسع في Baidu مقابل Google من Search Engine Land: “SEO strategies that work for Google may not always translate directly to success on Baidu, China’s dominant search engine.” (ترجمة) «استراتيجيات SEO التي تعمل لدى Google قد لا تنتقل دائمًا بصورة مباشرة إلى النجاح على Baidu، محرك البحث المهيمن في الصين».
ولفهم موضع Baiduspider في الصورة الأكبر — عائلة الزواحف، وGooglebot وBingbot بوصفهما نظيرين، ومفهوم user-agent، وrobots.txt — تجمعها بوابة الزحف، بينما يمثل SEO الدولي موطن سياق السوق الصينية.
ملخص الذكاء الاصطناعي
ملخص مكثف للنسخة المتقدمة:
- Baiduspider = زاحف الويب لدى Baidu — Googlebot السوق الصينية. تهيمن Baidu داخل الصين القارية (StatCounter، يونيو 2026: Baidu نحو 47%، وGoogle نحو 2%)، لذا فهو تخصص في SEO الدولي لا فكرة لاحقة لـGooglebot. وتتأرجح الحصة من شهر إلى آخر — تعامل معها بوصفها لقطة.
- تتشارك المتغيرات عائلة الرمز
Baiduspider: الحاسوب والهاتف عمومًا، إضافة إلى-imageو-videoو-newsو-favo(إشارة مرجعية) و-cpro(شبكة إعلانات) و-ads(تجاري). UA العام للحاسوب:Mozilla/5.0 (compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html). Baiduspider-renderموثق رسميًا — لكن في صفحة أكاديمية Ziyuan الصينية فقط، وهو غائب عن الأسئلة الشائعة الإنجليزية. وما يفعله «-render» بصورة مختلفة غير محدد في مواصفة.- تحقق عبر DNS ثنائي الاتجاه إلى
*.baidu.comأو*.baidu.jp(فـBaidu تزحف من الاثنين): ابحث عكسيًا عن IP، ثم ابحث أماميًا عن اسم المضيف عائدًا إلى IP نفسه. ويمكن انتحال user-agent؛ وتحذر Baidu من المنتحلين. - robots.txt: تدعي Baidu أنها “strictly complies” (ترجمة) «تلتزم التزامًا صارمًا»، وتدعم أحرف البدل
*/$والمطابقة الحساسة لحالة الأحرف — مع استثناء مسمى: يعملBaiduspider-cproوBaiduspider-adsبموجب اتفاقيات تجارية ويتجاهلان robots.txt. وبصورة منفصلة لا يحترم Baiduspidercrawl-delayغير القياسي (بحسب Abby Hamilton من SEJ). وتحتاج تغييرات القواعد نحو 48 ساعة حتى تسري. - JavaScript هو أكبر فجوة مقارنةً بـGooglebot — لا توجد مواصفة قدرة رسمية؛ والإجماع الصناعي (Dan Taylor: “notoriously bad… crawling JavaScript” (ترجمة) «سيئ بصورة سيئة السمعة… في زحف JavaScript») هو أن HTML المصيّر من الخادم/الثابت هو الافتراضي الآمن للمواقع الموجهة إلى الصين.
- تكرار الزحف خوارزمي (قدرة الخادم + جودة الموقع + تكرار التحديث)؛ أبلغ عن الزحف المفرط عبر نموذج ملاحظات Baidu، واعرض/ضع حدًا للمعدل في منصة موارد بحث Baidu (Ziyuan) — نظير Search Console لدى Baidu.
- لا يدعم Baidu hreflang (نتيجة صناعية؛ ولا توثق أي من الشركتين الأمر في الاتجاه الآخر) — استخدم
content-language/<html lang>بدلًا منه. - لا ثقافة ممثلين بالإنجليزية: أوضح صوت رسمي لـBaidu بالإنجليزية هو أسئلة شائعة غير موقعة، لذا تحمل اختبارات الممارسين معظم المعرفة التشغيلية.
الوثائق الرسمية
وثائق المصادر الأولية. وتنقسم وثائق Baidu بين أسئلة شائعة بالإنجليزية وصفحات Ziyuan (منصة موارد بحث Baidu) بالصينية؛ أما روابط Google فموجودة للمقارنة عند تقاطع hreflang.
Baidu
- الأسئلة الشائعة عن Baiduspider (help.baidu.com) — الأسئلة الشائعة الرسمية من Baidu باللغة الإنجليزية: ماهية Baiduspider، وجدول user-agent، وسياسة تكرار الزحف، والتحقق من DNS مع أمثلة عملية، ومعالجة robots.txt. وهذا هو المصدر الأولي بالإنجليزية.
- 【بيان رسمي】خطوتان للتعرف الصحيح إلى عنكبوت Baidu (User-Agent) (ziyuan.baidu.com) — المقالة الرسمية الصينية لدى Baidu عن التعرف إلى Baiduspider: قنوات UA الثلاث (الهاتف/الحاسوب/البرنامج المصغر) ، وUA الخاص بـ
Baiduspider-render، وطريقة «مصادقة DNS ثنائي الاتجاه» كاملة. - الفهرس اليدوي لمنصة موارد بحث Baidu (ziyuan.baidu.com) — فهرس دليل منتج Ziyuan الذي يؤكد مساحات أدوات 抓取频次 (تكرار الزحف) وrobots و抓取诊断 (تشخيص الزحف).
- baidu.com/robots.txt — ملف robots.txt الحي الخاص بـBaidu، ومثال حقيقي على التقسيم بحسب الزاحف.
Google (للمقارنة عند تقاطع hreflang)
- إخبار Google بالنسخ المترجمة من صفحتك — وثائق hreflang لدى Google، المحصورة بالكامل في بحث Google؛ ومن اللافت أنها لا تقول شيئًا عن احترام Baidu أو Bing أو Yandex لـhreflang.
اقتباسات من المصدر
لا تملك Baidu متحدثًا إنجليزيًا مسمى، لذا فإن «المصدر» هنا هو أسئلتها الشائعة غير الموقعة، إلى جانب تعليقات صناعية مسماة تقوم مقام اقتباسات الممثلين التي تحصل عليها من Google أو Bing. وكل رابط هنا رابط عميق يقفز إلى المقطع المقتبس.
Baidu — «الأسئلة الشائعة عن Baiduspider» (help.baidu.com، بالإنجليزية)
- “Baiduspider is Baidu search engine program which is used to visit pages on the internet and build information into Baidu index. This enables users to locate your site when they perform a search.” (ترجمة) «Baiduspider هو برنامج محرك بحث Baidu المستخدم لزيارة الصفحات على الإنترنت وبناء المعلومات في فهرس Baidu، مما يمكّن المستخدمين من العثور على موقعك عند البحث». انتقل إلى الاقتباس
- “In order to ensure the search results cover most of your pages, Baiduspider must keep the crawling at a certain level… to adjust the frequency based on combined factors, such as your server’s capability, your site’s quality and the update frequency of your site.” (ترجمة) «لضمان أن تغطي نتائج البحث معظم صفحاتك، يجب أن يحافظ Baiduspider على الزحف عند مستوى معين… وأن يضبط التكرار استنادًا إلى عوامل مجتمعة مثل قدرة خادمك وجودة موقعك وتكرار تحديثه». انتقل إلى الاقتباس
- “We recommend using reverse DNS lookup to verify Baiduspider.” (ترجمة) «نوصي باستخدام بحث DNS العكسي للتحقق من Baiduspider». انتقل إلى الاقتباس
- “The hostname of Baiduspider is .baidu.com or .baidu.jp. Others are fake hostnames.” (ترجمة) «اسم المضيف الخاص بـBaiduspider هو .baidu.com أو .baidu.jp. وما عدا ذلك أسماء مضيفين زائفة». انتقل إلى الاقتباس
- “Baidu strictly complies with robots.txt protocol.” (ترجمة) «تلتزم Baidu التزامًا صارمًا ببروتوكول robots.txt». انتقل إلى الاقتباس
Baidu — أكاديمية Ziyuan (ziyuan.baidu.com، بالصينية)
- الأصل: “二、双向DNS解析认证” — الصياغة الإنجليزية: “Step two: bidirectional DNS resolution authentication” (ترجمة) «الخطوة الثانية: مصادقة تحليل DNS ثنائي الاتجاه»، وهو الاسم الذي تطلقه Baidu نفسها على التحقق من Baiduspider عبر بحث عكسي يتبعه بحث أمامي يعود إلى IP نفسه. عرض الصفحة
Dan Taylor، Search Engine Journal — عن JavaScript
- “Baidu is notoriously bad when it comes to crawling JavaScript, so make sure that all your important content and links are served in plain HTML on both the mobile and desktop versions of your website.” (ترجمة) «تشتهر Baidu بسوءها في زحف JavaScript، لذا تأكد من تقديم كل محتواك وروابطك المهمة في HTML عادي على إصداري موقعك للهاتف والحاسوب.» (مارس 2021). انتقل إلى الاقتباس
Michael Bonfils، Search Engine Land — عن انتقال الاستراتيجية
- “SEO strategies that work for Google may not always translate directly to success on Baidu, China’s dominant search engine.” (ترجمة) «استراتيجيات SEO التي تعمل لدى Google قد لا تنتقل دائمًا بصورة مباشرة إلى النجاح على Baidu، محرك البحث المهيمن في الصين». انتقل إلى الاقتباس
Abby Hamilton، Search Engine Journal — عن crawl-delay
- يسرد جدول مقارنة الزواحف لديها Baiduspider على أنه لا يدعم توجيه
crawl-delayغير القياسي (“Baidu | Baiduspider | No” (ترجمة) «Baidu | Baiduspider | لا»). (نوفمبر 2024). اقرأ التغطية
help.baidu.com جزئيًا عبر JavaScript، وصفحة أكاديمية Ziyuan صينية فقط؛ وقد تأكدت الاقتباسات الإنجليزية أعلاه بوصفها سلاسل فرعية مطابقة في الصفحات الحية، لكن أكدها مقابل الصفحات الحية (واستخدم متصفحًا للمصادر المصيّرة عبر JS/المصادر الصينية) قبل معاملتها نهائية. هل ينبغي أن أسمح لـBaiduspider بزحف موقعي — وكيف أتعامل معه؟
لا يستحق Baiduspider الجهد إلا إذا كنت تريد ظهورًا في سوق الصين. انقر خلاله.
Deciding what to do about Baiduspider
تحقق من أن الروبوت هو Baiduspider فعلًا
توصي الأسئلة الشائعة لدى Baidu نفسها باستخدام DNS العكسي للتحقق من Baiduspider، لأن انتحال سلسلة user-agent سهل جدًا. نفّذ الفحص ثنائي الاتجاه الكامل الذي تسميه Baidu في صفحتها الصينية في Ziyuan: ابحث عكسيًا عن IP (يجب أن ينتهي اسم المضيف بـ*.baidu.com أو*.baidu.jp)، ثم ابحث أماميًا عن اسم المضيف عائدًا إلى IP نفسه.
macOS / Linux
# 1) Reverse-DNS the IP from your logs — it must end in baidu.com or baidu.jp
host 123.125.66.120
# → 120.66.125.123.in-addr.arpa domain name pointer Baiduspider-123-125-66-120.crawl.baidu.com
# 2) Forward-DNS that hostname back — it must resolve to the same IP
host Baiduspider-123-125-66-120.crawl.baidu.com
# → Baiduspider-123-125-66-120.crawl.baidu.com has address 123.125.66.120صيغة dig في macOS (كما تعرضها الأسئلة الشائعة لدى Baidu):
dig -x 123.125.66.120Windows
nslookup 123.125.66.120
nslookup Baiduspider-123-125-66-120.crawl.baidu.comإذا لم ينته البحث العكسي بـbaidu.com أو baidu.jp، أو لم يُرجع البحث الأمامي IP الأصلي، فليس ذلك Baiduspider — أسقطه أو حدّ من معدله. (وهي طريقة الخطوتين نفسها للتحقق من Googlebot وBingbot؛ راجع علامتي التبويب Scripts في مقالتيهما لإصداري Google/Bing.)
استخرج إصابات Baiduspider فقط من سجلات الخادم
استخرج أسطر Baiduspider المرشحة من سجل الوصول، ثم تحقق من كل IP بفحص DNS أعلاه — لا تثق بالسلسلة وحدها.
# Extract lines whose user-agent claims to be Baiduspider, print unique IPs
grep -i 'baiduspider' /var/log/nginx/access.log \
| awk '{print $1}' | sort -uطابق اسم مضيف مع النطاقات المسموحة لدى Baidu (regex)
بعد أن تحل اسم مضيف عكسيًا، يؤكد هذا التعبير النمطي أنه يقع في إحدى مساحتي الزحف الشرعيتين لدى Baidu (.baidu.com أو .baidu.jp) لا في نطاق شبيه به:
# Passes only for hostnames ending in .baidu.com or .baidu.jp
echo "Baiduspider-123-125-66-120.crawl.baidu.com" \
| grep -Eiq '\.baidu\.(com|jp)$' && echo "legit namespace" || echo "FAKE"احذر الأسماء الشبيهة مثل baidu.com.evil.example — فتثبيت النمط عند نهاية السلسلة ($) هو ما يمنع مرورها.
نقطة بداية لـrobots.txt خاصة بـBaiduspider
# Let Baiduspider crawl everything except low-value spaces
User-agent: Baiduspider
Disallow: /search
Disallow: /*?*sort=
# Block Baiduspider entirely (China not a target market)
# User-agent: Baiduspider
# Disallow: /تذكر: يتحكم Disallow في الزحف لا الفهرسة، وتحتاج تغييرات القواعد نحو 48 ساعة حتى تسري. ويتجاهل زاحفا الإعلانات Baiduspider-cpro وBaiduspider-ads robots.txt عن قصد.
Baiduspider — ورقة غش
سلاسل user-agent ومتغيرات الزحف
| المتغير | رمز robots.txt | User-agent |
|---|---|---|
| العام (الحاسوب + الهاتف) | Baiduspider | Mozilla/5.0 (compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html) |
| بحث الصور | Baiduspider-image | يتشارك رمز عائلة Baiduspider، مع لاحقة -image |
| بحث الفيديو | Baiduspider-video | لاحقة -video (لا يدعم حاليًا قواعد robots.txt لكل وكيل) |
| بحث الأخبار | Baiduspider-news | لاحقة -news |
| إشارة Baidu المرجعية | Baiduspider-favo | لاحقة -favo |
| Baidu Union (شبكة إعلانات) | Baiduspider-cpro | لاحقة -cpro — يتجاهل robots.txt بموجب اتفاق تجاري |
| البحث التجاري | Baiduspider-ads | لاحقة -ads — يتجاهل robots.txt بموجب اتفاق تجاري |
| التصيير (متغير JS) | — | Mozilla/5.0 (compatible; Baiduspider-render/2.0; +http://www.baidu.com/search/spider.html) — موثق فقط في صفحة أكاديمية Ziyuan الصينية لدى Baidu، وغائب عن الأسئلة الشائعة الإنجليزية |
يشير UA لكل متغير معلن إلى عنوان URL المرجعي نفسه http://www.baidu.com/search/spider.html — نظير Baiduspider للعنوان google.com/bot.html الخاص بـGooglebot.
الامتثال لـrobots.txt في لمحة
| الزاحف | هل يتبع robots.txt؟ |
|---|---|
Baiduspider العام و-image و-video و-news و-favo | نعم — تقول أسئلة Baidu الشائعة: “Baidu strictly complies with robots.txt protocol” (ترجمة) «تلتزم Baidu التزامًا صارمًا ببروتوكول robots.txt» |
Baiduspider-cpro | لا — استثناء مسمى وموثق (اتفاق تجاري) |
Baiduspider-ads | لا — استثناء مسمى وموثق (اتفاق تجاري) |
توجيه crawl-delay غير القياسي | غير محترم من أي متغير Baiduspider، بحسب Abby Hamilton من Search Engine Journal |
حقائق سريعة
- تحقق عبر DNS ثنائي الاتجاه: ابحث عكسيًا عن IP الزحف لتؤكد اسم مضيف ينتهي بـ
*.baidu.comأو*.baidu.jp، ثم ابحث أماميًا عن اسم المضيف عائدًا إلى IP نفسه. لا يثبت user-agent وحده شيئًا. - تحتاج تغييرات robots.txt نحو 48 ساعة حتى تسري على موقع فُهرس بالفعل.
- تدعم Baidu مطابقة أحرف البدل
*و$في مسارات robots.txt، وتطبق مطابقة مسارات دقيقة حساسة لحالة الأحرف. - تكرار الزحف يُعدّل خوارزميًا ذاتيًا (قدرة الخادم وجودة الموقع وتكرار التحديث) — اعرضه وضع له حدًا في منصة موارد بحث Baidu (Ziyuan).
- أكبر فجوة عملية لـBaiduspider مقارنةً بـGooglebot هي ضعف تصيير JavaScript — وHTML المصيّر من الخادم أو الثابت هو الافتراضي الآمن للمحتوى الموجه إلى الصين.
- لا تدعم Baidu hreflang — والإشارة الاحتياطية هي
content-languageصحيح و<html lang>.
قائمة تحقق للاستعداد لـBaiduspider
مرور سريع للتأكد من أنك تعمل مع Baiduspider لا ضده بالخطأ — وهي الأرض نفسها التي تغطيها علامة التبويب Advanced في صورة قائمة تحقق.
- لا يحجب robots.txt
Baiduspider(أو المتغير الذي يهمك) عن أي شيء تريد العثور عليه في نتائج بحث Baidu. - أُرسلت خريطة موقع في منصة موارد بحث Baidu (Ziyuan).
- يستخدم التحقق من الروبوت DNS ثنائي الاتجاه — بحث عكسي إلى
*.baidu.com/*.baidu.jp، ثم بحث أمامي يؤكد IP نفسه — وليس سلسلة user-agent وحدها. - أنت على دراية بأن
Baiduspider-cproو**Baiduspider-ads** يتجاهلان robots.txt عن قصد، ولذلك لن يوقفهما حظرهما هناك فعليًا. - مرّ نحو 48 ساعة على أي تشديد حديث لـrobots.txt قبل إعادة فحص حالة الفهرسة.
- يوجد المحتوى الحرج والروابط الداخلية والبيانات الوصفية في استجابة HTML المصيّرة من الخادم — لا تحقنها JavaScript من جهة العميل وحدها.
- ضُبط
content-languageو<html lang>بصورة صحيحة، لأن Baidu لا تدعم hreflang. - روجعت حمولة الزحف في مساحة Crawl Frequency (抓取频次) في Ziyuan إذا كان مرور Baiduspider يجهد الخادم.
- أُبلغ عن الزحف غير المعقول أو المفرط عبر نموذج ملاحظات Baidu (
webmaster.baidu.com/feedback/index) بدل التخمين أو الحجب مباشرةً. - لا يوجد اعتماد باقٍ على Baidu MIP — فقد تقاعد الإطار (أُخرجت الذاكرة المؤقتة تدريجيًا في يونيو 2020، وأُوقفت الخدمة الكاملة في أواخر سبتمبر 2022).
أدوات للعمل مع Baiduspider
- DNS Checker — أداتي الخاصة بفحص DNS ثنائي الاتجاه الذي توصي به الأسئلة الشائعة لدى Baidu. أدخل IP الزاحف مع نوع السجل PTR لتنفيذ البحث العكسي (ينتهي اسم مضيف Baiduspider الحقيقي بـ
.baidu.comأو.baidu.jp)، ثم أدخل اسم المضيف مع نوع السجل A لتؤكد أن البحث الأمامي يعود إلى IP نفسه. وتستعلم الأداة من Cloudflare وGoogle وQuad9 جنبًا إلى جنب حتى تلاحظ أي اختلاف بين محللات DNS. - robots.txt Tester — أداتي الخاصة لفحص ما إذا كانت قواعد robots.txt تحجب Baiduspider أو تسمح له كما تقصد. الصق ملفك، وأدخل
Baiduspider(أوBaiduspider-imageوBaiduspider-newsوغيرهما) في حقل user-agent المخصص، واختبره مقابل مسارات حقيقية — إذ تعرض الأداة القاعدة الفائزة لكل عنوان URL. وتذكر أنBaiduspider-cproوBaiduspider-adsيتجاهلان robots.txt مهما أظهر الفاحص، لأنهما يعملان بموجب اتفاقيات تجارية منفصلة.
خرافات وأخطاء Baiduspider التي ينبغي تجنبها
الخرافة: «أي user-agent يحتوي على Baiduspider هو Baidu فعلًا».
لماذا هي خاطئة: يمكن انتحال سلسلة user-agent بسهولة، وتحذر الأسئلة الشائعة لدى Baidu من “spammers or other trouble makers who pretend to be Baiduspider.” (ترجمة) «مرسلي البريد المزعج أو مثيري المتاعب الآخرين الذين يتظاهرون بأنهم Baiduspider».
افعل بدلًا من ذلك: نفّذ فحص DNS ثنائي الاتجاه — بحثًا عكسيًا إلى اسم مضيف *.baidu.com/*.baidu.jp، ثم بحثًا أماميًا عائدًا إلى IP نفسه — قبل الوثوق بأي إصابة تحمل «Baiduspider» (أو حجبها بناءً عليها).
الخرافة: «Baidu لا تتبع robots.txt أبدًا، أو أنها غير موثوقة عمومًا بشأنه».
لماذا هي خاطئة: تقول أسئلة Baidu الشائعة: “Baidu strictly complies with robots.txt protocol” (ترجمة) «تلتزم Baidu التزامًا صارمًا ببروتوكول robots.txt» لزواحفها القياسية. والاستثناء الحقيقي ضيق ومسمى — يعمل Baiduspider-cpro وBaiduspider-ads بموجب اتفاقيات تجارية ويتجاهلان robots.txt — وليس عبارة مبهمة مثل «Baidu تتجاهل robots».
افعل بدلًا من ذلك: اذكر استثناء cpro/ads المحدد، ولا تخلطه بحقيقة منفصلة هي أن Baiduspider لا يحترم توجيه crawl-delay غير القياسي.
الخرافة: «يصير Baiduspider JavaScript بقدر جودة Googlebot الحديث تقريبًا». لماذا هي خاطئة: الإجماع الصناعي (وصفه Dan Taylor بأنه “notoriously bad… crawling JavaScript” (ترجمة) «سيئ بصورة سيئة السمعة… في زحف JavaScript») هو أن Baiduspider متأخر كثيرًا عن Chromium الدائم التحديث لدى Googlebot؛ والمحتوى الذي لا يظهر إلا من جهة العميل خطر فهرسة حقيقي لدى Baidu حتى عندما تحتل الصفحة ترتيبًا جيدًا في Google. افعل بدلًا من ذلك: قدم المحتوى والروابط والبيانات الوصفية المهمة في HTML مصيّر من الخادم أو ثابت للمواقع الموجهة إلى الصين — وهو الافتراضي الآمن عبر Googlebot وBingbot وBaiduspider معًا.
الخرافة: «يعمل hreflang لدى Baidu بالطريقة نفسها التي يعمل بها لدى Google».
لماذا هي خاطئة: لا تدعم Baidu hreflang إطلاقًا (وهي نتيجة صناعية — ولا تعلق وثائق Google نفسها على المحركات الأخرى في أي من الاتجاهين).
افعل بدلًا من ذلك: استخدم content-language و<html lang> دقيقين كي تقرأ Baidu لغة الصفحة على الأقل؛ ولا تعتمد على hreflang لتوجيه Baidu.
الخرافة: «Baiduspider-render ليس متغيرًا موثقًا رسميًا».
لماذا هي خاطئة: لا يسرده جدول الأسئلة الشائعة الإنجليزية لدى Baidu، لكن صفحة أكاديمية Ziyuan الصينية توثق Baiduspider-render/2.0 بوصفه UA بديلًا للحاسوب/الهاتف ومتغيرًا للبرنامج المصغر. وهو رسمي — لكن بالصينية فقط.
افعل بدلًا من ذلك: صفه بأنه موثق رسميًا (بالصينية فقط)، مع الإشارة إلى أن Baidu لا تنشر مواصفة لما يفعله «-render» بصورة مختلفة فعلًا.
الخرافة: «Baidu MIP ما زال رافعة ترتيب حية وموصى بها». لماذا هي خاطئة: إطار MIP (Mobile Instant Pages) الشبيه بـAMP لدى Baidu قديم. ووفق مسرد MIP لدى Jademond ، أُخرجت ذاكرة MIP المؤقتة تدريجيًا في يونيو 2020 وأُوقفت خدمة MIP الكاملة في أواخر سبتمبر 2022 — ومع ذلك تروج له بعض مواد الوكالات المؤرخة حديثًا كأنه حي، وهو مصدر التباس بحد ذاته. افعل بدلًا من ذلك: تعامل مع MIP بوصفه متقاعدًا، وتشَكك في أي دليل حديث يقدمه كرافعة سرعة/ترتيب نشطة.
اختبر نفسك: Baiduspider
خمسة أسئلة سريعة عن زاحف Baidu. اختر إجابة لكل سؤال ثم تحقق منها.
موارد تستحق وقتك
كتاباتي ذات الصلة
- وسوم Hreflang: دليل بسيط (لكنه كامل) — دليلي في Ahrefs (مع Joshua Hardwick) عن hreflang؛ محصور في Google، وهو سياق يوضح لماذا يمثل غياب دعم Baidu لـhreflang مسألة منفصلة.
- أكثر من 67% من النطاقات التي تستخدم Hreflang لديها مشكلات — دراسة فريقي لـ374 756 نطاقًا؛ تركز على تنفيذ Google، ومفيدة بوصفها نقيض عدم دعم Baidu.
- دليل المبتدئين إلى SEO التقني — موضع الزواحف والإشارات الدولية في الصورة الأكبر.
كلماتي
- SEO الدولي: الأجزاء التقنية الغريبة (Pubcon Vegas 2019، SlideShare) — حديثي عن الحالات التقنية الحدية في SEO الدولي، وهي البيئة التي يعيش فيها عمل سوق Baidu.
من أرجاء المجال
- الأسئلة الشائعة عن Baiduspider (Baidu، help.baidu.com) — الأسئلة الشائعة الإنجليزية الخاصة بـBaidu: جدول UA، والتحقق من DNS، ومعالجة robots.txt، وسياسة تكرار الزحف. المصدر الأولي بالإنجليزية.
- Google مقابل Baidu: الفروق الأساسية في استراتيجية SEO (Dan Taylor، Search Engine Journal) — تقييم «السوء الشهير في زحف JavaScript» والتوصية بـHTML العادي.
- Baidu مقابل Google: استكشاف مشهد SEO في 2024 (Michael Bonfils، Search Engine Land) — وجهة نظر مؤسس وكالة حول سبب عدم انتقال تكتيكات Google مباشرةً إلى Baidu.
- الدليل الحديث لـRobots.txt (Abby Hamilton، Search Engine Journal) — جدول مقارنة الزواحف الذي يبين أن Baiduspider لا يحترم
crawl-delay. - دليل زواحف الويب: ما تحتاج إلى معرفته (James Allen، Search Engine Land) — موضع Baiduspider في جولة أوسع للزواحف.
- فهم عناكب Baidu وUser Agents وrobots.txt (Jademond Digital) — بحث عملي عميق في متغيرات زاحف Baidu ومعالجة robots.
- Baidu MIP (مسرد) (Jademond Digital) — مصدر تواريخ تقاعد MIP (إخراج الذاكرة المؤقتة في يونيو 2020؛ وإيقاف الخدمة الكاملة في أواخر سبتمبر 2022).
سجل التغييرات
تم التحديث في 22 أغسطس 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.
تم التحديث في 8 أغسطس 2026.
ملخص تحريري وتفاصيل التغيير المسجلة.تفاصيل التغيير
-
تفاصيل التغيير متاحة حاليًا باللغة الإنجليزية.
المقارنة الكاملة غير متاحة — لم تُؤرشف لقطة سابقة لهذه المراجعة.