Baiduspider — robot indeksujący Baidu
Czym jest Baiduspider — warianty i user-agenty crawlera Baidu, zgodność z robots.txt (oraz wyjątek cpro/ads), weryfikacja odwrotnego DNS, słabe renderowanie JavaScript i kontrola indeksowania w Ziyuan.
Języki
1 sygnał dowodowy na tej stronie
- Powiązane działające narzędzieDNS Checker
Baiduspider to web crawler Baidu — odpowiednik Googlebota na rynek chiński, bot, który odkrywa, pobiera i indeksuje strony dla Baidu Search w Chinach kontynentalnych. Działa w nazwanych wariantach dzielących wspólną rodzinę tokenów Baiduspider (image, video, news, favo, cpro, ads), plus wariant JavaScript Baiduspider-render, który Baidu dokumentuje tylko po chińsku. Zweryfikuj go za pomocą dwukierunkowego DNS do *.baidu.com lub *.baidu.jp (user-agent można sfałszować), ponieważ FAQ Baidu ostrzega przed oszustami. FAQ Baidu twierdzi, że ściśle przestrzega robots.txt — z jednym wyjątkiem: Baiduspider-cpro i Baiduspider-ads działają na podstawie umów komercyjnych i ignorują go. Jego największym praktycznym ograniczeniem w porównaniu z Googlebotem jest słabe renderowanie JavaScript, więc bezpiecznym domyślnym rozwiązaniem jest HTML renderowany po stronie serwera. Kontroluj jego szybkość indeksowania przez Baidu Search Resource Platform (Ziyuan).
Evidence for this claim Baiduspider is Baidu Search's crawler and Baidu's Search Resource Platform is the authoritative place to verify current crawler guidance. Scope: Current official Baidu webmaster platform; user-agent text alone is not authentication. Confidence: medium · Verified: Baidu Search Resource Platform Evidence for this claim Crawler access directives use the standardized robots.txt protocol, but engine-specific support and verification should be checked against Baidu's current documentation. Scope: Robots Exclusion Protocol baseline, distinct from undocumented Baidu-specific behavior. Confidence: high · Verified: IETF RFC 9309: Robots Exclusion ProtocolTL;DR — Baiduspider to robot indeksujący Baidu — bot, który odwiedza Twoje strony, pobiera je dla wyszukiwarki Baidu. Jeśli Chiny kontynentalne są dla Ciebie ważnym rynkiem, Baiduspider powinien znaleźć się w Twoim monitorowaniu indeksowania. Sprawdź aktualną dokumentację dla webmasterów Baidu przed poleganiem na zachowaniach specyficznych dla silnika, zwłaszcza w przypadku renderowania JavaScriptu i kontroli robotów.
Czym jest Baiduspider
Google nie działa w Chinach kontynentalnych. Baidu działa — to wyszukiwarka, z której korzysta tam większość ludzi, a Baiduspider to jej robot indeksujący. Gdy Baiduspider odwiedza Twoją witrynę, śledzi linki, czyta Twoją mapę witryny, pobiera Twoje strony i przekazuje je do budowy indeksu Baidu — bazy danych, z której Baidu korzysta, gdy ktoś szuka. Jeśli Baiduspider nie może dotrzeć do strony i jej przeczytać, ta strona nie pojawi się w Baidu.
Słowami samego Baidu (z oficjalnego angielskiego FAQ): “Baiduspider is Baidu search engine program which is used to visit pages on the internet and build information into Baidu index. This enables users to locate your site when they perform a search.” (tłumaczenie) „Baiduspider to program wyszukiwarki Baidu, który służy do odwiedzania stron w internecie i budowania informacji w indeksie Baidu. Dzięki temu użytkownicy mogą znaleźć Twoją witrynę podczas wyszukiwania.” To to samo zadanie, które Googlebot wykonuje dla Google, a Bingbot dla Binga.
Dlaczego może to być dla Ciebie ważne
Baiduspider ma znaczenie tylko wtedy, gdy chcesz być znajdowany w Chinach kontynentalnych. Baidu wciąż tam prowadzi, podczas gdy Google ledwo się liczy — więc witryna skierowana do Chin (lub globalna witryna z chińską publicznością) potrzebuje Baiduspidera tak samo, jak zachodnia witryna potrzebuje Googlebota. Jeśli w ogóle nie obsługujesz klientów w Chinach, Baiduspider to po prostu kolejny bot uderzający na Twój serwer, a niektóre witryny decydują się go blokować, aby oszczędzić zasoby.
Haczyk: Baiduspider słabo radzi sobie z JavaScriptem
To jest najważniejsza sprawa. Googlebot uruchamia nowoczesną wersję Chrome i dobrze czyta większość witryn opartych na JavaScripcie. Baiduspider nie — powszechnie raportuje się, że słabo radzi sobie z uruchamianiem JavaScriptu. Jeśli Twoje ważne treści lub linki pojawiają się dopiero po uruchomieniu JavaScriptu, Baidu może ich nigdy nie zobaczyć, nawet jeśli ta sama strona dobrze pozycjonuje się w Google. Bezpieczne posunięcie dla witryny skierowanej do Chin: upewnij się, że Twoje prawdziwe treści znajdują się w czystym HTML, który wraca przed uruchomieniem jakiegokolwiek JavaScriptu.
Jak pomóc (lub zatrzymać) Baiduspidera
- Aby go wpuścić: linkuj do swoich ważnych stron, prześlij mapę witryny w Baidu Search
Resource Platform (odpowiednik Search Console Baidu) i nie blokuj przypadkiem
tych stron w
robots.txt. - Aby trzymać go z dala od części witryny: użyj
robots.txt— Baidu twierdzi, że przestrzega tam standardowych zasad. - Aby go spowolnić: Baidu Search Resource Platform ma obszar częstotliwości indeksowania, gdzie możesz zobaczyć i ograniczyć, ile Baiduspider indeksuje.
Chcesz wersję techniczną — dokładne ciągi user-agent, jak zweryfikować prawdziwego Baiduspidera, osobliwości robots.txt i kontrolę częstotliwości indeksowania? Przełącz się na zakładkę Advanced.
Evidence for this claim Baiduspider is Baidu Search's crawler and Baidu's Search Resource Platform is the authoritative place to verify current crawler guidance. Scope: Current official Baidu webmaster platform; user-agent text alone is not authentication. Confidence: medium · Verified: Baidu Search Resource Platform Evidence for this claim Crawler access directives use the standardized robots.txt protocol, but engine-specific support and verification should be checked against Baidu's current documentation. Scope: Robots Exclusion Protocol baseline, distinct from undocumented Baidu-specific behavior. Confidence: high · Verified: IETF RFC 9309: Robots Exclusion ProtocolTL;DR — Baiduspider to robot indeksujący Baidu — odpowiednik Googlebota na rynek chiński. Działa w nazwanych wariantach dzielących rodzinę tokenów
Baiduspider(ogólny PC/mobilny, plus-image,-video,-news,-favo,-cpro,-ads) oraz wariant JavaScriptBaiduspider-render, który Baidu dokumentuje tylko po chińsku. Zweryfikuj go przez dwukierunkowy DNS do*.baidu.com/*.baidu.jp— oficjalne FAQ Baidu ostrzega przed podszywającymi się. Baidu twierdzi, że “strictly complies with robots.txt protocol,” (tłumaczenie) „ściśle przestrzega protokołu robots.txt”, z nazwanym wyjątkiem:Baiduspider-cproiBaiduspider-adsdziałają na podstawie umów komercyjnych i mogą stosować inne zasady dostępu; nie dokumentuje też niestandardowegocrawl-delayjako niezawodnej kontroli. Ponieważ zachowanie renderowania może się zmieniać, serwerowo renderowany HTML jest konserwatywnym domyślnym wyborem dla krytycznych treści. Zweryfikuj aktualne kontrole w Baidu Search Resource Platform (Ziyuan).
Czym Baiduspider naprawdę jest
Baiduspider (百度蜘蛛) to robot indeksujący obsługiwany przez Baidu, wyszukiwarkę, która
dominuje w Chinach kontynentalnych, gdzie Google jest w dużej mierze niedostępny za
Wielkim Murem Chińskim. Jego zadaniem jest standardowy proces crawl → index → serve: odkrywanie
URL-i, pobieranie stron i budowanie indeksu, z którego korzysta Baidu Search. Oficjalne
angielskie FAQ Baidu, “FAQs of Baiduspider”
na help.baidu.com, to rzadki przykład podstawowej anglojęzycznej dokumentacji
w tym temacie i to z niego pochodzi większość bezpośrednich cytatów poniżej.
Asymetria, która wszystko ramuje: Baidu ma znaczenie na rynku krajowym, a nie globalnym. StatCounter w czerwcu 2026 r. dla Chin podał, że Baidu ma 47,44 %, Bing 23,24 %, Haosou 14,02 %, Sogou 2,62 %, a Google zaledwie 2,28 % (StatCounter, Search Engine Market Share China). Traktuj to jako migawkę, a nie stałą — liczby StatCounter dla Chin zmieniają się znacząco z miesiąca na miesiąc w zależności od miksu urządzeń i metodologii (Baidu był raportowany w zakresie od około 40 % do 65 % w różnych migawkach z lat 2025–2026), więc sprawdź aktualną wartość, zamiast cytować jeden miesiąc w nieskończoność. Wniosek pozostaje niezmienny: Baidu prowadzi wewnątrz Chin, podczas gdy Google prowadzi w pozostałej części świata, dlatego optymalizacja pod Baiduspider jest traktowana jako odrębna specjalizacja SEO międzynarodowego, a nie dodatek do Googlebota. Nasz hub SEO dla konkretnych rynków omawia, gdzie Baidu wpisuje się obok Yandex, Naver i innych regionalnych wyszukiwarek.
Ciągi user-agent i warianty robota
Angielskie FAQ Baidu wymienia warianty robota bezpośrednio. Cytowane dosłownie (i tak, własny tekst Baidu powtarza “Baiduspider” zarówno dla PC, jak i mobile, zamiast podawać odrębne ciągi):
Name of Products | User-agent PC search | Baiduspider Mobile search | Baiduspider Image search | Baiduspider-image Video search | Baiduspider-video News search | Baiduspider-news Baidu bookmark | Baiduspider-favo Union baidu | Baiduspider-cpro Business search | Baiduspider-ads other search | Baiduspider
Tak więc oficjalnie nazwane warianty w angielskim FAQ to Baiduspider-image,
-video, -news, -favo (zakładki), -cpro (robot sieci “union”/reklamowej)
oraz -ads (wyszukiwanie biznesowe) — wszystkie współdzielą token rodziny
Baiduspider. Dosłowny ogólny ciąg user-agent dla PC, podany na stronie Baidu, to:
Mozilla/5.0 (compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html)UA dla mobile zawiera Baiduspider/2.0 wewnątrz ciągu Android WebKit. Każdy
zadeklarowany wariant wskazuje na ten sam adres URL referencyjny http://www.baidu.com/search/spider.html
— odpowiednik google.com/bot.html dla Googlebota.
Baiduspider-render — wariant JS, który Baidu dokumentuje tylko po chińsku
Oto subtelność, którą warto dobrze zrozumieć, bo wiele artykułów się w niej myli:
tabela z angielskiego FAQ powyżej nie wymienia wariantu “Baiduspider-render”,
co skłoniło niektóre przewodniki do nazwania go jedynie folklorem osób trzecich. Tak nie jest. Baidu dokumentuje
Baiduspider-render oficjalnie — tylko na swojej chińskojęzycznej stronie Ziyuan Academy,
“【官方说法】只需两步,正确识别百度蜘蛛(User-Agent)”
(“[Oficjalne oświadczenie] Dwa kroki do prawidłowej identyfikacji Baiduspider”). Ta strona
dzieli UA na trzy kanały — 移动 (mobile), PC i 小程序 (mini-program) — i
wymienia alternatywny render UA obok zwykłego:
Mozilla/5.0 (compatible; Baiduspider-render/2.0; +http://www.baidu.com/search/spider.html)z pasującym ciągiem dla mobile i wariantem mini-program (Baiduspider-render/2.0;Smartapp).
Zatem Baiduspider-render jest oficjalnie udokumentowany — tylko po chińsku, nieobecny w
angielskim FAQ. Tego, co Baidu nie publikuje, to specyfikacja, czym “-render”
właściwie różni się w działaniu; w przeciwieństwie do Google, Baidu nie dokumentuje
swoich możliwości renderowania JavaScript. Ta luka jest źródłem poniższego zastrzeżenia dotyczącego renderowania JS.
Jak zweryfikować Baiduspider (a nie sfałszowanego bota)
Ciąg user-agent jest trywialnie podrabiany — każdy może wysłać żądanie, które mówi
Baiduspider. Własne FAQ Baidu ostrzega właśnie o tym, opisując “spammers or
other trouble makers who pretend to be Baiduspider,” i zaleca weryfikację
za pomocą DNS, a nie ciągu znaków. Z FAQ, dosłownie:
“We recommend using reverse DNS lookup to verify Baiduspider. Verification methods are different under linux/windows/os environments.” (tłumaczenie) „Zalecamy użycie odwrotnego wyszukiwania DNS do weryfikacji Baiduspidera. Metody weryfikacji różnią się w środowiskach Linux/Windows/OS.”
Podaje polecenia dla poszczególnych systemów — host w Linuxie, nslookup w Windows, dig -x w
macOS — z praktycznymi przykładami oraz zasadą, która ma znaczenie:
Zgodnie z FAQ Baidu nazwa hosta Baiduspidera to *.baidu.com lub *.baidu.jp; pozostałe nazwy hostów są fałszywe.
Dwie domeny *.baidu.com oraz *.baidu.jp to osobliwość, o której należy pamiętać —
Baidu indeksuje zarówno z przestrzeni odwrotnego DNS .com, jak i .jp, więc prawidłowa
nazwa hosta Baiduspider może kończyć się na którąkolwiek z nich. (Jeden z własnych przykładów Baidu
nawet rozwiązuje się na BaiduMobaider-119-63-195-254.crawl.baidu.jp — zwróć uwagę na “BaiduMobaider,”
nie “Baiduspider” w tej nazwie hosta; to prawdziwa osobliwość w dokumentacji Baidu,
nie literówka do cichej poprawy.)
Angielskie FAQ Baidu w swojej prozie opisuje tylko połowę dotyczącą odwrotnego wyszukiwania, ale
chińska strona Ziyuan Academy jest bardziej jednoznaczna: nazywa cały proces
“双向DNS解析认证” (dwukierunkowe uwierzytelnianie przez DNS) i dzieli go na
“第一步:DNS反查IP” (Krok 1: odwrotne wyszukiwanie IP) oraz “第二步:对域名运行正向DNS查找”
(Krok 2: wykonaj bezpośrednie wyszukiwanie DNS dla nazwy hosta). To kompletna, poprawna
metoda — odwrotnie wyszukaj IP, aby potwierdzić nazwę hosta *.baidu.com/*.baidu.jp,
następnie wykonaj bezpośrednie wyszukiwanie tej nazwy hosta i potwierdź, że rozwiązuje się z powrotem na to samo IP.
To to samo dwuetapowe podejście, którego użyłbyś do weryfikacji
Googlebot lub
Bingbot — polecenia znajdują się w
zakładce Scripts.
Baiduspider i robots.txt
Baidu składa niezwykle mocne, cytowalne oświadczenie o zgodności we własnym FAQ:
“Baidu strictly complies with robots.txt protocol.” (tłumaczenie) „Baidu ściśle przestrzega protokołu robots.txt.”
Obsługuje też standardowe mechanizmy kontroli, których można się spodziewać. Według materiałów Ziyuan Academy
Baiduspider obsługuje dopasowanie wieloznaczne z * i $ w ścieżkach robots.txt
(na równi z Google i Bing) oraz wykonuje dokładne, uwzględniające wielkość liter dopasowanie
ścieżek. Można ustawić reguły per user-agent — FAQ Baidu podaje praktyczne przykłady,
w tym ten, który blokuje wszystko dla ogólnego Baiduspider, ale pozwala indeksatorowi obrazów na dostęp do /image/:
User-agent: Baiduspider
Disallow: /
User-agent: Baiduspider-image
Allow: /image/(Baidu zauważa również, że Baiduspider-video obecnie nie obsługuje tych reguł.)
Nazwany wyjątek od “ścisłej zgodności”
Interesujące napięcie: Baidu twierdzi, że ściśle przestrzega zasad, ale dokumentuje nazwany,
oficjalny wyjątek. Baiduspider-cpro (indeksator sieci reklamowej) i
Baiduspider-ads (wyszukiwarka biznesowa) działają na podstawie odrębnych umów handlowych i
celowo ignorują robots.txt. Dosłownie z FAQ: “Baiduspider-cpro will not
work on the records set by robots.txt” (tłumaczenie) „Baiduspider-cpro nie działa na
rekordach ustawionych przez robots.txt” — to samo dotyczy -ads. Zatem uczciwe ujęcie
nie jest niejasnym “Baidu nie zawsze respektuje robots.txt”, które można zobaczyć na stronach agregatorów
— chodzi o to, że standardowe indeksatory Baidu przestrzegają zasad, z dwoma wyłączonymi umownie
indeksatorami reklamowymi jako jedynym konkretnym, udokumentowanym wyjątkiem.
Osobny, węższy punkt, który łatwo pomylić: Baiduspider nie honoruje
niestandardowej dyrektywy crawl-delay. Abby Hamilton z Search Engine Journal udokumentowała to w The Modern Guide To Robots.txt
(listopad 2024) — jej tabela porównawcza indeksatorów wymienia “Baidu | Baiduspider | No” dla
obsługi crawl-delay (YandexBot od Yandex, w przeciwieństwie do tego, ma “Yes”). To
inne twierdzenie niż standardowa zgodność z Allow/Disallow i warto je
rozróżniać, aby przypadkiem nie zaprzeczyć własnemu oświadczeniu Baidu o robots.txt.
Prawdziwy przykład: robots.txt samego baidu.com
Baidu praktykuje segmentację robots.txt na własnej domenie. Jego aktywny
robots.txt daje własnemu Baiduspiderowi
krótszą listę zakazów niż Googlebotowi, MSNBotowi, Sogou i Youdao (które
dodatkowo mają zablokowane /shifen/, /homepage/ i /cpro), a dla każdego
nienazwanego user-agenta domyślnie blokuje wszystko (Disallow: /):
User-agent: Baiduspider
Disallow: /baidu
Disallow: /s?
Disallow: /ulink?
Disallow: /link?
Disallow: /home/news/data/
Disallow: /bhJeden szczegół operacyjny z FAQ, który warto znać podczas edytowania reguł: jeśli zaostrzysz robots.txt po tym, jak Baidu już zaindeksowało witrynę, “it usually takes 48 hours for the updated robots.txt to take effect.” (tłumaczenie) „zazwyczaj potrzeba 48 godzin, aby zaktualizowany robots.txt zaczął obowiązywać.”
Czy Baiduspider renderuje JavaScript?
To największe praktyczne ograniczenie Baiduspidera w porównaniu z Googlebotem i warto być precyzyjnym co do tego, co jest oficjalne, a co nie. Angielskie FAQ Baidu w ogóle nie porusza renderowania JavaScript — nie ma specyfikacji możliwości takiej, jaką Google publikuje dla Googlebota. Zamiast tego mamy spójne testy branżowe. Dan Taylor ujął to wprost w porównaniu Google vs Baidu w Search Engine Journal Google vs Baidu comparison (marzec 2021): “Baidu is notoriously bad when it comes to crawling JavaScript, so make sure that all your important content and links are served in plain HTML on both the mobile and desktop versions of your website.” (tłumaczenie) „Baidu jest notorycznie słabe w indeksowaniu JavaScript, więc upewnij się, że wszystkie ważne treści i linki są serwowane w czystym HTML zarówno na wersji mobilnej, jak i desktopowej Twojej witryny.”
To jest zgodne ze stanowiskiem, które ta witryna już przyjmuje. Nasze contentful SEO omówienie zauważa, że Bing, Yandex i Baidu “may not index [client-side-rendered JS] at all,” (tłumaczenie) „mogą w ogóle nie indeksować JavaScriptu renderowanego po stronie klienta”, i że dynamiczne renderowanie jest zdeprecjonowane jako ogólna technika Google. Umieść te trzy duże roboty na spektrum: Googlebot wykonuje pełne renderowanie evergreen-Chromium, Bingbot wykonuje solidne renderowanie Chromium/Edge, a Baiduspider jest najsłabszy z trzech w JavaScript — przy czym zwykły, serwerowo renderowany HTML jest uniwersalnie bezpiecznym rozwiązaniem awaryjnym dla wszystkich.
Praktyczna wskazówka dla witryny skierowanej do Chin: domyślnie wybierz renderowanie po stronie serwera lub statyczny HTML, aby krytyczne treści, linki i metadane znajdowały się w początkowej odpowiedzi przed uruchomieniem jakiegokolwiek JavaScript. Traktuj treści dostępne tylko po stronie klienta jako ryzyko indeksowania specyficznie dla Baidu, niezależnie od tego, czy dobrze pozycjonują się w Google. Przedstaw SSR jako branżową najlepszą praktykę — nie jako oficjalną rekomendację Baidu, ponieważ nie istnieje żadne podstawowe oświadczenie Baidu na temat renderowania JS, na które można się powołać.
Kontrolowanie częstotliwości indeksowania Baiduspidera
Baidu przedstawia częstotliwość indeksowania jako algorytmicznie samoregulującą się, a nie coś, co ustawiasz bezpośrednio. Z FAQ, dosłownie:
“In order to ensure the search results cover most of your pages, Baiduspider must keep the crawling at a certain level. We have been trying our best to avoid increasing the loading to your servers, and to adjust the frequency based on combined factors, such as your server’s capability, your site’s quality and the update frequency of your site.” (tłumaczenie) „Aby wyniki wyszukiwania obejmowały większość Twoich stron, Baiduspider musi utrzymywać indeksowanie na określonym poziomie. Dokładamy wszelkich starań, aby nie zwiększać obciążenia serwerów oraz dostosowywać częstotliwość na podstawie połączonych czynników, takich jak wydajność serwera, jakość witryny i częstotliwość jej aktualizacji.”
To ta sama logika pojemności serwera plus zapotrzebowania, którą opisują Google i Bing. FAQ
wymienia formularz opinii (webmaster.baidu.com/feedback/index) jako oficjalną
dźwignię do zgłaszania nadmiernego indeksowania — “If you find any unreasonable access from
Baiduspider, please inform us.” (tłumaczenie) „Jeśli zauważysz jakikolwiek nietypowy dostęp od Baiduspidera, poinformuj nas.”
Na poziomie produktu, Baidu Search Resource Platform (百度搜索资源平台, na
ziyuan.baidu.com — konsola historycznie nazywana “Baidu Webmaster Tools”) jest
odpowiednikiem Google Search Console i Bing Webmaster Tools w Baidu. Jej ręczne
indeksowanie potwierdza obszar produktu “抓取频次” (Crawl Frequency), w którym właściciele witryn
mogą bezpośrednio przeglądać i ograniczać szybkość indeksowania Baiduspidera, wraz z narzędziami do robots i diagnostyki indeksowania.
Traktuj formularz opinii jako oficjalną ścieżkę eskalacji w angielskiej dokumentacji Baidu,
a pulpit nawigacyjny Ziyuan Crawl Frequency jako praktyczną kontrolę na poziomie interfejsu.
(Dokładna ścieżka menu w produkcie znajduje się za zalogowanym kontem Ziyuan, więc potwierdź
bieżący interfejs tam przed cytowaniem konkretnych kroków.)
hreflang i inne sygnały standardowe Google
Sygnały standardowe dla Google nie wszystkie przenoszą się na Baidu — a to jest
wniosek branżowy/praktyczny, a nie coś, co dokumentują obie firmy. Dokumentacja
Google dotycząca wersji zlokalizowanych
jest ograniczona wyłącznie do wyszukiwarki Google i nie twierdzi, czy Baidu, Bing czy
Yandex honorują hreflang. Na tej stronie nasz przewodnik po hreflang
stwierdza to wprost: Baidu w ogóle nie obsługuje hreflang — rozwiązaniem zastępczym
jest ustawienie dokładnego content-language i <html lang>, aby Baidu mogło przynajmniej
odczytać język strony. To jest uzupełnienie mojej własnej pracy nad hreflang w kontekście Google (przewodnik Ahrefs
po tagach hreflang oraz
badanie 374 756 domen, z których oba
omawiają wyłącznie implementację Google), a nie jej zaprzeczenie.
Brak kultury anglojęzycznych przedstawicieli — dlaczego FAQ jest wyjątkowo cenne
Jedna rzecz, która naprawdę wyróżnia ekosystem Baidu: w przeciwieństwie do Google (Gary Illyes,
John Mueller), Bing (Fabrice Canel) czy Yandex, Baidu nie utrzymuje widocznej
anglojęzycznej kultury pytań i odpowiedzi publicznych przedstawicieli. Nie ma nazwanego rzecznika prowadzącego
wymianę zdań ze społecznością SEO. Najwyraźniejszym oficjalnym anglojęzycznym głosem Baidu jest niepodpisane,
instytucjonalne FAQ na help.baidu.com. Dlatego właśnie to FAQ — oraz chińskojęzyczne
strony Akademii Ziyuan za nim — są tak cenne: większość praktycznej wiedzy o
Baiduspider w anglojęzycznym świecie SEO pochodzi z testów praktyków
(analiza logów serwera, ćwiczenia weryfikacji DNS, próby i błędy z robots.txt), a nie
z oficjalnych komentarzy przedstawicieli. Michael Bonfils podsumował szerszą lekcję w
Search Engine Land Baidu vs. Google:
“SEO strategies that work for Google may not always translate directly to success on
Baidu, China’s dominant search engine.” (tłumaczenie) „Strategie SEO, które działają w Google, nie zawsze przekładają się bezpośrednio na sukces w Baidu, dominującej wyszukiwarce Chin.”
Aby zobaczyć, gdzie Baiduspider wpisuje się w szerszy obraz — rodzinę robotów indeksujących, Googlebota i Bingbota jako odpowiedniki, koncepcję user-agenta oraz robots.txt — centrum crawlingu spaja to wszystko, a SEO międzynarodowe jest miejscem dla kontekstu rynku chińskiego.
Podsumowanie AI
Skrócona wersja wersji Advanced:
- Baiduspider = robot indeksujący Baidu — odpowiednik Googlebota na rynek chiński. Baidu dominuje wewnątrz Chin kontynentalnych (StatCounter czerwiec 2026: Baidu ~47 %, Google ~2 %), więc to specjalność międzynarodowego SEO, a nie dodatek do Googlebota. Ten udział zmienia się z miesiąca na miesiąc — traktuj go jako migawkę.
- Warianty należą do tej samej rodziny tokenów
Baiduspider: ogólny PC/mobilny oraz-image,-video,-news,-favo(zakładki),-cpro(sieć reklamowa),-ads(biznesowy). Ogólny UA dla PC:Mozilla/5.0 (compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html). Baiduspider-renderjest oficjalnie udokumentowany — ale tylko na chińskojęzycznej stronie Akademii Ziyuan Baidu, brak go w angielskim FAQ. Czym dokładnie różni się „-render” — nie jest to określone.- Weryfikacja przez dwukierunkowy DNS do
*.baidu.comlub*.baidu.jp(Baidu indeksuje z obu): odwrotne wyszukiwanie IP, a następnie sprawdzenie, czy nazwa hosta prowadzi z powrotem do tego samego IP. User-agent można sfałszować; Baidu ostrzega przed oszustami. - robots.txt: Baidu twierdzi, że „ściśle przestrzega”, obsługuje symbole wieloznaczne
*/$i dopasowywanie z uwzględnieniem wielkości liter — z wymienionym wyjątkiem:Baiduspider-cproiBaiduspider-adsdziałają na podstawie umów komercyjnych i ignorują robots.txt. Osobno Baiduspider nie honoruje niestandardowegocrawl-delay(według Abby Hamilton z SEJ). Zmiany zasad zaczynają obowiązywać po około 48 godzinach. - JavaScript to największa luka w porównaniu z Googlebotem — brak oficjalnej specyfikacji możliwości; konsensus branżowy (Dan Taylor: „notorycznie słaby… w indeksowaniu JavaScript”) jest taki, że renderowanie po stronie serwera/statyczny HTML to bezpieczna domyślna opcja dla stron kierowanych na Chiny.
- Częstotliwość indeksowania jest algorytmiczna (możliwości serwera + jakość witryny + częstotliwość aktualizacji); zgłaszaj nadmierne indeksowanie przez formularz opinii Baidu, a wskaźnik przeglądaj/ograniczaj w Baidu Search Resource Platform (Ziyuan) — odpowiednik Search Console Baidu.
- Baidu nie obsługuje hreflang (ustalenie branżowe; żadna z firm tego nie dokumentuje
w żaden sposób) — użyj zamiast tego
content-language/<html lang>. - Brak kultury wsparcia po angielsku: najjaśniejszym oficjalnym angielskim głosem Baidu jest niepodpisane FAQ, więc wiedza operacyjna pochodzi głównie z testów praktyków.
Oficjalna dokumentacja
Dokumentacja źródłowa. Dokumentacja Baidu jest podzielona na angielskie FAQ i chińskojęzyczne strony Ziyuan (Baidu Search Resource Platform); linki do Google służą porównaniu w kontekście hreflang.
Baidu
- FAQ Baiduspidera (help.baidu.com) — oficjalne angielskie FAQ Baidu: czym jest Baiduspider, tabela user-agentów, polityka częstotliwości indeksowania, weryfikacja DNS z przykładami oraz obsługa robots.txt. Główne źródło w języku angielskim.
- 【官方说法】只需两步,正确识别百度蜘蛛(User-Agent)(ziyuan.baidu.com) — chińskojęzyczny oficjalny artykuł Baidu o identyfikacji Baiduspider: trzy kanały UA (mobilny/PC/mini-program), UA
Baiduspider-renderoraz metoda „dwukierunkowego uwierzytelniania DNS” opisana w całości. - Indeks podręcznika Baidu Search Resource Platform (ziyuan.baidu.com) — indeks podręcznika produktu Ziyuan potwierdzający obszary narzędzi 抓取频次 (Częstotliwość indeksowania), robots oraz 抓取诊断 (Diagnostyka indeksowania).
- baidu.com/robots.txt — aktualny robots.txt Baidu, prawdziwy przykład segmentacji według poszczególnych robotów.
Google (dla porównania w kontekście hreflang)
- Informowanie Google o zlokalizowanych wersjach strony — dokumentacja hreflang Google, ograniczona wyłącznie do Google Search; zauważalnie nie wspomina, czy Baidu, Bing lub Yandex honorują hreflang.
Cytaty ze źródła
Baidu nie utrzymuje żadnego nazwanego rzecznika prasowego mówiącego po angielsku, więc „źródłem” jest tutaj własne, niepodpisane FAQ Baidu, a także nazwane komentarze branżowe, które zastępują cytaty rzeczników, jakie można by uzyskać od Google czy Bing. Każdy link to link bezpośredni, który przeskakuje do cytowanego fragmentu.
Baidu — „FAQs of Baiduspider” (help.baidu.com, angielski)
- “Baiduspider is Baidu search engine program which is used to visit pages on the internet and build information into Baidu index. This enables users to locate your site when they perform a search.” (tłumaczenie) „Baiduspider to program wyszukiwarki Baidu, który służy do odwiedzania stron w internecie i gromadzenia informacji w indeksie Baidu. Dzięki temu użytkownicy mogą znaleźć Twoją witrynę podczas wyszukiwania.” Przejdź do cytatu
- “In order to ensure the search results cover most of your pages, Baiduspider must keep the crawling at a certain level… to adjust the frequency based on combined factors, such as your server’s capability, your site’s quality and the update frequency of your site.” (tłumaczenie) „Aby wyniki wyszukiwania obejmowały większość Twoich stron, Baiduspider musi utrzymywać indeksowanie na określonym poziomie… aby dostosować częstotliwość na podstawie połączonych czynników, takich jak wydajność Twojego serwera, jakość Twojej witryny i częstotliwość jej aktualizacji.” Przejdź do cytatu
- “We recommend using reverse DNS lookup to verify Baiduspider.” (tłumaczenie) „Zalecamy użycie odwrotnego wyszukiwania DNS w celu weryfikacji Baiduspider.” Przejdź do cytatu
- *“The hostname of Baiduspider is *.baidu.com or .baidu.jp. Others are fake hostnames.” (tłumaczenie) „Nazwa hosta Baiduspider to *.baidu.com lub *.baidu.jp. Inne są fałszywymi nazwami hostów.” Przejdź do cytatu
- “Baidu strictly complies with robots.txt protocol.” (tłumaczenie) „Baidu ściśle przestrzega protokołu robots.txt.” Przejdź do cytatu
Baidu — Ziyuan Academy (ziyuan.baidu.com, chiński)
- Oryginał: “二、双向DNS解析认证” — angielska parafraza: „Krok drugi: dwukierunkowe uwierzytelnianie przez rozwiązywanie DNS”, własna nazwa Baidu na weryfikację Baiduspidera poprzez odwrotne wyszukiwanie, a następnie wyszukiwanie w przód z powrotem do tego samego adresu IP. Zobacz stronę
Dan Taylor, Search Engine Journal — o JavaScript
- “Baidu is notoriously bad when it comes to crawling JavaScript, so make sure that all your important content and links are served in plain HTML on both the mobile and desktop versions of your website.” (tłumaczenie) „Baidu jest notorycznie słaby w indeksowaniu JavaScript, więc upewnij się, że wszystkie ważne treści i linki są serwowane w czystym HTML zarówno w wersji mobilnej, jak i desktopowej Twojej witryny.” (marzec 2021.) Przejdź do cytatu
Michael Bonfils, Search Engine Land — o przenoszeniu strategii
- “SEO strategies that work for Google may not always translate directly to success on Baidu, China’s dominant search engine.” (tłumaczenie) „Strategie SEO, które działają w Google, nie zawsze przekładają się bezpośrednio na sukces w Baidu, dominującej wyszukiwarce Chin.” Przejdź do cytatu
Abby Hamilton, Search Engine Journal — o crawl-delay
- Jej tabela porównawcza robotów indeksujących wymienia Baiduspider jako nieobsługującego niestandardowej dyrektywy
crawl-delay(„Baidu | Baiduspider | Nie”). (listopad 2024.) Przeczytaj artykuł
help.baidu.com jest częściowo renderowane przez JavaScript, a strona Ziyuan Academy jest tylko po chińsku; powyższe angielskie cytaty zostały potwierdzone jako dokładne podciągi żywych stron, ale przed potraktowaniem ich jako ostatecznych zweryfikuj je na żywych stronach (i użyj przeglądarki dla źródeł renderowanych przez JS/po chińsku). Czy powinienem pozwolić Baiduspiderowi indeksować moją witrynę — i jak to obsłużyć?
Baiduspider jest wart zachodu tylko wtedy, gdy faktycznie chcesz widoczności na rynku chińskim. Kliknij, aby przejść dalej.
Deciding what to do about Baiduspider
Zweryfikuj, czy bot to naprawdę Baiduspider
Własne FAQ Baidu zaleca odwrotne DNS w celu weryfikacji Baiduspider, ponieważ
ciąg user-agent jest trywialnie podrabiany. Wykonaj pełną dwukierunkową kontrolę, którą Baidu
wymienia na swojej chińskiej stronie Ziyuan: odwrotne wyszukiwanie IP (nazwa hosta musi kończyć się na
*.baidu.com lub *.baidu.jp), a następnie bezpośrednie wyszukiwanie tej nazwy hosta z powrotem na
to samo IP.
macOS / Linux
# 1) Reverse-DNS the IP from your logs — it must end in baidu.com or baidu.jp
host 123.125.66.120
# → 120.66.125.123.in-addr.arpa domain name pointer Baiduspider-123-125-66-120.crawl.baidu.com
# 2) Forward-DNS that hostname back — it must resolve to the same IP
host Baiduspider-123-125-66-120.crawl.baidu.com
# → Baiduspider-123-125-66-120.crawl.baidu.com has address 123.125.66.120Forma dig w macOS (jak podaje FAQ Baidu):
dig -x 123.125.66.120Windows
nslookup 123.125.66.120
nslookup Baiduspider-123-125-66-120.crawl.baidu.comJeśli odwrotne wyszukiwanie nie kończy się na baidu.com lub baidu.jp, albo bezpośrednie wyszukiwanie
nie zwraca oryginalnego IP, to nie jest Baiduspider — odrzuć je lub ogranicz jego szybkość. (Ta sama
dwuetapowa metoda co przy weryfikacji Googlebot i Bingbot; zobacz karty Scripts w tych artykułach,
aby poznać wersje dla Google/Bing.)
Wyciągnij tylko trafienia Baiduspider z logów serwera
Pobierz kandydackie linie Baiduspider z logu dostępu, a następnie zweryfikuj każde IP za pomocą kontroli DNS powyżej — nie ufaj samemu ciągowi.
# Extract lines whose user-agent claims to be Baiduspider, print unique IPs
grep -i 'baiduspider' /var/log/nginx/access.log \
| awk '{print $1}' | sort -uDopasuj nazwę hosta do dozwolonych domen Baidu (regex)
Gdy już odwrotnie rozwiążesz nazwę hosta, ten regex potwierdza, że znajduje się ona w jednej z dwóch
legalnych przestrzeni nazw crawlerów Baidu (.baidu.com lub .baidu.jp), a nie w podobnej do nich:
# Passes only for hostnames ending in .baidu.com or .baidu.jp
echo "Baiduspider-123-125-66-120.crawl.baidu.com" \
| grep -Eiq '\.baidu\.(com|jp)$' && echo "legit namespace" || echo "FAKE"Uważaj na podobne nazwy, jak baidu.com.evil.example — zakotwiczenie wzorca na końcu
ciągu ($) to właśnie to, co uniemożliwia ich przejście.
Punkt startowy robots.txt dla Baiduspider
# Let Baiduspider crawl everything except low-value spaces
User-agent: Baiduspider
Disallow: /search
Disallow: /*?*sort=
# Block Baiduspider entirely (China not a target market)
# User-agent: Baiduspider
# Disallow: /Pamiętaj: Disallow kontroluje indeksowanie, a nie crawling, a zmiany zasad zaczynają obowiązywać po około 48
godzinach. Crawlery reklamowe Baiduspider-cpro i Baiduspider-ads
ignorują robots.txt z założenia.
Baiduspider — ściągawka
Ciągi user-agent i warianty crawlerów
| Wariant | token robots.txt | User-agent |
|---|---|---|
| Ogólny (PC + mobile) | Baiduspider | Mozilla/5.0 (compatible; Baiduspider/2.0; +http://www.baidu.com/search/spider.html) |
| Wyszukiwanie obrazów | Baiduspider-image | Współdzieli token rodziny Baiduspider, sufiks -image |
| Wyszukiwanie wideo | Baiduspider-video | Sufiks -video (obecnie nie obsługuje reguł robots.txt per-agent) |
| Wyszukiwanie wiadomości | Baiduspider-news | Sufiks -news |
| Zakładki Baidu | Baiduspider-favo | Sufiks -favo |
| Union baidu (sieć reklamowa) | Baiduspider-cpro | Sufiks -cpro — ignoruje robots.txt na mocy umowy handlowej |
| Wyszukiwanie biznesowe | Baiduspider-ads | Sufiks -ads — ignoruje robots.txt na mocy umowy handlowej |
| Render (wariant JS) | — | Mozilla/5.0 (compatible; Baiduspider-render/2.0; +http://www.baidu.com/search/spider.html) — udokumentowany tylko na chińskojęzycznej stronie Ziyuan Academy Baidu, nieobecny w angielskim FAQ |
UA każdego zadeklarowanego wariantu wskazuje ten sam adres referencyjny,
http://www.baidu.com/search/spider.html — odpowiednik Baiduspider dla
google.com/bot.html Googlebota.
Zgodność z robots.txt w skrócie
| Crawler | Przestrzega robots.txt? |
|---|---|
Ogólny Baiduspider, -image, -video, -news, -favo | Tak — FAQ Baidu stwierdza “Baidu strictly complies with robots.txt protocol” (tłumaczenie) „Baidu ściśle przestrzega protokołu robots.txt” |
Baiduspider-cpro | Nie — nazwany, udokumentowany wyjątek (umowa handlowa) |
Baiduspider-ads | Nie — nazwany, udokumentowany wyjątek (umowa handlowa) |
Niestandardowa dyrektywa crawl-delay | Nie honorowana przez żaden wariant Baiduspider, według Abby Hamilton z Search Engine Journal |
Szybkie fakty
- Weryfikacja przez dwukierunkowy DNS: odwrotne wyszukiwanie adresu IP pełzającego robota w celu potwierdzenia nazwy hosta kończącej się na
*.baidu.comlub*.baidu.jp, a następnie wyszukiwanie w przód tej nazwy hosta z powrotem do tego samego adresu IP. Sam ciąg user-agent niczego nie dowodzi. - Zmiany w robots.txt zaczynają obowiązywać po około 48 godzinach na już zaindeksowanej stronie.
- Baidu obsługuje dopasowanie symboli wieloznacznych
*i$w ścieżkach robots.txt oraz dokonuje dokładnego, uwzględniającego wielkość liter dopasowania ścieżek. - Częstotliwość pełzania jest algorytmicznie samoregulująca się (wydajność serwera, jakość strony, częstotliwość aktualizacji) — możesz ją przeglądać i ograniczać w Baidu Search Resource Platform (Ziyuan).
- Największą praktyczną luką Baiduspidera w porównaniu z Googlebotem jest słabe renderowanie JavaScript — HTML renderowany po stronie serwera lub statyczny jest bezpiecznym domyślnym rozwiązaniem dla treści skierowanych do Chin.
- Baidu nie obsługuje hreflang — sygnałem zastępczym jest dokładny
content-languagei<html lang>.
Lista kontrolna gotowości Baiduspidera
Szybkie sprawdzenie, aby potwierdzić, że pracujesz z Baiduspiderem, a nie przypadkowo przeciwko niemu — te same zagadnienia co w zakładce Zaawansowane, w formie listy kontrolnej.
- robots.txt nie blokuje
Baiduspider(ani wariantu, który Cię interesuje) przed niczym, co ma być znajdowane w wynikach wyszukiwania Baidu. - Mapa witryny została przesłana w Baidu Search Resource Platform (Ziyuan).
- Weryfikacja bota używa dwukierunkowego DNS — odwrotne wyszukiwanie do
*.baidu.com/*.baidu.jp, a następnie wyszukiwanie w przód potwierdzające ten sam adres IP — nigdy tylko ciąg user-agent. - Świadomość, że
Baiduspider-cproiBaiduspider-adscelowo ignorują robots.txt, więc blokowanie ich tam faktycznie ich nie zatrzyma. - Wszelkie niedawne zaostrzenia robots.txt miały około 48 godzin na propagację przed ponownym sprawdzeniem statusu indeksowania.
- Krytyczne treści, linki wewnętrzne i metadane istnieją w odpowiedzi HTML renderowanej po stronie serwera — nie są wstrzykiwane tylko przez JavaScript po stronie klienta.
-
content-languagei<html lang>są ustawione poprawnie, ponieważ Baidu nie obsługuje hreflang. - Obciążenie pełzaniem zostało sprawdzone w obszarze Częstotliwość pełzania (抓取频次) w Ziyuan, jeśli ruch Baiduspidera obciąża serwer.
- Nierozsądne lub nadmierne pełzanie zostało zgłoszone przez formularz opinii Baidu (
webmaster.baidu.com/feedback/index), a nie zgadywane lub blokowane w całości. - Brak trwałego polegania na Baidu MIP — framework został wycofany (Cache wycofany w czerwcu 2020, pełna usługa zakończona pod koniec września 2022).
Narzędzia do pracy z Baiduspiderem
- DNS Checker — moje własne narzędzie do dwukierunkowego
sprawdzenia DNS, które zaleca oficjalne FAQ Baidu. Wpisz adres IP pełzającego robota z typem rekordu
PTR, aby wykonać odwrotne wyszukiwanie (prawdziwa nazwa hosta Baiduspidera kończy się na
.baidu.comlub.baidu.jp), a następnie wpisz tę nazwę hosta z typem rekordu A, aby potwierdzić, że wyszukiwanie w przód rozwiązuje się z powrotem do tego samego adresu IP. Narzędzie odpytuje Cloudflare, Google i Quad9 obok siebie, abyś mógł zauważyć rozbieżności w resolverze. - robots.txt Tester — moje własne narzędzie do sprawdzania,
czy Twoje reguły robots.txt faktycznie blokują lub zezwalają Baiduspiderowi tak, jak zamierzasz.
Wklej swój plik, wpisz
Baiduspider(lubBaiduspider-image,Baiduspider-newsitp.) w polu niestandardowego user-agenta i przetestuj go przeciwko prawdziwym ścieżkom — pokaże dokładną regułę, która wygrywa dla każdego adresu URL. Pamiętaj, żeBaiduspider-cproiBaiduspider-adsignorują robots.txt niezależnie od tego, co pokaże tester, ponieważ działają na podstawie oddzielnych umów komercyjnych.
Mity i błędy dotyczące Baiduspidera, których należy unikać
Mit: „Każdy user-agent zawierający ‘Baiduspider’ to naprawdę Baidu.”
Dlaczego to błędne: ciąg user-agent jest trywialnie podrabiany, a oficjalne FAQ Baidu ostrzega
przed “spammers or other trouble makers who pretend to be Baiduspider.”
Zamiast tego: wykonaj dwukierunkowe sprawdzenie DNS — odwrotne wyszukiwanie do
nazwy hosta *.baidu.com/*.baidu.jp, a następnie wyszukiwanie w przód z powrotem do tego samego adresu IP — zanim
zaufasz (lub zablokujesz na podstawie) jakiemukolwiek trafieniu „Baiduspider”.
Mit: „Baidu nigdy nie przestrzega robots.txt lub generalnie jest w tej kwestii zawodny.”
Dlaczego to nieprawda: FAQ Baidu stwierdza, że „Baidu ściśle przestrzega protokołu robots.txt” w przypadku swoich standardowych robotów indeksujących. Prawdziwy wyjątek jest wąski i nazwany — Baiduspider-cpro i Baiduspider-ads działają na podstawie umów komercyjnych i ignorują robots.txt — a nie niejasne „Baidu ignoruje robots.”
Zamiast tego: powołaj się na konkretny wyjątek cpro/ads i nie myl go z osobnym faktem, że Baiduspider nie honoruje niestandardowej dyrektywy crawl-delay.
Mit: „Baiduspider renderuje JavaScript mniej więcej tak dobrze jak nowoczesny Googlebot.” Dlaczego to nieprawda: konsensus branżowy (Dan Taylor nazwał to „notorycznie słabym… indeksowaniem JavaScript”) jest taki, że Baiduspider znacznie odstaje od wiecznie aktualnego Chromium Googlebota; treści dostępne tylko po stronie klienta to realne ryzyko indeksowania w Baidu, nawet jeśli dobrze pozycjonują się w Google. Zamiast tego: serwuj ważne treści, linki i metadane w HTML renderowanym po stronie serwera lub statycznym dla stron kierowanych na Chiny — to bezpieczna domyślna opcja zarówno dla Googlebota, Bingbota, jak i Baiduspidera.
Mit: „hreflang działa w Baidu tak samo jak w Google.”
Dlaczego to nieprawda: Baidu w ogóle nie obsługuje hreflang (ustalenie branżowe — dokumentacja Google nie komentuje innych wyszukiwarek).
Zamiast tego: użyj dokładnych atrybutów content-language i <html lang>, aby Baidu mógł przynajmniej odczytać język strony; nie polegaj na hreflang, aby kierować Baidu.
Mit: „Baiduspider-render” nie jest oficjalnie udokumentowanym wariantem.”
Dlaczego to nieprawda: angielska tabela FAQ Baidu go nie wymienia, ale chińskojęzyczna strona Ziyuan Academy dokumentuje Baiduspider-render/2.0 jako alternatywny UA dla PC/mobile oraz wariant dla mini-programów. To oficjalne — tylko po chińsku.
Zamiast tego: opisz go jako oficjalnie udokumentowany (tylko po chińsku), zaznaczając, że Baidu nie publikuje specyfikacji, czym dokładnie różni się „-render”.
Mit: „Baidu MIP to wciąż aktywna, zalecana dźwignia rankingowa.” Dlaczego to nieprawda: framework MIP (Mobile Instant Pages) Baidu, podobny do AMP, jest przestarzały. Według glosariusza MIP od Jademond pamięć podręczna MIP została wycofana w czerwcu 2020, a pełna usługa MIP została zakończona do końca września 2022 — a mimo to niektóre aktualne treści agencyjne nadal promują ją jako działającą, co samo w sobie jest źródłem zamieszania. Zamiast tego: traktuj MIP jako wycofany i podchodź sceptycznie do każdego nowego przewodnika, który przedstawia go jako aktywną dźwignię szybkości/rankingu.
Sprawdź się: Baiduspider
Pięć szybkich pytań o robocie indeksującym Baidu. Wybierz odpowiedź na każde, a potem sprawdź.
Zasoby warte Twojego czasu
Moje powiązane teksty
- Hreflang Tags: A Simple (But Complete) Guide — mój przewodnik na Ahrefs (z Joshuą Hardwickiem) o hreflang; skupiony na Google i kontekst dla tego, dlaczego brak wsparcia hreflang w Baidu to osobna kwestia.
- Over 67% of Domains Using Hreflang Have Issues — badanie mojego zespołu na 374 756 domenach; skupione na implementacji Google, przydatne jako kontrast do braku wsparcia w Baidu.
- The Beginner’s Guide to Technical SEO — gdzie roboty indeksujące i sygnały międzynarodowe wpisują się w szerszy obraz.
Moje wystąpienia
- Międzynarodowe SEO: dziwne techniczne przypadki (Pubcon Vegas 2019, SlideShare) — moja prelekcja o technicznych przypadkach brzegowych międzynarodowego SEO, czyli obszarze, w którym osadzona jest praca nad rynkiem Baidu.
Z branży
- FAQ Baiduspidera (Baidu, help.baidu.com) — oficjalne angielskie FAQ Baidu: tabela UA, weryfikacja DNS, obsługa robots.txt i polityka częstotliwości indeksowania. Główne angielskie źródło.
- Google a Baidu: kluczowe różnice w strategii SEO (Dan Taylor, Search Engine Journal) — ocena „notorycznie słabego indeksowania JavaScriptu” i zalecenie czystego HTML.
- Baidu a Google: poruszanie się po krajobrazie SEO w 2024 roku (Michael Bonfils, Search Engine Land) — spojrzenie założyciela agencji na to, dlaczego taktyki Google nie przenoszą się bezpośrednio na Baidu.
- Nowoczesny przewodnik po robots.txt (Abby Hamilton, Search Engine Journal) — tabela porównawcza crawlerów pokazująca, że Baiduspider nie honoruje
crawl-delay. - Przewodnik po robotach indeksujących: co musisz wiedzieć (James Allen, Search Engine Land) — miejsce Baiduspidera w szerszym przeglądzie crawlerów.
- Zrozumienie pająków Baidu, user-agentów i robots.txt (Jademond Digital) — praktyczne omówienie wariantów crawlera Baidu i obsługi robots.
- Baidu MIP (glosariusz) (Jademond Digital) — źródło dat wycofania MIP (Cache wycofany w czerwcu 2020; pełna usługa zakończona pod koniec września 2022).
Dziennik zmian
Zaktualizowano 8 sie 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 3 sie 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.