Crawler Bingbot
Czym jest Bingbot, jak działa jego indeksowanie oparte na Chromium, dlaczego jego zasięg wykracza poza Bing oraz jak zweryfikować prawdziwego crawlera przez dwuetapowy odwrotny DNS zamiast ufać user-agentowi.
Języki
2 sygnałów dowodowych na tej stronie
- Dane źródłowe dostępne przez linkLista adresów IP Bingbota (bingbot.json)
- Powiązane działające narzędzieGooglebot Verifier
Bingbot to crawler wyszukiwarki Microsoft Bing: odkrywa, pobiera i renderuje strony, a jego indeks zasila także Yahoo, DuckDuckGo, Ecosię, domyślną wyszukiwarkę Edge i Microsoft Copilot. Działa na evergreenowym silniku Chromium, odkrywa nowe adresy URL na dużą skalę, wstępnie filtruje mało obiecujące adresy i przechowuje każdy URL w pamięci. Weryfikuj go przez odwrotny DNS do hosta kończącego się na search.msn.com, a następnie zwykłe wyszukiwanie DNS; zarządzaj nim przez robots.txt, Crawl Control i IndexNow.
Evidence for this claim Bingbot is Microsoft's crawler for Bing search services and identifies itself with documented user-agent strings. Scope: Current Microsoft Bingbot documentation. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Bingbot Evidence for this claim Microsoft recommends verifying Bingbot through reverse and forward DNS rather than trusting the user-agent string alone. Scope: Current Bingbot verification method. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Verify BingbotTL;DR — Bingbot to robot indeksujący Microsoft Bing — bot, który odwiedza Twoje strony, pobiera je i dodaje do indeksu wyszukiwarki Bing. Działa bardzo podobnie do Googlebota. Zablokowanie go uniemożliwia Bingowi indeksowanie dotkniętych adresów URL i może również wpłynąć na produkty lub partnerów korzystających z infrastruktury wyszukiwania Bing, dlatego zweryfikuj wpływ na podstawie aktualnej dokumentacji Microsoft.
Czym jest Bingbot
Gdy widzisz bingbot w logach swojego serwera, to robot indeksujący Microsoft odwiedza
Twoją witrynę. Podobnie jak Googlebot dla Google, Bingbot podąża za linkami, czyta
mapy witryn, pobiera Twoje strony i przekazuje je do dodania do indeksu Bing —
bazy danych, z której Bing korzysta, gdy ktoś szuka.
Został uruchomiony 1 października 2010 roku, zastępując starszego bota o nazwie MSNBot.
Nazwa, którą zobaczysz w robots.txt i w logach, to po prostu bingbot.
Dlaczego to ważniejsze, niż myślisz
Oto część, która zaskakuje ludzi. Udział Bing w rynku wyszukiwarek jest niewielki, więc kuszące jest całkowite zignorowanie Bingbota. Ale indeks Bing, który buduje Bingbot, nie zasila tylko Bing. Obsługuje również:
- Yahoo Search
- DuckDuckGo
- Ecosia
- Domyślną wyszukiwarkę Microsoft Edge
- Microsoft Copilot
Więc jeśli zablokujesz Bingbota, nie tylko znikniesz z Bing — odetniesz się od wszystkich tych naraz. To znacznie większa sprawa, niż sugeruje „3% udziału w rynku”.
Czy Bingbot czyta JavaScript?
Tak. Kiedyś istniała obawa, że Bing nie poradzi sobie z witrynami opartymi na JavaScript, ale Bingbot działa teraz na tym samym silniku Chromium, który napędza Microsoft Edge, więc renderuje strony tak, jak robi to nowoczesna przeglądarka. Jeśli Twoje treści pojawiają się w aktualnej wersji Edge lub Chrome, Bingbot zazwyczaj też je widzi.
Jak pomóc (lub zatrzymać) Bingbota
- Aby go wpuścić: upewnij się, że Twoje ważne strony są linkowane, prześlij mapę witryny w
Bing Webmaster Tools i nie blokuj ich przypadkowo w
robots.txt. - Aby go spowolnić: Bing Webmaster Tools ma funkcję o nazwie Crawl Control, która pozwala ustawić, jak szybko Bingbot indeksuje, godzinę po godzinie.
- Aby przyspieszyć: istnieje opcja „push” o nazwie IndexNow, która pozwala poinformować Bing natychmiast, gdy strona się zmieni, zamiast czekać na następne indeksowanie.
Chcesz wersję techniczną — ciągi znaków user-agent, jak zweryfikować, że żądanie naprawdę pochodzi od Bingbota, inne roboty Microsoft i jak Bingbot zasila Copilota? Przełącz się na zakładkę Zaawansowane.
Evidence for this claim Bingbot is Microsoft's crawler for Bing search services and identifies itself with documented user-agent strings. Scope: Current Microsoft Bingbot documentation. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Bingbot Evidence for this claim Microsoft recommends verifying Bingbot through reverse and forward DNS rather than trusting the user-agent string alone. Scope: Current Bingbot verification method. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Verify BingbotTL;DR — Bingbot to robot indeksujący Microsoft Bing (token
robots.txt:bingbot), działający od 1 października 2010 roku, kiedy zastąpił MSNBota. Jest zawsze aktualny na silniku Edge opartym na Chromium, więc renderuje nowoczesny JavaScript. Jego realny zasięg jest szerszy niż ruch przypisywany bezpośrednio do bing.com, ponieważ Microsoft wykorzystuje swoją infrastrukturę wyszukiwania w różnych produktach i partnerstwach. Zweryfikuj go za pomocą udokumentowanej metody weryfikacji Bing, zamiast ufać ciągowi user-agent. Zarządzaj indeksowaniem za pomocąrobots.txt, Crawl Control w Bing Webmaster Tools i IndexNow — protokołu push Bing, stworzonego wspólnie z Yandex.
Od MSNBota do Bingbota
Bingbot to główny robot indeksujący Microsoft — program, który odkrywa, pobiera
i przetwarza strony, aby budować i aktualizować indeks Bing. Został uruchomiony
1 października 2010 roku, zastępując starszego MSNBota. To przejście wiązało się z
regułą robots.txt, która nadal ma znaczenie, jeśli masz stare dyrektywy:
ogłoszenie Microsoftu mówiło: “as of October 1st, if we detect separate sets of custom directives for both MSNBot and BingBot in your robots.txt file, the BingBot directives will take precedence.” (tłumaczenie) «Od 1 października, jeśli wykryjemy osobne zestawy niestandardowych dyrektyw zarówno dla MSNBot, jak i BingBot w pliku robots.txt, dyrektywy BingBot będą miały pierwszeństwo.» Więc reguły MSNBota nie po cichu nadpisują
Twoich reguł Bingbota — jest odwrotnie.
Bingbot zasila więcej niż Bing
To jest najważniejsze przeformułowanie na tej stronie. Bezpośredni udział Binga w rynku wyszukiwarek jest niewielki, przez co wielu specjalistów SEO go pomija. Ale indeks budowany przez Bingbota zasila również Yahoo Search, DuckDuckGo, Ecosia, domyślną wyszukiwarkę Edge oraz Microsoft Copilot — a historycznie zasilał też ChatGPT Search. Zależność od Yahoo sięga premiery w 2010 roku, kiedy Microsoft ostrzegał właścicieli witryn: “To keep your content in the Bing index, please ensure that BingBot has the same access to your site as given to MSNBot.” (tłumaczenie) „Aby utrzymać Twoje treści w indeksie Binga, upewnij się, że BingBot ma taki sam dostęp do Twojej witryny, jaki przyznano MSNBot.”
Praktyczna konsekwencja: reguła Disallow wobec bingbot nie kosztuje Cię „tylko Binga”. Od razu rozprzestrzenia się na cały ten ekosystem. Niezależnie od tego, czy zależy Ci konkretnie na Bingu, czy nie, Bingbot jest bramą do znaczącej części przeszukiwalnej sieci — i coraz częściej do odpowiedzi AI.
Ciąg user-agenta (i dlaczego jest wiecznie aktualny)
User-agent Bingbota zawiera token bingbot/2.0 oraz numer wersji Chrome/W.X.Y.Z oparty na Chromium, gdzie W.X.Y.Z jest zastępowane aktualną stabilną kompilacją Microsoft Edge (własny przykład Microsoftu: 100.0.4896.127) — to właśnie podstawienie czyni ten ciąg wiecznie aktualnym. Zgodnie z ogłoszeniem Microsoftu z kwietnia 2022 r. dotyczącym sfinalizowanych ciągów, desktopowy UA to Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm) Chrome/W.X.Y.Z Safari/537.36, a mobilny UA to Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/W.X.Y.Z Mobile Safari/537.36 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm). Wcześniejszy podgląd tych ciągów z grudnia 2019 r. proponował też dodatkowy końcowy fragment Edg/W.X.Y.Z, ale nie ma go w finalnych ciągach opublikowanych przez Microsoft w 2022 r. i potwierdzonych jako w pełni działające w lutym 2023 r. — jeśli dopasowujesz UA bingbota w kodzie, nie wymagaj go. Starszy, starszy ciąg to goły Mozilla/5.0 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm).
„Wiecznie aktualny” oznacza dokładnie tyle, że numer wersji automatycznie śledzi najnowszy stabilny Edge. W praktyce zlikwidowało to starą dwupoziomową lukę między indeksowaniem a renderowaniem: ponieważ Bingbot działa na tej samej rodzinie silników Chromium co nowoczesny Edge i Chrome, renderuje JavaScript tak, jak robi to obecna przeglądarka. Bing traktuje też dobrą wiarę dynamicznego renderowania jako uzasadnioną opcję dla witryn z dużą ilością JS — w ich ocenie nie jest to cloaking.
Weryfikacja Bingbota — sam user-agent nie wystarczy
Ciągi user-agent można łatwo sfałszować, więc żądanie podające się za Bingbota samo w sobie niczego nie dowodzi. Wiarygodna kontrola to dwuetapowy odwrotny DNS:
- Odwrotne (PTR) wyszukiwanie adresu IP indeksującego z Twoich logów. Prawdziwy adres IP Bingbota rozwiązuje się do nazwy hosta kończącej się na
search.msn.com— wzorzec tomsnbot-<ip-with-dashes>.search.msn.com(więc157.55.39.1→msnbot-157-55-39-1.search.msn.com). - Bezpośrednie (A) wyszukiwanie tej nazwy hosta. Musi ona rozwiązać się z powrotem do oryginalnego adresu IP.
Jeśli którykolwiek z tych kroków się nie powiedzie, to nie jest Bingbot. Microsoft publikuje listę adresów IP pod adresem bing.com/toolbox/bingbot.json (28 prefiksów IPv4, ostatnio wygenerowana w styczniu 2024 r.), ale zalecenie samej firmy to przedkładanie odwrotnego DNS nad listę adresów IP, ponieważ adresy mogą się zmieniać w dowolnym momencie. Traktuj JSON jako przybliżone odniesienie, a nie listę dozwolonych adresów w zaporze. (Ta sama logika odwrotnego DNS zamiast listy adresów IP dotyczy Googlebota — zobacz skrypty weryfikacyjne w zakładce Skrypty.)
Jak Bingbot odkrywa i indeksuje
Odkrywanie jest napędzane linkami. Fabrice Canel, wieloletni lider Bingbota w Microsoft, opisuje to podejście jako podążanie za ważnością: “We are guided by key pages that are important on the internet and we follow links to understand what’s next.” (tłumaczenie) «Kierujemy się kluczowymi stronami, które są ważne w internecie, i podążamy za linkami, aby zrozumieć, co będzie dalej.» Skala jest ogromna — w wywiadzie z 2019 roku Canel powiedział: “Every day, my team discovers more than 100 billion new URLs never seen before, while useless URLs parameters are ignored.” (tłumaczenie) «Codziennie mój zespół odkrywa ponad 100 miliardów nowych adresów URL, których nigdy wcześniej nie widział, a bezużyteczne parametry URL są ignorowane.» (Dane z 2020 roku mówią o około 70 miliardach nowych adresów URL dziennie; obie liczby są prawdziwe, ale pochodzą z różnych dat, więc warto podawać rok, gdy się na nie powołujesz.)
Dwie zachowania odróżniają Bingbota od tego, jak Google opisuje własnego crawlera:
- Filtrowanie wstępne przed pobraniem. Bingbot podejmuje decyzję o koszcie/wartości, zanim w ogóle pobierze adres URL. Jak ujął to Bing: “Pages that are deemed to have absolutely no potential for being useful in satisfying a user’s search query in Bing results are not retained.” (tłumaczenie) «Strony, które uznano za niemające absolutnie żadnego potencjału, aby być przydatne w zaspokojeniu zapytania użytkownika w wynikach Bing, nie są przechowywane.»
- Pamięć URL. Bingbot zapamiętuje adresy URL praktycznie na zawsze: “Bingbot retains every URL in memory and comes back and recrawls intermittently, even if all links to it have been removed.” (tłumaczenie) «Bingbot przechowuje każdy adres URL w pamięci i wraca, aby go okresowo ponownie przeszukiwać, nawet jeśli wszystkie linki do niego zostały usunięte.» Dlatego strona może nadal widzieć odwiedziny Bingbota długo po tym, jak usuniesz wszystkie wewnętrzne linki do niej.
Pod tym wszystkim kryje się postawa stawiająca uprzejmość na pierwszym miejscu. Canel: “Our default crawl policy is to be as polite as possible when crawling the web.” (tłumaczenie) «Nasza domyślna polityka indeksowania jest taka, aby być tak uprzejmym, jak to możliwe, podczas przeszukiwania sieci.» I jego szczera opinia o samym problemie: “Crawling right is a fascinating engineering problem that hasn’t fully been solved yet.” (tłumaczenie) «Prawidłowe indeksowanie to fascynujący problem inżynieryjny, który nie został jeszcze w pełni rozwiązany.»
Inne crawlery Microsoftu
Bingbot to nie jedyny bot Microsoftu, którego zobaczysz:
- AdIdxBot (
adidxbot) — crawler kontroli jakości Bing Ads. Warto wiedzieć, że dzieli budżet indeksowania z Bingbotem, więc intensywne indeksowanie reklam może uszczuplić budżet na Twoje organiczne strony. - BingPreview — generuje zrzuty stron i miniatury podglądów.
- MicrosoftPreview — podglądy linków w Teams i Office.
- BingVideoPreview — podglądy wideo wyświetlane tylko w Bing. Podobnie jak inne ma warianty desktopowe i mobilne, a identyfikuje się za pomocą
+https://aka.ms/microsoftbots, a nie adresu URLbingbot.htm, którego używają starsze crawlera. - MSNBot / MSNBot-Media — starszy crawler, wycofany 1 października 2010 r.
Kontrolowanie indeksowania Bingbota
Trzy dźwignie, od ogólnych do precyzyjnych:
robots.txt— tokenbingbotkontroluje indeksowanie. Użyj go, aby trzymać bota z dala od miejsc o niskiej wartości; nie jest to narzędzie do usuwania z indeksu.- Crawl Control (Bing Webmaster Tools) — pozwala ustawić godzinowe tempo indeksowania Bingbota, dzięki czemu możesz je spowolnić w godzinach szczytu i przyspieszyć poza nimi. To prawdziwa różnica między Google a Bing: Google wycofał suwak tempa indeksowania w Search Console, podczas gdy Bing nadal daje Ci aktywną kontrolę.
- IndexNow — zamiast czekać na ponowne indeksowanie, wypychasz zmianę. To protokół “created by Microsoft Bing and Yandex, allowing websites to easily notify search engines whenever their website content is created, updated, or deleted.” (tłumaczenie) «stworzony przez Microsoft Bing i Yandex, umożliwiający stronom internetowym łatwe powiadamianie wyszukiwarek za każdym razem, gdy ich treść jest tworzona, aktualizowana lub usuwana.» Jeden ping dociera do każdej uczestniczącej wyszukiwarki. Nie będę tutaj powielać pełnego opisu — zobacz szczegółowy przewodnik po IndexNow, aby poznać konfigurację, kluczowy plik i limit 10 000 adresów URL na żądanie.
Strategiczny punkt, do którego wracam: Bing naprawił reputację agresywnego indeksowania, stając się wydajnym, a IndexNow jest tego kluczowym elementem. Jak napisałem w mojej analizie indeksowania botów AI i wyszukiwarek, “It’s estimated that 53% of crawler traffic is wasted effort, and IndexNow can help cut that number down to almost nothing.” (tłumaczenie) «Szacuje się, że 53% ruchu crawlerów to zmarnowany wysiłek, a IndexNow może pomóc zmniejszyć tę liczbę do prawie zera.» Wypychanie zmian jest lepsze niż próby zachęcania do większej eksploracyjnej indeksacji.
Bingbot, Copilot i luka w rezygnacji z AI
Ponieważ indeks Bing zasila Microsoft Copilot, Bingbot jest de facto również botem AI. Wskazówki Canela dotyczące dobrego pozycjonowania się tam są konkretne: “schema markup helps Microsoft’s LLMs understand your content,” (tłumaczenie) «znaczniki schema pomagają modelom językowym Microsoftu zrozumieć Twoje treści» oraz “Gen AIs value fresh content in particular, partly as a reference check of their LLM training data. Use the API at indexnow.org to push that information as it’s published or updated.” (tłumaczenie) «Modele generatywnej AI szczególnie cenią świeże treści, częściowo jako weryfikację danych treningowych swoich modeli językowych. Użyj API na stronie indexnow.org, aby przesyłać te informacje w momencie ich publikacji lub aktualizacji.»
Jest pewien niuans, który artykuły konkurencji zwykle pomijają. Google oferuje token Google-Extended, który pozwala zrezygnować z trenowania AI bez wpływu na indeksowanie w wyszukiwarce. Według większości zewnętrznych interpretacji nie ma odpowiednika osobnej rezygnacji dla Binga — co oznacza, że zablokowanie bingbot w celu uniknięcia trenowania Copilota spowodowałoby również usunięcie z wyszukiwarki Bing i wszystkiego, co z niej wynika. Traktowałbym to jako obserwację dotyczącą obecnego stanu tych mechanizmów, a nie ustaloną politykę Microsoftu, i przed podjęciem działań sprawdziłbym aktualną dokumentację.
Aby zobaczyć, gdzie Bingbot wpisuje się w szerszy obraz — rodzina botów indeksujących, Googlebot, koncepcja user-agenta, boty AI, robots.txt i IndexNow — centrum poświęcone indeksowaniu łączy to wszystko.
Podsumowanie AI
Skrócona wersja sekcji Advanced:
- Bingbot = bot indeksujący Binga. Token
robots.txtbingbot; działa od 1 października 2010 roku, kiedy zastąpił MSNBot (a dyrektywy BingBot mają pierwszeństwo nad pozostałymi dyrektywami MSNBot). - Zasięg > udział w rynku. Indeks budowany przez Bingbota zasila również Yahoo, DuckDuckGo, Ecosię, domyślną wyszukiwarkę Edge i Copilota — więc zablokowanie
bingbotma skutki daleko wykraczające poza Binga. - Zawsze aktualne renderowanie. Działa na silniku Edge opartym na Chromium; UA zawiera token
bingbot/2.0oraz numer wersjiChrome/W.X.Y.Zzastąpiony aktualną stabilną wersją Edge (bez osobnego fragmentuEdg/w końcowych ciągach z 2022 roku). Renderuje nowoczesny JavaScript; renderowanie dynamiczne w dobrej wierze nie jest cloakingiem. - Weryfikacja przez dwuetapowy odwrotny DNS: PTR do
msnbot-*.search.msn.com, a następnie wyszukiwanie w przód, które pasuje do adresu IP. User-agenty można sfałszować; preferuj odwrotny DNS zamiast listy IPbingbot.json(która się zmienia). - Jak indeksuje: podąża za „kluczowymi stronami” i linkami, odkrywa około 100 miliardów nowych adresów URL dziennie (2019; około 70 miliardów w danych z 2020 roku), wstępnie filtruje adresy URL bez „potencjału” przed pobraniem i przechowuje każdy adres URL w pamięci — ponownie indeksuje nawet po usunięciu wszystkich linków.
- Inne boty Microsoftu: AdIdxBot (dzieli budżet indeksowania z Bingbotem), BingPreview, MicrosoftPreview, BingVideoPreview; MSNBot został wycofany.
- Kontroluj go za pomocą
robots.txt, Crawl Control (stawka godzinowa — Google usunął swój odpowiednik) oraz IndexNow (push, stworzony wspólnie z Yandexem). Ujęcie Patricka: około 53% ruchu botów jest marnowane, a IndexNow redukuje to do niemal zera. - Aspekt AI: Bingbot zasila Copilota; schema i świeże treści pomagają; nie ma wyraźnego odpowiednika Google-Extended w Bing, więc blokowanie w celu trenowania AI również usuwa z wyszukiwania (traktuj jako obserwację, zweryfikuj aktualną dokumentację).
Oficjalna dokumentacja
Dokumentacja źródłowa, głównie od Microsoftu/Binga, z linkiem porównawczym do Google. Uwaga: wiele wpisów na blogs.bing.com i stron bing.com/webmasters/help jest renderowanych w JavaScript lub przekierowuje, więc potwierdź szczegóły w przeglądarce, jeśli link nie działa.
Bing / Microsoft
- Jakich crawlerów używa Bing? — oficjalna lista botów Microsoftu i ich tokenów user-agent (Bingbot, AdIdxBot oraz crawlerów podglądu).
- Ogłoszenie zmiany user-agenta crawlera Bingbota — oficjalne, finalne ciągi UA Bingbota dla desktopu i urządzeń mobilnych (potwierdzone jako w pełni aktywne w lutym 2023); to źródło dokładnych ciągów cytowanych powyżej.
- Lista adresów IP Bingbota (bingbot.json) — opublikowane prefiksy IPv4. Używaj wyłącznie jako odniesienia; Microsoft zaleca zamiast tego odwrotny DNS.
- Narzędzie Verify Bingbot — internetowe narzędzie Microsoftu do potwierdzania, że adres IP indeksujący jest faktycznie Bingbotem.
- Bing Webmaster Tools — Crawl Control — ustaw stawkę indeksowania Bingbota na godzinę.
- IndexNow / indexnow.org — protokół push do natychmiastowego sygnalizowania utworzonych, zaktualizowanych lub usuniętych adresów URL.
- Seria bingbot: maksymalizacja efektywności crawlowania — filozofia „efektywności indeksowania” Binga.
Google (dla porównania)
- Overview of Google crawlers and fetchers — user-agenty i zakresy IP Googlebota, odpowiednik konfiguracji Binga. Zwróć uwagę na różnice: Google wycofał ręczną kontrolę stawki indeksowania, nie używa IndexNow dla ogólnych stron i oferuje
Google-Extendeddo rezygnacji z trenowania AI oddzielnie od wyszukiwania.
Cytaty ze źródła
Oficjalne wypowiedzi na temat Bingbota — głównie od Fabrice’a Canela, lidera Bingbota w Microsoft. Każdy link to link bezpośredni prowadzący do cytowanego fragmentu.
Fabrice Canel, Microsoft Bing — odkrywanie i skala
- “We are guided by key pages that are important on the internet and we follow links to understand what’s next.” (tłumaczenie) „Kierujemy się kluczowymi stronami, które są ważne w internecie, i podążamy za linkami, aby zrozumieć, co będzie dalej.” Przejdź do cytatu
- “Every day, my team discovers more than 100 billion new URLs never seen before, while useless URLs parameters are ignored.” (tłumaczenie) „Każdego dnia mój zespół odkrywa ponad 100 miliardów nowych adresów URL, których nigdy wcześniej nie widziano, podczas gdy bezużyteczne parametry URL są ignorowane.” (wywiad z Search Engine Journal, 2019.) Przejdź do cytatu
- “Crawling right is a fascinating engineering problem that hasn’t fully been solved yet.” (tłumaczenie) „Prawidłowe indeksowanie to fascynujący problem inżynieryjny, który nie został jeszcze w pełni rozwiązany.” (SEJ, 2019.) Przejdź do cytatu
- “Our default crawl policy is to be as polite as possible when crawling the web.” (tłumaczenie) „Nasza domyślna polityka indeksowania polega na byciu tak uprzejmym, jak to możliwe, podczas indeksowania sieci.” (SEJ, 2019.) Przejdź do cytatu
Microsoft Bing — jak Bingbot obsługuje adresy URL
- “Bingbot retains every URL in memory and comes back and recrawls intermittently, even if all links to it have been removed.” (tłumaczenie) „Bingbot zachowuje każdy URL w pamięci i wraca, aby go okresowo ponownie przeszukiwać, nawet jeśli wszystkie linki do niego zostały usunięte.” Przejdź do cytatu
- “Pages that are deemed to have absolutely no potential for being useful in satisfying a user’s search query in Bing results are not retained.” (tłumaczenie) „Strony, które uznano za całkowicie pozbawione potencjału przydatności w zaspokojeniu zapytania użytkownika w wynikach Bing, nie są zachowywane.” Przejdź do cytatu
Fabrice Canel, Microsoft Bing — wydajność, schema i AI
- “Less is more for SEO. Never forget that. Less URLs to crawl, better for SEO.” (tłumaczenie) „Mniej znaczy więcej dla SEO. Nigdy o tym nie zapominaj. Mniej URL-i do przeszukania, lepiej dla SEO.” Przejdź do cytatu
- “schema markup helps Microsoft’s LLMs understand your content.” (tłumaczenie) „znaczniki schema pomagają modelom LLM Microsoftu zrozumieć Twoje treści.” (SMX Munich, 2025.) Przejdź do cytatu
- “Gen AIs value fresh content in particular, partly as a reference check of their LLM training data. Use the API at indexnow.org to push that information as it’s published or updated.” (tłumaczenie) „Generatywne AI szczególnie cenią świeże treści, częściowo jako sprawdzenie referencyjne swoich danych treningowych LLM. Użyj API na indexnow.org, aby przesyłać te informacje w momencie ich publikacji lub aktualizacji.” Przejdź do cytatu
Microsoft Bing — premiera w 2010 roku i IndexNow
- “as of October 1st, if we detect separate sets of custom directives for both MSNBot and BingBot in your robots.txt file, the BingBot directives will take precedence.” (tłumaczenie) „od 1 października, jeśli wykryjemy osobne zestawy niestandardowych dyrektyw zarówno dla MSNBot, jak i BingBot w pliku robots.txt, dyrektywy BingBot będą miały pierwszeństwo.” (Bing Webmaster blog, 2010.)
- “To keep your content in the Bing index, please ensure that BingBot has the same access to your site as given to MSNBot.” (tłumaczenie) „Aby utrzymać treści w indeksie Bing, upewnij się, że BingBot ma taki sam dostęp do Twojej witryny jak MSNBot.” (Bing Webmaster blog, 2010.)
- “IndexNow is a new protocol created by Microsoft Bing and Yandex, allowing websites to easily notify search engines whenever their website content is created, updated, or deleted.” (tłumaczenie) „IndexNow to nowy protokół stworzony przez Microsoft Bing i Yandex, umożliwiający witrynom łatwe powiadamianie wyszukiwarek o tworzeniu, aktualizacji lub usuwaniu treści.” (Bing Webmaster blog, 2021.)
Patrick Stox (ja) — poprawa wydajności Bing
- “There was a lot of blowback on Bing in the past because of their aggressive crawling.” (tłumaczenie) „W przeszłości Bing spotykała się z dużą krytyką z powodu agresywnego przeszukiwania.” Przejdź do cytatu
- “It’s estimated that 53% of crawler traffic is wasted effort, and IndexNow can help cut that number down to almost nothing.” (tłumaczenie) „Szacuje się, że 53 % ruchu crawlerów to zmarnowany wysiłek, a IndexNow może pomóc zredukować tę liczbę do prawie zera.” Przejdź do cytatu
blogs.bing.com przekierowuje teraz na stronę główną bloga lub renderuje się za pomocą JavaScript, a niektóre źródła branżowe blokują automatyczne sprawdzanie. Powyższe linie dotyczące premiery w 2010 roku i premiery IndexNow zostały zweryfikowane na podstawie oryginalnego tekstu bloga, ale ich aktywne adresy URL postów mogą przekierowywać — potwierdź w przeglądarce (lub w Wayback Machine) przed potraktowaniem któregokolwiek z nich jako ostatecznego, i polegaj na zweryfikowanych linkach SEJ/SEL/Kalicube powyżej, gdy potrzebujesz stabilnego źródła. Co powinienem zrobić z Bingbotem?
Decyzje dotyczące Bingbota zależą od dwóch rzeczy: czy żądanie naprawdę pochodzi od Bingbota, oraz czy chcesz go spowolnić, przyspieszyć, czy całkowicie zablokować. Kliknij, aby przejść dalej.
Deciding what to do about Bingbot
Bingbot i roboty Microsoft — ściągawka
Ciągi user-agent
| Wariant | Ciąg (aktualny) |
|---|---|
| Desktop | Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm) Chrome/W.X.Y.Z Safari/537.36 |
| Mobile | Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/W.X.Y.Z Mobile Safari/537.36 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm) |
| Legacy (przed Chromium) | Mozilla/5.0 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm) |
W.X.Y.Z = aktualna stabilna wersja Microsoft Edge, podstawiana do tokenu
Chrome/ (evergreen — aktualizuje się sam). To są finalne ciągi, które Microsoft
opublikował w kwietniu 2022 i potwierdził jako w pełni aktywne w lutym 2023;
wcześniejsza wersja zapoznawcza z grudnia 2019 proponowała też końcowy fragment
Edg/W.X.Y.Z, ale nie jest on częścią sfinalizowanego UA — nie wymagaj go w kodzie
dopasowującym boty.
Rodzina robotów Microsoft
| Robot | Token robots.txt | Co robi |
|---|---|---|
| Bingbot | bingbot | Główny robot indeksujący dla indeksu Bing |
| AdIdxBot | adidxbot | Kontrola jakości Bing Ads — dzieli budżet indeksowania z Bingbotem |
| BingPreview | — | Migawki stron / miniatury podglądu |
| MicrosoftPreview | — | Podglądy linków w Teams / Office |
| BingVideoPreview | — | Podglądy wideo tylko w Bing (aka.ms/microsoftbots) |
| MSNBot, MSNBot-Media | msnbot | Starszy — wycofany 1 października 2010 |
Szybkie fakty
- Uruchomiony 1 października 2010, zastępując MSNBot.
- Jeśli w
robots.txtistnieją zarówno dyrektywy MSNBot, jak i BingBot, wygrywa BingBot. - Weryfikuj przez odwrotny DNS do
*.search.msn.com, nie przez user-agent ani listę IP (IP się zmieniają). - Lista IP:
bing.com/toolbox/bingbot.json— 28 prefiksów IPv4, wygenerowana w styczniu 2024. - Crawl Control w Bing Webmaster Tools ustawia godzinową szybkość indeksowania (Google usunął swój odpowiednik).
- IndexNow = wypychanie zmienionych URL-i; współtworzony z Yandex.
Weryfikacja, czy bot to naprawdę Bingbot
Żądanie, które mówi, że jest Bingbotem, niczego nie dowodzi — ciąg user-agent
jest trywialny do sfałszowania. Jak ujmuje to Microsoft, fakt, że bot używa
dokładnego user-agenta Bingbota, nie czyni go Bingbotem. Potwierdź to dwuetapowym
odwrotnym + zwykłym sprawdzeniem DNS. Prawdziwy adres IP Bingbota odwrotnie
rozwiązuje się do nazwy hosta kończącej się na search.msn.com (wzorzec
msnbot-<ip-with-dashes>.search.msn.com), a ta nazwa hosta musi rozwiązywać się
z powrotem do tego samego IP.
macOS / Linux
# 1) Reverse DNS the IP from your logs — it should end in search.msn.com
host 157.55.39.1
# → 1.39.55.157.in-addr.arpa domain name pointer msnbot-157-55-39-1.search.msn.com
# 2) Forward DNS that hostname back — it must resolve to the same IP
host msnbot-157-55-39-1.search.msn.com
# → msnbot-157-55-39-1.search.msn.com has address 157.55.39.1Windows
nslookup 157.55.39.1
nslookup msnbot-157-55-39-1.search.msn.comJeśli odwrotne wyszukiwanie nie kończy się na search.msn.com lub zwykłe
wyszukiwanie nie zwraca oryginalnego IP, to nie jest Bingbot — odrzuć lub
ogranicz jego szybkość. Możesz też skorzystać z internetowego narzędzia Verify Bingbot
Microsoftu oraz opublikowanej listy IP bingbot.json
jako przybliżonego sprawdzenia krzyżowego — ale Microsoft wyraźnie stwierdza, że
IP mogą się zmieniać, więc DNS jest źródłem prawdy, a nie zakodowana na stałe
lista dozwolonych. (To samo podejście co przy weryfikacji Googlebota; wersję dla
Google znajdziesz w zakładce Scripts w centrum indeksowania.)
Lista kontrolna gotowości na Bingbota
Szybkie sprawdzenie, czy współpracujesz z Bingbotem, a nie przeciwko niemu:
-
robots.txtnie blokujebingbotprzed niczym, co chcesz mieć w Bing (pamiętaj: to obejmuje również Yahoo, DuckDuckGo, Ecosia i Copilot). - Brak nieaktualnych dyrektyw MSNBot konfliktujących z regułami Bingbot (BingBot wygrywa, ale je wyczyść).
- Mapa witryny XML przesłana w Bing Webmaster Tools, zawierająca tylko kanoniczne,
indeksowalne adresy URL z dokładnym
lastmod. - Weryfikacja bota używa odwrotnego + zwykłego DNS, a nie user-agenta ani zakodowanej na sztywno listy adresów IP.
- Jeśli używasz zapory lub listy dozwolonych botów, weryfikujesz przez DNS — a nie przypinasz
adresów IP z
bingbot.json(one się zmieniają). - Crawl Control przejrzany, jeśli ruch Bingbot obciąża serwer w godzinach szczytu.
- IndexNow skonfigurowany tak, aby tworzone/aktualizowane/usuwane adresy URL były wypychane, a nie czekano na nie.
- Treść zależna od JS jest osiągalna i renderuje się (Bingbot jest evergreen, ale prawdziwe
linki
<a href>wciąż biją nawigację tylko po kliknięciu). - Świadomość, że AdIdxBot dzieli budżet indeksowania Bingbot, jeśli używasz Bing Ads.
- Przed zablokowaniem
bingbotz powodów AI potwierdzono, że nie ma osobnej rezygnacji dla Copilot — zablokowanie go obecnie usuwa Cię też z wyszukiwarki Bing.
Modele myślowe
1. Zasięg, nie udział w rynku. Bezpośredni udział Bing w wyszukiwaniu jest mały, więc kuszące
jest ocenianie Bingbota tylko przez tę liczbę. Ważniejsza zmiana perspektywy: indeks, który buduje
Bingbot, jest backendem dla Yahoo Search, DuckDuckGo, Ecosia, domyślnej wyszukiwarki Edge i
Microsoft Copilot. Reguła Disallow: bingbot nie kosztuje Cię „3 % wyszukiwania” — kosztuje
Cię wszystkie te powierzchnie naraz. Oceniaj decyzje dotyczące Bingbota przez zasięg ekosystemu, a nie
przez samodzielną liczbę Bing.
2. Weryfikuj przez DNS, nie przez user-agenta. Ciąg user-agenta w żądaniu to tylko nagłówek,
który ustawia klient — każdy może wpisać bingbot/2.0 w poleceniu curl. Jedynym twierdzeniem,
którego nie da się tanio sfałszować, jest rekord DNS wskazujący z powrotem na własną domenę Microsoftu
search.msn.com, sprawdzany w obu kierunkach (odwrotnie, potem zwykle). Traktuj każdy
inny sygnał — user-agent, opublikowaną listę adresów IP — jako wskazówkę, nie dowód.
3. Trzy dźwignie, od tępej do chirurgicznej. robots.txt to tępe narzędzie: trzyma
Bingbota całkowicie poza ścieżką, ale to kontrola indeksowania, nie usuwania z indeksu.
Crawl Control w Bing Webmaster Tools to pokrętło: kształtuje kiedy Bingbot uderza
najmocniej, godzinę po godzinie, bez wyłączania czegokolwiek. IndexNow to skalpel:
w ogóle nie czeka, aż Bingbot wróci — wypycha pojedynczy adres URL w momencie
zmiany. Sięgaj po najmniej tępą dźwignię, która rozwiązuje rzeczywisty problem.
4. Google wycofał pokrętło; Bing je zachował. Google usunął ogranicznik szybkości indeksowania z Search Console. Crawl Control Binga wciąż daje Ci aktywną kontrolę stawki godzinowej. Jeśli jesteś przyzwyczajony do traktowania zarządzania szybkością indeksowania jako „czegoś, czego już naprawdę nie można robić”, to prawda dla Googlebota, ale nie dla Bingbota — to realna, aktualna dźwignia, warta użycia, gdy ruch Bingbota obciąża serwer w godzinach szczytu.
Stały KPI: łączny ruch z poleceń w ekosystemie Bing
Liczba udziału Bing w rynku nie oddaje tego, ile Bingbot jest dla Ciebie wart, ponieważ indeks, który buduje, zasila też Yahoo Search, DuckDuckGo, Ecosia i Microsoft Copilot. Uczciwy KPI to nie „ruch z Bing” w izolacji — to łączny ruch z poleceń w całym tym ekosystemie, śledzony w czasie.
Segmentuj ruch z poleceń według pełnej rodziny indeksu Bing
- Metryka — Sesje/kliknięcia w Twoim narzędziu analitycznym, gdzie referrer to
bing.com,search.yahoo.com,duckduckgo.com,ecosia.orglubcopilot.microsoft.com, zsumowane i śledzone jako jedna grupa (obok, nie zamiast) Twojego numeru Google. - Co Ci to mówi — Czy blokowanie lub niedostateczne obsługiwanie Bingbota faktycznie kosztuje Cię ruch poza samym Bingiem. Spadek widoczny we wszystkich pięciu referrerach jednocześnie to problem z dostępem Bingbota, a nie problem z rankingiem w jednej wyszukiwarce.
- Jak to wyciągnąć — Segmentuj istniejące narzędzie analityczne (GA4, logi serwera lub cokolwiek już używasz) według domeny referrera dla każdej z pięciu powyższych i połącz to z Bing Webmaster Tools — Search Performance, które raportuje kliknięcia i wyświetlenia Binga bezpośrednio (nie widzi danych Yahoo/DuckDuckGo/Ecosia downstream, więc dane referrera z analityki to jedyne miejsce, gdzie istnieje ten połączony widok).
- Benchmark / realistyczny zakres — Nie ma uczciwej ogólnobranżowej liczby, do której należy dążyć — podział ekosystemu różni się ogromnie w zależności od odbiorców i geografii. Ustal własną bazę na podstawie kilku miesięcy danych referrera, zanim ocenisz ruch w pojedynczym miesiącu.
- Częstotliwość — Miesięcznie wystarczy do śledzenia trendu; sprawdzaj co tydzień tuż po zmianie
robots.txt, wdrożeniu IndexNow lub czegokolwiek innego, co wpływa na dostęp Bingbota.
Narzędzia do weryfikacji i kontroli Bingbota
- Googlebot Verifier — moje własne narzędzie. Wklej adres IP, który twierdzi, że jest Bingbotem, a on wykona za Ciebie sprawdzenie forward-confirmed reverse DNS, a także wskaże prawdziwego właściciela sieci, jeśli to spoofer. To praktyczna wersja dwuetapowego sprawdzenia DNS z zakładki Skrypty, bez dotykania terminala.
- robots.txt Tester — moje własne narzędzie. Sprawdź, czy
konkretny URL jest dozwolony czy zablokowany dla tokenu
bingbot(w odróżnieniu od*lub Googlebota), zobacz dokładnie, która reguła wygrywa, i wyłap pozostałą dyrektywęmsnbotwalczącą z Twoją regułą Bingbota, zanim trafi na produkcję. - Verify Bingbot tool — własne narzędzie online Microsoftu, przydatne jako krzyżowe sprawdzenie względem Googlebot Verifier.
- Bing Webmaster Tools — Crawl Control — ustaw bezpośrednio godzinową szybkość indeksowania Bingbota; aktywna kontrola, której odpowiednik Google wycofał.
- IndexNow (
indexnow.org) — wypychaj utworzone/zaktualizowane/usunięte URL-e zamiast czekać na następny przebieg Bingbota; jeden ping dociera do każdej uczestniczącej wyszukiwarki.
Zasoby warte Twojego czasu
Moje powiązane artykuły
- Poznaj nowe crawlery: boty AI zbliżają się do botów wyszukiwarek — gdzie omawiam agresywne indeksowanie Binga w przeszłości, zwrot w stronę IndexNow i statystykę 53% zmarnowanego ruchu.
- Kiedy należy martwić się budżetem crawl? — zawiera ramy „crawl efficiency” Binga i notatkę, że “Bing also has an Indexing API that’s available to everyone.” (tłumaczenie) „Bing ma również API indeksowania dostępne dla każdego.”
- Bingbot (glosariusz SEO Ahrefs) — krótka wersja referencyjna.
- Podręcznik technicznego SEO dla początkujących — gdzie roboty indeksujące wpisują się w szerszy obraz.
Moje wystąpienia
- How Search Works (SlideShare) — moje omówienie indeksowania, renderowania, indeksowania i rankingu. (Stałe zastrzeżenie ma zastosowanie: “This is my understanding of systems… not going to be 100% complete or accurate.” (tłumaczenie) „To moje rozumienie systemów… nie będzie w 100% kompletne ani dokładne.”)
Od innych
- Jak działa Bingbot: odkrywanie, crawlowanie, ekstrakcja i indeksowanie (SEJ) — szczegółowy opis Fabrice’a Canela dotyczący pamięci URL-i i wstępnego filtrowania, o których mowa powyżej.
- Dlaczego i jak Bing planuje ulepszyć swojego crawlera, Bingbota (SEJ, 2019) — wywiad z Canela, w którym pada liczba 100 miliardów nowych URL-i dziennie, cytat o uprzejmej polityce crawlowania oraz zdanie o „fascynującym problemie inżynieryjnym”.
- Microsoft Bing / Copilot: wykorzystanie schema dla LLM-ów (Search Engine Land, 2025) — Canel na SMX Munich o tym, jak znaczniki schema pomagają modelom LLM Microsoftu oraz o świeżych treściach jako sygnale rankingowym dla Copilota.
- Pięć bram infrastruktury za crawlowaniem, renderowaniem i indeksowaniem (Search Engine Land) — ramy efektywności crawlowania Canela „mniej znaczy więcej dla SEO”, wyjaśnione brama po bramie.
- Jak Bingbot i Googlebot wybierają strony (Kalicube) — cytat Canela o „kierowaniu się kluczowymi stronami” w filozofii odkrywania URL-i, z porównaniem do Googlebota.
- r/TechSEO — społeczność dla debugowania crawlowania i indeksowania.
Statystyki, które warto cytować
- ~100 miliardów nowych URL-i odkrywanych dziennie — dane Fabrice’a Canela z 2019 roku dotyczące tego, ile nigdy wcześniej nie widzianych URL-i Bingbot znajduje codziennie (“more than 100 billion new URLs never seen before” (tłumaczenie) «ponad 100 miliardów nowych adresów URL, których nigdy wcześniej nie widziano»). Osobna liczba z 2020 roku mówiła o około 70 miliardach — podawaj datę, gdy cytujesz którąkolwiek z nich. Źródło
- ~53 % ruchu crawlującego to zmarnowany wysiłek — moje oszacowanie i argument za IndexNow: wysyłanie zmian “can help cut that number down to almost nothing.” (tłumaczenie) «może pomóc zmniejszyć tę liczbę do prawie zera» Źródło
- 28 opublikowanych prefiksów IPv4 — rozmiar oficjalnej listy adresów IP Bingbota Microsoftu (
bingbot.json, wygenerowanej w styczniu 2024) — przydatny kontekst, ale Microsoft ostrzega, że adresy się zmieniają, więc weryfikuj przez odwrotny DNS. Źródło
Sprawdź się: Bingbot
Pięć szybkich pytań o Bingbota, weryfikację i zasięg. Wybierz odpowiedź na każde, a potem sprawdź.
Dziennik zmian
Zaktualizowano 8 sie 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 3 sie 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 18 lip 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.