Crawler Bingbot

Czym jest Bingbot, jak działa jego indeksowanie oparte na Chromium, dlaczego jego zasięg wykracza poza Bing oraz jak zweryfikować prawdziwego crawlera przez dwuetapowy odwrotny DNS zamiast ufać user-agentowi.

Opublikowano po raz pierwszy: 24 cze 2026 · Ostatnia aktualizacja: 8 sie 2026 · Advanced
Języki
2 sygnałów dowodowych na tej stronie

Bingbot to crawler wyszukiwarki Microsoft Bing: odkrywa, pobiera i renderuje strony, a jego indeks zasila także Yahoo, DuckDuckGo, Ecosię, domyślną wyszukiwarkę Edge i Microsoft Copilot. Działa na evergreenowym silniku Chromium, odkrywa nowe adresy URL na dużą skalę, wstępnie filtruje mało obiecujące adresy i przechowuje każdy URL w pamięci. Weryfikuj go przez odwrotny DNS do hosta kończącego się na search.msn.com, a następnie zwykłe wyszukiwanie DNS; zarządzaj nim przez robots.txt, Crawl Control i IndexNow.

TL;DR — Bingbot to robot indeksujący Microsoft Bing (token robots.txt: bingbot), działający od 1 października 2010 roku, kiedy zastąpił MSNBota. Jest zawsze aktualny na silniku Edge opartym na Chromium, więc renderuje nowoczesny JavaScript. Jego realny zasięg jest szerszy niż ruch przypisywany bezpośrednio do bing.com, ponieważ Microsoft wykorzystuje swoją infrastrukturę wyszukiwania w różnych produktach i partnerstwach. Zweryfikuj go za pomocą udokumentowanej metody weryfikacji Bing, zamiast ufać ciągowi user-agent. Zarządzaj indeksowaniem za pomocą robots.txt, Crawl Control w Bing Webmaster Tools i IndexNow — protokołu push Bing, stworzonego wspólnie z Yandex.

Evidence for this claim Bingbot is Microsoft's crawler for Bing search services and identifies itself with documented user-agent strings. Scope: Current Microsoft Bingbot documentation. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Bingbot Evidence for this claim Microsoft recommends verifying Bingbot through reverse and forward DNS rather than trusting the user-agent string alone. Scope: Current Bingbot verification method. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Verify Bingbot

Od MSNBota do Bingbota

Bingbot to główny robot indeksujący Microsoft — program, który odkrywa, pobiera i przetwarza strony, aby budować i aktualizować indeks Bing. Został uruchomiony 1 października 2010 roku, zastępując starszego MSNBota. To przejście wiązało się z regułą robots.txt, która nadal ma znaczenie, jeśli masz stare dyrektywy: ogłoszenie Microsoftu mówiło: “as of October 1st, if we detect separate sets of custom directives for both MSNBot and BingBot in your robots.txt file, the BingBot directives will take precedence.” (tłumaczenie) «Od 1 października, jeśli wykryjemy osobne zestawy niestandardowych dyrektyw zarówno dla MSNBot, jak i BingBot w pliku robots.txt, dyrektywy BingBot będą miały pierwszeństwo.» Więc reguły MSNBota nie po cichu nadpisują Twoich reguł Bingbota — jest odwrotnie.

Bingbot zasila więcej niż Bing

To jest najważniejsze przeformułowanie na tej stronie. Bezpośredni udział Binga w rynku wyszukiwarek jest niewielki, przez co wielu specjalistów SEO go pomija. Ale indeks budowany przez Bingbota zasila również Yahoo Search, DuckDuckGo, Ecosia, domyślną wyszukiwarkę Edge oraz Microsoft Copilot — a historycznie zasilał też ChatGPT Search. Zależność od Yahoo sięga premiery w 2010 roku, kiedy Microsoft ostrzegał właścicieli witryn: “To keep your content in the Bing index, please ensure that BingBot has the same access to your site as given to MSNBot.” (tłumaczenie) „Aby utrzymać Twoje treści w indeksie Binga, upewnij się, że BingBot ma taki sam dostęp do Twojej witryny, jaki przyznano MSNBot.”

Praktyczna konsekwencja: reguła Disallow wobec bingbot nie kosztuje Cię „tylko Binga”. Od razu rozprzestrzenia się na cały ten ekosystem. Niezależnie od tego, czy zależy Ci konkretnie na Bingu, czy nie, Bingbot jest bramą do znaczącej części przeszukiwalnej sieci — i coraz częściej do odpowiedzi AI.

Ciąg user-agenta (i dlaczego jest wiecznie aktualny)

User-agent Bingbota zawiera token bingbot/2.0 oraz numer wersji Chrome/W.X.Y.Z oparty na Chromium, gdzie W.X.Y.Z jest zastępowane aktualną stabilną kompilacją Microsoft Edge (własny przykład Microsoftu: 100.0.4896.127) — to właśnie podstawienie czyni ten ciąg wiecznie aktualnym. Zgodnie z ogłoszeniem Microsoftu z kwietnia 2022 r. dotyczącym sfinalizowanych ciągów, desktopowy UA to Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm) Chrome/W.X.Y.Z Safari/537.36, a mobilny UA to Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/W.X.Y.Z Mobile Safari/537.36 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm). Wcześniejszy podgląd tych ciągów z grudnia 2019 r. proponował też dodatkowy końcowy fragment Edg/W.X.Y.Z, ale nie ma go w finalnych ciągach opublikowanych przez Microsoft w 2022 r. i potwierdzonych jako w pełni działające w lutym 2023 r. — jeśli dopasowujesz UA bingbota w kodzie, nie wymagaj go. Starszy, starszy ciąg to goły Mozilla/5.0 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm).

„Wiecznie aktualny” oznacza dokładnie tyle, że numer wersji automatycznie śledzi najnowszy stabilny Edge. W praktyce zlikwidowało to starą dwupoziomową lukę między indeksowaniem a renderowaniem: ponieważ Bingbot działa na tej samej rodzinie silników Chromium co nowoczesny Edge i Chrome, renderuje JavaScript tak, jak robi to obecna przeglądarka. Bing traktuje też dobrą wiarę dynamicznego renderowania jako uzasadnioną opcję dla witryn z dużą ilością JS — w ich ocenie nie jest to cloaking.

Weryfikacja Bingbota — sam user-agent nie wystarczy

Ciągi user-agent można łatwo sfałszować, więc żądanie podające się za Bingbota samo w sobie niczego nie dowodzi. Wiarygodna kontrola to dwuetapowy odwrotny DNS:

  1. Odwrotne (PTR) wyszukiwanie adresu IP indeksującego z Twoich logów. Prawdziwy adres IP Bingbota rozwiązuje się do nazwy hosta kończącej się na search.msn.com — wzorzec to msnbot-<ip-with-dashes>.search.msn.com (więc 157.55.39.1msnbot-157-55-39-1.search.msn.com).
  2. Bezpośrednie (A) wyszukiwanie tej nazwy hosta. Musi ona rozwiązać się z powrotem do oryginalnego adresu IP.

Jeśli którykolwiek z tych kroków się nie powiedzie, to nie jest Bingbot. Microsoft publikuje listę adresów IP pod adresem bing.com/toolbox/bingbot.json (28 prefiksów IPv4, ostatnio wygenerowana w styczniu 2024 r.), ale zalecenie samej firmy to przedkładanie odwrotnego DNS nad listę adresów IP, ponieważ adresy mogą się zmieniać w dowolnym momencie. Traktuj JSON jako przybliżone odniesienie, a nie listę dozwolonych adresów w zaporze. (Ta sama logika odwrotnego DNS zamiast listy adresów IP dotyczy Googlebota — zobacz skrypty weryfikacyjne w zakładce Skrypty.)

Jak Bingbot odkrywa i indeksuje

Odkrywanie jest napędzane linkami. Fabrice Canel, wieloletni lider Bingbota w Microsoft, opisuje to podejście jako podążanie za ważnością: “We are guided by key pages that are important on the internet and we follow links to understand what’s next.” (tłumaczenie) «Kierujemy się kluczowymi stronami, które są ważne w internecie, i podążamy za linkami, aby zrozumieć, co będzie dalej.» Skala jest ogromna — w wywiadzie z 2019 roku Canel powiedział: “Every day, my team discovers more than 100 billion new URLs never seen before, while useless URLs parameters are ignored.” (tłumaczenie) «Codziennie mój zespół odkrywa ponad 100 miliardów nowych adresów URL, których nigdy wcześniej nie widział, a bezużyteczne parametry URL są ignorowane.» (Dane z 2020 roku mówią o około 70 miliardach nowych adresów URL dziennie; obie liczby są prawdziwe, ale pochodzą z różnych dat, więc warto podawać rok, gdy się na nie powołujesz.)

Dwie zachowania odróżniają Bingbota od tego, jak Google opisuje własnego crawlera:

  • Filtrowanie wstępne przed pobraniem. Bingbot podejmuje decyzję o koszcie/wartości, zanim w ogóle pobierze adres URL. Jak ujął to Bing: “Pages that are deemed to have absolutely no potential for being useful in satisfying a user’s search query in Bing results are not retained.” (tłumaczenie) «Strony, które uznano za niemające absolutnie żadnego potencjału, aby być przydatne w zaspokojeniu zapytania użytkownika w wynikach Bing, nie są przechowywane.»
  • Pamięć URL. Bingbot zapamiętuje adresy URL praktycznie na zawsze: “Bingbot retains every URL in memory and comes back and recrawls intermittently, even if all links to it have been removed.” (tłumaczenie) «Bingbot przechowuje każdy adres URL w pamięci i wraca, aby go okresowo ponownie przeszukiwać, nawet jeśli wszystkie linki do niego zostały usunięte.» Dlatego strona może nadal widzieć odwiedziny Bingbota długo po tym, jak usuniesz wszystkie wewnętrzne linki do niej.

Pod tym wszystkim kryje się postawa stawiająca uprzejmość na pierwszym miejscu. Canel: “Our default crawl policy is to be as polite as possible when crawling the web.” (tłumaczenie) «Nasza domyślna polityka indeksowania jest taka, aby być tak uprzejmym, jak to możliwe, podczas przeszukiwania sieci.» I jego szczera opinia o samym problemie: “Crawling right is a fascinating engineering problem that hasn’t fully been solved yet.” (tłumaczenie) «Prawidłowe indeksowanie to fascynujący problem inżynieryjny, który nie został jeszcze w pełni rozwiązany.»

Inne crawlery Microsoftu

Bingbot to nie jedyny bot Microsoftu, którego zobaczysz:

  • AdIdxBot (adidxbot) — crawler kontroli jakości Bing Ads. Warto wiedzieć, że dzieli budżet indeksowania z Bingbotem, więc intensywne indeksowanie reklam może uszczuplić budżet na Twoje organiczne strony.
  • BingPreview — generuje zrzuty stron i miniatury podglądów.
  • MicrosoftPreview — podglądy linków w Teams i Office.
  • BingVideoPreview — podglądy wideo wyświetlane tylko w Bing. Podobnie jak inne ma warianty desktopowe i mobilne, a identyfikuje się za pomocą +https://aka.ms/microsoftbots, a nie adresu URL bingbot.htm, którego używają starsze crawlera.
  • MSNBot / MSNBot-Media — starszy crawler, wycofany 1 października 2010 r.

Kontrolowanie indeksowania Bingbota

Trzy dźwignie, od ogólnych do precyzyjnych:

  • robots.txt — token bingbot kontroluje indeksowanie. Użyj go, aby trzymać bota z dala od miejsc o niskiej wartości; nie jest to narzędzie do usuwania z indeksu.
  • Crawl Control (Bing Webmaster Tools) — pozwala ustawić godzinowe tempo indeksowania Bingbota, dzięki czemu możesz je spowolnić w godzinach szczytu i przyspieszyć poza nimi. To prawdziwa różnica między Google a Bing: Google wycofał suwak tempa indeksowania w Search Console, podczas gdy Bing nadal daje Ci aktywną kontrolę.
  • IndexNow — zamiast czekać na ponowne indeksowanie, wypychasz zmianę. To protokół “created by Microsoft Bing and Yandex, allowing websites to easily notify search engines whenever their website content is created, updated, or deleted.” (tłumaczenie) «stworzony przez Microsoft Bing i Yandex, umożliwiający stronom internetowym łatwe powiadamianie wyszukiwarek za każdym razem, gdy ich treść jest tworzona, aktualizowana lub usuwana.» Jeden ping dociera do każdej uczestniczącej wyszukiwarki. Nie będę tutaj powielać pełnego opisu — zobacz szczegółowy przewodnik po IndexNow, aby poznać konfigurację, kluczowy plik i limit 10 000 adresów URL na żądanie.

Strategiczny punkt, do którego wracam: Bing naprawił reputację agresywnego indeksowania, stając się wydajnym, a IndexNow jest tego kluczowym elementem. Jak napisałem w mojej analizie indeksowania botów AI i wyszukiwarek, “It’s estimated that 53% of crawler traffic is wasted effort, and IndexNow can help cut that number down to almost nothing.” (tłumaczenie) «Szacuje się, że 53% ruchu crawlerów to zmarnowany wysiłek, a IndexNow może pomóc zmniejszyć tę liczbę do prawie zera.» Wypychanie zmian jest lepsze niż próby zachęcania do większej eksploracyjnej indeksacji.

Bingbot, Copilot i luka w rezygnacji z AI

Ponieważ indeks Bing zasila Microsoft Copilot, Bingbot jest de facto również botem AI. Wskazówki Canela dotyczące dobrego pozycjonowania się tam są konkretne: “schema markup helps Microsoft’s LLMs understand your content,” (tłumaczenie) «znaczniki schema pomagają modelom językowym Microsoftu zrozumieć Twoje treści» oraz “Gen AIs value fresh content in particular, partly as a reference check of their LLM training data. Use the API at indexnow.org to push that information as it’s published or updated.” (tłumaczenie) «Modele generatywnej AI szczególnie cenią świeże treści, częściowo jako weryfikację danych treningowych swoich modeli językowych. Użyj API na stronie indexnow.org, aby przesyłać te informacje w momencie ich publikacji lub aktualizacji.»

Jest pewien niuans, który artykuły konkurencji zwykle pomijają. Google oferuje token Google-Extended, który pozwala zrezygnować z trenowania AI bez wpływu na indeksowanie w wyszukiwarce. Według większości zewnętrznych interpretacji nie ma odpowiednika osobnej rezygnacji dla Binga — co oznacza, że zablokowanie bingbot w celu uniknięcia trenowania Copilota spowodowałoby również usunięcie z wyszukiwarki Bing i wszystkiego, co z niej wynika. Traktowałbym to jako obserwację dotyczącą obecnego stanu tych mechanizmów, a nie ustaloną politykę Microsoftu, i przed podjęciem działań sprawdziłbym aktualną dokumentację.

Aby zobaczyć, gdzie Bingbot wpisuje się w szerszy obraz — rodzina botów indeksujących, Googlebot, koncepcja user-agenta, boty AI, robots.txt i IndexNow — centrum poświęcone indeksowaniu łączy to wszystko.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.