Weryfikator Googlebot

Crawler lists updated 24 days ago.

Pick the bot the user-agent string claims — spoof detection only runs when there's a claim to test. Try it with a real one: — fills the form; press Verify to run the check (checks are rate-limited).

Kontrole są uruchamiane na naszym serwerze; pobieramy podany adres URL i nie przechowujemy wyników. Submitted IPs are checked in memory, never stored. Anonymous aggregate verdict counts feed our research posts; domains are counted once via an anonymized hash, never stored in the clear. Anonimowe liczniki wyników poszczególnych uruchomień mogą być wykorzystywane do badań zbiorczych; adresy URL, domeny, adresy IP i identyfikatory nigdy nie są uwzględniane, a statystyki nie są publikowane poniżej 100 uruchomień.

Opinia
Zgłoś błąd

Coś nie działa w Weryfikator Googlebot? Opisz, co się stało — zgłoszenie trafi bezpośrednio do prywatnej kolejki weryfikacji, a nie na publiczną listę.

Dane, które zostaną wysłane
 Dane wejściowe narzędzia, przesłane pliki, wklejone źródła, pełne wyniki, parametry zapytania i fragmenty URL nie są dołączane automatycznie. Możesz edytować lub usunąć zaznaczony powyżej fragment. Metadane przeglądarki i ochrony przed nadużyciami są przetwarzane w celu zapobiegania spamowi. 

Bulk IPs or access-log lines

Paste up to 500 IPs or log lines. Published-range matching and user-agent claim extraction run entirely in your browser. Use Spot-check only for the few rows where you want live reverse-DNS confirmation.

Supported bots and verification methods

Not every operator makes verification possible. Some publish IP ranges and support reverse DNS, some publish ranges only, and some publish nothing at all — a user agent alone proves nothing, since any script can send any user-agent string.

BotOperatorTypePublished IP listReverse DNS
Googlebot · docs Google Search ✅ 315 ranges ✅ .googlebot.com, .google.com
Google special crawlers · docs Google Search ✅ 270 ranges ✅ .google.com
Google user-triggered fetchers · docs Google User-triggered ✅ 1550 ranges ✅ .gae.googleusercontent.com, .google.com, .googleusercontent.com
Bingbot · docs Microsoft Search ✅ 28 ranges ✅ .search.msn.com
YandexBot · docs Yandex Search ❌ none ✅ .yandex.ru, .yandex.net, .yandex.com
Baiduspider · docs Baidu Search ❌ none
Yeti · docs Naver Search ❌ none
GPTBot · docs OpenAI AI training ✅ 21 ranges
OAI-SearchBot · docs OpenAI AI search ✅ 35 ranges
ChatGPT-User · docs OpenAI User-triggered ✅ 258 ranges
ClaudeBot · docs Anthropic AI training ✅ 20 ranges
PerplexityBot · docs Perplexity AI search ✅ 8 ranges
Perplexity-User · docs Perplexity User-triggered ✅ 4 ranges
Applebot · docs Apple Search ✅ 12 ranges ✅ .applebot.apple.com
Amazonbot · docs Amazon AI training ❌ none ✅ .crawl.amazonbot.amazon
DuckDuckBot · docs DuckDuckGo Search ✅ 481 ranges
Meta-ExternalAgent · docs Meta AI training ❌ none
Bytespider ByteDance AI training ❌ none

How verification works

  1. Published-range check. The IP is matched against the operator's official IP range list (the same JSON files Google, Microsoft, OpenAI, Perplexity, Apple, and DuckDuckGo publish), refreshed weekly.
  2. Forward-confirmed reverse DNS (FCrDNS). For bots that support it, the IP's PTR record must resolve to an official hostname (e.g. crawl-66-249-66-1.googlebot.com) at a domain-label boundary, and a forward lookup of that hostname must answer the exact same IP. Both directions must agree — a PTR record alone is trivially fakeable.
  3. Naming the spoofer. When a claim fails both checks, the IP's actual network owner is looked up via its ASN, so the verdict says who it really is instead of just "not Googlebot."

The verdict tiers are deliberately distinct: reverse-DNS confirmed is proof; a published-list match is strong but not confirmation; and unverifiable bots such as Bytespider and Meta publish no machine-readable range list — treat those user agents with suspicion. ClaudeBot now has an official published list, so it can return a list match even though Anthropic does not document reverse-DNS verification.

Need evidence across many requests? Use the Log File Analyzer to inspect crawl budget by bot and section, status-code waste, and spoofing signals. Log parsing stays in your browser.

O tym narzędziu

Sprawdź, czy adres IP przedstawiający się jako Googlebot, Bingbot, GPTBot, ClaudeBot lub inny crawler jest autentyczny. Narzędzie porównuje opublikowane zakresy IP i potwierdzony odwrotny DNS, a w przypadku podszywania wskazuje rzeczywistego właściciela sieci.

Funkcje

  • Kontrola adresu IPv4 lub IPv6 względem oficjalnych zakresów oraz odwrotnego DNS potwierdzonego zapytaniem w przód.
  • Pięć odrębnych werdyktów: verified, published match, spoofed, unverifiable albo unknown bot.
  • Szczegółowe dowody obejmujące zakres, PTR, potwierdzenie w przód i właściciela ASN.
  • Gotowe reguły dla Cloudflare WAF, nginx i Apache, gdy bot został uznany za podszywający się.

Jak to działa

Narzędzie porównuje adres IP z oficjalnymi zakresami wybranego operatora, a następnie wykonuje odwrotne DNS i potwierdzenie w przód, jeśli operator publikuje taką metodę. Obie kontrole muszą prowadzić do oficjalnej nazwy hosta; w przeciwnym razie raport pokazuje ograniczenie lub zaobserwowanego właściciela ASN zamiast zgadywać.

Ograniczenia

  • Weryfikacja zależy od informacji publikowanych przez operatora i nie dowodzi zamiaru autentycznego bota.
  • Adresy IP są sprawdzane w pamięci, a listy zakresów okresowo odświeżane; werdykt opisuje bieżącą obserwację.

Częste pytania

Jak sprawdzić, czy Googlebot jest prawdziwy?

Pobierz adres IP z logów serwera, a nie sam ciąg identyfikujący robota, pod który każdy może się podszyć, i sprawdź go na dwa sposoby: porównaj z opublikowanymi zakresami IP Googlebot oraz wykonaj odwrotne wyszukiwanie DNS z potwierdzeniem w przód. Rekord PTR adresu IP powinien wskazywać nazwę hosta kończącą się na googlebot.com lub google.com, a wyszukiwanie tej nazwy w przód musi zwrócić ten sam adres IP. Narzędzie robi oba testy automatycznie po wklejeniu IP i wybraniu Googlebot.

Czym jest odwrotny DNS z potwierdzeniem w przód (FCrDNS)?

FCrDNS to dwukierunkowa kontrola DNS. Najpierw wyszukiwanie odwrotne zamienia IP na nazwę hosta za pomocą rekordu PTR, a następnie wyszukiwanie tej nazwy w przód musi prowadzić dokładnie do tego samego IP. Oba kierunki muszą być zgodne na oficjalnej granicy domeny. Sam rekord PTR niczego nie dowodzi, bo właściciel bloku IP może ustawić dowolny tekst; wiarygodność daje dopiero potwierdzenie w przód.

Dlaczego robot jest oznaczony jako „nieweryfikowalny”, a nie prawdziwy lub podszyty?

Niektórzy operatorzy, między innymi Bytespider i robot firmy Meta, nie publikują zakresów IP ani nie obsługują odwrotnego DNS, więc nie ma autorytatywnej kontroli ich deklaracji. Narzędzie zwraca „nieweryfikowalny” zamiast zgadywać. Anthropic nie należy już do tej grupy, ponieważ publikuje oficjalną listę adresów IP robota. Dopasowanie jest opisane jako zgodność z opublikowaną listą, nie potwierdzenie odwrotnego DNS, a sam ciąg identyfikujący robota nadal można podrobić.

Czy mogę zablokować fałszywy crawler po adresie IP?

Tak, a gdy werdykt wskazuje podszycie, narzędzie udostępnia gotowe reguły blokowania dla Cloudflare, nginx i Apache. Blokowanie pojedynczego IP jest jednak niekończącą się pogonią, bo sprawcy zmieniają adresy. Przy trwałym fałszywym ruchu skuteczniej blokować ASN, czyli właściciela sieci wskazanego w dowodach, albo użyć reguł zarządzania botami w zaporze.

Czy sprawdzany tutaj adres IP jest zapisywany w logach lub przechowywany?

Nie. Podane adresy IP są sprawdzane w pamięci względem opublikowanych zakresów i aktywnego DNS, bez zapisywania w magazynie. Same listy zakresów są odświeżane co tydzień z oficjalnych źródeł operatorów, więc werdykt opiera się na danych mających najwyżej kilka dni.

Następny krokGenerator mapy witryny XML — generate the corrected version. Wskazówki są dostępne po angielsku.