Verificador de bots
Crawler lists updated 24 days ago.
Published range snapshot is stale. Refresh the operator range files before relying on an IP-range verdict, then rerun the check.
Las comprobaciones se ejecutan desde nuestro servidor; consultamos la URL que introduces y no conservamos los resultados. Submitted IPs are checked in memory, never stored. Anonymous aggregate verdict counts feed our research posts; domains are counted once via an anonymized hash, never stored in the clear. Los contadores anónimos de resultados por ejecución pueden utilizarse para investigación agregada; nunca incluyen URL, dominios, IP ni identificadores, y no se publica ninguna estadística con menos de 100 ejecuciones.
Bulk IPs or access-log lines
Paste up to 500 IPs or log lines. Published-range matching and user-agent claim extraction run entirely in your browser. Use Spot-check only for the few rows where you want live reverse-DNS confirmation.
Pasaporte del sitio Contexto local de este sitio guardado
Datos locales
Los destinos guardados, las listas con nombre y los resúmenes de comprobaciones recientes permanecen solo en este navegador.
Why this verdict
Reproduce this result in an agent
Uses the same inputs as the result above. No request is made from this panel.
MCP tool
Arguments
Next steps
- Browse the crawler & AI bot reference
Compare search, AI-training, and AI-search bots, their published ranges, and what can actually be verified.
- Read the AI crawler reference
Understand the major crawlers, their purpose, and the trade-offs before blocking them.
- Check URL status codes
Use a URL list when you need to triage affected requests, not just one IP.
Copy-paste rules for the exact IP. Blocking a single IP is whack-a-mole — for persistent fake-crawler traffic, block by ASN or use your firewall's bot rules.
Valorar esta herramienta
Supported bots and verification methods
Not every operator makes verification possible. Some publish IP ranges and support reverse DNS, some publish ranges only, and some publish nothing at all — a user agent alone proves nothing, since any script can send any user-agent string.
| Bot | Operator | Type | Published IP list | Reverse DNS |
|---|---|---|---|---|
| Googlebot · docs | Search | ✅ 315 ranges | ✅ .googlebot.com, .google.com | |
| Google special crawlers · docs | Search | ✅ 270 ranges | ✅ .google.com | |
| Google user-triggered fetchers · docs | User-triggered | ✅ 1550 ranges | ✅ .gae.googleusercontent.com, .google.com, .googleusercontent.com | |
| Bingbot · docs | Microsoft | Search | ✅ 28 ranges | ✅ .search.msn.com |
| YandexBot · docs | Yandex | Search | ❌ none | ✅ .yandex.ru, .yandex.net, .yandex.com |
| Baiduspider · docs | Baidu | Search | ❌ none | ❌ |
| Yeti · docs | Naver | Search | ❌ none | ❌ |
| GPTBot · docs | OpenAI | AI training | ✅ 21 ranges | ❌ |
| OAI-SearchBot · docs | OpenAI | AI search | ✅ 35 ranges | ❌ |
| ChatGPT-User · docs | OpenAI | User-triggered | ✅ 258 ranges | ❌ |
| ClaudeBot · docs | Anthropic | AI training | ✅ 20 ranges | ❌ |
| PerplexityBot · docs | Perplexity | AI search | ✅ 8 ranges | ❌ |
| Perplexity-User · docs | Perplexity | User-triggered | ✅ 4 ranges | ❌ |
| Applebot · docs | Apple | Search | ✅ 12 ranges | ✅ .applebot.apple.com |
| Amazonbot · docs | Amazon | AI training | ❌ none | ✅ .crawl.amazonbot.amazon |
| DuckDuckBot · docs | DuckDuckGo | Search | ✅ 481 ranges | ❌ |
| Meta-ExternalAgent · docs | Meta | AI training | ❌ none | ❌ |
| Bytespider | ByteDance | AI training | ❌ none | ❌ |
How verification works
- Published-range check. The IP is matched against the operator's official IP range list (the same JSON files Google, Microsoft, OpenAI, Perplexity, Apple, and DuckDuckGo publish), refreshed weekly.
- Forward-confirmed reverse DNS (FCrDNS). For bots that support it, the IP's PTR record must resolve to an official hostname (e.g.
crawl-66-249-66-1.googlebot.com) at a domain-label boundary, and a forward lookup of that hostname must answer the exact same IP. Both directions must agree — a PTR record alone is trivially fakeable. - Naming the spoofer. When a claim fails both checks, the IP's actual network owner is looked up via its ASN, so the verdict says who it really is instead of just "not Googlebot."
The verdict tiers are deliberately distinct: reverse-DNS confirmed is proof; a published-list match is strong but not confirmation; and unverifiable bots such as Bytespider and Meta publish no machine-readable range list — treat those user agents with suspicion. ClaudeBot now has an official published list, so it can return a list match even though Anthropic does not document reverse-DNS verification.
Need evidence across many requests? Use the Log File Analyzer to inspect crawl budget by bot and section, status-code waste, and spoofing signals. Log parsing stays in your browser.
Acerca de esta herramienta
Verifica un rastreador. Pega una dirección IP y obtén un veredicto mediante dos métodos independientes: los rangos de IP publicados por el operador y el DNS inverso con confirmación directa.
Una cadena user-agent puede afirmar que es Googlebot y mentir. Contrasta la IP con las fuentes publicadas para saber quién controla realmente la dirección.
Funciones
- Comprueba rangos de IP publicados y DNS inverso con confirmación directa —FCrDNS—. Si la identidad es falsa, muestra el propietario real de la red.
- Ofrece cinco veredictos distintos, incluido «No verificable» para operadores que no publican un rango legible por máquinas ni admiten DNS inverso.
- El panel de pruebas muestra el rango coincidente, hostname PTR, resultado de la confirmación directa y propietario del ASN.
- Genera reglas de bloqueo listas para copiar para Cloudflare WAF, nginx y Apache cuando una IP se marca como suplantada.
Cómo funciona
Obtén la dirección IP de los logs del servidor, no de la cadena user-agent. La herramienta la compara con los rangos oficiales publicados por el operador y, cuando existe un método documentado, resuelve el PTR y confirma hacia delante que el hostname vuelve a la misma IP. También consulta el propietario ASN como contexto; la identidad verificada no demuestra la intención del rastreador.
Limitaciones
- Algunos operadores, como Bytespider y Meta, no publican rangos de IP ni ofrecen DNS inverso, por lo que sus afirmaciones solo pueden clasificarse como no verificables. Anthropic sí publica ahora una lista oficial: una coincidencia con ella no equivale a una confirmación por DNS inverso. Un user-agent siempre puede falsificarse.
- Admite IPv4 e IPv6. Las IP se comprueban en memoria y no se almacenan; las listas de rangos se actualizan semanalmente, por lo que un snapshot antiguo debe renovarse antes de confiar en el veredicto.
Preguntas frecuentes
¿Cómo verifico que Googlebot es auténtico?
Usa la IP de los registros, no solo la cadena declarada. Compárala con rangos publicados y realiza una consulta inversa confirmada: el registro inverso debe terminar en un dominio oficial y resolver de nuevo a la misma IP.
¿Qué es una consulta inversa confirmada hacia delante?
Es una comprobación bidireccional: una consulta inversa convierte la IP en nombre de servidor y la consulta directa debe devolver la misma IP. Ambas direcciones deben coincidir.
¿Por qué un robot aparece como no verificable?
Algunos operadores no publican rangos ni admiten consultas inversas. La herramienta indica no verificable en vez de adivinar; una cadena declarada por sí sola puede falsificarse.
¿Puedo bloquear por IP un robot falso?
Sí, pero una IP aislada cambia con facilidad. Para tráfico persistente suele ser mejor actuar por propietario de red o reglas de gestión de robots del cortafuegos.
¿Se almacena o registra la IP comprobada?
No. Se compara en memoria con rangos publicados y consultas activas. Las listas se actualizan semanalmente desde fuentes oficiales.
Problemas habituales y cómo solucionarlos
- Error La IP del rastreador está fuera del intervalo publicado por el operador Solución: Trata el rastreador como no verificado y bloquéalo o investígalo hasta que su IP coincida con un intervalo publicado.
- Error El DNS inverso no coincide con el rastreador declarado Solución: Trata la solicitud como no verificada salvo que el DNS inverso termine en el dominio publicado por el operador del rastreador; bloquea o investiga las discrepancias.
- Error El DNS directo no confirma el host inverso Solución: Resuelve el nombre de host del DNS inverso y exige que apunte de nuevo a la IP solicitante antes de confiar en el rastreador.
- Advertencia La identidad del rastreador no se puede verificar de forma concluyente Solución: Recopila la evidencia que falta y trata el resultado como no verificado hasta que pueda confirmarse.
- Advertencia La instantánea de intervalos publicados está obsoleta Solución: Actualiza la instantánea de intervalos del operador y vuelve a ejecutar la verificación antes de confiar en el veredicto sobre la IP.