Analizador de archivos de registro

Free, no signup. Server logs answer a question your analytics can't: what are crawlers actually doing on your site. Drop one in and see crawl budget by bot and by section, how much is wasted on 404s and redirects, how AI crawlers compare to search engines, and which requests are impostors faking a crawler user-agent.

Handles nginx / Apache (combined & common), IIS / W3C Extended, and JSON logs (incl. Cloudflare Logpush) — format auto-detected. Crawler ranges updated 24 days ago.

Drop your access log here
or ·
Multiple files allowed. Big logs stream in chunks.

Se ejecuta por completo en tu navegador: nada de lo que pegues se sube ni se almacena. Spot-checking a suspicious IP against the Googlebot Verifier sends only that IP to our server. Los contadores anónimos de resultados por ejecución pueden utilizarse para investigación agregada; nunca incluyen URL, dominios, IP ni identificadores, y no se publica ninguna estadística con menos de 100 ejecuciones.

Comentarios
Informar de un error

¿Algo no funciona en Analizador de archivos de registro? Cuéntanos qué ha ocurrido. El informe va directamente a una cola privada de revisión, no a una lista pública.

Datos que se enviarán
 No se adjuntan automáticamente entradas de la herramienta, archivos subidos, fuentes pegadas, resultados completos, parámetros de consulta ni fragmentos de URL. Puedes editar o eliminar arriba el pasaje seleccionado. Los metadatos del navegador y de protección contra abusos se procesan para prevenir spam. 

Acerca de esta herramienta

Un registro de acceso del servidor muestra cómo se comportan realmente los rastreadores en tu sitio: qué URL solicitan, qué códigos de estado reciben y qué partes del presupuesto de rastreo desperdician. Esta herramienta separa los rastreadores de búsqueda tradicional (como Googlebot), búsqueda con IA y entrenamiento, y señala los agentes de usuario sospechosos con pruebas de IP y DNS.

Los formatos de nginx, Apache, IIS/W3C y JSON (incluido Cloudflare Logpush) se analizan localmente; nada se sube. Los resultados describen el comportamiento de rastreo, no la indexación.

Funciones

  • Presupuesto de rastreo por bot con recuentos verificados, suplantados y no verificables, distribución de estados y porcentaje de desperdicio.
  • Desglose de bots de búsqueda, búsqueda con IA y entrenamiento por sección, además de una tendencia diaria a lo largo del tiempo.
  • Informe de suplantadores con comprobación de DNS inverso y ASN para las IP sospechosas.
  • Recomendaciones clasificadas con líneas Disallow de robots.txt listas para copiar y exportación CSV de bots y URL desperdiciadas.

Cómo funciona

Suelta uno o varios archivos de registro en el área de carga o usa los datos de ejemplo. El formato se detecta automáticamente, los archivos grandes se transmiten por fragmentos y cada línea recibe atributos de bot, IP, estado y ruta. Después, el analizador calcula el presupuesto, el desperdicio y las tendencias, comprueba en directo las IP sospechosas y ordena reparaciones concretas.

Limitaciones

  • La herramienta solo ve las solicitudes que tu servidor registró; no puede explicar por qué un rastreador eligió una URL ni demostrar si se indexó.
  • Los rastreadores sin intervalos de IP publicados quedan como no verificables, en lugar de clasificarse como genuinos o falsos.
  • Las secciones se deducen de las rutas de URL; la agrupación es una vista del registro y no un informe completo del estado del sitio.

Preguntas frecuentes

¿Mis archivos de registro se suben a algún lugar?

No. El análisis se ejecuta por completo en el navegador mediante un hilo auxiliar: el archivo se lee del disco y se procesa localmente por fragmentos. La única excepción es la comprobación opcional de una IP en el informe de suplantación, que envía solo esa IP al verificador para consultar la resolución inversa confirmada y el propietario de red. Al cerrar la pestaña desaparecen todos los datos procesados.

¿Qué formatos de registro admite?

El formato se detecta automáticamente. Lee formatos habituales de servidores web, el formato ampliado de Microsoft y registros JSON, incluidas exportaciones de proveedores perimetrales. Puedes soltar varios archivos a la vez; los grandes se procesan por fragmentos para que incluso varios gigabytes no bloqueen la pestaña.

¿Cómo distingue un rastreador auténtico de uno suplantado?

Cada solicitud se asocia con un rastreador conocido mediante el agente de usuario y después se compara la IP de origen con los intervalos publicados por el operador, actualizados semanalmente. Una cadena de Googlebot procedente de una IP ajena a Google se marca como posible suplantación. Algunos operadores no publican intervalos, por lo que esos accesos se marcan como no verificables.

¿Qué se considera desperdicio del presupuesto de rastreo?

Cualquier solicitud de robot que recibe una redirección, salvo una revalidación útil 304 sin cambios, un fallo 4xx como 404 o 410, o un fallo de servidor 5xx. La herramienta agrupa el desperdicio por robot, sección y URL concreta para mostrar dónde están las correcciones de mayor impacto.

¿Puedo bloquear suplantadores con robots.txt?

No. Los impostores declaran un agente de rastreador precisamente para ignorar robots.txt; bloquéalos por IP o propietario de red en el perímetro o cortafuegos. robots.txt sí sirve para rastreadores genuinos que desperdician recursos en secciones que no quieres rastrear, y la sección de recomendaciones genera reglas de exclusión listas para copiar.

Siguiente pasoGenerador de robots.txt — generate the corrected version. La orientación está disponible en inglés.