Generador de sitemaps XML
Bounded and polite: at most three page requests run at once; each request is capped at 900 KB/10 seconds, and the server also rate-limits each target host. This is a sitemap seed, not a full-site crawler.
Las comprobaciones se ejecutan desde nuestro servidor; consultamos la URL que introduces y no conservamos los resultados. The start site, its robots.txt, and eligible same-host HTML pages are sent through this site's bounded fetch endpoints. Crawl decisions and XML generation run in your browser. Los contadores anónimos de resultados por ejecución pueden utilizarse para investigación agregada; nunca incluyen URL, dominios, IP ni identificadores, y no se publica ninguna estadística con menos de 100 ejecuciones.
+ guarda el sitio o la página actuales. Usa ☆ junto a cualquier sitio, página o lista guardados para añadirlos a favoritos. El historial de comprobaciones recientes aparece debajo.
Crear una lista con nombre
Destino rellenado desde tus selecciones locales.
Pasaporte del sitio Contexto local de este sitio guardado
Datos locales
Los destinos guardados, las listas con nombre y los resúmenes de comprobaciones recientes permanecen solo en este navegador.
Sitemap output
Excluded
Unknown / not included
Valorar esta herramienta
Acerca de esta herramienta
Gratis y sin registro. Rastrea un conjunto limitado de páginas del mismo sitio, respeta robots.txt, excluye URL con noindex o canonical externo y descarga un sitemap XML que distingue claramente lo incluido, excluido y desconocido.
Funciones
- Permite elegir un máximo de 25, 50, 100 o 200 páginas y avisa si la cola sigue pendiente al alcanzar ese límite.
- Respeta las reglas de Googlebot en robots.txt y excluye páginas con noindex o canonical que apunta a otra URL.
- Mantiene como desconocidas las respuestas fallidas, no HTML, truncadas o distintas de 2xx en vez de incluirlas silenciosamente.
- Solo emite lastmod cuando encuentra un HTTP Last-Modified válido, un time datetime visible o dateModified/datePublished en JSON-LD.
Cómo funciona
Desde la Start URL, el rastreador sigue enlaces del mismo sitio hasta el máximo seleccionado, consulta robots.txt y evalúa estado HTTP, tipo de contenido, noindex y canonical. Las páginas aptas se convierten en entradas XML; las excluidas y desconocidas se informan aparte, y lastmod solo se añade a partir de evidencia de fecha válida.
Limitaciones
- Es una semilla limitada, no un rastreador completo: ejecuta como máximo tres solicitudes simultáneas, limita cada respuesta a 900 KB/10 segundos y aplica límites por host.
- No asigna la fecha actual a todas las páginas y no puede confirmar URL que no descubre dentro del máximo elegido o que quedan en estado desconocido.
Preguntas frecuentes
¿Rastreará todo mi sitio?
No. Eliges un límite estricto de hasta 200 páginas. La herramienta indica si la cola sigue ocupada al alcanzarlo, de modo que nunca presenta un rastreo limitado como completo.
¿Qué páginas se excluyen?
Se excluyen las que tienen noindex en cabecera o meta, un canonical hacia otra URL o están bloqueadas para el robot de Google en robots.txt. Los fallos, respuestas no HTML, truncadas o fuera de 2xx permanecen en un estado desconocido separado.
¿Cómo se elige lastmod?
Solo se emite una cabecera HTTP Last-Modified válida, un atributo datetime mostrado o un valor JSON-LD dateModified/datePublished. La herramienta nunca asigna la fecha actual a todas las páginas.
Problemas habituales y cómo solucionarlos
- Advertencia La página con noindex se excluye del sitemap Solución: Elimina noindex si la página debe indexarse; de lo contrario, mantenla fuera del sitemap.
- Advertencia La página que no devuelve 200 se excluye del sitemap Solución: Restaura una respuesta 200 directa para la página canónica o deja fuera del sitemap la URL que no devuelva 200.
- Advertencia La página que declara otra referencia canónica se excluye Solución: Incluye solo el destino canónico y mantén fuera del sitemap la URL que declara otra referencia canónica.
- Información Se elimina la URL duplicada Solución: Conserva una entrada de URL canónica normalizada y elimina las grafías duplicadas o las variantes de parámetros.
- Advertencia La URL no válida se excluye Solución: Corrige la URL absoluta mal formada antes de añadirla al sitemap.
- Advertencia La URL de otro host se excluye Solución: Genera un sitemap independiente para el otro host verificado y mantén este sitemap limitado a su propio host.