Probador de robots.txt

1. robots.txt
2. Pages to test
3. Bots

Se ejecuta por completo en tu navegador: nada de lo que pegues se sube ni se almacena. The server is only used to fetch a site's robots.txt or sitemap (browsers can't — no CORS). Los contadores anónimos de resultados por ejecución pueden utilizarse para investigación agregada; nunca incluyen URL, dominios, IP ni identificadores, y no se publica ninguna estadística con menos de 100 ejecuciones.

Comentarios
Informar de un error

¿Algo no funciona en Probador de robots.txt? Cuéntanos qué ha ocurrido. El informe va directamente a una cola privada de revisión, no a una lista pública.

Datos que se enviarán
 No se adjuntan automáticamente entradas de la herramienta, archivos subidos, fuentes pegadas, resultados completos, parámetros de consulta ni fragmentos de URL. Puedes editar o eliminar arriba el pasaje seleccionado. Los metadatos del navegador y de protección contra abusos se procesan para prevenir spam. 

Acerca de esta herramienta

Audita con un clic el acceso de los principales rastreadores de IA, LLM y buscadores.

Consulta un dominio, pega una lista de URL o carga URL desde un sitemap, incluido un robots.txt activo e independiente para cada subdominio proporcionado, con un máximo de 10 orígenes por ejecución.

Funciones

  • Coincidencia compatible con Google: prevalece la regla más específica, con comodines, herencia del subagente y reglas según el código de estado.
  • Añade un grupo de user-agent para cada bot de IA —como GPTBot, Google-Extended, ClaudeBot, CCBot y PerplexityBot— con Disallow: /. Usa el botón de auditoría de rastreadores de IA para cargarlos y confirmar qué regla coincide. Respetar robots.txt es voluntario; los bots fiables lo hacen, pero no es un mecanismo de control de acceso.
  • Google renderiza las páginas para entenderlas. Si no puede obtener el CSS y JavaScript necesarios, puede interpretar mal el diseño, el contenido o la compatibilidad móvil. Permite los recursos necesarios para el renderizado y bloquea únicamente rutas prescindibles.
  • robots.txt no avisa cuando un Disallow mal colocado oculta media web a Google. Prueba las URL con un comparador basado en el parser de Google.

Cómo funciona

El comparador utiliza el parser de robots.txt de código abierto de Google: prevalece la regla más específica, con comodines, herencia del subagente y reglas por código de estado. Compara cada URL con cada grupo de user-agent y muestra la regla ganadora, los conflictos y las advertencias de lint.

Limitaciones

  • La comparación se ejecuta por completo en el navegador: los archivos pegados nunca salen de tu dispositivo.
  • Aquí no se infiere el comportamiento de rastreadores ajenos a Google; consulta la documentación del rastreador antes de interpretar el resultado.

Preguntas frecuentes

¿robots.txt impide que una página se indexe?

No. Una regla de bloqueo impide el rastreo, no la indexación. Para excluir una página, permite rastrearla y añade noindex mediante meta robots o X-Robots-Tag; si también la bloqueas, Google no podrá ver noindex.

¿Importa el orden de las reglas en robots.txt?

No para Google. Aplica la regla más específica, es decir, la ruta coincidente más larga. Otros robots pueden usar la primera coincidencia, así que mantén reglas inequívocas.

¿Cuál es la diferencia entre bloquear y usar noindex?

Una regla de robots.txt evita que el robot obtenga una URL. noindex en una etiqueta meta o cabecera HTTP evita que permanezca en el índice. Combinarlos falla porque una página bloqueada no se obtiene y no se ve noindex.

¿Bloquear CSS o JavaScript en robots.txt perjudica al SEO?

Puede hacerlo. Google renderiza páginas; si no obtiene el CSS y JS necesarios, puede interpretar mal el diseño, contenido o adaptación móvil. Permite los recursos necesarios y bloquea solo rutas realmente prescindibles.

¿Cómo bloqueo robots de IA con robots.txt?

Añade un grupo específico para cada robot de IA con una regla que bloquee la raíz. El cumplimiento de robots.txt es voluntario y no constituye una medida de seguridad ni de restricción de acceso.

Siguiente pasoGenerador de robots.txt — generate a replacement robots.txt with the directives you meant to ship. La orientación está disponible en inglés.