Generador y validador de llms.txt
Free, no signup. Build a clean llms.txt that points LLMs at your key pages, or paste one you already have and check that it's well-formed.
| Check | Status when healthy |
|---|---|
| H1 | One site-name H1 |
| Summary | A short blockquote is recommended |
| Links | Grouped, absolute HTTPS URLs |
| Size | Keep the map concise (under ~20 KiB) |
llms.txt is a community proposal
(llmstxt.org), not an official standard.
No major AI crawler is documented to read it today. Treat it as low-effort, low-risk housekeeping —
not a ranking lever. If you want to influence what AI systems can access, that's
robots.txt and your on-page content, not this file.
More on how AI crawlers actually work → Upload your own access log to the Log File Analyzer. Its browser-local /llms.txt report distinguishes verified AI crawler requests, unverifiable crawler claims, spoofed claims, other traffic, and no observation in the supplied period. A request is retrieval evidence only—not proof of rankings, citations, or broad provider adoption.
The Optional section (a crawler may skip it) is emitted last automatically — just name a section “Optional”.
Se ejecuta por completo en tu navegador: nada de lo que pegues se sube ni se almacena. Los contadores anónimos de resultados por ejecución pueden utilizarse para investigación agregada; nunca incluyen URL, dominios, IP ni identificadores, y no se publica ninguna estadística con menos de 100 ejecuciones.
We fetch only <domain>/llms.txt (nothing else) — browsers can't, because of CORS.
Se ejecuta por completo en tu navegador: nada de lo que pegues se sube ni se almacena. Fetch by URL sends only the domain to our server to retrieve /llms.txt (browsers can't — CORS); validation still runs locally. Los contadores anónimos de resultados por ejecución pueden utilizarse para investigación agregada; nunca incluyen URL, dominios, IP ni identificadores, y no se publica ninguna estadística con menos de 100 ejecuciones.
+ guarda el sitio o la página actuales. Usa ☆ junto a cualquier sitio, página o lista guardados para añadirlos a favoritos. El historial de comprobaciones recientes aparece debajo.
Crear una lista con nombre
Destino rellenado desde tus selecciones locales.
Pasaporte del sitio Contexto local de este sitio guardado
Datos locales
Los destinos guardados, las listas con nombre y los resúmenes de comprobaciones recientes permanecen solo en este navegador.
Valorar esta herramienta
Where this is heading: serving Markdown to LLMs
Looking ahead — not something to do today. llms.txt and per-page Markdown are proposals no major AI crawler is documented to consume yet.
llms.txt is a directory — one file pointing at your key pages. The more interesting
idea, once AI clients adopt it, is content negotiation: same URL, two representations.
Serve HTML to browsers and a clean Markdown rendering to LLM clients,
and decide which at the edge.
A Cloudflare Worker picks the representation from the request — either
Accept: text/markdown or a known AI user-agent — and emits
Vary: Accept (or Vary: User-Agent) so shared caches don't hand the wrong
variant to the wrong client.
It's exactly the move behind this site's hybrid /robots.txt —
same bytes, only the Content-Type label negotiated — just extended to actual content,
and to a real body difference rather than only a header.
Acerca de esta herramienta
Genera o valida un archivo llms.txt bien estructurado para orientar a los LLM hacia tus páginas importantes. Comprueba el título H1, el resumen en cita, las secciones, los enlaces HTTPS absolutos, las URL duplicadas y los enlaces externos, sin afirmar que un sistema de IA lea realmente el archivo.
llms.txt es una propuesta comunitaria, no un estándar oficial; ningún rastreador de IA importante está documentado como lector de este archivo. Úsalo como un mapa claro de tus páginas, no como una garantía de posicionamiento o de citas.
Funciones
- Generador guiado con nombre del sitio, resumen, secciones y filas de enlaces.
- Validador de H1 y resúmenes ausentes, enlaces relativos o mal formados, enlaces HTTP, URL duplicadas, enlaces externos y estructura.
- Rellenado desde sitemap.xml, con agrupación de URL por el primer segmento de la ruta y una URL del sitio opcional para señalar enlaces externos.
- Resultados inmediatos con recuentos de errores, advertencias e información, además de copiar, descargar y compartir; todo permanece local salvo la recuperación opcional de una URL.
Cómo funciona
En la pestaña Generar, introduce el nombre del sitio, el resumen y las secciones; el generador produce un título # H1, un resumen > opcional y secciones ## con enlaces Markdown - [título](https://url). En la pestaña Validar, pega, carga o recupera /llms.txt desde un dominio; los hallazgos se clasifican por gravedad y se muestran con una vista previa.
Limitaciones
- La comprobación cubre la forma y la estructura; no mide si un sistema de IA lee el archivo ni si los enlaces son accesibles.
- Por encima de unos 20 KiB, el archivo se marca como demasiado grande para un mapa conciso; el contenido completo se sirve mejor por página mediante Markdown y negociación de contenido.
- La recuperación de una URL pasa por un proxy CORS limitado; los datos pegados o cargados permanecen en el navegador y no se conservan.
Preguntas frecuentes
¿Los rastreadores de IA realmente leen llms.txt?
No de forma documentada. llms.txt es una propuesta comunitaria de llmstxt.org, no un estándar oficial; ningún rastreador principal de IA —OpenAI, Google, Anthropic o Perplexity— ha publicado compatibilidad para leerlo. Trátalo como mantenimiento de poco esfuerzo y bajo riesgo, un mapa ordenado de tus mejores páginas, no como una palanca de posicionamiento. Lo que los sistemas de IA pueden alcanzar depende de robots.txt y del contenido de tus páginas.
¿Qué debe contener un archivo llms.txt?
Un título H1 obligatorio «# » con el nombre del sitio, seguido preferiblemente de un resumen de una línea en una cita «> ». Añade encabezados de sección «## », por ejemplo Documentación y Guías, cada uno con una lista de enlaces Markdown en el formato «- [título](url): notas opcionales». Una sección especial «## Optional» reúne los enlaces que un rastreador puede omitir. Cada URL debe ser una dirección absoluta https:// que el LLM pueda obtener directamente.
¿Dónde se coloca un archivo llms.txt en mi sitio?
En la raíz del dominio, en https://site.example/llms.txt, según la misma regla de ubicación que robots.txt. Este validador puede recuperar esa ruta exacta para cualquier dominio mediante un pequeño intermediario del servidor, porque los navegadores no pueden hacer solicitudes entre orígenes; así puedes comprobar un archivo publicado sin pegarlo.
¿Qué comprueba el validador?
Comprueba la forma del archivo según la propuesta, no si un sistema lo lee. Señala la falta de un título H1 como fallo, el resumen ausente como advertencia, las URL mal formadas o relativas, los enlaces http://, las URL duplicadas, los enlaces antes de cualquier sección, los encabezados profundos «### » fuera de la estructura, los enlaces externos y los archivos demasiado grandes para seguir siendo un mapa conciso. No puede garantizar que un sistema de IA utilice el archivo.
¿Qué tamaño debe tener llms.txt?
Pequeño. Es un directorio de enlaces, no una copia del contenido. El validador muestra una información cuando el archivo supera aproximadamente 20 KiB; a ese tamaño normalmente ya no es un mapa conciso y empieza a duplicar páginas. Para ofrecer a los LLM contenido completo y limpio, usa Markdown por página y negociación de contenido, no un archivo llms.txt más grande.
Problemas habituales y cómo solucionarlos
- Error El archivo contiene varios títulos H1 Solución: Conserva exactamente un H1 para el nombre del sitio y convierte los demás encabezados de nivel superior en secciones H2.
- Error La URL del enlace es relativa Solución: Sustituye el enlace relativo por una URL HTTPS completa que un rastreador pueda obtener directamente.
- Error La URL del enlace no es válida Solución: Corrige el destino mal formado del enlace para convertirlo en una URL HTTPS absoluta y válida.
- Advertencia La URL del enlace utiliza HTTP Solución: Cambia el enlace HTTP por su equivalente HTTPS que funcione.
- Información El enlace apunta a otro host Solución: Elimina el enlace a otro host o colócalo en el archivo llms.txt que pertenezca a dicho host.
- Error El archivo no tiene un título H1 Solución: Añade exactamente un # H1 al principio con el nombre del sitio o del proyecto.
- Advertencia El archivo no tiene un bloque de cita de resumen Solución: Añade un resumen breve en un bloque que empiece por > inmediatamente después del H1.
- Información El resumen no aparece justo después del título Solución: Mueve el bloque de cita del resumen justo debajo del H1 y antes de cualquier encabezado de sección.
- Advertencia Ninguna sección contiene enlaces Solución: Añade enlaces HTTPS absolutos y útiles bajo encabezados de sección H2 descriptivos.
- Advertencia La sección opcional no es la última Solución: Mueve la sección ## Optional después de todas las secciones de enlaces obligatorias o principales.
- Advertencia La URL del enlace está duplicada Solución: Conserva la URL una sola vez en su sección más pertinente y elimina las entradas duplicadas.
- Información El archivo es demasiado grande para ser un mapa conciso Solución: Elimina los enlaces y las descripciones de poco valor hasta que el archivo sea un mapa conciso de menos de unos 20 KiB.
- Error El archivo está vacío Solución: Añade un H1, un resumen breve y enlaces HTTPS absolutos agrupados hacia los recursos principales del sitio.