Generador y validador de llms.txt

Free, no signup. Build a clean llms.txt that points LLMs at your key pages, or paste one you already have and check that it's well-formed.

llms.txt structural rubric
CheckStatus when healthy
H1 One site-name H1
Summary A short blockquote is recommended
Links Grouped, absolute HTTPS URLs
Size Keep the map concise (under ~20 KiB)

Source: llmstxt.org proposal; not a crawler-consumption guarantee

Heads up: llms.txt is a community proposal (llmstxt.org), not an official standard. No major AI crawler is documented to read it today. Treat it as low-effort, low-risk housekeeping — not a ranking lever. If you want to influence what AI systems can access, that's robots.txt and your on-page content, not this file. More on how AI crawlers actually work →
Want evidence instead of assumptions?

Upload your own access log to the Log File Analyzer. Its browser-local /llms.txt report distinguishes verified AI crawler requests, unverifiable crawler claims, spoofed claims, other traffic, and no observation in the supplied period. A request is retrieval evidence only—not proof of rankings, citations, or broad provider adoption.

The Optional section (a crawler may skip it) is emitted last automatically — just name a section “Optional”.

Output — llms.txt

Se ejecuta por completo en tu navegador: nada de lo que pegues se sube ni se almacena. Los contadores anónimos de resultados por ejecución pueden utilizarse para investigación agregada; nunca incluyen URL, dominios, IP ni identificadores, y no se publica ninguna estadística con menos de 100 ejecuciones.

Where this is heading: serving Markdown to LLMs

Looking ahead — not something to do today. llms.txt and per-page Markdown are proposals no major AI crawler is documented to consume yet.

llms.txt is a directory — one file pointing at your key pages. The more interesting idea, once AI clients adopt it, is content negotiation: same URL, two representations. Serve HTML to browsers and a clean Markdown rendering to LLM clients, and decide which at the edge.

A Cloudflare Worker picks the representation from the request — either Accept: text/markdown or a known AI user-agent — and emits Vary: Accept (or Vary: User-Agent) so shared caches don't hand the wrong variant to the wrong client.

It's exactly the move behind this site's hybrid /robots.txt — same bytes, only the Content-Type label negotiated — just extended to actual content, and to a real body difference rather than only a header.

Acerca de esta herramienta

Genera o valida un archivo llms.txt bien estructurado para orientar a los LLM hacia tus páginas importantes. Comprueba el título H1, el resumen en cita, las secciones, los enlaces HTTPS absolutos, las URL duplicadas y los enlaces externos, sin afirmar que un sistema de IA lea realmente el archivo.

llms.txt es una propuesta comunitaria, no un estándar oficial; ningún rastreador de IA importante está documentado como lector de este archivo. Úsalo como un mapa claro de tus páginas, no como una garantía de posicionamiento o de citas.

Funciones

  • Generador guiado con nombre del sitio, resumen, secciones y filas de enlaces.
  • Validador de H1 y resúmenes ausentes, enlaces relativos o mal formados, enlaces HTTP, URL duplicadas, enlaces externos y estructura.
  • Rellenado desde sitemap.xml, con agrupación de URL por el primer segmento de la ruta y una URL del sitio opcional para señalar enlaces externos.
  • Resultados inmediatos con recuentos de errores, advertencias e información, además de copiar, descargar y compartir; todo permanece local salvo la recuperación opcional de una URL.

Cómo funciona

En la pestaña Generar, introduce el nombre del sitio, el resumen y las secciones; el generador produce un título # H1, un resumen > opcional y secciones ## con enlaces Markdown - [título](https://url). En la pestaña Validar, pega, carga o recupera /llms.txt desde un dominio; los hallazgos se clasifican por gravedad y se muestran con una vista previa.

Limitaciones

  • La comprobación cubre la forma y la estructura; no mide si un sistema de IA lee el archivo ni si los enlaces son accesibles.
  • Por encima de unos 20 KiB, el archivo se marca como demasiado grande para un mapa conciso; el contenido completo se sirve mejor por página mediante Markdown y negociación de contenido.
  • La recuperación de una URL pasa por un proxy CORS limitado; los datos pegados o cargados permanecen en el navegador y no se conservan.

Preguntas frecuentes

¿Los rastreadores de IA realmente leen llms.txt?

No de forma documentada. llms.txt es una propuesta comunitaria de llmstxt.org, no un estándar oficial; ningún rastreador principal de IA —OpenAI, Google, Anthropic o Perplexity— ha publicado compatibilidad para leerlo. Trátalo como mantenimiento de poco esfuerzo y bajo riesgo, un mapa ordenado de tus mejores páginas, no como una palanca de posicionamiento. Lo que los sistemas de IA pueden alcanzar depende de robots.txt y del contenido de tus páginas.

¿Qué debe contener un archivo llms.txt?

Un título H1 obligatorio «# » con el nombre del sitio, seguido preferiblemente de un resumen de una línea en una cita «> ». Añade encabezados de sección «## », por ejemplo Documentación y Guías, cada uno con una lista de enlaces Markdown en el formato «- [título](url): notas opcionales». Una sección especial «## Optional» reúne los enlaces que un rastreador puede omitir. Cada URL debe ser una dirección absoluta https:// que el LLM pueda obtener directamente.

¿Dónde se coloca un archivo llms.txt en mi sitio?

En la raíz del dominio, en https://site.example/llms.txt, según la misma regla de ubicación que robots.txt. Este validador puede recuperar esa ruta exacta para cualquier dominio mediante un pequeño intermediario del servidor, porque los navegadores no pueden hacer solicitudes entre orígenes; así puedes comprobar un archivo publicado sin pegarlo.

¿Qué comprueba el validador?

Comprueba la forma del archivo según la propuesta, no si un sistema lo lee. Señala la falta de un título H1 como fallo, el resumen ausente como advertencia, las URL mal formadas o relativas, los enlaces http://, las URL duplicadas, los enlaces antes de cualquier sección, los encabezados profundos «### » fuera de la estructura, los enlaces externos y los archivos demasiado grandes para seguir siendo un mapa conciso. No puede garantizar que un sistema de IA utilice el archivo.

¿Qué tamaño debe tener llms.txt?

Pequeño. Es un directorio de enlaces, no una copia del contenido. El validador muestra una información cuando el archivo supera aproximadamente 20 KiB; a ese tamaño normalmente ya no es un mapa conciso y empieza a duplicar páginas. Para ofrecer a los LLM contenido completo y limpio, usa Markdown por página y negociación de contenido, no un archivo llms.txt más grande.

Siguiente pasoEstimador de volumen de búsqueda en IA — score it against a calibrated model. La orientación está disponible en inglés.