Generator i walidator llms.txt

Free, no signup. Build a clean llms.txt that points LLMs at your key pages, or paste one you already have and check that it's well-formed.

llms.txt structural rubric
CheckStatus when healthy
H1 One site-name H1
Summary A short blockquote is recommended
Links Grouped, absolute HTTPS URLs
Size Keep the map concise (under ~20 KiB)

Source: llmstxt.org proposal; not a crawler-consumption guarantee

Heads up: llms.txt is a community proposal (llmstxt.org), not an official standard. No major AI crawler is documented to read it today. Treat it as low-effort, low-risk housekeeping — not a ranking lever. If you want to influence what AI systems can access, that's robots.txt and your on-page content, not this file. More on how AI crawlers actually work →
Want evidence instead of assumptions?

Upload your own access log to the Log File Analyzer. Its browser-local /llms.txt report distinguishes verified AI crawler requests, unverifiable crawler claims, spoofed claims, other traffic, and no observation in the supplied period. A request is retrieval evidence only—not proof of rankings, citations, or broad provider adoption.

The Optional section (a crawler may skip it) is emitted last automatically — just name a section “Optional”.

Output — llms.txt

Działa w całości w Twojej przeglądarce — nic, co wklejasz, nie jest przesyłane ani zapisywane. Anonimowe liczniki wyników poszczególnych uruchomień mogą być wykorzystywane do badań zbiorczych; adresy URL, domeny, adresy IP i identyfikatory nigdy nie są uwzględniane, a statystyki nie są publikowane poniżej 100 uruchomień.

Where this is heading: serving Markdown to LLMs

Looking ahead — not something to do today. llms.txt and per-page Markdown are proposals no major AI crawler is documented to consume yet.

llms.txt is a directory — one file pointing at your key pages. The more interesting idea, once AI clients adopt it, is content negotiation: same URL, two representations. Serve HTML to browsers and a clean Markdown rendering to LLM clients, and decide which at the edge.

A Cloudflare Worker picks the representation from the request — either Accept: text/markdown or a known AI user-agent — and emits Vary: Accept (or Vary: User-Agent) so shared caches don't hand the wrong variant to the wrong client.

It's exactly the move behind this site's hybrid /robots.txt — same bytes, only the Content-Type label negotiated — just extended to actual content, and to a real body difference rather than only a header.

O tym narzędziu

Utwórz poprawny plik llms.txt wskazujący LLM-om najważniejsze strony albo wklej istniejący plik i sprawdź jego strukturę — bezpłatnie, z jasnym wyjaśnieniem, że to jeszcze propozycja, a nie standard.

Funkcje

  • Formularzowe narzędzie z sekcjami, wierszami linków, podglądem wyniku na żywo i samoczynną walidacją.
  • Sprawdzanie wymaganego tytułu H1, podsumowania, składni Markdown, bezwzględnych adresów URL oraz duplikatów.
  • Pobieranie pliku llms.txt przez URL, wstępne wypełnianie z sitemap.xml i grupowanie adresów według ścieżki.
  • Kopiowanie, pobieranie i udostępnianie szkicu oraz generowanie czystego Markdownu dla klientów LLM.

Jak to działa

W zakładce Generuj wpisz nazwę witryny, jednowierszowe podsumowanie i sekcje linków, a następnie obserwuj wynik llms.txt. W zakładce Waliduj wklej plik lub pobierz go przez URL; sprawdź tytuł H1, składnię Markdown, bezwzględne adresy HTTPS, duplikaty i sekcję Optional, po czym popraw plik.

Ograniczenia

  • llms.txt to propozycja społeczności; nie ma udokumentowanego dużego crawlera AI, który dziś ją odczytuje, więc nie jest to dźwignia widoczności ani rankingu.
  • Walidator sprawdza strukturę, adresy HTTPS i Markdown, ale nie odwiedza linków, by potwierdzić ich działanie; pliki większe niż około 20 KiB przestają być zwięzłą mapą, a wynik nie dowodzi, że system AI pobierze plik.
  • Działa po stronie przeglądarki; jedyne żądanie serwera to pobieranie pliku /llms.txt przez CORS z /api/llms-fetch, a pliki i szkice nie opuszczają strony.

Częste pytania

Czy crawlery AI rzeczywiście czytają llms.txt?

Nie w żaden udokumentowany sposób. llms.txt to propozycja społeczności z llmstxt.org, nieoficjalna norma, a żaden główny crawler AI (OpenAI, Google, Anthropic, Perplexity) nie opublikował obsługi. Traktuj go jako prostą mapę najlepszych stron, nie dźwignię rankingową. Rzeczywisty dostęp systemów AI zależy od robots.txt i treści strony.

Co powinien zawierać plik llms.txt?

Jeden wymagany tytuł H1 „# ” z nazwą witryny, zalecane jednowierszowe podsumowanie w cytacie „> ”, potem nagłówki sekcji „## ” z listami linków Markdown w formie „- [tytuł](url): opcjonalne uwagi”. Specjalna sekcja „## Optional” zawiera linki możliwe do pominięcia. Każdy URL powinien być bezwzględnym adresem https://, który LLM może pobrać bezpośrednio.

Gdzie umieścić llms.txt w witrynie?

W katalogu głównym domeny pod https://site.example/llms.txt, zgodnie z konwencją robots.txt. Walidator może pobrać tę dokładną ścieżkę przez mały serwerowy pośrednik, aby sprawdzić aktywny plik bez wklejania.

Co sprawdza walidator?

Sprawdza formę pliku względem propozycji, nie to, czy ktoś go czyta. Oznacza brak H1, brak podsumowania, błędne lub względne URL, linki http://, duplikaty adresów URL, linki przed sekcją, głębokie nagłówki „### ”, linki zewnętrzne i zbyt duże pliki. Nie gwarantuje wykorzystania przez systemy AI.

Jak duży powinien być llms.txt?

Mały. To katalog linków, nie kopia treści. Walidator dodaje informację powyżej około 20 KiB, bo plik zwykle przestaje być wtedy zwięzłą mapą. Pełna czysta treść dla LLM powinna być Markdownem strony i negocjacją treści, nie większym llms.txt.

Następny krokEstymator wolumenu wyszukiwań AI — score it against a calibrated model. Wskazówki są dostępne po angielsku.