Crawlery AI
Trzy rodzaje crawlerów AI — boty treningowe, indeksujące wyszukiwanie AI i pobieracze uruchamiane przez użytkownika — najważniejsze nazwane boty oraz sposoby kontrolowania każdego z nich bez szkody dla SEO.
Języki
2 sygnałów dowodowych na tej stronie
- Dane źródłowe dostępne przez linkopublikowaną listę adresów IP
- Powiązane działające narzędzieLog File Analyzer
Crawlery AI dzielą się na trzy kategorie, a ich mylenie jest podstawowym błędem: (1) boty treningowe i ulepszające modele, takie jak GPTBot, ClaudeBot i CCBot; (2) crawlery wyszukiwania AI, takie jak OAI-SearchBot, PerplexityBot i Applebot; oraz (3) pobieracze uruchamiani przez użytkownika, tacy jak ChatGPT-User, Perplexity-User i Claude-User. Kontrole są zależne od operatora i agenta: zablokowanie GPTBot nie blokuje OAI-SearchBot, a OAI-AdsBot ma osobny zakres reklamowy. Google-Extended i Applebot-Extended to tokeny produktu/kontroli, nie niezależne crawlery. Google-Extended obejmuje ulepszanie modeli Gemini/Vertex i grounding, ale nie uwzględnienie w Google Search, ranking, AI Overviews ani AI Mode; Applebot-Extended kontroluje użycie w bazowych modelach Apple bez usuwania stron z wyszukiwarki Apple. llms.txt pozostaje propozycją, a nie szeroko przyjętym standardem kontroli.
OpenAI publikuje oddzielne mechanizmy kontroli dla botów treningowych, wyszukiwawczych i wykonujących działania użytkownika. Evidence for this claim OpenAI publishes separate controls for GPTBot, OAI-SearchBot, and ChatGPT-User, and says each setting is independent. Scope: OpenAI-declared crawlers and user agents; their purposes and robots behavior are platform-specific. Confidence: high · Verified: OpenAI: Crawlers Anthropic również opisuje odrębne agenty treningowe, wyszukiwawcze i uruchamiane na żądanie użytkownika. Evidence for this claim Anthropic documents ClaudeBot, Claude-SearchBot, and Claude-User separately and says its bots honor robots.txt directives. Scope: Anthropic-declared bots; user-initiated retrieval has additional product-specific conditions. Confidence: high · Verified: Anthropic: Bot information
Evidence for this claim Cloudflare Radar reports worldwide Cloudflare-observed HTTP request trends for the five most active AI bots during the 28 days ending 2026-07-30. Scope: A dated Cloudflare Radar context chart; it is not site-specific traffic and is not a census of all web requests. Confidence: high · Verified: Cloudflare Radar: HTTP traffic by AI botThe chart compares request trends for the five most active AI bots observed by Cloudflare during the selected four-week period, including Googlebot, ClaudeBot, Meta-ExternalAgent, GPTBot, and Bingbot.
TL;DR — „AI crawlery” to nie jedna rzecz — są trzy. Niektóre boty pobierają Twoją witrynę, aby trenować modele AI (na przykład GPTBot i ClaudeBot). Inne budują indeks, dzięki któremu wyszukiwanie AI może Cię cytować (na przykład OAI-SearchBot i PerplexityBot). Jeszcze inne pobierają stronę na żywo, bo ktoś właśnie zadał pytanie (na przykład ChatGPT-User). Każdy ma własną nazwę w Twoim
robots.txt, więc możesz zezwalać na jego działanie lub blokować go niezależnie. Zablokowanie botów treningowych nie zaszkodzi pozycjom w Google — zablokowanie botów wyszukiwania AI może ukryć Cię w odpowiedziach AI.
Czym są crawlery AI
Znasz już crawlery wyszukiwarek — takie jak Googlebot lub Bingbot — które odwiedzają Twoje strony, aby mogły pojawiać się w wynikach wyszukiwania. Crawlery AI to nowsza grupa: boty prowadzone przez firmy AI (OpenAI, Anthropic, Google, Apple, Perplexity i inne), które pobierają strony do własnych celów.
Najważniejsze, co trzeba zrozumieć przed zablokowaniem czegokolwiek: nie wszystkie wykonują tę samą pracę. Są trzy rodzaje.
- Boty treningowe czytają strony, aby pomagać w budowie i ulepszaniu modeli AI. Słynne przykłady to GPTBot (OpenAI) i ClaudeBot (Anthropic).
- Boty wyszukiwania AI czytają strony, aby budować przeszukiwalny indeks, dzięki któremu ChatGPT lub Perplexity mogą odpowiedzieć na pytanie i podać do Ciebie odsyłacz. Robią to OAI-SearchBot i PerplexityBot.
- Pobieracze uruchamiani przez użytkownika pobierają konkretną stronę w czasie rzeczywistym, ponieważ ktoś o coś zapytał. Przykładem jest ChatGPT-User — nie przemierza samodzielnie sieci, lecz wykonuje zadanie dla użytkownika.
Dlaczego ta różnica ma znaczenie
Każdy bot ma własną nazwę (swój user-agent), a plik robots.txt może zezwalać
na jego działanie lub blokować go po nazwie. Możesz więc niezależnie zdecydować:
- Czy przeszkadza mi, że firmy AI trenują na moich treściach? → to pytanie dotyczy botów treningowych.
- Czy chcę pojawiać się w odpowiedziach ChatGPT i Perplexity? → to pytanie dotyczy botów wyszukiwania AI. Większość osób chce je pozostawić dozwolone.
Oto wielki mit, który trzeba obalić: blokowanie botów AI nie szkodzi pozycjom Twojej witryny w Google. Google powiedział to wprost, a wydawcy blokujący boty treningowe AI nadal uzyskują dobre pozycje. Jeśli jednak zablokujesz boty wyszukiwania AI, możesz zniknąć z odpowiedzi AI — nie blokuj więc przypadkiem nie tej kategorii.
Nazwy widoczne w logach
- GPTBot — OpenAI, trening.
- OAI-SearchBot — OpenAI, bot zasilający wyszukiwanie ChatGPT.
- ChatGPT-User — OpenAI, pobranie na żywo po pytaniu użytkownika.
- ClaudeBot — Anthropic, trening.
- PerplexityBot — Perplexity, wyszukiwanie/cytowania.
- CCBot — Common Crawl, organizacja non-profit, której dane trenują wiele modeli AI.
- Bytespider — ByteDance (właściciel TikToka), trening.
- Applebot — Apple, zasila Siri, Spotlight i Apple Intelligence.
Dwie kolejne nazwy to Google-Extended i Applebot-Extended — nie są
rzeczywistymi crawlerami. To tylko przełączniki w robots.txt, które mówią:
“don’t use my content to train your AI.” (tłumaczenie) „nie używaj moich treści do trenowania AI”. Niczego nie pobierają.
Chcesz zobaczyć pełną tabelę bot po bocie, receptury robots.txt, debatę „czy one naprawdę przestrzegają robots.txt?” oraz odpowiedź na pytanie, czy w ogóle je blokować? Przejdź do karty Advanced.
OpenAI mówi, że ustawienia GPTBot, OAI-SearchBot i ChatGPT-User są niezależne. Evidence for this claim OpenAI publishes separate controls for GPTBot, OAI-SearchBot, and ChatGPT-User, and says each setting is independent. Scope: OpenAI-declared crawlers and user agents; their purposes and robots behavior are platform-specific. Confidence: high · Verified: OpenAI: Crawlers Anthropic osobno wskazuje ClaudeBot, Claude-SearchBot i Claude-User oraz opisuje obsługę robots.txt. Evidence for this claim Anthropic documents ClaudeBot, Claude-SearchBot, and Claude-User separately and says its bots honor robots.txt directives. Scope: Anthropic-declared bots; user-initiated retrieval has additional product-specific conditions. Confidence: high · Verified: Anthropic: Bot information
TL;DR — Crawlery AI dzielą się na trzy kategorie, a ich mylenie jest błędem, który popełnia niemal każdy. Boty treningowe (GPTBot, ClaudeBot, CCBot, Bytespider, Amazonbot, Meta-ExternalAgent) pobierają dane do budowy korpusów modeli. Boty wyszukiwania AI (OAI-SearchBot, PerplexityBot, Applebot, Amzn-SearchBot) budują indeks cytowań. Pobieracze uruchamiani przez użytkownika (ChatGPT-User, Perplexity-User, Claude-User) pobierają stronę na żywo, gdy ktoś zada pytanie. Każdy ma własny user-agent i własną regułę
robots.txt, więc zablokowanie GPTBot nie dotyka OAI-SearchBot. Google-Extended i Applebot-Extended to tokeny, nie boty — nie crawlują, tylko wyłączają Cię z trenowania/groundingu. Blokowanie botów treningowych nie wpływa na pozycje w Google (Google tak mówi, a dane empiryczne to potwierdzają); blokowanie botów wyszukiwania AI zmniejsza widoczność w odpowiedziach AI. Debata orobots.txtjest realna w przypadku pobieraczy użytkownika (operatorzy twierdzą, że „może nie mieć zastosowania”) i Perplexity (zgłaszane skryte crawlowanie). llms.txt to propozycja, w dużej mierze nieczytana i nieprzyjęta przez największych operatorów.
Trzy kategorie — kręgosłup całego tematu
Training crawlers such as GPTBot, ClaudeBot, and CCBot collect data for model corpora. AI-search crawlers such as OAI-SearchBot and PerplexityBot build indexes used for answers and citations. User-triggered agents such as ChatGPT-User and Claude-User fetch a page for a live request. Blocking one category does not automatically block the others.
© Patrick Stox LLC · CC BY 4.0 ·
Każdy nazwany bot AI należy do jednego z trzech koszyków. Właściwa kategoria rozstrzyga każdą późniejszą decyzję (blokować go? zezwolić? co stanie się z moim SEO?).
1. Crawlery treningowe / zbierające dane. Crawlują na dużą skalę, aby budować korpusy do trenowania i dostrajania LLM-ów. To boty, które większość wydawców chce blokować, a ich zablokowanie nie wpływa na pozycje w wyszukiwarce. Należą do nich: GPTBot (OpenAI), ClaudeBot (Anthropic), CCBot (Common Crawl), Bytespider (ByteDance), Amazonbot (Amazon), Meta-ExternalAgent (Meta), AI2Bot (Allen Institute), cohere-training-data-crawler (Cohere), Diffbot, Timpibot (Timpi) i webzio-extended (Webz.io). Są też dwa tokeny kontrolne, które NIE są osobnymi crawlerami — Google-Extended i Applebot-Extended — omówione poniżej.
2. Crawlery wyszukiwania AI / indeksujące. Budują aktualny indeks używany do odpowiadania na zapytania z cytatami i odsyłaczami do Ciebie. Ich zablokowanie może usunąć Cię z wyników wyszukiwania AI. Należą do nich: OAI-SearchBot (OpenAI — odrębny od GPTBot), PerplexityBot (Perplexity), Applebot (Apple — zasila podpowiedzi Spotlight/Siri/Safari) oraz Amzn-SearchBot (Amazon).
3. Pobieracze uruchamiani przez użytkownika / na żądanie. Pobierają konkretną stronę na żywo, bo użytkownik zadał pytanie, a nie dlatego, że bot sam przemierza sieć. Operatorzy zazwyczaj twierdzą, że robots.txt nie wiąże pobrania zainicjowanego przez użytkownika — to obszar sporny. Należą do nich: ChatGPT-User (OpenAI), Perplexity-User (Perplexity), Claude-User i Claude-SearchBot (Anthropic), Amzn-User (Amazon, dla Alexy) oraz Meta-ExternalFetcher (Meta).
Pełna tabela z tokenami user-agentów i informacją o zgodności z robots.txt znajduje się w karcie Cheat Sheets — to centralny element tego artykułu.
Pułapka „token, nie bot” (Google-Extended i Applebot-Extended)
To najbardziej niezrozumiany fakt w tej dziedzinie, więc ujmę go precyzyjnie. Google-Extended i Applebot-Extended niczego nie crawlują. Nie mają niezależnego user-agenta i nie generują ruchu crawlującego. Są tokenami kontroli robots.txt, które zmieniają to, co istniejące crawle mogą robić z Twoją treścią.
- Google-Extended kontroluje użycie treści do ulepszania aplikacji Gemini i generatywnych modeli Vertex AI, w tym do groundingu poza Google Search. Nie kontroluje AI Overviews ani AI Mode w Google Search — te korzystają z dostępu Googlebota. Google mówi wprost: “Google-Extended does not impact a site’s inclusion in Google Search nor is it used as a ranking signal in Google Search.” (tłumaczenie) „Google-Extended nie wpływa na uwzględnienie witryny w Google Search ani nie jest używany jako sygnał rankingowy w Google Search.” Zablokowanie go nie robi nic Googlebotowi ani Twoim pozycjom.
- Applebot-Extended działa tak samo w Apple. Apple stwierdza: “Applebot-Extended does not crawl webpages. Webpages that disallow Applebot-Extended can still be included in search results.” (tłumaczenie) „Applebot-Extended nie crawluje stron internetowych. Strony z zakazem dla Applebot-Extended nadal mogą trafić do wyników wyszukiwania.” Wyłącza Cię z trenowania modeli bazowych Apple (Apple Intelligence) — Twoje strony nadal pojawiają się w Spotlight/Siri dzięki rzeczywistemu crawlerowi, Applebot.
Zatem Disallow: Google-Extended i Disallow: Applebot-Extended to mechanizmy
kontroli użycia produktu, a nie niezależne blokady crawlowania. Opublikowane zakresy
tych tokenów nie usuwają stron z odpowiednich indeksów wyszukiwania, ale tokeny nie
są zamienne i nie należy obu skracać do określenia „bot treningowy”.
Najwięksi operatorzy, bot po bocie
OpenAI prowadzi cztery zadeklarowane, niezależne boty: GPTBot (trening — “used to make our generative AI foundation models more useful and safe” (tłumaczenie) „używany do tego, aby nasze bazowe modele generatywnej AI były bardziej użyteczne i bezpieczne”), OAI-SearchBot (wyszukiwanie — “used to surface websites in search results in ChatGPT’s search features” (tłumaczenie) „używany do wyświetlania witryn w wynikach wyszukiwania funkcji wyszukiwania ChatGPT”), ChatGPT-User (pobieracz użytkownika — “used for certain user actions in ChatGPT” (tłumaczenie) „używany do określonych działań użytkownika w ChatGPT”) oraz OAI-AdsBot (niezależny zakres reklam, a nie bot treningowy ani crawler indeksu wyszukiwania). Zdanie z polityki OpenAI jest wzorem dla całej tej dziedziny: “Each bot setting is independent, allowing webmasters granular control over how their content interacts with different OpenAI systems.” (tłumaczenie) „Każde ustawienie bota jest niezależne, co pozwala webmasterom szczegółowo kontrolować interakcję ich treści z różnymi systemami OpenAI.” Zablokowanie GPTBot “signals that future data from these materials should be excluded from model training datasets” (tłumaczenie) „sygnalizuje, że przyszłe dane z tych materiałów powinny zostać wykluczone ze zbiorów treningowych modeli”; zablokowanie OAI-SearchBot oznacza, że witryna “won’t appear in ChatGPT search results.” (tłumaczenie) „nie pojawi się w wynikach wyszukiwania ChatGPT”.
Anthropic prowadzi trzy boty: ClaudeBot (trening), Claude-SearchBot (indeksowanie wyszukiwania) i Claude-User (pobieranie użytkownika). Anthropic stwierdza, że jego boty “respect ‘do not crawl’ signals by honoring industry standard directives in robots.txt” (tłumaczenie) „respektują sygnały „nie crawluj”, przestrzegając standardowych dla branży dyrektyw w robots.txt”. Bieżąca strona pomocy wskazuje również wspólną opublikowaną listę adresów IP do weryfikacji botów Anthropic. Ta lista specyficzna dla operatora jest dowodem tożsamości, a nie uniwersalną regułą weryfikacji IP lub reverse DNS dla każdego bota.
Google — kluczowy fakt to ten opisany wyżej: Google-Extended jest tokenem,
nie botem. Google prowadzi również Google-CloudVertexBot (crawluje na żądanie
właściciela witryny dla agentów Vertex AI; nie wpływa na ranking) oraz agenty
uruchamiane przez użytkownika, takie jak Gemini-Deep-Research i
Google-NotebookLM.
Apple prowadzi Applebot (rzeczywisty crawler zasilający podpowiedzi Spotlight/Siri/Safari, który “may also be used to help train Apple foundation models” (tłumaczenie) „może być również używany do pomocy w trenowaniu bazowych modeli Apple”) oraz token Applebot-Extended. Zablokowanie Applebota usuwa Cię z wyszukiwania Apple; zablokowanie Applebot-Extended tylko wyłącza trenowanie.
Perplexity deklaruje dwa boty: PerplexityBot (wyszukiwanie/cytowania — wyraźnie “not used to crawl content for AI foundation models” (tłumaczenie) „nieużywany do crawlowania treści na potrzeby bazowych modeli AI”, więc Perplexity nie ma zadeklarowanego crawlera treningowego) oraz Perplexity-User (pobieranie użytkownika). Dokumentacja mówi, że Perplexity-User “generally ignores robots.txt rules” (tłumaczenie) „zwykle ignoruje reguły robots.txt”, ponieważ pobranie inicjuje użytkownik. Perplexity jest również bohaterem zgłaszanej sprawy dotyczącej skrytego crawlowania — zobacz kontrowersję poniżej.
Amazon prowadzi trzy boty i jest tu użytecznym wyjątkiem: Amazonbot (ulepsza
produkty i “may be used to train Amazon AI models” (tłumaczenie) „może być używany do trenowania modeli AI Amazon”), Amzn-SearchBot (wyszukiwanie) oraz Amzn-User (pobrania użytkownika Alexy). Z dokumentacji Amazon wynika, że Amzn-SearchBot i Amzn-User wyraźnie NIE crawlują na potrzeby trenowania generatywnych modeli AI — twierdzenie „wszystkie firmy AI pobierają dane do treningu” jest więc mitem. Amazon respektuje także metatag noarchive o szczególnym znaczeniu: „nie używaj strony do trenowania modelu” — to rzadki sposób wyłączenia treningu na poziomie pojedynczej strony.
Obsługa robots.txt przez Amazon ma dwie nietypowe krawędzie operacyjne: crawlery mogą używać kopii robots.txt zapisanej w pamięci podręcznej w ciągu poprzednich 30 dni, a Amazon mówi, że jeśli nie można pobrać pliku, jego crawlery zachowują się tak, jakby plik nie istniał. Nie oznacza to, że nieudane pobranie audytowe dowodzi, iż Amazon zobaczył stan zezwalający na wszystko; audyt i Amazon mogą docierać do hosta w różnych momentach albo innymi ścieżkami sieciowymi.
Evidence for this claim Amazon says its crawlers may use a robots.txt copy cached within the previous 30 days. Scope: Amazon crawler behavior only; a current audit fetch cannot identify which cached copy Amazon used. Confidence: high · Verified: Amazon: Amazonbot Evidence for this claim Amazon says its crawlers behave as if robots.txt does not exist when they cannot fetch it. Scope: Amazon crawler behavior only; a tool-side fetch failure is not proof that Amazon observed the same failure. Confidence: high · Verified: Amazon: AmazonbotMeta prowadzi Meta-ExternalAgent (trening/indeksowanie dla Llama i Meta AI), Meta-ExternalFetcher (pobieranie użytkownika) oraz osobno Facebookbot (podglądy odsyłaczy — nie crawler AI). Zablokowanie Meta-ExternalAgent nie wpływa na podglądy odsyłaczy na Facebooku.
Common Crawl (CCBot) jest prowadzony przez fundację non-profit utrzymującą otwarte archiwum sieci. To ukryta warstwa: zbiór danych Common Crawl służył do trenowania ChatGPT, Claude, LLaMA i wielu innych modeli — zatem zablokowanie CCBot ma dalsze skutki dla modeli, które nigdy nie crawlują Twojej witryny bezpośrednio. Common Crawl ostrzega również, że podszywający się napastnicy fałszują CCBot.
ByteDance (Bytespider) jest najbardziej agresywny: deklaruje przestrzeganie robots.txt, lecz szeroko zgłaszano jego naruszanie przy bardzo dużym wolumenie żądań. Warto znać także: AI2Bot (Allen Institute, modele otwarte / zbiór Dolma), Cohere, Diffbot (ekstrakcja danych strukturalnych, których wynik zasila wiele dalszych procesów AI) oraz Timpibot / webzio-extended.
Czy boty AI rzeczywiście przestrzegają robots.txt?
W przypadku crawlerów treningowych i wyszukiwawczych najwięksi operatorzy (OpenAI, Anthropic, Google, Apple, Amazon) deklarują w dokumentacji, że przestrzegają robots.txt. Obszarem spornym są pobieracze uruchamiane przez użytkownika, bo kilku operatorów wprost twierdzi, że robots.txt może nie mieć zastosowania, gdy żądanie zainicjowała osoba — OpenAI mówi, że “these actions are initiated by a user, robots.txt rules may not apply” (tłumaczenie) „te działania są inicjowane przez użytkownika, więc reguły robots.txt mogą nie mieć zastosowania”; Perplexity mówi, że Perplexity-User “generally ignores robots.txt rules.” (tłumaczenie) „zwykle ignoruje reguły robots.txt”. To deklarowana polityka, a nie naruszenie.
Kontrowersja wokół Perplexity to główny spór; oznaczę ją jako zgłoszoną, a
nie rozstrzygniętą. W czerwcu 2024 r. Wired i programista Robb Knight zgłosili, że
Perplexity uzyskiwało treści z witryn, które je zablokowały, najwyraźniej używając
nieujawnionych adresów IP. W sierpniu 2025 r. Cloudflare poinformował, że Perplexity
używało skrytego user-agenta podszywającego się na macOS pod Chrome, zmieniało IP i
ASN-y, aby omijać blokady, oraz pobierało treści z nowo utworzonych domen testowych
z pełnym Disallow: / — po czym Cloudflare usunął Perplexity z listy zweryfikowanych
botów. Przedstawiaj to jako udokumentowane doniesienia tych źródeł; własna dokumentacja
Perplexity nadal utrzymuje, że PerplexityBot przestrzega robots.txt.
Ponieważ niektóre boty w pewnym zakresie ignorują robots.txt, Cloudflare stał się praktyczną warstwą egzekwowania — blokowaniem na poziomie sieci, przełącznikiem „AI Scrapers and Crawlers” jednym kliknięciem, zarządzanym robots.txt, śledzeniem naruszeń robots.txt i wersją beta pay-per-crawl. Od lipca 2025 r. nowe domeny Cloudflare domyślnie blokują znane crawlery AI.
Jak kontrolować crawlery AI
- robots.txt per user-agent to główna dźwignia i działa szczegółowo:
zablokowanie
GPTBotnie blokujeOAI-SearchBotaniChatGPT-User. Receptury robots.txt (blokowanie wszystkich botów treningowych oraz botów wyszukiwania AI) znajdują się w karcie Scripts. - Tokeny treningowe —
Google-ExtendediApplebot-Extended— wyłączają trenowanie Gemini/Apple Intelligence bez kosztu dla wyszukiwania. - Metatag
noarchiveAmazon jest wyłączeniem treningu na poziomie pojedynczej strony. - Cloudflare AI Crawl Control — blokowanie, zezwalanie i naliczanie opłat na
poziomie sieci, a także zarządzany robots.txt i dyrektywy Content Signals
(
search,ai-input,ai-train); domyślniesearch=yes, ai-train=no. - llms.txt to propozycja (Jeremy Howard / Answer.AI, wrzesień 2024), nie przyjęty standard — najwięksi crawlery go nie respektują. To wyselekcjonowana mapa Markdown przeznaczona do odczytu w czasie wnioskowania, ale badanie Ahrefs obejmujące 137 tys. witryn wykazało, że 97% opublikowanych plików llms.txt nie otrzymuje żadnych żądań, a żaden duży dostawca LLM nie przyjął go formalnie. Traktuj go jako narzędzie dokumentacyjne, nie narzędzie wyszukiwania AI.
- Społecznościowy projekt ai.robots.txt utrzymuje obszerny plik
Disallow: /, zawierający ponad 150 user-agentów botów AI — przydatne źródło przy blokowaniu zbiorczym.
Polityka crawlerów stawiająca na widoczność
W przypadku publicznej witryny edukacyjnej lub komercyjnej, która chce być widoczna w wyszukiwaniu AI, moją domyślną polityką jest:
- Zezwalaj konwencjonalnym crawlerom wyszukiwarek, które zasilają wybrane przez Ciebie powierzchnie wyszukiwania, w tym Googlebot i Bingbot.
- Zezwalaj udokumentowanym crawlerom wyszukiwania/indeksowania AI, takim jak
OAI-SearchBot,Claude-SearchBotiPerplexityBotna publicznych treściach. - Zezwalaj zamierzonym pobraniom kierowanym przez użytkownika, takim jak
ChatGPT-User,Claude-UseriPerplexity-User, pamiętając, że operatorzy różnie traktują robots.txt. Evidence for this claim OpenAI publishes separate controls for GPTBot, OAI-SearchBot, and ChatGPT-User, and says each setting is independent. Scope: OpenAI-declared crawlers and user agents; their purposes and robots behavior are platform-specific. Confidence: high · Verified: OpenAI: Crawlers Evidence for this claim Anthropic documents ClaudeBot, Claude-SearchBot, and Claude-User separately and says its bots honor robots.txt directives. Scope: Anthropic-declared bots; user-initiated retrieval has additional product-specific conditions. Confidence: high · Verified: Anthropic: Bot information Evidence for this claim Perplexity documents PerplexityBot for search indexing separately from Perplexity-User for user-requested fetches, with different robots behavior. Scope: Perplexity-declared crawlers and published IP ranges; a user-agent string alone does not verify identity. Confidence: high · Verified: Perplexity: Crawlers - Podejmij osobną decyzję dotyczącą praw do dostępu treningowego/rozwoju modeli.
GPTBot,ClaudeBot,Google-Extendedi inne mechanizmy treningowe nie muszą mieć tej samej polityki co wyszukiwanie. Zezwalaj na nie tylko wtedy, gdy takie użycie jest zgodne z Twoją polityką publikacji. - Chroń prywatne i operacyjne ścieżki uwierzytelnianiem. Trzymaj
/admin/, podglądy, dane kont i niepubliczne API za autoryzacją po stronie serwera;Disallowjest tylko preferencją dla crawlera. - Weryfikuj tożsamość przed pominięciem kontroli WAF. Łącz udokumentowany user-agent z aktualnymi zakresami IP dostawcy, weryfikacją reverse DNS albo obsługiwanym uwierzytelnianiem bota. Nigdy nie twórz szerokiej reguły zezwalającej WAF wyłącznie na podstawie podatnego na podszywanie user-agenta.
Nie dodawaj osobnej grupy user-agenta tylko po to, aby zapisać Allow: /, chyba że
powtórzysz każdą restrykcję, która nadal ma dotyczyć tego crawlera. W regułach
dopasowania robots określona grupa może zastąpić grupę wieloznaczną, zamiast
dziedziczyć jej wykluczenia prywatnych ścieżek — zależy to od parsera operatora.
Najprostszy bezpieczny plik to często jedna niezależnie bezpieczna grupa * oraz
wąsko określone wyłączenia treningowe.
W przypadku tej witryny bieżąca polityka publiczna to jawne zezwolenie na wyszukiwanie,
AI input i trening AI, przy jednoczesnym wykluczeniu ścieżek administracyjnych,
podglądów, API, pułapek i bram. Pozostawiłbym dozwolone wyszukiwanie i pobieranie
zainicjowane przez użytkownika. Zmieniłbym ai-train=yes wyłącznie jako decyzję
dotyczącą praw redakcyjnych — nie jako taktykę widoczności AI — ponieważ nie ma
potwierdzonej korzyści cytowania z dostępu treningowego.
Dostęp crawlera AI to nie gotowość na AI
Reguła zezwalająca dowodzi co najwyżej, że zadeklarowana polityka robots pozwala określonemu agentowi zażądać URL-a. Nie dowodzi, że operator przestrzega polityki, pobrał stronę, wyrenderował ją, wydobył ważne informacje, umieścił je w kontekście modelu, zacytował stronę ani wykonał działanie.
Trzymaj osobno pięć warstw:
| Warstwa | Pytanie | Dowód |
|---|---|---|
| Uprawnienie | Czy ten nazwany agent może zażądać URL-a według zadeklarowanej polityki? | Efektywny test robots i dostępu sieciowego |
| Ekstrahowalność | Czy ważna treść jest obecna w stabilnym tekście, odsyłaczach, metadanych lub danych strukturalnych? | Surowy i wyrenderowany przechwyt z ekstrakcją pól |
| Renderowanie | Czy treść przetrwa rzeczywiste możliwości przeglądarki/JavaScript agenta? | Dowód pobrania specyficzny dla dostawcy, a w przeciwnym razie jawnie opisana granica testu |
| Operacyjność | Czy agent może rozpoznać i bezpiecznie wywołać zamierzone działanie? | Udokumentowany kontrakt narzędzia/interfejsu i kontrolowany test end-to-end |
| Gotowość handlowa | Czy tożsamość, cena, dostępność, polityka, realizacja, koszyk i checkout są zgodne? | Uzgodnienie feedu, strony, backendu i zamówienia |
Checker dostępu crawlera powinien więc dla polityki raportować allowed, blocked albo indeterminate, a nie „AI ready”. Udany request w logu dowodzi, że wystąpiło żądanie; nie jest dowodem, że strona została użyta w odpowiedzi. Prawidłowa deklaracja feedu lub narzędzia również nie dowodzi, że publiczna strona renderuje się poprawnie ani że checkout może zrealizować przedstawioną ofertę.
Zobacz Jak działa wyszukiwanie AI dla warstw pobierania i cytowania oraz Optymalizację zakupów AI dla gotowości katalogu i transakcji. Rozdzielenie warstw sprawia, że środek zaradczy jest konkretny: popraw politykę dostępu przy blokadzie, wynik strony przy problemie z ekstrakcją, renderowanie przy brakującym stanie, kontrakt interfejsu przy problemie z operacyjnością albo dane handlowe przy nieudanym zakupie.
W przypadku stron e-commerce test ekstrahowalności powinien sprawdzać, czy podstawowa tożsamość produktu i wybrana oferta — SKU, identyfikator grupy, cena, waluta i dostępność — istnieją w odpowiedzi początkowej oraz nadal są zgodne po renderowaniu. Standard surowej i wyrenderowanej strony produktu definiuje to, co powinno być widoczne po stronie serwera; samo uprawnienie crawlera nic nie mówi o tym kontrakcie.
Mit, który kosztuje Cię ruch: trening ≠ wyszukiwanie AI
Oto rzecz, którą trzeba zrozumieć. Blokowanie botów treningowych to nie to samo co blokowanie botów wyszukiwania AI. To osobne reguły robots.txt o przeciwnych konsekwencjach:
- Zablokowanie botów treningowych (GPTBot, ClaudeBot, CCBot, Bytespider oraz tokenów Google-Extended/Applebot-Extended) → nie wpływa na pozycje w Google, co potwierdzają Google i empiryczne dane wydawców. Po prostu wyłączasz się z trenowania modeli.
- Zablokowanie botów wyszukiwania AI (OAI-SearchBot, PerplexityBot) → tracisz widoczność w odpowiedziach ChatGPT i Perplexity. To rzeczywisty kompromis, a nie bezpłatna korzyść.
Jeśli zablokujesz zbyt szeroko — na przykład regułą obejmującą OAI-SearchBot, choć chodziło Ci tylko o zatrzymanie treningu — możesz po cichu usunąć się z wyszukiwania AI. Precyzyjnie określ, jakiej kategorii dotyczy każda reguła.
Dlaczego wydawcy w ogóle blokują boty: umowa społeczna
Powód całej tej debaty sprowadza się do ruchu. Jak ująłem to w mojej analizie botów AI, “there’s a cost to bots crawling your websites and there’s a social contract between search engines and website owners, where search engines add value by sending referral traffic to websites. Google sends traffic (for now), so they don’t get blocked.” (tłumaczenie) „Crawlowanie witryn przez boty ma koszt, a między wyszukiwarkami i właścicielami witryn istnieje umowa społeczna: wyszukiwarki dodają wartość, wysyłając witrynom ruch z odsyłaczy. Google wysyła ruch (na razie), więc nie jest blokowane.” Crawlery AI jak dotąd przeważnie nie odsyłają ruchu — a dane uzasadniają ten niepokój. W mojej analizie Cloudflare Radar boty AI są już zdecydowanie drugim crawlerem za wyszukiwarkami i zmierzają do ich wyprzedzenia. Więcej w karcie Stats.
Ujawnienie: jestem byłym pracownikiem Ahrefs i otrzymuję bezpłatny dostęp do Ahrefs. Powiązana analiza crawlerów to moja opublikowana praca z tamtego okresu; Ahrefs nie recenzuje ani nie zatwierdza obecnych wniosków redakcyjnych tej witryny.W sprawie szerszego procesu, w który to się wpisuje — odkrywania, harmonogramu crawlowania, renderowania oraz różnic między crawlowaniem i indeksowaniem — zobacz hub crawlowania oraz sąsiednie tematy o crawlerach ogólnie, user-agentach, Googlebocie, Bingbocie i robots.txt.
Podsumowanie AI
Skrócona wersja karty Advanced:
- Crawlery AI dzielą się na trzy kategorie, a nie jedną — ich mylenie to podstawowy
błąd.
- Treningowe: GPTBot, ClaudeBot, CCBot, Bytespider, Amazonbot, Meta-ExternalAgent, AI2Bot, Cohere, Diffbot — zbierają dane do korpusów modeli.
- Wyszukiwanie AI/indeksowanie: OAI-SearchBot, PerplexityBot, Applebot, Amzn-SearchBot — budują indeks cytowań.
- Pobieracze uruchamiani przez użytkownika: ChatGPT-User, Perplexity-User, Claude-User — pobierają stronę na żywo, gdy ktoś zada pytanie.
- Każdy bot ma własny user-agent i własną regułę robots.txt. Zablokowanie GPTBot nie blokuje OAI-SearchBot ani ChatGPT-User.
- Google-Extended i Applebot-Extended to tokeny kontroli, a nie crawlery — nie crawlują; tylko wyłączają Cię z trenowania/groundingu. Ich zablokowanie nie ma kosztu dla wyszukiwania.
- Blokowanie botów treningowych ≠ szkoda dla SEO. Google mówi, że Google-Extended „nie wpływa na uwzględnienie witryny w Google Search”. Zgadzają się z tym dane empiryczne wydawców.
- Blokowanie botów wyszukiwania AI OBNIŻA widoczność AI w ChatGPT/Perplexity — to rzeczywisty kompromis.
- Amazonboty Amzn-SearchBot i Amzn-User NIE trenują na pobieranych treściach (według Amazona). „Wszystkie boty AI trenują” to mit.
- Spór o robots.txt: pobieracze użytkownika wyłączają się z zasad („mogą nie mieć zastosowania”); Perplexity jest opisywane (Wired/Robb Knight 2024; Cloudflare 2025) jako korzystające ze skrytych crawlerów — przedstawiaj to jako doniesienia, nie rozstrzygnięty fakt.
- llms.txt to propozycja, nie przyjęty standard — 97% plików jest nieczytanych; żaden duży LLM go nie obsługuje. Cloudflare to praktyczna warstwa egzekwowania.
Oficjalna dokumentacja
Dokumentacja źródłowa operatorów AI oraz odpowiednich propozycji.
OpenAI
- Boty/crawlery OpenAI — GPTBot, OAI-SearchBot, ChatGPT-User, OAI-AdsBot oraz zasada, że „każde ustawienie bota jest niezależne”.
Anthropic
- Czy Anthropic crawluje dane z sieci? — ClaudeBot, Claude-SearchBot, Claude-User, sterowanie robots i bieżąca weryfikacja listą adresów IP.
- Lista adresów IP crawlerów Anthropic — dane weryfikacyjne specyficzne dla operatora.
- Typowe crawlery Google (w tym Google-Extended) — tokeny produktów i user-agenty.
- Funkcje AI a Twoja witryna — o uwzględnieniu w AI Overviews i AI Mode decyduje Googlebot, nie Google-Extended.
Apple
- Informacje o Applebot — Applebot i Applebot-Extended oraz rozróżnienie „Applebot-Extended nie crawluje stron internetowych”.
Amazon
- Amazonbot — Amazonbot, Amzn-SearchBot, Amzn-User, wyłączenie treningu przez
noarchivei wskazanie, które boty nie trenują.
Perplexity
- Crawlery Perplexity — PerplexityBot i Perplexity-User, w tym stwierdzenie, że „zwykle ignoruje reguły robots.txt”.
Common Crawl
- CCBot — niekomercyjny crawler stojący za dużą częścią danych treningowych LLM oraz ostrzeżenie przed podszywaniem się.
Allen Institute for AI
- Informacja o crawlerze AI2 — AI2Bot i sposób jego filtrowania.
Cloudflare (sterowanie crawlerami AI)
- AI Crawl Control — blokowanie, zezwalanie i naliczanie opłat, monitoring oraz śledzenie naruszeń robots.txt.
- Zarządzany robots.txt — automatycznie utrzymywane dyrektywy crawlerów AI.
- Kontrolowanie użycia treści do trenowania AI — zarządzany robots.txt, Content Signals i pay-per-crawl.
Propozycja
- Specyfikacja llms.txt — mapa przeznaczona do odczytu w czasie wnioskowania (propozycja, nie przyjęty standard).
- Projekt ai.robots.txt — społecznościowo utrzymywana lista user-agentów botów AI.
Cytaty ze źródeł
Stwierdzenia operatorów i propozycji zapisane w źródłach. Każdy odsyłacz prowadzi bezpośrednio do zweryfikowanego cytowanego fragmentu.
OpenAI — niezależne boty, niezależne zastosowania
- “Each bot setting is independent, allowing webmasters granular control over how their content interacts with different OpenAI systems.” (tłumaczenie) „Każde ustawienie bota jest niezależne, co pozwala webmasterom szczegółowo kontrolować interakcję ich treści z różnymi systemami OpenAI.” — dokumentacja botów OpenAI. Przejdź do cytatu
- GPTBot jest “used to make our generative AI foundation models more useful and safe.” (tłumaczenie) „używany do tego, aby nasze bazowe modele generatywnej AI były bardziej użyteczne i bezpieczne”. OAI-SearchBot jest “used to surface websites in search results in ChatGPT’s search features.” (tłumaczenie) „używany do wyświetlania witryn w wynikach wyszukiwania funkcji wyszukiwania ChatGPT”. ChatGPT-User: ponieważ “these actions are initiated by a user, robots.txt rules may not apply.” (tłumaczenie) „te działania są inicjowane przez użytkownika, więc reguły robots.txt mogą nie mieć zastosowania”. Przejdź do cytatu
Anthropic — kontrola robots i zakres weryfikacji
- Anthropic opisuje ClaudeBot, Claude-SearchBot i Claude-User, ich kontrolę przez robots oraz wspólną metodę weryfikacji listą adresów IP. Źródło
Google — token, nie bot
- “Google-Extended does not impact a site’s inclusion in Google Search nor is it used as a ranking signal in Google Search.” (tłumaczenie) „Google-Extended nie wpływa na uwzględnienie witryny w Google Search ani nie jest używany jako sygnał rankingowy w Google Search”. Przejdź do cytatu
Apple — Applebot-Extended nie crawluje
- W dokumentacji Apple czytamy: “Applebot-Extended does not crawl webpages. Webpages that disallow Applebot-Extended can still be included in search results.” (tłumaczenie) „Ten bot rozszerzony sam nie pobiera stron. Zakaz dla niego nie wyklucza witryny z wyników wyszukiwania”. Przejdź do cytatu
Perplexity — wyjątek dla pobieracza użytkownika
- PerplexityBot jest “designed to surface and link websites in search results on Perplexity. It is not used to crawl content for AI foundation models.” (tłumaczenie) „zaprojektowany do wyświetlania witryn i linkowania do nich w wynikach wyszukiwania Perplexity. Nie służy do crawlowania treści na potrzeby bazowych modeli AI”. Perplexity-User: “Since a user requested the fetch, this fetcher generally ignores robots.txt rules.” (tłumaczenie) „Ponieważ pobranie zlecił użytkownik, ten pobieracz zwykle ignoruje reguły robots.txt”. Przejdź do cytatu
Common Crawl — ukryta warstwa treningowa
- CCBot istnieje po to, aby “democratizing access to web information by producing and maintaining an open repository of web crawl data.” (tłumaczenie) „demokratyzować dostęp do informacji z sieci przez tworzenie i utrzymywanie otwartego repozytorium danych z crawlowania sieci”. Uwaga: “we are aware of crawlers falsely identifying themselves as CCBot.” (tłumaczenie) „wiemy o crawlerach, które fałszywie identyfikują się jako CCBot”. Przejdź do cytatu
llms.txt — propozycja według własnego opisu
- “A proposal to standardise on using an
/llms.txtfile to provide information to help LLMs use a website at inference time.” (tłumaczenie) „Propozycja ustandaryzowania pliku/llms.txt, który dostarcza informacji pomagających LLM-om używać witryny w czasie wnioskowania”. — specyfikacja llms.txt. Przejdź do cytatu
Ja — umowa społeczna
- “There’s a cost to bots crawling your websites and there’s a social contract between search engines and website owners, where search engines add value by sending referral traffic to websites. Google sends traffic (for now), so they don’t get blocked.” (tłumaczenie) „Crawlowanie witryn przez boty kosztuje, a wyszukiwarki i właścicieli witryn łączy umowa społeczna: wyszukiwarka daje wartość, gdy wysyła ruch z odsyłaczy. Google robi to (na razie), więc nie jest blokowane”. — Patrick Stox, Ahrefs. Przeczytaj artykuł
Główna tabela crawlerów AI
Centralny element artykułu. Każdy ważny bot AI, jego token user-agenta, operator,
kategoria i deklarowana zgodność z robots.txt. Kopiuj tokeny dokładnie — pisownia
i wielkość liter mają znaczenie w robots.txt.
| Bot | Token UA | Operator | Kategoria | Czy przestrzega robots.txt? |
|---|---|---|---|---|
| GPTBot | GPTBot | OpenAI | Trening | Tak (deklaracja) |
| OAI-SearchBot | OAI-SearchBot | OpenAI | Wyszukiwanie AI | Tak (deklaracja) |
| ChatGPT-User | ChatGPT-User | OpenAI | Pobieranie użytkownika | „Może nie mieć zastosowania” (inicjowane przez użytkownika) |
| OAI-AdsBot | OAI-AdsBot | OpenAI | Reklamy (nie trening) | Tak (deklaracja) |
| ClaudeBot | ClaudeBot | Anthropic | Trening | Tak (deklaracja) |
| Claude-SearchBot | Claude-SearchBot | Anthropic | Wyszukiwanie AI | Tak w przypadku indeksowania |
| Claude-User | Claude-User | Anthropic | Pobieranie użytkownika | Tak (Anthropic twierdzi, że wszystkie jego boty przestrzegają robots.txt) |
| Google-Extended | Google-Extended (tylko token — brak osobnego UA) | Kontrola treningu/groundingu | Tak (token wyłączenia) | |
| Google-CloudVertexBot | Google-CloudVertexBot | Vertex AI na żądanie właściciela | Tak | |
| PerplexityBot | PerplexityBot | Perplexity | Wyszukiwanie AI | Tak w przypadku indeksowania (zob. spory) |
| Perplexity-User | Perplexity-User | Perplexity | Pobieranie użytkownika | „Zwykle ignoruje” (deklaracja) |
| Applebot | Applebot | Apple | Wyszukiwanie AI (+ trening) | Tak |
| Applebot-Extended | Applebot-Extended (tylko token — nie crawluje) | Apple | Kontrola treningu | Tak (token wyłączenia) |
| Amazonbot | Amazonbot | Amazon | Trening | Tak (deklaracja) |
| Amzn-SearchBot | Amzn-SearchBot | Amazon | Wyszukiwanie AI (bez treningu) | Tak (deklaracja) |
| Amzn-User | Amzn-User | Amazon | Pobieranie użytkownika (Alexa; bez treningu) | Tak (deklaracja) |
| Meta-ExternalAgent | meta-externalagent | Meta | Trening/indeksowanie | Tak (deklaracja) |
| Meta-ExternalFetcher | meta-externalfetcher | Meta | Pobieranie użytkownika | Deklarowana |
| CCBot | CCBot | Common Crawl | Trening (otwarte dane) | Tak; istnieją podszywający się agenci |
| Bytespider | Bytespider | ByteDance | Trening | Sporna — zob. spory |
| AI2Bot | AI2Bot | Allen Institute | Trening | Tak (deklaracja) |
| cohere-training-data-crawler | cohere-training-data-crawler | Cohere | Trening | Tak (deklaracja) |
| Diffbot | Diffbot | Diffbot | Trening/ekstrakcja | Tak domyślnie |
| Timpibot | Timpibot | Timpi | Trening | Tak (deklaracja) |
| webzio-extended | webzio-extended | Webz.io | Trening | Deklarowana |
Trzy zasady wynikające z tabeli
- Zablokowanie bota treningowego (GPTBot, ClaudeBot, CCBot…) → brak wpływu na ranking.
- Zablokowanie bota wyszukiwania AI (OAI-SearchBot, PerplexityBot) → utrata widoczności w odpowiedziach AI.
- Google-Extended i Applebot-Extended to tokeny, nie crawlery — czyste wyłączenia treningu bez kosztu dla wyszukiwania.
Szybkie fakty
- GPTBot ≠ OAI-SearchBot ≠ ChatGPT-User — trzy niezależne reguły OpenAI.
Amzn-SearchBotiAmzn-UserAmazona nie trenują na pobieranych treściach.- Amazon respektuje metatag
noarchivejako sygnał „bez treningu” dla pojedynczej strony. - llms.txt to propozycja, nie przyjęty standard; najwięksi crawlerzy go nie respektują.
- Blokuj po user-agencie w robots.txt, a nie po IP (blokada IP może uniemożliwić botowi odczytanie Twojego robots.txt).
Jak audytować i decydować, na co zezwolić
Praktyczne przejście pomagające zdecydować, które crawlery AI zezwolić, blokować albo tylko obserwować.
- Pobierz logi serwera i wypisz, które user-agenty AI faktycznie do Ciebie trafiają (GPTBot, ClaudeBot, CCBot, Bytespider, OAI-SearchBot, PerplexityBot, Applebot itd.) oraz jak często. Logi są źródłem prawdy.
- Przypisz każdy do kategorii — trening, wyszukiwanie AI albo pobieranie użytkownika. Decyzje wynikają z kategorii, nie z marki.
- Zdecyduj o stanowisku wobec treningu. Jeśli akceptujesz trenowanie na treściach, zezwól botom treningowym. Jeśli nie, zablokuj GPTBot, ClaudeBot, CCBot, Bytespider, Amazonbot, Meta-ExternalAgent — i dodaj tokeny
Google-ExtendedorazApplebot-Extended. Żadne z tych działań nie wpływa na pozycje w Google. - Ostrożnie zdecyduj o wyszukiwaniu AI. Jeśli chcesz pojawiać się w odpowiedziach ChatGPT i Perplexity, pozostaw OAI-SearchBot i PerplexityBot dozwolone. Blokuj je tylko wtedy, gdy naprawdę chcesz zrezygnować z wyszukiwania AI.
- Nie złap niewłaściwego bota. Sprawdź, czy reguła „blokuj trening” nie obejmuje także bota wyszukiwania AI. GPTBot ≠ OAI-SearchBot.
- Blokuj po user-agencie, nie po IP — blokada IP może uniemożliwić botowi odczytanie robots.txt (to wyraźne ostrzeżenie Anthropic).
- Weryfikuj podejrzane boty. CCBot i inne boty bywają podrabiane; przed zaufaniem user-agentowi sprawdź opublikowane zakresy IP lub reverse DNS.
- Rozważ egzekwowanie na poziomie sieci (Cloudflare AI Crawl Control) dla botów, które nie przestrzegają robots.txt w sposób godny zaufania.
- Pomiń llms.txt jako działanie SEO — to propozycja, w dużej mierze nieczytana i nierozpoznawana przez największe crawlery. Nie oczekuj dzięki niej widoczności w wyszukiwaniu AI.
- Sprawdzaj co kwartał. Nowe boty pojawiają się stale (lista ai.robots.txt jest dobrym punktem odniesienia), a operatorzy zmieniają zachowanie.
Błąd, który kosztuje ruch z wyszukiwania AI
Mylenie botów treningowych z botami wyszukiwania AI to najdroższy pojedynczy błąd w tej dziedzinie — właśnie ten mit wskazany wyżej jako wymagający obalenia. Reguła mająca zatrzymać trenowanie modeli i reguła mająca zatrzymać cytowanie w wyszukiwaniu AI nie są tą samą regułą; ich pomieszanie ma przeciwne skutki.
- Źle: blokowanie „botów AI” jako jednej całości (pojedyncza reguła
Disallow, która przypadkiem obejmuje GPTBot i OAI-SearchBot). Dlaczego to źle: po cichu usuwa Cię z odpowiedzi ChatGPT i Perplexity, choć wydawało Ci się, że tylko rezygnujesz z treningu. Zrób tak: zapisuj osobne, nazwane reguły dla poszczególnych botów — blokuj GPTBot/ClaudeBot/CCBot/Bytespider w celu wyłączenia treningu, a OAI-SearchBot/PerplexityBot pozostaw dozwolone, chyba że świadomie chcesz zrezygnować z wyszukiwania AI.
Mylenie weryfikacji tożsamości z polityką dostępu
Opublikowana przez dostawcę lista adresów IP może pomóc zweryfikować, kto wysłał żądanie. Nie mówi jednak, jaka powinna być Twoja polityka, i nie zamienia blokady sieciowej w regułę robots.
- Źle: traktowanie zweryfikowanego zakresu jako automatycznej decyzji o zezwoleniu lub blokadzie.
Dlaczego to źle: tożsamość, deklarowana preferencja crawlowania i egzekwowany dostęp sieciowy to odrębne fakty.
Zrób tak: wyrażaj politykę crawlowania udokumentowanym tokenem
User-agent; dodatkowo stosuj egzekwowanie na poziomie sieci (Cloudflare AI Crawl Control) wobec botów, które nie przestrzegają pliku w sposób godny zaufania.
Traktowanie llms.txt jako dźwigni wyszukiwania AI
llms.txt jest stale reklamowany jako „robots.txt dla wyszukiwania AI”, ale to ujęcie jest nieprawidłowe według źródeł samego artykułu.
- Źle: publikowanie pliku
llms.txtz oczekiwaniem, że zwiększy widoczność lub liczbę cytowań w wyszukiwaniu AI. Dlaczego to źle: to propozycja, nie przyjęty standard — badanie Ahrefs obejmujące 137 tys. witryn wykazało, że 97% opublikowanych plików llms.txt pozostaje bez żadnych żądań, a żaden duży dostawca LLM nie przyjął go formalnie. Zrób tak: traktuj llms.txt najwyżej jako narzędzie dokumentacyjne, a wysiłek włóż w regułyrobots.txti crawlery wyszukiwania AI, które faktycznie kontrolują widoczność.
Ufanie user-agentowi bez jego weryfikacji
CCBot jest szczególnie często podrabiany — przyznaje to samo Common Crawl — a Bytespiderowi powszechnie przypisuje się ignorowanie zasad, których rzekomo przestrzega.
- Źle: zakładanie, że ciąg
User-agentw logach jest tym, za kogo się podaje. Dlaczego to źle: sfałszowany lub niezgodny bot może wysyłać pełny wolumen żądań, podczas gdy reguła robots.txt pozostaje niewykonana. Zrób tak: przed zaufaniem temu ciągowi potwierdź duży wolumen lub podejrzane żądania w opublikowanych zakresach IP operatora albo przez reverse DNS — karta Tools zawiera narzędzie stworzone dokładnie do tego sprawdzenia.
Decyzja: zezwolić, blokować czy monitorować
1. Najpierw przypisz kategorię — od niej zależy wszystko. Trening, wyszukiwanie AI czy pobieranie użytkownika. Gdy kategoria jest właściwa, konsekwencja jest oczywista: blokady treningowe są bezpieczne dla SEO, blokady wyszukiwania AI kosztują widoczność AI, a pobieranie użytkownika jest sporne.
2. Reguła zezwól / blokuj / monitoruj.
- Zezwalaj botom wyszukiwania AI (OAI-SearchBot, PerplexityBot, Applebot), jeśli chcesz widoczności z odsyłaczy AI — większość witryn powinna tak zrobić.
- Blokuj boty treningowe (GPTBot, ClaudeBot, CCBot, Bytespider), jeśli nie chcesz, aby trenowano na Twoich treściach — bez kosztu dla rankingu. Dodaj tokeny Google-Extended/Applebot-Extended dla treningu Gemini/Apple.
- Monitoruj pobieracze uruchamiane przez użytkownika i znanych złych aktorów (Bytespider, niezadeklarowany ruch Perplexity). robots.txt może ich nie zatrzymać; logi i reguły na poziomie sieci pozwalają faktycznie ich obserwować i kontrolować.
3. Sprawdzenie „token, nie bot”. Zanim wyciągniesz wnioski z ruchu crawlera, zapytaj: czy to rzeczywisty crawler, czy token kontroli? Google-Extended i Applebot-Extended nie generują żadnego ruchu — tylko przełączają uprawnienie dotyczące ruchu, który już wystąpił.
4. Trening ≠ wyszukiwanie AI (kosztowny błąd). Dwie osobne reguły robots.txt i przeciwne konsekwencje. Nigdy nie blokuj „botów AI” jako jednej całości — albo nie zatrzymasz treningu, albo przypadkowo usuniesz się z odpowiedzi AI.
5. robots.txt to żądanie; egzekwowanie jest osobne. Protokół działa wobec botów, które go przestrzegają. Wobec tych, które wyłączają się z zasad (pobieracze użytkownika) albo którym przypisuje się ignorowanie pliku (skryte crawlery Perplexity, Bytespider), potrzebne jest egzekwowanie na poziomie sieci (Cloudflare) — sam robots.txt nie wystarczy.
Czy blokować tego bota AI?
To drzewo decyzyjne przeprowadza krok po kroku przez regułę zezwól/blokuj/monitoruj z karty Frameworks. Najpierw ustal, do której z trzech kategorii należy bot, a następnie odpowiedz na jedno pytanie rozstrzygające o jego losie.
Should I block this AI bot?
Kwartalny audyt robots.txt botów AI
Regularne sprawdzenie pozwala dopasować reguły robots.txt do rzeczywistości, gdy pojawiają się nowe boty AI, a operatorzy zmieniają zachowanie — karta Checklists już sygnalizuje „sprawdzaj co kwartał”, a poniżej znajduje się wersja krok po kroku.
- Pobierz kwartalne trafienia botów AI. Przepuść logi serwera przez Analizator plików logów albo wyszukaj znaną listę user-agentów (karta Scripts zawiera dokładne polecenie), aby zobaczyć, które boty AI faktycznie Cię odwiedziły i jak często.
- Ponownie sprawdź kategorię każdego bota. Porównaj każdy user-agent z główną tabelą na karcie Cheat Sheets, aby potwierdzić, czy nadal jest treningowy, wyszukiwawczy czy użytkownika — a każdy nowy, nierozpoznany bot oznacz na tle listy projektu ai.robots.txt.
- Przetestuj bieżące reguły. Uruchom działający
robots.txtw Testerze robots.txt dla user-agenta każdego bota, aby potwierdzić, że reguły treningowe nie obejmują przypadkiem bota wyszukiwania AI. - Zweryfikuj podejrzane lub intensywne trafienia. Przed zaufaniem user-agentowi potwierdź CCBot, Bytespider i podobne boty w opublikowanych zakresach IP operatora albo przez reverse DNS za pomocą Weryfikatora Googlebota — podszywanie się zdarza.
- Zapisz kwartalny udział crawlowania botów AI. Odnotuj podział ruchu na trening, wyszukiwanie AI i pobieranie użytkownika (zob. kartę How to Measure), aby kolejny audyt kwartalny miał trend do porównania, a nie tylko pojedynczy obraz.
Potwierdź, że edycja robots.txt zrobiła to, co zamierzałeś
Po edycji robots.txt w celu zablokowania botów treningowych wykonaj poniższe kontrole, zanim uznasz zmianę za zakończoną — chodzi o udowodnienie, że boty wyszukiwania AI nadal docierają do stron, a boty treningowe są rzeczywiście blokowane.
Test 1: boty wyszukiwania AI nadal dozwolone
- Test: sprawdź URL dla user-agentów
OAI-SearchBotiPerplexityBotza pomocą Testera robots.txt albo potwierdź rzeczywiste trafienia przez Weryfikator Googlebota. - Oczekiwany wynik: „Dozwolone” dla obu botów na każdej stronie, którą chcesz cytować w odpowiedziach AI.
- Interpretacja niepowodzenia: wynik „Zabronione” oznacza, że reguła blokująca trening jest zbyt szeroka i złapała niewłaściwy user-agent.
- Okno monitorowania: natychmiast w testerze; na odświeżenie własnej kopii robots.txt przez bota poczekaj kilka dni.
- Warunek wycofania: bot wyszukiwania AI, któremu chcesz zezwolić, pokazuje wynik „Zabronione” albo po zmianie spadają cytowania/odsyłacze z tej wyszukiwarki.
Test 2: boty treningowe rzeczywiście zablokowane
- Test: sprawdź ten sam URL dla
GPTBot,ClaudeBot,CCBotiBytespiderza pomocą Testera robots.txt. - Oczekiwany wynik: „Zabronione” dla każdego z nich.
- Interpretacja niepowodzenia: wynik „Dozwolone” zwykle oznacza literówkę w tokenie — pisownia i wielkość liter mają znaczenie w robots.txt.
- Okno monitorowania: natychmiast.
- Warunek wycofania: nie jest wymagany — blokada treningu nie potrzebuje ścieżki wycofania, chyba że ostatecznie uznasz, że trenowanie Ci odpowiada.
Test 3: pozycje w Google bez zmian
- Test: sprawdź skuteczność i zasięg indeksowania dotkniętych URL-i w Search Console kilka tygodni po zablokowaniu botów treningowych lub tokena
Google-Extended. - Oczekiwany wynik: brak istotnej zmiany wyświetleń lub pozycji — Google stwierdza, że
Google-Extended“does not impact a site’s inclusion in Google Search.” (tłumaczenie) „nie wpływa na uwzględnienie witryny w Google Search”. - Interpretacja niepowodzenia: duży spadek wyświetleń zbiegający się ze zmianą zwykle oznacza, że zbyt szeroka reguła złapała samego Googlebota.
- Okno monitorowania: 2–4 tygodnie (opóźnienie raportowania Search Console).
- Warunek wycofania: wyświetlenia lub pozycje spadają, a Googlebot ma wynik „Zabronione” dla URL-a, który powinien być crawlable.
Stałe KPI ruchu botów AI
Śledzenie tych wartości kwartał po kwartale pokazuje, czy polityka wobec botów AI rzeczywiście robi to, czego chcesz — niezależnie od pojedynczej edycji robots.txt.
| Metryka | Co mówi | Jak pobrać | Benchmark / realistyczny zakres | Częstotliwość |
|---|---|---|---|---|
| Udział botów AI w całym ruchu crawlującym według kategorii (trening / wyszukiwanie AI / pobieranie użytkownika) | Czy boty AI stanowią coraz większą część całkowitego obciążenia crawlowaniem i która kategoria je napędza | Logi serwera przez Analizator plików logów albo Cloudflare AI Crawl Control, jeśli korzystasz z Cloudflare | Brak uniwersalnego celu — Cloudflare Radar określił udział botów AI na około 18,9% wszystkich żądań botów w skali branży (2025), ale liczy się miks Twojej witryny; najpierw ustal własną bazę w pierwszym kwartale, potem śledź trend | Kwartalnie |
| Stosunek crawlowania do odsyłaczy dla każdego bota wyszukiwania AI | Ile „czynszu za crawlowanie” płacisz za jednostkę ruchu z odsyłaczy wyszukiwania AI | Porównaj liczbę crawli danego user-agenta w logach serwera z rzeczywistymi wizytami z odsyłaczy w analityce | Brak stałego celu — karta Stats artykułu podaje około 14 crawli Google na jeden odsyłacz wobec znacznie wyższych stosunków dla crawlerów AI; oczekuj gorszego wyniku niż Google i obserwuj trend, nie samą liczbę | Kwartalnie |
| Dokładność blokad treningowych | Czy reguła Disallow dla botów treningowych nie łapie przypadkiem także bota wyszukiwania AI lub pobieracza użytkownika | Przeprowadź audyt robots.txt względem głównej tabeli na karcie Cheat Sheets; potwierdź wynik w Testerze robots.txt | Powinna wynosić zero — żaden bot wyszukiwania AI nie powinien być blokowany przez regułę przeznaczoną dla botów treningowych | Przy każdej zmianie robots.txt oraz kwartalny audyt |
robots.txt — blokowanie najważniejszych botów
Blokuj crawlery treningowe, pozostaw wyszukiwanie AI. Wyłączasz w ten sposób trenowanie modeli, zachowując widoczność w odpowiedziach ChatGPT/Perplexity. Kopiuj tokeny dokładnie.
# --- AI training crawlers ---
User-agent: GPTBot
Disallow: /
User-agent: ClaudeBot
Disallow: /
User-agent: CCBot
Disallow: /
User-agent: Bytespider
Disallow: /
User-agent: meta-externalagent
Disallow: /
User-agent: Amazonbot
Disallow: /
# --- Training control tokens (not crawlers) ---
# Opt out of Gemini/Vertex training; search unaffected
User-agent: Google-Extended
Disallow: /
# Opt out of Apple Intelligence training; Applebot search unaffected
User-agent: Applebot-Extended
Disallow: /Blokuj indeksujące boty wyszukiwania AI (to ZMNIEJSZA widoczność odpowiedzi AI). Rób to tylko wtedy, gdy naprawdę chcesz zrezygnować z odpowiedzi ChatGPT/Perplexity.
User-agent: OAI-SearchBot
Disallow: /
User-agent: PerplexityBot
Disallow: /Najważniejsza zasada: zablokowanie GPTBot nie blokuje OAI-SearchBot ani ChatGPT-User — każdy z nich ma niezależną regułę.
Rozpoznawanie botów AI w logach dostępu
Sprawdź, które user-agenty AI do Ciebie trafiają i jak często.
macOS / Linux
# Count hits per known AI bot in an Apache/Nginx access log
grep -iE 'GPTBot|OAI-SearchBot|ChatGPT-User|ClaudeBot|Claude-User|Claude-SearchBot|PerplexityBot|Perplexity-User|CCBot|Bytespider|Amazonbot|Amzn-SearchBot|meta-externalagent|Applebot|AI2Bot|Diffbot' access.log \
| grep -oiE 'GPTBot|OAI-SearchBot|ChatGPT-User|ClaudeBot|Claude-User|Claude-SearchBot|PerplexityBot|Perplexity-User|CCBot|Bytespider|Amazonbot|Amzn-SearchBot|meta-externalagent|Applebot|AI2Bot|Diffbot' \
| sort | uniq -c | sort -rnWindows (PowerShell)
# Count hits per known AI bot in an access log
$bots = 'GPTBot','OAI-SearchBot','ChatGPT-User','ClaudeBot','Claude-User','Claude-SearchBot','PerplexityBot','Perplexity-User','CCBot','Bytespider','Amazonbot','Amzn-SearchBot','meta-externalagent','Applebot','AI2Bot','Diffbot'
Select-String -Path .\access.log -Pattern ($bots -join '|') |
ForEach-Object { ($_ -split '"')[5] } |
ForEach-Object { foreach ($b in $bots) { if ($_ -match $b) { $b } } } |
Group-Object | Sort-Object Count -Descending | Select-Object Count, NameCiąg user-agenta można sfałszować (szczególnie CCBot) — przed podjęciem działań potwierdź ważne boty w opublikowanych zakresach IP operatora albo przez reverse DNS i forward DNS.
Klasyfikowanie trafień w logach według kategorii botów AI
Wklej surowe wiersze logu serwera albo listę ciągów user-agentów i poproś AI o sklasyfikowanie każdego z nich na podstawie głównej tabeli z karty Cheat Sheets — przydatne, gdy patrzysz na plik logu pełen nieznanych nazw botów.
I have a list of user-agent strings from my server logs. Using this
classification (paste the Cheat Sheets table from this article, or the list
below), classify each user-agent as one of: Training, AI-search, User fetch,
or Control token (not a crawler). Flag any user-agent you don't recognize as
"unknown — verify."
Categories:
- Training: GPTBot, ClaudeBot, CCBot, Bytespider, Amazonbot, Meta-ExternalAgent,
AI2Bot, cohere-training-data-crawler, Diffbot, Timpibot, webzio-extended
- AI-search: OAI-SearchBot, PerplexityBot, Applebot, Amzn-SearchBot
- User fetch: ChatGPT-User, Perplexity-User, Claude-User, Claude-SearchBot,
Amzn-User, Meta-ExternalFetcher
- Control token (no crawl traffic): Google-Extended, Applebot-Extended
My user-agent list:
<paste your list here>Tworzenie listy blokad robots.txt na podstawie stanowiska
Opisz prostym językiem swoje stanowisko wobec treningu i wyszukiwania AI, a następnie poproś AI o przygotowanie odpowiadających mu reguł robots.txt. Przed publikacją sprawdź wynik w Testerze robots.txt.
Draft a robots.txt block that does the following, using exact, correctly-cased
user-agent tokens for each rule (one User-agent/Disallow pair per bot, don't
combine bots under one User-agent line):
1. Block all training bots: GPTBot, ClaudeBot, CCBot, Bytespider,
Meta-ExternalAgent, Amazonbot.
2. Also disallow the Google-Extended and Applebot-Extended control tokens
(training/grounding opt-out only — not real crawlers).
3. Leave OAI-SearchBot and PerplexityBot allowed so AI-search visibility is
unaffected.
Output only the robots.txt block, no explanation. Narzędzia do weryfikowania i kontrolowania botów AI
-
Weryfikator Googlebota — wklej trafienia z logów serwera i potwierdź, czy żądanie „GPTBot” lub „ClaudeBot” rzeczywiście pochodzi z opublikowanego zakresu IP tego operatora, czy od podszywacza. To bezpośrednia poprawka błędu „ufania user-agentowi” z karty What Not to Do.
-
Tester robots.txt — sprawdź, czy konkretny URL jest dozwolony lub zablokowany dla user-agenta konkretnego bota, aby potwierdzić, że reguła blokująca trening nie łapie również bota wyszukiwania AI.
-
Generator robots.txt — twórz reguły blokowania treningu i zezwalania na wyszukiwanie AI z karty Scripts, bez ręcznego wpisywania tokenów user-agentów (literówka po cichu psuje regułę).
-
Generator i walidator llms.txt — jeśli nadal chcesz mieć plik llms.txt do celów dokumentacyjnych, wygeneruj go i zwaliduj tutaj — tylko nie oczekuj, że zwiększy widoczność w wyszukiwaniu AI (zob. What Not to Do).
Zasoby warte uwagi
Moje powiązane teksty
- Poznaj nowe crawlery sieci: boty AI zbliżają się do botów wyszukiwarek — moja analiza Cloudflare Radar; boty AI jako wyraźnie drugi crawler oraz ujęcie w kategoriach umowy społecznej.
- Boty AI, które blokuje najwięcej z około 140 milionów witryn — dane o odsetku blokad robots.txt w otwartej sieci oraz zależność między wolumenem żądań a odsetkiem blokad.
- ChatGPT ma 12% wolumenu wyszukiwania Google, ale Google wysyła 190x więcej ruchu — różnica między odsyłaczami AI i wyszukiwania, która napędza spór o blokowanie.
- Co naprawdę wiemy o optymalizacji pod wyszukiwanie LLM — szerszy kontekst GEO.
Od innych autorów
- Cloudflare: Perplexity używa ukrytych, nieujawnionych crawlerów — dochodzenie z sierpnia 2025 (raportowane ustalenia).
- Robb Knight: Perplexity AI kłamie na temat swojego user-agenta — pierwotne dochodzenie z czerwca 2024.
- Projekt ai.robots.txt — społecznościowo utrzymywana lista ponad 150 user-agentów botów AI.
- Known Agents (wcześniej Dark Visitors) — obszerna lista botów AI.
- Cloudflare: Ogłoszenie niezależności AI (blokowanie botów AI jednym kliknięciem) — ogłoszenie przełącznika Cloudflare „AI Scrapers and Crawlers” do blokowania botów jednym kliknięciem.
- Cloudflare: Kontrolowanie użycia treści do trenowania AI — zarządzany robots.txt, dyrektywy Content Signals i wyjaśnienie wersji beta pay-per-crawl.
- Heise Online: Crawler bez ograniczeń — Perplexity ignoruje robots.txt — relacja z czerwca 2024 o omijaniu robots.txt przez Perplexity.
- Gizmodo: Perplexity AI ignorowało zasady internetu — dalsze relacje o sporze dotyczącym przestrzegania robots.txt.
Statystyki warte cytowania
- Boty AI są wyraźnie drugim crawlerem. Z mojej analizy Cloudflare Radar wynika, że boty wyszukiwarek nadal crawlują najwięcej, ale boty AI zdecydowanie zajmują drugie miejsce i zmierzają do wyprzedzenia wyszukiwarek — już stanowią około 18,9% wszystkich żądań botów. Źródło
- Różnica w odsyłaczach napędza blokowanie. Google wysyła witrynom około 190 razy więcej ruchu niż ChatGPT, mimo że ChatGPT ma istotny udział w wolumenie wyszukiwania Google — to nierównowaga stojąca za argumentem o „umowie społecznej”. Źródło
- Stosunek crawlowania do odsyłaczy (Cloudflare, 2025). Około 14 crawli Google na jedną wizytę z odsyłacza wobec znacznie wyższych wartości dla crawlerów AI — rzędu tysięcy crawli OpenAI i dziesiątek tysięcy crawli Anthropic na jeden odsyłacz. To dlatego wydawcy kwestionują ten kompromis.
- Rzeczywistość llms.txt. W badaniu Ahrefs obejmującym 137 tys. witryn około 28% opublikowało plik llms.txt, ale 97% tych plików nie otrzymało żadnych żądań, a żaden duży dostawca LLM nie przyjął go formalnie. Źródło
- Odsetki blokad w otwartej sieci. Z mojego badania około 140 mln witryn wynika, że najczęściej blokowane boty AI to GPTBot, CCBot, ClaudeBot, Amazonbot i Bytespider — odsetki blokad rosną wraz z wolumenem żądań. Źródło
- Zasięg i egzekwowanie Bytespidera. Bytespider docierał do 40,40% wszystkich witryn chronionych przez Cloudflare, zanim Cloudflare zaczął go blokować w lipcu 2024 r.; później ruch spadł o 71,45%. Meta-ExternalAgent docierał do 22,16% chronionych witryn — ustępując tylko GPTBotowi (28,97%). Źródło
- Wzrost ruchu botów AI. Dane Cloudflare Radar pokazują, że ruch botów AI wzrósł w 2025 r. o 65% w ciągu sześciu miesięcy, a liczba żądań GPTBot wzrosła o 305% między majem 2024 a majem 2025. Od lipca 2025 r. nowe domeny Cloudflare domyślnie blokują znane crawlery AI, a ponad milion klientów Cloudflare włączyło funkcję blokowania botów AI. Źródło
Sprawdź się: Crawlery AI
Pięć krótkich pytań o trzech kategoriach crawlerów AI i związanych z nimi pułapkach. Wybierz odpowiedź na każde pytanie, a następnie sprawdź wynik.
Dziennik zmian
Zaktualizowano 9 sie 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 8 sie 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 30 lip 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 29 lip 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 29 lip 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 28 lip 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 19 lip 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 16 lip 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
- Advanced
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.