Generator mapy witryny XML
Bounded and polite: at most three page requests run at once; each request is capped at 900 KB/10 seconds, and the server also rate-limits each target host. This is a sitemap seed, not a full-site crawler.
Kontrole są uruchamiane na naszym serwerze; pobieramy podany adres URL i nie przechowujemy wyników. The start site, its robots.txt, and eligible same-host HTML pages are sent through this site's bounded fetch endpoints. Crawl decisions and XML generation run in your browser. Anonimowe liczniki wyników poszczególnych uruchomień mogą być wykorzystywane do badań zbiorczych; adresy URL, domeny, adresy IP i identyfikatory nigdy nie są uwzględniane, a statystyki nie są publikowane poniżej 100 uruchomień.
+ zapisuje bieżącą witrynę lub stronę. Użyj ☆ obok dowolnej zapisanej witryny, strony lub listy, aby dodać ją do ulubionych. Historia ostatnich kontroli pojawi się poniżej.
Utwórz nazwaną listę
Cel uzupełniony na podstawie lokalnych wyborów.
Paszport witryny Kontekst lokalny tej zapisanej witryny
Dane lokalne
Zapisane cele, nazwane listy i podsumowania ostatnich kontroli pozostają tylko w tej przeglądarce.
Sitemap output
Excluded
Unknown / not included
Oceń to narzędzie
O tym narzędziu
Przeskanuj ograniczony zbiór stron tej samej witryny, respektuj robots.txt i pobierz uczciwą mapę XML Sitemap bez udawania pełnego crawla.
Funkcje
- Twardy limit 25, 50, 100 lub maksymalnie 200 stron.
- Najwyżej trzy równoległe żądania, każde ograniczone do 900 KB i 10 sekund.
- Osobne listy stron uwzględnionych, wykluczonych oraz unknown / not included.
- Emitowanie lastmod wyłącznie z prawidłowego Last-Modified, time datetime albo JSON-LD dateModified/datePublished.
Jak to działa
Crawler pozostaje w tej samej witrynie, stosuje reguły Googlebot z robots.txt i odrzuca strony noindex lub wskazujące inny canonical. Odkryte adresy trafiają do kolejki do wybranego limitu, a XML obejmuje tylko strony z wystarczającymi dowodami w pobranej odpowiedzi.
Ograniczenia
- Generator nie crawluje całej witryny i jawnie zgłasza kolejkę pozostałą po osiągnięciu limitu.
- Odpowiedzi nie-2xx, nie-HTML, ucięte i zakończone błędem pozostają w stanie nieznanym.
- Narzędzie nigdy nie wpisuje dzisiejszej daty lastmod do każdej strony.
Częste pytania
Czy narzędzie przeszukuje całą moją witrynę?
Nie. Wybierasz sztywny limit do 200 stron. Narzędzie informuje, gdy po osiągnięciu limitu kolejka nadal nie jest pusta, dlatego ograniczony proces przeszukiwania nigdy nie jest przedstawiany jako kompletny.
Które strony są wykluczane?
Wykluczane są strony z nagłówkiem lub tagiem meta noindex, strony, których canonical wskazuje inne miejsce, oraz adresy URL zablokowane dla Googlebota w robots.txt. Odpowiedzi zakończone błędem, inne niż HTML, obcięte i spoza zakresu 2xx pozostają w osobnym stanie nieznanym.
Jak wybierana jest wartość lastmod?
Emitowana jest tylko prawidłowa wartość nagłówka HTTP Last-Modified, widoczny atrybut datetime elementu time albo wartość dateModified lub datePublished z JSON-LD. Narzędzie nigdy nie przypisuje wszystkim stronom dzisiejszej daty.
Typowe problemy i sposoby ich naprawy
- Ostrzeżenie Strona noindex jest wykluczona z mapy witryny Poprawka: Usuń noindex, jeśli strona ma być indeksowana; w przeciwnym razie pozostaw ją poza mapą witryny.
- Ostrzeżenie Strona bez statusu 200 jest wykluczona z mapy witryny Poprawka: Przywróć bezpośrednią odpowiedź 200 dla strony kanonicznej albo pozostaw adres bez statusu 200 poza mapą.
- Ostrzeżenie Strona wskazująca inny adres kanoniczny jest wykluczona Poprawka: Uwzględnij tylko miejsce kanoniczne, a adres wskazujący gdzie indziej pozostaw poza mapą witryny.
- Informacja Zduplikowany adres URL został usunięty Poprawka: Zachowaj jeden znormalizowany kanoniczny wpis adresu URL i usuń zduplikowane warianty pisowni lub parametrów.
- Ostrzeżenie Nieprawidłowy adres URL został wykluczony Poprawka: Popraw błędny bezwzględny adres URL przed dodaniem go do mapy witryny.
- Ostrzeżenie Adres URL innego hosta został wykluczony Poprawka: Wygeneruj osobną mapę witryny dla innego zweryfikowanego hosta i zachowaj tę mapę wyłącznie dla bieżącego hosta.