Generator mapy witryny XML

Bounded and polite: at most three page requests run at once; each request is capped at 900 KB/10 seconds, and the server also rate-limits each target host. This is a sitemap seed, not a full-site crawler.

Kontrole są uruchamiane na naszym serwerze; pobieramy podany adres URL i nie przechowujemy wyników. The start site, its robots.txt, and eligible same-host HTML pages are sent through this site's bounded fetch endpoints. Crawl decisions and XML generation run in your browser. Anonimowe liczniki wyników poszczególnych uruchomień mogą być wykorzystywane do badań zbiorczych; adresy URL, domeny, adresy IP i identyfikatory nigdy nie są uwzględniane, a statystyki nie są publikowane poniżej 100 uruchomień.

Opinia
Zgłoś błąd

Coś nie działa w Generator mapy witryny XML? Opisz, co się stało — zgłoszenie trafi bezpośrednio do prywatnej kolejki weryfikacji, a nie na publiczną listę.

Dane, które zostaną wysłane
 Dane wejściowe narzędzia, przesłane pliki, wklejone źródła, pełne wyniki, parametry zapytania i fragmenty URL nie są dołączane automatycznie. Możesz edytować lub usunąć zaznaczony powyżej fragment. Metadane przeglądarki i ochrony przed nadużyciami są przetwarzane w celu zapobiegania spamowi. 

O tym narzędziu

Przeskanuj ograniczony zbiór stron tej samej witryny, respektuj robots.txt i pobierz uczciwą mapę XML Sitemap bez udawania pełnego crawla.

Funkcje

  • Twardy limit 25, 50, 100 lub maksymalnie 200 stron.
  • Najwyżej trzy równoległe żądania, każde ograniczone do 900 KB i 10 sekund.
  • Osobne listy stron uwzględnionych, wykluczonych oraz unknown / not included.
  • Emitowanie lastmod wyłącznie z prawidłowego Last-Modified, time datetime albo JSON-LD dateModified/datePublished.

Jak to działa

Crawler pozostaje w tej samej witrynie, stosuje reguły Googlebot z robots.txt i odrzuca strony noindex lub wskazujące inny canonical. Odkryte adresy trafiają do kolejki do wybranego limitu, a XML obejmuje tylko strony z wystarczającymi dowodami w pobranej odpowiedzi.

Ograniczenia

  • Generator nie crawluje całej witryny i jawnie zgłasza kolejkę pozostałą po osiągnięciu limitu.
  • Odpowiedzi nie-2xx, nie-HTML, ucięte i zakończone błędem pozostają w stanie nieznanym.
  • Narzędzie nigdy nie wpisuje dzisiejszej daty lastmod do każdej strony.

Częste pytania

Czy narzędzie przeszukuje całą moją witrynę?

Nie. Wybierasz sztywny limit do 200 stron. Narzędzie informuje, gdy po osiągnięciu limitu kolejka nadal nie jest pusta, dlatego ograniczony proces przeszukiwania nigdy nie jest przedstawiany jako kompletny.

Które strony są wykluczane?

Wykluczane są strony z nagłówkiem lub tagiem meta noindex, strony, których canonical wskazuje inne miejsce, oraz adresy URL zablokowane dla Googlebota w robots.txt. Odpowiedzi zakończone błędem, inne niż HTML, obcięte i spoza zakresu 2xx pozostają w osobnym stanie nieznanym.

Jak wybierana jest wartość lastmod?

Emitowana jest tylko prawidłowa wartość nagłówka HTTP Last-Modified, widoczny atrybut datetime elementu time albo wartość dateModified lub datePublished z JSON-LD. Narzędzie nigdy nie przypisuje wszystkim stronom dzisiejszej daty.

Następny krokWalidator mapy witryny XML — verify it with a direct check. Wskazówki są dostępne po angielsku.