Mapa witryny XML
Czym jest mapa witryny XML, jej budowa, ignorowane tagi (priority/changefreq), dokładny lastmod, limity 50 000/50 MB, hreflang w mapach witryny oraz jak ją przesłać.
Języki
1 sygnał dowodowy na tej stronie
- Powiązane działające narzędzieGoogle Index Checker
Mapa witryny XML to plik UTF-8 zawierający listę kanonicznych, indeksowalnych adresów URL, które chcesz, aby wyszukiwarki znały — każdy w bloku <url> z wymaganym <loc> i opcjonalnym <lastmod>. Pomaga wyszukiwarkom odkrywać adresy URL, ale nie gwarantuje indeksacji; jej prawdziwa wartość to diagnostyka przesłane-a-zaindeksowane w Search Console. Google ignoruje <priority> i <changefreq>, a <lastmod> używa tylko wtedy, gdy jest weryfikowalnie dokładny (znaczące aktualizacje, a nie zbiorcze „dzisiaj”). Jedna mapa witryny ma limit 50 000 adresów URL lub 50 MB nieskompresowanych — powyżej tego dzielisz pliki i odwołujesz się do nich z indeksu map witryny. Uwzględniaj tylko kanoniczne, indeksowalne adresy URL ze statusem 200; pominięcie adresu URL w mapie witryny nie jest tym samym co noindex. Mapy witryny to także najłatwiejsze miejsce do zarządzania hreflang na dużą skalę. Odwołaj się do niej w robots.txt i prześlij ją w Search Console i Bing Webmaster Tools.
Evidence for this claim The XML sitemap protocol lists canonical URL locations and optional metadata, with limits of 50,000 URLs and 50 MB uncompressed per sitemap. Scope: Sitemaps protocol and current Google-supported limits. Confidence: high · Verified: Sitemaps XML format Evidence for this claim Google treats sitemaps as discovery hints rather than guarantees and supports submission through Search Console or robots.txt references. Scope: Current Google sitemap behavior and submission methods. Confidence: high · Verified: Google Search Central: Build and submit a sitemapTL;DR — Mapa witryny XML to plik zawierający listę stron Twojej witryny, które chcesz, aby wyszukiwarki znalazły. Każda strona ma jeden wpis: jej pełny adres URL oraz, opcjonalnie, datę ostatniej istotnej zmiany. Pomaga wyszukiwarkom odkryć Twoje strony — nie zmusza ich do indeksowania ani rankowania czegokolwiek. Umieszczasz ją pod adresem takim jak
/sitemap.xml, wskazujesz na nią wrobots.txti przesyłasz ją w Google Search Console i Bing Webmaster Tools.
Czym jest mapa witryny XML
Mapa witryny XML to lista Twoich adresów URL, zapisana w prostym, strukturalnym formacie, którą przekazujesz bezpośrednio wyszukiwarkom. Zamiast zmuszać je do odkrywania każdej strony przez podążanie za linkami, dajesz im czysty spis stron, na których Ci zależy.
Google opisuje mapę witryny jako “a file where you provide information about the pages, videos, and other files on your site.” (tłumaczenie) „plik, w którym podajesz informacje o stronach, filmach i innych plikach w swojej witrynie.” Część „XML” oznacza po prostu, że jest zapisana w formacie ze znacznikami, który maszyny czytają łatwo. Oto najmniejszy poprawny przykład:
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://www.example.com/foo.html</loc>
<lastmod>2026-06-04</lastmod>
</url>
</urlset>Czytając od góry do dołu: pierwsza linia mówi „to jest XML, zakodowany jako UTF-8.”
<urlset> obejmuje całą listę. Każdy <url> to jedna strona. <loc> to pełny adres
strony. <lastmod> to data ostatniej istotnej zmiany — i jest opcjonalny.
Co robi (a czego nie robi)
Mapa witryny pomaga wyszukiwarkom szybciej znaleźć Twoje strony — zwłaszcza nowe strony lub strony, które nie są dobrze linkowane z innych miejsc w Twojej witrynie. To jest zaleta.
Najczęściej pomijany haczyk: przesłanie mapy witryny nie gwarantuje indeksowania. Google nadal decyduje, czy każda strona jest warta zachowania. Mapa witryny to sposób, aby pomóc wyszukiwarkom znaleźć Twoje treści, a nie polecenie ich indeksowania. Dla mnie prawdziwa wartość polega na tym, co możesz zobaczyć później w Search Console — ile z przesłanych adresów URL faktycznie zostało zaindeksowanych. Ta różnica jest użytecznym wskaźnikiem diagnostycznym.
Co umieścić w mapie witryny
Trzymaj ją czystą. Mapa witryny powinna zawierać tylko strony, które faktycznie chcesz zaindeksować —
Twoje prawdziwe, kanoniczne strony, które zwracają normalną odpowiedź 200. Pomiń
przekierowania, zduplikowane adresy URL i wszystko, co ustawiłeś na noindex. Traktuj ją jako
schludny spis Twojego zestawu indeksowalnych stron, nic więcej.
Jedna ważna kwestia, która bywa myląca: pominięcie adresu URL w mapie witryny nie usuwa go
z Google. Mapa witryny reklamuje strony; nie ukrywa ich. Aby faktycznie
utrzymać stronę poza indeksem, potrzebujesz tagu noindex — a nie brakującego
wpisu w mapie witryny.
Gdzie ją umieścić i jak ją przesłać
- Zapisz ją pod sensownym adresem URL —
/sitemap.xmlto konwencjonalny domyślny. - Dodaj linię do
robots.txt, aby wyszukiwarki mogły ją znaleźć:Sitemap: https://www.example.com/sitemap.xml. - Prześlij ją w Google Search Console (raport Sitemaps) i Bing Webmaster Tools.
Większość nowoczesnych platform (WordPress, Shopify, Wix, Squarespace, Webflow) generuje mapę witryny automatycznie — zwykle wystarczy ją przesłać. Chcesz poznać pełną anatomie, limity, tagi, które Google ignoruje, oraz jak działa hreflang w mapach witryny? Przełącz się na zakładkę Advanced.
Evidence for this claim The XML sitemap protocol lists canonical URL locations and optional metadata, with limits of 50,000 URLs and 50 MB uncompressed per sitemap. Scope: Sitemaps protocol and current Google-supported limits. Confidence: high · Verified: Sitemaps XML format Evidence for this claim Google treats sitemaps as discovery hints rather than guarantees and supports submission through Search Console or robots.txt references. Scope: Current Google sitemap behavior and submission methods. Confidence: high · Verified: Google Search Central: Build and submit a sitemapTL;DR — Mapa witryny XML to plik UTF-8 z kanonicznymi, indeksowalnymi adresami
<loc>, każdy opcjonalnie z<lastmod>. Pomaga w odkrywaniu, nie w indeksowaniu — korzyścią jest sygnał przesłane-vs-zaindeksowane w Search Console. Google ignoruje<priority>i<changefreq>i używa<lastmod>tylko wtedy, gdy jest weryfikowalnie dokładny (znaczące aktualizacje, nigdy zbiorcze „dzisiaj”). Jeden plik ma limit 50 000 adresów URL lub 50 MB nieskompresowanych — powyżej tego podziel i użyj indeksu mapy witryny. Uwzględniaj tylko200, kanoniczne, indeksowalne adresy URL; wykluczenie adresu URL nie jest tym samym co noindexowanie go. XML to nie jedyny akceptowany format (RSS/Atom/txt też działają), a mapy witryny to najłatwiejsze miejsce do zarządzania hreflang na dużą skalę — chociaż te adnotacje pojawiają się z opóźnieniem, nie natychmiast. Odwołaj się do niej wrobots.txti prześlij ją w Search Console + Bing Webmaster Tools.
Czym właściwie jest mapa witryny XML
Mapa witryny XML to plik, zapisany zgodnie z protokołem sitemaps.org 0.9, który
zawiera listę adresów URL Twojej witryny, o których chcesz poinformować wyszukiwarki. Definicja Google: “Sitemap to plik, w którym podajesz informacje o stronach, filmach i innych plikach w swojej witrynie oraz o relacjach między nimi.” To narzędzie ułatwiające odkrywanie i diagnostyka pokrycia — wyraźnie nie gwarancja: “Mapa witryny pomaga wyszukiwarkom odkrywać adresy URL w Twojej witrynie, ale nie gwarantuje, że wszystkie elementy w mapie witryny zostaną zaindeksowane i przeszukane.”
To podejście ma znaczenie, ponieważ to tutaj marnuje się wiele wysiłku. Mapa witryny nie jest dźwignią rankingową ani poleceniem indeksowania. Oto opatrzony komentarzami minimalny przykład:
<?xml version="1.0" encoding="UTF-8"?> <!-- XML declaration; UTF-8 -->
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9"> <!-- root + namespace -->
<url> <!-- one entry per page -->
<loc>https://www.example.com/foo.html</loc> <!-- required: absolute URL -->
<lastmod>2026-06-04</lastmod> <!-- optional: last significant change -->
</url>
</urlset>Anatomia
- Deklaracja XML —
<?xml version="1.0" encoding="UTF-8"?>. Google jest tutaj jednoznaczne: “Plik mapy witryny musi być zakodowany w UTF-8.” Jeśli kodowanie będzie błędne, znaki specjalne się zepsują. <urlset>+ przestrzeń nazw — element główny, zxmlns="http://www.sitemaps.org/schemas/sitemap/0.9". Przestrzeń nazw to element, który informuje parser, że to mapa witryny; błędna lub brakująca przestrzeń nazw to częsty błąd w Search Console.<url>— jeden blok na stronę.<loc>— wymagane. “Używaj w pełni kwalifikowanych, bezwzględnych adresów URL w swoich mapach witryny” — nie ścieżek względnych, i poniżej ~2048 znaków. Wszystkie wartości muszą być escapowane encjami:&staje się&,'staje się',"staje się",>staje się>, a dosłowny znak mniejszości staje się<.<lastmod>— opcjonalne; data ostatniej znaczącej zmiany strony (więcej o zasadzie uczciwości poniżej).
Prawda o ignorowanych tagach
To najbardziej nieaktualna rzecz w większości poradników o mapach witryny. Dwa
przestarzałe tagi — <priority> i <changefreq> — są ignorowane przez Google. Gary
Illyes nazwał priority “zasadniczo workiem szumu,” a John Mueller powiedział, że priority i częstotliwość zmian “nie odgrywają już większej roli w przypadku map witryny.” Bing potwierdził to samo: changefreq i priority nie wpływają już na jego indeksowanie ani ranking. Możesz je zostawić (nie szkodzą) lub je usunąć — po prostu nic nie robią.
<lastmod> jest inne — nie wrzucaj go do jednego worka z ignorowanymi tagami. Google
rzeczywiście używa <lastmod>, ale tylko wtedy, gdy mu ufa, a to zaufanie jest
mniej więcej binarne: albo Google wierzy w Twoje daty, albo nie. Zasada jest taka, że data
powinna odzwierciedlać znaczącą zmianę — “aktualizacja głównej treści, danych strukturalnych lub linków na stronie jest ogólnie uznawana za znaczącą, jednak aktualizacja daty praw autorskich nie jest.” Tryb awarii, który stale widuję, to
przypisywanie każdemu adresowi URL dzisiejszej daty przy każdej kompilacji. To
samobójcze: Mueller nazwał to “po prostu lenistwem,” zauważając, że wyszukiwarkom łatwo to rozpoznać, a to tylko utrudnia im dostrzeżenie naprawdę zaktualizowanych stron. Kłam wystarczająco często, a — jak mówi Google — “w końcu przestaniemy Ci wierzyć.” Bing opiera się na <lastmod> jako sygnale świeżości nawet bardziej niż Google — więc dokładna data pomaga Ci w obu wyszukiwarkach, a fałszywa szkodzi w obu.
Umiejscowienie, nazewnictwo, kodowanie i kompresja
- Umiejscowienie/nazewnictwo. Nie ma wymaganego pliku, ale
/sitemap.xmlw katalogu głównym to konwencja. Domyślnie mapa witryny wpływa tylko na adresy URL na lub poniżej własnej ścieżki, więc trzymaj ją wystarczająco wysoko, aby obejmowała wszystko, co wymienia. Jedyny wyjątek: możesz hostować mapę witryny dla innej witryny, jeśli zweryfikowałeś własność tej witryny, a jejrobots.txtwskazuje z powrotem na faktyczną lokalizację mapy — Google nazywa to cross-submission i to jest mechanizm stojący za indeksem map witryn agregującym mapy hostowane gdzie indziej. - Kodowanie. Zawsze UTF-8.
- Kompresja. Możesz skompresować mapę witryny gzip (serwować ją jako
.xml.gz), co warto zrobić w przypadku dużych plików. Ważny niuans: limit 50 MB jest mierzony nieskompresowany — gzip oszczędza przepustowość, nie zapas względem limitu rozmiaru.
Limity → podział + indeks map witryn
Pojedyncza mapa witryny jest ograniczona do 50 000 adresów URL lub 50 MB nieskompresowanych, w zależności od tego, co nastąpi pierwsze. Google stwierdza to wprost: “All formats limit a single sitemap to 50MB (uncompressed) or 50,000 URLs.” (tłumaczenie) „Wszystkie formaty ograniczają pojedynczą mapę witryny do 50 MB (nieskompresowanych) lub 50 000 adresów URL.” Gdy przekroczysz którykolwiek z tych limitów, dzielisz listę na wiele plików map witryn i odwołujesz się do nich wszystkich z indeksu map witryn — mapy map witryn. To osobny temat pokrewny; w skrócie: przesyłasz indeks, a jeden indeks może wskazywać na maksymalnie 50 000 podrzędnych map witryn, więc nigdy nie zabraknie Ci pojemności.
Które adresy URL uwzględnić — oraz „wykluczenie ≠ noindex”
Uwzględniaj tylko adresy URL, które są indeksowalne, kanoniczne i zwracają 200. To oznacza
brak przekierowań 3xx, brak niekanonicznych duplikatów, brak stron z noindex, brak
adresów zablokowanych przez robots. Czysta mapa witryny zawierająca dokładnie Twój zestaw indeksowalny sprawia, że porównanie przesłanych i zaindeksowanych w Search Console jest znaczące — zaśmiecaj ją śmieciami, a wyrzucisz diagnostykę.
Teraz mechaniczny punkt, który ludzie mylą: wykluczenie adresu URL z mapy witryny nie powoduje jego deindeksacji. Mapa witryny to reklama, nie brama. Usunięcie wpisu adresu URL po prostu przestaje reklamować tę stronę; jeśli Google już o niej wie (poprzez linki, historię lub inne źródło), pozostaje w indeksie. Jedynymi mechanizmami, które faktycznie usuwają stronę, są dyrektywa noindex (z zezwoleniem na indeksowanie, aby Google mógł ją zobaczyć), kod 404/410 lub narzędzie do usuwania. Więc „usuń to z mapy witryny” nigdy nie jest właściwą odpowiedzią na pytanie „jak to zdeindeksować”.
Akceptowane formaty plików map witryn
XML to nie jedyny format akceptowany przez Google — warto o tym wiedzieć, aby nie zakładać, że jesteś skazany na ręczne pisanie XML. Google nazywa XML “the most versatile of the sitemap formats,” (tłumaczenie) „najbardziej wszechstronnym z formatów map witryn”, ale czyta również:
- RSS 2,0 / Atom — przydatne, ponieważ wiele systemów CMS już publikuje jeden; zawierają tylko adresy URL stron.
- mRSS — kanał RSS dla multimediów, używany do wideo.
- Zwykły tekst (
.txt) — dosłownie jeden adres URL na linię, tylko adresy stron internetowych, UTF-8.
XML nadal jest właściwym domyślnym wyborem, ponieważ to jedyny format obsługujący rozszerzenia (metadane lastmod, obrazy, wideo i adnotacje hreflang). Pozostałe są tylko adresami URL.
hreflang w mapach witryn
Jeśli prowadzisz witrynę wielojęzyczną lub wieloregionalną, mapa witryny jest zwykle najłatwiejszym miejscem do zarządzania hreflang — utrzymujesz cały klaster językowy w jednym pliku zamiast wstrzykiwać tagi zwrotne do każdego szablonu strony. (To jedno z trzech prawidłowych miejsc, w których może znajdować się hreflang; <head> i nagłówki HTTP to pozostałe.)
Jak to jest zaimplementowane. Każdy <url> otrzymuje elementy podrzędne xhtml:link rel="alternate", po jednym dla każdej wersji językowej/regionalnej, i deklarujesz przestrzeń nazw xmlns:xhtml="http://www.w3.org/1999/xhtml" na <urlset>:
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9"
xmlns:xhtml="http://www.w3.org/1999/xhtml">
<url>
<loc>https://www.example.com/english/page.html</loc>
<xhtml:link rel="alternate" hreflang="en" href="https://www.example.com/english/page.html"/>
<xhtml:link rel="alternate" hreflang="de" href="https://www.example.de/deutsch/page.html"/>
<xhtml:link rel="alternate" hreflang="x-default" href="https://www.example.com/english/page.html"/>
</url>
<!-- each alternate URL repeats the FULL set, including itself (return tags) -->
</urlset>Zasada tagów zwrotnych. To jest część, która sprawia problemy. Każdy element <url>
musi wymienić każdą alternatywną wersję strony — w tym samą siebie. Google: “Each
<url> element must have a child element <xhtml:link rel="alternate" hreflang="[supported_language-code]"> that lists every alternate version of the
page, including itself.” (tłumaczenie) „Każdy element <url> musi mieć element podrzędny <xhtml:link rel="alternate" hreflang="[supported_language-code]">, który wymienia każdą alternatywną wersję strony, włączając w to samą siebie.” I to musi być dwukierunkowe: “If page X links to page
Y, page Y must link back to page X. If this is not the case for all pages that use
hreflang annotations, those annotations may be ignored or not interpreted
correctly.” (tłumaczenie) „Jeśli strona X linkuje do strony Y, strona Y musi linkować z powrotem do strony X. Jeśli nie jest tak w przypadku wszystkich stron używających adnotacji hreflang, te adnotacje mogą zostać zignorowane lub niepoprawnie zinterpretowane.” Dodaj wpis x-default dla języka domyślnego, gdy żaden język nie pasuje. Pojedynczy
zepsuty lub brakujący tag zwrotny może unieważnić cały zestaw.
Limit dotyczy tylko adresów URL <loc>. Ulga dla dużych międzynarodowych witryn:
limit 50 000 adresów URL liczy tylko adresy URL stron <loc>, nie alternatywy
hreflang. Więc mapa witryny z 50 000 stron, każda z dziesięcioma alternatywami językowymi,
nadal się mieści — liczą się adresy URL lokalizacji, a nie adresy URL alternatyw.
Kiedy faktycznie zaczyna działać — licz na dni, nie minuty. Oto oczekiwanie, które warto sobie ustawić, i to jest mechanizm, a nie cytat. Google parsuje hreflang w twojej mapie witryny, gdy ponownie pobiera mapę, ale adnotacje działają dopiero, gdy wszystkie adresy URL w zestawie zostaną (ponownie) zindeksowane, a tagi zwrotne zostaną ze sobą uzgodnione. To oznacza, że jest realne opóźnienie między opublikowaniem hreflang a honorowaniem alternatyw, a jeden wolno indeksowany lub zepsuty URL w zestawie może wstrzymać resztę. Nie oczekuj, że zadziała natychmiast po przesłaniu — planuj, że ustabilizuje się w ciągu dni.
Odwołaj się do niej i prześlij ją
robots.txt— dodaj linięSitemap:z pełnym bezwzględnym adresem URL. To także pozwala wyszukiwarkom automatycznie ją odkryć.- Google Search Console — raport Sitemaps (lub API Search Console) to podstawowa metoda przesyłania; to także miejsce, gdzie odczytasz diagnostykę przesłane-vs-zaindeksowane.
- Bing Webmaster Tools — prześlij ją tam również; Bing pobiera ją szybko i regularnie sprawdza ponownie.
Jedna uwaga o automatyzacji z mojej perspektywy: mapa witryny powinna być generowana automatycznie na podstawie stron, które faktycznie masz, aby pozostała aktualna. Ręcznie budowana mapa witryny dezaktualizuje się w momencie, gdy twoja witryna się zmienia. Strony powiązane z tą — przegląd sitemaps, indeks mapy witryny dla dużych witryn oraz rozszerzenia image sitemap i video sitemap — obejmują resztę rodziny, a szerszy temat odkrywania łączy mapy witryny z innymi sposobami, w jakie wyszukiwarki znajdują twoje adresy URL.
Podsumowanie AI
Skrócona wersja wersji zaawansowanej:
- Mapa witryny XML to plik UTF-8 zawierający kanoniczne, indeksowalne adresy URL, które chcesz
udostępnić wyszukiwarkom — każdy
<url>ma wymagany<loc>(bezwzględny adres URL) i opcjonalny<lastmod>. Elementem głównym jest<urlset>z przestrzenią nazwsitemaps.org/0.9. - Pomaga w odkrywaniu, nie w indeksowaniu. Jego przesłanie nie gwarantuje, że strona zostanie zaindeksowana; prawdziwa korzyść to diagnostyka przesłane vs zaindeksowane w Search Console.
<priority>i<changefreq>są ignorowane przez Google (i Bing). Nie myl<lastmod>z nimi — jest używany, ale tylko wtedy, gdy jest weryfikowalnie dokładny (znaczące zmiany treści, nigdy zbiorcza data „dzisiaj”).- Limity: 50 000 adresów URL lub 50 MB nieskompresowanych, w zależności od tego, co nastąpi wcześniej. Powyżej tego podziel pliki i użyj indeksu mapy witryny. Gzip jest dozwolony, ale limit 50 MB dotyczy rozmiaru nieskompresowanego.
- Uwzględniaj tylko
200, kanoniczne, indeksowalne adresy URL. Zastosuj encje dla& ' " < >. Wykluczenie adresu URL ≠ brak indeksowania — usunięcie wymaganoindex/404, a nie brakującego wpisu w mapie witryny. - XML to nie jedyny format — RSS/Atom i zwykły
.txtteż działają (tylko adresy URL); XML to jedyny format obsługujący rozszerzenia obrazów, wideo i hreflang. - hreflang w mapach witryny: elementy podrzędne
xhtml:link rel="alternate"+ przestrzeń nazwxmlns:xhtml; każdy<url>musi wymieniać wszystkie alternatywy w tym siebie, dwukierunkowo, plusx-default. Limit 50 000 dotyczy tylko adresów<loc>URL, nie alternatyw. Przetwarzane przy ponownym pobraniu mapy, ale aktywne dopiero po ponownym przeszukaniu/zgodzeniu wszystkich adresów URL w zestawie — planuj dni, nie minuty. - Prześlij ją przez linię
Sitemap:wrobots.txt, Google Search Console i Bing Webmaster Tools. Generuj ją automatycznie, aby była aktualna.
Oficjalna dokumentacja
Dokumentacja źródłowa od wyszukiwarek.
- Omówienie map witryn — czym jest mapa witryny, czy jej potrzebujesz i że nie gwarantuje indeksowania.
- Tworzenie i przesyłanie mapy witryny — limity 50 000/50 MB, wymóg UTF-8, zasada bezwzględnych adresów URL, akceptowane formaty oraz definicja „znaczącej aktualizacji” dla
<lastmod>. - Zarządzanie mapami witryn za pomocą pliku indeksu mapy witryny — dzielenie dużych map witryn i indeks mapy witryny.
- Informowanie Google o zlokalizowanych wersjach strony — hreflang w mapach witryn przez
xhtml:link, zasada tagów zwrotnych ix-default. - Łączenie rozszerzeń map witryn — umieszczanie obrazów/wideo/hreflang w jednej mapie witryny.
- Raport map witryn (pomoc Search Console) — co oznacza każdy błąd przesyłania i jak go naprawić.
- Protokół sitemaps.org — podstawowa specyfikacja
0.9, którą dzielą wszystkie wyszukiwarki.
Bing / Microsoft
- Utrzymywanie treści wykrywalnej dzięki mapom witryn w wyszukiwaniu opartym na AI (lipiec 2025) — stanowisko Bing, że XML jest preferowany, a
<lastmod>to kluczowy sygnał. - Znaczenie ustawiania tagu lastmod w mapie witryny (luty 2023) — dlaczego Bing waży
<lastmod>przy decyzjach o ponownym przeszukiwaniu.
Cytaty ze źródła
Oficjalne wypowiedzi Google i Bing. Każdy link to link bezpośredni, który przenosi do cytowanego fragmentu na stronie źródłowej.
Google — czym jest mapa witryny i co robi
- “A sitemap is a file where you provide information about the pages, videos, and other files on your site, and the relationships between them.” — Sitemaps overview. Przejdź do cytatu
- “A sitemap helps search engines discover URLs on your site, but it doesn’t guarantee that all the items in your sitemap will be crawled and indexed.” Przejdź do cytatu
Google — format, limity i kodowanie
- “All formats limit a single sitemap to 50MB (uncompressed) or 50,000 URLs.” — Build and submit a sitemap. Przejdź do cytatu
- “The sitemap file must be UTF-8 encoded.” Przejdź do cytatu
- “Use fully-qualified, absolute URLs in your sitemaps.” Przejdź do cytatu
Google — ignorowane tagi i zasady dotyczące lastmod
- “we ignore those. It’s essentially a bag of noise.” — Gary Illyes, o
<priority>/<changefreq>. Przeczytaj relację - “Priority and change frequency doesn’t really play that much of a role with Sitemaps anymore.” — John Mueller. Przeczytaj relację
- “an update to the main content, the structured data, or links on the page is generally considered significant, however an update to the copyright date is not.” — o tym, co powinien odzwierciedlać
<lastmod>. Przejdź do cytatu - “setting today’s date in a sitemap file isn’t going to be something that works in favor of anyone, it’s just lazy.” — John Mueller. Przeczytaj relację
- “it’s binary, or at least was last time I checked. we either trust it or not.” — Gary Illyes, o tym, czy Google ufa Twojemu
<lastmod>. Przeczytaj relację
Google — limit 50 000 dotyczy adresów URL lokalizacji, a nie alternatyw hreflang
- Limit 50 000 adresów URL “is just the location URL” — a nie alternatywnych adresów URL hreflang. — John Mueller. Przeczytaj relację
Google — tagi zwrotne hreflang
- “Each
<url>element must have a child element<xhtml:link rel="alternate" hreflang="[supported_language-code]">that lists every alternate version of the page, including itself.” (tłumaczenie) «Każdy element<url>musi mieć element podrzędny<xhtml:link rel="alternate" hreflang="[supported_language-code]">, który wymienia każdą alternatywną wersję strony, włączając w to samą stronę.» — Dokumentacja wersji zlokalizowanych. Przejdź do cytatu - “If page X links to page Y, page Y must link back to page X. If this is not the case for all pages that use hreflang annotations, those annotations may be ignored or not interpreted correctly.” (tłumaczenie) «Jeśli strona X linkuje do strony Y, strona Y musi linkować z powrotem do strony X. Jeśli nie dotyczy to wszystkich stron używających adnotacji hreflang, te adnotacje mogą zostać zignorowane lub niepoprawnie zinterpretowane.» Przejdź do cytatu
Bing — XML i lastmod
- “XML remains the preferred format for sitemaps, as it supports structured metadata like lastmod, which helps Bing assess content freshness and relevance more effectively.” (tłumaczenie) «XML pozostaje preferowanym formatem dla map witryn, ponieważ obsługuje ustrukturyzowane metadane, takie jak lastmod, co pomaga Bing skuteczniej oceniać świeżość i trafność treści.» Przejdź do cytatu
Lista kontrolna mapy XML
Zbuduj ją poprawnie
- Plik jest zakodowany w UTF-8, z
<?xml version="1.0" encoding="UTF-8"?>w pierwszej linii. - Elementem głównym jest
<urlset>zxmlns="http://www.sitemaps.org/schemas/sitemap/0.9". - Każdy
<loc>to w pełni kwalifikowany, bezwzględny URL poniżej ~2048 znaków. - Wszystkie wartości są escapowane encjami (
& ' " > <). -
<priority>i<changefreq>usunięte lub zaakceptowane jako ignorowane (Google je ignoruje). -
<lastmod>obecny tylko tam, gdzie odzwierciedla znaczącą zmianę — nigdy zbiorcze “dzisiaj” na każdym URL-u. - Plik ma poniżej 50 000 URL-i i 50 MB nieskompresowany; jeśli nie, podziel i dodaj indeks mapy witryny.
Uwzględnij właściwe URL-e
- Tylko kanoniczne, indeksowalne URL-e ze statusem
200. - Bez przekierowań
3xx, bez niekanonicznych duplikatów, bez URL-i znoindex/zablokowanych przez robots. - Pamiętaj: pominięcie URL-a nie jest sposobem na jego deindeksację — użyj
noindexw tym celu.
Opublikuj i monitoruj ją
- Linia
Sitemap:dodana dorobots.txtz pełnym bezwzględnym URL-em. - Zgłoszona w Google Search Console i Bing Webmaster Tools.
- Generowana automatycznie z prawdziwych URL-i, aby pozostała aktualna.
- Obserwuj liczby zgłoszone vs zindeksowane w Search Console; podziel według sekcji/typu, aby zobaczyć, która część witryny jest niedostatecznie zindeksowana.
Mapa XML — ściąga
Referencja tagów
| Tag | Wymagany? | Co robi | Traktowanie przez Google |
|---|---|---|---|
<urlset> | Wymagany | Element główny; deklaruje przestrzeń nazw 0.9 | Parsowany (błędna/brakująca przestrzeń nazw = błąd) |
<url> | Wymagany | Jeden blok na stronę | Parsowany |
<loc> | Wymagany | W pełni kwalifikowany bezwzględny URL strony | Używany |
<lastmod> | Opcjonalny | Data ostatniej znaczącej zmiany | Używany — ale tylko jeśli weryfikowalnie dokładny |
<changefreq> | Opcjonalny | Wskazówka, jak często strona się zmienia | Ignorowany |
<priority> | Opcjonalny | Względne znaczenie (0,0–1,0) | Ignorowany |
xhtml:link rel="alternate" | Opcjonalny | Wersje alternatywne hreflang | Używany (wymaga xmlns:xhtml, tagów zwrotnych) |
Uwzględnij vs wyklucz
| Uwzględnij | Wyklucz |
|---|---|
| Kanoniczne URL-e | Niekanoniczne / zduplikowane URL-e |
| Indeksowalne strony | Strony z noindex |
Strony ze statusem 200 | Przekierowania 3xx, błędy 4xx/5xx |
| Strony, które chcesz przeszukiwać i indeksować | URL-e zablokowane przez robots |
Szybkie fakty
- Limity: 50 000 URL-i lub 50 MB nieskompresowanych, w zależności co nastąpi pierwsze → podziel i użyj indeksu mapy witryny.
- Kodowanie: UTF-8. URL-e: bezwzględne, z encjami.
- Dozwolony gzip (
.xml.gz); limit 50 MB dotyczy rozmiaru nieskompresowanego. - Limit 50 000 dla hreflang liczy tylko
<loc>URL-e, nie alternatywy. - Wykluczenie URL-a ≠ brak indeksowania.
- Akceptowane formaty: XML (ten uniwersalny), RSS/Atom, zwykły
.txt.
Minimalna poprawna mapa witryny XML
Najmniejsza poprawna mapa witryny — deklaracja, <urlset> z przestrzenią nazw, jeden <url> z wymaganym <loc> i opcjonalnym <lastmod>:
<?xml version="1.0" encoding="UTF-8"?>
<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">
<url>
<loc>https://www.example.com/</loc>
<lastmod>2026-06-22</lastmod>
</url>
<url>
<loc>https://www.example.com/blog/post-with-an-ampersand?a=1&b=2</loc>
<lastmod>2026-06-18</lastmod>
</url>
</urlset>Zwróć uwagę na drugi <loc>: & w ciągu zapytania jest escapowany encją do &. Surowe znaki &, ', ", < i > złamią XML.
Kompresja gzip dla dużych plików
Możesz serwować mapę witryny skompresowaną gzip, aby zaoszczędzić przepustowość — nazwij ją .xml.gz:
# Compress a sitemap; Google and Bing both accept .xml.gz
gzip -k sitemap.xml # produces sitemap.xml.gz, keeps the originalPamiętaj, że limit rozmiaru jest sprawdzany nieskompresowany — gzip zmniejsza rozmiar transferu, ale nie sufit 50 MB/50 000 URL-i. (W systemie Windows użyj dowolnego narzędzia zip, które tworzy prawdziwy strumień gzip, lub Compress-Archive nie jest gzip — preferuj wyjście gzip z 7-Zip.)
Odwołaj się do niej w robots.txt
Wskaż wyszukiwarkom linię Sitemap: (pełny bezwzględny URL; automatyczne wykrywanie działa stąd):
User-agent: *
Allow: /
Sitemap: https://www.example.com/sitemap.xmlZweryfikuj ją
Przed przesłaniem sprawdź plik:
- Pobierz go i potwierdź, że zwraca
200z prawdziwym ciałem XML (nie stroną HTML 404 — „Nieobsługiwany format” w Search Console zwykle oznacza, że przez pomyłkę przesłałeś stronę HTML). - Sprawdź poprawność składni lokalnie za pomocą
xmllint:
# Confirms the XML parses; flags unescaped & < > and mismatched tags
xmllint --noout sitemap.xml && echo "well-formed"- Prześlij i obserwuj raport Sitemaps w Search Console pod kątem liczby sparsowanych URL-i i błędów, a następnie śledź przesłane a zaindeksowane w kolejnych dniach.
Narzędzia do tworzenia i sprawdzania mapy witryny XML
- Google Index Checker — gdy Twoja mapa witryny jest już na żywo, to jest sposób na sprawdzenie drugiej strony diagnostyki: czy URL, który przesłałeś, jest faktycznie indeksowalny. Pokazuje kod statusu, przekierowania,
noindexi sygnały kanoniczne dla URL-a, a następnie kieruje Cię do URL Inspection w Search Console, aby uzyskać prawdziwą odpowiedź Google. Przydatne do ustalenia, dlaczego przesłany URL nie pojawia się w liczbie zaindeksowanych.
Gotowe prompty do pracy z mapą witryny
Audyt pliku mapy witryny pod kątem zgodności ze specyfikacją. Wklej surową zawartość XML swojej mapy witryny (lub jej reprezentatywny fragment) i poproś asystenta AI o sprawdzenie jej zgodnie z zasadami z tego artykułu:
Here is the content of my XML sitemap. Check it against these rules and list
every violation with the line/URL affected:
1. The declaration and encoding must be `<?xml version="1.0" encoding="UTF-8"?>`.
2. `<urlset>` must declare xmlns="http://www.sitemaps.org/schemas/sitemap/0.9".
3. Every <loc> must be a fully-qualified absolute URL, with & ' " < > properly
entity-escaped (& ' " > <).
4. Flag any <priority> or <changefreq> tags as harmless-but-ignored, not errors.
5. Flag any <lastmod> value that is identical across most/all URLs (a sign of a
fake "always today" date) as suspicious rather than a hard error.
6. Confirm the file is under 50,000 <url> entries and, if you can estimate file
size, under 50MB uncompressed.
[paste sitemap XML here]Spodziewaj się listy konkretnych naruszeń (nie przepisania) — traktuj ogólne „wygląda dobrze” jako sygnał, aby samodzielnie sprawdzić plik za pomocą xmllint.
Przejrzyj tagi zwrotne hreflang w mapie witryny. Jeśli zarządzasz hreflang przez bloki xhtml:link w mapie witryny, wklej sekcję pliku i poproś o sprawdzenie dwukierunkowości:
This is a section of my XML sitemap using xhtml:link rel="alternate" hreflang
tags. For each <url> block, list every hreflang alternate it declares, then
tell me which alternates are NOT reciprocated (page A links to page B, but B's
block doesn't link back to A) and whether an x-default entry is present for
each language cluster.
[paste sitemap XML section here]To wyłapuje dokładny tryb awarii opisany powyżej — jeden brakujący tag zwrotny może spowodować zignorowanie całego zestawu hreflang — szybciej niż ręczne sprawdzanie dużego pliku.
Zasoby warte Twojego czasu
Moje powiązane artykuły
- When Should You Worry About Crawl Budget? — gdzie czyste mapy witryny wpisują się w efektywność indeksowania i dlaczego Twoja mapa witryny powinna zawierać tylko indeksowalne URL-e.
- Enterprise Technical SEO — podejście „zautomatyzuj albo zgnije” i mapy witryny na dużą skalę.
- Website Migration: The Definitive Guide — dlaczego trzymam mapę witryny starych URL-i po migracji, aby obserwować, jak wypadają z indeksu w GSC.
- Hreflang: The Easy Guide — trzy prawidłowe miejsca, w których może znajdować się hreflang, w tym mapa witryny, i kompromisy.
- The Beginner’s Guide to Technical SEO — gdzie mapy witryny mieszczą się w szerszym obrazie.
Moje wystąpienia
- How Search Works (SlideShare) — moje omówienie indeksowania, odkrywania i indeksowania. (Stałe zastrzeżenie: „This is my understanding of systems… not going to be 100% complete or accurate.”)
Od innych
- Dokumentacja Sitemaps Google — kanoniczne źródło informacji o formatach, limitach i rozszerzeniach.
- sitemaps.org — międzywyszukiwarkowy protokół
0.9, na którym wszystko to jest zbudowane. - Sitemaps in AI-Powered Search Bing — bardziej stanowcze niż Google stanowisko Bing na temat
<lastmod>. - The Importance of Setting the lastmod Tag in Your Sitemap Bing — wyjaśnia, jak Bing używa
<lastmod>do priorytetyzacji ponownego indeksowania. - Search Engine Roundtable — sitemap coverage — zagregowane wypowiedzi Google i Bing na temat sitemap, w tym Gary’ego Illyesa o
<priority>i Johna Muellera o dokładności<lastmod>. - Google Search Central Blog: What Googlebot looks for in your sitemap — własny wpis Google potwierdzający
<lastmod>i usunięcie protokołu ping. - Search Engine Journal — XML Sitemaps — branżowe omówienie najlepszych praktyk i typowych błędów dotyczących sitemap.
Sprawdź się: XML sitemaps
Pięć pytań dotyczących specyfiki formatu XML sitemap — tagi, limity i hreflang. Wybierz odpowiedź na każde, a następnie sprawdź.
Dziennik zmian
Zaktualizowano 11 sie 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 18 lip 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.