Zduplikowana treść
Nie ma kary za zduplikowaną treść. Co naprawdę kosztuje Cię zduplikowana treść, jak Google grupuje duplikaty i wybiera kanoniczny adres URL oraz jak to naprawić.
Języki
1 sygnał dowodowy na tej stronie
- Powiązane działające narzędzieHTTP Status & Redirect Checker
Nie ma ogólnej kary za zduplikowaną treść — zarówno Google, jak i Bing to potwierdzają; zwykłe duplikaty są obsługiwane przez deduplikację i wybór kanoniczny, a nie działanie polityczne. Prawdziwe koszty są pośrednie i możliwe, a nie gwarantowane: rozproszenie sygnałów, wybranie niewłaściwego adresu URL (choć inny członek klastra może nadal służyć w określonym kontekście), mniej wydajne indeksowanie i bardziej zagmatwane pomiary. Silniki obsługują duplikaty, grupując pasujące adresy URL i wybierając jeden kanoniczny na podstawie zebranych sygnałów, aby reprezentować grupę. Większość duplikacji ma charakter techniczny, a nie redakcyjny (http/https, www, parametry, nawigacja fasetowa, wersje do druku i mobilne) — chociaż filtry, sortowania, paginacja, warianty produktów i pełne tłumaczenia wymagają indywidualnego podejścia, a nie automatycznego kanonicznego. Naprawiaj zgodnie z intencją, mniej więcej w tej kolejności: napraw przyczynę źródłową / 301 → rel=canonical → obsługa parametrów → noindex tylko wtedy, gdy naprawdę chcesz, aby strona zniknęła → hreflang → syndykacja, gdzie obecne wytyczne Google faworyzują partnera stosującego noindex do swojej kopii zamiast samego kanonicznego. Kary dotyczą tylko oszukańczego, masowego nadużycia.
Evidence for this claim Ordinary duplicate content is generally handled through canonicalization rather than a general duplicate-content penalty. Scope: Google duplicate URL handling. Confidence: high · Verified: Google Search Central: Duplicate URLs Evidence for this claim Redirects and rel=canonical are strong signals for specifying a preferred canonical URL, but Google may select another canonical. Scope: Google canonicalization signals. Confidence: high · Verified: Google Search Central: Canonical URLsTL;DR — Duplikaty treści to ta sama (lub prawie ta sama) treść widoczna pod więcej niż jednym adresem URL. Nie ma „kary za duplikaty treści” — Google mówi to od lat; zwykłe duplikaty są po prostu grupowane i wybierana jest jedna wersja do wyświetlenia. W rzeczywistości może to rozdzielić Twoje sygnały i czasami spowodować wyświetlenie „niewłaściwej” strony. Rozwiązaniem jest wskazanie wszystkiego na jeden preferowany adres URL w oparciu o to, co naprawdę chcesz osiągnąć, a nie panikowanie — i nie wszystko, co wygląda na duplikat (filtry, paginacja, przetłumaczone strony), faktycznie nim jest.
Czym są duplikaty treści
Duplikaty treści to sytuacja, w której ta sama lub bardzo podobna treść jest osiągalna pod więcej niż jednym adresem URL. Może się to zdarzyć na jednej stronie internetowej lub na różnych stronach.
W większości przypadków nie chodzi o to, że ktoś kopiuje Twoje teksty — to techniczny wypadek. Ta sama strona kończy się pod kilkoma adresami, na przykład:
http://example.comihttps://example.comexample.comiwww.example.comexample.com/pageiexample.com/page?utm_source=newsletter
Dla człowieka wszystkie te adresy wyglądają jak „ta strona”. Dla wyszukiwarki każdy inny adres URL to inna strona, która akurat ma tę samą treść.
Najważniejsze: nie ma kary za duplikaty treści
To jest obawa, która sprowadza większość ludzi do tego tematu, więc pozwól, że rozwieję ją od razu: Google nie karze Cię za posiadanie duplikatów treści. Zespół Google napisał już w 2008 roku, że nie ma czegoś takiego jak kara za duplikaty treści — przynajmniej nie w takim znaczeniu, w jakim większość ludzi to rozumie. Bing powtórzył to samo w 2025 roku: duplikaty treści same w sobie nie wywołują kar.
W 2016 roku napisałem nawet artykuł zatytułowany Mit kary za zduplikowaną treść. Ten mit okazał się niezwykle trudny do obalenia, ale nadal jest mitem.
Jedynym wyjątkiem jest sytuacja, gdy duplikacja jest zwodnicza — skrobanie cudzych stron i publikowanie ich ponownie lub automatyczne generowanie stosów stron w celu manipulowania rankingami. To spam, a spam jest egzekwowany. Normalna, przypadkowa, techniczna duplikacja nie jest w ogóle naruszeniem polityki — Google po prostu grupuje ją w klaster i wybiera jedną wersję do wyświetlenia, co jest rutynowym porządkowaniem, a nie karą.
Więc na czym polega prawdziwy problem?
Skoro nie ma kary, po co to naprawiać? Trzy prawdziwe powody:
- Twoje sygnały są rozdzielane. Linki, kliknięcia i udostępnienia mogą wskazywać na trzy różne wersje tej samej strony zamiast sumować się na jednej. To sprawia, że każda wersja jest słabsza niż połączona strona.
- Google może wybrać „niewłaściwy” adres URL. Gdy istnieją duplikaty, Google wybiera jeden, który reprezentuje grupę w wynikach. Może to nie być ten, który byś wybrał — a czasami inny członek grupy nadal jest wyświetlany, gdy lepiej pasuje do konkretnego wyszukiwania, więc nie zawsze jest to jedno stałe rozwiązanie.
- Crawlowanie staje się mniej wydajne. Google crawlowuje wybraną wersję najczęściej, a kopie rzadziej, aby oszczędzić wysiłek. Zwykle to wystarcza, ale na stronie z dużą liczbą duplikatów może to oznaczać, że nowe lub zaktualizowane strony są odkrywane wolniej, niż powinny.
Żaden z tych powodów nie jest karą. To po prostu nieefektywności — i wszystkie można naprawić.
Jak to naprawić (prosta wersja)
Cel jest zawsze ten sam: doprowadź wszystko do jednego preferowanego adresu URL.
- Przekieruj wersje, których nie chcesz (takie jak
httplub bezwww), na tę, którą chcesz, używając przekierowania 301. - Gdy musisz utrzymać duplikat dostępnym, dodaj znacznik kanoniczny
(
rel="canonical") informujący Google, która wersja jest prawdziwa. - Linkuj konsekwentnie do preferowanej wersji wszędzie na swojej stronie.
To 90% sukcesu. Chcesz pełną listę przyczyn, hierarchię rozwiązań według preferencji, konfigurację syndykacji i mity obalone jeden po drugim? Przełącz się na zakładkę Zaawansowane.
Evidence for this claim Ordinary duplicate content is generally handled through canonicalization rather than a general duplicate-content penalty. Scope: Google duplicate URL handling. Confidence: high · Verified: Google Search Central: Duplicate URLs Evidence for this claim Redirects and rel=canonical are strong signals for specifying a preferred canonical URL, but Google may select another canonical. Scope: Google canonicalization signals. Confidence: high · Verified: Google Search Central: Canonical URLsTL;DR — Nie ma ogólnej kary za zduplikowaną treść — Google i Bing mówią to wprost; zwykłe duplikaty są obsługiwane przez deduplikację i wybór kanoniczny, a nie działania polityczne. Realne koszty są pośrednie i możliwe, nie gwarantowane: rozproszenie sygnałów, wybór niewłaściwego URL-a (choć inny członek klastra może nadal służyć w konkretnym kontekście), mniej wydajne indeksowanie i bardziej zagmatwane pomiary. Silniki wykrywają duplikaty → grupują pasujące URL-e → wybierają jeden kanoniczny na podstawie zebranych sygnałów — zadeklarowany kanoniczny jest wskazówką, nie regułą. Większość duplikatów ma charakter techniczny, nie redakcyjny, ale filtry/sortowania/paginacja/warianty/tłumaczenia wymagają analizy przypadku, nie automatycznego kanonicznego. Naprawiaj zgodnie z intencją, mniej więcej w tej kolejności: przyczyna źródłowa / 301 →
rel="canonical"→ obsługa parametrów →noindextylko do faktycznego usunięcia → hreflang → syndykacja (obecne wytyczne Google preferują partneranoindex-ującego swoją kopię zamiast samego kanonicznego). Kary dotyczą tylko zwodniczego, masowego nadużycia — scrapowania i masowego republikowania bez wartości.
Czym właściwie jest zduplikowana treść
Jak ująłem to w moim przewodniku Ahrefs: “Duplicate content is the same or similar content that appears on the web in more than one place. It can exist on one website or across multiple websites.” (tłumaczenie) „Zduplikowana treść to ta sama lub podobna treść, która pojawia się w sieci w więcej niż jednym miejscu. Może istnieć na jednej stronie internetowej lub na wielu stronach internetowych.”* Przestarzała definicja Google (z wpisu Search Central z 2006 r.) określała ją jako znaczące bloki treści w obrębie domen lub między domenami, które całkowicie się pokrywają lub są znacznie podobne.
Kluczowe przeformułowanie: większość zduplikowanej treści to artefakt techniczny, nie plagiat. Jedna strona jest serwowana pod kilkoma adresami, a każdy adres jest odrębnym URL-em dla robota indeksującego. Duplikacja redakcyjna (kopiowanie tekstu) też istnieje, ale stanowi przypadek mniejszościowy — i nawet ona nie jest karana, chyba że jest zwodnicza.
Obecna dokumentacja Google opisuje tę zależność nieco precyzyjniej niż stare definicje powyżej: chodzi o treść główną, która jest taka sama lub bardzo podobna, a nie o zgodność słowo w słowo, i może wystąpić w obrębie jednej witryny lub w całej sieci. Warto odróżnić to od kilku rzeczy, którymi to nie jest: cienka treść (strona z zbyt małą ilością treści, by była użyteczna, niezależnie od duplikacji), plagiat (kwestia prawna/etyczna, nie techniczna), kanibalizacja słów kluczowych (wiele odrębnych stron na Twojej własnej witrynie konkurujących o to samo zapytanie — problem targetowania, nie duplikacji) oraz wynik „near-duplicate %” robota (konfigurowalny próg podobieństwa narzędzia, nie coś, co Google publikuje lub używa bezpośrednio — więcej o tym poniżej).
Czy istnieje kara za zduplikowaną treść? Nie.
To jest kręgosłup całego tematu, więc pozwól, że będę jednoznaczny: nie ma ogólnej kary za zduplikowaną treść. Oba główne silniki to potwierdzają.
Wpis Google z 2008 r. Obalamy mit kary za zduplikowaną treść zaczyna się od linijki, którą każdy powinien znać: “There’s no such thing as a ‘duplicate content penalty.’ At least, not in the way most people mean when they say that.” (tłumaczenie) „Nie ma czegoś takiego jak kara za zduplikowaną treść, przynajmniej nie w znaczeniu, w jakim zwykle używa się tego określenia”. John Mueller powtarzał to przez lata: “We don’t have a duplicate content penalty. It’s not that we would demote a site for having a lot of duplicate content.” (tłumaczenie) „Nie mamy kary za zduplikowaną treść. Nie obniżylibyśmy pozycji witryny tylko dlatego, że zawiera ona dużo zduplikowanej treści.”
Bing powiedział to samo ponownie, niedawno. W swoim wpisie z grudnia 2025 r. napisali: “Duplicate content doesn’t trigger search penalties on its own, but it does reduce visibility by diluting authority.” (tłumaczenie) „Zduplikowana treść nie wyzwala kar w wyszukiwarkach sama w sobie, ale zmniejsza widoczność poprzez rozproszenie autorytetu.”*
Przekonuję o tym od dekady. Mój artykuł z 2016 r. w Search Engine Land Mit kary za zduplikowaną treść ujął to wprost: “Duplicate content is not grounds for action unless its intent is to manipulate search results.” (tłumaczenie) „Zduplikowana treść nie jest podstawą do działania, chyba że jej celem jest manipulowanie wynikami wyszukiwania.”* Ta linijka wciąż oddaje całą historię.
Jedyny prawdziwy wyjątek: zwodnicze, masowe nadużycie
Kary wchodzą w grę tylko wtedy, gdy duplikacja jest manipulacyjna. To znajduje się w politykach spamu Google, a nie w jakiejkolwiek regule „duplikacji treści”. Wyraźna granica to nadużycie skalowanej treści: “Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users.” (tłumaczenie) „Nadużycie treści na dużą skalę występuje, gdy wiele stron jest generowanych przede wszystkim w celu manipulowania rankingami, a nie pomagania użytkownikom”. Skrobanie również jest wymienione — polityki wskazują “Republishing content from other sites without adding any original content or value, or even citing the original source.” (tłumaczenie) „Ponowne publikowanie treści z innych witryn bez dodania własnej treści lub wartości, a nawet bez wskazania pierwotnego źródła” jako nadużycie. Konsekwencja: “Sites that violate our policies may rank lower in results or not appear in results at all.” (tłumaczenie) „Witryny naruszające nasze zasady mogą zajmować niższe pozycje albo w ogóle nie pojawiać się w wynikach.”
Rozróżnienie, które ma znaczenie: łagodna duplikacja (ta sama strona na www i non-www) to nie to — Google normalnie radzi sobie ze zwykłą duplikacją treści poprzez deduplikację i wybór kanoniczny, a nie działanie polityczne. Zwodnicza, skalowana duplikacja to osobna kwestia, która znajduje się w polityce spamu. Nie myl tych dwóch rzeczy i nie popadaj w przeciwną skrajność — „brak kary” nie oznacza, że duplikacja nigdy nie może prowadzić do działań; oznacza, że zwykła duplikacja sama w sobie nie jest wyzwalaczem.
Prawdziwe koszty duplikacji treści
Skoro nie ma kary, po co się tym przejmować? Kilka pośrednich, możliwych kosztów — nie zagwarantowanych i nie to samo co utrata pozycji:
- Rozproszone / podzielone sygnały. Gdy kilka adresów URL zawiera tę samą treść, sygnały rankingowe się rozpraszają. Bing je wymienia: “When several URLs contain the same content, signals such as clicks, links, impressions, and engagement are often diluted.” (tłumaczenie) „Gdy kilka adresów URL zawiera tę samą treść, sygnały takie jak kliknięcia, linki, wyświetlenia i zaangażowanie często się rozpraszają”. Własna dokumentacja Google wymienia tę samą ideę bardziej warunkowo: konsolidacja sygnałów to jeden z powodów, aby określić kanoniczny adres URL, co sugeruje, że rozproszenie jest możliwe, a nie automatyczne — silny przekierowanie lub sygnał kanoniczny to to, co faktycznie składa podzielone sygnały na jeden adres URL.
- Wybrany zostaje niewłaściwy adres URL — lub inny pojawia się w konkretnym przypadku. Google grupuje zestaw i wybiera reprezentatywny kanoniczny adres URL. Jeśli twoje sygnały są mieszane, może wybrać wersję, której nie chciałeś — dokładnie to mówi status w Search Console „Duplicate, Google chose different canonical than user”. To nie zawsze jest pojedynczy stały wybór: własny przewodnik Google po działaniu wyszukiwarki zauważa, że inny członek grupy może zostać wyświetlony, gdy lepiej pasuje do konkretnego kontekstu — konkretnego urządzenia lub wąskiego zapytania — więc „duplikat” nie oznacza „trwale wykluczony”.
- Czołganie staje się mniej wydajne, niekoniecznie „zmarnowane”. Dokumentacja kanonizacji Google mówi, że najczęściej czołga wybrany kanoniczny adres URL, a pozostałych członków grupy rzadziej, aby zmniejszyć obciążenie. To względna zmiana częstotliwości, a nie dowód, że każdy duplikat na każdej stronie spala znaczną część budżetu czołgania — ale na dużych stronach z dużą ilością duplikacji to się sumuje, i to również tutaj duplikacja treści nakłada się na budżet czołgania, tuż obok nawigacji fasetowej i pułapek dla pająków.
- Pomiary stają się bardziej zagmatwane. Ruch, kliknięcia i konwersje rozdzielone między adresy URL utrudniają zobaczenie, jak dana treść faktycznie działa — Google wymienia „uproszczenie metryk śledzenia” jako jeden z własnych powodów do konsolidacji.
Jak Google (i Bing) radzą sobie z duplikatami
Mechanizm jest taki sam w obu wyszukiwarkach: wykryj → zgrupuj → wybierz kanoniczny.
Wpis Google z 2008 roku opisuje to w pierwszej osobie: gdy wykryją zduplikowaną treść, na przykład przez warianty spowodowane parametrami URL, grupują zduplikowane adresy URL w jeden klaster, a następnie wybierają ich zdaniem najlepszy adres URL, który ma reprezentować klaster w wynikach wyszukiwania. Uzasadnieniem była różnorodność wyników — chcą pokazać dziesięć różnych wyników na stronie, a nie dziesięć adresów URL z tą samą treścią — a Google stara się odfiltrować zduplikowane dokumenty, aby użytkownicy doświadczali mniejszej redundancji. Wskazali również koszt indeksowania: im więcej czasu i zasobów Googlebot spędza na indeksowaniu zduplikowanych treści w wielu adresach URL, tym mniej czasu ma na dotarcie do reszty Twoich treści.
Mueller opisał również stronę serwowania: jeśli Google znajdzie dokładnie te same informacje na wielu stronach w sieci, to gdy ktoś szuka, stara się znaleźć najlepiej pasującą stronę i nie pokaże wszystkich tych stron.
Zwrot w wyszukiwaniu AI w 2025 roku. Bing teraz przedstawia ten sam model dla odkrywania opartego na LLM: “LLMs group near-duplicate URLs into a single cluster and then choose one page to represent the set. If the differences between pages are minimal, the model may select a version that is outdated.” (tłumaczenie) „Modele LLM grupują prawie zduplikowane adresy URL w jeden klaster, a następnie wybierają jedną stronę, która ma reprezentować ten zbiór. Jeśli różnice między stronami są minimalne, model może wybrać wersję, która jest nieaktualna.” Tak więc konsolidacja chroni teraz również widoczność w wyszukiwarce AI, a nie tylko niebieskie linki. To świeży kąt, którego nie obejmuje większość starszych artykułów o zduplikowanych treściach.
To jest związek tego tematu z kanonikalizacją: grupowanie i wybieranie reprezentatywnego adresu URL jest kanonikalizacją. Zduplikowana treść to problem; kanonikalizacja to proces, który go rozwiązuje. Warto też być precyzyjnym co do tego, co oznacza „rozwiązuje to”: zadeklarowany kanon to silna wskazówka, a nie instrukcja, a to zebrane sygnały — przekierowania, rel="canonical", linki wewnętrzne, mapy witryn — które Google waży, aby wybrać reprezentanta. Żaden z nich indywidualnie nie gwarantuje wyniku.
Co powoduje zduplikowaną treść
Prawie wszystko to kwestia techniczna. Oto pełna taksonomia z mojego przewodnika Ahrefs, pogrupowana:
Warianty protokołu i hosta
- HTTP vs. HTTPS
- non-www vs. www
Warianty URL i parametry
- Parametry śledzenia (UTM itp.)
- Identyfikatory sesji w adresach URL
- Adresy URL rozróżniające wielkość liter (kapitalizacja)
- Ukośnik na końcu vs. brak ukośnika na końcu
Strony funkcji witryny
- Adresy URL przyjazne do druku
- Adresy URL specyficzne dla urządzeń mobilnych (subdomeny
m.) - Adresy URL AMP
- Nawigacja fasetowa / filtrowana
- Strony tagów i kategorii (archiwa)
- Adresy URL załączników / obrazów (standardowy szablon)
- Paginowane komentarze
- Wewnętrzne strony wyników wyszukiwania
- Lokalizacja (warianty regionalne w tym samym języku)
Między witrynami
- Środowiska staging / deweloperskie, które zostały zaindeksowane
- Syndykacja i skradziona treść
Wzorzec: zapytaj “ile różnych adresów URL może prowadzić do tej samej treści?” Każda dodatkowa odpowiedź to duplikat. Parametry URL to najbardziej płodne źródło, dlatego mają własne omówienie.
Nie wszystko, co wygląda na duplikację, nią jest
Kilka przypadków bywa błędnie nazywanych „zduplikowaną treścią”, podczas gdy właściwa odpowiedź to „to zależy” — warto zrobić szybki, osobny przegląd, zanim cokolwiek ruszysz:
- Filtry, sortowanie i paginacja. Parametr nie jest automatycznie
duplikatem. Parametry śledzenia i sesji (
?utm_source=,?sessionid=) tworzą faktycznie równoważną treść i powinny kanonizować do czystego adresu URL. Ale parametr filtra lub sortowania może zmienić to, co faktycznie znajduje się na stronie — wytyczne Google dotyczące adresów URL w e-commerce traktują je jako wymagające analizy przypadku po przypadku, a nie blanketowej kanonizacji. Strony paginowane to z kolei osobny przypadek: wytyczne Google dotyczące paginacji mówią, że każda strona w serii powinna mieć własny adres URL i własną samoodnoszącą się kanonikę — kanonizowanie każdej strony z powrotem do pierwszej nie jest zalecanym rozwiązaniem. - Warianty produktów. To również nie zawsze duplikaty. Osobne adresy URL dla faktycznie odrębnego koloru, rozmiaru lub konfiguracji mogą pomóc w znalezieniu danego wariantu samodzielnie; to równoważne ścieżki i zbędne parametry wskazujące na ten sam asortyment są duplikatami. Oceniaj intencję — czy to strona, której ktoś szukałby konkretnie? — a nie sam fakt, że to „tylko wariant”.
- Pełne tłumaczenia. Strona przetłumaczona na inny język nie jest
duplikatem tylko dlatego, że szablon i układ są zgodne — wytyczne Google dotyczące
wersji zlokalizowanych
wyznaczają granicę duplikatów na poziomie języka, a nie układu. Regionalne warianty
w tym samym języku (
en-usvs.en-gb) to te, które mogą grupować się jako prawie duplikaty; dlatego właśnie dla nich stosuje się hreflang, a nie konsolidację, o czym dalej na tej stronie. - „Odsetek prawie duplikatów” narzędzia indeksującego. Narzędzia do audytu witryn, takie jak Ahrefs i Screaming Frog, oznaczają strony powyżej progu podobieństwa (często domyślnie ustawionego na około 90%). Ten próg to konfigurowalne ustawienie diagnostyczne narzędzia, a nie liczba publikowana lub stosowana przez Google — traktuj oznaczoną parę jako sygnał do porównania faktycznie wyrenderowanej treści głównej, a nie jako werdykt sam w sobie.
Jak znaleźć zduplikowaną treść
- Search Console — „Duplikat, Google wybrał inną kanonikę niż użytkownik”. To najgłośniejszy sygnał, jaki masz. Oznacza, że Google nadpisał Twoją zadeklarowaną kanonikę. (Napisałem cały artykuł na blogu Ahrefs o tym statusie — zwykłe przyczyny to zduplikowana/podobna treść, łańcuchy lub pętle kanoniczne, literówki w tagach kanonicznych, nieprzetłumaczona treść międzynarodowa oraz renderowanie aplikacji JS jako powłoki.)
- Indeksator witryny (Ahrefs Site Audit, Screaming Frog) oznacza zduplikowane lub prawie zduplikowane strony, zduplikowane tytuły oraz warianty protokołu/hosta/ukośnika.
- Wyszukiwania
site:w celu wykrycia oczywistych przypadków — zarównohttp, jak ihttpsdziałają, zindeksowane adresy URL z parametrami, poddomeny stagingowe, które umknęły. - Kontrola osiągalności. W przypadku ważnej strony ręcznie przetestuj warianty
(
http/https,www/bezwww, końcowy ukośnik, wielkie litery) i sprawdź, co zwraca200zamiast przekierowania. - Porównaj wyrenderowaną treść, nie tylko surowy HTML. Google indeksuje to, co się renderuje — łącznie z JavaScriptem — więc dwa adresy URL z różnym źródłem, ale identycznym wyrenderowanym wynikiem, mogą nadal się grupować, a dwa adresy URL z podobnie wyglądającym surowym HTML, ale różną wyrenderowaną treścią (personalizacja, stany puste, szablony błędów) mogą nie być duplikatami. W razie wątpliwości sprawdź, co faktycznie ładuje się w przeglądarce.
Jak naprawić zduplikowaną treść (w kolejności preferencji)
Poniższa kolejność to użyteczny domyślny wybór, ale prawdziwe pierwsze pytanie brzmi: co faktycznie chcesz zrobić z tym adresem URL — ponieważ właściwa poprawka wynika z intencji, a nie ze stałej uniwersalnej hierarchii:
- Chcesz, aby duplikat zniknął całkowicie, a ruch został przekierowany? → 301.
- Musisz zachować dostępność, ale chcesz, aby inny URL reprezentował go w
wynikach? →
rel="canonical". - Czy to faktycznie odrębna strona, która została błędnie zgrupowana? → uczyń ją naprawdę różną, a nie naprawiaj — zobacz przyczyny powyżej.
- Chcesz celowo usunąć ją z indeksu Google? →
noindex.
Mając to na uwadze, oto kolejność, od najsilniejszych/rozwiązań u źródła problemu, aż po usunięcie:
1. Napraw przyczynę źródłową / skonsoliduj za pomocą przekierowań 301. W przypadku wariantów protokołu, hosta, ukośnika i wielkości liter, właściwym rozwiązaniem jest doprowadzenie do tego, aby tylko jedna wersja odpowiadała, i przekierowanie 301 pozostałych do niej. Google opisuje przekierowanie jako “A strong signal that the target of the redirect should become canonical.” (tłumaczenie) „Silny sygnał, że cel przekierowania powinien stać się kanoniczny”. Bing zaleca: “Use 301 redirects to consolidate variants into a single preferred URL.” (tłumaczenie) „Użyj przekierowań 301, aby skonsolidować warianty w jeden preferowany adres URL”. To preferowane rozwiązanie, ponieważ całkowicie usuwa duplikat i przekazuje sygnały.
2. rel="canonical" — gdy musisz zachować dostępność duplikatu. Jeśli duplikat musi pozostać aktywny (wersja do druku, sparametryzowany URL potrzebny użytkownikowi), dodaj tag kanoniczny wskazujący preferowany URL. Google: “silny sygnał, że określony URL powinien stać się kanoniczny.” Zwróć uwagę na słowo sygnał — to wskazówka, a nie dyrektywa. Google może i wybiera inaczej, gdy inne sygnały są sprzeczne. (Więcej o tagach kanonicznych / rel=canonical jako powiązanym temacie.)
3. Obsługa parametrów i spójne linkowanie wewnętrzne. Obsługuj parametry spójnie — kanonizuj do czystego URL i zawsze linkuj wewnętrznie do jednej wersji kanonicznej. (Stare narzędzie URL Parameters w GSC zostało wycofane w 2022 roku, więc teraz obsługujesz parametry przez canonical / robots / linkowanie wewnętrzne, a nie ustawienie w panelu.) Uwzględnienie URL w sitemap.xml to słaby sygnał, który pomaga mu stać się kanonicznym, więc trzymaj sitemapy tylko z kanonicznymi URL-ami.
4. noindex — tylko gdy naprawdę chcesz, aby strona zniknęła. noindex usuwa stronę; nie konsoliduje sygnałów do preferowanego URL tak, jak robi to 301 lub canonical. Sięgaj po niego tylko wtedy, gdy naprawdę chcesz, aby ta strona wypadła z indeksu (np. cienka strona wyników wyszukiwania wewnętrznego) — a nie jako domyślne rozwiązanie duplikatu. Użycie noindex tam, gdzie chciałeś konsolidacji, wyrzuca sygnały zamiast je scalać.
Warto tu dokonać wyraźnego rozróżnienia: robots.txt i narzędzie URL Removal w Search Console również nie są metodami kanonizacji, mimo że pojawiają się w tych samych rozmowach. Zablokowanie URL w robots.txt uniemożliwia Googlebotowi zobaczenie strony w ogóle, co oznacza, że nie może być ona oceniona ani włączona do klastra — nie mapuje to duplikatu na preferowany URL. Usunięcie tymczasowo ukrywa URL z wyników; niczego nie konsoliduje. Sięgaj po noindex (lub przekierowanie, lub canonical), gdy celem jest konsolidacja.
5. hreflang dla wariantów lokalizacyjnych. W przypadku wariantów regionalnych w tym samym języku (en-us vs en-gb), hreflang łączy wersje, aby właściwa była pokazywana właściwej grupie odbiorców. Nie podnosi rankingów i nie jest narzędziem konsolidacji — po prostu pokazuje poprawną wersję regionalną. (Zobacz SEO międzynarodowe.)
6. Syndykacja — i to się zmieniło. Ponowne publikowanie nie jest ryzykowne jeśli relacja jest odpowiednio skonfigurowana. Polityki spamowe Google nadal wyraźnie wyłączają syndykację — “publikacje informacyjne, które syndykują treści informacyjne z innych publikacji informacyjnych” są wymienione jako niebędące nadużyciem — więc ryzyko nigdy nie leżało w samej syndykacji.
Ale zalecany mechanizm odszedł od porady, którą kiedyś udzielałem (ja i większość branży, w tym mój starszy przewodnik Ahrefs), stawiającej canonical na pierwszym miejscu. Obecne wytyczne Google dotyczące rozwiązywania problemów z kanonikalizacją nie traktują już rel="canonical" jako głównego sposobu na to, aby kopia partnera syndykacyjnego nie konkurowała z Twoim oryginałem — ponieważ w praktyce strony syndykowane często różnią się na tyle (inny szablon, dodane intro, reklamy, powiązane linki), że Google nie zawsze honoruje canonical wskazujący z powrotem do Ciebie. To, co Google obecnie opisuje jako najbardziej skuteczne, to zablokowanie przez partnera syndykacyjnego indeksowania jego kopii (własny noindex lub wykluczenie jej z jego mapy witryny) zamiast polegania na canonicalu wskazującym z powrotem na Ciebie.
W praktyce: nadal proś partnera syndykacyjnego o canonical wskazujący z powrotem do Ciebie, jeśli się zgodzi — to nie szkodzi i nadal pomaga, gdy strony są prawie identyczne. Ale jeśli faktycznie kontrolujesz ryzyko, że kopia partnera wyprzedzi Twój oryginał, bardziej niezawodną prośbą jest, aby trzymał swoją kopię całkowicie poza indeksem, a nie tylko ją kanonikalizował. To prawdziwa aktualizacja starszej porady „canonical albo noindex, oba działają”, więc jeśli skonfigurowałeś syndykację jakiś czas temu, opierając się wyłącznie na canonicalu, warto wrócić do rozmów z partnerami tam, gdzie to ma znaczenie.
Mity o zduplikowanych treściach, obalone
- „Istnieje kara za zduplikowane treści.” Nie. Google: „There’s no such thing as a ‘duplicate content penalty.’” (tłumaczenie) „Nie ma czegoś takiego jak «kara za zduplikowane treści».” Bing: „doesn’t trigger search penalties on its own” (tłumaczenie) „nie wywołuje kar w wyszukiwarce sam w sobie”. Kary = tylko nadużycia polegające na oszustwie lub skalowaniu.
- „Jeśli dwie strony są podobne w >X%, dostajesz karę.” Nie. Nie ma progu procentowego podobieństwa, który wyzwala karę. Wyszukiwarki grupują i wybierają kanoniczną wersję; nie odejmują punktów za wynik podobieństwa. (Matt Cutts kiedyś ujął to tak, że gdzieś między 25% a 30% treści w sieci jest duplikatami — to normalne i oczekiwane.)
- „Cytowanie źródeł lub powtarzanie standardowych fragmentów szkodzi.” Nie. Stopki, wyłączenia odpowiedzialności, specyfikacje produktów i cytowanie innych źródeł to normalne powtórzenia, których wyszukiwarki oczekują.
- „Posiadanie jednocześnie http:// i https:// (lub www i bez www) skutkuje karą.” Brak kary — ale to jest realny problem rozdzielania sygnałów. Rozwiąż go przez 301 do preferowanej wersji, z powodów wydajności, a nie strachu.
- „Znacznik kanoniczny gwarantuje wersję kanoniczną.” Nie.
rel="canonical"to silna wskazówka/sygnał, a nie dyrektywa; 301 jest silniejsze; sprzeczne sygnały mogą sprawić, że Google wybierze inaczej — co dokładnie oznacza „Duplikat, Google wybrał inną wersję kanoniczną niż użytkownik”. - „
noindexto podstawowe rozwiązanie na duplikaty.” Zwykle błędne. Usuwa stronę; nie konsoliduje. Preferuj 301 / kanoniczny; używajnoindextylko wtedy, gdy faktycznie chcesz usunąć.
Podsumowanie
Nie ma kary. Jest rozwodnienie sygnałów, ranking niewłaściwego adresu URL i zmarnowane crawl — a lekarstwo na wszystkie trzy jest takie samo: skonsoliduj wszystko na jednym kanonicznym adresie URL, używając najsilniejszego sygnału, jaki rozsądnie możesz. A jeśli wolisz nie przebrnąć przez to sam, jak Google od dawna mówi, możesz pozwolić im to obsłużyć — oni zgrupują duplikaty i wybiorą reprezentanta za Ciebie. Ja po prostu wolę dokonać wyboru za nich.
Podsumowanie AI
Skrócona wersja wersji zaawansowanej:
- Nie ma ogólnej kary za zduplikowane treści. Google („nie ma czegoś takiego jak kara za zduplikowane treści”) i Bing („nie wyzwala kar w wyszukiwarce samodzielnie”) oboje tak twierdzą. Google zwykle radzi sobie ze zwykłą duplikacją poprzez deduplikację i wybór kanoniczny, a nie działania polityczne. Kary dotyczą tylko zwodniczego, skalowanego nadużycia — skrobania i masowego ponownego publikowania bez wartości (polityki spamu Google, „skalowane nadużycie treści”).
- Realne koszty są pośrednie i możliwe, a nie gwarantowane: (1) rozproszenie sygnałów — linki, kliknięcia, wyświetlenia mogą się rozdzielić między wersje; (2) wybór niewłaściwego adresu URL w wynikach, choć niekanoniczny element klastra może nadal służyć w określonym kontekście; (3) mniej wydajne indeksowanie — Google indeksuje kanoniczny częściej, kopie rzadziej; (4) bardziej zagmatwane pomiary.
- Wyszukiwarki sobie z tym radzą: wykryj → zgrupuj → wybierz kanoniczny. Google grupuje zduplikowane adresy URL w klaster i wybiera reprezentanta na podstawie zebranych sygnałów (zadeklarowany kanoniczny jest wskazówką, a nie regułą). Bing stosuje teraz ten sam model do wyszukiwania LLM/AI — i może wyświetlić nieaktualnego reprezentanta, więc konsolidacja chroni również widoczność w AI.
- Większość duplikacji ma charakter techniczny, a nie redakcyjny: http/https, www/non-www, parametry śledzenia, identyfikatory sesji, wielkość liter, końcowy ukośnik, adresy URL do druku/mobilne/AMP, nawigacja fasetowa, strony archiwalne, wyszukiwanie wewnętrzne, staging, syndykacja.
- Nie wszystko, co wygląda jak duplikacja, nią jest: filtry/sortowania/paginacja wymagają spojrzenia na treść, a nie blanketowego kanonicznego; strony paginowane zachowują własne kanoniczne; warianty produktów mogą zasługiwać na własne adresy URL; pełne tłumaczenia na inny język nie są duplikatami (regionalne warianty w tym samym języku mogą być); „procent prawie duplikatów” narzędzia indeksującego to ustawienie narzędzia, a nie próg Google.
- Znajdź to za pomocą statusu GSC „Duplikat, Google wybrał inny kanoniczny niż użytkownik”,
indeksatora strony, wyszukiwań
site:, sprawdzeń osiągalności oraz porównywania wyrenderowanej treści, a nie tylko surowego HTML. - Napraw zgodnie z intencją, mniej więcej w tej kolejności: przyczyna źródłowa / 301 (najsilniejszy) →
rel="canonical"(wskazówka, a nie dyrektywa) → obsługa parametrów + spójne linkowanie wewnętrzne →noindextylko do prawdziwego usunięcia (nie konsoliduje; nie robi tego teżrobots.txtani narzędzie do usuwania) → hreflang dla zlokalizowanych wariantów → syndykacja, gdzie obecne wytyczne Google faworyzują proszenie partnera onoindexich kopii zamiast polegania wyłącznie na kanonicznym. - Zabite mity: brak wyzwalacza procentowej podobieństwa; boilerplate/cytowanie jest w porządku; http+https
oba żyjące nie jest karą; tag kanoniczny to sygnał, a nie gwarancja;
noindexnie jest domyślnym rozwiązaniem na duplikaty.
Oficjalna dokumentacja
Dokumentacja źródłowa od wyszukiwarek.
- Czym jest kanonikalizacja — aktualny dokument techniczny: podobieństwo treści głównej, grupowanie, tempo indeksowania i wyjątek dotyczący serwowania w określonym kontekście. Zacznij tutaj, aby dowiedzieć się, jak faktycznie działa wykrywanie.
- Konsolidowanie zduplikowanych URL-i i wskazywanie adresu kanonicznego — dlaczego warto określić kanoniczny adres URL, jak Google wybiera go, jeśli tego nie zrobisz, oraz metody w kolejności siły sygnału (przekierowania > rel=canonical > sitemap). Zacznij tutaj, aby poznać hierarchię napraw.
- Rozwiązywanie problemów z kanonikalizacją — aktualne wytyczne dotyczące syndykacji (noindex po stronie partnera zamiast samego kanonicznego), środki zaradcze wobec kopiowania i scrapowania oraz czas ponownej oceny w ograniczonym zakresie.
- Szczegółowy przewodnik po działaniu wyszukiwarki Google — renderowanie przed indeksowaniem, grupowanie i dlaczego niekanoniczny element klastra może nadal być serwowany w określonym kontekście.
- Projektowanie struktury URL-i witryn e-commerce — wytyczne dotyczące parametrów i wariantów produktów; dlaczego parametr nie jest automatycznie duplikatem.
- Paginacja, przyrostowe wczytywanie stron i ich wpływ na wyszukiwarkę Google — każda strona paginowana powinna mieć własny adres URL i samoodnoszący się kanoniczny.
- Informowanie Google o zlokalizowanych wersjach strony — granica duplikatu to język, a nie układ; wzajemne hreflang dla wariantów regionalnych w tym samym języku.
- Zasady dotyczące spamu — gdzie faktycznie mieszkają kary: masowe nadużycia treści, scrapowanie i wyjątek dla syndykacji.
- Obalamy mit „kary za zduplikowaną treść” (2008) — oryginalny wpis o “braku kary” i pochodzenie ramowego ujęcia grupowania.
- Obsługa uzasadnionej duplikacji treści między domenami (2009) — starsze odniesienie do syndykacji (kanoniczny/noindex z powrotem do oryginału); zobacz aktualny dokument dotyczący rozwiązywania problemów powyżej, aby poznać zaktualizowane zalecenie.
- Sprawne radzenie sobie ze zduplikowaną treścią (2006) — starsza definicja zduplikowanej treści.
Bing / Microsoft
- Czy zduplikowana treść szkodzi SEO i widoczności w wyszukiwarkach AI? (grudzień 2025) — model Binga: brak kary → rozproszone sygnały → grupowanie → wybór jednego, rozszerzony o wyszukiwanie LLM/AI. Wymienione poprawki obejmują tagi kanoniczne, trwałe przekierowania, hreflang, noindex i IndexNow.
Cytaty ze źródła
Oficjalne wypowiedzi Google i Bing. Każdy link to link bezpośredni, który przenosi do cytowanego fragmentu na stronie źródłowej.
Google — nie ma kary
- “There’s no such thing as a ‘duplicate content penalty.’ At least, not in the way most people mean when they say that.” (tłumaczenie) „Nie ma czegoś takiego jak ‚kara za zduplikowaną treść’. Przynajmniej nie w taki sposób, w jaki większość ludzi to rozumie, gdy to mówią.” — Blog Google Search Central, Obalamy mit „kary za zduplikowaną treść” (2008). Przeczytaj wpis
- “We don’t have a duplicate content penalty. It’s not that we would demote a site for having a lot of duplicate content.” (tłumaczenie) „Google nie stosuje kary za zduplikowaną treść ani nie degraduje witryny wyłącznie dlatego, że zawiera ona wiele duplikatów.” — John Mueller, Google. Przejdź do cytatu
Google — gdzie faktycznie mieszkają kary (polityki spamowe)
- “Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users.” (tłumaczenie) „Nadużywanie treści na dużą skalę polega na generowaniu wielu stron przede wszystkim w celu manipulowania pozycjami w wynikach, a nie pomagania użytkownikom.” — Google Search Essentials, zasady dotyczące spamu. Skocz do cytatu
- “Republishing content from other sites without adding any original content or value, or even citing the original source.” (tłumaczenie) „Ponowne publikowanie treści z innych witryn bez dodania własnej treści lub wartości, a nawet bez wskazania pierwotnego źródła.” — Zasady Google dotyczące spamu; przykład nadużycia polegającego na kopiowaniu. Skocz do cytatu
- “Sites that violate our policies may rank lower in results or not appear in results at all.” (tłumaczenie) „Witryny naruszające nasze zasady mogą zajmować niższe pozycje albo w ogóle nie pojawiać się w wynikach.” Skocz do cytatu
- Wyjątek dotyczący syndykacji: “News publications that have syndicated news content from other news publications.” (tłumaczenie) „Publikacje informacyjne, które rozpowszechniają syndykowane wiadomości pochodzące z innych publikacji informacyjnych.” Skocz do cytatu
Google — grupowanie i hierarchia napraw
- “If you don’t specify a canonical URL, Google will identify which version of the URL is objectively the best version to show to users in Search.” (tłumaczenie) „Jeśli nie wskażesz kanonicznego URL-a, Google ustali, która wersja URL-a jest obiektywnie najlepsza do pokazania użytkownikom w wyszukiwarce.” — Dokumentacja Google Search Central. Skocz do cytatu
- Przekierowania: “A strong signal that the target of the redirect should become canonical.” (tłumaczenie) „Silny sygnał, że cel przekierowania powinien stać się adresem kanonicznym.” Skocz do cytatu
rel="canonical": “A strong signal that the specified URL should become canonical.” (tłumaczenie) „Silny sygnał, że wskazany URL powinien stać się adresem kanonicznym.” Skocz do cytatu- Uwzględnienie w mapie witryny: “A weak signal that helps the URLs that are included in a sitemap become canonical.” (tłumaczenie) „Słaby sygnał pomagający URL-om ujętym w mapie witryny stać się adresami kanonicznymi.” Skocz do cytatu
Bing — ten sam model, plus perspektywa wyszukiwania AI
- “Duplicate content doesn’t trigger search penalties on its own, but it does reduce visibility by diluting authority.” (tłumaczenie) „Zduplikowana treść sama nie powoduje kar w wyszukiwarce, ale ogranicza widoczność przez rozproszenie autorytetu.” — Blog Bing Webmaster (grudzień 2025). Skocz do cytatu
- “When several URLs contain the same content, signals such as clicks, links, impressions, and engagement are often diluted.” (tłumaczenie) „Gdy kilka URL-i zawiera tę samą treść, sygnały takie jak kliknięcia, linki, wyświetlenia i zaangażowanie często się rozpraszają.” Skocz do cytatu
- “LLMs group near-duplicate URLs into a single cluster and then choose one page to represent the set. If the differences between pages are minimal, the model may select a version that is outdated.” (tłumaczenie) „Modele LLM grupują niemal identyczne URL-e w jeden klaster, a następnie wybierają jedną stronę reprezentującą cały zbiór. Jeśli różnice między stronami są minimalne, model może wybrać nieaktualną wersję.” Skocz do cytatu
Lista kontrolna audytu duplikatów treści
Przejdź przez nią, aby znaleźć i rozwiązać problem duplikacji na stronie:
- Sprawdzono w Search Console statusy „Duplicate, Google chose different canonical than user” i „Duplicate without user-selected canonical”.
- Potwierdzono, że rozwiązuje się tylko jeden protokół —
httpprzekierowuje 301 nahttps. - Potwierdzono, że rozwiązuje się tylko jeden host — www i non-www nie zwracają oba
200; jeden przekierowuje 301 na drugi. - Potwierdzono jedną konwencję ukośnika końcowego i spójną wielkość liter — warianty przekierowują, zamiast oba się rozwiązywać.
- Parametry śledzenia / sesji (UTM, sortowanie, ID sesji) kanonizują do czystego URL-a.
- Warianty druku, mobilne (
m.) i AMP wskazują kanoniczny na główny URL. - Nawigacja fasetowa / filtrowana nie generuje indeksowalnych zduplikowanych URL-i
(kanoniczny, robots lub
#zamiast?). - Strony tagów/kategorii/archiwów i wewnętrznych wyników wyszukiwania nie są indeksowane jako cienkie duplikaty.
- Poddomeny staging / dev nie są indeksowane (zablokowane lub
noindex+ autoryzacja). - Każda ważna strona ma kanoniczny wskazujący na samą siebie.
- Linki wewnętrzne wszystkie wskazują na pojedynczą wersję kanoniczną (bez mieszanych linków protokołu/hosta/ukośnika).
- Mapy witryn zawierają tylko kanoniczne, indeksowalne URL-e.
- Warianty zlokalizowane są powiązane za pomocą hreflang (nie skonsolidowane).
- Kopie syndykowane — poproś partnera o
noindexjego kopii (skuteczniejsza prośba według obecnych wytycznych Google); kanoniczny wskazujący na Twój oryginał to dobry sygnał drugorzędny, nie główne rozwiązanie. - Filtry, sortowania i paginacja zostały ocenione pod kątem intencji, a nie automatycznie skanonizowane — strony paginowane zachowują własny kanoniczny.
Hierarchia rozwiązań (w kolejności preferencji)
Gdy znajdziesz duplikację, przejdź w dół tej listy — najpierw najmocniejsze, rozwiązania u źródła, na końcu usunięcie. Wybierz najwyższą opcję, która ma zastosowanie.
1. Napraw przyczynę źródłową / przekierowanie 301. Najlepszy wynik to taki, że duplikat przestaje istnieć. W przypadku wariantów protokołu, hosta, ukośnika i wielkości liter spraw, aby jedna wersja się rozwiązywała, a pozostałe przekieruj 301 do niej. Przekierowanie to najsilniejszy sygnał konsolidacji Google (“A strong signal that the target of the redirect should become canonical.” (tłumaczenie) „Silny sygnał, że cel przekierowania powinien stać się adresem kanonicznym”) i przekazuje sygnały dalej. Domyślne rozwiązanie.
2. rel="canonical" — gdy duplikat musi pozostać osiągalny.
Nie możesz usunąć duplikatu (widok do druku, potrzebny parametr)? Wskaż kanoniczny na
preferowany URL. To silna wskazówka, nie dyrektywa — Google może wybrać inaczej,
więc poprzyj to spójnymi linkami wewnętrznymi i czystą mapą witryny.
3. Obsługa parametrów + spójne linkowanie wewnętrzne. Traktuj parametry spójnie (kanoniczny do czystego URL-a) i zawsze linkuj wewnętrznie do jednej wersji kanonicznej. Narzędzie URL Parameters w GSC zniknęło (2022), więc to teraz jedyna dźwignia dla parametrów.
4. noindex — tylko gdy naprawdę chcesz, aby strona zniknęła.
noindex usuwa; nie konsoliduje. Użyj go, gdy strona naprawdę nie powinna
być w indeksie (cienkie strony wewnętrznych wyników wyszukiwania) — nigdy jako
domyślne rozwiązanie duplikatów, bo odrzuca sygnały zamiast je scalać.
5. hreflang — dla wariantów zlokalizowanych. Warianty regionalne w tym samym języku to nie do końca „duplikaty do skonsolidowania” — powiąż je za pomocą hreflang, aby właściwy region widział właściwą stronę. To nie podnosi rankingów; to kieruje ruch do właściwej wersji.
6. Syndykacja — poproś partnera o zablokowanie indeksowania, nie tylko o kanoniczny.
Gdy inni publikują ponownie Twoje treści, kanoniczny wskazujący na Twój oryginał nadal
pomaga i warto o niego poprosić — ale obecne wytyczne Google mówią, że zablokowanie przez
partnera indeksowania jego kopii (jego noindex) jest skuteczniejszym sposobem, aby kopia
nie konkurowała z Tobą, ponieważ strony syndykowane często różnią się na tyle, że sam
kanoniczny nie zapobiega temu w pełni. To aktualizuje starszą radę „kanoniczny albo
noindex, wybierz sam”.
Jednozdaniowa zasada decyzyjna: Czy mogę usunąć duplikat? → 301. Nie? →
kanoniczny. Inna treść dla regionu? → hreflang. Chcesz go całkowicie usunąć? →
noindex. Sięgaj po usunięcie tylko wtedy, gdy konsolidacja nie jest tym, czego chcesz. I
pamiętaj, że robots.txt / usuwanie URL-i nie znajdują się na tej liście — blokują lub ukrywają,
nie konsolidują.
Przyczyna → zalecane rozwiązanie
| Przyczyna duplikacji | Zalecane rozwiązanie |
|---|---|
| HTTP vs HTTPS | 301 przekierowanie na HTTPS |
| non-www vs www | 301 przekierowanie na preferowany host |
| Końcowy ukośnik vs brak | Wybierz jeden; 301 dla drugiego |
| Wielkie vs małe litery w URL | 301 na małe litery (lub wymuś wielkość liter) |
| Parametry śledzenia (UTM itp.) | rel="canonical" do czystego URL |
| ID sesji w URL | Usuń z URL; kanoniczny do czystego URL |
| URL przyjazne do druku | rel="canonical" do głównej strony |
Mobilne (m.) / AMP URL | rel="canonical" do strony kanonicznej |
| Fasetowana / filtrowana nawigacja | Kanoniczny, blokada robots lub # zamiast ? |
| Tag / kategoria / archiwum | Kanoniczny lub noindex, jeśli cienkie |
| Wewnętrzne wyniki wyszukiwania | noindex (zwykle chcesz, aby zniknęły) |
| Zlokalizowane warianty regionalne | hreflang (odnoś, nie konsoliduj) |
| Staging / dev zaindeksowane | Blokada + noindex + autoryzacja |
| Syndykacja | Poproś o noindex na kopii partnera (najskuteczniejsze); kanoniczny do Ciebie też pomaga, ale nie jest już głównym rozwiązaniem |
| Filtry, sortowanie, paginacja | Indywidualnie — nie automatycznie duplikat; każda strona paginowana ma własny kanoniczny |
| Pełne tłumaczenia (inny język) | Nie duplikat; użyj wzajemnego hreflang zamiast |
Siła sygnału (kolejność Google): 301 przekierowanie (silne) > rel="canonical"
(silne) > uwzględnienie w sitemap (słabe). Przekierowanie przewyższa kanoniczny, gdy są w konflikcie.
Co robi każde narzędzie
| Narzędzie | Konsoliduje sygnały? | Usuwa z indeksu? | Użyj do |
|---|---|---|---|
| 301 przekierowanie | Tak | Tak (stary URL) | Naprawy wariantów źródłowych |
rel="canonical" | Tak (jako wskazówka) | Nie | Utrzymanie duplikatu dostępnego |
noindex | Nie | Tak | Prawdziwe usunięcie strony |
| hreflang | Nie | Nie | Kierowanie zlokalizowanych wariantów |
Pamiętaj: nie ma kary — napraw duplikację dla konsolidacji i efektywności crawlowania, nie ze strachu.
Znajdowanie wariantów duplikatów
Nie potrzebujesz wymyślnego narzędzia, aby wykryć typowe techniczne duplikaty — kilka sprawdzeń znajdzie większość z nich.
Wyszukiwania site: (dowolna przeglądarka). Znajdź duplikaty już w indeksie:
site:example.com inurl:http:// # is the http version indexed?
site:example.com inurl:? # parameterized URLs indexed?
site:staging.example.com # did a staging subdomain escape?
site:example.com intitle:"Your Page Title" # same title on multiple URLs?Sprawdź, które warianty URL zwracają 200 (macOS / Linux). Jeśli więcej niż jeden
zwraca 200 zamiast przekierowania, masz problem z konsolidacją:
for url in \
"http://example.com/page" \
"https://example.com/page" \
"https://www.example.com/page" \
"https://example.com/page/" \
"https://example.com/Page"; do
code=$(curl -s -o /dev/null -w "%{http_code}" -I "$url")
echo "$code $url"
done
# Want: one 200 (the canonical) and the rest 301 to it.Windows (PowerShell) odpowiednik:
$urls = "http://example.com/page","https://example.com/page",
"https://www.example.com/page","https://example.com/page/"
foreach ($u in $urls) {
$r = Invoke-WebRequest -Uri $u -Method Head -MaximumRedirection 0 `
-SkipHttpErrorCheck -ErrorAction SilentlyContinue
"{0} {1}" -f $r.StatusCode, $u
}Przeczytaj zadeklarowany kanoniczny strony, aby potwierdzić, że wskazuje tam, gdzie oczekujesz:
curl -s "https://example.com/page" | grep -i 'rel="canonical"'Do deduplikacji całej witryny pozwól to zrobić crawlerowi — zobacz zakładkę Narzędzia.
Narzędzia do znajdowania i naprawiania duplikatów
- Google Search Console — raport Strony. Statusy “Duplicate, Google chose different canonical than user” i “Duplicate without user-selected canonical” oraz “Alternate page with proper canonical tag” (tłumaczenie) „Alternatywna strona z prawidłowym tagiem kanonicznym” mówią Ci dokładnie, jak Google traktuje Twoje duplikaty. Zacznij tutaj.
- URL Inspection (GSC) — dla dowolnego URL zobacz zadeklarowany przez użytkownika vs wybrany przez Google kanoniczny obok siebie.
- Ahrefs Site Audit — oznacza duplikaty i prawie duplikaty stron, zduplikowane tytuły/meta oraz warianty protokołu/hosta/ukośnika/wielkości liter w jednym crawl.
- Screaming Frog SEO Spider — crawl, aby ujawnić zduplikowaną treść (wykrywanie prawie duplikatów), łańcuchy/pętle kanoniczne i problemy z przekierowaniami.
- Ahrefs Webmaster Tools — darmowy crawl + audyt dla zweryfikowanych witryn.
- Wyszukiwania
site:— sposób bez konfiguracji, aby zobaczyć, jakie duplikaty są już zaindeksowane (zobacz zakładkę Skrypty). - Bing Webmaster Tools — ujawnia wzorce duplikacji (np. identyczne tytuły) i obsługuje IndexNow, aby wypchnąć zmienione/usunięte URL, dzięki czemu klaster aktualizuje się szybciej.
Przed / po: trzy typowe konfiguracje duplikatów
Uproszczony przykład dla każdego z trzech najczęstszych technicznych duplikatów na tej stronie, pokazujący, co jest zepsute i jak to naprawić.
1. Warianty protokołu i hosta, oba zwracające 200
# Bad — four addresses all serve the same page, all return 200
http://example.com/guide → 200
https://example.com/guide → 200
http://www.example.com/guide → 200
https://www.example.com/guide → 200Co jest nie tak: każde przeszukanie któregokolwiek z tych czterech adresów URL jest przeszukaniem „tej samej strony” z perspektywy Google, a każdy link zbudowany do „niewłaściwego” nie konsoliduje się z pozostałymi. Sygnały dzielą się na cztery części zamiast skupiać na jednym.
# Clean — one canonical host/protocol, everything else 301s to it
http://example.com/guide → 301 → https://www.example.com/guide
https://example.com/guide → 301 → https://www.example.com/guide
http://www.example.com/guide → 301 → https://www.example.com/guide
https://www.example.com/guide → 200 (canonical, self-referencing <link rel="canonical">)Naprawa: to krok „napraw przyczynę / 301” z powyższej hierarchii napraw — najsilniejszy sygnał, ponieważ całkowicie usuwa duplikat.
2. Adres URL z parametrem śledzenia z niewłaściwym canonical
<!-- Bad — the parameterized URL canonicalizes to itself,
so Google treats /product?utm_source=newsletter as its own page
instead of folding it into the clean URL -->
<!-- served at https://example.com/product?utm_source=newsletter -->
<link rel="canonical" href="https://example.com/product?utm_source=newsletter" />Co jest nie tak: samoodnoszący się canonical na sparametryzowanym adresie URL mówi Google „to jest prawdziwa strona”, co niweczy cel — czysty adres URL i każdy wariant parametru (?utm_source=, ?sort=, ?ref=) wyglądają jak osobny kandydat na canonical.
<!-- Clean — every parameter variant canonicalizes to the clean URL -->
<!-- served at https://example.com/product?utm_source=newsletter -->
<link rel="canonical" href="https://example.com/product" />Naprawa: to krok 3, obsługa parametrów — ustaw canonical każdego sparametryzowanego wariantu na czysty adres URL i linkuj wewnętrznie tylko do czystego adresu URL.
3. Syndykowana kopia bez powiązania z oryginałem
<!-- Bad — the syndicating site has no canonical or noindex pointing
back to your original, so the copy competes with it in results -->
<!-- your article, republished on partner-site.com/your-article -->
<link rel="canonical" href="https://partner-site.com/your-article" /><!-- Better, but not the most effective option on its own — the syndicated
copy canonicals back to your original -->
<!-- your article, republished on partner-site.com/your-article -->
<link rel="canonical" href="https://example.com/your-article" /><!-- Most effective per Google's current guidance — the partner keeps
their copy out of the index entirely, so there's nothing to compete
with your original at all -->
<!-- your article, republished on partner-site.com/your-article -->
<meta name="robots" content="noindex, follow" />Naprawa: to krok 6 z hierarchii — syndykacja sama w sobie nie jest ryzykowna
(zasady antyspamowe Google wyraźnie wyłączają legalną syndykację). Gdzie
zmieniła się porada: canonical wskazujący na Ciebie pomaga, ale nie niezawodnie
zapobiega konkurowaniu kopii partnera, ponieważ syndykowane strony często różnią
się na tyle, że Google może go nie honorować. Poproszenie partnera o noindex
jego kopii jest bardziej niezawodną naprawą.
Prompty do pracy z duplikatami treści
Gotowe do skopiowania prompty do zadań na tej stronie. Wklej własne adresy URL/HTML w wskazanych miejscach — zweryfikuj wynik przed działaniem; modele mogą błędnie odczytać semantykę parametrów.
Pogrupuj listę adresów URL w grupy duplikatów
Wklej: listę adresów URL (z eksportu przeszukiwania, wyszukiwania site: lub logów serwera). Oczekuj z powrotem: adresy URL pogrupowane w klastry duplikatów z sugerowanym canonical dla każdej grupy i uzasadnieniem.
Here is a list of URLs from my site. Group them into clusters of URLs
that likely serve the same or near-duplicate content (protocol/host
variants, trailing slash, case, tracking parameters, print/mobile/AMP
versions). For each cluster, suggest which URL should be the canonical
and explain why, using the fix hierarchy: 301 redirect for pure
technical variants, rel=canonical for URLs that must stay reachable.
URLs:
[paste URL list here]Audyt tagów canonical pod kątem konfliktów
Wklej: surowy HTML <head> (lub tylko linie canonical/hreflang/przekierowań) dla zestawu stron. Oczekuj z powrotem: oznaczoną listę konfliktów — samoodnoszące się canonical, które nie powinny istnieć, canonical wskazujące na przekierowujące adresy URL lub łańcuchy canonical.
Here is the <head> markup for several pages on my site. Check the
rel="canonical" tags for problems: a canonical pointing at a URL that
itself redirects or 404s, a canonical chain (A canonicals to B, B
canonicals to C), a parameterized URL with a self-referencing
canonical instead of pointing at the clean URL, or a canonical
pointing cross-domain unintentionally. List each issue found with the
URL and a one-line explanation.
[paste head markup per URL here]Zdecyduj o naprawie dla listy parametrów
Wklej: listę parametrów adresu URL widocznych w Search Console lub logach serwera (np. ?sort=, ?utm_source=, ?sessionid=, ?color=). Oczekuj z powrotem: zalecenie dla każdego parametru — canonicalizacja, noindex lub blokada — w zależności od tego, czy zmienia treść strony.
Here are the URL parameters my site generates, with a short note on
what each one does. For each parameter, tell me whether the resulting
URL should (a) canonicalize to the clean URL because it doesn't change
the content meaningfully, (b) stay indexable as its own page because
it does change the content (e.g. a real filter a user would search
for), or (c) be blocked/noindexed because it's low-value (session IDs,
sort order, tracking tags). Explain the reasoning for each.
Parameters:
[paste parameter list and notes here] Testy walidacyjne: czy konsolidacja faktycznie zadziałała?
Uruchom je po dokonaniu naprawy duplikatów treści — 301, zmianie canonical lub oczyszczeniu parametrów — aby potwierdzić, że zadziałała, i wiedzieć, kiedy wycofać zmiany.
1. Przekierowanie rozwiązuje się czysto
Test do uruchomienia: curl -I na każdym starym wariancie (lub HTTP Status Checker) dla adresów URL, które skonsolidowałeś. Oczekiwany wynik: pojedynczy 200 na preferowanym adresie URL, wszystko inne bezpośrednie 301 z nagłówkiem Location wskazującym wprost na niego (bez łańcucha). Interpretacja błędu: wariant nadal zwraca 200 (przekierowanie nie zostało wdrożone) lub Location wskazuje na inny przekierowujący adres URL (łańcuch, który osłabia sygnał). Okno monitorowania: natychmiastowe — można to sprawdzić w momencie wdrożenia zmiany. Wyzwalacz wycofania: jakikolwiek wariant nadal zwracający 200 lub łańcuch przekierowań dłuższy niż jeden skok.
2. Tag canonical wskazuje tam, gdzie zamierzasz
Test do wykonania: Canonical Checker (lub curl -s <url> | grep 'rel="canonical"') na sparametryzowanym/zduplikowanym adresie URL. Oczekiwany wynik: zadeklarowany canonical dokładnie odpowiada czystemu/preferowanemu adresowi URL (protokół, host i ścieżka — bez zbędnego parametru). Interpretacja błędu: samoodnoszący się canonical na wariancie oznacza, że poprawka nie została zastosowana; canonical wskazujący na przekierowujący lub niedostępny adres URL powinien wskazywać na finalny cel. Okno monitorowania: natychmiast. Warunek wycofania: canonical nadal samoodnoszący się na wariancie lub wskazujący na adres URL z kodem innym niż 200.
3. Wybrany przez Google canonical jest zgodny z Twoim
Test do wykonania: Google Search Console → URL Inspection na dotkniętym adresie URL — porównaj „User-declared canonical” z „Google-selected canonical”. Oczekiwany wynik: oba są zgodne. Interpretacja błędu: niezgodność oznacza, że Google nadal traktuje inny adres URL jako autorytatywny — zwykle to znak, że przekierowanie/canonical jest zbyt nowe lub inny sygnał (linki wewnętrzne, sitemap) nadal wskazuje na stary adres URL. Okno monitorowania: 2–4 tygodnie po wdrożeniu poprawki i ponownym przeszukaniu strony — to nie działa natychmiast. Warunek wycofania: niezgodność utrzymuje się po 4–6 tygodniach bez oznak zmniejszania.
4. Liczba statusów duplikatów w GSC maleje
Test do wykonania: Search Console → Raport Strony → liczba „Duplicate, Google chose different canonical than user” śledzona w czasie (lub przez Google Search Console CSV Analyzer, jeśli pobierasz dane programowo). Oczekiwany wynik: dotknięte adresy URL znikają z tego statusu w miarę ich ponownego przeszukiwania. Interpretacja błędu: liczba utrzymująca się na stałym poziomie lub rosnąca oznacza, że albo poprawka jeszcze się nie rozprzestrzeniła, albo sprzeczny sygnał (linki wewnętrzne, wpisy w sitemap) nadal wskazuje na niepreferowany adres URL. Okno monitorowania: 2–4 tygodnie, ponieważ zależy to od częstotliwości ponownego przeszukiwania. Warunek wycofania: liczba nadal niezmieniona po pełnym cyklu ponownego przeszukiwania bez wyjaśnienia — warto ponownie sprawdzić linki wewnętrzne i sitemap, zanim założysz, że poprawka jest błędna.
Zasoby warte Twojego czasu
Moje teksty — główne źródła tej strony
- Zduplikowana treść: dlaczego powstaje i jak ją naprawić — mój pełny przewodnik na Ahrefs: kompletna taksonomia przyczyn i hierarchia poprawek, na których opiera się ta strona.
- Mit kary za zduplikowaną treść — mój artykuł z 2016 roku na Search Engine Land. Ta strona jest w praktyce jego nowoczesną kontynuacją; przedstawiam ten argument od dekady.
- Duplikat: Google wybrał inny adres kanoniczny niż użytkownik — co oznacza status GSC, jego przyczyny i jak go naprawić.
- Tagi kanoniczne — wyjaśnienie — dogłębne omówienie rel=canonical.
- Google używa około 40 sygnałów kanonikalizacji — jak Google faktycznie wybiera reprezentatywny adres URL.
- Parametry URL: kompletny przewodnik dla specjalistów SEO — najbardziej płodne źródło zduplikowanych adresów URL.
Oficjalne
- Google: Czym jest kanonikalizacja · Konsolidacja zduplikowanych URL-i · Rozwiązywanie problemów z kanonikalizacją (aktualne wytyczne dotyczące syndykacji) · Zasady dotyczące spamu · Obsługa uzasadnionej duplikacji między domenami (starsze odniesienie do syndykacji).
- Bing: Czy zduplikowana treść szkodzi SEO i widoczności w wyszukiwarkach AI? (grudzień 2025).
Z branży
- r/TechSEO — społeczność poświęcona debugowaniu kanonikalizacji i duplikacji.
- Czym jest zduplikowana treść? (Semrush) — szeroki przegląd przyczyn i wykrywania; przydatna lektura uzupełniająca dla procesów opartych na narzędziach.
- Zduplikowana treść: przyczyny i rozwiązania (Yoast) — solidna lista przyczyn z poradami skoncentrowanymi na CMS (zwłaszcza WordPress) dotyczącymi nawigacji fasetowej i stron archiwalnych.
- Kompletny przewodnik po SEO zduplikowanej treści (Sitebulb) — szczegółowy przewodnik techniczny z dobrym omówieniem wykrywania prawie zduplikowanych treści i wpływu na wyszukiwarki AI.
- Czy istnieje kara za zduplikowaną treść? (SISTRIX) — zwięzła, bezpośrednia odpowiedź na pytanie o mit.
- Google SEO Office Hours, 31 stycznia 2021 — John Mueller o zduplikowanej treści — transkrypcja Search Engine Journal wyjaśnienia Muellera, że „to nie jest negatywny czynnik rankingowy”.
Cytaty warte zapamiętania
Cytaty, po które sięgam, gdy ktoś twierdzi, że istnieje kara:
- John Mueller, Google — podkreślał, że Google nie stosuje ogólnej kary za zduplikowaną treść ani nie obniża pozycji witryny tylko z powodu dużej liczby duplikatów. Źródło (mój przewodnik Ahrefs)
- Google (2008) — “There’s no such thing as a ‘duplicate content penalty.’ At least, not in the way most people mean when they say that.” (tłumaczenie) „Nie ma czegoś takiego jak ‚kara za zduplikowaną treść’. Przynajmniej nie w takim znaczeniu, w jakim większość ludzi używa tego sformułowania.” Źródło
- Ja, w Search Engine Land (2016) — pisałem, że sama duplikacja nie uzasadnia działania, dopóki jej celem nie jest manipulowanie wynikami wyszukiwania. Zwracałem też uwagę, że zwykłe porządkowanie duplikatów można pozostawić Google. Źródło
- Bing (2025) — “Duplicate content doesn’t trigger search penalties on its own, but it does reduce visibility by diluting authority.” (tłumaczenie) „Zduplikowana treść sama w sobie nie wywołuje kar w wyszukiwarkach, ale zmniejsza widoczność poprzez rozproszenie autorytetu.” Źródło
- Matt Cutts, Google — że około 25–30 % treści w internecie to duplikaty. Duplikacja jest normalna i oczekiwana, a nie karalna. Relacja (Search Engine Land)
Sprawdź się: Duplikaty treści
Pięć szybkich pytań o duplikaty treści i mity na ich temat. Wybierz odpowiedź na każde, a następnie sprawdź.
Dziennik zmian
Zaktualizowano 11 sie 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 17 lip 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.