URL oznaczony jako 'noindex' (status GSC)

Co oznacza status "URL oznaczony jako 'noindex'" w Google Search Console — oraz wariant "Zgłoszony URL oznaczony jako 'noindex'" i starsza nazwa "Wykluczony przez tag 'noindex'". Kiedy jest to zamierzone, a kiedy błąd, gdzie znajduje się noindex (meta tag vs. nagłówek X-Robots-Tag), konflikt z robots.txt, fantomowy/CDN noindex, oraz jak to naprawić i zweryfikować.

Opublikowano po raz pierwszy: 23 cze 2026 · Ostatnia aktualizacja: 3 sie 2026 · Advanced
Języki
1 sygnał dowodowy na tej stronie

"URL oznaczony jako 'noindex'" to status indeksowania strony w Google Search Console dla strony, którą Google przeszukał i znalazł na niej dyrektywę noindex (meta tag robots lub nagłówek X-Robots-Tag), więc nie umieścił jej w indeksie. Ten sam warunek, wiele nazw: obecna "URL oznaczony jako 'noindex'", ostrzejsze sformułowanie dla zgłoszonych w sitemap "Zgłoszony URL oznaczony jako 'noindex'", powszechnie używane w raportach i narzędziach, oraz starsza nazwa "Wykluczony przez tag 'noindex'." Zazwyczaj jest to zamierzone i w porządku — zweryfikuj listę URL-i, zanim cokolwiek "naprawisz". Prawdziwym sygnałem ostrzegawczym jest strona z noindex nadal znajdująca się w Twojej sitemap — zgłoszenie w sitemap to wskazówka dla Google, a nie gwarancja, a te dwie dyrektywy są ze sobą sprzeczne. Ponieważ noindex zależy od przeszukania, nie łącz go z blokadą w robots.txt — Google nie zobaczy noindex, jeśli nie może przeszukać strony. Sprawdź dwa miejsca (meta tag i nagłówek X-Robots-Tag), debuguj fantomowy/CDN noindex za pomocą na żywo pobrania Googlebot, następnie usuń dyrektywę, zweryfikuj naprawę i spodziewaj się, że ponowne przetworzenie zajmie więcej niż dzień czy dwa.

TL;DR — „URL marked ‘noindex’” to status indeksowania strony w GSC dla strony, którą Google przeskanował i znalazł na niej noindex — meta robots tag lub nagłówek X-Robots-Tag, a Google honoruje również meta robots tag umieszczony w treści strony, nie tylko w <head>. Wiele nazw, jeden stan: obecne „URL marked ‘noindex’”, ostrzejsze sformułowanie dla przesłanych w sitemapie „Submitted URL marked ‘noindex’”, którego powszechnie używają raporty i narzędzia, oraz starsze „Excluded by ‘noindex’ tag”. Różni się od zablokowania przez robots.txt (nigdy nie przeszukane) i od „Crawled — currently not indexed” (brak dyrektywy). Zwykle celowe — najpierw zweryfikuj listę URL-i. Adres URL z noindex wciąż znajdujący się w Twojej sitemapie to prawdziwy sygnał ostrzegawczy (przesłanie sitemapy to wskazówka, nie gwarancja). noindex jest zależny od przeszukania: połącz go z disallow w robots.txt, a Google nie będzie mógł go zobaczyć, więc strona może pozostać zaindeksowana. Gdy reguły są sprzeczne, Google stosuje bardziej restrykcyjną. Sprawdź dwa źródła (wyrenderowany HTML i nagłówek HTTP), debuguj fantomowy/CDN-owy noindex za pomocą testu na żywo Googlebota (URL Inspection / Rich Results Test), następnie usuń dyrektywę, Validate Fix i spodziewaj się, że ponowne przetwarzanie zajmie więcej niż dzień lub dwa — Google mówi, że w przypadku stron o niższym priorytecie może trwać miesiącami.

Co właściwie oznacza ten status

Raport opisuje zaobserwowaną przez Google dyrektywę, a nie to, dlaczego CMS, szablon lub CDN ją dodał. Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report Google musi być w stanie przeszukać stronę, aby zaobserwować i zastosować noindex. Evidence for this claim Google supports noindex through a robots meta tag or X-Robots-Tag header and must crawl the page to observe it. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Block indexing with noindex

Definicja Google jest precyzyjna: gdy Google próbowało zaindeksować stronę, napotkało dyrektywę noindex i dlatego jej nie zaindeksowało. Kluczowe słowo to napotkało — Google musiało przeszukać stronę, aby zobaczyć dyrektywę. Ten status niesie więc dwa fakty naraz: Google dotarło do strony, a strona powiedziała mu, żeby nie było indeksowane.

Evidence for this claim Google reports URL marked noindex when it encountered a noindex directive while trying to index the URL and therefore did not index it. Scope: verified Search Console properties Confidence: high · Verified: Page indexing report

To jest cały kręgosłup dokładności tutaj i to odróżnia ten status od jego sąsiadów:

  • Zablokowane przez robots.txt → Google nigdy nie mogło przeszukać, więc nie przeczytało żadnej treści ani żadnej dyrektywy.
  • „Crawled — currently not indexed” → Google przeszukało, nie znalazło żadnej dyrektywy i mimo to zdecydowało się nie indeksować.
  • „URL marked ‘noindex’” → Google przeszukało, znalazło noindex i zastosowało się do niego.
Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report

Trzy nazwy to jeden warunek

To dezorientuje ludzi, ponieważ etykieta zmieniała się z czasem i zależy od tego, jak znaleziono URL:

  • „URL marked ‘noindex’” — obecna, ogólna etykieta w raporcie Page Indexing. Znajduje się pod „Not indexed” (dawniej „Excluded”). To sformułowanie, którego używa i definiuje obecna dokumentacja raportu Page Indexing Google.
  • „Submitted URL marked ‘noindex’” — ten sam podstawowy warunek, ale dla URL-a, który jest również w przesłanej sitemapie. To ostrzejsze sformułowanie, którego praktycy i narzędzia SEO innych firm powszechnie używają dla tej kombinacji. Obecna dokumentacja pomocy Google nie opisuje tego jako osobno zdefiniowanego statusu odrębnego od „URL marked ‘noindex’”, więc traktuj dokładną etykietę jako zależną od raportu — ale sedno pozostaje niezależnie od tego, jak dane narzędzie to nazwie: sitemap ma wymieniać URL-e, które chcesz w wynikach wyszukiwania (a jej przesłanie to wskazówka dla Google, nie gwarancja indeksowania), więc URL z noindex w niej to sprzeczność, którą warto rozwiązać.
  • „Excluded by ‘noindex’ tag” — starsza nazwa z raportu „Index Coverage” sprzed 2021 roku. Wciąż najczęściej wyszukiwana potoczna wersja. To samo podstawowe zjawisko.

Jeśli trafiłeś tutaj z którejkolwiek z tych trzech, jesteś w tym samym miejscu.

Czy to problem? Decyzja: celowe vs przypadkowe

Nie „naprawiaj” tego odruchowo. Drzewo decyzyjne:

  1. Pobierz listę dotkniętych adresów URL (kliknij w status).
  2. Czy to strony, które chciałeś wykluczyć? Strony podziękowań, wewnętrzne wyszukiwanie, adresy URL z fasetami/filtrami, konto/admin, staging, który nie powinien być publiczny. → Brak działania. „Nie zindeksowano” to nie to samo co „uszkodzony”, a Google mówi to wprost: te adresy URL nie zostały zindeksowane, ale niekoniecznie z powodu błędu.
  3. Czy na tej liście jest strona, którą chcesz zindeksować? → Wyciekł na nią noindex. Znajdź i usuń go.
  4. Czy zindeksowany URL z noindex znajduje się również w przesłanej mapie witryny (często widoczny jako „Przesłany URL oznaczony jako ‘noindex’”)? → Rozwiąż sprzeczność bezpośrednio: usuń noindex (aby go zindeksować) lub usuń URL z mapy witryny (aby pozostawić go z noindex). Nie zostawiaj URL z noindex w mapie witryny — przesłanie mapy witryny to wskazówka dla Google, co chcesz zindeksować, a nie żądanie, które nadpisuje dyrektywę samej strony.

Powodem, dla którego konkurencja traktuje to jako czysty „błąd do naprawienia”, jest to, że pomijają krok 2. W większości przypadków ten status oznacza, że system działa poprawnie.

Gdzie znajduje się noindex: meta tag vs. nagłówek X-Robots-Tag

Istnieją dokładnie dwie metody dostarczania i musisz sprawdzić obie, ponieważ wyglądają zupełnie inaczej:

  • Meta robots tag<meta name="robots" content="noindex"> w <head> strony. Dotyczy wszystkich robotów; <meta name="googlebot" content="noindex"> dotyczy tylko Google. To ten, który możesz zobaczyć w HTML.
  • Nagłówek HTTP X-Robots-TagX-Robots-Tag: noindex w nagłówkach odpowiedzi serwera. To ten podstępny. Jest ustawiany w konfiguracji serwera, CMS lub CDN, nie w kodzie strony, więc „Podgląd źródła” go nie pokaże. Metoda nagłówka jest również jedynym sposobem na oznaczenie noindex plików innych niż HTML — nagłówek odpowiedzi może być użyty dla zasobów innych niż HTML, takich jak pliki PDF, pliki wideo i pliki obrazów, które nie mają <head>, aby pomieścić meta tag.
Evidence for this claim Google supports noindex through a robots meta tag or an X-Robots-Tag HTTP response header; both have the same effect, and the response header supports non-HTML resources. Scope: HTML and non-HTML web resources Confidence: high · Verified: Block Search indexing with noindex

Gdy GSC mówi noindex, a ty przysięgasz, że strona go nie ma, nagłówek jest pierwszym miejscem, do którego należy zajrzeć (zakładka ściągawki zestawia oba obok siebie).

Jak znaleźć dyrektywę na stronie

  1. Podgląd źródła / wyrenderowany DOM — poszukaj noindex. Sprawdź wyrenderowany <head>, nie tylko surowe źródło, ponieważ tag może być wstrzyknięty przez JavaScript lub menedżer tagów. Nie zatrzymuj się na <head>: Google powiedział, że nie egzekwuje umiejscowienia meta-robots i respektuje meta tag robots znaleziony w <body> strony, więc dyrektywa wstrzyknięta niżej w dokumencie również się liczy.
  2. Nagłówki odpowiedzicurl -I https://example.com/page/ (lub DevTools przeglądarki → Sieć → żądanie dokumentu → Nagłówki odpowiedzi) i poszukaj linii X-Robots-Tag.
  3. URL Inspection (GSC)Test live URL — pobiera stronę jako Googlebot i raportuje werdykt indeksowania oraz odpowiedź. To ten, który wykrywa dyrektywy serwowane tylko dla Google.
  4. Rich Results Test — kolejne prawdziwe pobranie Googlebota, które zwraca odpowiedź HTTP i wyrenderowany zrzut dokładnie tego, co serwer pokazuje Google.
  5. Sprawdź sprzeczne reguły robots, nie tylko pojedynczy tag. Jeśli do strony ma zastosowanie więcej niż jedna dyrektywa robots (na przykład szablon ustawia index, ale wtyczka lub nagłówek dodaje noindex), Google stosuje bardziej restrykcyjną regułę — więc przypadkowy noindex gdziekolwiek wygrywa, nawet jeśli inna reguła mówi index. Nie przestawaj szukać, gdy znajdziesz jedną dyrektywę, która wygląda na permisywną.

Konflikt robots.txt (dlaczego disallow + noindex przynosi odwrotny skutek)

To jest najbardziej zagmatwany punkt we wszystkich innych przewodnikach, więc chcę go dokładnie wyjaśnić. noindex jest zależny od indeksowania: Google musi być w stanie pobrać stronę, aby odczytać dyrektywę. Google jasno podaje zasadę — aby reguła noindex była skuteczna, strona nie może być zablokowana przez plik robots.txt i musi być w inny sposób dostępna dla robota indeksującego; jeśli jest zablokowana lub robot nie może jej uzyskać, robot nigdy nie zobaczy noindex, a strona może nadal pojawiać się w wynikach wyszukiwania (na przykład, jeśli inne strony do niej linkują).

Evidence for this claim Google must be allowed to crawl and otherwise access a URL to see and apply its noindex rule; a robots.txt block can hide the directive while the URL remains eligible to appear from other information. Scope: HTML and non-HTML web resources Confidence: high · Verified: Block Search indexing with noindex

Od lat piszę o odwrotnej stronie tego zagadnienia. W moim artykule na Ahrefs na temat “Indexed, though blocked by robots.txt”, głównym punktem jest to, że “crawling and indexing are two different things” — “if you block a page from being crawled, Google may still index it.” I konkretnie o tym konflikcie: “Unless Google can crawl a page, they won’t see the noindex meta tag and may still index it because it has links.” Tak więc samosabotujące połączenie to noindex + robots.txt disallow: dyrektywa disallow ukrywa noindex, a strona może pozostać zaindeksowana przez linki zewnętrzne.

Prawidłowa sekwencja, aby faktycznie usunąć stronę:

  1. Zezwól na indeksowanie i pozostaw noindex na miejscu.
  2. Poczekaj, aż Google ponownie przeszuka stronę, zobaczy dyrektywę i usunie ją.
  3. Dopiero wtedy, jeśli chcesz zaoszczędzić budżet indeksowania, możesz dodać ją do robots.txt — po deindeksacji, nie przed.

Moje stałe zalecenie, z tego samego artykułu: “Just add a noindex meta robots tag and make sure to allow crawling — assuming it’s canonical.”

Fantomowy noindex: pamięć podręczna CDN i dyrektywy tylko dla Googlebota

Najtrudniejsza wersja tego problemu to “fantomowy” noindex: patrzysz na stronę, nie widzisz żadnego noindex, a GSC nadal go raportuje. John Mueller odniósł się dokładnie do tego — w przypadkach, które widział, był faktyczny noindex, czasami pokazywany tylko Google, co może być bardzo trudne do debugowania. (Zauważył ten scenariusz, gdy się pojawił; parafrazuję jego punkt, a nie cytuję go jako formalne oświadczenie.)

Zwykli podejrzani — traktuj je jako hipotezy do sprawdzenia, nie potwierdzone przyczyny, dopóki rzeczywista odpowiedź nie pokaże jednej z nich:

  • CDN lub pamięć podręczna serwująca nieaktualny nagłówek X-Robots-Tag: noindex, którego nie ma już w konfiguracji origin.
  • Dyrektywa zależna od user-agenta — serwer zwraca czystą stronę Twojej przeglądarce, a z noindex Googlebotowi.
  • Wyciek ze stagingu/szablonu — noindex przeznaczony dla środowiska stagingowego trafiający do produkcji przez współdzielony szablon.

Diagnoza jest taka sama we wszystkich trzech przypadkach: nie ufaj “View Source” w swojej własnej przeglądarce. Wykonaj prawdziwe pobranie GooglebotaTest live URL w URL Inspection lub Rich Results Test — które pokazuje odpowiedź HTTP i wyrenderowaną stronę dokładnie tak, jak odbiera ją Google. W ten sposób wykryjesz serwer/CDN serwujący jedną rzecz Tobie, a inną robotowi indeksującemu.

Jak to naprawić i zweryfikować

Gdy potwierdzisz, że noindex jest błędem:

  1. Usuń dyrektywę u jej prawdziwego źródła — meta tag w szablonie lub nagłówek X-Robots-Tag w konfiguracji serwera/CMS/CDN. Wyczyść pamięć podręczną CDN/strony, aby poprawka była faktycznie serwowana.
  2. Potwierdź za pomocą testu na żywo Googlebot (URL Inspection → Test live URL), że strona nie zwraca już noindex i pokazuje „URL is available to Google.”
  3. Poproś o indeksację (Request Indexing) dla adresów o wysokim priorytecie i/lub użyj przycisku Validate Fix w raporcie, aby poinformować Google o konieczności ponownego sprawdzenia całego dotkniętego zestawu.
  4. Poczekaj. Usuwanie z indeksu i ponowne indeksowanie nie są natychmiastowe — Google musi najpierw ponownie przeszukać stronę, aby zobaczyć zmianę, a według wytycznych Google czas ponownego odwiedzenia zależy od ważności strony i może być znacznie dłuższy niż dzień czy dwa (dokumentacja podaje „miesiące” jako możliwość dla stron o niższym priorytecie). Request Indexing na priorytetowym adresie to sposób, aby poprosić Google o szybszą próbę, a nie sposób na wymuszenie konkretnego harmonogramu. Nie panikuj, jeśli status utrzymuje się podczas przetwarzania.

W odwrotnej sytuacji — gdy strona ma być zaindeksowana (noindex), ale utknęła w indeksie, ponieważ była również zablokowana przez robots.txt — najpierw odblokuj crawling, aby Google w końcu mógł zobaczyć noindex.

Gdzie to się znajduje

Ten status to jeden z węzłów w raporcie Page Indexing Google. Dyrektywa robots za nim — noindex — może być dostarczona jako meta tag robots lub nagłówek X-Robots-Tag, a odpowiednie narzędzie zależy od tego, czy pracujesz z plikami HTML czy nie-HTML. Sąsiednie statusy („Indexed, though blocked by robots.txt” i „Crawled — currently not indexed”) opisują różne stany i wymagają różnych poprawek; rozróżnianie ich to większość walki.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.