Znacznik meta robots

Znacznik meta robots określa sposób indeksowania i prezentowania strony — od poszczególnych dyrektyw i zasady „najpierw pobierz, potem zastosuj” po rozwiązywanie konfliktów oraz różnice między znacznikiem meta a nagłówkiem X-Robots-Tag.

Opublikowano po raz pierwszy: 23 cze 2026 · Ostatnia aktualizacja: 11 sie 2026 · Advanced
Języki
1 sygnał dowodowy na tej stronie

Znacznik meta robots — <meta name="robots" content="noindex"> w sekcji <head> — informuje wyszukiwarki, jak indeksować i prezentować pojedynczą stronę. Kluczowa jest zasada „najpierw pobierz, potem zastosuj”: strony zablokowanej w robots.txt robot nie pobierze, więc nie zobaczy jej noindex. Bez znacznika domyślnie obowiązuje index, follow. W razie konfliktu stosowana jest najbardziej restrykcyjna reguła; dla znacznika googlebot i ogólnego znacznika robots Googlebot przyjmuje sumę reguł negatywnych. Znacznik działa tylko w HTML — dla plików PDF, obrazów i innych zasobów nie-HTML użyj nagłówka X-Robots-Tag.

TL;DR — <meta name="robots" content="…"> w <head> kontroluje, jak pojedyncza strona jest indeksowana i serwowana; bez tagu domyślnie jest index, follow. Obowiązuje zasada najpierw pobierz, potem zastosuj: “these settings can be read and followed only if crawlers are allowed to access the pages” (tłumaczenie) „te ustawienia można odczytać i zastosować tylko wtedy, gdy roboty mają dostęp do stron” — dlatego URL zablokowany w robots.txt nie zostanie pobrany, a jego noindex pozostanie niewidoczne. Potwierdzają to moje własne dane z odwrotnego przypadku. Sprzeczne reguły rozstrzyga się na korzyść najbardziej restrykcyjnej; w przypadku tagu googlebot i ogólnego tagu robots, Googlebot przyjmuje sumę negatywnych reguł. Tag jest tylko HTML — użyj nagłówka X-Robots-Tag dla nie-HTML i na dużą skalę. Google czyta tylko dwa tokeny nazwane od przeszukiwaczy — googlebot i googlebot-news — i ignoruje każdą inną wartość, w tym tokeny innych silników, takie jak bingbot.

Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications

Co to jest, gdzie to umieścić i domyślna wartość

Znacznik meta robots pozwala, słowami Google, “use a granular, page-specific approach to controlling how an individual HTML page should be indexed and served to users in Google Search results.” (tłumaczenie) „stosować szczegółowe podejście na poziomie strony do kontrolowania sposobu indeksowania i prezentowania pojedynczej strony HTML użytkownikom wyników wyszukiwania Google”. Standardowym i przenośnym miejscem dla niego jest <head>:

<meta name="robots" content="noindex, nofollow">

Umieszczenie w <head> to konwencja autorska, której oczekuje każdy silnik, ale Google wyraźnie stwierdza, że nie jest to bezwzględny wymóg tej wyszukiwarki: “Google Search doesn’t enforce placement of meta robots in the HTML head and will respect robots meta tags in the body section of an HTML document as well.” (tłumaczenie) „Wyszukiwarka Google nie wymusza umieszczenia znacznika meta robots w sekcji head i respektuje go również w sekcji body dokumentu HTML”. Traktuj to jako tolerancję Google, a nie przenośne zalecenie — nadal umieszczaj znacznik w <head>, aby poprawnie odczytał go każdy robot i walidator oczekujący standardowego położenia.

Atrybut name to grupa docelowa, i to tutaj większość przewodników przecenia wsparcie Google. name="robots" adresuje każdego przeszukiwacza, który czyta tag. Poza tym Google obsługuje dokładnie dwa tokeny nazw robotów i ignoruje każdą inną wartość: “Google supports two user agent tokens in the robots meta tag; other values are ignored: googlebot for all text results, and googlebot-news for news results.” (tłumaczenie) „Google obsługuje w znaczniku meta robots dwa tokeny user-agent: googlebot dla wszystkich wyników tekstowych i googlebot-news dla wyników wiadomości; pozostałe wartości są ignorowane”. Znacznik name="bingbot" nie jest udokumentowanym mechanizmem sterowania Google — Bing czyta swój własny token na własnych warunkach, ale Google pomija każdą wartość name, której nie rozpoznaje. Zarówno atrybuty name, jak i content są nierozróżniające wielkości liter dla Google, podobnie jak nazwy i wartości nagłówka X-Robots-Tag.

Gdy nie ma tagu robots meta, domyślnie jest index, follow. Google zaznacza o regule all, że “has no effect if explicitly listed” (tłumaczenie) „nie wywołuje żadnego skutku, gdy zostanie podana jawnie”. Evidence for this claim For Google, the default robots meta behavior is index, follow when no restrictive rule is present. Scope: Google-supported robots meta rules; other crawlers publish their own support and defaults. Confidence: high · Verified: Google Search Central: Robots meta tag specifications Znacznik jest potrzebny tylko do zmiany wartości domyślnej.

Łączysz reguły na dwa sposoby: oddzielone przecinkami w jednym tagu (noindex, nofollow) lub jako wiele tagów <meta>. Google wyjaśnia, że można “create a multi-rule instruction by combining robots meta tag rules with commas or by using multiple meta tags.” (tłumaczenie) „utworzyć instrukcję z wieloma regułami, rozdzielając reguły znacznika meta robots przecinkami albo używając kilku znaczników meta”.

Reguła, która psuje wszystko: Google musi pobrać stronę, aby zobaczyć znacznik

To sedno całego artykułu. Znacznik meta robots działa według zasady najpierw pobierz, potem zastosuj. Google musi pobrać stronę, aby odczytać tag — więc wszystko, co zatrzymuje pobieranie, zatrzymuje tag przed zastosowaniem. Wprost ze specyfikacji:

Google ujmuje to wprost: “Keep in mind that these settings can be read and followed only if crawlers are allowed to access the pages that include these settings.” (tłumaczenie) „Należy pamiętać, że te ustawienia można odczytać i zastosować tylko wtedy, gdy roboty mają dostęp do stron, na których je umieszczono.”

Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications

A konsekwencja, wyrażona wprost:

Dokumentacja podaje też konsekwencję: “If a page is disallowed from crawling through the robots.txt file, then any information about indexing or serving rules will not be found and will therefore be ignored.” (tłumaczenie) „Jeśli plik robots.txt blokuje pobieranie strony, informacje o regułach indeksowania lub prezentowania nie zostaną odnalezione, a więc będą zignorowane.”

Klasyczny błąd — Disallow w robots.txt plus noindex na tym samym URL — po cichu niweczy noindex. Google nie pobiera strony, więc nie widzi znacznika, a URL może pozostać w indeksie (często jako sam adres bez fragmentu, jeśli coś do niego linkuje). Towarzyszący dokument Google o blokowaniu indeksowania mówi to samo prostszym językiem: aby reguła noindex działała, strona “must not be blocked by a robots.txt file… If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see the noindex rule, and the page can still appear in search results.” (tłumaczenie) „nie może być zablokowana przez plik robots.txt… Jeśli plik robots.txt blokuje stronę albo robot nie może uzyskać do niej dostępu, nigdy nie zobaczy reguły noindex, a strona może nadal pojawiać się w wynikach wyszukiwania.”

Obserwowałem odwrotną stronę tego mechanizmu na prawdziwych danych. W moim eksperymencie Historia zablokowania dwóch wysoko pozycjonowanych stron za pomocą robots.txt, celowo zablokowałem w robots.txt dwie nasze strony zajmujące wysokie pozycje. Ponieważ Google nie mógł już ich pobierać, nie mógł odświeżyć informacji o nich — a strony w większości utrzymały ranking: “We lost a position here or there and all of the featured snippets for the pages.” (tłumaczenie) „Straciliśmy pozycję tu czy tam i wszystkie wyróżnione fragmenty tych stron.” Moje wnioski: “Accidentally blocking pages (that Google already ranks) from being crawled using robots.txt probably isn’t going to have much impact on your rankings, and they will likely still show in the search results.” (tłumaczenie) „Przypadkowe zablokowanie za pomocą robots.txt możliwości pobierania stron, które Google już plasuje wysoko, prawdopodobnie nie wpłynie znacząco na ich pozycje i najpewniej nadal będą się pojawiać w wynikach wyszukiwania.” To ta sama moneta co problem noindex — zablokowany URL jest zamrożony. Blokada ≠ usunięcie. Jeśli naprawdę chcesz, aby strona zniknęła, potrzebujesz strony dostępnej do pobrania z dyrektywą noindex — właśnie po to służy ten znacznik.

To jest linia, którą publicznie wyznaczyłem, gdzie należy każde narzędzie. Zapytany, czy Google powinien dodać obsługę noindex do robots.txt, powiedziałem: “Google was clear they want robots.txt for crawl control only.” (tłumaczenie) „Google jasno stwierdziło, że chce, aby robots.txt służył wyłącznie do kontroli pobierania.” Sterowanie pobieraniem to zadanie robots.txt; indeksowanie to zadanie tagu meta (lub nagłówka). Nie pokrywają się, a dyrektywa noindex w robots.txt nigdy nie była oficjalnie wspierana — Google zaprzestał jej parsowania 1 września 2019 r.

Każda dyrektywa meta robots (referencja)

Wspierane wartości Google, z dosłownymi opisami ze specyfikacji:

Indeksowanie

  • all“There are no restrictions for indexing or serving. This rule is the default value and has no effect if explicitly listed.” (tłumaczenie) „Brak ograniczeń dla indeksowania lub serwowania. Ta reguła jest wartością domyślną i nie ma efektu, jeśli jest jawnie wymieniona.”
  • noindex“Do not show this page, media, or resource in search results.” (tłumaczenie) „Nie pokazuj tej strony, multimediów ani zasobu w wynikach wyszukiwania.”
  • none“Equivalent to noindex, nofollow.” (tłumaczenie) „Oznacza dokładnie to samo co połączenie dyrektyw noindex, nofollow.”
  • indexifembedded“Google is allowed to index the content of a page if it’s embedded in another page through iframes or similar HTML tags, in spite of a noindex rule.” (tłumaczenie) „Google może indeksować treść strony, jeśli jest osadzona w innej stronie przez iframe lub podobne tagi HTML, mimo reguły noindex.” (Jedyna dyrektywa, która nadpisuje noindex, dla treści osadzonych.)

Linki

  • nofollow“Do not follow the links on this page.” (tłumaczenie) „Nie podążaj za linkami na tej stronie.” To jest na poziomie strony — inny zakres niż per-link rel="nofollow", który dotyczy jednego linku.

Serwowanie i snippety

  • nosnippet“Do not show a text snippet or video preview in the search results for this page.” (tłumaczenie) „Nie pokazuj fragmentu tekstu ani podglądu wideo w wynikach wyszukiwania dla tej strony.” Ten zakres jest szerszy niż klasyczny fragment tekstu: Google mówi, że “applies to all forms of search results (at Google: web search, Google Images, Discover, AI Overviews, AI Mode) and will also prevent the content from being used as a direct input for AI Overviews and AI Mode.” (tłumaczenie) „Ma zastosowanie do wszystkich form wyników wyszukiwania w Google i zapobiega także wykorzystaniu treści jako bezpośredniego materiału wejściowego dla Przeglądów od AI i Trybu AI.”
  • max-snippet:[number]“Use a maximum of [number] characters as a textual snippet for this search result.” (tłumaczenie) „Użyj maksymalnie podanej liczby znaków jako fragmentu tekstowego dla tego wyniku wyszukiwania.” Zakres jest taki sam jak dla nosnippet: dyrektywa “applies to all forms of search results (such as Google web search, Google Images, Discover, Assistant, AI Overviews, AI Mode) and will also limit how much of the content may be used as a direct input for AI Overviews and AI Mode.” (tłumaczenie) „Ma zastosowanie do wszystkich form wyników wyszukiwania i ogranicza ilość treści, którą można wykorzystać bezpośrednio w Przeglądach od AI i Trybie AI.” To kontrola kwalifikowania treści jako bezpośredniego materiału wejściowego dla funkcji AI w wyszukiwarce Google, a nie ogólna rezygnacja z trenowania AI. Wyłączenie treści z trenowania modeli, na przykład przez Google-Extended, oraz osobna kontrola funkcji generatywnej AI w Search Console mają inne zakresy.
  • max-image-preview:[setting]“Set the maximum size of an image preview for this page in search results.” (tłumaczenie) „Ustaw maksymalny rozmiar podglądu obrazu tej strony w wynikach wyszukiwania.” Dostępne ustawienia to none, standard i large; przy ostatnim z nich “A larger image preview, up to the width of the viewport, may be shown.” (tłumaczenie) „Może zostać wyświetlony większy podgląd obrazu, nawet na całą szerokość obszaru wyświetlania.”
  • max-video-preview:[number]“Use a maximum of [number] seconds as a video snippet for videos on this page in search results.” (tłumaczenie) „Użyj maksymalnie podanej liczby sekund jako podglądu filmów z tej strony w wynikach wyszukiwania.”
  • notranslate“Don’t offer translation of this page in search results.” (tłumaczenie) „Nie proponuj tłumaczenia tej strony w wynikach wyszukiwania.”
  • noimageindex“Do not index images on this page.” (tłumaczenie) „Nie indeksuj obrazów znajdujących się na tej stronie.”
  • unavailable_after:[date/time]“Do not show this page in search results after the specified date/time.” (tłumaczenie) „Nie pokazuj tej strony w wynikach wyszukiwania po podanej dacie i godzinie.”

Historyczne — nieaktywne już kontrolki Google

Kilka dyrektyw, które wciąż krążą w starszych przewodnikach, to te, o których Google mówi, że już ich nie używa. Nie dodawaj ich, oczekując, że cokolwiek zdziałają:

  • noarchive“The noarchive rule is no longer used by Google Search to control whether a cached link is shown in search results, as the cached link feature no longer exists.” (tłumaczenie) „Reguła noarchive nie służy już w wyszukiwarce Google do sterowania wyświetlaniem linku do kopii z pamięci podręcznej, ponieważ ta funkcja już nie istnieje.”
  • nocache (synonim, którego niektóre wyszukiwarki używały dla noarchive) — “The nocache rule isn’t used by Google Search.” (tłumaczenie) „Reguła nocache nie jest używana przez wyszukiwarkę Google.”
  • nositelinkssearchbox“The nositelinkssearchbox rule is no longer used by Google Search to control whether the sitelink search box is shown for a given page, as the feature no longer exists.” (tłumaczenie) „Reguła nositelinkssearchbox nie służy już do sterowania wyświetlaniem pola wyszukiwania w linkach do podstron, ponieważ ta funkcja już nie istnieje.”

Na poziomie akapitu (nie w tagu meta)

Istnieje też mechanizm na poziomie fragmentu strony: atrybut data-nosnippet. Według Google można “designate textual parts of an HTML page not to be used as a snippet… on span, div, and section elements.” (tłumaczenie) „wskazać tekstowe części strony HTML, których nie należy używać jako fragmentu wyniku… na elementach span, div i section”. Wszystkie dyrektywy znacznika meta dotyczą całej strony; nosnippet / data-nosnippet pozwala wykluczyć pojedynczy fragment bez ingerowania w resztę.

Łączenie dyrektyw i rozwiązywanie konfliktów

Dwie zasady regulują to, co się dzieje, gdy dyrektywy wchodzą w konflikt.

1. Bardziej restrykcyjna reguła wygrywa. “In the case of conflicting robots rules, the more restrictive rule applies. For example, if a page has both max-snippet:50 and nosnippet rules, the nosnippet rule will apply.” (tłumaczenie) „W przypadku konfliktu reguł robots obowiązuje reguła bardziej restrykcyjna. Na przykład przy jednoczesnym użyciu max-snippet:50 i nosnippet zastosowana zostanie reguła nosnippet”. nosnippet jest bardziej restrykcyjne niż limit 50 znaków, więc to ono zadziała.

2. googlebot kontra robots — suma reguł negatywnych. Ten mechanizm jest często opisywany błędnie. Znacznik nazwany googlebot nie zastępuje po prostu ogólnego znacznika robots; w części wspólnej Googlebot przyjmuje sumę ograniczeń. Google wyjaśnia: “For situations where multiple crawlers are specified along with different rules, the search engine will use the sum of the negative rules.” (tłumaczenie) „Gdy wskazano kilka robotów z różnymi regułami, wyszukiwarka zastosuje sumę reguł negatywnych”. Przykład:

<meta name="robots" content="nofollow">
<meta name="googlebot" content="noindex">

“The page containing these meta tags will be interpreted as having a noindex, nofollow rule when crawled by Googlebot.” (tłumaczenie) „Strona zawierająca te znaczniki meta zostanie zinterpretowana jako objęta regułą noindex, nofollow, gdy pobierze ją Googlebot”. Reguła nofollow z robots plus noindex z googlebot dają razem noindex, nofollow dla Googlebota. Jeśli znaczniki googlebot i robots ustawiają tę samą dyrektywę odmiennie, dla tego robota obowiązuje wariant nazwany jego nazwą.

Meta tag robots a X-Robots-Tag (nagłówek HTTP)

Znacznik meta robots działa tylko w HTML, ponieważ wymaga <head>. Dla innych zasobów służy X-Robots-Tag, który przekazuje dokładnie ten sam zestaw reguł w nagłówku odpowiedzi HTTP. Google podaje: “The X-Robots-Tag can be used as an element of the HTTP header response for a given URL. Any rule that can be used in a robots meta tag can also be specified as an X-Robots-Tag.” (tłumaczenie) „Nagłówek X-Robots-Tag może być elementem odpowiedzi HTTP dla danego adresu URL, a każdą regułę dostępną w znaczniku meta robots można określić również w tym nagłówku”. Powód jego istnienia jest prosty: “You can use the X-Robots-Tag for non-HTML files like image files where the usage of robots meta tags in HTML is not possible.” (tłumaczenie) „Nagłówka X-Robots-Tag można używać dla plików nie-HTML, takich jak obrazy, w których nie da się zastosować znacznika meta robots”.

Więc:

  • PDF, obraz lub inny nie-HTML? Nie możesz dodać tagu <meta> — użyj nagłówka, np. X-Robots-Tag: noindex.
  • Całe katalogi lub wzorce? Nagłówek jest ustawiany na poziomie serwera/CDN, więc skaluje się do całych ścieżek w jednej regule konfiguracji.
  • Jedna wyszukiwarka? Nagłówek może również celować w crawlera: X-Robots-Tag: googlebot: noindex, nofollow, a wiele nagłówków X-Robots-Tag może być połączonych w jednej odpowiedzi.

Te same reguły, dwa mechanizmy dostarczania: meta tag dla stron HTML, nagłówek dla wszystkiego innego i dla skalowania.

Które dyrektywy obsługują Bing i inne wyszukiwarki

Nie zakładaj, że zestaw dyrektyw jest uniwersalny — nie jest. Bing obsługuje podstawowe reguły indeksowania i serwowania — noindex, nofollow, noarchive (z nocache jako synonimem) oraz nosnippet — i honoruje X-Robots-Tag dla zasobów niebędących HTML. Ale Bing nie obsługuje skrótu none, więc dla bezpieczeństwa między wyszukiwarkami zapisz jawnie noindex, nofollow, zamiast polegać na none. Rodzina kontroli fragmentów i podglądów — max-snippet, max-image-preview, max-video-preview — wraz z noimageindex, notranslate, indexifembedded i unavailable_after jest skutecznie tylko dla Google. W razie wątpliwości zapisuj dyrektywy wprost i traktuj kontrolki max-* jako funkcje Google.

Częste błędy (i poprawki)

  • Disallow + noindex na tym samym URL. noindex nigdy nie jest widziany. Poprawka: pozostaw stronę dostępną do indeksowania; zostaw tylko noindex.
  • noindex plus rel=canonical wskazujący gdzie indziej. Sprzeczne sygnały — mówisz Google zarówno “porzuć tę stronę”, jak i “skonsoliduj ją z inną”. Wybierz jedno. (Więcej w kanonikalizacji.)
  • noindex na całym środowisku stagingowym wdrożony na produkcję. Katastrofalna, ogólnostronicowa deindeksacja. Sprawdź przed uruchomieniem.
  • noindex wstrzyknięty tylko przez JavaScript po stronie klienta. Google musi wyrenderować stronę, aby to zobaczyć, a jeśli wyrenderowany HTML różni się od oczekiwanego, zachowanie również się różni. Preferuj tag w surowym HTML lub nagłówek. (Zobacz renderowanie.)
  • Oczekiwanie, że Bing będzie honorować dyrektywy tylko dla Google (none, rodzina max-*).
  • Oczekiwanie, że dyrektywa robots wykona zadanie, którego nie obsługuje. Reguła noindex lub nosnippet sama w sobie nie gwarantuje oszczędności budżetu pobierania, poufności, zmiany pozycji, identycznego zachowania w różnych wyszukiwarkach, konkretnego terminu usunięcia ani wykluczenia z każdej powierzchni AI lub wyszukiwania. Każdy z tych wyników wymaga innego mechanizmu: uwierzytelniania dla poufności, robots.txt dla pobierania, dokumentacji konkretnej wyszukiwarki dla zgodności oraz Search Console lub Google-Extended dla zakresów związanych z AI. Google nie podaje stałego czasu usunięcia strony objętej noindex; dla mniej ważnej strony proces “may take months” (tłumaczenie) „może potrwać miesiące”.

Aby umieścić to w szerszym kontekście: robots.txt steruje pobieraniem; noindex steruje obecnością w indeksie; a nosnippet / data-nosnippet, max-snippet i max-image-preview kształtują sposób prezentowania wyniku. X-Robots-Tag przekazuje te same dyrektywy w nagłówku HTTP dla plików niebędących HTML.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.