Kanały RSS
Jak wyszukiwarki używają kanałów RSS 2,0 i Atom 1,0 jako kanału odkrywania świeżej treści — Feedfetcher, robots.txt, WebSub oraz powód, dla którego kanał uzupełnia, ale nigdy nie zastępuje mapy witryny XML.
Języki
Google i Bing akceptują kanały RSS 2,0 i Atom 1,0 jako sygnał odkrywania podobny do mapy witryny — kanał pokazuje jednak tylko niedawno zmienione adresy URL, dlatego uzupełnia pełną mapę witryny XML, zamiast ją zastępować. Google pobiera kanały przez Feedfetcher, osobnego robota ignorującego robots.txt; aby go zablokować, zwróć 4xx zamiast stosować disallow. Kanały działają w modelu pull; WebSub dodaje mechanizm push dla Google, a IndexNow jest dziś preferowanym sygnałem push Bing. Kanały mogą przyspieszać odkrywanie, ale nie poprawiają pozycji i nie gwarantują indeksacji.
Evidence for this claim RSS 2.0 defines a channel of items with metadata such as title, link, description, publication date, and GUID. Scope: RSS 2.0 feed format; consumer behavior varies. Confidence: high · Verified: RSS 2.0 Specification Evidence for this claim Google accepts RSS 2.0 and Atom 1.0 feeds as sitemap submissions, generally covering recent URLs; submission aids discovery but does not guarantee indexing. Scope: Current Google sitemap format support. Confidence: high · Verified: Google Search Central: Build and submit a sitemapTL;DR — Kanał RSS lub Atom to plik XML zawierający listę najnowszych stron. Wyszukiwarki mogą użyć go do szybszego znajdowania nowej treści — kanał można przesłać w Google Search Console lub Bing Webmaster Tools, tak jak mapę witryny. Kanał pokazuje jednak tylko najnowsze adresy URL, więc działa obok pełnej mapy witryny XML, a nie zamiast niej. Tak jak mapa witryny pomaga znaleźć stronę — nie sprawia, że strona uzyskuje wyższe pozycje.
Czym jest kanał RSS
Kanał RSS (Really Simple Syndication) lub kanał Atom to plik XML publikowany przez witrynę, który zawiera najnowsze treści — zwykle kilkadziesiąt ostatnich wpisów. Większość platform blogowych i CMS-ów generuje go automatycznie. Czytelnicy używają kanałów do śledzenia aktualizacji w czytniku, ale ten sam plik spełnia też drugą funkcję: wyszukiwarki mogą odczytać go, aby odkrywać najnowsze adresy URL.
Jak używają go wyszukiwarki
Kanał działa podobnie do mapy witryny. Mogą wydarzyć się dwie rzeczy:
- Przesyłasz go. W Google Search Console lub Bing Webmaster Tools możesz dodać URL kanału jako mapę witryny. Wyszukiwarka będzie wtedy sprawdzać nowe strony.
- Roboty znajdują go samodzielnie. Jeśli w
<head>strony umieścisz tag automatycznego wykrywania — wiersz<link rel="alternate" type="application/rss+xml">— robot może zauważyć kanał bez jego wcześniejszego przesłania.
W obu przypadkach wyszukiwarka okresowo pobiera kanał i zauważa ostatnio dodane lub zmienione adresy URL.
Jedna rzecz do zapamiętania
Kanał nie zastępuje mapy witryny XML. Kanał wymienia tylko najnowsze treści — nie obejmuje starszych stron ani archiwów. Własna rada Google brzmi, by używać obu: mapy witryny do pełnego pokrycia całej witryny, a kanału jako sygnału świeżości tego, co właśnie się zmieniło.
Tak jak mapa witryny, kanał pomaga tylko w odkrywaniu — znalezieniu i pobraniu strony. Nie gwarantuje indeksacji i nie podnosi pozycji.
Chcesz poznać szczegóły — Feedfetchera (oddzielnego robota Google), powód ignorowania przez niego robots.txt, WebSub oraz to, jak wskazówki Bing przesunęły się w stronę IndexNow? Przejdź do karty Advanced.
Evidence for this claim RSS 2.0 defines a channel of items with metadata such as title, link, description, publication date, and GUID. Scope: RSS 2.0 feed format; consumer behavior varies. Confidence: high · Verified: RSS 2.0 Specification Evidence for this claim Google accepts RSS 2.0 and Atom 1.0 feeds as sitemap submissions, generally covering recent URLs; submission aids discovery but does not guarantee indexing. Scope: Current Google sitemap format support. Confidence: high · Verified: Google Search Central: Build and submit a sitemapTL;DR — RSS 2,0 i Atom 1,0 są akceptowane przez Google jako format mapy witryny, a inne wyszukiwarki mogą obsługiwać przesyłanie kanałów zgodnie z aktualnymi wskazówkami dla webmasterów. Kanał pokazuje tylko ostatnio zmienione adresy URL, więc uzupełnia pełną mapę witryny XML — nigdy jej nie zastępuje. Kanały działają w modelu pull; WebSub może dodawać powiadomienia w modelu publikuj–subskrybuj, a IndexNow to osobny protokół powiadamiania o adresach URL używany przez obsługujące go wyszukiwarki. Kanały przyspieszają odkrywanie, nie pozycjonowanie, i podobnie jak mapy witryny nigdy nie gwarantują indeksacji.
Kanał jako sygnał odkrywania w formacie mapy witryny
Jeśli CMS już publikuje kanał RSS lub Atom, wyszukiwarki mogą używać go tak jak mapy witryny — jako listy adresów URL do odkrycia. Google mówi wprost: “Google accepts RSS 2.0 and Atom 1.0 feeds,” (tłumaczenie) „Google akceptuje kanały RSS 2,0 i Atom 1,0” oraz “if your CMS generates an RSS or Atom feed, you can submit the feed’s URL as a sitemap.” (tłumaczenie) „jeśli CMS generuje kanał RSS lub Atom, możesz przesłać adres URL kanału jako mapę witryny”. Pole przesyłania w Google Search Console przyjmuje adres kanału tak samo jak sitemap.xml.
Problemem jest zakres. Pełna mapa witryny XML ma katalogować każdy adres URL w witrynie; kanał jest kroczącym oknem najnowszych elementów. Google mówi jasno: “This feed only provides information on recent URLs.” (tłumaczenie) „Ten kanał zawiera informacje tylko o najnowszych adresach URL”. Kanał jest więc sygnałem świeżości, a nie pełnym indeksem stron. Dokładnie tak opisuję go w sekcji Discovery — Google akceptuje kanały jako format mapy witryny, ale kanał pokazuje tylko niedawno zmienione adresy URL.
Dwie różne rzeczy są prawdziwe i warto je rozdzielić: kanał jest aktualny dzięki temu, które URL są obecnie na nim wymienione — ta część jest strukturalna i niezawodna. To, co robi wartość pubDate/updated każdego elementu po pobraniu kanału przez dostawcę, to osobne pytanie; Google i Bing nie publikują szczegółowej specyfikacji sposobu ważenia tych dat, więc traktuj je jako użyteczny kontekst, który przekazujesz, a nie udokumentowaną gwarancję przetwarzania.
Kanały uzupełniają mapę witryny — nie zastępują jej
To mit, który warto obalić od razu: “an RSS feed replaces my XML sitemap.” (tłumaczenie) „kanał RSS zastępuje moją mapę witryny XML”. Tak nie jest. Udokumentowana rekomendacja Google to używanie obu — mapy witryny do pełnego pokrycia całej witryny (starsze strony, archiwa, wszystko), a kanału RSS/Atom jako warstwy świeżości tego, co właśnie się zmieniło. Jeśli usuniesz mapę i zostawisz tylko kanał, archiwum starszych adresów URL straci najbardziej niezawodną ścieżkę odkrywania.
Warto też wiedzieć, co mogą zawierać kanały: kanał mRSS (Media RSS) może przekazywać Google szczegóły dotyczące treści wideo, ale kanały RSS/Atom mogą opisywać tylko wideo — nie obrazy ani wiadomości. Do odkrywania obrazów nadal potrzebujesz mapy witryny obrazów, a w przypadku Google News przesyłasz treści przez kanały właściwe dla wiadomości. Kanał pomaga odkrywać, ale nie jest uniwersalnym przewodem metadanych.
Feedfetcher: robot Google dla News i WebSub — oraz pułapka robots.txt
To część pomijana w większości tekstów, dlatego trzeba precyzyjnie określić zakres: dokumentacja Google opisuje Feedfetchera wąsko jako “how Google crawls RSS or Atom feeds for Google News and WebSub.” (tłumaczenie) „jak Google pobiera kanały RSS lub Atom na potrzeby Google News i WebSub”. To jest udokumentowane zastosowanie — Google nie mówi na tej stronie, że Feedfetcher obsługuje każdy kanał przesłany jako mapa witryny w Search Console, więc nie uogólniam tego na ścieżkę przesyłania mapy witryny. Dokumentacja Feedfetchera potwierdza w kontekście News/WebSub dwie rzeczy:
- Z założenia ignoruje robots.txt. Google mówi to wprost: Feedfetcher nie przestrzega reguł robots.txt, ponieważ działa w imieniu człowieka, który jawnie zasubskrybował kanał — “a direct agent of the human user, not as a robot.” (tłumaczenie) „bezpośredni przedstawiciel użytkownika, a nie robot”. Jeśli więc planujesz „zablokować kanał przed robotami” przez
Disalloww robots.txt, Feedfetcher to zignoruje. Aby faktycznie zablokować Feedfetcher, zwracaj 4xx (404 lub 410) dla adresu URL kanału — nie disallow. To ten sam rodzaj błędu co próba deindeksacji strony przez robots.txt: używasz niewłaściwego mechanizmu. - Pobiera tylko adres URL kanału, a nie zawarte w nim linki. Google wyjaśnia: “unlike normal web crawlers, Feedfetcher isn’t discovering links to crawl at all; instead, it crawls a single URL that’s provided to it.” (tłumaczenie) „w przeciwieństwie do zwykłych robotów internetowych Feedfetcher w ogóle nie odkrywa linków do pobrania; zamiast tego pobiera pojedynczy przekazany mu adres URL”. Google mówi też, że Feedfetcher “shouldn’t retrieve feeds from most sites more than once every hour on average,” (tłumaczenie) „nie powinien pobierać kanałów z większości witryn średnio częściej niż raz na godzinę”, choć często aktualizowane witryny mogą być odświeżane częściej. Google nie dokumentuje, co dzieje się później z adresami URL wewnątrz kanału przesłanego jako ogólna mapa witryny Search — ta ścieżka nie jest opisana, więc traktuj ją jako nieudokumentowaną, zamiast zakładać, że przechodzi przez Feedfetcher.
Jak Bing używa kanałów — i dlaczego zmienił obraz IndexNow
Bing akceptuje szeroki zestaw formatów map witryny: XML, RSS 2,0, mRSS, Atom 0,3 i Atom 1,0 oraz zwykły tekst. Kanały RSS/Atom dobrze pasują do blogów publikujących często, a historycznie Bing monitorował te kanały, aby wychwytywać nowe treści.
Nowsze wskazówki Bing poszły jednak dalej. Wskazówki dotyczące map witryny z 2025 roku podkreślają XML z dokładnym lastmod oraz IndexNow jako preferowany zestaw i wyraźnie przestały eksponować RSS/Atom. Bing uzasadnia to własnymi słowami: “Instead of Bing continually monitoring RSS and similar feeds or frequently crawling websites to check for new pages… websites will notify Bing directly about relevant URLs changing on their website.” (tłumaczenie) „zamiast ciągłego monitorowania RSS i podobnych kanałów przez Bing lub częstego pobierania witryn w celu sprawdzania nowych stron… witryny będą bezpośrednio powiadamiać Bing o zmianach odpowiednich adresów URL”. Innymi słowy, IndexNow ma zastąpić stary schemat „Bing monitoruje kanał RSS” jawnym powiadomieniem push. RSS nadal działa w Bing, a przesłanie go wymaga niewiele pracy — jeśli jednak inwestujesz w szybkość wykrywania zmian przez Bing, IndexNow jest dziś główną rekomendacją.
Pull a push: gdzie pasuje WebSub
Kanały działają z natury w modelu pull — wyszukiwarka pobiera je ponownie według własnego harmonogramu. Aby dodać mechanizm push, użyj WebSub (dawniej PubSubHubbub). Google go obsługuje: “If you use Atom or RSS, you can use WebSub to broadcast your changes to search engines, including Google.” (tłumaczenie) „Jeśli używasz Atom lub RSS, możesz użyć WebSub do rozgłaszania zmian wyszukiwarkom, w tym Google”. Zamiast czekać na ponowne pobranie, kanał rozgłasza zmianę subskrybującym wyszukiwarkom, dzięki czemu aktualizacja dociera bliżej czasu rzeczywistego. Najprostszy model obu wyszukiwarek wygląda tak:
- Google: kanał RSS/Atom do odkrywania pull, WebSub do wysyłania zmian kanału.
- Bing: RSS/Atom jest akceptowany, ale IndexNow to preferowany push w czasie rzeczywistym.
WebSub jest pushowym uzupełnieniem RSS — tak jak lastmod i IndexNow są pushowymi uzupełnieniami po stronie mapy witryny. (Więcej o całym krajobrazie pull/push znajdziesz w hubie Discovery.)
Konfiguracja kanału do odkrywania
Krótka, praktyczna lista kontrolna:
- Publikuj poprawny kanał RSS 2,0 lub Atom 1,0 (większość CMS-ów robi to automatycznie). Używaj w nim bezwzględnych adresów URL i ogranicz liczbę elementów do bieżącego okna.
- Dodaj tag automatycznego wykrywania w
<head>strony, aby roboty mogły znaleźć kanał:<link rel="alternate" type="application/rss+xml" title="Feed" href="/feed.xml">. - Prześlij URL kanału jako mapę witryny w Google Search Console i Bing Webmaster Tools. Sam autodiscovery może zadziałać, ale jawne przesłanie jest bardziej niezawodne.
- Dla świeżości Google dodaj WebSub; dla świeżości Bing wdroż IndexNow.
- Nie blokuj kanału w robots.txt, zakładając, że Feedfetcher będzie go przestrzegać — jeśli naprawdę musisz go zablokować, użyj 4xx.
Ograniczenia — takie same jak w przypadku map witryny
Trzy uczciwe ograniczenia, o których trzeba pamiętać:
- Tylko najnowsze adresy URL. Kanał jest sygnałem świeżości, a nie pełnym pokryciem. Pozostaw mapę witryny XML dla reszty.
- Brak gwarancji indeksacji. Odkrycie to nie indeksacja. Kanał sprawia, że adres URL zostaje wcześniej znaleziony i pobrany; decyzja o indeksacji jest osobna.
- Brak sygnału rankingowego. Kanały przyspieszają odkrywanie i mogą pomóc świeżej treści zostać pobraną przed zdobyciem backlinków, ale nie dają poza tym korzyści rankingowej — dokładnie tak samo jak mapa witryny.
Podsumowanie AI
Skrócona wersja karty Advanced:
- Kanały są sygnałem odkrywania w formacie mapy witryny. Google akceptuje RSS 2,0 i Atom 1,0; Bing akceptuje RSS 2,0 oraz Atom 0,3/1.0 (i mRSS). Prześlij URL kanału jako mapę witryny albo udostępnij go przez tag autodiscovery
<link rel="alternate">. - Kanał obejmuje tylko najnowsze adresy URL. Uzupełnia pełną mapę witryny XML — nigdy jej nie zastępuje. Google zaleca używanie obu.
- Feedfetcher to robot Google dla kanałów RSS/Atom, udokumentowany konkretnie dla Google News i WebSub — Google nie stwierdza, że obsługuje każdy kanał przesłany jako mapa witryny Search. Z założenia ignoruje robots.txt — aby go zablokować, zwróć 4xx, nie disallow. Pobiera tylko adres URL kanału (nie podąża za linkami w kanale).
- Tożsamość elementu kanału nie jest kontrolą Search.
guid/idzapewnia stałą tożsamość elementu wewnątrz kanału; nie jest dyrektywą kanoniczną. X-Robots-Tag: noindex w odpowiedzi kanału wymaga, aby robot miał już do niego dostęp, i nie jest kontrolą dostępu. - Pull a push: kanały są pull. WebSub zmienia je w push dla Google (rozgłasza zmiany kanału). W Bing IndexNow jest teraz preferowanym pushem w czasie rzeczywistym i zastąpił dawny schemat „Bing monitoruje RSS”.
- mRSS może przenosić szczegóły wideo; kanały nie opisują obrazów ani wiadomości.
- Ograniczenia: tylko najnowsze adresy URL, brak gwarancji indeksacji i brak korzyści rankingowej — kanały tylko przyspieszają odkrywanie.
Oficjalna dokumentacja
Dokumentacja źródłowa wyszukiwarek.
- Tworzenie i przesyłanie mapy witryny — akceptacja RSS 2,0 / Atom 1,0, przesyłanie kanału jako mapy witryny, ograniczenie „tylko najnowsze adresy URL”, mRSS dla wideo i WebSub.
- Feedfetcher — działanie dedykowanego robota Google do pobierania kanałów i powód ignorowania robots.txt (blokowanie przez 4xx).
- Najlepsze praktyki map XML i kanałów RSS/Atom (2014) — rekomendacja Google „używaj obu”: mapa dla pokrycia, kanał dla świeżości.
- Używanie kanałów RSS/Atom do odkrywania nowych URL (2009) — pierwotne ogłoszenie kanałów jako metody odkrywania.
Bing / Microsoft
- Utrzymywanie wykrywalności treści za pomocą map witryn w wyszukiwaniu opartym na AI (lipiec 2025) — aktualne wskazówki Bing podkreślające XML +
lastmod+ IndexNow. - Przesyłanie do Bing nawet 10 000 adresów URL dziennie (2019) — wypowiedź Fabrice’a Canela o zastąpieniu monitorowania RSS bezpośrednimi powiadomieniami.
Cytaty ze źródeł
Wypowiedzi Google i Bing zapisane w źródłach. Każdy link prowadzi bezpośrednio do fragmentu cytowanej strony.
Google — kanały jako format odkrywania
- “Google accepts RSS 2.0 and Atom 1.0 feeds.” (tłumaczenie) „Google akceptuje kanały RSS 2,0 i Atom 1,0”. — dokumentacja Google Search Central. Przejdź do cytatu
- “If you use Atom or RSS, you can use WebSub to broadcast your changes to search engines, including Google.” (tłumaczenie) „Jeśli używasz Atom lub RSS, możesz użyć WebSub do rozgłaszania zmian wyszukiwarkom, w tym Google”. Przejdź do cytatu
Bing / Microsoft
- “Instead of Bing continually monitoring RSS and similar feeds or frequently crawling websites to check for new pages, discover content changes and/or new outbound links, websites will notify Bing directly about relevant URLs changing on their website.” (tłumaczenie) „Zamiast ciągłego monitorowania RSS i podobnych kanałów przez Bing lub częstego pobierania witryn w celu sprawdzania nowych stron, odkrywania zmian treści i nowych linków wychodzących, witryny będą bezpośrednio powiadamiać Bing o zmianach odpowiednich adresów URL”. — Microsoft Bing, o IndexNow i przesyłaniu URL. Przejdź do cytatu
Lista kontrolna audytu kanału
Przejdź przez te punkty, zanim uznasz kanał za „gotowy”. To ten sam zakres co kroki konfiguracji w karcie Advanced, przekształcony w listę pass/fail:
- Kanał jest poprawnym, dobrze sformułowanym RSS 2,0 lub Atom 1,0 — bez uszkodzonego XML, nieescapowanych ampersandów i niezamkniętych tagów.
- Każdy element ma prawdziwy, odrębny
<link>wskazujący bezwzględny URL (nie ścieżkę względną i nie placeholder). - Każdy element ma
pubDate(RSS) alboupdated/published(Atom) — kanał bez dat nie daje robotom podstaw do oceny, co jest „najnowsze”. - Liczba elementów odpowiada rzeczywistemu bieżącemu oknu publikacji (mniej więcej ostatnie kilkadziesiąt wpisów) — nie jest skrócona do 3–5 ani rozdmuchana do całego archiwum.
- Pełna treść kontra podsumowanie to świadomy wybór, a nie domyślne ustawienie — uwzględnij wygodę czytelników w czytnikach, licencjonowanie, ryzyko ponownej publikacji i skrobania oraz to, jak bardzo chcesz chronić przejścia na własną witrynę. Nie jest to udokumentowany czynnik rankingowy Google Search; niezależnie od wyboru zachowaj poprawną strukturę elementu oraz stałą tożsamość wpisu (guid/id).
- W
<head>jest tag autodiscovery:<link rel="alternate" type="application/rss+xml" title="Feed" href="/feed.xml">. - Odpowiedź HTTP kanału ma właściwy
Content-Type(application/rss+xmllubapplication/atom+xml), a nietext/html. - URL kanału przesłano jako mapę witryny zarówno w Google Search Console, jak i Bing Webmaster Tools.
- URL kanału nie jest zablokowany w
robots.txt, jeśli chcesz, aby Feedfetcher i czytniki kanałów mogły do niego dotrzeć (disallow i tak nie zatrzyma Feedfetchera — zobacz kartę anti-patterns). - Pełna mapa witryny XML nadal istnieje i jest przesłana osobno — kanał to warstwa świeżości, nie cała mapa.
- WebSub jest skonfigurowany, jeśli chcesz wysyłać push dla Google; IndexNow jest skonfigurowany, jeśli chcesz wysyłać push dla Bing.
Modele myślowe
1. Kanał = warstwa świeżości, mapa witryny = pełna mapa. Nie pytaj „kanał czy mapa witryny” — to nie jest wybór. Mapa odpowiada na pytanie „co istnieje w tej witrynie”, a kanał na pytanie „co zmieniło się niedawno”. Używaj obu; kanał nigdy nie zastępuje pokrycia mapy witryny.
2. Pull kontra push i to, czego chce każda wyszukiwarka. Sam kanał jest pull — wyszukiwarka pobiera go ponownie według własnego harmonogramu. WebSub zmienia go w push dla Google. IndexNow jest preferowanym kanałem push Bing i zastąpił „monitorowanie kanału RSS”. Jeśli celem jest szybsze odkrywanie dla konkretnej wyszukiwarki, dopasuj kanał do wyszukiwarki: WebSub dla Google, IndexNow dla Bing.
3. Feedfetcher to nie Googlebot.
Dedykowany robot Google pobierający kanały ma własne reguły — przede wszystkim ignoruje robots.txt. Każdą decyzję dotyczącą kontroli adresu URL kanału podejmuj z uwzględnieniem zachowania tego robota, a nie Googlebota.
4. Reguła decyzji „czy kanał pomaga tej witrynie?”. Kanał jest wart utrzymania, gdy: (a) publikujesz nowe lub zaktualizowane treści wystarczająco często, by „najnowsze” było znaczącym, ruchomym oknem, oraz (b) chcesz udostępnić sygnał świeżości nie tylko wyszukiwarkom (czytnikom kanałów, subskrybentom WebSub i agregatorom zewnętrznym). Witryna, która rzadko się zmienia, niewiele zyskuje z kanału ponad to, co już zapewnia mapa witryny.
5. Odkrywanie, nie indeksacja i nie pozycjonowanie. Każda decyzja tutaj mieści się w tej samej granicy co mapa witryny: kanał może tylko przyspieszyć znalezienie i pobranie adresu URL. Nie wpływa na decyzje indeksacyjne ani pozycje.
Formaty kanałów — co jest akceptowane i wymagane
Akceptowane jako sygnał odkrywania w formacie mapy witryny
| Format | Akceptowany przez Google | Akceptowany przez Bing | Uwagi |
|---|---|---|---|
| RSS 2,0 | Tak | Tak | Najczęstszy domyślny format CMS |
| Atom 1,0 | Tak | Tak | |
| Atom 0,3 | Nie | Tak | Dokumentacja Bing go wymienia; traktuj jako starszy format |
| mRSS (Media RSS) | Tylko wideo | Tak (jako format mapy witryny) | Google: tylko metadane wideo, nie ogólna mapa witryny |
| JSON Feed | Nie wymieniony | Nie wymieniony | Format czytników kanałów; żadna wyszukiwarka nie dokumentuje go jako wejścia mapy witryny |
Minimalne użyteczne elementy każdego wpisu
| Element | RSS 2,0 | Atom 1,0 | Dlaczego ma znaczenie dla odkrywania |
|---|---|---|---|
| Link elementu | <link> | <link href> | Rzeczywisty adres URL do pobrania — musi być bezwzględny |
| Data | <pubDate> | <updated> / <published> | Pozwala wyszukiwarce ocenić, co jest „najnowsze” |
| Tytuł | <title> | <title> | Kontekst dla ludzi/czytnika, nie dane rankingowe |
| Unikalny identyfikator | <guid> (zalecany) | <id> (wymagany) | Zapobiega ponownemu przetworzeniu tego samego elementu jako nowego |
Pull kontra push według wyszukiwarki
| Wyszukiwarka | Pull (sam kanał) | Odpowiednik push |
|---|---|---|
| RSS/Atom, okresowo pobierany ponownie | WebSub | |
| Bing | RSS/Atom, okresowo pobierany ponownie | IndexNow (preferowany względem monitorowania kanału) |
Blokowanie Feedfetchera — zrób tak, nie inaczej
| Cel | Niewłaściwe narzędzie | Właściwe narzędzie |
|---|---|---|
| Zatrzymanie Feedfetchera przed odczytaniem URL kanału | robots.txt Disallow (ignorowane) | Zwróć 4xx (404/410) dla URL kanału |
Tożsamość kanału a kontrole Search — to różne mechanizmy
Elementy guid/id kanału i jego link należą do specyfikacji kanału, a nie do dyrektyw Search. Nie używaj ich do kanonikalizacji ani kontroli dostępu, do których nigdy nie zostały zbudowane:
| Kontrola | Co faktycznie robi | Czego NIE robi |
|---|---|---|
RSS guid / Atom id | Nadaje elementowi stałą tożsamość w obrębie kanału, aby odbiorca wiedział „ten sam element, nie pokazuj ponownie” | Nie mówi Google ani Bing, który URL strony jest kanoniczny |
link elementu (RSS) / link href (Atom) | Kieruje czytnik kanału lub robota do docelowego adresu URL | Sam w sobie nie jest sygnałem kanonikalizacji |
Relacja kanoniczna (rel="canonical" lub nagłówek HTTP Link) | Osobny mechanizm wdrażany w odpowiedzi samego artykułu w celu konsolidacji zduplikowanych URL | Nie jest automatycznie wywnioskowana z guid/id/link kanału |
X-Robots-Tag: noindex w odpowiedzi kanału | Może zastosować dyrektywę Search do odpowiedzi innej niż HTML, np. pliku kanału — ale dopiero gdy robot może już uzyskać do niej dostęp | Nie jest narzędziem kontroli dostępu i nie zatrzyma pobierania ani syndykacji kanału |
| Uwierzytelnianie HTTP / prywatny URL | Faktycznie ogranicza to, kto może pobrać kanał | Nie jest osiągane przez żaden z powyższych wierszy |
Błędy, których należy unikać
Próba zablokowania Feedfetchera przez robots.txt.
Feedfetcher jest udokumentowany jako robot, który z założenia ignoruje robots.txt — działa w imieniu zasubskrybowanego człowieka, a nie autonomicznie. Reguła Disallow dla adresu URL kanału niczego mu nie zrobi. Zamiast tego: jeśli naprawdę musisz zatrzymać Feedfetchera przed odczytaniem kanału, zwróć dla tego adresu URL 4xx (404 lub 410).
Traktowanie kanału jako zamiennika mapy witryny XML. Kanał wymienia tylko najnowsze elementy — usunięcie mapy, bo „kanał ją pokrywa”, odbiera ścieżkę odkrywania każdej starszej stronie i archiwum. Zamiast tego: zachowaj oba; własne wskazówki Google mówią o mapie dla pełnego pokrycia i kanale jako warstwie świeżości.
Publikowanie kanału bez elementu pubDate/updated.
Bez daty przy każdym elemencie robot (lub czytnik kanałów) nie ma podstaw do oceny, co jest rzeczywiście najnowsze. Zamiast tego: dopilnuj, aby każdy element miał rzeczywistą, poprawną datę — nie znacznik czasu kompilacji identyczny dla wszystkich wpisów.
Brak tagu autodiscovery w <head>.
Bez <link rel="alternate" type="application/rss+xml" href="..."> roboty i czytniki znajdą kanał tylko wtedy, gdy jawnie go prześlesz lub gdzieś umieścisz link. Zamiast tego: dodaj tag automatycznego wykrywania, aby kanał sam ogłaszał swoją obecność na każdej stronie.
Pozwalanie, by liczba elementów kanału rosła bez kontroli albo spadała zbyt nisko. Kanał z całym archiwum przestaje być sygnałem „najnowszych” treści; kanał ograniczony do 2–3 elementów może pominąć serię publikacji z tego samego dnia. Zamiast tego: dobierz liczbę elementów do rzeczywistego rytmu publikacji — tak, by pokryć przerwę między crawlami, ale nie stworzyć drugiej mapy witryny.
Zakładanie, że przesłanie RSS oznacza dziś szybsze odkrywanie w Bing. Kiedyś było to rozsądne założenie; własne wskazówki Bing przesunęły się od tego czasu w stronę IndexNow jako preferowanego sygnału w czasie rzeczywistym, jawnie opisywanego jako zastępstwo dla „ciągłego monitorowania RSS”. Zamiast tego: zachowaj przesłanie RSS (to niewiele kosztuje i nadal działa), ale traktuj IndexNow jako główną dźwignię świeżości Bing, nie kanał.
Udowodnij, że kanał faktycznie działa
Kontrole pass/fail po opublikowaniu lub zmianie kanału — każda zawiera sygnał błędu i moment, w którym należy rozważyć wycofanie zmiany.
Test: kanał jest poprawnym XML
- Test: Załaduj URL kanału w W3C Feed Validator.
- Oczekiwany wynik: “This is a valid RSS/Atom feed” (tłumaczenie) „To jest poprawny kanał RSS/Atom” bez błędów (ostrzeżenia dotyczące opcjonalnych elementów są dopuszczalne).
- Interpretacja błędu: Błąd walidacji zwykle oznacza niepoprawny XML, nieescapowany znak albo brak wymaganego elementu — kanał może nadal renderować się w przeglądarce, ale nie przejść bardziej rygorystycznych parserów.
- Okno monitorowania: Natychmiast — sprawdź ponownie po każdej zmianie szablonu kanału.
- Wycofanie: Każdy błąd walidatora (nie ostrzeżenie) oznacza powrót do poprzedniego szablonu, dopóki kanał nie przejdzie czysto.
Test: poprawny nagłówek Content-Type
- Test: Wykonaj
curl -I https://example.com/feed.xmli odczytaj nagłówekContent-Type. - Oczekiwany wynik:
application/rss+xml(RSS) lubapplication/atom+xml(Atom) — nietext/htmlanitext/plain. - Interpretacja błędu:
text/htmlzwykle oznacza, że trasa kanału jest obsługiwana przez niewłaściwy handler (catch-all CMS-u albo warstwę cache przepisującą nagłówki). - Okno monitorowania: Natychmiast.
- Wycofanie: Nieprawidłowy Content-Type na żywym URL kanału — popraw konfigurację serwera, zanim zaczniesz polegać na kanale do odkrywania.
Test: przesłanie mapy witryny zostało zaakceptowane
- Test: Prześlij URL kanału w sekcji Sitemaps Google Search Console i w sekcji Sitemaps Bing Webmaster Tools.
- Oczekiwany wynik: Status “Success” (tłumaczenie) „Powodzenie” w Google albo stan przetworzony lub poprawny w Bing. Żadna wyszukiwarka nie dokumentuje gwarantowanej liczby odkrytych adresów URL ani zobowiązującego terminu przetwarzania — niezerowa liczba odkrytych adresów jest dobrym sygnałem, ale traktuj ją jako obserwację, a nie samodzielny wymóg zaliczenia testu.
- Interpretacja błędu: Status “Couldn’t fetch” (tłumaczenie) „Nie udało się pobrać” lub “General HTTP error” (tłumaczenie) „Ogólny błąd HTTP” zwykle oznacza zablokowany adres URL kanału, odpowiedź inną niż 200 albo przekroczenie limitu czasu.
- Okno monitorowania: Ponowne sprawdzenie po dniu lub dwóch to praktyczna reguła, nie udokumentowane SLA — sprawdź ponownie po zmianie serwera lub CDN wpływającej na trasę kanału.
- Wycofanie: Jeśli po ponownym sprawdzeniu przesłanie nadal jest w stanie błędu, zbadaj odpowiedź serwera, zanim założysz, że wyszukiwarka „sama to rozgryzie”.
Test: tag autodiscovery jest obecny i poprawny
- Test: Wyświetl źródło strony, która powinna udostępniać kanał, i potwierdź obecność tagu
<link rel="alternate" type="application/rss+xml">(lubatom+xml) z właściwymhref. - Oczekiwany wynik: Tag istnieje w
<head>, ahrefrozwiązuje się do tego samego URL kanału, który zweryfikowałeś powyżej. - Interpretacja błędu: Brak tagu oznacza, że roboty korzystające z automatycznego wykrywania i czytniki nie znajdą kanału bez jawnego przesłania; błędny
hrefwskazuje na nieaktualny lub martwy kanał. - Okno monitorowania: Natychmiast — sprawdź po każdej zmianie szablonu.
- Wycofanie: Brak tagu albo wskazywanie niewłaściwego URL na żywej stronie.
Test: Feedfetcher nie może być zablokowany przez robots.txt (sprawdź, że pułapka Cię nie dotyczy)
- Test: Sprawdź w
robots.txtregułęDisallowobejmującą ścieżkę kanału, a następnie potwierdź, że bezpośrednio pobrany adres URL kanału nadal zwraca200. - Oczekiwany wynik: Jeśli chcesz, aby kanał był pobierany, zwraca
200— samo disallow w robots.txt nie zatrzymałoby Feedfetchera, ale warto potwierdzić, że adres URL nie zwraca też innej odpowiedzi z niezależnego powodu. Jeśli zamierzasz zablokować Feedfetchera, adres URL powinien zwracać4xx, a nie polegać na disallow. - Interpretacja błędu: 200, gdy zamierzałeś zablokować Feedfetchera, oznacza, że blokada faktycznie nie działa — wiersz robots.txt jest ignorowany zgodnie z dokumentacją.
- Okno monitorowania: Natychmiast.
- Wycofanie: Status URL kanału nie odpowiada intencji (zablokowany, gdy powinien być otwarty, albo odwrotnie).
Sprawdź się: kanały RSS
Pięć krótkich pytań o to, jak wyszukiwarki używają kanałów RSS i Atom do odkrywania. Wybierz odpowiedź na każde, a potem sprawdź wynik.
Dziennik zmian
Zaktualizowano 11 sie 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 11 sie 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.
Zaktualizowano 18 lip 2026.
Podsumowanie redakcyjne i zapisane szczegóły zmian.Szczegóły zmian
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
-
Szczegółowe uwagi dotyczące zmian są obecnie dostępne po angielsku.
Pełne porównanie jest niedostępne — dla tej wersji nie zarchiwizowano wcześniejszej migawki.