Jak działa wyszukiwarka
Jak działa wyszukiwarka — Polski
SEO i dostępność
Gdzie dostępność stron internetowych i SEO naprawdę się pokrywają (tekst alternatywny, nagłówki, tekst linków, szybkość), a gdzie się rozchodzą — oraz dlaczego Google mówi, że dostępność nie jest czynnikiem rankingowym.
Polski › TreściStrona alternatywna z prawidłowym tagiem kanonicznym
„Strona alternatywna z prawidłowym tagiem kanonicznym” w raporcie indeksowania Google Search Console nie jest błędem — to system kanonikalizacji działający zgodnie z przeznaczeniem. Wyjaśniamy znaczenie statusu, dlaczego duże liczby zwykle są normalne, czym różni się on od dwóch statusów duplikatów oraz jakie nieliczne przypadki warto zbadać.
Polski › TreściMapy witryn
Czym jest mapa witryny, czy jej potrzebujesz, jakie są jej typy oraz jak ją znaleźć, utworzyć i przesłać — a także dlaczego pomaga w odkrywaniu, ale nigdy nie gwarantuje indeksowania.
Polski › TreściCrawlowanie
Jak wyszukiwarki odkrywają i pobierają sieć — Googlebot i Bingbot, odkrywanie URL-i, harmonogram crawlowania, renderowanie oraz różnice między crawlowaniem, indeksowaniem i rankingiem. Hub poświęcony całemu tematowi crawlowania.
Polski › TreściBudżet indeksowania
Czym właściwie jest budżet indeksowania — pojemność indeksowania plus zapotrzebowanie na indeksowanie — co go marnuje, oraz uczciwy test, czy Twoja witryna jest wystarczająco duża, aby w ogóle trzeba było się tym przejmować.
Polski › TreściRobots.txt
Co naprawdę robi robots.txt — kontroluje pobieranie, a nie indeksowanie — oraz dokładna składnia, sposób obsługi przez Google i błędy, które mogą zaszkodzić witrynie.
Polski › TreściKanoniczność
Jak wyszukiwarki wybierają jeden kanoniczny URL spośród duplikatów i konsolidują na nim sygnały rankingowe — dlaczego rel=canonical jest wskazówką, a nie regułą, i jak dopasować wszystkie sygnały.
Polski › TreściZduplikowana treść
Nie ma kary za zduplikowaną treść. Co naprawdę kosztuje Cię zduplikowana treść, jak Google grupuje duplikaty i wybiera kanoniczny adres URL oraz jak to naprawić.
Polski › TreściKanały RSS
Jak wyszukiwarki używają kanałów RSS 2,0 i Atom 1,0 jako kanału odkrywania świeżej treści — Feedfetcher, robots.txt, WebSub oraz powód, dla którego kanał uzupełnia, ale nigdy nie zastępuje mapy witryny XML.
Polski › TreściMapa witryny XML
Czym jest mapa witryny XML, jej budowa, ignorowane tagi (priority/changefreq), dokładny lastmod, limity 50 000/50 MB, hreflang w mapach witryny oraz jak ją przesłać.
Polski › TreściCrawlery AI
Trzy rodzaje crawlerów AI — boty treningowe, indeksujące wyszukiwanie AI i pobieracze uruchamiane przez użytkownika — najważniejsze nazwane boty oraz sposoby kontrolowania każdego z nich bez szkody dla SEO.
Polski › TreściZablokowano z powodu nieautoryzowanego żądania (401)
Co oznacza status indeksowania stron Google Search Console „Blocked due to unauthorized request (401)”, czym różni się od 403 według RFC 9110, jakie są typowe przyczyny, jak diagnozować problem jako bot i jak dobrać naprawę do rodzaju strony — publicznej, prywatnej, błędnie zablokowanej przez WAF lub za paywallem.
Polski › TreściBaiduspider — robot indeksujący Baidu
Czym jest Baiduspider — warianty i user-agenty crawlera Baidu, zgodność z robots.txt (oraz wyjątek cpro/ads), weryfikacja odwrotnego DNS, słabe renderowanie JavaScript i kontrola indeksowania w Ziyuan.
Polski › TreściCrawler Bingbot
Czym jest Bingbot, jak działa jego indeksowanie oparte na Chromium, dlaczego jego zasięg wykracza poza Bing oraz jak zweryfikować prawdziwego crawlera przez dwuetapowy odwrotny DNS zamiast ufać user-agentowi.
Polski › TreściAgent użytkownika
Czym jest user agent — nagłówek HTTP, za pomocą którego roboty indeksujące i przeglądarki identyfikują siebie, token w robots.txt a pełny ciąg znaków oraz jak zweryfikować, czy bot jest prawdziwy.
Polski › TreściPageRank i SEO
PageRank to oryginalny algorytm analizy linków Google — czym jest, model przypadkowego internauty i wzór, aktualizacja Reasonable Surfer, jego historia od paska narzędziowego do wycieku API w 2024 roku, dlaczego nadal jest podstawowym systemem rankingowym i co oznacza dla Twoich linków oraz architektury wewnętrznej.
Polski › TreściPrzekierowania JavaScript
Czym jest przekierowanie JavaScript, jak potok renderowania Google traktuje je inaczej niż przekierowanie 301 po stronie serwera, kiedy jest akceptowalnym ostatecznym rozwiązaniem oraz jak je wdrożyć i wykryć — a także gdzie pasują meta refresh i History API.
Polski › TreściGooglebot i SEO
Czym właściwie jest Googlebot — Smartphone vs Desktop, evergreen Chromium, stringi user-agent, weryfikacja zakresów IP, limity bajtów oraz rozróżnienie crawl vs rank.
Polski › TreściIndeksowanie
Jak wyszukiwarki przechowują i porządkują strony, aby móc je pozycjonować — analiza treści, kanonikalizacja, dlaczego zaindeksowane nie oznacza zaindeksowane, oraz czytanie raportu indeksowania stron w GSC.
Polski › TreściIndeksowanie Mobile-First
Czym właściwie jest indeksowanie mobile-first — Google używa Twojego mobilnego HTML do indeksowania i rankingu — dlaczego parytet treści jest zasadą
Polski › TreściNie znaleziono (404)
Co oznacza "Nie znaleziono (404)" w raporcie Indeksowanie stron w Google Search Console — dlaczego Google znalazło adresy URL, których nigdy nie przesłałeś, dlaczego błędy 404 zwykle nie szkodzą SEO oraz mały zestaw błędów 404, które faktycznie warto naprawić.
Polski › TreściURL oznaczony jako 'noindex' (status GSC)
Co oznacza status "URL oznaczony jako 'noindex'" w Google Search Console — oraz wariant "Zgłoszony URL oznaczony jako 'noindex'" i starsza nazwa "Wykluczony przez tag 'noindex'". Kiedy jest to zamierzone, a kiedy błąd, gdzie znajduje się noindex (meta tag vs. nagłówek X-Robots-Tag), konflikt z robots.txt, fantomowy/CDN noindex, oraz jak to naprawić i zweryfikować.
Polski › TreściRozrost indeksu
Rozrost indeksu to termin SEO oznaczający zaindeksowane adresy URL o niskiej wartości, cienkie i zduplikowane. To problem efektywności indeksowania i jakości, a nie kara — oto jak go naprawić.
Polski › TreściAPI indeksowania Google
Co faktycznie robi Google Indexing API — oficjalnie wspierane tylko dla stron z danymi strukturalnymi JobPosting i BroadcastEvent (transmisje na żywo), a nie dla ogólnych treści. Mity, co naprawdę mówi Google i czego użyć zamiast tego, aby przyspieszyć indeksowanie.
Polski › TreściIndexNow dla SEO
IndexNow to otwarty protokół push, który natychmiast informuje Bing, Yandex, Naver, Seznam i Yep o zmianach adresów URL — jedna subskrypcja, udostępniana wszystkim. Jak działa, jak go skonfigurować i dlaczego nie ma wpływu na Google.
Polski › TreściProtokół WebSub
WebSub (dawniej PubSubHubbub) to protokół push, który w czasie rzeczywistym rozgłasza zmiany kanałów RSS/Atom do wyszukiwarek takich jak Google — czym jest, jak działa i jakie ma ograniczenia.
Polski › TreściRenderowanie
Jak usługa renderowania Google uruchamia Twój JavaScript, aby zbudować stronę, którą indeksuje — oraz opcje renderowania (CSR, SSR, SSG, hydratacja, ISR, edge, dynamiczne) i ich kompromisy SEO.
Polski › TreściRaport indeksowania stron (GSC)
Jak działa raport indeksowania stron w Google Search Console (dawniej Stan w indeksie) — strony zindeksowane i niezindeksowane, kolumna Źródło, wszystkie stany, Weryfikacja poprawki oraz opóźnienie raportu.