Jak działa wyszukiwarka

Jak działa wyszukiwarka — Polski

Polski › Treści

SEO i dostępność

Gdzie dostępność stron internetowych i SEO naprawdę się pokrywają (tekst alternatywny, nagłówki, tekst linków, szybkość), a gdzie się rozchodzą — oraz dlaczego Google mówi, że dostępność nie jest czynnikiem rankingowym.

Czytaj artykuł →
Polski › Treści

Strona alternatywna z prawidłowym tagiem kanonicznym

„Strona alternatywna z prawidłowym tagiem kanonicznym” w raporcie indeksowania Google Search Console nie jest błędem — to system kanonikalizacji działający zgodnie z przeznaczeniem. Wyjaśniamy znaczenie statusu, dlaczego duże liczby zwykle są normalne, czym różni się on od dwóch statusów duplikatów oraz jakie nieliczne przypadki warto zbadać.

Czytaj artykuł →
Polski › Treści

Mapy witryn

Czym jest mapa witryny, czy jej potrzebujesz, jakie są jej typy oraz jak ją znaleźć, utworzyć i przesłać — a także dlaczego pomaga w odkrywaniu, ale nigdy nie gwarantuje indeksowania.

Czytaj artykuł →
Polski › Treści

Crawlowanie

Jak wyszukiwarki odkrywają i pobierają sieć — Googlebot i Bingbot, odkrywanie URL-i, harmonogram crawlowania, renderowanie oraz różnice między crawlowaniem, indeksowaniem i rankingiem. Hub poświęcony całemu tematowi crawlowania.

Czytaj artykuł →
Polski › Treści

Budżet indeksowania

Czym właściwie jest budżet indeksowania — pojemność indeksowania plus zapotrzebowanie na indeksowanie — co go marnuje, oraz uczciwy test, czy Twoja witryna jest wystarczająco duża, aby w ogóle trzeba było się tym przejmować.

Czytaj artykuł →
Polski › Treści

Robots.txt

Co naprawdę robi robots.txt — kontroluje pobieranie, a nie indeksowanie — oraz dokładna składnia, sposób obsługi przez Google i błędy, które mogą zaszkodzić witrynie.

Czytaj artykuł →
Polski › Treści

Kanoniczność

Jak wyszukiwarki wybierają jeden kanoniczny URL spośród duplikatów i konsolidują na nim sygnały rankingowe — dlaczego rel=canonical jest wskazówką, a nie regułą, i jak dopasować wszystkie sygnały.

Czytaj artykuł →
Polski › Treści

Zduplikowana treść

Nie ma kary za zduplikowaną treść. Co naprawdę kosztuje Cię zduplikowana treść, jak Google grupuje duplikaty i wybiera kanoniczny adres URL oraz jak to naprawić.

Czytaj artykuł →
Polski › Treści

Kanały RSS

Jak wyszukiwarki używają kanałów RSS 2,0 i Atom 1,0 jako kanału odkrywania świeżej treści — Feedfetcher, robots.txt, WebSub oraz powód, dla którego kanał uzupełnia, ale nigdy nie zastępuje mapy witryny XML.

Czytaj artykuł →
Polski › Treści

Mapa witryny XML

Czym jest mapa witryny XML, jej budowa, ignorowane tagi (priority/changefreq), dokładny lastmod, limity 50 000/50 MB, hreflang w mapach witryny oraz jak ją przesłać.

Czytaj artykuł →
Polski › Treści

Crawlery AI

Trzy rodzaje crawlerów AI — boty treningowe, indeksujące wyszukiwanie AI i pobieracze uruchamiane przez użytkownika — najważniejsze nazwane boty oraz sposoby kontrolowania każdego z nich bez szkody dla SEO.

Czytaj artykuł →
Polski › Treści

Zablokowano z powodu nieautoryzowanego żądania (401)

Co oznacza status indeksowania stron Google Search Console „Blocked due to unauthorized request (401)”, czym różni się od 403 według RFC 9110, jakie są typowe przyczyny, jak diagnozować problem jako bot i jak dobrać naprawę do rodzaju strony — publicznej, prywatnej, błędnie zablokowanej przez WAF lub za paywallem.

Czytaj artykuł →
Polski › Treści

Baiduspider — robot indeksujący Baidu

Czym jest Baiduspider — warianty i user-agenty crawlera Baidu, zgodność z robots.txt (oraz wyjątek cpro/ads), weryfikacja odwrotnego DNS, słabe renderowanie JavaScript i kontrola indeksowania w Ziyuan.

Czytaj artykuł →
Polski › Treści

Crawler Bingbot

Czym jest Bingbot, jak działa jego indeksowanie oparte na Chromium, dlaczego jego zasięg wykracza poza Bing oraz jak zweryfikować prawdziwego crawlera przez dwuetapowy odwrotny DNS zamiast ufać user-agentowi.

Czytaj artykuł →
Polski › Treści

Agent użytkownika

Czym jest user agent — nagłówek HTTP, za pomocą którego roboty indeksujące i przeglądarki identyfikują siebie, token w robots.txt a pełny ciąg znaków oraz jak zweryfikować, czy bot jest prawdziwy.

Czytaj artykuł →
Polski › Treści

PageRank i SEO

PageRank to oryginalny algorytm analizy linków Google — czym jest, model przypadkowego internauty i wzór, aktualizacja Reasonable Surfer, jego historia od paska narzędziowego do wycieku API w 2024 roku, dlaczego nadal jest podstawowym systemem rankingowym i co oznacza dla Twoich linków oraz architektury wewnętrznej.

Czytaj artykuł →
Polski › Treści

Przekierowania JavaScript

Czym jest przekierowanie JavaScript, jak potok renderowania Google traktuje je inaczej niż przekierowanie 301 po stronie serwera, kiedy jest akceptowalnym ostatecznym rozwiązaniem oraz jak je wdrożyć i wykryć — a także gdzie pasują meta refresh i History API.

Czytaj artykuł →
Polski › Treści

Googlebot i SEO

Czym właściwie jest Googlebot — Smartphone vs Desktop, evergreen Chromium, stringi user-agent, weryfikacja zakresów IP, limity bajtów oraz rozróżnienie crawl vs rank.

Czytaj artykuł →
Polski › Treści

Indeksowanie

Jak wyszukiwarki przechowują i porządkują strony, aby móc je pozycjonować — analiza treści, kanonikalizacja, dlaczego zaindeksowane nie oznacza zaindeksowane, oraz czytanie raportu indeksowania stron w GSC.

Czytaj artykuł →
Polski › Treści

Indeksowanie Mobile-First

Czym właściwie jest indeksowanie mobile-first — Google używa Twojego mobilnego HTML do indeksowania i rankingu — dlaczego parytet treści jest zasadą

Czytaj artykuł →
Polski › Treści

Nie znaleziono (404)

Co oznacza "Nie znaleziono (404)" w raporcie Indeksowanie stron w Google Search Console — dlaczego Google znalazło adresy URL, których nigdy nie przesłałeś, dlaczego błędy 404 zwykle nie szkodzą SEO oraz mały zestaw błędów 404, które faktycznie warto naprawić.

Czytaj artykuł →
Polski › Treści

URL oznaczony jako 'noindex' (status GSC)

Co oznacza status "URL oznaczony jako 'noindex'" w Google Search Console — oraz wariant "Zgłoszony URL oznaczony jako 'noindex'" i starsza nazwa "Wykluczony przez tag 'noindex'". Kiedy jest to zamierzone, a kiedy błąd, gdzie znajduje się noindex (meta tag vs. nagłówek X-Robots-Tag), konflikt z robots.txt, fantomowy/CDN noindex, oraz jak to naprawić i zweryfikować.

Czytaj artykuł →
Polski › Treści

Rozrost indeksu

Rozrost indeksu to termin SEO oznaczający zaindeksowane adresy URL o niskiej wartości, cienkie i zduplikowane. To problem efektywności indeksowania i jakości, a nie kara — oto jak go naprawić.

Czytaj artykuł →
Polski › Treści

API indeksowania Google

Co faktycznie robi Google Indexing API — oficjalnie wspierane tylko dla stron z danymi strukturalnymi JobPosting i BroadcastEvent (transmisje na żywo), a nie dla ogólnych treści. Mity, co naprawdę mówi Google i czego użyć zamiast tego, aby przyspieszyć indeksowanie.

Czytaj artykuł →
Polski › Treści

IndexNow dla SEO

IndexNow to otwarty protokół push, który natychmiast informuje Bing, Yandex, Naver, Seznam i Yep o zmianach adresów URL — jedna subskrypcja, udostępniana wszystkim. Jak działa, jak go skonfigurować i dlaczego nie ma wpływu na Google.

Czytaj artykuł →
Polski › Treści

Protokół WebSub

WebSub (dawniej PubSubHubbub) to protokół push, który w czasie rzeczywistym rozgłasza zmiany kanałów RSS/Atom do wyszukiwarek takich jak Google — czym jest, jak działa i jakie ma ograniczenia.

Czytaj artykuł →
Polski › Treści

Renderowanie

Jak usługa renderowania Google uruchamia Twój JavaScript, aby zbudować stronę, którą indeksuje — oraz opcje renderowania (CSR, SSR, SSG, hydratacja, ISR, edge, dynamiczne) i ich kompromisy SEO.

Czytaj artykuł →
Polski › Treści

Raport indeksowania stron (GSC)

Jak działa raport indeksowania stron w Google Search Console (dawniej Stan w indeksie) — strony zindeksowane i niezindeksowane, kolumna Źródło, wszystkie stany, Weryfikacja poprawki oraz opóźnienie raportu.

Czytaj artykuł →