Porównanie strony w historii

Kontrole są uruchamiane na naszym serwerze; pobieramy podany adres URL i nie przechowujemy wyników. The exact URL is sent in a POST body to this site, then used for bounded Common Crawl index/WARC lookup and a safe current-page fetch. Results may be cached; raw archived HTML is not returned. Anonimowe liczniki wyników poszczególnych uruchomień mogą być wykorzystywane do badań zbiorczych; adresy URL, domeny, adresy IP i identyfikatory nigdy nie są uwzględniane, a statystyki nie są publikowane poniżej 100 uruchomień.

Opinia
Zgłoś błąd

Coś nie działa w Porównanie strony w historii? Opisz, co się stało — zgłoszenie trafi bezpośrednio do prywatnej kolejki weryfikacji, a nie na publiczną listę.

Dane, które zostaną wysłane
 Dane wejściowe narzędzia, przesłane pliki, wklejone źródła, pełne wyniki, parametry zapytania i fragmenty URL nie są dołączane automatycznie. Możesz edytować lub usunąć zaznaczony powyżej fragment. Metadane przeglądarki i ochrony przed nadużyciami są przetwarzane w celu zapobiegania spamowi. 

O tym narzędziu

Porównaj jeden wybrany zapis Common Crawl z bieżącymi, ograniczonymi sygnałami SEO surowego HTML i wyodrębnionym tekstem tej samej strony.

Funkcje

  • Porównanie title, H1, meta description, canonical, robots, word count i typów structured data.
  • Osobne statusy HTTP zapisu i bieżącej strony oraz jawny znacznik czasu i indeks crawla.
  • Ograniczone podobieństwo tekstu i krótkie fragmenty dodane lub usunięte.
  • Opcjonalna graniczna data zapisu, która pomaga wybrać odpowiedni indeks Common Crawl.

Jak to działa

Usługa wybiera jeden rekord z odpowiedniego czasowo indeksu, czyta ograniczony zakres bajtów WARC i pobiera bieżącą stronę przez chroniony endpoint. Następnie wyodrębnia porównywalne fakty surowego HTML oraz limitowane fragmenty tekstu; różnica pozostaje dowodem do przeglądu, nie automatycznym defektem SEO.

Ograniczenia

  • Common Crawl próbkuje sieć, więc zapisy mogą być nieobecne, niepełne, ucięte lub pozbawione payload.
  • Wynik nie jest pełnym archiwum, nie uruchamia JavaScript i nie ładuje archiwalnych podzasobów.
  • Pochodne obserwacje oraz fragmenty nie udzielają praw do ponownej publikacji treści osoby trzeciej.

Częste pytania

Co porównuje narzędzie?

Porównuje wybraną migawkę dokładnego adresu URL z Common Crawl z bieżącą publiczną stroną: tytuł, H1, metaopis, canonical, dyrektywy robots, liczbę słów, typy danych strukturalnych, ograniczone podobieństwo tekstu i skrócone fragmenty dodane lub usunięte. Statusy HTTP migawki i strony bieżącej są osobnymi obserwacjami, nie historią statusów.

Czy brak migawki oznacza, że strona nigdy nie istniała?

Nie. Common Crawl próbkuje internet i nie przechwytuje każdego URL podczas każdego crawla. Brakujące, niepełne, wyłącznie ponowne i przycięte rekordy są zgłaszane jako ograniczenia pokrycia, a nie zaliczenie lub błąd.

Czy mogę zobaczyć lub pobrać pełną zarchiwizowaną stronę?

Nie. Usługa pobiera jeden dokładny zakres bajtów WARC i zwraca tylko wyprowadzone fakty oraz ograniczone fragmenty tekstu. Nie udostępnia przeglądarki całej strony, nie wykonuje zarchiwizowanego JavaScript ani nie ładuje zasobów podrzędnych.

Czy mogę wykorzystać wynik komercyjnie?

Narzędzie raportuje wyprowadzone obserwacje i nie przyznaje praw do zarchiwizowanych treści osób trzecich. Przed wykorzystaniem materiału w produkcie komercyjnym sprawdź aktualne warunki Common Crawl i prawa witryny źródłowej.

Następny krokGenerator mapy witryny XML — generate the corrected version. Wskazówki są dostępne po angielsku.