Historischer Seitenvergleich

Die Prüfungen laufen auf unserem Server. Wir rufen die von dir eingegebene URL ab und speichern die Ergebnisse nicht. The exact URL is sent in a POST body to this site, then used for bounded Common Crawl index/WARC lookup and a safe current-page fetch. Results may be cached; raw archived HTML is not returned. Anonyme Ergebniszähler auf Ausführungsebene können für aggregierte Forschung verwendet werden; URLs, Domains, IP-Adressen und Kennungen werden nie einbezogen, und Statistiken werden erst ab 100 Ausführungen veröffentlicht.

Rückmeldung
Fehler melden

Funktioniert etwas in Historischer Seitenvergleich nicht? Teile uns mit, was passiert ist — die Meldung geht direkt an eine private Prüfwarteschlange, nicht in eine öffentliche Liste.

Gesendete Angaben
 Werkzeugeingaben, Uploads, eingefügte Quellen, vollständige Ergebnisse, Abfrageparameter und URL-Fragmente werden nicht automatisch angehängt. Du kannst die oben ausgewählte Passage bearbeiten oder entfernen. Browser- und Missbrauchsschutz-Metadaten werden zur Spamabwehr verarbeitet. 

Über dieses Werkzeug

Vergleiche einen ausgewählten Common-Crawl-Capture mit der aktuellen öffentlichen Seite anhand begrenzter Raw-HTML-Signale und extrahiertem Text. Der Bericht zeigt Titel, H1, Meta-Beschreibung, Canonical, Robots-Direktiven, Wortzahl, strukturierte Datentypen und gekürzte Textauszüge getrennt für Capture und aktuelle Antwort.

Ein Unterschied oder ein fehlender Capture ist Evidenz für eine Prüfung, keine vollständige Versionshistorie oder ein automatischer SEO-Fehler.

Funktionen

  • Auswahl eines datumsrelevanten Common-Crawl-Indexes und eines begrenzten WARC-Bytebereichs
  • Vergleich von Metadaten, Canonical, Robots, strukturierten Daten, Wortzahl und Textähnlichkeit
  • Getrennte HTTP-Statusbeobachtungen für Capture und aktuelle Seite
  • Begrenzte hinzugefügte/entfernte Auszüge mit Attribution und Rechtehinweisen

So funktioniert es

Gib eine exakte öffentliche URL ein und wähle optional ein spätestes Capture-Datum. Der Dienst wählt einen datumsrelevanten Common-Crawl-Indexdatensatz, liest einen begrenzten WARC-Bytebereich und ruft die aktuelle Seite über den geschützten Endpunkt ab. Vergleiche anschließend Titel, H1, Description, Canonical, Robots, Wortzahl, strukturierte Datentypen, Textähnlichkeit und gekürzte Auszüge.

Einschränkungen

  • Common Crawl sampelt das Web; Captures können fehlen, unvollständig, gekürzt oder reine Revisit-Datensätze ohne Payload sein.
  • Der Dienst verspricht keine lebenslange Abdeckung, spielt archiviertes JavaScript nicht ab und lädt keine Subressourcen.
  • Das Ergebnis gewährt keine Rechte an archiviertem Drittanbieterinhalt; prüfe Common-Crawl-Bedingungen und Rechte der Ursprungsseite vor kommerzieller Nutzung.

Häufig gestellte Fragen

Was vergleicht das Werkzeug?

Es vergleicht die ausgewählte Common-Crawl-Aufnahme einer exakten URL mit der aktuellen öffentlichen Seite: Title, H1, Meta Description, Canonical, robots-Direktiven, Wortanzahl, Typen strukturierter Daten, begrenzte Textähnlichkeit sowie begrenzte Auszüge hinzugefügter und entfernter Inhalte. Die HTTP-Status der Aufnahme und der aktuellen Seite werden getrennt als Quellbeobachtungen angezeigt, nicht als Vergleich des Statusverlaufs.

Bedeutet eine fehlende Aufnahme, dass die Seite nie existierte?

Nein. Common Crawl erfasst das Web stichprobenartig und nimmt nicht jede URL bei jedem Crawl auf. Fehlende, unvollständige, reine erneut aufrufen- und abgeschnittene Datensätze werden als Abdeckungsgrenzen gemeldet, statt in ein bestandenes oder fehlgeschlagenes Ergebnis umgewandelt zu werden.

Kann ich die vollständige archivierte Seite ansehen oder herunterladen?

Nein. Der Dienst ruft einen exakten WARC-Bytebereich ab und gibt nur abgeleitete Fakten und begrenzte Textauszüge zurück. Er bietet keinen Betrachter für die vollständige archivierte Seite, führt kein archiviertes JavaScript aus und lädt keine archivierten Unterressourcen.

Kann ich das Ergebnis kommerziell nutzen?

Dieses Werkzeug meldet abgeleitete Beobachtungen und gewährt keine Rechte an archivierten Inhalten Dritter. Prüfe die aktuellen Bedingungen von Common Crawl und die Rechte der Ursprungswebsite, bevor du archiviertes wesentlich in einem kommerziellen Produkt verwendest.

Nächster SchrittXML-Sitemap-Generator — generate the corrected version. Anleitung auf Englisch verfügbar.