Vergleich von Crawl-Exporten

Wird vollständig in deinem Browser ausgeführt – nichts, was du einfügst, wird hochgeladen oder gespeichert. Both files stay in your browser. Files over 15 MiB and rows beyond the 100,000-row comparison cap are rejected or reported as truncated. Anonyme Ergebniszähler auf Ausführungsebene können für aggregierte Forschung verwendet werden; URLs, Domains, IP-Adressen und Kennungen werden nie einbezogen, und Statistiken werden erst ab 100 Ausführungen veröffentlicht.

Rückmeldung
Fehler melden

Funktioniert etwas in Vergleich von Crawl-Exporten nicht? Teile uns mit, was passiert ist — die Meldung geht direkt an eine private Prüfwarteschlange, nicht in eine öffentliche Liste.

Gesendete Angaben
 Werkzeugeingaben, Uploads, eingefügte Quellen, vollständige Ergebnisse, Abfrageparameter und URL-Fragmente werden nicht automatisch angehängt. Du kannst die oben ausgewählte Passage bearbeiten oder entfernen. Browser- und Missbrauchsschutz-Metadaten werden zur Spamabwehr verarbeitet. 

Über dieses Werkzeug

Normalisiere zwei Screaming-Frog-, Sitebulb-, Scout-Site-Audit- oder generische CSV-/TSV-Crawl-Exporte lokal und prüfe hinzugefügte, entfernte und feldgeänderte URLs. Unkartierte Spalten, ungültige URLs, Duplikate und unvollständige Abdeckung bleiben sichtbar; Pfadvorlagen dienen nur als deterministische Triagehilfe.

Ein Unterschied ist keine bewiesene Regression. Nutze vergleichbare Crawl-Konfigurationen und verifiziere wichtige Befunde im Quell-Crawler oder auf der Live-Seite.

Funktionen

  • Erkennung gängiger Vendor-Header und URL-Normalisierung
  • Vergleich gemeinsamer Seitenfelder wie Status, Indexierbarkeit, Title, Canonical, H1, Wortzahl, Tiefe und Inlinks
  • Gruppierung hinzugefügter, entfernter und geänderter URLs nach Pfadvorlage
  • Browserlokale Verarbeitung und CSV-Export der normalisierten Änderungsliste

So funktioniert es

Exportiere Seiten-CSV oder TSV vor und nach dem Crawl mit vergleichbarem Scope, Robots, Rendering, Authentifizierung und Limits. Lade beide Dateien, prüfe Vendor-Erkennung, gemappte Felder, ignorierte Spalten, ungültige URLs, Duplikate und Caps. Triage die Inventaränderungen nach Pfadvorlage, inspiziere Feldänderungen pro URL und exportiere anschließend die normalisierte Änderungsliste.

Einschränkungen

  • Unterschiedliche Rendering-, Authentifizierungs-, Robots-, Extraktions-, Scoring- und Crawl-Einstellungen werden nicht reproduziert.
  • Vendor-spezifische Issue-Taxonomien werden nicht als äquivalent angenommen; Issue-Labels werden nur als sortierter Text verglichen, wenn beide Dateien sie liefern.
  • Ein hinzugefügter oder entfernter URL beweist keine Crawlability-Änderung; Konfiguration, Limits, Auth, Robots oder echte Site-Änderungen können Ursachen sein.

Häufig gestellte Fragen

Welche Crawl-Exporte kann ich vergleichen?

Das Werkzeug erkennt gängige Spaltenüberschriften aus Seitenexporten von Screaming Frog, Sitebulb und Scout Site Audit Free sowie aus generischen CSV- oder TSV-Dateien. Es benötigt eine URL-Spalte und vergleicht nur Felder, die in beiden Dateien erkannt werden.

Werden herstellerspezifische Problembezeichnungen als gleichwertig behandelt?

Nein. Herstellerspezifische Problemtaxonomien können unterschiedliche Definitionen und Schwellenwerte haben. Der Vergleich normalisiert gemeinsame Seitennachweise wie Status, Indexierbarkeit, Title, Canonical, H1, Wortanzahl, Tiefe und eingehende Links. Problembezeichnungen werden nur dann als alphabetisch sortierte Zeichenfolgen verglichen, wenn beide Dateien sie bereitstellen.

Beweist eine hinzugefügte oder entfernte URL eine Veränderung der Crawlbarkeit?

Nein. Eine URL kann aufgrund des Crawl-Umfangs, technischer Begrenzungen, der Authentifizierung, der robots-Regeln, abweichender Einstellungen oder einer tatsächlichen Änderung der Website erscheinen oder verschwinden. Bestätige vergleichbare Crawl-Konfigurationen, bevor du Inventardifferenzen als Regressionen behandelst.

Werden die Exporte hochgeladen?

Nein. Einlesen, Normalisierung, Vergleich, Filterung und CSV-Ausgabe erfolgen lokal in deinem Webbrowser. Die ausgewählten Dateien werden nicht an diese Website gesendet.

Wie werden Pfadvorlagen erstellt?

Bei der Gruppierung werden numerische Kennnummern, universell eindeutige Kennungen und lange hexadezimale Zeichenfolgen in Pfadsegmenten ersetzt. Das ist eine deterministische Triagehilfe und kein CMS-spezifischer Vorlagendetektor.

Nächster SchrittXML-Sitemap-Generator — generate the corrected version. Anleitung auf Englisch verfügbar.