Confronto storico pagina

I controlli vengono eseguiti dal nostro server; recuperiamo l’URL inserito e non conserviamo i risultati. The exact URL is sent in a POST body to this site, then used for bounded Common Crawl index/WARC lookup and a safe current-page fetch. Results may be cached; raw archived HTML is not returned. I conteggi anonimi degli esiti per singola esecuzione possono essere utilizzati per ricerche aggregate; URL, domini, IP e identificatori non sono mai inclusi e nessuna statistica viene pubblicata sotto le 100 esecuzioni.

Commenti
Segnala un errore

Qualcosa non funziona in Confronto storico pagina? Descrivi cosa è successo: la segnalazione va direttamente a una coda di valutazione privata, non a un elenco pubblico.

Dati che verranno inviati
 Input dello strumento, caricamenti, fonti incollate, risultati completi, parametri di query e frammenti URL non vengono allegati automaticamente. Puoi modificare o rimuovere il passaggio selezionato sopra. I metadati del browser e anti-abuso vengono elaborati per prevenire lo spam. 

Informazioni sullo strumento

Confronta una cattura Common Crawl con i segnali SEO e il testo estratto della pagina pubblica corrente.

Funzionalità

  • Confronto di title, H1, description, canonical, robots e dati strutturati.
  • Timestamp della cattura e indice di crawl come osservazioni separate.
  • Similarity e excerpt di testo limitati e normalizzati.
  • Nessun replay di JavaScript o subresource archiviate.

Come funziona

Inserisci una URL esatta e, se vuoi, una data limite. Il servizio sceglie un record di indice pertinente, legge un intervallo WARC delimitato e confronta fatti HTML raw con la pagina corrente.

Limitazioni

  • Common Crawl campiona il web: catture mancanti, incomplete, troncate o solo revisit sono limiti di copertura.
  • Le osservazioni non sono una cronologia completa né una licenza per ripubblicare contenuti di terzi; verifica termini e diritti.

Domande frequenti

Che cosa confronta lo strumento?

Confronta la cattura Common Crawl selezionata per un URL esatto con la pagina pubblica attuale: titolo, H1, meta descrizione, canonical, direttive robots, conteggio parole, tipi di dati strutturati, somiglianza testuale e brevi estratti aggiunti o rimossi. Gli stati HTTP delle due fonti restano osservazioni separate.

Una cattura mancante significa che la pagina non è mai esistita?

No. Common Crawl campiona il web e non acquisisce ogni URL a ogni scansione. Record mancanti, incompleti, di sola rivisitazione o troncati vengono indicati come limiti di copertura, non come esito positivo o negativo.

Posso visualizzare o scaricare l’intera pagina archiviata?

No. Il servizio recupera un solo segmento di dati WARC e restituisce fatti derivati e brevi estratti. Non offre un visualizzatore completo, non esegue JavaScript archiviato e non carica risorse secondarie.

Posso usare commercialmente il risultato?

Lo strumento riporta osservazioni derivate e non concede diritti sui contenuti archiviati di terzi. Controlla le condizioni attuali di Common Crawl e i diritti del sito originario prima dell’uso commerciale.

Passaggio successivoGeneratore XML sitemap — generate the corrected version. Le indicazioni sono disponibili in inglese.