Comparador histórico de páginas

As verificações são executadas em nosso servidor; buscamos a URL informada e não guardamos os resultados. The exact URL is sent in a POST body to this site, then used for bounded Common Crawl index/WARC lookup and a safe current-page fetch. Results may be cached; raw archived HTML is not returned. Contadores anônimos de resultados por execução podem ser usados em pesquisas agregadas; URLs, domínios, IPs e identificadores nunca são incluídos, e nenhuma estatística é divulgada com menos de 100 execuções.

Comentários
Relatar um erro

Algo não está funcionando no Comparador histórico de páginas? Conte o que aconteceu — o relato vai direto para uma fila privada de triagem, não para uma lista pública.

O que será enviado
 Entradas da ferramenta, uploads, fonte colada, resultados completos, parâmetros de consulta e fragmentos de URL não são anexados automaticamente. Você pode editar ou remover o trecho selecionado acima. Metadados do navegador e de proteção contra abuso são processados para prevenir spam. 

Sobre esta ferramenta

Grátis, sem cadastro. Compare um limitado Comum Rastreamento captura com o atual público página. Coverage é sampled evidência—não prova de cada version que existed.

Compare um Comum Rastreamento captura com o atual page’s limitado raw-HTML SEO signals e extracted texto.

Recursos

  • O service selects um date-relevant Comum Rastreamento índice registro, reads um limitado WARC byte intervalo, e busca o atual público página por o guarded endpoint. Isso extracts comparável raw-HTML facts e limitado texto excerpts; isso faz não replay archived JavaScript ou subresources.
  • Isso compares um exato URL’s selecionado Comum Rastreamento captura com o atual público página: título, H1, meta descrição, canonical, robots directives, word count, structured-data tipos, limitado texto similarity, e limitado adicionado/removido excerpts. Captura e atual HTTP statuses são mostrado separately como origem observações, não como um status-history comparação.
  • Um limitado comparação pode mostrar um captura timestamp e rastreamento índice alongside um changed título, canonical, ou structured-data tipo. Isso relatórios somente o selecionado captura e atual raw HTML; um ausente captura ou um difference é evidência para revisão, não um Concluído version histórico ou um automatic SEO defect.
  • Observado página signals

Como funciona

O service selects um date-relevant Comum Rastreamento índice registro, reads um limitado WARC byte intervalo, e busca o atual público página por o guarded endpoint. Isso extracts comparável raw-HTML facts e limitado texto excerpts; isso faz não replay archived JavaScript ou subresources.

Limitações

  • Histórico captura dados comes de Comum Rastreamento ; este site é não affiliated com isso. Comum Rastreamento amostras o web, so captures pode ser ausente, incompleto, truncado, ou represented por revisit registros sem um payload. O ferramenta consultas somente um few date-relevant rastreamento indexes e never promises lifetime coverage.
  • Não. Comum Rastreamento amostras o web e faz não captura cada URL em cada rastreamento. Ausente, incompleto, revisit-only, e truncado registros são reported como coverage limites rather than converted em um pass ou failure.

Perguntas frequentes

O que a ferramenta compara?

Ela compara a captura selecionada de uma URL exata no Common Crawl com a página pública atual: title, H1, meta description, canonical, diretivas de robots, contagem de palavras, tipos de dados estruturados, similaridade limitada de texto e trechos adicionados/removidos com limite. Os status HTTP da captura e da página atual são mostrados separadamente como observações das fontes, não como uma comparação do histórico de status.

Uma captura ausente significa que a página nunca existiu?

Não. O Common Crawl coleta amostras da web e não captura todas as URLs em todos os rastreamentos. Registros ausentes, incompletos, somente de revisita e truncados são informados como limites de cobertura, em vez de transformados em aprovação ou falha.

Posso visualizar ou baixar a página arquivada completa?

Não. O serviço recupera um único intervalo exato de bytes do WARC e retorna apenas fatos derivados e trechos limitados de texto. Ele não oferece um visualizador de arquivo de página inteira, não executa JavaScript arquivado nem carrega subrecursos arquivados.

Posso usar o resultado comercialmente? <!--Can I use the result commercially?-->

Esta ferramenta informa observações derivadas e não concede direitos sobre conteúdo arquivado de terceiros. Consulte os termos atuais do Common Crawl e os direitos do site de origem antes de usar significativo arquivado em um produto comercial. <!--This tool reports derived observations and does not grant rights in third-party archived content. Review Common Crawl’s current terms and the originating site’s rights before relying on archived material in a commercial product.-->

Próxima etapaGerador de sitemap XML — generate the corrected version. Orientações disponíveis em inglês.