過去ページ比較

チェックは当サーバーから実行します。入力したURLは取得しますが、結果は保存しません。 The exact URL is sent in a POST body to this site, then used for bounded Common Crawl index/WARC lookup and a safe current-page fetch. Results may be cached; raw archived HTML is not returned. 匿名化した実行単位の結果件数を集計調査に使う場合があります。URL、ドメイン、IPアドレス、識別子は含めず、100回未満の実行から統計を公開しません。

フィードバック
不具合を報告

過去ページ比較 で問題が発生しましたか?状況をお知らせください。報告は公開リストではなく、非公開の確認キューに直接送られます。

送信される情報
 ツールへの入力、アップロード、貼り付けたソース、完全な結果、クエリパラメーター、URLフラグメントは自動では添付されません。上で選択した箇所は編集または削除できます。ブラウザーと不正利用防止のメタデータはスパム防止のために処理されます。 

このツールについて

Common Crawlの制限付きキャプチャ1件と現在のページを比較し、メタデータ、canonical、robotsディレクティブ、構造化データ型、語数、抽出テキストの変更を確認します。取得元HTTPステータスは別の観測値として扱います。

無料・登録不要。公開HTTP(S)ページの正確なURLを1つ入力し、必要なら以前の日付を選んで古いキャプチャを優先します。比較を実行してキャプチャ日時とクロールインデックスを確認し、差分は自動的なSEO欠陥ではなくレビューの手掛かりとして扱います。

機能

  • 選択したキャプチャと現在ページの比較
  • タイトル、説明、canonical、robotsの差分
  • 構造化データ型と抽出語数の比較
  • 変更箇所と取得状態を確認できるレポート

仕組み

選択したCommon Crawlキャプチャと現在のページを制限付きで取得し、HTTPステータス、タイトル、説明、canonical、robots、見出し、構造化データ型、語数、抽出テキストを同じ形式へ正規化します。隣接する値を比較し、変更、欠落、取得失敗を分けて表示します。

制限事項

  • Common Crawlのキャプチャはすべての版や資産を保持するとは限らず、比較は取得できたHTMLに限られます。差分だけで原因、意図、SEO上の欠陥を証明することはできません。
  • JavaScript、サブリソース、認証ページは完全に再現されない場合があります。現在ページと過去キャプチャの取得時点も異なるため、観測できない期間を推測しません。

よくある質問

何を比較しますか?

1つの正確な URL について、選択した Common Crawl の取得記録と現在の公開ページを比較します。対象は title、H1、meta description、canonical、robots 指示、単語数、構造化データの種類、範囲を限定したテキスト類似度、上限付きの追加・削除抜粋です。取得記録と現在の HTTP ステータスは、履歴比較ではなく個別の観測事実として表示します。

取得記録がないことはページが存在しなかったという意味ですか?

いいえ。Common Crawl はウェブを標本収集しており、すべてのクロールで全 URL を取得するわけではありません。欠落、不完全、再訪のみ、途中で切れた記録は、合否に変換せず収録範囲の制限として報告します。

アーカイブページ全体を表示またはダウンロードできますか?

いいえ。サービスは正確な1つの WARC バイト範囲を取得し、派生した事実と範囲を限定したテキスト抜粋だけを返します。ページ全体のアーカイブ表示、アーカイブ JavaScript の実行、アーカイブされたサブリソースの読み込みは行いません。

結果を商用利用できますか?

このツールは派生した観測結果を報告するもので、第三者のアーカイブ内容に関する権利を付与しません。商用製品で利用する前に、Common Crawl の現行利用条件と元サイトの権利を確認してください。

次のステップXMLサイトマップジェネレーター — generate the corrected version. ガイダンスは英語で利用できます.