過去ページ比較
チェックは当サーバーから実行します。入力したURLは取得しますが、結果は保存しません。 The exact URL is sent in a POST body to this site, then used for bounded Common Crawl index/WARC lookup and a safe current-page fetch. Results may be cached; raw archived HTML is not returned. 匿名化した実行単位の結果件数を集計調査に使う場合があります。URL、ドメイン、IPアドレス、識別子は含めず、100回未満の実行から統計を公開しません。
+ で現在のサイトまたはページを保存します。保存したサイト、ページ、リストの横にある☆を使うとお気に入りに追加できます。最近のチェック履歴は下に表示されます。
名前付きリストを作成
ローカルの選択内容から対象を入力しました。
サイトパスポート この保存済みサイトのローカルコンテキスト
ローカルデータ
保存した対象、名前付きリスト、最近のチェック概要はこのブラウザ内だけに残ります。
Observed page signals
Bounded text changes
このツールを評価
このツールについて
Common Crawlの制限付きキャプチャ1件と現在のページを比較し、メタデータ、canonical、robotsディレクティブ、構造化データ型、語数、抽出テキストの変更を確認します。取得元HTTPステータスは別の観測値として扱います。
無料・登録不要。公開HTTP(S)ページの正確なURLを1つ入力し、必要なら以前の日付を選んで古いキャプチャを優先します。比較を実行してキャプチャ日時とクロールインデックスを確認し、差分は自動的なSEO欠陥ではなくレビューの手掛かりとして扱います。
機能
- 選択したキャプチャと現在ページの比較
- タイトル、説明、canonical、robotsの差分
- 構造化データ型と抽出語数の比較
- 変更箇所と取得状態を確認できるレポート
仕組み
選択したCommon Crawlキャプチャと現在のページを制限付きで取得し、HTTPステータス、タイトル、説明、canonical、robots、見出し、構造化データ型、語数、抽出テキストを同じ形式へ正規化します。隣接する値を比較し、変更、欠落、取得失敗を分けて表示します。
制限事項
- Common Crawlのキャプチャはすべての版や資産を保持するとは限らず、比較は取得できたHTMLに限られます。差分だけで原因、意図、SEO上の欠陥を証明することはできません。
- JavaScript、サブリソース、認証ページは完全に再現されない場合があります。現在ページと過去キャプチャの取得時点も異なるため、観測できない期間を推測しません。
よくある質問
何を比較しますか?
1つの正確な URL について、選択した Common Crawl の取得記録と現在の公開ページを比較します。対象は title、H1、meta description、canonical、robots 指示、単語数、構造化データの種類、範囲を限定したテキスト類似度、上限付きの追加・削除抜粋です。取得記録と現在の HTTP ステータスは、履歴比較ではなく個別の観測事実として表示します。
取得記録がないことはページが存在しなかったという意味ですか?
いいえ。Common Crawl はウェブを標本収集しており、すべてのクロールで全 URL を取得するわけではありません。欠落、不完全、再訪のみ、途中で切れた記録は、合否に変換せず収録範囲の制限として報告します。
アーカイブページ全体を表示またはダウンロードできますか?
いいえ。サービスは正確な1つの WARC バイト範囲を取得し、派生した事実と範囲を限定したテキスト抜粋だけを返します。ページ全体のアーカイブ表示、アーカイブ JavaScript の実行、アーカイブされたサブリソースの読み込みは行いません。
結果を商用利用できますか?
このツールは派生した観測結果を報告するもので、第三者のアーカイブ内容に関する権利を付与しません。商用製品で利用する前に、Common Crawl の現行利用条件と元サイトの権利を確認してください。
よくある問題と修正方法
- 情報 選択した取得時点から、観測されたページシグナルが変わっています 修正: 変化したタイトル、説明文、見出し、件数、スキーマタイプを意図したページ履歴と照合し、本当に意図しない変更だけを復元してください。