検索エンジンのディスカバリー:URL が発見される仕組み

検索エンジンがリンク、サイトマップ、フィード、IndexNow、URL 検査から URL を発見する仕組みと、孤立ページや「検出 - インデックス未登録」の対処を解説します。

初回公開:2026年6月22日 · 最終更新:2026年8月22日 · Advanced
言語
このページには証拠シグナルが1件あります

ディスカバリーは検索エンジンが URL の存在を知る段階です。主要経路は内部/外部リンクとサイトマップで、RSS、WebSub、IndexNow、対象限定の Indexing API、URL 検査が補助します。孤立ページには関連ハブから内部リンクを追加します。発見、クロール、インデックス登録は別で、URL の送信は登録を保証しません。

要点 — 検索エンジンは取得前に URL の存在を知る必要があります。Google の公式モデルでは URL 発見はクロール段階の一部です。プル経路は内部リンク、外部リンク、サイトマップ、フィード、プッシュ経路は WebSub、lastmod、対象限定の Indexing API、IndexNow、URL 検査です。孤立ページには内部リンクを追加します。「検出 - インデックス未登録」は発見済み・未取得の状態で、原因を一つに決めつけず仮説を順に検証します。

Evidence for this claim Google discovers URLs through links, sitemaps, and other previously known signals before crawling and possible indexing. Scope: Current Google crawling and indexing overview. Confidence: high · Verified: Google Search Central: How Search works Evidence for this claim Sitemaps and indexing requests can aid discovery but do not guarantee crawling, indexing, or serving in results. Scope: Current Google sitemap and indexing-request behavior. Confidence: high · Verified: Google Search Central: Learn about sitemaps

URL 発見とは

発見は URL を既知の一覧へ加える段階です。Google は “This process is called ‘URL discovery’.” (翻訳)「この処理を URL 発見と呼ぶ」とし、既知のページからのリンクとサイトマップを主要経路として説明します。

Evidence for this claim Google does not guarantee that a discovered or submitted URL will be crawled, indexed, or served. Scope: web search Confidence: high · Verified: In-depth guide to how Google Search works

リンクとサイトマップが基本で、ほかの方法はその変形か、待たずに変更を通知するプッシュ手段です。

段階モデルについて。 本稿は診断のため発見 → クロール → インデックス登録 → 表示と分けますが、Google はクロール、インデックス登録、表示の三段階とし、URL 発見をクロールに含めます。

Evidence for this claim Google's official three-stage model is crawling, indexing, and serving; it places URL discovery at the beginning of the crawling stage rather than defining discovery as a separate official fourth stage. Scope: web search Confidence: high · Verified: In-depth guide to how Google Search works

発見、クロール、インデックス登録の違い

Google の公式三段階を、本稿の四段階の説明へ対応させます。

  • 発見 — URL の存在を知る。まだ取得していません。
  • クロール — URL を取得してレンダリングします。クロールを参照。
  • インデックス登録 — 内容を処理して検索インデックスへ保存します。
  • 表示 — 検索語句に対して順位付けして提示します。

Google は “Google Search works in three stages, and not all pages make it through each stage” (翻訳)「Google 検索は三段階で、すべてのページが各段階を通過するわけではない」と説明します。発見は第一段階の入口で、各段階自体は順位要因ではなく前提条件です。

URL 発見のプルとプッシュ

プルは検索エンジン自身が URL を見つけ、プッシュはサイト側が通知する考え方です。

プル:検索エンジンが見つける

内部リンクと外部リンク。 Google は既知ページから新しいページへのリンクを抽出すると説明します。適切にリンクされたページはサイト内の移動で到達でき、外部リンクも新しい URL を知らせます。

Evidence for this claim Google says it can usually discover most pages on a properly linked site, while new sites with few external links and large sites with unlinked pages have a greater risk of pages not being discovered. Scope: sitemaps and internal links Confidence: high · Verified: What is a sitemap?

サイトマップ。 “A sitemap helps search engines discover URLs on your site, but it doesn’t guarantee that all the items in your sitemap will be crawled and indexed.” (翻訳)「URL 発見を助けるが、全項目のクロールとインデックス登録は保証しない」と Google は明記します。

RSS/Atom。 Google は “Google accepts RSS 2.0 and Atom 1.0 feeds.” (翻訳)「RSS 2.0 と Atom 1.0 を受け付ける」としています。最近変更した URL が中心なので完全なサイトマップを補完します。

プッシュ:変更を通知する

WebSub。 Google は “If you use Atom or RSS, you can use WebSub to broadcast your changes to search engines, including Google.” (翻訳)「Atom または RSS の変更を Google を含む検索エンジンへ通知できる」と説明します。

サイトマップの lastmod URL の変更を示し、再クロールの優先付けを助けます。正確な値だけを使います。

Google Indexing API は対象限定。 JobPosting または VideoObject 内の BroadcastEvent を含むページだけが対象で、一般的な URL 送信 API ではありません。

IndexNow は Bing など向けで Google は不参加。 追加、更新、削除を即時通知し、“Search engines adopting the IndexNow protocol agree that submitted URLs will be automatically shared with all other participating search engines.” (翻訳)「参加検索エンジン間で送信 URL を自動共有する」とされています。2026年8月時点の参加先は Bing、Yandex、Naver、Seznam、Yep で、Google は含まれません。 最新情報は公式文書 で確認します。 Google の “we don’t support IndexNow” (翻訳)「IndexNow をサポートしない」という一次声明があるわけではなく、参加先一覧からの推論です。

URL 検査による手動送信。 Google は “To request a crawl of individual URLs, use the URL Inspection tool.” (翻訳)「個別 URL のクロールは URL 検査を使う」と案内します。送信上限があり、繰り返しても速くなりません。

Pull and push can both make a URL known, but neither route skips the crawl queue or guarantees indexing. 出典: /technical-seo/how-search-works/discovery/

Two discovery routes feed one crawl queue. Pull discovery includes following links and reading sitemaps. Push discovery includes IndexNow for participating engines, the scope-limited Google Indexing API, and freshness notifications such as sitemap lastmod, RSS, or WebSub. Google does not use IndexNow for general pages, and its Indexing API supports only JobPosting and qualifying livestream pages.

© Patrick Stox LLC · CC BY 4.0 ·

Google と Bing の説明

Bing の Fabrice Canel は “Crawling is the process by which bingbot discovers new and updated documents or content to be added to Bing’s searchable index.” (翻訳)「クロールは bingbot が検索インデックスへ加える新規・更新内容を発見する処理」と定義します。両社とも発見をパイプラインの入口として扱います。

Canel は Bing が一日に初見の正規化 URL を数百億規模で発見すると述べました。変動する概算であり、現在の保証値ではなく規模感として扱います。 原文表現は ”12s of billions … never seen before” (翻訳)「一日に初めて見る数百億規模」です。

発見に失敗する孤立ページ

孤立ページは内部リンクがありません。サイトマップ、外部リンク、リダイレクト、canonical/hreflang 参照などで見つかる場合はありますが、発見が遅れやすく重要性も伝わりません。

関連するハブまたはカテゴリから内部リンクを追加します。XML サイトマップは発見を助けますが、閲覧可能な構造の代わりにはなりません。

Search Console の「検出 - インデックス未登録」

確実に分かるのは段階です。Google は URL を知っていますが、まだクロールしていません。Google はサーバー過負荷を避けるためクロールを再スケジュールした可能性を説明します。詳しい診断は専用ガイドで扱います。 原文の状態名 “Discovered – currently not indexed” (翻訳)「検出 - インデックス未登録」を確認します。

**「クロール済み - インデックス未登録」**は下流の別問題で、取得済みだが登録されていません。

  • 検出 - インデックス未登録 = URL は既知だが未取得。最終クロール日は空です。
  • クロール済み - インデックス未登録 = 取得したが登録しなかった状態です。

原因を一つに決めず、次の順で仮説を検証します。

  1. クロール予定またはサーバー負荷への配慮。
  2. 孤立または弱い内部リンク。
  3. サイト全体の品質とクロール需要。
  4. 重複、薄い内容、ソフトエラー、ファセットなど低価値な URL 群。
  5. 大量 URL、無限空間、パラメータによるクロール容量の圧迫。

Google は個別 URL の単一で決定的な理由を公開していません。Mueller はすべてを登録しないのは正常だと述べています。私のインデックス登録ガイド も参照し、完全な診断は専用ガイド で仮説を順に検証します。 “it’s completely normal that we don’t index everything off of the website,” (翻訳)「サイトのすべてを登録しないのは完全に正常です。」不要な制御がないか noindex も確認します。

発見を助ける方法

効果の大きい順に確認します。

  1. 関連ページから 内部リンクを追加する。
  2. canonical かつインデックス可能な URL を正確な lastmod とともに XML サイトマップへ入れる。
  3. サイトマップを Google と Bing へ送信する。
  4. RSS/Atom と WebSub を使う。
  5. Bing などへ IndexNow を使う。
  6. Google の対象形式だけ Indexing API を使う。
  7. 単発 URL は URL 検査で一度送る。
  8. 「検出 - インデックス未登録」が多い場合はサイト全体の品質とクロール需要を改善する。

次に読む項目

このハブは URL が既知になる仕組みの地図です。サイトマップ側の詳細は次のとおりです。

サイトマップ

  • サイトマップ — 形式と発見支援の概要。
    • XML サイトマップ — フィールド、上限、正確な lastmod
      • サイトマップ インデックス — 大規模サイトの分割。
    • 画像サイトマップ — 通常ページで発見しにくい画像。
    • 動画サイトマップ — 動画メタデータと発見。
    • ニュース サイトマップ — 最近のニュース記事。
    • RSS/Atom フィード — 最近変更した URL と WebSub。
    • テキスト サイトマップ — URL だけの簡易形式。
    • HTML サイトマップ — 利用者とクローラー向けのリンク集。

発見後の取得、スケジューラ、レンダリング、クロール バジェットはクロール を参照してください。全体像は検索の仕組み を参照してください。

各項目はサイドバーから個別ガイドへ移動できます。

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.