Guide de la découverte d’URL

Comment les moteurs de recherche découvrent les URL grâce aux liens internes, backlinks, sitemaps, flux RSS/Atom et protocoles push comme IndexNow et l’Indexing API. Le hub consacré à la découverte.

Première publication : 22 juin 2026 · Dernière mise à jour : 22 août 2026 · Advanced
Langues
1 indice probant sur cette page

La découverte est l’étape où le moteur apprend qu’une URL existe, avant de pouvoir l’explorer, l’indexer ou la classer. Ce hub emploie ce terme pédagogique pour le premier mouvement de ce que le modèle officiel de Google intègre à l’exploration. Les URL sont découvertes en pull — liens internes, backlinks, sitemaps, RSS/Atom — ou signalées en push — IndexNow, Indexing API, lastmod, WebSub et Inspection de l’URL. Google parle de « découverte d’URL », distincte de l’exploration et de l’indexation : « Détectée, actuellement non indexée » signifie que l’URL est connue mais pas encore explorée, avec plusieurs causes possibles plutôt qu’un déclencheur déterministe. Google nomme directement les liens et les sitemaps ; les pages orphelines constituent l’échec classique ; soumettre une URL ne garantit jamais son indexation. Ce hub cartographie l’ensemble et mène aux guides approfondis sur les sitemaps.

TL;DR — La découverte est le nom donné dans ce hub au premier mouvement de la recherche (découvrir → explorer → indexer → diffuser) : le moteur doit apprendre qu’une URL existe avant de récupérer quoi que ce soit. Le modèle officiel de Google intègre cette action à l’étape d’exploration de son processus en trois étapes, au lieu d’en faire une quatrième étape distincte — même séquence, vocabulaire différent. Les URL sont découvertes en mode pull (liens internes, backlinks, sitemaps, RSS/Atom) et en mode push (IndexNow, Indexing API, lastmod des sitemaps, WebSub, Inspection de l’URL). Google appelle cette recherche la « découverte d’URL ». Elle se distingue de l’exploration et de l’indexation : « Détectée, actuellement non indexée » signifie donc que l’URL a été trouvée mais pas encore explorée, un état pouvant avoir plusieurs causes et non un diagnostic unique garanti. Les liens et les sitemaps sont les deux voies que Google nomme directement ; les pages orphelines constituent l’échec classique ; IndexNow concerne Bing et d’autres moteurs, mais pas Google ; l’Indexing API est limitée à JobPosting et BroadcastEvent ; enfin, soumettre une URL ne garantit jamais son indexation.

Evidence for this claim Google discovers URLs through links, sitemaps, and other previously known signals before crawling and possible indexing. Scope: Current Google crawling and indexing overview. Confidence: high · Verified: Google Search Central: How Search works Evidence for this claim Sitemaps and indexing requests can aid discovery but do not guarantee crawling, indexing, or serving in results. Scope: Current Google sitemap and indexing-request behavior. Confidence: high · Verified: Google Search Central: Learn about sitemaps

Qu’est-ce que la découverte d’URL ?

La découverte est l’étape où l’URL est trouvée. Avant qu’une page puisse être explorée, indexée ou diffusée, le moteur doit savoir qu’elle existe et l’ajouter à sa liste de pages connues. Google la nomme explicitement : “This process is called ‘URL discovery’.” (Traduction) « Ce processus s’appelle la “découverte d’URL”. » Selon les propres termes de Google, “Some pages are known because Google has already visited them. Other pages are discovered when Google extracts a link from a known page to a new page… Still other pages are discovered when you submit a list of pages (a sitemap) for Google to crawl.” (Traduction) « Certaines pages sont connues parce que Google les a déjà consultées. D’autres sont découvertes lorsque Google extrait, depuis une page connue, un lien vers une nouvelle page… D’autres encore sont découvertes lorsque vous soumettez à Google une liste de pages (un sitemap) à explorer. »

Evidence for this claim Google does not guarantee that a discovered or submitted URL will be crawled, indexed, or served. Scope: web search Confidence: high · Verified: In-depth guide to how Google Search works

Ce seul passage résume tout le hub : les pages sont trouvées grâce aux liens, internes comme externes, et aux sitemaps. Tout le reste est une variante de ces deux principes, ou une manière de pousser une notification au lieu d’attendre que le moteur vienne la chercher.

Précision sur le modèle des étapes. Ce hub présente découverte → exploration → indexation → diffusion comme quatre étapes distinctes et nommées, car séparer « trouvée », « récupérée » et « stockée » facilite le diagnostic d’une page bloquée. Le modèle officiel de Google nomme trois étapes — exploration, indexation et diffusion — et définit la découverte d’URL comme le premier mouvement au sein de l’exploration, non comme une quatrième étape autonome. La chronologie est identique dans les deux cas ; ce hub donne simplement un nom et une section propres à la découverte, car son fonctionnement est suffisamment différent et son diagnostic suffisamment souvent erroné pour le justifier.

Evidence for this claim Google's official three-stage model is crawling, indexing, and serving; it places URL discovery at the beginning of the crawling stage rather than defining discovery as a separate official fourth stage. Scope: web search Confidence: high · Verified: In-depth guide to how Google Search works

Découverte, exploration et indexation

Distinguez ces trois notions et la plupart des confusions sur la découverte disparaîtront — en suivant notre découpage pédagogique en quatre étapes du modèle officiel à trois étapes de Google :

  • Découverte — le moteur apprend qu’une URL existe. Rien n’a encore été récupéré.
  • Exploration — le moteur télécharge l’URL découverte et en effectue le rendu. C’est le sujet du hub Exploration.
  • Indexation — le moteur analyse et stocke la page explorée afin de pouvoir la diffuser.

Google décrit la suite du processus en trois étapes : “Google Search works in three stages, and not all pages make it through each stage” (Traduction) « La recherche Google fonctionne en trois étapes, et toutes les pages ne franchissent pas chacune d’elles » — à savoir l’exploration, l’indexation et la diffusion. La découverte est la porte d’entrée de la première étape. Aucune de ces actions n’est, en elle-même, un facteur de classement : ce sont des conditions préalables pour être éligible au classement. Une URL jamais découverte ne sera jamais explorée, indexée ou diffusée. Point final.

Comment les moteurs découvrent les URL : pull et push

Le modèle mental le plus clair oppose pull et push. En pull, le moteur trouve les URL de lui-même ; en push, vous les lui signalez.

Pull — le moteur trouve l’URL de lui-même

Liens internes et backlinks. Google : “Other pages are discovered when Google extracts a link from a known page to a new page: for example, a hub page, such as a category page, links to a new blog post.” (Traduction) « D’autres pages sont découvertes lorsque Google extrait d’une page connue un lien vers une nouvelle page : par exemple, lorsqu’une page hub, telle qu’une page de catégorie, renvoie vers un nouvel article de blog. » La documentation de Google indique aussi qu’un site correctement maillé permet généralement de découvrir ainsi la plupart de ses pages, tandis que les nouveaux sites ayant peu de liens externes et les grands sites comportant des pages non liées risquent davantage de présenter des lacunes. Les liens ne sont pas la seule voie d’entrée, mais Google les cite en premier et ils se déploient automatiquement à mesure que vous publiez. Voilà pourquoi le maillage interne est l’un des leviers de découverte les plus puissants et pourquoi les pages orphelines peinent à être découvertes, comme expliqué plus loin. Les backlinks fonctionnent de la même manière : un lien externe provenant d’une page déjà connue du moteur lui révèle votre nouvelle URL.

Evidence for this claim Google says it can usually discover most pages on a properly linked site, while new sites with few external links and large sites with unlinked pages have a greater risk of pages not being discovered. Scope: sitemaps and internal links Confidence: high · Verified: What is a sitemap?

Sitemaps. Google : “A sitemap helps search engines discover URLs on your site, but it doesn’t guarantee that all the items in your sitemap will be crawled and indexed.” (Traduction) « Un sitemap aide les moteurs de recherche à découvrir les URL de votre site, mais ne garantit pas que tous ses éléments seront explorés et indexés. » Cette réserve est essentielle : un sitemap est une aide à la découverte, pas une garantie d’indexation. Les guides approfondis du sous-ensemble consacré aux sitemaps détaillent leur fonctionnement : sitemap XML, index de sitemaps, sitemap d’images et sitemap vidéo.

Flux RSS et Atom. Google accepte les flux comme format de sitemap : “Google accepts RSS 2.0 and Atom 1.0 feeds.” (Traduction) « Google accepte les flux RSS 2.0 et Atom 1.0. » Un flux ne révèle toutefois que vos URL récemment modifiées ; il complète donc un sitemap exhaustif sans le remplacer.

Push — vous informez le moteur d’un changement

WebSub (PubSubHubbub). Pour les flux RSS et Atom, Google prend en charge WebSub : “If you use Atom or RSS, you can use WebSub to broadcast your changes to search engines, including Google.” (Traduction) « Si vous utilisez Atom ou RSS, vous pouvez utiliser WebSub pour diffuser vos modifications aux moteurs de recherche, dont Google. » Au lieu d’attendre une nouvelle récupération, votre flux diffuse le changement.

Attribut lastmod du sitemap. Ce signal de fraîcheur indique aux moteurs qu’une URL a changé et mérite peut-être d’être réexplorée. Bing s’y appuie davantage que Google : Bing a déclaré que le champ lastmod reste un signal clé pour l’aider à prioriser les URL à réexplorer et réindexer. Les détails figurent dans le groupe consacré aux sitemaps.

Google Indexing API — portée limitée. C’est l’outil le plus souvent détourné de son usage. L’Indexing API ne peut servir à demander l’exploration que de pages contenant des données structurées JobPosting ou BroadcastEvent intégrées dans un VideoObject. Ce n’est pas un point d’entrée général permettant de « soumettre n’importe quelle URL à Google », malgré les présentations trompeuses. Si votre page n’est ni une offre d’emploi ni la page d’un événement diffusé en direct, l’Indexing API n’est pas l’outil adapté.

IndexNow — Bing et d’autres moteurs, mais pas Google. IndexNow est un protocole push : il avertit les moteurs participants dès qu’une URL est ajoutée, mise à jour ou supprimée. Selon sa FAQ, “Search engines adopting the IndexNow protocol agree that submitted URLs will be automatically shared with all other participating search engines.” (Traduction) « Les moteurs de recherche qui adoptent le protocole IndexNow acceptent que les URL soumises soient automatiquement partagées avec tous les autres moteurs participants. » Au moment de la rédaction, d’après la documentation actuelle d’indexnow.org vérifiée en juillet 2026, les moteurs participants sont Microsoft Bing, Yandex, Naver, Seznam.cz et Yep. Consultez la documentation IndexNow à jour, car cette liste peut changer. Google n’y figure pas. Aucune page d’aide de Google n’affirme “we don’t support IndexNow” (Traduction) « nous ne prenons pas en charge IndexNow » : la non-participation de Google est déduite de son absence de la liste actuelle des partenaires et des déclarations de représentants de Google présentant IndexNow comme un protocole seulement testé, et non d’une confirmation officielle de Google. Il s’agit donc de la meilleure lecture disponible, pas d’une déclaration officielle. Quel que soit le moteur, notifier IndexNow signifie seulement qu’une URL a changé : chaque moteur participant décide encore indépendamment s’il l’explore et l’indexe, et quand il le fait. La règle « notification ne signifie pas garantie » vaut pour les sitemaps comme pour tous les autres canaux de découverte. Pour Google, utilisez les liens, les sitemaps et l’Inspection de l’URL.

Soumission manuelle — Inspection de l’URL. Pour soumettre ponctuellement une URL à Google : “To request a crawl of individual URLs, use the URL Inspection tool.” (Traduction) « Pour demander l’exploration d’URL individuelles, utilisez l’outil Inspection de l’URL. » N’espérez toutefois pas accélérer le processus en répétant l’opération : Google précise que “there’s a quota for submitting individual URLs and requesting a recrawl multiple times for the same URL won’t get it crawled any faster.” (Traduction) « un quota s’applique à la soumission d’URL individuelles et demander plusieurs fois la réexploration de la même URL ne la fera pas explorer plus rapidement. » Bing dispose de son propre canal de soumission d’URL, limité à 10 000 URL par jour, distinct d’IndexNow.

Pull and push can both make a URL known, but neither route skips the crawl queue or guarantees indexing. Source : /technical-seo/how-search-works/discovery/

Two discovery routes feed one crawl queue. Pull discovery includes following links and reading sitemaps. Push discovery includes IndexNow for participating engines, the scope-limited Google Indexing API, and freshness notifications such as sitemap lastmod, RSS, or WebSub. Google does not use IndexNow for general pages, and its Indexing API supports only JobPosting and qualifying livestream pages.

© Patrick Stox LLC · CC BY 4.0 ·

Comment Google et Bing décrivent la découverte

Les deux moteurs présentent la découverte comme l’entrée du processus. Bing l’intègre directement à sa définition de l’exploration — Fabrice Canel : “Crawling is the process by which bingbot discovers new and updated documents or content to be added to Bing’s searchable index.” (Traduction) « L’exploration est le processus par lequel bingbot découvre les documents ou contenus nouveaux et mis à jour à ajouter à l’index consultable de Bing. »

L’échelle mérite qu’on s’y attarde, même si le chiffre exact évolue. Fabrice Canel a indiqué que Bing découvrait chaque jour plusieurs dizaines de milliards d’URL normalisées jamais rencontrées auparavant — dans une publication d’août 2022, il parlait de « 12s of billions … never seen before ». Je n’ai pas revérifié indépendamment ce chiffre dans une source primaire actuelle : considérez-le comme un ordre de grandeur, non comme un total quotidien précis et actuel. Quel que soit le chiffre aujourd’hui, la découverte fonctionne comme un flux massif et les moteurs dépriorisent agressivement certaines URL — toile de fond de l’état « Détectée, actuellement non indexée » décrit plus bas.

Pages orphelines : quand la découverte échoue

Une page orpheline ne reçoit aucun lien interne. Les liens étant l’une des deux voies de découverte que Google nomme directement, avec les sitemaps, une page orpheline ne peut être trouvée que par un sitemap, un lien externe, une redirection ou une référence canonique/hreflang. En l’absence de toutes ces voies, elle peut ne jamais être découverte.

La solution est le maillage interne, pas une astuce push. Créez un lien vers la page depuis un hub ou une page de catégorie pertinente — exactement l’exemple donné par Google d’une page de catégorie renvoyant vers un nouvel article de blog. Inscrire une page orpheline dans votre sitemap XML aide Google à la découvrir, mais ne remplace pas le signal du lien interne qui indique au moteur que la page compte. C’est précisément pourquoi les pages orphelines apparaissent souvent comme « Détectées, actuellement non indexées » : Google a trouvé leur entrée dans le sitemap, mais a dépriorisé l’exploration d’une page vers laquelle rien ne pointe.

« Détectée, actuellement non indexée » dans Search Console

La certitude associée à cet état concerne la limite entre les étapes. Le rôle de ce hub est de bien fixer cette limite, non de poser un diagnostic exhaustif — l’article dédié s’en charge. Selon la description de Google, “Discovered – currently not indexed” (Traduction) « Détectée, actuellement non indexée » signifie que la page a été trouvée mais n’a pas encore été explorée : Google voulait explorer l’URL, mais prévoyait que cela surchargerait le site et a donc reprogrammé l’exploration, raison pour laquelle la date de dernière exploration est vide.

À l’inverse, “Crawled – currently not indexed,” (Traduction) « Explorée, actuellement non indexée » est un problème différent et ultérieur : la page a été explorée mais pas indexée, et elle pourra ou non l’être plus tard. La plupart des articles tiers passent à côté de cette limite entre les étapes :

  • Détectée, actuellement non indexée = Google connaît l’URL mais ne l’a pas récupérée. Il s’agit d’un état de découverte ou de planification de l’exploration, avec une date de dernière exploration vide.
  • Explorée, actuellement non indexée = Google a récupéré la page, mais a choisi de ne pas l’indexer. Il s’agit d’un état lié à l’indexation ou à la qualité.

Quelles sont les causes de l’état « Détectée, actuellement non indexée » ? Examinez-les dans cet ordre, sans les confondre avec une cause unique confirmée :

  1. Dépriorisation liée à la planification de l’exploration ou à la charge serveur perçue — la raison indiquée par Google pour l’état lui-même.
  2. Page orpheline ou très faiblement liée en interne, ce qui réduit l’effort d’exploration que Google souhaite lui consacrer.
  3. Signaux de qualité ou d’autorité à l’échelle du site réduisant la demande globale d’exploration — une tendance propre au site, pas la preuve d’un défaut sur cette page précise.
  4. Site nouveau ou peu reconnu, dont la demande d’exploration reste faible.

Aucune de ces explications n’est la cause universelle. Google documente directement l’explication liée à la planification de l’exploration, mais ne publie pas de raison déterministe unique expliquant pourquoi une URL donnée reste dans cet état. Utilisez donc la liste précédente comme une échelle d’hypothèses à vérifier, non comme un diagnostic présumé. Cet état ne signifie pas non plus qu’un élément est cassé : John Mueller a déclaré “it’s completely normal that we don’t index everything off of the website,” (Traduction) « il est tout à fait normal que nous n’indexions pas tout ce qui se trouve sur le site » — et conseille de réévaluer la qualité globale du site plutôt que de chercher un problème technique sur chaque page. Gary Illyes a également souligné que l’immense majorité des sites n’ont pas à se préoccuper du budget d’exploration. Mon raccourci de praticien, tiré de mon guide de l’indexation chez Ahrefs — à relire avant de le tenir pour parole d’évangile, car je n’ai pas revérifié la page en direct lors de ce passage — est le suivant : Détectée signifie que Google connaît l’URL mais ne l’a pas explorée ; Explorée signifie qu’elle a été récupérée mais pas indexée et renvoie généralement à un problème de qualité. Les solutions se recoupent : rendez le contenu unique, utile et aligné sur l’intention ; supprimez tout blocage accidentel par noindex, robots ou canonique ; maintenez un serveur rapide et stable ; construisez une hiérarchie logique dotée d’un maillage interne solide ; puis demandez une nouvelle exploration dans l’Inspection de l’URL et surveillez le résultat. Pour distinguer capacité et demande d’exploration et suivre une procédure de correction détaillée, consultez l’article consacré à « Détectée, actuellement non indexée ».

Comment favoriser la découverte

Par ordre approximatif d’efficacité :

  1. Renforcez les liens internes vers la page afin qu’elle ne soit plus orpheline. C’est le levier le plus puissant, car les liens constituent l’une des deux voies de découverte que Google nomme directement.
  2. Ajoutez-la à un sitemap XML propre, composé d’URL canoniques et indexables avec un lastmod exact. Soumettez le sitemap dans Google Search Console et Bing Webmaster Tools.
  3. Améliorez la qualité globale du site afin d’accroître la demande d’exploration — c’est ce qui fait évoluer à grande échelle les pages « Détectées, actuellement non indexées ».
  4. Utilisez Inspection de l’URL → Demander une indexation pour une URL importante isolée ; n’oubliez pas le quota et le fait que répéter la demande n’accélère rien.
  5. Pour Bing et les autres moteurs participants, utilisez IndexNow afin de pousser immédiatement les URL modifiées. Google ne propose pas d’équivalent push pour les pages générales : appuyez-vous sur les liens, les sitemaps et l’Inspection de l’URL.

Pour aller plus loin

Ce hub cartographie la manière dont une URL devient connue. Les guides approfondis qu’il contient expliquent le fonctionnement des sitemaps :

Sitemaps

  • Sitemaps — vue d’ensemble : ce qu’est un sitemap, les formats acceptés par Google et la place de sa soumission dans la découverte — une aide, pas une garantie.
    • Sitemap XML — format standard, champs, limites de taille et bonne utilisation de lastmod.
    • Index de sitemaps — division et référencement de plusieurs sitemaps lorsque vous dépassez la capacité d’un fichier.
    • Sitemap d’images — signalement des images en vue de leur découverte dans la recherche d’images.
    • Sitemap vidéo — signalement des contenus vidéo et de leurs métadonnées.

Pour comprendre ce qui se passe après la découverte d’une URL — récupération, planificateur d’exploration, rendu et budget d’exploration — consultez le hub Exploration. Les sujets push connexes, comme IndexNow et la Google Indexing API, se trouvent aussi à proximité de la partie consacrée à l’exploration. Pour une vue plus large, consultez Fonctionnement de la recherche.

Chacun des sujets imbriqués ci-dessus possède son propre guide approfondi dans ce hub ; ils figurent également dans la barre latérale.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.