« Découverte, actuellement non indexée » : causes et correctifs
Ce que signifie le statut « Découverte, actuellement non indexée » dans Google Search Console, sa différence avec « Explorée, actuellement non indexée », ses causes et ses correctifs.
Langues
1 indice probant sur cette page
- Outil en ligne associéLog File Analyzer
« Découverte, actuellement non indexée » est un statut du rapport Indexation des pages de Google Search Console. Google connaît l’URL, par un sitemap ou un lien, mais ne l’a pas encore explorée : le champ Dernière exploration est vide. Ce fait le distingue de « Explorée, actuellement non indexée », où la page a été récupérée et reste évaluée pour l’indexation. Les deux grands facteurs sont la capacité d’exploration, lorsque le serveur serait surchargé, et la demande d’exploration, liée à la qualité, au maillage et à la priorité. Les correctifs portent sur le maillage interne, la qualité, la réduction du gaspillage, les liens vers les pages prioritaires et la stabilité du serveur. « Demander une indexation » peut pousser quelques URL, mais ne passe pas à l’échelle et ne traite pas la cause ; une exploration ne garantit pas non plus l’indexation.
Evidence for this claim Google defines Discovered - currently not indexed as a page it found but has not yet crawled, with an empty last crawl date. Scope: Google Search Console Page Indexing status. Confidence: high · Verified: Google: Page indexing reportTL;DR — “Discovered – currently not indexed” (traduction) « Découverte, actuellement non indexée » dans Google Search Console signifie que Google a trouvé votre page, mais ne l’a pas encore téléchargée (explorée) ; elle ne peut donc pas apparaître dans les résultats. Le champ Dernière exploration est vide. En général, Google n’a pas jugé la page prioritaire à ce moment-là, ou son exploration aurait trop sollicité votre serveur. La solution consiste à rendre vos pages importantes plus accessibles et manifestement dignes d’être explorées, pas à cliquer sans cesse sur « Demander une indexation ».
Ce que signifie ce statut
Ouvrez Google Search Console, accédez au rapport Indexation des pages et vous verrez vos pages regroupées par statut. « Découverte, actuellement non indexée » rassemble les URL que Google connaît, mais qu’il n’a pas encore réellement explorées. Evidence for this claim Google defines Discovered - currently not indexed as a page it found but has not yet crawled, with an empty last crawl date. Scope: Google Search Console Page Indexing status. Confidence: high · Verified: Google: Page indexing report
Rappelez-vous les trois étapes que toute page doit franchir pour apparaître dans les résultats :
- Crawl — Google télécharge la page.
- Index — Google l’enregistre dans sa base de données.
- Serve (rank) — Google l’affiche lorsqu’une personne effectue une recherche.
Une page « Discovered » est bloquée avant la première étape. Google a trouvé l’URL — généralement dans votre sitemap ou via un lien —, l’a ajoutée à sa file d’attente, puis ne l’a pas récupérée. L’indice le plus clair se trouve dans l’outil Inspection de l’URL : le champ Dernière exploration est vide, puisqu’aucune exploration n’a encore eu lieu.
Evidence for this claim Google defines Discovered - currently not indexed as a page it found but has not yet crawled, with an empty last crawl date. Scope: Google Search Console Page Indexing status. Confidence: high · Verified: Google: Page indexing reportPourquoi Google laisse une page au statut « Discovered »
Deux raisons, en termes simples :
- Google ne voulait pas surcharger votre site. Il ralentit si l’exploration de pages supplémentaires risque de mettre votre serveur à rude épreuve, puis la reprogramme.
- Google n’a pas jugé la page prioritaire. Si votre site, ou cette partie du site, paraît pauvre, dupliqué ou difficile d’accès, Google réduit la priorité d’exploration de ces URL. Il s’agit d’un diagnostic plausible, pas d’un fait que le statut prouve à lui seul.
En quoi ce statut diffère de « Explorée, actuellement non indexée »
Ces deux statuts se ressemblent beaucoup et sont constamment confondus. La différence tient à un mot : crawled.
- Discovered — Google n’a pas encore récupéré la page. Le champ Dernière exploration est vide.
- Explorée, actuellement non indexée — Google a récupéré la page, mais ne l’a pas conservée dans l’index. Le champ Dernière exploration contient une date.
« Discovered » correspond donc à « nous n’y sommes pas encore arrivés » ; « Crawled » à « nous l’avons examinée et écartée pour le moment ». Les étapes et les correctifs diffèrent.
Ce qui aide réellement
- Créez des liens vers la page depuis des pages déjà explorées — page d’accueil, navigation principale ou articles populaires. Les pages orphelines, auxquelles aucun lien ne mène, constituent une cause possible.
- Rendez la page réellement utile, sans en faire un quasi-duplicata d’autres pages.
- Ajoutez-la à votre sitemap XML : cela aide Google à la découvrir, sans forcément accroître sa priorité.
- Gardez un serveur rapide et stable.
L’erreur la plus fréquente
Cliquer encore et encore sur « Demander une indexation » ne résout pas le problème. Cela peut accélérer le traitement de quelques URL importantes, mais ne passe pas à l’échelle de centaines ou de milliers de pages et ne change rien à la raison de leur faible priorité. Si une section entière reste en « Discovered », le signal concerne la qualité, la structure ou le serveur du site ; un bouton ne le corrigera pas. Evidence for this claim Google says repeated recrawl requests for the same URL do not make crawling faster and recommends sitemaps for many URLs. Scope: URL Inspection request indexing; crawling still does not guarantee indexing. Confidence: high · Verified: Google: Ask Google to recrawl URLs
Vous voulez un diagnostic complet — distinguer un problème de serveur d’un problème de qualité et appliquer des correctifs qui passent à l’échelle ? Ouvrez l’onglet Advanced.
TL;DR — « Découverte, actuellement non indexée » signifie que Google a trouvé l’URL, mais ne l’a pas explorée : le champ Dernière exploration est vide, seul fait qui distingue ce statut de « Explorée, actuellement non indexée » (page récupérée, puis non conservée). Deux facteurs entrent en jeu : la capacité d’exploration — explorer maintenant surchargerait le serveur, donc Google reporte — et la demande d’exploration — le site ou les pages ne justifient pas encore cet effort d’exploration, signal lié à la qualité et au maillage interne. Le problème touche souvent le site ou un modèle entier, pas une seule page. Travaillez d’abord la demande : maillage interne, qualité, réduction du gaspillage d’exploration et liens vers les pages prioritaires ; sur les grands sites, traitez aussi la capacité du serveur. Demander une indexation peut pousser quelques URL, mais ne passe pas à l’échelle et ne corrige pas la cause. Enfin, l’exploration d’une page ne garantit toujours pas son indexation.
La définition exacte donnée par Google
D’après la définition du rapport Indexation des pages : “The page was found by Google, but not crawled yet. Typically, Google wanted to crawl the URL but this was expected to overload the site; therefore Google rescheduled the crawl. This is why the last crawl date is empty on the report.” (traduction) « Google a repéré la page sans l’avoir encore explorée. Il souhaitait généralement explorer l’URL, mais a estimé que cela risquait de surcharger le site ; l’exploration a donc été reportée. Voilà pourquoi la date de dernière exploration est vide dans le rapport. » Evidence for this claim Google defines Discovered - currently not indexed as a page it found but has not yet crawled, with an empty last crawl date. Scope: Google Search Console Page Indexing status. Confidence: high · Verified: Google: Page indexing report Cette dernière phrase fournit l’indice décisif : date de dernière exploration vide = URL jamais récupérée. L’Inspection de l’URL ne présentera aucune exploration enregistrée.
Il s’agit donc d’un état de file d’attente avant exploration. Rien n’a été indexé puis supprimé, et aucune pénalité n’a été appliquée. Google connaît l’URL — découverte via un sitemap, un lien interne ou un lien externe —, mais ne l’a tout simplement pas encore récupérée.
« Discovered » ou « Explorée, actuellement non indexée »
Cette distinction doit être exacte, car les causes et les correctifs des deux statuts sont différents. Le tableau complet figure dans l’onglet Cheat Sheets ; voici la version courte :
- Découverte, actuellement non indexée = pas encore récupérée. Champ Dernière exploration vide. C’est un signal de priorité ou de capacité d’exploration : Google n’a pas encore consacré de requête d’exploration à la page.
- Explorée, actuellement non indexée = récupérée, mais non conservée. Le champ Dernière exploration contient une date. Google a examiné la page et, pour le moment, ne l’a pas indexée ; cette évaluation peut avoir plusieurs causes — duplication, contenu pauvre, canonicalisation vers une autre URL, etc. — et ne constitue pas un verdict unique sur la qualité.
Point souvent oublié : faire sortir une page de « Discovered » ne signifie pas qu’elle sera indexée. Elle peut passer à « Explorée, actuellement non indexée » et y rester. L’exploration est une porte d’entrée, pas une garantie. Evidence for this claim Google says repeated recrawl requests for the same URL do not make crawling faster and recommends sitemaps for many URLs. Scope: URL Inspection request indexing; crawling still does not guarantee indexing. Confidence: high · Verified: Google: Ask Google to recrawl URLs
Google knows the URL. On the highlighted Discovered currently not indexed branch, Google has not fetched it, the Last Crawl field is empty, and diagnosis focuses on crawl priority or capacity. On the Crawled currently not indexed branch, Google fetched the page but did not index it, the Last Crawl field has a date, and diagnosis focuses on index selection, page value, duplication, rendering, and conflicting signals.
© Patrick Stox LLC · CC BY 4.0 ·
Pourquoi des pages restent en « Discovered »
Google présente l’exploration comme un budget composé de deux moitiés. « Discovered » est le symptôme classique d’une contrainte sur l’une ou l’autre.
Capacité d’exploration — votre serveur
Google calcule une limite de capacité d’exploration, c’est-à-dire le nombre maximal de
connexions simultanées qu’il utilisera selon les réponses de votre serveur. Son guide précise :
“Google’s crawlers calculate a crawl capacity limit, which is the maximum number of simultaneous
parallel connections that Google can use to crawl a site,” (traduction) « Les robots de Google
calculent une limite de capacité d’exploration, soit le nombre maximal de connexions parallèles
simultanées que Google peut employer pour explorer un site », puis “if the site slows down or
responds with server errors, the limit goes down and Google crawls less.” (traduction) « si le
site ralentit ou répond par des erreurs serveur, cette limite diminue et Google réduit son
exploration ». Réponses lentes, délais d’attente et erreurs 5xx brident tous l’exploration.
Quand la capacité devient le goulot d’étranglement, les URL s’accumulent dans la catégorie
« Découverte » parce qu’il n’y a tout simplement pas assez de marge pour les récupérer.
Demande d’exploration — qualité et structure de votre site
L’autre moitié correspond à l’envie de Google d’explorer l’URL. C’est là que se situent la plupart des problèmes « Discovered ». Les systèmes de Google déduisent la priorité d’exploration des modèles d’URL, du maillage interne et de la qualité globale du site. Une page enfouie, orpheline ou presque identique à de nombreuses pages de faible valeur suscite peu de demande et reste dans la file.
Le guide de Google sur le budget d’exploration cite explicitement les “Sites with a large portion of their total URLs classified by Search Console as Discovered - currently not indexed.” (traduction) « sites dont une grande partie des URL sont classées par Search Console dans la catégorie des URL découvertes, mais actuellement non indexées ». Google relie ainsi ce statut à une contrainte associant capacité et demande. Le guide s’adresse aussi aux sites comptant des millions d’URL et aux sites d’environ 10 000 pages ou plus qui changent rapidement, tout en présentant ces nombres comme des estimations, pas comme des seuils exacts. Pour un site nettement plus petit, considérez ce guide comme un contexte plutôt que comme la preuve d’un plafond strict de capacité.
Souvent un signal global, pas un défaut isolé
Ce changement de perspective est utile dans de nombreux cas, mais il repose sur une tendance observée, pas sur une fréquence publiée par Google. « Discovered » signifie rarement qu’une page X présente à elle seule un défaut précis. Plus souvent, Google extrapole à partir des modèles d’URL et de la qualité globale qu’une catégorie de pages ne mérite pas une exploration soutenue. C’est une inférence de praticien fondée sur le comportement des modèles et gabarits, pas un fait prouvé par le statut pour chaque URL. John Mueller a rappelé deux grands facteurs : la capacité du serveur et la qualité globale du site. Il a aussi évoqué des causes plus larges que la simple surcharge : génération accidentelle d’un trop grand nombre d’URL, mauvais maillage interne et nécessité de renforcer le site pour prioriser les pages importantes. Ces propos sont paraphrasés d’interventions relayées par la presse spécialisée ; je ne les ai pas rattachés à une transcription verbatim.
L’échelle joue également. Des articles spécialisés attribuent largement à Gary Illyes l’idée qu’environ 90 % des sites n’ont pas à se soucier du budget d’exploration. Je n’ai pas vérifié ce chiffre dans l’enregistrement d’origine : considérez-le comme une approximation souvent relayée, pas comme une statistique confirmée. L’orientation reste utile : sur un site petit ou moyen, un plafond réel de capacité est peu probable ; un retard persistant tient plus souvent à la demande — qualité, maillage ou gaspillage d’exploration — qu’au serveur. Confirmez-le avec vos statistiques d’exploration et vos journaux, sans le déduire uniquement de la taille du site.
Diagnostiquer la cause
Avant toute correction, déterminez si la contrainte porte sur la capacité ou sur la demande :
- Vérification de la capacité. Examinez les statistiques d’exploration de GSC — temps de réponse
moyen, état de l’hôte, répartition des codes de réponse — et les journaux serveur pour repérer
lenteurs, pics d’erreurs
5xxet délais d’attente. Si le serveur bride clairement Google, le problème vient de la capacité. - Vérification de la demande. Examinez la profondeur des liens internes, les pages orphelines et la qualité globale — modèles d’URL pauvres, dupliqués ou générés automatiquement. Des URL profondes, orphelines ou quasi dupliquées signalent un problème de demande.
Ne choisissez pas un correctif à partir d’une généralité comme « la plupart des sites sont X ». Décidez d’après vos propres preuves : regroupements par modèle d’URL, journaux serveur, statistiques d’exploration, nombre de liens internes, couverture du sitemap et de l’inventaire, ainsi que valeur commerciale de chaque groupe. Pour les sites petits et moyens, les données pointent souvent vers la demande ; pour les très grands sites, les sites e-commerce ou programmatiques, les deux facteurs se cumulent souvent. Vérifiez-le avant de vous engager.
Comment corriger le problème
Voici les leviers, approximativement classés par impact pour la plupart des sites :
Renforcer le maillage interne et corriger les pages orphelines
Le maillage interne est le levier de demande que vous contrôlez le mieux. Les pages sans lien entrant ou situées à de nombreux clics de profondeur dominent souvent le groupe « Discovered ». Reliez vos URL importantes depuis des pages fréquemment explorées — accueil, pages hub, navigation principale — et rapprochez-les de la surface de l’architecture.
Améliorer la qualité ; consolider les pages pauvres et dupliquées
Si Google interprète vos modèles d’URL comme étant de faible valeur, ajouter davantage de pages n’aidera pas. Retenez la mise en garde de Mueller : réduire le nombre de pages indexables sans améliorer le site ne rend pas celui-ci meilleur. La chirurgie du volume ne corrige pas à elle seule un problème « Discovered » causé par la qualité. Consolidez les pages pauvres et quasi dupliquées, puis donnez aux pages conservées une véritable valeur. Cette formulation paraphrase sa réponse ; ce n’est pas une citation verbatim.
Réduire le gaspillage d’exploration
Navigation à facettes, paramètres d’URL, identifiants de session, soft 404s et espaces infinis forment l’usine classique à URL « Discovered » : ils consomment la capacité sur des URL inutiles et retardent le contenu réel. Les sites e-commerce et programmatiques y perdent le plus. Réduire ce gaspillage libère de la capacité et clarifie le signal de qualité associé à vos modèles d’URL. Voir budget d’exploration et spider traps.
Accélérer et stabiliser le serveur
Côté capacité, des réponses plus rapides et plus stables relèvent la capacité d’exploration limit.
Google l’indique explicitement : lorsqu’un site ralentit ou renvoie des erreurs, il est moins exploré.
Corrigez les erreurs 5xx, réduisez les temps de réponse et éliminez les délais d’attente.
Obtenir des liens vers les pages prioritaires
Les liens externes augmentent la demande d’exploration des pages qu’ils ciblent, mais lentement. C’est un levier réel pour les pages vraiment importantes, pas un interrupteur instantané. N’attendez pas d’un backlink qu’il fasse sortir une URL de « Discovered » du jour au lendemain.
Quand utiliser — ou non — « Demander une indexation »
Utilisez cette fonction pour un petit nombre d’URL réellement importantes à faire explorer plus tôt. N’en faites pas un correctif pour des milliers d’URL « Discovered » : cela ne passe pas à l’échelle et Google précise qu’une nouvelle soumission n’est pas nécessaire. Pour le statut voisin « Crawled », Google dit explicitement qu’il n’est pas nécessaire de soumettre à nouveau l’URL à l’exploration ; « Discovered » suit la même logique. La demande d’indexation pousse la file d’attente, mais ne change pas la raison de la faible priorité.
Quand ne rien faire
Une certaine quantité d’URL « Discovered » relève d’un tri normal : Google connaît l’URL sans l’avoir encore priorisée et pourra l’explorer plus tard. S’il ne s’agit que de quelques URL réellement peu importantes, vous pouvez les laisser. Agissez lorsqu’une part grande ou importante de vos URL reste bloquée, car elle révèle alors une contrainte de capacité ou de demande corrigeable.
Pour mesurer cette « part grande ou importante », définissez d’abord le dénominateur. Dans le rapport Indexation des pages, la liste d’exemples de chaque statut est limitée à 1 000 URL et ne garantit pas l’exhaustivité. Ne prenez donc pas l’export des exemples pour une liste complète. Comparez le total du rapport à votre propre inventaire de sitemap ou d’URL, puis priorisez selon l’importance commerciale et le potentiel de trafic, pas seulement selon le nombre de lignes.
Cas particuliers : grands sites, e-commerce et programmatique
Ici, « Discovered » cesse d’être cosmétique. Les sites comptant des millions d’URL, une navigation à facettes, des fiches produits quasi dupliquées ou des espaces de paramètres infinis génèrent bien plus d’URL que Google ne souhaite en explorer ; une grande partie reste donc en « Discovered » par conception. Commencez par réduire le gaspillage — consolidation, exclusion de l’exploration des espaces de faible valeur lorsque c’est approprié, correction des explosions de paramètres —, puis améliorez le maillage et la qualité des URL utiles, et enfin la capacité serveur. Les nouveaux sites à faible autorité connaissent une version atténuée du même phénomène : faible demande, donc attente prolongée des pages faibles.
Où se situe ce statut
« Discovered » est un statut du rapport Indexation des pages et correspond à l’étape d’exploration ; les correctifs reposent donc sur le budget d’exploration, le maillage interne et les fondamentaux de l’indexation. Son voisin « Explorée, actuellement non indexée » représente la version post-exploration du même problème. Pour l’étape amont — découverte et récupération des URL —, consultez crawling ; pour l’étape aval, consultez indexing.
Résumé IA
Version condensée de l’onglet Advanced :
- Définition : statut Indexation des pages de GSC indiquant que Google a trouvé l’URL, mais ne l’a pas explorée ; le champ Dernière exploration est vide. C’est un état de file d’attente avant exploration, pas une pénalité.
- Comparaison avec « Explorée, actuellement non indexée » : « Discovered » = pas encore récupérée, signal de priorité ou de capacité ; « Crawled » = récupérée, puis encore évaluée pour l’indexation, avec plusieurs causes possibles et non un verdict unique sur la qualité. Sortir de « Discovered » ne garantit pas l’indexation.
- Deux causes racines selon Google : la capacité d’exploration — une exploration immédiate surchargerait le serveur, donc Google la reporte — et la demande d’exploration — le site ou les pages ne justifient pas cet effort, selon leur qualité et leur maillage. Le guide budget d’exploration vise les sites très grands ou changeant rapidement et qualifie ses seuils de simples estimations.
- Le signal est souvent global, pas propre à une page : Google extrapole la priorité à partir des modèles d’URL et de la qualité générale. C’est une inférence de praticien, pas un fait que le statut prouve pour une URL donnée.
- Diagnostic : statistiques d’exploration et journaux pour la capacité ; profondeur des liens, pages orphelines et qualité globale pour la demande. Les petits et moyens sites sont plus souvent limités par la demande. L’estimation d’environ 90 % de sites n’ayant pas à se soucier du crawl budget, largement attribuée à Illyes, n’a pas été vérifiée dans l’enregistrement d’origine : confirmez toujours avec vos propres données.
- Correctifs : renforcer le maillage et corriger les pages orphelines ; améliorer et consolider les pages pauvres ou dupliquées ; réduire le gaspillage dû aux facettes, paramètres, soft 404s et espaces infinis ; accélérer le serveur ; obtenir des liens vers les pages prioritaires.
- Demander une indexation peut pousser quelques URL, mais ne passe pas à l’échelle et ne corrige pas la cause ; Google dit qu’une nouvelle soumission n’est pas nécessaire. Réduire le nombre de pages sans améliorer leur qualité n’aide pas davantage.
- Mesure du retard : les exemples du rapport Indexation des pages sont limités à 1 000 URL par statut et ne sont pas forcément exhaustifs. Mesurez la part par rapport à votre propre inventaire, pas seulement à l’export échantillonné.
Documentation officielle
Documentation de première main publiée par les moteurs de recherche.
- Rapport sur l’indexation des pages — définitions de “Discovered – currently not indexed” (traduction) « Découverte, actuellement non indexée » et de “Crawled – currently not indexed,” (traduction) « Explorée, actuellement non indexée », ainsi que des autres statuts du rapport.
- Optimiser le budget d’exploration — capacité et demande d’exploration ; le guide cite explicitement les sites dont une grande part des URL appartient à la première catégorie.
- Guide détaillé du fonctionnement de la recherche Google — exploration → indexation → diffusion, découverte des URL et raisons pour lesquelles toutes les pages ne franchissent pas chaque étape.
- Exploration et indexation — documentation centrale sur robots, sitemaps et contrôles permettant de réduire le gaspillage d’exploration.
Bing / Microsoft
- Aide de Bing Webmaster Tools — Bing n’utilise pas le même libellé ; il rend compte de l’indexation dans ses outils d’inspection et régule l’exploration selon le quota et la valeur du contenu. Vérifiez sa terminologie actuelle avant de la citer.
Citations de la source
Déclarations officielles de Google. Chaque lien mène directement au passage cité dans la source.
Google — définition dans le rapport Indexation des pages
- “Discovered - currently not indexed: The page was found by Google, but not crawled yet. Typically, Google wanted to crawl the URL but this was expected to overload the site; therefore Google rescheduled the crawl. This is why the last crawl date is empty on the report.” (traduction) « Découverte, actuellement non indexée : Google a trouvé la page sans encore l’explorer. En règle générale, il voulait explorer l’URL, mais prévoyait que cela surchargerait le site ; il a donc reprogrammé l’exploration. C’est la raison pour laquelle la date de dernière exploration est vide dans le rapport. » — Aide Google Search Console, rapport Indexation des pages. Accéder à la citation
Google — statut voisin, à titre de comparaison
- “Crawled - currently not indexed: The page was crawled by Google but not indexed. It may or may not be indexed in the future; no need to resubmit this URL for crawling.” (traduction) « Explorée, actuellement non indexée : Google a exploré la page sans l’indexer. Elle pourra ou non être indexée ultérieurement ; il n’est pas nécessaire de la soumettre de nouveau à l’exploration. » — Documentation d’aide de Google Search Console, rapport consacré à l’indexation des pages. Accéder à la citation
Google — capacité d’exploration et bridage côté serveur
- “Google’s crawlers calculate a crawl capacity limit, which is the maximum number of simultaneous parallel connections that Google can use to crawl a site.” (traduction) « Les robots de Google calculent une limite de capacité d’exploration, soit le nombre maximal de connexions parallèles simultanées que Google peut utiliser pour explorer un site. » — Google Search Central, Optimiser le budget d’exploration. Accéder à la citation
- Le même guide vise les “Sites with a large portion of their total URLs classified by Search Console as Discovered - currently not indexed.” (traduction) « sites dont une grande partie des URL sont classées par Search Console comme découvertes, mais actuellement non indexées ». Accéder à la citation
Checklist de triage pour « Découverte, actuellement non indexée »
Procédez de haut en bas : identifiez le type de problème avant de commencer les corrections.
- Confirmer le statut dans Inspection de l’URL de GSC : le champ Dernière exploration est-il vide ? Vide signifie réellement « Discovered », pas « Crawled ».
- Vérifier la capacité : examiner les statistiques d’exploration — temps de réponse moyen et état de l’hôte — ainsi que les journaux serveur pour les lenteurs, délais d’attente et pics de
5xx. - Vérifier la demande : les URL touchées sont-elles orphelines ou profondément enfouies dans l’architecture ? Mesurer leur profondeur de liens internes.
- Vérifier la qualité : s’agit-il de modèles d’URL pauvres, quasi dupliqués ou générés automatiquement, plutôt que de pages réellement distinctes ?
- Vérifier le gaspillage : facettes, paramètres, identifiants de session, soft 404s ou espace infini gonflent-ils le nombre d’URL ?
- Maillage interne : relier les pages « Discovered » importantes depuis des pages déjà explorées — accueil, hubs, navigation — sans trop de profondeur.
- Sitemap : inclure les URL concernées dans le sitemap XML ; cela aide la découverte, pas nécessairement la priorité.
- Santé du serveur : maintenir des réponses rapides et stables, avec un minimum de
5xxet de délais d’attente. - Définir la portée : quelques URL de faible valeur peuvent rester en l’état ; une part grande ou importante exige de traiter la cause de capacité ou de demande.
- Demander une indexation : ne l’utiliser que pour quelques URL réellement prioritaires, jamais comme correctif en masse.
Modèles mentaux
1. Discovered = trouvée, pas récupérée. Le champ Dernière exploration vide résume le diagnostic. Si une URL a été récupérée, elle n’est plus « Discovered », mais « Crawled ». Commencez par cette distinction : tout le reste en dépend.
2. Capacité ou demande. Une URL reste en « Discovered » pour deux grandes raisons : Google ne pouvait pas l’explorer (capacité du serveur) ou ne voulait pas encore l’explorer (demande liée à la qualité, aux liens et à la priorité). Diagnostiquez avant d’agir. statistiques d’exploration et journaux renseignent la capacité ; profondeur, pages orphelines et qualité globale renseignent la demande.
3. Souvent un signal global, pas un défaut isolé. Google extrapole la priorité à partir des modèles d’URL et de la qualité générale. C’est une inférence de praticien fondée sur ces comportements, pas un fait que le statut prouve pour une URL. « Discovered » signale plus souvent une catégorie de pages qu’une anomalie unique. Corrigez le modèle, pas seulement la page, après l’avoir confirmé avec vos données.
4. L’exploration est une porte d’entrée, pas une garantie. Sortir une page de « Discovered » lui vaut seulement une récupération. Elle peut encore arriver dans « Explorée, actuellement non indexée » et ne jamais être indexée. Préparez l’étape de qualité, pas seulement celle de l’exploration.
5. Les sites petits et moyens sont plus souvent limités par la demande. Les plafonds réels de capacité touchent surtout les très grands sites. Sur un site petit ou moyen, commencez plutôt par la demande — maillage et qualité — que par l’hypothèse d’un mur serveur. Confirmez toutefois avec statistiques d’exploration et les journaux, sans déduire la cause de la taille seule.
6. Demander une indexation pousse la file ; il ne soigne pas la cause. La fonction remonte quelques URL dans la file. Elle ne change rien à la raison de leur faible priorité et ne passe pas à l’échelle. Utilisez les leviers structurels pour corriger le fond.
« Discovered » ou « Crawled » — carte des correctifs
Discovered ou Explorée, actuellement non indexée
| Découverte, actuellement non indexée | Explorée, actuellement non indexée | |
|---|---|---|
| Ce qui s’est passé | Trouvée, pas encore récupérée | Récupérée, non conservée |
| Date de dernière exploration | Vide | Renseignée |
| Étape | Avant l’exploration, dans la file | Après l’exploration, décision d’indexation |
| Signal principal | Priorité ou capacité d’exploration | Évaluation d’indexation, plusieurs causes possibles |
| Cause type | Maillage faible, gaspillage, charge serveur, faible demande | Duplication, contenu pauvre, canonicalisation vers une autre URL, etc. |
| Premier levier | Maillage interne, réduction du gaspillage, vitesse du serveur | Améliorer ou consolider la page elle-même |
| Nouvelle soumission nécessaire ? | Non, sauf pour pousser quelques URL prioritaires | Non |
Capacité ou demande : quel est le problème ?
| Symptôme | Cause probable | Premier correctif |
|---|---|---|
statistiques d’exploration lents, pics de 5xx ou de délais d’attente dans les journaux | Capacité d’exploration | Accélérer et stabiliser le serveur |
| URL orphelines ou profondément enfouies | Demande d’exploration | Maillage interne, réduction de la profondeur |
| Modèles pauvres, quasi dupliqués ou générés automatiquement | Crawl demand (qualité) | Consolider, améliorer, élaguer |
| Millions d’URL de facettes ou de paramètres | Gaspillage d’exploration | Réduire les espaces infinis, gérer les paramètres |
| Petit site, peu d’URL « Discovered » | Tri normal | Souvent, ne rien faire |
Faits essentiels
- « Discovered » signifie que le champ Dernière exploration est vide : c’est le fait distinctif.
- Les deux facteurs de Google : capacité d’exploration et demande d’exploration.
- Des articles spécialisés attribuent largement à Gary Illyes l’estimation qu’environ 90 % des sites n’ont pas à se soucier du budget d’exploration. Non vérifiée dans l’enregistrement d’origine, elle donne une orientation, pas une statistique confirmée. Sur les petits et moyens sites, un retard persistant tient plus souvent à la qualité ou au maillage qu’à un plafond de capacité.
- Demander une indexation ne passe pas à l’échelle, ne corrige pas la cause et ne nécessite pas de soumissions répétées.
- Être explorée ne garantit pas l’indexation.
- Les exemples du rapport Indexation des pages sont limités à 1 000 par statut et ne sont pas forcément exhaustifs : mesurez par rapport à votre inventaire, pas à l’échantillon.
Pourquoi Google n’a-t-il pas exploré ces URL ?
Discovered – currently not indexed diagnosis
Outils pour distinguer capacité et demande
- Log File Analyzer — vérifier si les requêtes de Googlebot diminuent, quels modèles d’URL les consomment et si des erreurs apparaissent.
- Robots.txt Tester — écarter un blocage d’accès avant d’interpréter l’absence d’exploration comme une décision de planification.
- Sitemap Validator — vérifier la présence des URL canoniques prioritaires et la disponibilité ainsi que la structure du sitemap.
- Link Analyzer — vérifier que la page concernée possède un chemin interne explorable au lieu de n’exister que dans un sitemap.
Tests de validation
Test : la correction du maillage et du sitemap déclenche une exploration
Test à exécuter — publier le lien interne et la correction du sitemap, puis vérifier l’historique de l’URL dans les journaux serveur et son statut dans Inspection de l’URL. Résultat attendu — Googlebot demande l’URL canonique et le champ dernière exploration n’est plus vide. Interprétation d’un échec — l’URL conserve des signaux faibles de découverte ou de priorité, présente une variante conflictuelle ou appartient à un problème plus large de demande d’exploration. Fenêtre de suivi — suivre la cadence habituelle d’exploration du site et comparer avec des pages prioritaires similaires, sans supposer une visite immédiate. Déclencheur de retour arrière — ne retirer le nouveau lien que s’il crée une navigation indésirable ou un chemin vers une URL dupliquée ; sinon, diagnostiquer les signaux restants.
Test : la correction de capacité serveur rétablit l’exploration
Test à exécuter — déployer le correctif serveur et comparer, dans les journaux, le volume de requêtes Googlebot, le temps de réponse et les erreurs. Résultat attendu — les requêtes réussies des robots reviennent sans le profil antérieur d’erreurs ou de latence. Interprétation d’un échec — la contrainte de capacité subsiste, ou la demande d’exploration plutôt que la capacité constitue le facteur limitant. Fenêtre de suivi — comparer plusieurs cycles d’exploration et les mêmes jours et heures que la référence avant correction. Déclencheur de retour arrière — revenir en arrière si le déploiement augmente les erreurs ou la latence rencontrées par les robots.
Mesurer le problème
Population « Découverte, actuellement non indexée »
Métrique — nombre et part des URL canoniques soumises dans ce statut, avec votre propre inventaire de sitemap ou d’URL comme dénominateur, et non les seuls exemples du rapport. Ce qu’elle révèle — si le retard augmente plus vite que Google n’explore les URL. Comment l’obtenir — exporter le rapport Indexation des pages et segmenter par sitemap ou gabarit. La liste d’exemples est limitée à 1 000 URL par statut et n’est pas forcément exhaustive : traitez-la comme un échantillon, pas un recensement. Référence ou plage réaliste — établir une base par gabarit ; l’objectif utile est un retard en baisse pour l’inventaire prioritaire, pas un pourcentage universel. Cadence — chaque semaine pendant la correction, puis chaque mois.
Délai entre découverte et première exploration
Métrique — temps écoulé entre publication ou inclusion au sitemap et première requête de Googlebot. Ce qu’elle révèle — si les changements de priorité et de capacité améliorent la planification. Comment l’obtenir — joindre les horodatages de publication ou du sitemap aux premières requêtes observées dans les journaux serveur. Référence ou plage réaliste — comparer des types de pages comparables sur votre site ; la cadence varie trop pour un seuil universel. Cadence — chaque mois ou après une modification importante de gabarit ou de serveur.
Réussite et gaspillage des robots
Métrique — requêtes Googlebot réussies vers les URL importantes par rapport aux erreurs et aux modèles d’URL de faible valeur. Ce qu’elle révèle — si la capacité est consacrée à l’inventaire qui vous importe. Comment l’obtenir — segmenter les journaux serveur par code d’état et modèle d’URL. Référence ou plage réaliste — utiliser la répartition avant changement comme base et exiger une hausse de la part prioritaire sans augmentation des erreurs. Cadence — chaque semaine pendant le diagnostic, puis chaque mois une fois la situation stabilisée.
Prompts d’analyse du retard
Trouver les causes au niveau des gabarits
Regroupe cet export d’URL « Découverte, actuellement non indexée » par gabarit et modèle d’URL. Pour chaque groupe, compare la présence dans le sitemap, le nombre de liens internes, la date de publication et la date de première apparition dans les journaux serveur. Classe les hypothèses de capacité, de gaspillage et de demande d’exploration selon les preuves. N’affirme aucune cause lorsque les preuves nécessaires sont absentes.
Prioriser un échantillon de correction
Sélectionne un jeu de test représentatif parmi ces URL : pages très prioritaires et peu prioritaires, récentes et anciennes, ainsi que chaque gabarit principal. Propose une seule modification par hypothèse et précise le signal de réussite observable et le déclencheur de retour arrière. Données : [coller les lignes].
Testez vos connaissances
Ressources utiles
Mes articles associés
- Corriger les URL découvertes mais actuellement non indexées — mon guide Ahrefs sur cinq axes de diagnostic : budget d’exploration, qualité du contenu, maillage interne, backlinks et problèmes techniques, avec leurs correctifs.
- Guide du débutant sur le SEO technique — place de l’exploration et de l’indexation dans l’ensemble du SEO technique.
Sources officielles
- Rapport sur l’indexation des pages de Google — source des deux définitions de statut.
- Optimiser le budget d’exploration selon Google — capacité et demande d’exploration ; le document cite explicitement cette catégorie.
Autres sources
- Google explique comment corriger les URL découvertes mais non indexées (Search Engine Journal) — compte rendu du cadre capacité-qualité présenté par Mueller.
- Comprendre et résoudre le statut des URL découvertes mais non indexées (Search Engine Land) — démarche de diagnostic de Dan Taylor.
- Corriger les URL découvertes mais actuellement non indexées (Onely) — analyse technique pour distinguer capacité et qualité, notamment avec les journaux serveur.
- Commentaires de Google sur les URL découvertes mais actuellement non indexées (Search Engine Roundtable) — compte rendu par Barry Schwartz des commentaires de représentants de Google sur ce statut.
- r/TechSEO — communauté consacrée au diagnostic de l’exploration et de l’indexation.
Journal des modifications
Mis à jour le 22 août 2026.
Résumé éditorial et détails enregistrés des changements.Détails des changements
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
Comparaison complète indisponible — aucun instantané antérieur n’a été archivé pour cette révision.
Mis à jour le 22 août 2026.
Résumé éditorial et détails enregistrés des changements.Détails des changements
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
Comparaison complète indisponible — aucun instantané antérieur n’a été archivé pour cette révision.
Mis à jour le 17 juil. 2026.
Résumé éditorial et détails enregistrés des changements.Détails des changements
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
Comparaison complète indisponible — aucun instantané antérieur n’a été archivé pour cette révision.