Rapport d'indexation des pages (GSC)
Comment fonctionne le rapport d'indexation des pages de Google Search Console, anciennement Index Coverage : pages indexées ou non, colonne Source, tous les états, Validate fix et délai du rapport.
Le rapport d'indexation des pages, anciennement Index Coverage et désormais intitulé Pages sous Indexation dans Google Search Console, indique combien d'URL sont indexées ou non, puis regroupe les URL non indexées par motif dans la table Pourquoi les pages ne sont pas indexées. C'est un rapport agrégé à l'échelle de la propriété : pour une page précise, utilisez Inspection d'URL. Une page non indexée n'est pas forcément un problème : canonical/duplicate, noindex, robots.txt et 404 intentionnelles sont des résultats corrects, et Google dit qu'il faut seulement s'attendre à l'indexation des pages canoniques. Filtrez par Source = Website, travaillez la table de haut en bas et utilisez Validate fix, généralement sous deux semaines, pour demander un nouveau crawl.
Preuve à l’appui de cette affirmation The Page indexing report shows indexed and not-indexed pages known to Google and groups non-indexing by reason. Portée : Current Page indexing report terminology and behavior. Niveau de confiance : élevé · Vérifié : Google Search Console: Page indexing report Preuve à l’appui de cette affirmation The Page indexing report is for site-wide patterns; URL Inspection provides the indexed and live-test details for an individual URL. Portée : Current distinction between Page indexing and URL Inspection. Niveau de confiance : élevé · Vérifié : Google Search Console: URL Inspection toolTL;DR — Le rapport d’indexation des pages de Google Search Console indique combien de pages Google a indexées (et peut afficher dans la recherche) contre combien ne sont pas indexées, et précise pourquoi pour ces dernières. Il s’appelait autrefois Index Coverage. « Non indexée » semble inquiétant, mais ne l’est généralement pas : de nombreuses URL sont censées rester hors de l’index.
Qu’est-ce que le rapport d’indexation des pages ?
Lorsque vous ouvrez Google Search Console et cliquez sur Pages sous Indexation dans le menu de gauche, vous arrivez au rapport d’indexation des pages. Google le décrit simplement : il permet de « voir quelles pages Google peut trouver et indexer sur votre site, et de connaître les problèmes d’indexation rencontrés ».
Le rapport répartit toutes les URL que Google connaît sur votre site en deux catégories :
- Indexées — ces pages peuvent apparaître dans Google Search.
- Non indexées — ces pages ne figurent pas dans l’index, soit parce qu’un élément est cassé, soit pour une raison parfaitement correcte (page dupliquée, blocage, directive demandant de ne pas indexer, etc.).
En dessous, la table « Pourquoi les pages ne sont pas indexées » liste les motifs et le nombre d’URL qui relèvent de chacun. C’est cette table qui sert réellement au travail.
Pourquoi « non indexée » n’est généralement pas une crise
Voici ce que beaucoup de personnes manquent lors de leur première ouverture du rapport : non indexée ne signifie pas cassée. L’aide du rapport le dit clairement : « Not indexed is not necessarily bad. » Vous ne devez pas vous attendre à ce que toutes les URL de votre site soient indexées. Pages de tags, variantes filtrées d’une liste produit, anciennes URL redirigées, doublons : que Google les laisse de côté signifie souvent que le rapport fonctionne correctement.
Lorsque le nombre « non indexées » est élevé, ne paniquez donc pas. Lisez d’abord les motifs qui le composent avant de modifier quoi que ce soit.
Ce n’est pas le bon outil pour vérifier une page
Ceci est une vue d’ensemble de tout votre site. Pour savoir si une URL précise est indexée, ce n’est pas le bon rapport : utilisez l’outil Inspection d’URL (la barre de recherche en haut de Search Console). Google est explicite. Le rapport sert aux tendances et aux regroupements ; Inspection d’URL sert à une page à la fois.
En avez-vous vraiment besoin ?
Si votre site compte moins de 500 pages, Google dit que vous n’avez « probablement pas besoin d’utiliser ce rapport » : une recherche site:votresite.com suffit pour contrôler ponctuellement ce qui est indexé. Le rapport devient utile sur les sites plus importants, où il est impossible de tout vérifier à l’œil.
Vous voulez la version complète — lire chaque colonne, comprendre les 16 états, voir comment fonctionne « Validate fix » et diagnostiquer une baisse soudaine des pages indexées ? Ouvrez l’onglet Avancé.
Preuve à l’appui de cette affirmation The Page indexing report shows indexed and not-indexed pages known to Google and groups non-indexing by reason. Portée : Current Page indexing report terminology and behavior. Niveau de confiance : élevé · Vérifié : Google Search Console: Page indexing report Preuve à l’appui de cette affirmation The Page indexing report is for site-wide patterns; URL Inspection provides the indexed and live-test details for an individual URL. Portée : Current distinction between Page indexing and URL Inspection. Niveau de confiance : élevé · Vérifié : Google Search Console: URL Inspection toolTL;DR — Le rapport d’indexation des pages, anciennement Index Coverage et désormais Pages sous Indexation dans GSC, est une vue agrégée de toutes les URL que Google connaît dans votre propriété, séparées entre Indexées et Non indexées, les secondes étant regroupées par motif. Il ne sert pas aux pages individuelles : c’est le rôle d’Inspection d’URL. Une page non indexée n’est pas forcément mauvaise : canonical/duplicate, noindex, robots.txt et 404 intentionnelles sont des résultats corrects ; Google dit qu’il faut seulement attendre l’indexation des pages canoniques. Filtrez par Source = Website, travaillez de haut en bas et utilisez Validate fix pour demander un recrawl. Le rapport a un délai.
Ce qu’est réellement le rapport (et son ancien nom)
La définition en une ligne de Google est la plus claire : le rapport permet de « voir quelles pages Google peut trouver et indexer sur votre site, et de connaître les problèmes d’indexation rencontrés ». Plus précisément, il « montre l’état d’indexation Google de toutes les URL que Google connaît dans votre propriété ». C’est un rapport agrégé à l’échelle de la propriété, pas un outil par URL.
Si vous faites du SEO depuis plusieurs années, vous le connaissiez sous le nom de rapport Index Coverage. Google l’a renommé Page indexing en 2022 (il apparaît comme « Pages » dans la navigation), si bien que de nombreux anciens guides et habitudes continuent de parler de « Coverage ». C’est le même rapport. Le changement de nom a été aperçu dans une démonstration Google I/O 2022 puis déployé plus tard ; une mise à jour de la qualité des données de janvier 2021 avait déjà remanié plusieurs états, raison pour laquelle d’anciennes captures d’écran diffèrent de l’interface actuelle.
Comment lire le rapport
La vue récapitulative comporte plusieurs éléments à comprendre avant de cliquer.
Indexées contre Non indexées. Ce sont les deux totaux au-dessus du graphique. Google précise qu’ils sont « complets et exacts de son point de vue, mais que de petits écarts peuvent survenir pour diverses raisons ». Vous pouvez cliquer sur « Voir les données sur les pages indexées » pour consulter l’historique du nombre indexé et un échantillon de 1 000 URL indexées au maximum.
La table « Pourquoi les pages ne sont pas indexées ». C’est le cœur du rapport. Elle « montre les problèmes qui ont empêché l’indexation des URL de votre site », triés selon les problèmes que Google juge les plus importants à traiter. Commencez par le haut : l’ordre est déjà une liste de priorités.
La colonne Source — votre filtre de correction. Chaque problème vient soit de Google, soit du site ; Google le précise : « La valeur Source indique si la source du problème est Google ou le site. En général, vous ne pouvez corriger que les problèmes dont la source est “Website”. » Ainsi Source = Website, avec un état de validation « failed » ou « not started », constitue votre vraie liste de travail. Les états dont la source est Google ne sont généralement pas à corriger par vous.
La table « Améliorer l’expérience sur la page ». Il s’agit d’une table séparée pour les « problèmes qui n’ont pas empêché l’indexation, mais que nous vous recommandons de corriger ». Ce sont des avertissements, pas des bloqueurs.
Le filtre sitemap. Au-dessus du graphique, vous pouvez limiter le rapport à Toutes les pages connues, Toutes les pages envoyées, Pages non envoyées uniquement ou à un sitemap précis. Une URL est considérée comme envoyée par un sitemap même si elle a aussi été découverte par un autre mécanisme.
Les listes d’URL exemples sont plafonnées. L’échantillon des URL concernées est limité à 1 000 éléments et ne garantit pas de montrer toutes les URL de l’état. Traitez ces exemples comme un échantillon, et non comme l’export complet du groupe.
Ordre de triage si vous n’avez que dix minutes. Limitez le rapport au sitemap qui représente l’inventaire d’URL que vous voulez réellement indexer. Cherchez d’abord un changement inattendu dans les totaux : une hausse ou une baisse est plus urgente qu’un niveau stable. Filtrez Source = Website, puis donnez la priorité aux modèles ou motifs d’URL essentiels à l’activité. Corrigez tout le motif, pas une seule URL, avant de valider.
Rapport contre Inspection d’URL — utilisez le bon outil
Google dit : « Ce rapport ne sert pas à examiner l’état d’indexation de pages précises. Pour trouver l’état d’indexation d’une page précise, utilisez l’outil Inspection d’URL. »
- Rapport d’indexation des pages = tendances agrégées, regroupées par motif, à l’échelle de la propriété.
- Inspection d’URL = état actuel et indexé d’une URL, canonical choisi par Google et option « Tester l’URL publiée ».
Lorsqu’un état vous déroute, prenez une URL exemple et inspectez-la. Les deux outils ont été conçus pour fonctionner ensemble.
Le délai : le rapport est en retard sur la réalité
Le rapport n’est pas en temps réel : il reflète le dernier crawl de chaque URL et les compteurs bougent lorsque Google recrawl. Google indique qu’il met à jour le nombre d’instances chaque fois qu’il explore une page présentant des problèmes connus, que vous ayez ou non demandé une validation. John Mueller a décrit le rapport d’indexation comme étant en retard : il s’agit surtout d’un décalage temporel, le rapport rattrapant progressivement un état déjà modifié. Ne réagissez pas trop vite à un chiffre qui peut simplement être ancien.
Le test en direct d’Inspection d’URL confirme si Google peut actuellement crawler et indexer l’URL, mais ne dit pas quel canonical Google choisira parmi plusieurs doublons. Le choix du canonical est une décision d’indexation distincte, prise sur les données indexées. Pour les états canonical/duplicate, le résultat indexé d’Inspection d’URL est le signal à suivre, même s’il peut encore être en retard sur votre dernière modification.
Où aller ensuite — tous les états, regroupés
La table « Pourquoi les pages ne sont pas indexées » est la carte du reste de cette section. Chaque état ci-dessous possède son propre guide. Certains se corrigent, d’autres se confirment puis se laissent en place.
Non indexées — choix de Google (souvent rien à corriger)
- Découverte – actuellement non indexée — Google a trouvé l’URL mais ne l’a pas encore crawlée. Généralement un signal de demande de crawl ou de qualité du site.
- Explorée – actuellement non indexée — Google a crawlée la page et a choisi de ne pas l’indexer (pour l’instant), souvent pour des raisons de qualité ou de duplication.
Bloquées par vous (intentionnel — confirmer le choix)
- Bloquée par robots.txt — votre robots.txt a demandé à Google de ne pas la crawler.
- URL marquée noindex — Google a trouvé une directive noindex en essayant de l’indexer.
Erreurs HTTP (généralement à corriger)
- Bloquée en raison d’une requête non autorisée (401) — la page a demandé à Googlebot de s’authentifier.
- Bloquée en raison d’un accès interdit (403) — l’accès n’a pas été accordé au crawler.
- Bloquée pour une autre erreur 4xx — erreur 4xx différente de celles nommées.
- Erreur de serveur (5xx) — le serveur a renvoyé une erreur de niveau 500.
- Introuvable (404) — l’URL a renvoyé une 404.
Canonical et doublons (généralement correct — vérifier le canonical choisi)
- Page alternative avec balise canonical correcte — la page pointe vers son canonical, qui est indexé. Tout fonctionne comme prévu.
- Doublon sans canonical sélectionné par l’utilisateur — Google a choisi une autre page comme canonical, sans déclaration de votre part.
- Doublon, Google a choisi un canonical différent de celui de l’utilisateur — alignez les signaux plutôt que d’ajouter une balise plus forte.
Redirections (une normale, une défectueuse)
- Page avec redirection — URL non canonique qui redirige vers une autre page. C’est normal : c’est la destination qui est indexée.
- Erreur de redirection — chaîne trop longue, boucle, cible vide ou incorrecte, ou URL dépassant la longueur maximale. Celle-ci se corrige.
Avertissements (indexées, mais à examiner)
- Indexée malgré un blocage robots.txt — Google a indexé la page malgré le blocage ; il ne peut pas lire son contenu ni un éventuel noindex.
- Page indexée sans contenu — indexée, mais Google n’a pas pu lire un contenu significatif, souvent à cause du rendu.
Les groupes canonical/duplicate, noindex, robots et 404 intentionnelles sont souvent corrects — Google dit : « You should not expect all URLs on your site to be indexed, only the canonical pages. » Les groupes à poursuivre sont les erreurs HTTP, erreurs de redirection et accumulations inattendues de pages explorées ou découvertes actuellement non indexées.
Corriger et valider
- Corrigez chaque occurrence du problème sur le site.
- Ouvrez les détails et cliquez sur Validate fix.
- Ne recliquez pas avant que la validation ait réussi ou échoué.
La validation prend généralement jusqu’à environ deux semaines, mais peut durer beaucoup plus longtemps. La demande passe par Not started, Started, Looking good, Passed, Failed ou N/A si Google a constaté la correction seul. Google peut aussi détecter les corrections sans demande, mais la validation fournit un résultat suivi.
Astuce de rapidité : validez un sous-ensemble. Envoyez un sitemap contenant les pages importantes, filtrez le rapport sur ce sitemap, puis demandez la validation ; une demande sur un sous-ensemble peut se terminer plus vite.
Diagnostiquer les baisses, hausses et « plus de non-indexées que d’indexées »
- Les pages indexées baissent sans nouvelle erreur. Vous avez probablement bloqué des pages existantes avec robots.txt, noindex ou une exigence de connexion. Cherchez une hausse correspondante dans un état non indexé.
- Plus de pages non indexées qu’indexées. Il s’agit souvent d’une règle robots.txt sur une grande section ou d’un flot de doublons produit par les paramètres de filtre et de tri. C’est un problème de navigation à facettes et de canonicalisation.
- Hausse soudaine d’une erreur. Une modification de modèle peut avoir introduit une erreur sur de nombreuses URL, ou un sitemap peut contenir des URL bloquées, noindexées ou supprimées.
Quelques repères à conserver
- Indexée ≠ classée. Indexée signifie seulement éligible à l’affichage dans Search.
- Une couverture de 100 % n’est pas le but. Seules les pages canoniques doivent être indexées ; un site sain a des URL volontairement non indexées.
- Validate fix ne réindexe pas instantanément. Il demande un recrawl ; prévoyez environ deux semaines.
- Les données GSC ont des limites. Les exemples plafonnent à 1 000 URL, les totaux peuvent diverger et le rapport est en retard. Anonymized Queries Make Up Nearly Half of GSC Traffic le rappelle.
Une phrase sur Bing
Bing n’a pas d’équivalent unique au rapport Page Indexing. La vue agrégée la plus proche est Site Explorer de Bing Webmaster Tools, répartie entre pages indexées, erreurs, avertissements et exclues ; Inspection d’URL couvre une URL. Utilisez Site Explorer pour la vue d’ensemble et Inspection d’URL pour une page.
Cette page est le hub du rapport d’indexation. Pour le pipeline complet — découverte, crawl, rendu, indexation et diffusion — consultez le cluster How Search Works.
Résumé IA
Une synthèse de la version Avancé :
- Ce que c’est : le rapport d’indexation des pages de Google Search Console, anciennement Index Coverage, affiché comme Pages sous Indexation. Il montre l’état d’indexation de toutes les URL connues dans la propriété, entre Indexées et Non indexées.
- Agrégé, pas par URL. Pour une page précise, utilisez Inspection d’URL.
- Non indexée n’est pas forcément mauvais. Canonical/duplicate, noindex, robots.txt et 404 intentionnelles sont des résultats corrects ; seules les pages canoniques doivent être attendues dans l’index.
- La table « Pourquoi les pages ne sont pas indexées » est prétriée par importance : travaillez de haut en bas. Filtrez Source = Website pour trouver ce que vous pouvez réellement corriger.
- 16 états regroupés : choix de Google (découverte/explorée actuellement non indexée), blocage volontaire (robots.txt, noindex), erreurs HTTP (401, 403, autre 4xx, 5xx, 404), canonical/doublons, redirections et avertissements.
- Corriger puis Validate fix prend généralement environ deux semaines. Pour aller plus vite, filtrez un sitemap contenant vos pages prioritaires et validez le sous-ensemble.
- Le rapport est en retard sur la réalité. Mueller l’a décrit comme un rapport qui rattrape progressivement l’état du site.
- Diagnostic : baisse des pages indexées sans erreur = blocage ; plus de non indexées = robots.txt ou doublons de paramètres ; hausse d’erreur = changement de modèle ou mauvais sitemap.
- Les petits sites de moins de 500 pages n’en ont probablement pas besoin : une recherche site: suffit.
- Bing : pas d’équivalent direct ; Site Explorer pour l’agrégat, Inspection d’URL pour une page.
Documentation officielle
Documentation primaire des moteurs de recherche.
- Rapport d’indexation des pages — aide Search Console : groupes, colonne Source, états, filtre sitemap et parcours Validate fix.
- Améliorations des données Index Coverage (janvier 2021) — mise à jour ayant remanié plusieurs états.
- Outil Inspection d’URL — complément par URL du rapport.
Bing / Microsoft
- Bing Webmaster Tools — Inspection d’URL — vue Bing par URL de l’index, du SEO et du balisage.
- Bing Webmaster Tools — Site Explorer — analogue agrégé le plus proche du rapport Page Indexing de GSC.
Citations de la source
Déclarations publiques de Google. Chaque lien profond ouvre le passage cité sur la page source.
Google — définition et contenu du rapport
- “See which pages Google can find and index on your site, and learn about any indexing problems encountered.” — Aide Search Console. Aller à la citation
- “The Page indexing report shows the Google indexing status of all URLs that Google knows about in your property.” Aller à la citation
Google — rapport contre page et personne qui peut corriger
- “This report isn’t used to investigate the index status of specific pages. To find the index status of a specific page, use the URL Inspection tool.” Aller à la citation
- “The Source value in the table shows whether the source of the issue is Google or the website. In general, you can fix only issues where the source is listed as “Website”.” Aller à la citation
Google — « non indexée » n’est pas forcément mauvais
- “Not indexed is not necessarily bad.” Aller à la citation
- “You should not expect all URLs on your site to be indexed, only the canonical pages.” Aller à la citation
Google — besoin et délai de validation
- “If your site has fewer than 500 pages, you probably don’t need to use this report.” Aller à la citation
- “Validation typically takes up to about two weeks, but in some cases can take much longer, so please be patient.” Aller à la citation
Gary Illyes, Google — sur crawled – currently not indexed et la qualité du site
- “And the general quality of the of the site, that can matter a lot of how many of these crawled but not indexed you see in search console. If the number of these URLs is very high that could hint at general quality issues.” Lire l’analyse
John Mueller, Google — sur le délai du rapport
- “It’s just a report that’s kind of lagging behind.” Mueller a précisé que c’était “more a matter of timing”. Lire l’analyse
Travailler le rapport d’indexation — liste de contrôle
Un passage reproductible pour trier le rapport au lieu de le regarder sans méthode :
- Notez les totaux Indexées contre Non indexées et leur tendance.
- Ouvrez la table « Pourquoi les pages ne sont pas indexées » et travaillez de haut en bas.
- Filtrez par Source = Website : ce sont les problèmes réellement corrigeables.
- Pour chaque problème, prélevez une URL exemple et utilisez Inspection d’URL.
- Séparez les états intentionnels (noindex, robots bloqué, alternative avec canonical, page avec redirection) des états cassés (5xx, 404, erreur de redirection, 4xx inattendue).
- Pour les états canonical/duplicate, vérifiez le canonical choisi par Google avant toute correction.
- Si explorée/découverte – actuellement non indexée est élevé, traitez-le comme un signal de qualité ou de demande de crawl à l’échelle du site.
- Comparez une baisse des pages indexées à une hausse d’un état non indexé.
- Corrigez toutes les occurrences, puis cliquez sur Validate fix.
- Pour valider plus vite, filtrez un sitemap de pages prioritaires.
- Souvenez-vous du délai : accordez environ deux semaines aux changements.
Les modèles mentaux
1. Rapport = agrégat ; Inspection d’URL = page unique. Le rapport d’indexation montre les motifs à l’échelle du site. Inspection d’URL montre la vérité sur une URL : état en direct, canonical choisi et rendu. Associez toujours les deux : repérez un motif dans le rapport, confirmez la cause avec Inspection.
2. Non indexée ≠ cassée. Face à un grand nombre de non-indexées, demandez-vous « quels sont les motifs ? », pas « dois-je tout corriger ? ». Canonical/duplicate, noindex, robots et 404 intentionnelles sont corrects. Google attend seulement vos pages canoniques dans l’index.
3. Source = Website est votre liste de travail. La colonne Source sépare le choix de Google de votre choix. Vous ne pouvez déplacer que les problèmes du site. Filtrer Source = Website, avec un état Failed ou Not started, transforme une table inquiétante en liste actionnable.
4. L’ordre est une liste de priorités. Google trie la table « Pourquoi les pages ne sont pas indexées » par importance. Ne créez pas votre propre ordre : commencez par le haut.
5. Validate fix est une demande de recrawl, pas un interrupteur. Le clic demande à Google de revérifier les URL connues ; il faut environ deux semaines et la demande peut échouer. Pour accélérer, limitez-la à un sitemap de pages prioritaires.
6. Le rapport est toujours un peu en retard. Il reflète le dernier crawl par URL et se met à jour au recrawl. Chaque lecture est un instantané retardé, pas la vérité en direct.
Fiche mémo du rapport d’indexation
Les deux rapports souvent confondus
| Question | Utiliser |
|---|---|
| Comment tout mon site est-il indexé et pourquoi des pages ne le sont-elles pas ? | Rapport d’indexation des pages |
| Cette URL est-elle indexée ? Quel canonical Google a-t-il choisi ? | Inspection d’URL |
Les 16 états, regroupés
| Groupe | États | Réaction habituelle |
|---|---|---|
| Choix de Google (non indexées) | Découverte – actuellement non indexée · Explorée – actuellement non indexée | Signal de qualité ou de demande de crawl ; pas une correction page par page |
| Bloquées par vous | Bloquée par robots.txt · URL marquée noindex | Confirmer que c’est intentionnel |
| Erreurs HTTP | 401 · 403 · autre 4xx · 5xx · 404 | Corriger |
| Canonical et doublons | Page alternative avec canonical correct · Doublon sans canonical · Doublon, canonical Google différent | Généralement correct ; vérifier le canonical choisi |
| Redirections | Page avec redirection (normal) · Erreur de redirection (cassée) | Corriger seulement l’erreur |
| Avertissements | Indexée malgré robots.txt · Page indexée sans contenu | Indexée, mais à examiner |
Faits rapides
- Ancien nom : rapport Index Coverage, renommé Page indexing en 2022.
- Source = Website = problèmes que vous pouvez corriger.
- Validate fix ≈ deux semaines ; limitez à un petit sitemap pour accélérer.
- Les listes d’URL exemples plafonnent à 1 000 et le rapport a un délai.
- Indexée ≠ classée : indexée signifie seulement éligible à l’affichage.
- Moins de 500 pages ? Vous n’avez probablement pas besoin de ce rapport ; utilisez une recherche site:.
Problèmes courants
Symptôme → cause probable → correction, pour les motifs qui ramènent réellement à ce rapport.
Des pages de connexion, d’accès refusé ou d’application vide sont indexées
Exemple : /account/invoices/123 doit exiger une connexion. Pour un crawler déconnecté, elle renvoie 200 OK, une directive robots indexable et une coque HTML marquée dont le contenu principal dit « Sign in to continue ». Des liens internes ou un ancien sitemap exposent des milliers d’URL de factures. Google ne contourne pas la connexion : il indexe la coque 200 explorable que l’application sert.
Inspectez plusieurs URL déconnecté et comparez le statut HTTP, le canonical, les directives robots et le contenu principal rendu. La correction est généralement au niveau du modèle : exiger l’authentification avant de servir la ressource, renvoyer 401, 403, 404 ou 410 selon le modèle d’accès, retirer les URL des sitemaps et de la navigation crawlable, ou servir noindex si la coque publique doit rester accessible. Vérifiez la réponse en direct et l’état indexé ; corriger un seul exemple ne prouve pas que le motif de route est résolu.
Le nombre de pages indexées baisse sans nouvelle erreur
- Symptôme : le total Indexées baisse, sans hausse correspondante dans une erreur.
- Cause probable : des pages indexées ont été bloquées par une nouvelle règle robots.txt, un noindex de modèle ou une exigence de connexion.
- Correction : cherchez une hausse dans un état non indexé non HTTP, inspectez une URL exemple et vérifiez les directives robots en direct avec robots-txt-tester (/tools/robots-txt-tester).
« Plus de non indexées que d’indexées »
- Symptôme : le total Non indexées est supérieur au total Indexées sur un site établi.
- Cause probable : règle robots.txt sur une grande section ou flot de doublons issus de paramètres de filtre et de tri.
- Correction : comparez le motif aux balises canonical avec canonical-checker (/tools/canonical-checker) et confirmez que les URL sont réellement des doublons avant de les regrouper. C’est un problème de navigation à facettes/canonicalisation, pas un bug du rapport.
Hausse soudaine d’un état d’erreur HTTP
- Symptôme : 401, 403, 404 ou 5xx augmente sur de nombreuses URL après une mise en ligne.
- Cause probable : changement de modèle cassant l’authentification, la redirection ou la page d’erreur, ou sitemap rempli d’URL bloquées, noindexées ou supprimées.
- Correction : prélevez des URL dans le détail de l’état et vérifiez leur statut avec http-status-checker (/tools/http-status-checker). Si le sitemap est en cause, auditez-le avec sitemap-validator (/tools/sitemap-validator).
« Erreur de redirection » et non « Page avec redirection »
- Symptôme : le rapport affiche Redirect error, différent de Page with redirect.
- Cause probable : chaîne trop longue, boucle, cible vide/mal formée ou dépassant la longueur maximale.
- Correction : tracez les sauts avec redirect-chain-mapper (/tools/redirect-chain-mapper) et réduisez à un saut vers l’URL finale.
« Validate fix » revient Failed
- Symptôme : le problème a été corrigé, Validate fix lancé, mais l’état est Failed.
- Cause probable : la correction n’a pas atteint toutes les URL (cache CDN, déploiement limité à la recette ou modèle incomplet) ou Google a recrawlé avant la propagation.
- Correction : contrôlez directement plusieurs URL concernées, avec la source ou un test HTTP/robots, puis demandez à nouveau la validation. Inutile d’attendre un cycle complet si la correction sous-jacente est confirmée.
Tests de validation
Prouver qu’une correction a changé la réalité sous-jacente du rapport, et pas seulement son libellé.
Confirmer que le statut en direct d’une page bloquée est attendu
- Test : http-status-checker (/tools/http-status-checker) ou curl -I sur l’URL.
- Résultat attendu : le code voulu — 200 pour débloquer, ou 301/404 volontaire pour retirer la page.
- Interprétation d’un échec : l’ancien 401/403/5xx persiste ; la correction n’est pas déployée partout. Vérifiez CDN, répartiteur et environnement.
- Fenêtre : immédiate, car le statut HTTP est en direct.
- Retour arrière : le statut reste incorrect après purge du cache ; annulez et rediagnostiquez avant toute nouvelle mise en production.
Confirmer qu’une correction robots.txt débloque réellement l’URL
- Test : robots-txt-tester (/tools/robots-txt-tester) sur le chemin précis.
- Résultat attendu : l’URL est autorisée pour Googlebot.
- Interprétation d’un échec : la règle existe encore, une règle plus précise correspond ou le mauvais robots.txt a été vérifié.
- Fenêtre : immédiate pour le fichier ; accordez un cycle de crawl normal avant l’évolution de l’état GSC.
- Retour arrière : l’URL reste bloquée après vérification du fichier de production.
Confirmer qu’une correction canonical a produit le résultat voulu
- Test : canonical-checker (/tools/canonical-checker), puis Inspection d’URL pour le canonical choisi par Google.
- Résultat attendu : la balise link canonical correspond à l’URL voulue et Inspection montre l’accord de Google.
- Interprétation d’un échec : le tag est corrigé mais les signaux de duplication restent contradictoires : liens internes, sitemap et redirections doivent converger.
- Fenêtre : 2 à 4 semaines ; le choix de canonical est lent à se stabiliser.
- Retour arrière : le canonical choisi diverge après quatre semaines et un cycle Validate fix ; corrigez les signaux, pas seulement la balise.
Confirmer qu’une correction de redirection a supprimé la chaîne ou la boucle
- Test : redirect-chain-mapper (/tools/redirect-chain-mapper).
- Résultat attendu : un seul saut vers la destination finale, qui renvoie 200.
- Interprétation d’un échec : plusieurs sauts ou boucle ; une nouvelle règle s’est ajoutée à une ancienne au lieu de la remplacer.
- Fenêtre : immédiate pour la chaîne, puis un cycle de recrawl avant GSC.
- Retour arrière : plus d’un saut persiste ; consolidez les règles à la source.
Confirmer que la demande « Validate fix » a réellement réussi
- Test : bouton Validate fix sur l’état concerné du rapport, idéalement limité à un sitemap prioritaire.
- Résultat attendu : l’état devient Passed ou N/A, ce qui signifie que Google a confirmé la correction indépendamment.
- Interprétation d’un échec : Failed signifie que Google a encore trouvé le problème sur au moins certaines URL ; revenez à la correction, ne recliquez pas mécaniquement.
- Fenêtre : généralement jusqu’à deux semaines, parfois davantage.
- Retour arrière : deux échecs consécutifs après confirmation de la correction ; vérifiez que chaque motif d’URL reçoit réellement le changement.
Comment mesurer
Les KPI à suivre dans le temps, et non des contrôles isolés.
Nombre de pages indexées (tendance, pas instantané)
- Ce que cela indique : si l’empreinte indexée du site progresse, stagne ou diminue.
- Comment l’obtenir : total Indexées en haut du rapport ou graphique historique sous « Voir les données sur les pages indexées ».
- Référence réaliste : aucune valeur universelle ; elle dépend du nombre de pages canoniques que vous voulez indexer. Suivez la tendance contre ce nombre, pas une couverture de 100 %.
- Cadence : mensuelle, ou immédiatement après une grande modification de contenu ou de structure d’URL.
Total « Pourquoi les pages ne sont pas indexées », Source = Website
- Ce que cela indique : la taille de votre liste réellement actionnable.
- Comment l’obtenir : filtrez la table par Source = Website et additionnez les URL des états Failed ou Not started.
- Référence réaliste : aucune cible honnête universelle. Établissez une base lors de votre prochain passage complet et suivez sa diminution.
- Cadence : mensuelle, ou hebdomadaire pendant un nettoyage ou une migration.
Nombre d’états d’erreur HTTP (401/403/404/5xx)
- Ce que cela indique : si les pages censées être servies sont cassées pour Googlebot ; c’est le groupe presque toujours utile à corriger.
- Comment l’obtenir : lignes individuelles du rapport, recoupées avec http-status-checker sur un échantillon d’URL.
- Référence réaliste : zéro pour les URL canoniques que vous voulez garder ; les 404 attendues sur des pages supprimées sont normales.
- Cadence : après chaque mise en ligne touchant routage, authentification ou modèles ; sinon mensuelle.
Taux de réussite des corrections validées
- Ce que cela indique : si les corrections atteignent toutes les URL.
- Comment l’obtenir : suivez chaque demande dans sa vue d’état (Passed, Failed, N/A).
- Référence réaliste : aucune cible fixe ; un schéma sain résout la plupart des demandes en Passed ou N/A au premier essai. Les échecs répétés sont le signal.
- Cadence : par cycle de correction, environ deux semaines après la demande.
Outils
Le rapport montre ce que Google pense être incorrect ; ces outils confirment et corrigent la cause sous-jacente.
Outils de ce site
- gsc-workbench (/tools/gsc-workbench) — travailler avec ses données GSC via l’API.
- gsc-regex-tester (/tools/gsc-regex-tester) — tester les filtres regex des rapports GSC.
- http-status-checker (/tools/http-status-checker) — confirmer les statuts 401/403/404/5xx.
- redirect-checker et redirect-chain-mapper — vérifier un saut ou retracer une chaîne.
- canonical-checker (/tools/canonical-checker) — vérifier la balise canonical.
- robots-txt-tester (/tools/robots-txt-tester) — tester le blocage d’une URL.
- sitemap-validator et xml-sitemap-generator — auditer ou reconstruire un sitemap.
- site-audit-lite (/tools/site-audit-lite) — contrôle de crawl plus large lorsqu’un motif est global.
Outils tiers
- Google Search Console — le rapport lui-même et Inspection d’URL.
- Bing Webmaster Tools — Site Explorer et Inspection d’URL.
- Screaming Frog — crawler le site comme Googlebot pour recouper statuts, redirections et canonicals.
Des ressources qui méritent votre temps
Mes articles associés
- How to Fix Discovered - currently not indexed — analyse détaillée de l’un des états les plus mal compris.
- How to Remove URLs From Google Search — lien avec noindex et l’outil de suppression.
- Anonymized Queries Make Up Nearly Half of GSC Traffic — étude GSC sur les limites des données.
- The Beginner’s Guide to Technical SEO — place de l’indexation et de GSC dans le SEO technique.
Mes présentations
- How Search Works (SlideShare) — crawl, rendu, indexation et classement.
Officiel
Dans l’écosystème
- r/TechSEO — communauté de dépannage de l’indexation.
- Google Explains Reasons For Crawled Not Indexed — Gary Illyes et les signaux de qualité.
- Mueller Asked About Lag in Google Search Console Indexing Report — délai du rapport.
- Google Search Console Coverage Report Renamed to Pages Report — changement de nom Index Coverage.
- Index Coverage Data Improvements — mise à jour de janvier 2021.
- Google Search Console Help — Page indexing report — référence officielle complète.
Quiz
Testez ce que vous retenez de la lecture du rapport d’indexation.
Journal des modifications
Mis à jour le 2 août 2026.
Résumé éditorial et détails enregistrés des changements.Détails des changements
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
Comparaison complète indisponible — aucun instantané antérieur n’a été archivé pour cette révision.