Guide de la navigation à facettes
La navigation à facettes permet de filtrer une catégorie par couleur, taille, prix ou marque, mais peut créer des millions d’URL presque identiques qui gaspillent le budget d’exploration et diluent les signaux de classement. Découvrez quelles URL de filtre indexer ou neutraliser, et comment choisir entre canonique, noindex et robots.txt.
Langues
La navigation à facettes est la première source de gaspillage d’exploration signalée aux moteurs : Gary Illyes l’estime à environ 50 % des problèmes d’exploration remontés à Google. Chaque combinaison de filtres peut créer sa propre URL explorable et transformer un catalogue de 10 000 produits en millions de pages presque identiques. La décision stratégique précède la technique : faites des combinaisons répondant à une demande réelle des pages de destination indexables, et empêchez les états purement fonctionnels de créer des URL explorables. robots.txt bloque l’exploration, pas l’indexation ; noindex retire une page de l’index sans économiser l’exploration ; la canonique consolide les signaux sans arrêter l’exploration. Google a supprimé l’outil Paramètres d’URL en 2022 ; Bing propose encore URL Normalization.
TL;DR — La navigation à facettes est l’ensemble des filtres d’une page de catégorie — couleur, taille, prix, marque. Ils sont utiles aux acheteurs, mais chaque filtre activé peut créer une nouvelle adresse web (URL). Sur une grande boutique, quelques milliers de pages produits peuvent ainsi devenir des millions de pages filtrées presque identiques, qui gaspillent l’attention limitée que les moteurs accordent au site. Il ne faut pas supprimer les filtres, mais décider quelles pages filtrées méritent d’apparaître dans Google et écarter les autres.
Qu’est-ce que la navigation à facettes ?
Sur presque toutes les pages de catégorie d’une boutique en ligne, un panneau — souvent placé à gauche — permet d’affiner la sélection : Couleur : bleu. Taille : grande. Marque : Samsung. Moins de 500 $. Chacun de ces critères est une facette ; l’ensemble du panneau constitue la navigation à facettes, aussi appelée « recherche à facettes » ou simplement « filtres de produits ».
L’expérience utilisateur est réellement bonne. Le problème est purement technique : il tient aux adresses web.
Pourquoi les filtres créent-ils un problème SEO ?
Lorsque vous activez un filtre, la plupart des boutiques modifient l’URL de la page afin de mémoriser votre choix. Par exemple :
example.com/sofas?color=blue
example.com/sofas?color=blue&size=large
example.com/sofas?color=blue&size=large&brand=ikeaChaque combinaison unique possède une URL distincte. C’est là que le calcul devient problématique : un catalogue de 10 000 produits, 20 couleurs, 15 tailles et quelques ordres de tri recèle des millions d’URL filtrées possibles. La plupart affichent presque la même poignée de produits qu’une autre URL.
Les moteurs de recherche essaient de visiter — explorer — et de conserver dans leur index les URL du site. Leur temps n’est pas illimité pour un domaine donné. S’ils le consacrent à des millions de pages filtrées presque identiques, ils n’explorent pas vos nouveaux produits. Gary Illyes, de Google, a indiqué que la navigation à facettes était la plainte d’exploration la plus fréquente reçue par Google, soit environ la moitié des cas.
L’erreur la plus fréquente
La solution n’est pas de supprimer les filtres : les acheteurs en ont besoin. Elle consiste à indiquer aux moteurs quelles pages filtrées comptent et lesquelles ne comptent pas :
- Une page filtrée correspondant à une recherche réelle et fréquente — par exemple « canapés en velours bleu » — peut mériter sa propre page de destination dans Google.
- Une page que personne ne recherche — “blue sofas sorted by price, page 3” (traduction) « canapés bleus triés par prix, page 3 » — relève uniquement de l’expérience utilisateur. Les acheteurs doivent pouvoir l’utiliser, sans que Google y perde du temps.
Trois outils principaux permettent d’écarter les URL inutiles : robots.txt,
noindex et la balise canonique. Chacun remplit une fonction différente. Les
confondre aggrave souvent le problème. L’onglet Avancé explique précisément lequel
employer selon le cas, avec un tableau de décision.
Dernier point à connaître d’emblée : Google Search Console proposait autrefois un outil « Paramètres d’URL » qui permettait de demander à Google d’ignorer certains paramètres de filtre. Il n’existe plus : Google l’a supprimé en 2022. De nombreux anciens tutoriels le citent encore ; inutile de le chercher.
Quel contrôle faut-il appliquer à cette URL à facettes ?
Choose a treatment for a faceted URL
Le nombre d’URL à facettes explose soudainement
- Confirmez le motif. Comparez l’échantillon d’URL indexées ou explorées à la taille réelle du catalogue. Regroupez les URL excédentaires par paramètre et combinaison de paramètres. Si aucun motif de facettes ne se répète, arrêtez-vous et cherchez une autre source d’URL.
- Trouvez le chemin de découverte. Explorez les modèles de catégorie et inspectez les liens internes pour savoir quels contrôles émettent des valeurs
hrefexplorables. Si les URL n’apparaissent que dans les journaux, vérifiez aussi les liens externes et les anciens sitemaps. - Mesurez l’exposition aux robots. Segmentez les journaux serveur selon les paramètres suspects. Si Googlebot ne les demande pas, privilégiez le nettoyage de l’index ; s’ils représentent une grande part des requêtes, privilégiez la prévention de l’exploration.
- Classez la demande. Séparez les combinaisons soutenues par une demande des états purement fonctionnels. Conservez le premier groupe comme pages de destination ; n’appliquez aucun blocage général avant cette étape.
- Appliquez un contrôle principal. Utilisez de vraies pages indexables pour les combinaisons soutenues par la demande, des fragments ou contrôles sans lien lorsqu’aucune URL n’est nécessaire,
robots.txtpour prévenir l’exploration, ou unnoindexexplorable pour désindexer. N’associez jamais une interdiction ànoindex. - Vérifiez et surveillez. Testez des URL représentatives, puis suivez les journaux, les statistiques d’exploration et l’indexation des pages. Si des pages de destination utiles disparaissent ou si des paramètres légitimes sont bloqués, resserrez ou annulez la règle.
Erreurs de navigation à facettes qui compliquent le nettoyage
Bloquer une URL dans robots.txt et lui ajouter noindex
Google ne peut pas récupérer une page bloquée pour y découvrir la directive
noindex. Autorisez l’exploration pendant la désindexation, puis n’envisagez un
blocage d’exploration qu’après la disparition des URL indésirables de l’index.
Ajouter noindex et une canonique à la même page à facettes
noindex demande de ne pas indexer la page ; la canonique demande à Google de la
regrouper avec une autre URL. Choisissez le signal adapté à l’objectif au lieu
d’envoyer des instructions contradictoires.
Attendre des balises canoniques qu’elles arrêtent l’exploration
Google doit explorer une URL filtrée pour lire sa canonique. Utilisez les canoniques pour consolider les signaux, pas comme unique contrôle d’un espace d’exploration incontrôlé.
Bloquer indistinctement tous les paramètres
Un même paramètre peut produire des combinaisons inutiles et des pages de destination précieuses. Inventoriez la fonction de chaque paramètre et rédigez des règles étroites assorties d’exceptions explicites.
Indexer toutes les combinaisons pour capter la longue traîne
La plupart des combinaisons n’ont ni demande propre ni contenu réellement distinct. Ne créez de pages de destination que pour celles que la demande justifie et neutralisez les autres.
Diagnostiquer les défaillances de la navigation à facettes
Le nombre d’URL indexées dépasse largement celui du catalogue
Cause probable : les filtres, tris et ordres de paramètres produisent de nombreuses versions explorables du même ensemble de produits. Correction : regroupez les URL par paramètre, ne conservez que les combinaisons soutenues par la demande et appliquez le contrôle d’exploration ou d’indexation approprié. Vérifiez que les catégories concernées dans Indexation des pages et les segments de journaux diminuent.
Les requêtes de Googlebot saturent le serveur
Cause probable : le robot a découvert un espace de facettes presque infini.
Correction : repérez les motifs de paramètres dans les journaux serveur,
supprimez les liens explorables vers les états inutiles et appliquez des règles
robots.txt étroites. Vérifiez que les requêtes de Googlebot se reportent vers
les URL de catégories et de produits.
Une facette en noindex reste indexée
Cause probable : la même URL est interdite dans robots.txt, si bien que
Google ne peut pas lire la directive. Correction : autorisez l’exploration assez
longtemps pour que Google traite noindex. Dans Inspection d’URL, confirmez que la
page publiée peut être récupérée et qu’elle expose la directive.
Google choisit une URL à facettes plutôt que l’URL de catégorie
Cause probable : les canoniques, liens internes, entrées de sitemap ou signaux de contenu ne concordent pas. Correction : alignez ces signaux sur la canonique voulue et supprimez les liens internes vers les formes en double. Dans Inspection d’URL, comparez la canonique déclarée à celle choisie par Google.
Classer les paramètres de facettes sans déléguer la décision au modèle
Collez un CSV indiquant le paramètre, des exemples d’URL, le nombre de produits, la demande estimée et si l’ensemble de résultats diffère de la catégorie de base. Examinez chaque recommandation avant sa mise en œuvre.
You are helping triage faceted-navigation URL patterns. For each CSV row, classify the pattern as one of: candidate indexable landing page, crawl-prevention candidate, deindexing candidate, canonical-to-base candidate, or needs human review.
Use these rules:
- A landing-page candidate needs verified standalone search demand and meaningfully distinct content.
- robots.txt controls crawling, not guaranteed indexing.
- noindex requires the URL to remain crawlable.
- canonical consolidates signals but does not stop crawling.
- Empty or impossible combinations should return 404.
Return a table with: parameter pattern, evidence used, recommended class, implementation precondition, representative URL to test, and risk if wrong. Do not invent keyword demand. Mark missing evidence as NEEDS DATA.
CSV:
[PASTE CSV] Mesurer la part d’exploration des facettes dans un journal d’accès
Exécutez ce script Python sur un journal d’accès standard. Adaptez les motifs du robot et des facettes à votre site. Il rend compte des requêtes observées ; il ne décide pas si une URL mérite d’être indexée.
import re
import sys
from collections import Counter
from urllib.parse import urlsplit, parse_qsl
BOT = re.compile(r"Googlebot", re.I)
REQUEST = re.compile(r'"(?:GET|HEAD)\s+(\S+)\s+HTTP/[^\"]+"')
FACET_KEYS = {"color", "size", "brand", "price", "sort", "order"}
total = 0
faceted = 0
keys = Counter()
with open(sys.argv[1], encoding="utf-8", errors="replace") as log:
for line in log:
if not BOT.search(line):
continue
match = REQUEST.search(line)
if not match:
continue
total += 1
query_keys = {key for key, _ in parse_qsl(urlsplit(match.group(1)).query)}
matched = query_keys & FACET_KEYS
if matched:
faceted += 1
keys.update(matched)
print({"googlebot_requests": total, "facet_requests": faceted})
print(keys.most_common())Extraire les liens à facettes paramétrés dans un crawler
Utilisez cette expression XPath dans l’extraction personnalisée de Screaming Frog pour collecter les liens dont la chaîne de requête contient l’une des clés nommées :
//a[contains(@href,'?') and (contains(@href,'color=') or contains(@href,'size=') or contains(@href,'brand=') or contains(@href,'sort='))]/@hrefL’expression régulière équivalente capture l’URL dans le groupe 1 et le premier nom de paramètre reconnu dans le groupe 2 :
href=["']([^"']*[?&]((?:color|size|brand|price|sort|order))=[^"']*)["']Lister les liens à facettes de la page actuelle
Exécutez ce code dans la console Chrome DevTools. Adaptez keys aux paramètres
réels du site.
const keys = new Set(["color", "size", "brand", "price", "sort", "order"]);
console.table(
[...document.querySelectorAll("a[href]")]
.map((a) => new URL(a.href, location.href))
.filter((u) => [...u.searchParams.keys()].some((k) => keys.has(k)))
.map((u) => ({
url: u.href,
keys: [...u.searchParams.keys()].filter((k) => keys.has(k)).join(","),
})),
); Prouver l’effet du changement de contrôle de l’exploration
Déployez le changement sur une cohorte d’URL avant de l’appliquer à tout le site, et conservez une cohorte comparable intacte comme témoin. Les mesures d’exploration et d’indexation évoluent pour de nombreuses raisons étrangères à votre modification : seule une comparaison de cohortes permet d’en isoler l’effet de façon fiable.
Tester la règle robots.txt
Test à exécuter : utilisez le flux de test du fichier robots.txt dans Search Console, ou récupérez le fichier publié et testez des URL représentatives autorisées et interdites. Résultat attendu : les facettes inutiles sont bloquées, tandis que la catégorie de base, les produits et les pages de destination approuvées restent autorisés. Interprétation d’un échec : le motif est trop large, trop étroit ou ne correspond pas à la forme réelle des URL. Fenêtre de suivi : la règle est immédiate ; le comportement des robots change après leur prochaine consultation. Déclencheur d’annulation : une catégorie, un produit ou une facette approuvée utile devient bloqué.
Tester une page de destination soutenue par la demande
Test à exécuter : inspectez sa réponse, son HTML rendu, sa canonique, ses liens internes et sa présence dans le sitemap. Résultat attendu : elle renvoie 200, se désigne elle-même comme canonique, expose des éléments de page distincts et reste accessible par des liens explorables. Interprétation d’un échec : la page est encore traitée comme un état de facette neutralisé. Fenêtre de suivi : les signaux techniques sont immédiats ; la canonique choisie par Google et l’état d’indexation exigent une nouvelle exploration. Déclencheur d’annulation : Google regroupe durablement la page ailleurs, ou celle-ci ne peut conserver ni contenu distinct ni demande.
Tester la désindexation sans blocage
Test à exécuter : inspectez une URL à facettes indésirable représentative après l’ajout de noindex. Résultat attendu : Google peut récupérer l’URL et voit noindex ; l’URL quitte ensuite l’index. Interprétation d’un échec : une règle robots, un problème de rendu ou un conflit d’en-tête ou de modèle masque la directive. Fenêtre de suivi : la diffusion de la directive est immédiate ; la suppression de l’index suit la nouvelle exploration. Déclencheur d’annulation : le modèle applique noindex aux pages de destination approuvées.
Indicateurs de santé de la navigation à facettes
Suivez séparément la part d’exploration, l’empreinte dans l’index et les performances des pages de destination ; ne les réduisez pas à un score unique. Aucun contrôle de cet article ne garantit l’exploration, l’indexation, le classement, le trafic ou une citation par une IA : ils modifient seulement ce que les moteurs et robots d’IA peuvent découvrir.
Part des facettes dans l’exploration par les robots
Indicateur : pourcentage des requêtes Googlebot vérifiées qui touchent des motifs de facettes non indexables. Ce qu’il révèle : si la capacité d’exploration est détournée vers des états d’URL réservés à l’expérience utilisateur. Comment l’obtenir : validez le trafic des robots et segmentez les journaux serveur selon les paramètres de facettes connus du site. Référence ou plage réaliste : établissez une base par modèle et visez une baisse durable après le nettoyage ; catalogues et demandes d’exploration diffèrent trop pour fixer une cible universelle. Fréquence : chaque semaine pendant la correction, puis chaque mois.
Empreinte des URL à facettes dans Indexation des pages
Indicateur : nombre et part d’URL à facettes dans les catégories indexées, en double, explorées mais non indexées et soft 404. Ce qu’il révèle : si les contrôles d’exploration et les signaux canoniques contiennent l’inflation de l’index. Comment l’obtenir : exportez des échantillons d’Indexation des pages dans Search Console et classez les URL par motif de paramètres. Référence ou plage réaliste : comparez-les au nombre de pages de destination à facettes volontairement indexables et prenez le propre catalogue de la boutique comme base. Fréquence : chaque mois ; les changements d’indexation sont retardés.
Performances des pages de destination approuvées
Indicateur : clics, impressions et conversions des combinaisons de facettes volontairement indexables. Ce qu’il révèle : si les exceptions soutenues par la demande justifient leur coût d’exploration et de maintenance. Comment l’obtenir : regroupez ces URL précises dans Search Console et l’outil d’analyse. Référence ou plage réaliste : comparez chaque page à sa base antérieure au lancement et à la catégorie de base pertinente, pas à un seuil arbitraire pour tout le site. Fréquence : chaque mois et après toute modification importante du catalogue.
TL;DR — La navigation à facettes est la première source de surexploration signalée à Google — environ 50 % des plaintes, selon Gary Illyes. Chaque combinaison de filtres peut créer une URL explorable distincte : un petit catalogue cache alors des millions de pages presque identiques, avec contenu dupliqué, inflation de l’index, gaspillage du budget d’exploration et dilution du PageRank. La décision stratégique précède la technique : transformer les combinaisons répondant à une demande réelle en pages de destination indexables et neutraliser celles qui relèvent uniquement de l’UX. Les leviers ne sont pas interchangeables : robots.txt arrête l’exploration, pas l’indexation ; noindex retire de l’index, mais exige une exploration et n’économise pas le budget ; la canonique consolide les signaux sans arrêter l’exploration. Les fragments d’URL (
#) évitent le problème, car Google les ignore. L’outil Paramètres d’URL de GSC a disparu ; les contrôles sont côté serveur. Bing conserve URL Normalization.
Le mécanisme : comment les filtres font exploser l’espace d’URL
La navigation à facettes devient un problème SEO dès qu’un filtre modifie l’URL d’une manière qu’un robot peut suivre. Trois notions sont souvent confondues ; les distinguer éclaire tout le reste : l’interaction dans l’interface — l’acheteur active un filtre —, l’état d’URL récupérable — le clic produit-il une adresse qu’un robot peut demander ? — et la page de destination indexable — cette URL doit-elle figurer dans l’index de Google ? Un système à facettes peut exposer une, deux ou trois de ces notions : un filtre côté client sans changement d’URL n’expose que la première ; un filtre dans la chaîne de requête, les deux premières ; une page organisée pour « canapés en velours bleu », les trois, volontairement.
Les trois mises en œuvre courantes :
| Motif | Exemple | Comportement d’exploration et d’indexation |
|---|---|---|
| Paramètres de requête | /sofas?color=blue&size=large | Cas le plus courant ; exploré et indexable par défaut, donc à gérer |
| Segments de chemin | /sofas/blue/large/ | Aspect plus propre, mais blocage systématique plus difficile avec robots.txt |
| Fragments d’URL | /sofas#color=blue | Googlebot ignore les fragments : aucune incidence sur l’exploration ou l’indexation |
Le calcul résume tout le problème. 10 000 produits × 20 couleurs × 15 tailles × 5 ordres de tri donnent 15 000 000+ URL potentielles. Gary Illyes a décrit vivement le scénario d’échec sur LinkedIn : “Sometimes you might create these new fake URLs accidentally, exploding your URL space from a balmy 1000 URLs to a scorching 1 million, exciting crawlers that in turn hammer your servers unexpectedly.” (traduction) « Il arrive que vous créiez accidentellement ces nouvelles fausses URL, faisant passer votre espace d’URL d’un tranquille millier à un million étouffant, ce qui excite les robots qui martèlent alors vos serveurs de façon inattendue. »
Google ne peut pas simplement observer un espace d’URL filtrées et décider de l’ignorer. Illyes l’a expliqué dans Search Off the Record : “Once it discovers a set of URLs, it cannot make a decision about whether that URL space is good or not unless it crawled a large chunk of that URL space.” (traduction) « Après avoir découvert un ensemble d’URL, il ne peut juger si cet espace est bon ou non sans en avoir exploré une grande partie. » Voilà pourquoi il s’agit de la première plainte liée à l’exploration : lorsque Google comprend que ces URL sont inutiles, il les a déjà explorées.
Enquête détaillée : les filtres ne représentaient que la moitié du piège
Le bilan d’exploration de Google pour la fin 2025 apporte un exemple réel
particulièrement utile : Gary Illyes a attribué environ 50 % des problèmes
d’exploration abordés à la navigation à facettes et 25 % supplémentaires aux
paramètres d’action.
Cette deuxième catégorie compte, car un audit e-commerce limité à color, size
et brand peut manquer les URL créées par add-to-cart, les actions de
comparaison et de liste de souhaits, ainsi que par le tri, les sessions et le suivi.
Voici le schéma d’enquête, avec des volumes illustratifs qui ne prétendent pas constituer une référence habituelle. Un marchand possède 18 000 produits et catégories indexables, mais un crawl découvre 640 000 URL. Le regroupement des échantillons du crawl et des journaux par paramètre donne :
| Famille d’URL | URL observées | Ce qu’elle révèle |
|---|---|---|
filtres (color, size, brand) | 290 000 | combinaisons et ordre de paramètres en double |
actions (add, compare, wishlist) | 170 000 | liens explorables qui exécutent des actions utilisateur |
| tri et pagination | 96 000 | mêmes ensembles dans des ordres et à des profondeurs différents |
| session et suivi | 71 000 | doublons passifs ajoutés aux liens internes |
| inconnus | 13 000 | file d’examen, pas liste de blocage automatique |
La correction ne consiste pas en une seule règle Disallow générale. Supprimez les
liens d’action explorables, cessez d’ajouter des paramètres de session et de campagne
aux liens internes, normalisez les ordres de filtres en double, renvoyez 404 pour
les combinaisons impossibles et conservez les rares filtres soutenus par la demande
comme pages de destination stables. Vérifiez ensuite le résultat dans les journaux
serveur : le signal de réussite est le déplacement des requêtes des robots vers les
URL de catégories et de produits, pas seulement un export de crawl plus petit.
Les quatre problèmes causés
- Contenu presque identique.
/washing-machines/samsung/et/washing-machines/?brand=samsungpeuvent servir le même ensemble de produits. Les signaux de classement se répartissent entre les deux au lieu d’être consolidés. - Inflation de l’index. Même une fraction de ces millions d’URL dans l’index pèse sur les signaux de qualité globaux du site.
- Gaspillage du budget d’exploration. Toute exploration consacrée à une facette de faible valeur est refusée à un nouveau produit. L’effet se cumule : la découverte du contenu récent ralentit aussi. Le budget d’exploration devient surtout critique à grande échelle ; consultez le budget d’exploration pour savoir qui doit réellement s’en préoccuper.
- Dilution du PageRank. Une catégorie qui renvoie vers 500 combinaisons de filtres répartit son autorité interne entre 501 destinations au lieu de la transmettre aux produits qui devraient se classer.
Il faut le dire clairement, car les clients posent la question : ce n’est pas un risque de pénalité. Google n’inflige pas d’action manuelle pour les doublons créés par la navigation à facettes. C’est un problème d’efficacité de l’exploration et de l’indexation, ainsi que de dilution des signaux, pas une pénalité pour contenu dupliqué.
La décision stratégique vient en premier
Avant de modifier robots.txt ou une balise meta, tranchez pour chaque URL :
cette combinaison de filtres mérite-t-elle une place dans l’index ?
- Elle mérite l’indexation si elle correspond à une demande de recherche réelle, c’est-à-dire à une requête effectivement saisie : « jean skinny taille haute », « chaussures de randonnée imperméables », « canapé en velours bleu ». Elle devient une vraie page de destination.
- Elle ne la mérite pas s’il s’agit d’une combinaison arbitraire, d’un ordre de tri ou d’une longue pile de facettes que personne ne recherche. Elle est neutralisée.
La recherche de mots-clés permet de fixer la limite. Relevez les modificateurs de facettes candidats, vérifiez leur volume et choisissez un seuil. En pratique, environ 300+ recherches mensuelles constituent une barre raisonnable pour justifier une page à facettes indexée autonome ; en dessous, bloquez ou utilisez des fragments. Cette distinction compte pour la longue traîne : 99,84 % des mots-clés reçoivent moins de 1 000 recherches mensuelles, mais représentent 39,33 % de la demande totale. La plupart des combinaisons n’ont aucune demande ; la minorité qui en possède offre une vraie occasion, que seules des pages précises autorisées dans l’index peuvent saisir.
La demande ne suffit pas. Pour devenir une page de destination indexable, une combinaison doit réunir une demande vérifiée, une valeur distincte — contenu et assortiment réellement différents de la catégorie de base, pas les mêmes produits dans un autre ordre — et un engagement de suivi portant sur l’exploration, l’indexation et les performances. Considérez chaque page promue comme une expérience qui doit mériter son maintien, pas comme une victoire garantie sur la longue traîne ; l’onglet Mesure indique quoi suivre.
Les leviers techniques et leurs différences
C’est ici que la plupart des mises en œuvre échouent : les trois contrôles principaux paraissent interchangeables, mais ne le sont pas.
Interdiction dans robots.txt : arrête l’exploration et constitue la prévention
privilégiée par Google. Bloquer les espaces de paramètres de filtres tout en
autorisant les fiches et la liste non filtrée est le levier le plus fort pour le
budget d’exploration. Voici l’exemple de Google :
disallow: /*?*products=
disallow: /*?*color=
disallow: /*?*size=
allow: /*?products=all$Le piège : robots.txt bloque l’exploration, pas l’indexation. Une URL
bloquée qui reçoit des liens entrants peut encore apparaître dans l’index sous forme
de résultat composé uniquement de l’URL, sans extrait puisque Google n’a jamais lu la
page. Cet outil convient donc à l’objectif « cesser de gaspiller l’exploration sur cet
espace », pas à « retirer cette URL de l’index ».
noindex retire de l’index, mais exige une exploration. Google est explicite :
“Google has to crawl the page in order to find the noindex rule.” (traduction)
« Google doit explorer la page pour trouver la règle noindex. » noindex contrôle
l’indexation, pas l’exploration ; il n’économise pas le budget, car Googlebot
doit récupérer la page pour lire la balise. Utilisez-le pour retirer une page de
l’index, pas pour améliorer l’efficacité de l’exploration.
rel="canonical" consolide les signaux, mais reste le levier le plus faible
pour l’exploration. Désigner la catégorie non filtrée depuis les pages filtrées
consolide les signaux en double et, selon Google, “may, over time, decrease the crawl volume of non-canonical versions”
(traduction) « peut, avec le temps, réduire le volume d’exploration des
versions non canoniques », mais cette méthode est “generally less effective in the long term”
(traduction) « généralement moins efficace à long terme » que
robots.txt ou les fragments. C’est une indication que Google peut ignorer, pas une
directive. Elle ne réduit pas non plus la charge serveur à court terme, puisque Google
doit explorer les pages non canoniques pour lire leur balise.
Les fragments d’URL (#) évitent entièrement le problème. Puisque
“Google Search generally doesn’t support URL fragments in crawling and indexing,”
(traduction) « Google Search ne prend généralement pas en charge les
fragments d’URL pour l’exploration et l’indexation », un état comme
/sofas#color=blue n’a aucune incidence sur l’exploration ou l’indexation. C’est la
prévention la plus propre pour les filtres sans demande : le filtre s’applique côté
client et aucune nouvelle URL explorable ne naît.
rel="nofollow" sur les liens de filtres : tout ou rien. Vous pouvez
décourager Google de suivre ces liens, mais, selon Google, “every anchor pointing to a specific
URL must have the rel=‘nofollow’ attribute in order for it to be effective.”
(traduction) « chaque ancre pointant vers une URL donnée doit porter
l’attribut rel=‘nofollow’ pour que la méthode soit efficace ». Un seul lien suivi sur
le site suffit à créer une fuite. Il s’agit désormais aussi d’une indication, pas
d’une directive.
Consultez l’onglet Fiches pratiques pour le tableau de décision complet.
Les interdictions essentielles
Ces associations créent des défaillances discrètes :
noindexet interdictionrobots.txtsur la même URL. C’est l’erreur classique. Googlebot ne peut récupérer l’URL bloquée, donc ne voit jamais la balisenoindexet la page peut rester indexée. Pour désindexer, il faut autoriser l’exploration et servirnoindex.noindexetcanonicalsur la même URL. Les signaux se contredisent. John Mueller l’a formulé ainsi : “noindex doesn’t tell Google that you want it combined with something else and that signals should be forwarded.” (traduction) « noindex n’indique pas à Google que vous souhaitez regrouper la page avec une autre ni transmettre ses signaux. » Choisissez l’un des deux.- La canonique seule pour alléger le budget d’exploration. Elle n’arrête pas l’exploration : Google continue de récupérer les URL non canoniques.
Bonnes pratiques de structure pour les facettes que vous indexez
Pour la minorité de pages filtrées choisies pour l’indexation, la documentation Google fournit des règles claires :
- Utilisez le séparateur standard
&, pas des virgules, points-virgules, barres verticales ou crochets. - Conservez un ordre de filtres constant.
/sofas/blue/fabricet/sofas/fabric/bluedoivent aboutir à une seule forme canonique. - Aucune valeur de filtre en double :
?color=blue&color=bluedoit renvoyer 404, pas 200. - Renvoyez un véritable 404 pour les combinaisons vides ou impossibles. Si
/sofas/redne donne aucun résultat, renvoyez404, pas une page générique 200 « aucun résultat » soutenue parnoindex. - Préférez des chemins propres aux chaînes de requête pour les facettes indexables :
/sofas/blue/se lit mieux que/sofas?color=blue&style=&sort=.
Navigation à facettes JavaScript ou AJAX : prévention avec contrepartie
Si les filtres AJAX côté client n’émettent pas de vrais liens <a href> vers
des URL filtrées, ils s’appliquent dans le navigateur et aucune URL explorable
n’est créée. C’est excellent pour le budget d’exploration. La contrepartie est
symétrique : Googlebot ne peut pas atteindre ces états ; les combinaisons utiles de
longue traîne ne seront donc pas indexées non plus.
La référence pour les grands catalogues est un modèle hybride : préafficher ou
rendre côté serveur les combinaisons de filtres à forte demande sous forme de vraies
pages liées et indexables, avec une introduction unique et une présence dans le
sitemap ; garder côté client tous les états éphémères sans demande — AJAX, fragments
ou paramètres pushState associés à une canonique vers la base. Google rend le
JavaScript, mais cette opération attend dans une file et reste plus lente que
l’exploration HTML. Pour une page dont l’indexation fiable est souhaitée, ne dépendez
pas uniquement du rendu côté client. Voir aussi le SEO JavaScript.
L’outil Paramètres d’URL a disparu
Prévenez rapidement les clients, car de nombreux tutoriels recommandent encore
cet outil. Google a abandonné l’outil Paramètres d’URL en avril 2022 : sa détection
était devenue assez bonne pour que “only about 1% of the parameter configurations currently specified in the URL Parameters tool were useful
for crawling.” (traduction) « seulement environ 1 % des configurations
de paramètres alors indiquées dans l’outil étaient utiles à l’exploration ».
Interrogé sur un éventuel retour, Illyes a répondu : “In theory yes. In practice no.”
(traduction) « Théoriquement, oui ; concrètement, non. » Search Console ne
permet plus de demander à Google d’ignorer un paramètre : il reste la gestion côté
serveur — robots.txt, noindex, fragments — ou rien.
Bing fonctionne différemment. Bing Webmaster Tools propose encore URL Normalization, où l’on indique les paramètres supprimables. Fabrice Canel précise : “our crawler will not visit the URLs with extra parameters except for an occasional test.” (traduction) « notre robot ne visitera pas les URL comportant des paramètres supplémentaires, sauf lors d’un test occasionnel ». Si Bing compte pour vous — et la recherche par IA s’appuie de plus en plus sur son index — cette configuration distincte prend environ cinq minutes.
Remarque sur le blocage général des paramètres
Méfiez-vous des règles robots.txt trop larges. Si un paramètre remplit plusieurs
fonctions — par exemple, ?type= sert à une facette inutile, mais aussi à une vue
paginée ou canonique légitime — une règle générale disallow: /*?*type= bloquera
aussi les bonnes URL. Auditez la fonction réelle de chaque paramètre avant de le
bloquer et préférez des règles étroites avec des exceptions allow à une règle
fourre-tout qui élimine les pages utiles avec les autres.
Comment auditer votre propre site
- Explorez-le. Ahrefs Site Audit ou Screaming Frog révélera l’explosion des URL, les motifs de paramètres et la profondeur des pages filtrées.
- Comparez le décompte
site:au nombre réel de produits. Si le nombre de résultatssite:example.comdépasse largement le catalogue, l’inflation de l’index vient probablement des facettes. - Rapport Indexation des pages de GSC. Recherchez de gros volumes de “Crawled — currently not indexed” (traduction) « Explorée, actuellement non indexée » et “Duplicate without user-selected canonical” (traduction) « Page en double sans URL canonique sélectionnée par l’utilisateur » : les facettes y apparaissent.
- Journaux serveur. Ils constituent la vérité sur le gaspillage d’exploration et montrent exactement quelle part du temps de Googlebot va aux URL paramétrées plutôt qu’aux produits.
The worked sample contains 240 parameter occurrences: 108 filter parameters, 54 tracking parameters, 34 sort parameters, 28 pagination parameters, and 16 unknown parameters. Filter parameters account for 45 percent of the supplied inventory.
Place de ce sujet dans le pilier
La navigation à facettes est le défi technique emblématique du SEO e-commerce : elle explique pourquoi ce SEO est plus difficile que le SEO ordinaire, sans être différent par nature. Elle est directement liée à l’architecture des sites e-commerce, car les filtres se greffent sur la pyramide des catégories, au SEO des pages de catégorie, sur lesquelles ils vivent, et à l’histoire plus générale de l’exploration et de la canonisation. Les SEO techniques abordent souvent ce sujet par l’architecture de l’information ; son ancrage pratique se trouve ici, du côté de la boutique.
Résumé par l’IA
Version condensée de l’angle Avancé :
- Définition : panneau de filtres des pages de catégorie ou d’archive — couleur, taille, prix, marque — aussi appelé recherche à facettes ou filtrage des produits. Excellente UX ; le problème SEO vient uniquement de la création possible d’une URL explorable distincte pour chaque combinaison.
- Problème d’échelle : 10 000 produits × couleurs × tailles × tris produisent des millions d’URL presque identiques. Selon Gary Illyes, les facettes représentent environ 50 % des problèmes d’exploration signalés à Google, qui ne peut éviter cet espace sans en avoir d’abord exploré « une grande partie ».
- Quatre effets : contenu presque identique, inflation de l’index, gaspillage du budget d’exploration et dilution du PageRank. Aucune pénalité : il s’agit d’efficacité et de dilution des signaux.
- Stratégie d’abord : indexez les combinaisons répondant à une demande réelle — environ 300+ recherches mensuelles comme barre de travail — et neutralisez les autres.
- Leviers différents :
robots.txtarrête l’exploration, pas l’indexation ;noindexretire de l’index, mais exige une exploration et n’économise donc pas le budget ; lacanonicalconsolide les signaux sans arrêter l’exploration ; les fragments d’URL (#) évitent tout le problème parce que Google les ignore. - À ne jamais faire : associer
noindexà une interdictionrobots.txt— Google ne peut plus lire la balise — ou associernoindexà unecanonical, car les signaux se contredisent ; Mueller recommande d’en choisir un. - Outils : Google a abandonné Paramètres d’URL en 2022 ; seuls les contrôles côté serveur subsistent. Bing conserve URL Normalization.
- Filtres JS ou AJAX : ils préviennent le gaspillage d’exploration, mais empêchent aussi l’indexation des facettes utiles de longue traîne ; préaffichez celles à forte demande.
Documentation officielle
Conseils de sources primaires sur la navigation à facettes et la gestion des paramètres.
- Gestion de l’exploration des URL de navigation à facettes — page d’aide permanente que Google a mise en avant en décembre 2024 à partir d’un article de 2014.
- Navigation à facettes, version destinée à l’infrastructure d’exploration — mêmes conseils, avec les exemples
robots.txtet de séparateur&. - Décembre de l’exploration : navigation à facettes (2024) — article qui la qualifie de “by far the most common source of overcrawl issues” (traduction) « de loin la source la plus fréquente de problèmes de surexploration ».
- Bonnes pratiques et cinq mauvaises pratiques de navigation à facettes (2014) — référence d’origine, désormais remplacée, mais utile pour l’historique.
- Nettoyage de printemps : l’outil Paramètres d’URL (2022) — annonce de l’abandon.
- Optimiser votre budget d’exploration — contexte expliquant l’importance du gaspillage provoqué par les facettes.
Bing / Microsoft
- Better than canonical; URL Normalization — Fabrice Canel présente l’outil de gestion des paramètres de Bing, toujours actif contrairement à celui de Google.
Citations des sources
Déclarations publiques de Google et Bing. Les liens profonds mènent au passage cité lorsque la page source accepte les fragments de texte.
Google — l’ampleur du problème selon Gary Illyes
- “Once it discovers a set of URLs, it cannot make a decision about whether that URL space is good or not unless it crawled a large chunk of that URL space.” (traduction) « Après avoir découvert un ensemble d’URL, il ne peut juger si cet espace d’URL est bon ou non sans en avoir exploré une grande partie. » — Déclaration de Gary Illyes dans Search Off the Record, lors du bilan d’exploration de fin 2025. Rapporté textuellement par Search Engine Land ; à confirmer dans l’épisode avant de le considérer comme définitif. Couverture
- “An interesting quirk of URLs is that you can add an infinite (I call BS) number of URL parameters to the URL path, and by that essentially forming new resources.” (traduction) « Une particularité intéressante des URL est que l’on peut ajouter au chemin un nombre infini — je n’y crois pas — de paramètres et ainsi former, en substance, de nouvelles ressources. » — Gary Illyes, LinkedIn, août 2024. Rapporté par Search Engine Journal. Couverture
- “Sometimes you might create these new fake URLs accidentally, exploding your URL space from a balmy 1000 URLs to a scorching 1 million, exciting crawlers that in turn hammer your servers unexpectedly.” (traduction) « Il arrive que vous créiez accidentellement ces nouvelles fausses URL, faisant passer votre espace d’URL d’un tranquille millier à un million étouffant, ce qui excite les robots qui martèlent alors vos serveurs de façon inattendue. » — Gary Illyes, LinkedIn, août 2024. Rapporté par Search Engine Journal. Couverture
- À propos du retour de l’outil Paramètres d’URL : “In theory yes. In practice no.” (traduction) « En théorie, oui. En pratique, non. » — Gary Illyes, LinkedIn, 2024. Rapporté par Search Engine Journal. Couverture
Google — documentation
- “Google has to crawl the page in order to find the noindex rule.” (traduction) « Google doit explorer la page pour trouver la règle noindex. » — Google Search Central, documentation sur la navigation à facettes. Accéder à la citation
- “Google Search generally doesn’t support URL fragments in crawling and indexing.” (traduction) « Google Search ne prend généralement pas en charge les fragments d’URL pour l’exploration et l’indexation. » Accéder à la citation
- À propos de
rel="nofollow": “every anchor pointing to a specific URL must have the rel=‘nofollow’ attribute in order for it to be effective.” (traduction) « chaque ancre pointant vers une URL donnée doit porter l’attribut rel=‘nofollow’ pour que la méthode soit efficace ». Accéder à la citation - À propos de l’outil abandonné : “only about 1% of the parameter configurations currently specified in the URL Parameters tool were useful for crawling.” (traduction) « seulement environ 1 % des configurations de paramètres alors indiquées dans l’outil Paramètres d’URL étaient utiles à l’exploration ». Accéder à la citation
Google — John Mueller
- “noindex doesn’t tell Google that you want it combined with something else and that signals should be forwarded.” (traduction) « noindex n’indique pas à Google que vous souhaitez regrouper la page avec une autre ni transmettre ses signaux. » — à propos de l’association de
noindexet d’unecanonical. — John Mueller, Google. Rapporté par Search Engine Journal. Couverture
Bing — Fabrice Canel
- À propos d’URL Normalization : “our crawler will not visit the URLs with extra parameters except for an occasional test.” (traduction) « notre robot ne visitera pas les URL comportant des paramètres supplémentaires, sauf lors d’un test occasionnel ». Accéder à la citation
- “relying on canonical tag is not necessarily the perfect solution to fix all your duplicate content problems.” (traduction) « s’appuyer sur la balise canonique n’est pas nécessairement la solution parfaite à tous vos problèmes de contenu dupliqué ». Accéder à la citation
Liste de contrôle de l’audit de navigation à facettes
Procédure pour repérer et corriger le gaspillage d’exploration et d’indexation causé par les facettes :
- Explorez le site avec Ahrefs Site Audit ou Screaming Frog et mesurez l’explosion des URL paramétrées par rapport au nombre réel de produits.
- Comparez le nombre indexé avec
site:yourdomain.comà la taille réelle du catalogue ; un grand écart indique une inflation de l’index. - Dans Indexation des pages de GSC, examinez “Crawled — currently not indexed” (traduction) « Explorée, actuellement non indexée » et “Duplicate without user-selected canonical” (traduction) « Page en double sans URL canonique sélectionnée par l’utilisateur » pour les URL à facettes.
- Vérifiez dans les journaux serveur quelle part de l’exploration de Googlebot touche des URL paramétrées plutôt que des produits.
- Listez chaque paramètre de filtre et sa fonction ; confirmez qu’aucun ne remplit deux rôles avant de rédiger des règles de blocage.
- Étudiez les mots-clés des modificateurs de facettes et signalez les combinaisons répondant à une demande réelle — environ 300+ recherches mensuelles — pour les rendre indexables.
- Pour les facettes à faible demande, retenez une seule méthode de neutralisation
par URL ; n’associez jamais
noindexà une interdictionrobots.txt. - Pour les facettes indexables, vérifiez l’ordre constant des filtres, les
séparateurs
&, la canonique autoréférente, l’introduction unique et la présence dans le sitemap. - Confirmez que les combinaisons vides ou impossibles renvoient
404, et non une page 200 « aucun résultat ». - Configurez URL Normalization dans Bing Webmaster Tools, séparément de Google.
Les modèles mentaux
1. La stratégie avant la tactique : indexer ou neutraliser ? Chaque URL à facettes impose un choix binaire : correspond-elle à une demande réelle — page de destination indexable — ou relève-t-elle uniquement de l’UX — à neutraliser ? Prenez cette décision avant de toucher une balise. Aucun outil ne corrige une stratégie absente.
2. Les trois leviers remplissent trois fonctions différentes. Gardez cette distinction et la plupart des confusions disparaissent :
robots.txtcontrôle l’exploration, pas l’indexation.noindexcontrôle l’indexation, pas l’exploration ; il exige une exploration.- La
canonicalconsolide les signaux ; c’est une indication qui n’arrête pas l’exploration.
3. Règle de décision pour la neutralisation.
- Vous voulez que les robots ignorent entièrement un espace sans vous soucier de
l’indexation ? Interdisez-le dans
robots.txt. - Vous voulez retirer une page de l’index ? Autorisez l’exploration et servez
noindex; ne la bloquez jamais. - Vous voulez qu’un filtre sans demande ne crée aucune URL ? Utilisez un fragment
d’URL (
#) ou AJAX sans<a href>.
4. Mieux vaut prévenir que guérir. La navigation à facettes la plus propre est celle où les URL inutiles ne naissent jamais : fragments et filtrage côté client pour les états sans demande, vraies pages uniquement pour ceux que la demande soutient. Nettoyer un million d’URL déjà explorées demande bien plus de travail que de ne jamais les créer.
5. La contrepartie de la longue traîne. Le filtrage JavaScript ou AJAX neutralise à la fois le gaspillage d’exploration et l’indexation. C’est une qualité pour les facettes inutiles et un défaut pour celles qui ont de la valeur. Préaffichez les combinaisons soutenues par la demande et laissez les autres côté client.
Contrôle de la navigation à facettes : fiche pratique
Fonction réelle de chaque contrôle
| Contrôle | Arrête l’exploration ? | Arrête l’indexation ? | Usage conseillé | Point de vigilance |
|---|---|---|---|---|
interdiction robots.txt | Oui | Non | Alléger le budget sur les espaces de facettes de faible valeur | Une URL bloquée qui reçoit des liens peut encore apparaître sans extrait |
noindex, meta ou en-tête | Non, doit rester explorable | Oui | Retirer des pages à facettes de l’index | N’économise pas l’exploration ; ne jamais l’associer à un blocage robots.txt |
rel="canonical" | Non | Consolide, à titre indicatif | Pointer les pages filtrées vers la catégorie parente | Indication, pas directive ; Google explore toujours les URL non canoniques |
fragment d’URL (#) | Oui, car ignoré | Oui, car ignoré | Filtres sans demande dont on veut annuler l’incidence | Non partageable sans pushState en JavaScript |
rel="nofollow" sur les liens | Décourage | Non | Réduire le transfert d’autorité aux URL filtrées | Doit figurer sur tous les liens vers l’URL ; désormais une indication |
| rendre indexable | Non | Non | Facettes soutenues par la demande, environ 300+ recherches par mois | Exige un texte unique, une canonique autoréférente et un sitemap |
Associations interdites
noindexet interdictionrobots.txt: Google ne voit pasnoindexet l’URL reste indexée.noindexetcanonical: signaux contradictoires ; Mueller recommande d’en choisir un.- La
canonicalseule pour le budget d’exploration : elle n’arrête pas l’exploration.
Règles d’URL pour les facettes que vous indexez
- Utilisez uniquement le séparateur
&, sans virgule, point-virgule ni crochet. - Conservez un ordre de filtres constant pour obtenir une seule forme canonique.
- N’acceptez aucune valeur de filtre en double.
- Renvoyez
404pour les combinaisons vides ou impossibles, pas une page 200 « aucun résultat ». - Préférez les chemins propres aux chaînes de requête :
/sofas/blue/plutôt que/sofas?color=blue&sort=.
Faits essentiels
- La navigation à facettes représente environ 50 % des problèmes d’exploration signalés à Google, selon Illyes.
- GSC a supprimé l’outil Paramètres d’URL en avril 2022 ; seuls les contrôles côté serveur subsistent.
- L’équivalent de Bing, URL Normalization, reste actif dans Bing Webmaster Tools.
- Google ignore les fragments d’URL (
#) pour l’exploration et l’indexation. - Seuil de travail pour une page à facettes indexable : environ 300+ recherches mensuelles.
Outils de diagnostic et de gestion de la navigation à facettes
- Ahrefs Site Audit révèle l’explosion des URL paramétrées, les groupes de pages presque identiques et la profondeur d’exploration des pages filtrées.
- Screaming Frog SEO Spider explore avec une extraction personnalisée pour cartographier chaque paramètre et les liens entre les URL à facettes.
- Google Search Console — Indexation des pages montre l’inflation des facettes dans “Crawled — currently not indexed” (traduction) « Explorée, actuellement non indexée » et “Duplicate without user-selected canonical” (traduction) « Page en double sans URL canonique sélectionnée par l’utilisateur ».
- Inspection d’URL de GSC confirme comment une URL de filtre est explorée, rendue et indexée, ainsi que la canonique choisie par Google.
- Analyse des journaux serveur — Screaming Frog Log File Analyser ou journaux envoyés à BigQuery — donne la vérité sur la part d’exploration consacrée aux URL paramétrées.
- Bing Webmaster Tools — URL Normalization est le contrôle de paramètres encore actif de Bing ; il détecte à l’avance les doublons courants à examiner.
- Recherche de mots-clés avec Ahrefs Keywords Explorer repère les modificateurs de facettes dont la demande justifie une page de destination indexable.
Testez vos connaissances : navigation à facettes
Cinq questions sur le choix des URL à facettes à indexer et du contrôle à utiliser.
Journal des modifications
Mis à jour le 21 août 2026.
Résumé éditorial et détails enregistrés des changements.Détails des changements
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
Comparaison complète indisponible — aucun instantané antérieur n’a été archivé pour cette révision.
Mis à jour le 28 juil. 2026.
Résumé éditorial et détails enregistrés des changements.Détails des changements
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
Comparaison complète indisponible — aucun instantané antérieur n’a été archivé pour cette révision.
Mis à jour le 27 juil. 2026.
Résumé éditorial et détails enregistrés des changements.Détails des changements
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
Comparaison complète indisponible — aucun instantané antérieur n’a été archivé pour cette révision.
Mis à jour le 18 juil. 2026.
Résumé éditorial et détails enregistrés des changements.Détails des changements
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
-
Les notes détaillées des changements sont actuellement disponibles en anglais.
Comparaison complète indisponible — aucun instantané antérieur n’a été archivé pour cette révision.