Le problème
Une catégorie de 200 chaussures avec 6 filtres combinables peut générer des dizaines de milliers d'URL : /chaussures?couleur=noir&taille=42&prix=50-100... Googlebot passe son temps sur ces variantes au lieu d'explorer les pages importantes, et ces pages quasi identiques se concurrencent entre elles.
La stratégie recommandée
| Type de facette | Exemple | Traitement |
|---|---|---|
| Recherchée par les internautes | « chaussures de randonnée femme » | Page indexable, URL propre, contenu dédié |
| Utile au visiteur, pas recherchée | Tri par prix, taille 42 | Non indexée, canonical vers la catégorie |
| Combinaisons multiples | Couleur + taille + prix | Non explorée (robots.txt ou liens non crawlables) |
- Identifier les combinaisons qui ont un volume de recherche et en faire de vraies pages
- Éviter de générer des liens explorables vers les combinaisons sans intérêt
- Vérifier dans les logs ou les statistiques d'exploration que Googlebot n'y passe pas son temps
Termes liés
- Crawl BudgetNombre de pages que Googlebot va explorer sur votre site lors d'une session de crawl donnée.
- Contenu dupliquéContenu identique ou très similaire accessible via plusieurs URLs différentes, diluant la puissance SEO.
- CanonicalBalise HTML indiquant aux moteurs de recherche quelle URL est la version principale d'une page en cas de contenu dupliqué.
- Paramètres d'URLÉléments ajoutés après le « ? » d'une URL (?couleur=noir&tri=prix) pour filtrer, trier ou suivre une visite.