Structure des URL : les bonnes pratiques pour le SEO
Des URL claires et explorables aident Google et vos visiteurs. Découvrez les règles à suivre et les pièges qui gonflent le crawl.
L’URL est l’adresse unique de chaque page de votre site. Une structure d’URL claire aide Google à explorer votre site efficacement et donne à vos visiteurs un repère immédiat sur le contenu attendu. À l’inverse, des URL trop complexes ou incohérentes peuvent conduire le moteur à explorer votre site de façon inefficace, avec des taux d’exploration anormalement élevés ou, au contraire, quasi nuls.
Pour le SEO, soigner ses URL revient à faciliter le travail de Googlebot tout en améliorant l’expérience de navigation. Une bonne URL est lisible par une machine comme par un humain : elle respecte les standards techniques, décrit la page et évite les paramètres superflus qui dispersent l’exploration sur des contenus identiques, un terrain où le choix de l’URL canonique prend tout son sens.
Ce que je regarde en premier sur un gros site, ce sont les paramètres d’URL : filtres, tris et sessions qui multiplient les adresses pour un même contenu et noient le budget d’exploration. Une URL doit rester lisible par une machine comme par un humain, mais le vrai danger, ce n’est pas un mot mal placé, c’est la combinatoire qui fait exploser le nombre d’URL sans que personne s’en aperçoive.
Les règles d'une URL explorable et lisible
Google s’appuie sur la norme technique IETF STD 66 pour interpréter les URL. Au-delà de cette conformité, quelques bonnes pratiques rendent vos adresses plus compréhensibles et plus stables dans le temps. Le tableau ci-dessous réunit les principales recommandations à appliquer dès que c’est possible.
| Bonne pratique | Recommandé | À éviter |
|---|---|---|
Mots dans l’URL |
Termes descriptifs et lisibles (/wiki/aviation) |
Identifiants longs et illisibles (index.php?topic=42&area=3a5e) |
Langue |
Mots dans la langue de votre audience |
Termes hors sujet pour vos lecteurs |
Séparateur de mots |
Trait d’union (summer-clothing) |
Trait de soulignement (summer_clothing) ou mots collés |
Caractères non ASCII |
Encodage-pourcent dans l’attribut href |
Caractères accentués ou non latins bruts |
Casse |
Une casse cohérente et homogène |
Mélange de /Apple et /apple pour la même page |
Paramètres |
Le strict nécessaire au contenu |
Paramètres superflus qui ne changent rien à la page |
Les configurations qui font exploser le nombre d'URL
Certaines mécaniques de site génèrent une avalanche d’URL pointant vers des contenus quasi identiques. Le filtrage combiné (par exemple hôtels en bord de mer et avec salle de sport), les paramètres de tri ou de référence, les identifiants de session ou un calendrier infini créent inutilement des milliers d’adresses. Résultat : Googlebot gaspille de la bande passante sur des pages redondantes et peut ne pas atteindre vos contenus réellement utiles.
Pour limiter le problème, supprimez les paramètres inutiles, remplacez les identifiants de session par des cookies et utilisez des URL relatives à la racine plutôt qu’au dossier parent. Sur les futures pages d’un calendrier dynamique, l’attribut nofollow évite que Google s’y engouffre ; pour aller plus loin, voyez comment rendre vos liens explorables.
Cas particuliers : multirégional et fragments
Deux situations méritent une attention spécifique. Pour un site visant plusieurs régions, une structure d’URL pensée pour le ciblage géographique facilite la tâche de Google, par exemple via un domaine propre à un pays. Adaptez aussi la langue des mots de l’URL à celle de votre audience, en translittérant si besoin.
Attention enfin aux fragments d’URL, la portion qui suit le caractère dièse. Google ne les prend généralement pas en compte pour modifier le contenu d’une page. Si vous changez le contenu via JavaScript, appuyez-vous sur l’API History plutôt que sur un fragment, sous peine de rendre vos variations invisibles pour le moteur.
Si vous constatez que Google explore des URL générées par le tri, le filtrage ou des espaces infinis, envisagez un fichier robots.txt pour en bloquer l’accès à Googlebot. Pensez aussi à renvoyer le bon code HTTP pour les pages inexistantes : un serveur mal configuré peut créer des URL fictives à l’infini à partir de liens relatifs mal placés.
À faire
- utiliser des mots descriptifs
- séparer les mots par des traits d’union
- encoder les caractères spéciaux
- harmoniser la casse
- réduire les paramètres
À éviter
- multiplier les paramètres de tri et de session
- modifier le contenu via un fragment d’URL
- mélanger majuscules et minuscules
- laisser un calendrier infini créer des liens sans limite
Points clés à retenir
- Préférez des mots descriptifs aux identifiants illisibles
- Séparez les mots avec des traits d'union, pas des traits de soulignement
- Encodez les caractères non ASCII dans vos liens
- Réduisez au maximum les paramètres qui ne changent pas le contenu
- Bloquez via robots.txt les URL dynamiques qui gaspillent le crawl
Des URL simples et stables facilitent l’exploration et la compréhension de votre site.
Quiz : testez vos connaissances
Quiz : testez vos connaissances
-
Google traite-t-il /APPLE et /apple de la même façon ?
- Oui, Google ignore toujours la casse des adresses
- Oui, à condition que la page renvoie un code 200
- Non, il les considère comme deux URL distinctes, d'où l'intérêt d'harmoniser la casse
Google traite
/APPLEet/applecomme deux adresses différentes. Mélanger majuscules et minuscules fragmente le contenu sur plusieurs URL, mieux vaut harmoniser la casse. -
Pour séparer les mots dans une URL, quel caractère privilégier ?
- L'espace encodé
- Le trait d'union
- Le trait de soulignement
Le trait d’union est recommandé pour séparer les mots d’une URL. Le trait de soulignement sert historiquement à lier des concepts comme
format_date. -
Que faire si Google explore des URL générées par le tri ou le filtrage ?
- Laisser faire, car ces URL renforcent le contenu du site
- Envisager un fichier robots.txt pour bloquer l'accès à ces URL
- Ajouter encore plus de paramètres pour mieux organiser les pages
Le filtrage combiné, les paramètres de tri ou les espaces infinis génèrent une avalanche d’URL quasi identiques. Un fichier
robots.txtpeut bloquer l’accès à ces adresses sans intérêt.
Besoin d'un accompagnement SEO ?
Vos URL gonflent le crawl ou brouillent votre arborescence ? Faisons le point sur votre structure.