Empêcher l’indexation d’une page avec noindex
Apprenez à empêcher Google d'indexer une page avec noindex, via la balise meta ou l'en-tête HTTP, sans erreur de mise en oeuvre.
La règle noindex permet d’empêcher l’indexation d’une page par les moteurs de recherche qui l’acceptent, dont Google. Lors de sa prochaine exploration, Googlebot détecte la balise ou l’en-tête, puis exclut totalement la page des résultats, même si d’autres sites pointent vers elle. C’est l’outil de référence pour retirer durablement une page de la recherche.
Côté SEO, noindex est précieux pour garder hors de l’index des pages sans valeur de recherche : pages de remerciement, résultats de recherche interne, versions de test, contenus dupliqués. Il s’applique page par page, ce qui est pratique si vous n’avez pas accès à la racine du serveur. Attention toutefois : noindex contrôle l’indexation, pas l’exploration, deux étapes distinctes à ne pas confondre. La page doit rester accessible à Googlebot pour que la règle soit lue.
Le piège classique avec noindex, c’est de le combiner avec un blocage dans le robots.txt : si Googlebot ne peut pas explorer la page, il ne verra jamais la directive et la page peut rester indexée. Pour qu’un noindex fonctionne, il faut au contraire laisser Google venir lire la page. C’est contre-intuitif, mais c’est la première chose que je vérifie quand une page refuse de sortir de l’index.
Deux façons de mettre en oeuvre noindex
Il existe deux méthodes, au même effet : la balise meta dans le code HTML et l’en-tête de réponse HTTP. Choisissez la plus pratique selon votre type de contenu. La balise meta convient aux pages HTML, tandis que l’en-tête HTTP est idéal pour les ressources non HTML comme les PDF, vidéos ou images. Google n’autorise pas la déclaration de noindex dans le fichier robots.txt.
| Méthode | Cible | Cas d'usage typique |
|---|---|---|
Balise meta robots |
Tous les moteurs compatibles |
Page HTML standard |
Balise meta googlebot |
Robots d’exploration Google uniquement |
Cibler seulement Google |
En-tête X-Robots-Tag |
Pages et ressources non HTML |
Fichiers PDF, images, vidéos |
Exemples concrets à copier
Pour empêcher tous les moteurs compatibles d’indexer une page, placez la balise dans la section head du document. Vous pouvez aussi combiner noindex avec d’autres règles, par exemple nofollow, pour ne pas suivre les liens de la page.
<meta name="robots" content="noindex">
<!-- Cibler uniquement les robots Google -->
<meta name="googlebot" content="noindex">
<!-- Combiner noindex et nofollow -->
<meta name="robots" content="noindex, nofollow">
Cas des ressources non HTML
Pour un fichier PDF, une image ou une vidéo, vous ne pouvez pas insérer de balise meta. Renvoyez alors un en-tête de réponse HTTP X-Robots-Tag avec la valeur noindex (ou none). L’effet est identique : la ressource est exclue de l’index une fois explorée.
HTTP/1.1 200 OK
(...)
X-Robots-Tag: noindex
(...)
Pour que noindex fonctionne, la page ne doit pas être bloquée par le robots.txt. Si Googlebot ne peut pas accéder à la page, il ne lit jamais la règle noindex, et la page peut continuer à figurer dans les résultats, par exemple via des liens externes. Laissez toujours la page explorable lorsque vous voulez la désindexer.
À faire
- placer la balise meta dans la section head
- utiliser X-Robots-Tag pour les fichiers non HTML
- laisser la page accessible à Googlebot
- demander une réexploration pour accélérer la prise en compte
À éviter
- déclarer noindex dans le robots.txt (non pris en charge)
- bloquer la page dans le robots.txt et y poser noindex
- attendre une désindexation immédiate
- oublier que d’autres moteurs peuvent interpréter la règle différemment
Points clés à retenir
- Choisissez la balise meta pour les pages HTML
- Utilisez X-Robots-Tag pour les PDF, images et vidéos
- Ne bloquez jamais la page dans le robots.txt
- Combinez noindex et nofollow si nécessaire
- Demandez une réexploration pour accélérer l'effet
Noindex retire une page des résultats, à condition qu’elle reste explorable.
Quiz : testez vos connaissances
Quiz : testez vos connaissances
-
Peut-on déclarer noindex directement dans le robots.txt ?
- Non, Google ne prend pas en charge noindex dans le robots.txt
- Oui, mais seulement pour les fichiers PDF
- Oui, c'est la méthode la plus simple à mettre en place
Google ne prend pas en charge
noindexdans lerobots.txt. Utilisez la balisemeta robotsou l’en-tête HTTPX-Robots-Tag. -
Une condition essentielle pour que noindex fonctionne ?
- La page doit rester accessible, donc non bloquée par le robots.txt
- La page doit aussi être bloquée dans le robots.txt
- La page doit recevoir des liens depuis d'autres sites
Si la page est bloquée par le
robots.txt, Googlebot ne peut pas la lire et ne voit jamais la règlenoindex. La page doit donc rester explorable. -
Comment appliquer noindex à un fichier PDF ?
- Ajouter une ligne noindex dans le robots.txt
- Renvoyer un en-tête HTTP X-Robots-Tag avec la valeur noindex
- Insérer une balise meta dans la section head du PDF
Un PDF ne peut pas recevoir de balise meta. Renvoyez alors un en-tête de réponse HTTP
X-Robots-Tagavec la valeurnoindexpour exclure la ressource de l’index.
Besoin d'un accompagnement SEO ?
Vous hésitez sur les pages à désindexer ou à garder dans Google ? Faisons le tri ensemble.