Mis à jour le 8 juillet 2026 · Relu et vérifié par Damien Hernandez
Noindex : définition, rôle et bonnes pratiques SEO
Le noindex (balise meta robots noindex ou en-tête X-Robots-Tag) est une règle d’indexation qui demande aux moteurs de recherche de ne pas afficher une page dans leurs résultats. Le noindex n’empêche pas le crawl : il exclut la page de l’index. En SEO, il retire des URL sans intérêt des résultats, sans supprimer la page du site.
À retenir
- Pour être pris en compte, le noindex exige une page crawlable, jamais bloquée par le robots.txt (Google Search Central).
- Le noindex existe sous deux formes au même effet : balise meta robots et en-tête X-Robots-Tag (Google Search Central).
- Depuis le 1er septembre 2019, Google n’accepte plus la règle noindex dans le robots.txt (billet Google, 2 juillet 2019).
Comment fonctionne le noindex ?
Le noindex agit au moment du crawl. Quand Googlebot explore une page, il lit la balise meta robots dans le <head> ou l’en-tête HTTP X-Robots-Tag. Si la règle noindex est présente, Google retire la page de son index à la prochaine exploration, même si d’autres sites pointent vers elle. Le noindex n’a donc d’effet que si la page reste accessible aux robots. Une page bloquée par le robots.txt n’est pas explorée : Google ne voit jamais le noindex, et l’URL peut rester indexée via des liens externes. Le noindex accepte des valeurs combinées, comme noindex, follow ou noindex, nofollow, qui précisent si les liens de la page doivent être suivis. En cas de règles contradictoires, la plus restrictive s’applique.
Pourquoi le noindex est important pour le SEO ?
Le noindex sert à piloter ce que Google affiche d’un site. Sur un site volumineux, de nombreuses URL techniques (tri, filtres à facettes, recherche interne, panier, pages de remerciement) diluent la qualité perçue et consomment du budget de crawl. Le noindex retire ces pages des résultats tout en les gardant accessibles aux internautes. À l’inverse, un noindex posé par erreur sur une page stratégique la fait disparaître des SERP : c’est l’une des causes les plus fréquentes de chute brutale du trafic organique. Le noindex demande donc une vérification régulière en audit, car une seule directive mal placée peut coûter la visibilité d’une section entière.
| Critère | noindex | Disallow (robots.txt) |
|---|---|---|
| Objectif | Exclure la page de l’index | Empêcher le crawl de la page |
| La page est-elle explorée ? | Oui, indispensable pour lire la règle | Non, le robot n’y accède pas |
| Peut-elle apparaître dans les SERP ? | Non, une fois recrawlée | Oui, en URL seule si des liens externes pointent vers elle |
| Où se place la règle | Balise meta robots ou en-tête HTTP | Fichier robots.txt à la racine |
Auditez l’indexation de votre site
Quand utiliser une balise noindex ?
Une balise noindex s’utilise sur les pages sans valeur pour la recherche mais utiles aux internautes : pages de remerciement, panier, résultats de recherche interne, pages de compte, versions imprimables, environnements de test. L’objectif est de garder ces URL accessibles tout en les excluant des résultats Google. À l’inverse, une balise noindex ne doit jamais figurer sur une page stratégique que vous voulez faire ranker.
Quelle est la différence entre noindex et nofollow ?
Le noindex et le nofollow répondent à deux besoins distincts. Le noindex empêche l’indexation d’une page : elle n’apparaît pas dans les résultats. Le nofollow, appliqué à un lien ou via la balise meta robots, indique aux moteurs de ne pas suivre les liens et de ne pas transmettre de signal à travers eux. On peut les combiner en noindex, nofollow, mais noindex, follow laisse Google suivre les liens d’une page tout en la gardant hors de l’index.
Exemple concret de noindex
Un noindex mal implémenté vient souvent d’une confusion avec le robots.txt. La bonne pratique consiste à poser la règle dans le code de la page (ou dans l’en-tête HTTP pour une ressource non HTML), et à laisser cette page crawlable pour que Google lise la directive.
<!-- Dans le <head> de la page HTML -->
<meta name="robots" content="noindex, follow">
# Ou via l'en-tete HTTP (ressource non HTML, ex. PDF)
X-Robots-Tag: noindex
Erreur fréquente observée en audit
Cas réel. Sur un site voyage à fort volume, un mauvais pattern d’URL avait généré environ 14 000 pages inutiles. Pour les retirer proprement des résultats, il ne fallait pas combiner noindex et blocage robots.txt : une page bloquée au crawl ne permet pas à Google de lire la directive. La correction a consisté à nettoyer les liens internes, laisser Google recrawler les URL à traiter, puis consolider les pages canoniques utiles.
Sources
- Google Search Central, Bloquer l’indexation dans la recherche avec noindex · documentation officielle
- Google Search Central Blog, A note on unsupported rules in robots.txt · 2 juillet 2019
Termes liés

Damien Hernandez · Consultant SEO senior, 15 ans d’expérience (Accor, Louvre Hotels, Infopro Digital). Spécialiste SEO technique et GEO (optimisation pour les moteurs génératifs).