Crawl et indexation Niveau · Intermédiaire Lecture 4 min

Noindex

Retirer une page de l’index sans bloquer son exploration, et ne pas le confondre avec le nofollow.

Définition courte

Le noindex (balise meta robots noindex ou en-tête X-Robots-Tag) est une règle d’indexation qui demande aux moteurs de recherche de ne pas afficher une page dans leurs résultats. Le noindex n’empêche pas le crawl : il exclut la page de l’index. En SEO, il retire des URL sans intérêt des résultats, sans supprimer la page du site.

À retenir
01Pour être pris en compte, le noindex exige une page crawlable, jamais bloquée par le robots.txt (Google Search Central).
02Le noindex existe sous deux formes au même effet : balise meta robots et en-tête X-Robots-Tag (Google Search Central).
03Depuis le 1er septembre 2019, Google n’accepte plus la règle noindex dans le robots.txt (billet Google, 2 juillet 2019).

Comment fonctionne le noindex ?

Le noindex agit au moment du crawl. Quand Googlebot explore une page, il lit la balise meta robots dans le <head> ou l’en-tête HTTP X-Robots-Tag. Si la règle noindex est présente, Google retire la page de son index à la prochaine exploration, même si d’autres sites pointent vers elle. Le noindex n’a donc d’effet que si la page reste accessible aux robots. Une page bloquée par le robots.txt n’est pas explorée : Google ne voit jamais le noindex, et l’URL peut rester indexée via des liens externes. Le noindex accepte des valeurs combinées, comme noindex, follow ou noindex, nofollow, qui précisent si les liens de la page doivent être suivis. En cas de règles contradictoires, la plus restrictive s’applique.

Pourquoi le noindex est important pour le SEO ?

Le noindex sert à piloter ce que Google affiche d’un site. Sur un site volumineux, de nombreuses URL techniques (tri, filtres à facettes, recherche interne, panier, pages de remerciement) diluent la qualité perçue et consomment du budget de crawl. Le noindex retire ces pages des résultats tout en les gardant accessibles aux internautes. À l’inverse, un noindex posé par erreur sur une page stratégique la fait disparaître des SERP : c’est l’une des causes les plus fréquentes de chute brutale du trafic organique. Le noindex demande donc une vérification régulière en audit, car une seule directive mal placée peut coûter la visibilité d’une section entière.

CritèrenoindexDisallow (robots.txt)
ObjectifExclure la page de l’indexEmpêcher le crawl de la page
La page est-elle explorée ?Oui, indispensable pour lire la règleNon, le robot n’y accède pas
Peut-elle apparaître dans les SERP ?Non, une fois recrawléeOui, en URL seule si des liens externes pointent vers elle
Où se place la règleBalise meta robots ou en-tête HTTPFichier robots.txt à la racine

Quand utiliser une balise noindex ?

Une balise noindex s’utilise sur les pages sans valeur pour la recherche mais utiles aux internautes : pages de remerciement, panier, résultats de recherche interne, pages de compte, versions imprimables, environnements de test. L’objectif est de garder ces URL accessibles tout en les excluant des résultats Google. À l’inverse, une balise noindex ne doit jamais figurer sur une page stratégique que vous voulez faire ranker.

Quelle est la différence entre noindex et nofollow ?

Le noindex et le nofollow répondent à deux besoins distincts. Le noindex empêche l’indexation d’une page : elle n’apparaît pas dans les résultats. Le nofollow, appliqué à un lien ou via la balise meta robots, indique aux moteurs de ne pas suivre les liens et de ne pas transmettre de signal à travers eux. On peut les combiner en noindex, nofollow, mais noindex, follow laisse Google suivre les liens d’une page tout en la gardant hors de l’index.

Exemple concret de noindex

Un noindex mal implémenté vient souvent d’une confusion avec le robots.txt. La bonne pratique consiste à poser la règle dans le code de la page (ou dans l’en-tête HTTP pour une ressource non HTML), et à laisser cette page crawlable pour que Google lise la directive.

<!-- Dans le <head> de la page HTML --> <meta name="robots" content="noindex, follow"># Ou via l'en-tete HTTP (ressource non HTML, ex. PDF) X-Robots-Tag: noindex

Erreur fréquente observée en audit

Cas réel. Sur un site voyage à fort volume, un mauvais pattern d’URL avait généré environ 14 000 pages inutiles. Pour les retirer proprement des résultats, il ne fallait pas combiner noindex et blocage robots.txt : une page bloquée au crawl ne permet pas à Google de lire la directive. La correction a consisté à nettoyer les liens internes, laisser Google recrawler les URL à traiter, puis consolider les pages canoniques utiles.

Aller plus loin

Faire expliquer ce terme par une IA

Ouvre le moteur de ton choix avec un prompt pré-rempli sur ce terme.

Sources

  1. 1Google Search Central, Bloquer l’indexation dans la recherche avec noindex · documentation officielle
  2. 2Google Search Central Blog, A note on unsupported rules in robots.txt · 2 juillet 2019

Trois idées reçues sur le noindex

Le noindex concentre les confusions les plus coûteuses en audit. Elles portent toutes sur la frontière entre exploration et indexation.

Mythe

Le robots.txt permet de désindexer une page. Google ignore la directive noindex dans le robots.txt depuis le 1er septembre 2019. Bloquer l’URL empêche même la lecture du noindex placé dans la page.

Mythe

Le noindex bloque le passage de Googlebot. Le noindex exclut la page de l’index sans empêcher son exploration. Googlebot doit crawler la page pour lire la directive.

Mythe

Noindex et nofollow font la même chose. Le noindex porte sur l’indexation de la page, le nofollow sur le traitement des liens. Les deux se combinent sans se remplacer.

Questions fréquentes

Pourquoi ma page en noindex apparaît-elle encore dans Google ?

Un blocage au robots.txt empêche Google de lire la directive. La page reste alors indexée par ses liens entrants, sans extrait. Retirer le Disallow autorise le crawl et la prise en compte du noindex.

Combien de temps avant qu’un noindex fasse effet ?+

L’effet suit le prochain passage de Googlebot. Le délai va de quelques jours à plusieurs semaines selon la fréquence de crawl. L’inspection d’URL accélère la prise en compte page par page.

Faut-il retirer une page en noindex du sitemap ?+

Oui, une fois la désindexation constatée. Le sitemap sert à signaler les URL destinées à l’index. Garder l’URL le temps du traitement aide Google à repasser lire la directive.

Damien Hernandez, consultant SEO senior
Auteur

Damien Hernandez

Consultant SEO senior, 17 ans d’expérience (Accor, Louvre Hotels, Infopro Digital). Spécialiste SEO technique, analyse de logs et optimisation pour les moteurs génératifs (GEO).