Tout comprendre sur RankerSquare Voir

Balise noindex : à quoi ça sert et quand l'utiliser

La balise noindex empêche une page d'apparaître dans Google sans la supprimer du site. Définition, code exact, cas d'usage et erreurs à éviter.

Qu’est-ce que la balise noindex ?

La balise noindex est une instruction placée dans le code d'une page pour demander aux moteurs de ne pas l'afficher dans leurs résultats. Elle prend la forme d'une balise <meta> noindex posée dans l'en-tête HTML, sous la ligne suivante : <meta name="robots" content="noindex">. La page reste en ligne et reste accessible aux visiteurs. Seule sa présence dans l'index disparaît. C'est une directive, non une simple suggestion : Google, Bing et les autres la respectent.

À quoi sert cette directive

Toutes les pages d'un site n'ont pas vocation à être trouvées sur Google. Un formulaire envoyé, un filtre produit, une page de test : ces adresses encombrent l'indexation Google sans jamais générer un appel. Les exclure permet de concentrer l'attention des robots sur les pages qui vendent, un point décisif quand le budget de crawl est limité. Pour un dirigeant, l'enjeu est simple : montrer au moteur ce qui rapporte, et rien d'autre.

Comment ça marche côté code

Les robots d'exploration lisent le code source avant de décider s'ils ajoutent l'URL à leur index. Quand ils rencontrent la consigne, la page concernée est retirée ou jamais ajoutée. Pour les fichiers sans HTML, comme un PDF ou une image, on passe par l'en-tête HTTP X-Robots-Tag, qui transmet les mêmes règles. Sur WordPress, la plupart des extensions SEO proposent une case par page qui écrit cette balise à votre place.

  • noindex, follow : la page sort de l'index, mais les liens qu'elle contient restent suivis
  • noindex, nofollow : la page sort de l'index et ses liens ne sont plus suivis
  • X-Robots-Tag : la même consigne pour un PDF, une image ou un fichier téléchargeable
  • Réglages WordPress : une case à cocher par article, par page ou par type de contenu

Quand utiliser noindex sur certaines pages

Les raisons sont presque toujours les mêmes : la page sert au visiteur, mais elle n'a aucune chance ni aucun intérêt à se positionner. Certaines pages créent même du contenu dupliqué et brouillent la lecture de votre site. D'autres n'existent que pour un usage interne. Voici les familles d'adresses qui ne doivent pas rester dans l'index.

  • Panier, tunnel de commande, compte client et espace de connexion
  • Pages de remerciement après un formulaire ou un achat
  • Résultats de recherche interne et pages de filtres générées automatiquement
  • Mentions légales, pages de test, versions d'impression
  • Archives d'étiquettes vides ou très pauvres en contenu

noindex ou fichier robots.txt : ne pas confondre

Les deux outils n'agissent pas au même endroit. Le fichier robots.txt sert à bloquer l'accès des robots à une adresse : c'est une règle d'exploration. Le noindex, lui, agit après la lecture et vise l'indexation d’une page. Point important : si vous interdisez l'exploration dans le fichier robots.txt, le moteur ne verra jamais la consigne et pourra quand même afficher l'URL. Pour empêcher l'indexation, laissez l'accès ouvert et utilisez la balise meta. Le sitemap XML ne doit pas non plus lister une page mise en noindex.

Les erreurs courantes et comment vérifier

L'accident le plus fréquent arrive lors d'un nouveau site : la case « demander aux moteurs de recherche de ne pas indexer ce site » reste cochée après la mise en ligne. Le trafic ne décolle jamais, et personne ne comprend pourquoi. Un contrôle dans la Search Console, via l'inspection d'URL, révèle le problème en quelques secondes. C'est aussi le premier réflexe à avoir avant de lancer une campagne de référencement SEO.

  • Oublier de décocher le réglage de blocage global après une refonte
  • Mettre un noindex sur une page stratégique au lieu d'une adresse secondaire
  • Combiner blocage robots.txt et balise meta, ce qui annule la consigne
  • Laisser des pages exclues dans le sitemap et envoyer des signaux contradictoires
  • Ne jamais vérifier le code source après une mise à jour du thème

Questions fréquentes

Pour éviter que des adresses sans valeur commerciale ne diluent la perception de votre site par le moteur de recherche. Une page de panier ou de confirmation ne répond à aucune requête. La sortir de l'index améliore la qualité moyenne de ce que Google voit de vous, et concentre l'exploration sur vos pages de vente.

Le noindex empêche l'affichage de la page dans les résultats. Le nofollow concerne les liens : il indique de ne pas suivre une destination. Les deux s'écrivent dans la même balise meta et peuvent se combiner, mais ils ne traitent pas du tout le même sujet.

Où se cache exactement la consigne (le fameux noindex) ? La balise se lit dans le code source, entre les balises head, en cherchant le terme « robots ». Sur WordPress, elle se pilote depuis l'onglet SEO de l'éditeur. Pour ne plus indexer une page, il suffit de l'activer, puis de contrôler le résultat dans la Search Console : une page ne quitte l'index qu'après un nouveau passage du robot, ce qui prend de quelques jours à quelques semaines.

À lire aussi. Sur le même thème.