SEO
Que signifie noindex ? Fonctionnement, cas d'usage et comment le repérer
noindex tient une page à l'écart des résultats de recherche. Comment il fonctionne, en quoi il diffère d'un blocage robots.txt, quand c'est le bon outil, et comment repérer celui qui a été laissé par erreur.
Sur cette page
noindex est une instruction adressée aux moteurs de recherche : vous pouvez visiter cette page, mais ne l'affichez pas dans les résultats. C'est l'un des leviers les plus utiles dont vous disposez pour maîtriser ce qui apparaît dans la recherche, et, lorsqu'il est laissé par erreur, l'un des plus dommageables, car rien sur la page ne semble anormal aux yeux des visiteurs.
Deux façons de définir un noindex
La balise meta robots
Dans le <head> de la page : <meta name="robots" content="noindex">. Le nom robots s'applique à tous les moteurs de recherche ; vous pouvez en cibler un seul par son propre nom, par exemple googlebot. Les directives se combinent : noindex, nofollow demande en plus aux robots de ne pas suivre les liens de la page, et none équivaut à noindex, nofollow.
L'en-tête X-Robots-Tag
Les mêmes directives peuvent être envoyées dans un en-tête de réponse HTTP : X-Robots-Tag: noindex. C'est la seule solution pour les fichiers non HTML comme les PDF, et il est facile de le définir pour tout le site dans la configuration du serveur, ce qui explique aussi qu'on l'y oublie. Vous ne le verrez pas dans le code source de la page ; consultez les en-têtes de réponse dans les outils de développement ou avec curl -I.
noindex n'est pas un blocage robots.txt
C'est le malentendu le plus répandu. Disallow dans robots.txt empêche les robots de récupérer une page ; noindex les empêche de l'indexer. Pour qu'un robot voie un noindex, il doit récupérer la page : si vous bloquez une URL dans robots.txt, le robot ne voit donc jamais le noindex. L'URL peut même apparaître dans les résultats, sans description, si d'autres sites pointent vers elle.
Par conséquent, pour tenir une page à l'écart de la recherche, autorisez l'exploration et utilisez noindex. Google a cessé de prendre en charge les règles noindex dans robots.txt en 2019. Notre guide sur robots.txt et sitemap.xml explique à quoi sert réellement robots.txt.
Quand noindex est le bon outil
- Les pages de remerciement, de confirmation et de compte, sans intérêt dans la recherche.
- Les pages de résultats du moteur de recherche interne.
- Les pages d'étiquettes, d'archives ou de filtres au contenu mince, que vous ne voulez pas voir concurrencer vos pages principales.
- Les sites de préproduction et de prévisualisation, idéalement protégés aussi par un mot de passe, puisque
noindexn'empêche personne de les visiter. - Les pages de destination de campagne qui dupliquent votre contenu principal.
noindex n'est pas le bon outil pour les doublons que vous voulez regrouper sous une seule URL : utilisez pour cela une balise canonique ou une redirection, comme expliqué dans comment corriger les problèmes de balise canonique. Et n'associez pas noindex à une balise canonique pointant vers une autre page : l'un dit « écartez cette page », l'autre « cette page est une copie de celle-là ».
Comment un noindex reste en place par erreur
- Un réglage du site de préproduction recopié en production lors de la mise en ligne.
- La case « Demander aux moteurs de recherche de ne pas indexer ce site » de WordPress, dans Réglages → Lecture, restée cochée.
- Un réglage par défaut d'une extension SEO qui passe en noindex des types de contenu entiers, comme les produits ou les catégories.
- Un en-tête
X-Robots-Tagajouté dans la configuration du serveur ou du CDN pour la préproduction, puis déployé partout. - Un gabarit de page qui ajoute
noindexlorsqu'un champ est vide.
Vérifiez si une page est indexable
L'outil d'analyse SEO gratuit de Rudra recherche un noindex dans la balise meta robots et l'en-tête X-Robots-Tag, contrôle robots.txt et résume le tout : indexable ou non, avec la raison.
Comment contrôler une page
Soumettez la page à l'outil d'analyse SEO gratuit de Rudra. Il recherche noindex et nofollow (ou none) dans la balise meta robots et dans l'en-tête X-Robots-Tag, vérifie si robots.txt bloque la page et relève une redirection HTTP ou un code d'erreur, puis affiche un verdict unique, « indexable » ou non, accompagné de la raison. Il signale aussi comme un conflit une page en noindex dont la balise canonique pointe ailleurs, et mentionne les directives qui limitent l'extrait, comme nosnippet, lesquelles ne bloquent pas l'indexation mais modifient l'apparence du résultat. Un noindex coûte 30 points au score SEO, parce qu'il retire entièrement la page de la recherche.
À l'échelle d'un site entier, une analyse de site Rudra compte les pages indexables et les pages en noindex, et signale les pages en noindex listées dans votre sitemap. Dans Google Search Console, le rapport « Indexation des pages » liste les pages « Exclue par la balise "noindex" », et l'inspection d'URL indique si une URL donnée peut être indexée.
Supprimer un noindex
- Trouvez d'où il vient : code source de la page (balise meta), en-têtes de réponse (
X-Robots-Tag), réglages du CMS, réglages de l'extension SEO ou configuration du serveur. - Supprimez-le à la source, et videz tout cache de pages ou de CDN.
- Contrôlez de nouveau la page en ligne pour confirmer que la balise et l'en-tête ont tous deux disparu.
- Assurez-vous que la page n'est pas bloquée dans robots.txt et qu'elle figure dans votre sitemap.
- Dans Search Console, utilisez l'inspection d'URL et demandez l'indexation des pages importantes. La réexploration peut tout de même prendre des jours, voire des semaines.
Questions fréquentes
noindex retire-t-il immédiatement une page de Google ?
Non. Google doit réexplorer la page pour voir la directive. Pour les retraits urgents, l'outil « Suppressions » de Search Console masque temporairement une URL le temps que le noindex prenne effet.
Les pages en noindex transmettent-elles encore des signaux de liens ?
Les robots peuvent toujours suivre les liens d'une page en noindex, sauf si vous ajoutez nofollow. À la longue, les moteurs de recherche peuvent explorer moins souvent une page en noindex : ne comptez donc pas sur ces pages comme voie d'accès principale à vos contenus importants.
Les pages en noindex doivent-elles figurer dans mon sitemap ?
Non. Un sitemap doit lister les pages que vous souhaitez voir indexées. Y lister des pages en noindex envoie des signaux contradictoires.
noindex et nofollow, est-ce la même chose ?
Non. noindex tient la page à l'écart des résultats ; nofollow demande aux robots de ne pas suivre ses liens. On peut les utiliser séparément ou ensemble.