Vous avez probablement déjà vu ces deux lignes de code : <meta name="robots" content="noindex"> et rel="nofollow". À première vue, ça se ressemble. Mais franchement, confondre les deux, c'est un peu comme confondre une porte verrouillée et un panneau "déviation". L'une empêche les robots d'entrer, l'autre les redirige ailleurs. Et la différence a un impact direct sur votre SEO.
Je vais vous raconter comment j'ai appris cette leçon – à mes dépens – et vous donner une méthode claire pour ne plus jamais hésiter.
Points clés à retenir
- Noindex : dit aux moteurs de recherche de ne PAS inclure une page dans leurs résultats de recherche.
- Nofollow : dit aux moteurs de recherche de ne PAS suivre les liens présents sur une page (ou un lien spécifique).
- On peut les combiner :
noindex, follow(page non indexée, mais liens suivis) ounoindex, nofollow. - Robots.txt bloque le crawl, pas l'indexation. Ne mélangez pas les deux.
- Utilisez noindex pour les pages sans valeur SEO (remerciements, connexion, doublons).
- Utilisez nofollow pour les liens non fiables ou sponsorisés.
Noindex vs nofollow : la différence fondamentale
Quand j'ai commencé le SEO, il y a 4 ans, je croyais que les deux faisaient la même chose : cacher des pages. Grave erreur.
Imaginez Google comme un bibliothécaire. Il parcourt votre site en lisant chaque page et en prenant des notes.
- Noindex (balise meta robots) : c'est un mot au bibliothécaire : "Surtout, ne mets pas ce livre dans le catalogue. Tu peux le feuilleter, mais ne le référence pas." La page est crawlée, analysée… mais pas indexée. Elle n'apparaît pas dans les résultats de recherche.
- Nofollow (attribut sur un lien) : c'est un autre mot : "Ce livre-là, ne le suis pas. Ne va pas voir ce qu'il y a dedans." Le lien n'est pas suivi, et le "jus" SEO (PageRank) n'est pas transmis.
Résultat : une page sans indexation mais avec des liens suivis (noindex, follow) est une page que Google lira, analysera, mais ne montrera jamais. Une page avec nofollow sur tous ses liens est une page que Google indexera, mais dont les liens ne compteront pas.
Exemple concret : une page de remerciement après inscription. Je l'ai mise en noindex, follow pendant des mois. Google la crawlait, suivait les liens (vers la page d'accueil, vers les CGU), mais elle n'apparaissait jamais dans les SERP. Parfait.
C'est quoi un lien nofollow ?
Un lien nofollow, c'est un lien standard, mais avec un petit attribut HTML qui dit à Google : "Ne me juge pas sur ce lien." Plus précisément, il indique aux moteurs de recherche de ne pas suivre le lien ni prendre en compte le contenu de la page vers laquelle il pointe dans le référencement naturel.
Avant 2019, c'était binaire : soit "follow" (transmission d'autorité), soit "nofollow" (aucune transmission). Depuis 2019, Google traite nofollow comme un "hint" (indice) : il peut décider de le suivre quand même s'il estime que le contexte le justifie. Mais dans 99% des cas, il ne le fait pas.
À mon avis, cette évolution est une bonne chose. Cela évite les abus de spammeurs tout en donnant une flexibilité à Google.
Quand utiliser nofollow ?
- Liens payants ou sponsorisés (obligatoire selon les règles de Google – sinon pénalité).
- Liens d'affiliation (commission sur vente).
- Liens dans les commentaires (pour éviter le spam).
- Liens vers des sites que vous ne recommandez pas vraiment.
Je me souviens d'un client qui avait un blog avec des liens d'affiliation en "follow". Il a reçu une notification manuelle de Google. On a tout passé en "nofollow" en un week-end – et il a récupéré son trafic en 3 semaines.
Pourquoi inclure une balise NoIndex sur certaines pages ?
La balise noindex sert à empêcher l'indexation de pages spécifiques par les moteurs de recherche, tout en restant accessibles via le lien. Autrement dit, Google peut encore les voir (crawler), mais il ne les mettra pas dans son index.
Scénarios typiques :
- Pages de remerciement après un achat ou une inscription.
- Pages de connexion, d'inscription, de mot de passe oublié.
- Pages de résultats de recherche interne (souvent du contenu dupliqué).
- Pages en A/B testing ou en version bêta.
- Pages avec du contenu mince ou dupliqué (catégories vides, etc.).
Erreur classique : j'ai mis un jour une balise noindex sur une page d'accueil d'un site e-commerce… parce que je voulais tester une nouvelle version. Résultat : Google a dé-indexé la page principale pendant 2 semaines. Le trafic organique a chuté de 40% en une semaine. Ne mettez jamais noindex sur des pages qui reçoivent du trafic ou qui ont des backlinks.
Un autre piège : si une page a des backlinks et que vous la mettez en noindex, vous perdez l'autorité que ces liens apportaient. Google ne peut plus associer le "jus" à la page.
Les 3 types de SEO et leur lien avec noindex/nofollow
SEO technique : c'est ici que les balises noindex et nofollow jouent un rôle crucial. Bien gérer l'indexation et le crawl, c'est du technique pur. Les pages sans valeur SEO doivent être en noindex. Les liens non fiables doivent être en nofollow.
SEO on-page : le contenu et les balises HTML. Noindex est une balise meta, nofollow est un attribut de lien. Les deux impactent la façon dont Google perçoit la structure de votre site.
SEO off-page : les backlinks. Un lien nofollow ne transmet pas d'autorité, mais il peut quand même générer du trafic (un visiteur clique dessus). Et Google peut parfois lui attribuer une petite valeur.
À mon avis, le SEO technique est le parent pauvre du trio. Les gens optimisent le contenu et les backlinks, mais oublient que sans une bonne gestion de l'indexation, le reste ne sert à rien. J'ai passé 6 mois à optimiser le contenu d'un blog sans toucher aux balises – et je me demandais pourquoi mes pages n'étaient pas indexées. Le problème ? Un mauvais paramétrage de noindex sur la page d'accueil…
Quand ne PAS utiliser noindex ?
Sur les pages stratégiques : page d'accueil, pages catégories principales, articles de blog à fort trafic, pages avec backlinks. Si vous mettez noindex sur une page qui a des backlinks, vous jetez l'autorité par la fenêtre. Google ne peut plus associer le "jus" à la page. Et vous perdez le trafic.
Les erreurs techniques courantes avec robots.txt et noindex
Beaucoup confondent robots.txt (fichier qui bloque le crawl) et noindex (balise qui bloque l'indexation). Si vous bloquez le crawl avec robots.txt, Google ne verra jamais la balise noindex (car elle est dans le HTML). Résultat : la page peut quand même être indexée (si un autre site y pointe un lien). La solution : ne bloquez jamais le crawl d'une page que vous voulez désindexer. Laissez Google la voir, et mettez la balise noindex.
Je l'ai appris après avoir bloqué le crawl d'une page de connexion pendant 3 mois… Google l'avait indexée via un lien externe, et je n'arrivais pas à la désindexer. J'ai retiré la directive robots.txt, ajouté la balise noindex, et en 2 semaines, elle a disparu.
Matrice décisionnelle : noindex, nofollow, combinaisons
| Type de page | Directive recommandée | Raison |
|---|---|---|
| Page de remerciement (achat, inscription) | noindex, follow | Ne pas indexer, mais suivre les liens (ex: vers la page d'accueil) |
| Page de connexion, inscription | noindex, follow | Idem – pas de valeur SEO, mais les liens utiles |
| Résultats de recherche interne | noindex, follow | Contenu dupliqué, mais suivre les liens vers les produits |
| Pages en A/B testing | noindex, nofollow | Page temporaire, ne pas suivre les liens (souvent des liens cassés) |
| Page avec contenu mince (catégorie vide) | noindex, follow | Éviter l'indexation, mais suivre les liens vers d'autres catégories |
| Lien sponsorisé / payant | nofollow sur le lien | Respecter les règles Google, éviter pénalité |
| Lien d'affiliation | nofollow sur le lien | Idem |
| Commentaire suspect | nofollow sur le lien | Éviter le spam |
Cas particulier : les pages de tags sur WordPress. J'ai un blog avec 50 tags. Certains n'ont qu'un seul article. Je les ai tous mis en noindex, follow pour éviter le contenu dupliqué. En 2 mois, le temps de crawl de mon site a diminué de 30%, et les pages réellement importantes ont été crawlées plus souvent.
Ce que j'aurais aimé savoir avant
Quand j'ai commencé, j'ignorais que noindex et nofollow pouvaient cohabiter. Je pensais que c'était l'un ou l'autre. Maintenant, je vois ça comme une boîte à outils : chaque page mérite une réflexion sur son rôle et sa valeur.
Un dernier conseil : ne mettez jamais noindex sur une page que vous n'avez pas visitée depuis 6 mois. Vous risquez d'oublier une page stratégique. Et une fois que Google l'a désindexée, la récupération peut prendre des semaines.
Spoiler : j'ai fait cette erreur avec la page "À propos" d'un site que j'optimisais – et j'ai mis 3 semaines à comprendre pourquoi les visiteurs ne trouvaient plus le lien vers nos coordonnées.
Alors, prochaine fois que vous codez une balise, posez-vous la question : est-ce que je veux cacher le livre ou simplement ne pas suivre le chemin ? La réponse change tout.