Par l’équipe Limpi. Les faits externes sont distingués des méthodes Limpi et aucune visibilité, position ou citation automatique n’est garantie.
Comprendre le problème
La combinaison meta robots noindex, nofollow associe deux instructions distinctes : noindex concerne l’apparition de la page dans les résultats pris en charge par le moteur, tandis que nofollow demande de ne pas suivre les liens de cette page selon le comportement documenté. Leur présence doit correspondre à un objectif explicite, pas à une recette générale pour bloquer une zone.
Inspecter le comportement réellement servi
Lisez la balise meta robots dans le HTML final et vérifiez les éventuelles directives X-Robots-Tag. Contrôlez aussi le statut HTTP et l’accès par robots.txt, car un crawler doit pouvoir obtenir la réponse pour lire une directive portée dans la page. Relevez les valeurs selon user-agent si plusieurs meta ou en-têtes ciblés existent.
Distinguer les mécanismes proches
noindex n’est pas robots.txt : l’un est une directive d’indexation lue dans une réponse accessible, l’autre contrôle l’exploration selon ses règles. nofollow ne rend pas les URL liées privées et ne remplace pas une authentification. Séparez également la décision d’indexer cette page de la façon dont ses liens participent à la découverte du reste du site.
Identifier les causes probables
La combinaison peut provenir d’un environnement de préproduction copié en production, d’un plugin SEO configuré globalement ou d’une règle de template appliquée à trop de routes. Une page peut aussi hériter d’un nofollow alors que ses liens internes sont nécessaires au maillage, sans qu’une intention claire ne justifie ce choix.
Corriger à la bonne couche
Définissez d’abord l’objectif : la page doit-elle apparaître dans les résultats, ses liens doivent-ils être traités normalement, et la zone doit-elle être accessible publiquement ? Ajustez ensuite les directives à cet objectif. Si le besoin est de protéger une information, utilisez un contrôle d’accès approprié plutôt que de compter sur noindex ou nofollow.
Traiter les cas limites sans automatisme
Une page noindex peut encore être accessible directement et ses URLs peuvent être découvertes par d’autres moyens. Des moteurs ou crawlers différents peuvent avoir des comportements spécifiques ; cette page borne ses explications à la documentation Google utilisée comme source. Vérifiez les directives combinées et les valeurs contradictoires entre HTML et en-têtes.
Valider sur des cas réels
Après modification, demandez la page comme un crawler autorisé et confirmez que la directive finale correspond à l’intention. Vérifiez qu’aucun robots.txt ne rend la balise illisible si votre stratégie dépend de noindex. Contrôlez également quelques pages du même gabarit pour éviter qu’une correction locale laisse une règle globale incohérente.
Conserver une preuve reproductible
Conservez le HTML ou l’en-tête contenant la directive, le statut HTTP, la règle robots.txt applicable et la décision d’indexation attendue. Une preuve utile montre la configuration réellement servie, pas seulement le réglage d’un plugin. Documentez les différences entre pages si le template applique des directives conditionnelles.
Prévenir la régression
Centralisez la politique robots meta par type de page et ajoutez un contrôle de non-régression sur les routes publiques majeures. Lors d’un passage préproduction vers production, vérifiez explicitement noindex. Évitez les cases à cocher globales dont l’effet sur nofollow ou X-Robots-Tag n’est pas visible dans la revue de déploiement.
Clôturer le diagnostic
noindex et nofollow répondent à deux questions différentes. Utilisez-les seulement lorsque chaque effet correspond à l’objectif de la page, et gardez la réponse accessible au crawler lorsqu’une directive doit être lue. Ne les présentez ni comme mécanisme de confidentialité ni comme équivalent d’une règle robots.txt.
Construire une matrice de contrôle
Pour directive noindex nofollow, construisez une matrice qui sépare constat, intention, couche propriétaire et preuve finale. Le périmètre documentaire de cette page est volontairement borné : Décrire noindex et nofollow selon la documentation Google, en séparant l’exclusion des résultats de la décision de suivre les liens de la page. Ajoutez au minimum le contexte de test, la valeur observée, le résultat attendu, l'origine technique supposée puis confirmée, et la méthode de revalidation. Quand plusieurs gabarits partagent le même composant, échantillonnez des cas représentatifs plutôt que de multiplier des constats identiques. Une anomalie ambiguë doit rester en revue jusqu'à ce qu'une preuve distingue clairement configuration, contenu et comportement réellement servi. Cette matrice permet aussi de vérifier qu'une correction locale ne masque pas un problème global et qu'un changement d'infrastructure n'est pas confondu avec une décision éditoriale.
Relier ce contrôle au reste du diagnostic
Ce sujet ne doit pas être traité isolément. Vérifiez les pages et contrôles liés /seo/indexation-crawl, /seo/robots-txt-vs-meta-robots, /seo/x-robots-tag, puis comparez leurs conclusions avec l'intention « meta robots noindex nofollow ». Les sources officielles associées à cette page sont google_robots_meta; elles bornent les affirmations externes et doivent être revalidées si leur documentation évolue. Ne transformez pas une recommandation Limpi en règle universelle : distinguez ce qui est imposé par une spécification, ce qui dépend d'un moteur ou navigateur et ce qui relève d'un choix d'implémentation. Terminez par un contrôle de cohérence entre title, H1, contenu visible, canonical, maillage et données structurées. Si deux signaux se contredisent, conservez le cas en revue au lieu de conclure sur la base d'un seul outil. Consignez enfin la date du contrôle, le gabarit concerné et le propriétaire de la correction afin de pouvoir rejouer exactement le même scénario après une évolution du site. Pour isoler ce diagnostic, relevez aussi googlebot, robots meta, indexation SERP, liens sortants, directives combinées, valeur content, user-agent ciblé, héritage CMS, template conditionnel, environnement de staging et accessibilité de la réponse. Cette nomenclature évite de mélanger la politique d'indexation HTML avec le contrôle d'accès, le fichier robots.txt ou le traitement d'un document non HTML. Ajoutez crawl autorisé, balise head, directive index, directive follow, snippet, archive, traduction, imageindex, max-snippet, unavailable_after, héritage par layout, environnement production, contrôle Search Console, rendu serveur, statut 200, réponse HTML, route marketing, catégorie, pagination et politique éditoriale.
Sources officielles
Les règles des moteurs et des fournisseurs de crawlers peuvent évoluer. Les affirmations techniques de cette page sont bornées par les documentations officielles ci-dessous.
Continuer à comprendre votre visibilité
À lire ensuite
Indexation et crawl : comprendre pourquoi Google trouve ou ignore vos pages robots.txt ou meta robots : quelle différence ? Quand utiliser X-Robots-Tag plutôt qu’une meta robots ?