Retour au blog
SEO technique

Noindex SEO : retirer une URL de l’index sans la bloquer

Choisissez entre noindex, robots.txt et X-Robots-Tag pour retirer une URL des résultats sans empêcher son contrôle.

Schéma original montrant les chemins noindex, robots.txt et X-Robots-Tag
Schéma original montrant les chemins noindex, robots.txt et X-Robots-Tag
Richard Cohen

Par Richard Cohen

Founder & SEO Strategist

Publié le Mis à jour le 3 min de lectureLinkedIn

Réponse directe : utilisez noindex lorsque Google doit pouvoir accéder à une URL et constater qu’elle ne doit pas apparaître dans les résultats. Utilisez robots.txt pour contrôler l’exploration d’un chemin, mais ne le considérez pas comme un moyen fiable de faire disparaître une URL déjà connue. Pour un fichier non HTML, le contrôle adapté est généralement X-Robots-Tag.

Commencer par la décision éditoriale

Avant d’ajouter une balise, écrivez la raison de l’exclusion. S’agit-il d’une page de confirmation, d’une recherche interne, d’une variante temporaire, d’un environnement de test ou d’une page qui fait doublon avec une URL propriétaire ? La justification doit être compréhensible par une autre personne dans quelques mois.

Séparez la question « cette URL doit-elle être dans Google ? » de la question « Google doit-il pouvoir suivre les liens présents ici ? ». Une page de confirmation peut être exclue tout en laissant les liens fonctionner. Une zone privée demande un contrôle d’accès, pas une simple directive pour les robots. Une page canonique mal choisie demande une décision de contenu avant une directive d’indexation.

Comprendre les trois contrôles

Sur une page HTML, une directive peut être placée dans le document : . Noindex demande de ne pas afficher la page dans les résultats. Follow est une décision séparée : n’ajoutez pas automatiquement une restriction aux liens.

Pour un PDF ou une ressource sans section HTML, utilisez l’en-tête HTTP : X-Robots-Tag: noindex. Google précise que ces réglages ne peuvent être lus que si le crawler accède à la ressource. Une page bloquée par robots.txt avant la lecture de sa balise noindex ne fournit donc pas la même information.

Robots.txt sert à donner des règles d’exploration par chemin. Il peut réduire des accès inutiles, mais il ne remplace pas une instruction d’indexation. Une URL connue par un lien peut rester visible sous une forme limitée si Google ne peut pas la consulter. Retirer une URL du sitemap ne produit pas à lui seul une instruction noindex.

Dans une application JavaScript, ne faites pas apparaître noindex uniquement après une exécution client si la page doit redevenir indexable après correction. Google indique qu’un noindex rencontré peut empêcher le rendu et l’exécution JavaScript ; une logique tardive peut donc produire un résultat inattendu.

Méthode de contrôle

1. Listez l’URL, sa famille, sa page propriétaire et la raison de l’exclusion. 2. Vérifiez le statut HTTP, les redirections et l’en-tête X-Robots-Tag. 3. Lisez le HTML initial et recherchez les directives robots. 4. Comparez robots.txt et noindex afin de détecter un blocage contradictoire. 5. Contrôlez les liens, la canonical et le sitemap. 6. Testez une URL concernée, une URL qui doit rester indexable et une URL redirigée. 7. Après une mise à jour autorisée, contrôlez l’URL dans Search Console et archivez l’état.

Quand choisir une autre solution

Une page presque identique n’est pas automatiquement un cas noindex. Une consolidation ou une redirection pertinente peut être préférable. Une ressource confidentielle ne doit pas compter sur noindex comme seule protection : utilisez une authentification ou une restriction d’accès adaptée.

Si un document doit être trouvé, gardez-le textuel, accessible et relié depuis une page HTML utile. Pour ce cas, consultez le guide SEO PDF. Pour le diagnostic par URL, lisez l’Inspection Search Console.

FAQ

Noindex supprime-t-il immédiatement une URL ?

Non. Google doit pouvoir explorer la ressource et mettre à jour son état.

Faut-il ajouter nofollow avec noindex ?

Pas automatiquement. L’indexation et le suivi des liens sont deux décisions différentes.

Une URL bloquée par robots.txt peut-elle apparaître ?

Oui, une URL connue peut parfois apparaître avec peu de contenu si Google ne peut pas la consulter.

Passer à l’action

Demandez un audit SEO pour vérifier directives, sitemap, rendu et liens avant modification.

Sources primaires

  • Robots meta tags et X-Robots-Tag
  • Googlebot
  • Bases du SEO JavaScript
  • Sources & Références