Désindexation
- La désindexation retire une page des résultats de Google sans la supprimer du site.
- Elle aide à ne garder dans l’index que les contenus utiles et stratégiques.
- Elle optimise le budget de crawl et limite les risques liés aux contenus faibles ou dupliqués.
- La méthode courante repose sur la balise meta robots noindex.
- Un en-tête HTTP X-Robots-Tag gère les fichiers non HTML comme les PDF.
Qu’est-ce que la désindexation ?
La désindexation est l’action de retirer une page de l’index d’un moteur de recherche. La page reste en ligne mais n’apparaît plus dans les résultats de recherche. On y recourt quand un contenu n’a pas vocation à être trouvé via une recherche.
C’est un geste de tri qui sert la qualité globale du site et favorise l’indexation des seules pages utiles. À l’inverse, l’index de Google ne conserve alors que vos contenus stratégiques.
À quoi sert la désindexation ?
L’objectif est d’améliorer le référencement en ne laissant indexer que les pages utiles. Le budget de crawl se concentre alors sur le meilleur contenu.
Retirer de l’index une page faible réduit aussi le risque lié aux contenus dupliqués ou obsolètes. Le taux de pages indexées inutilement baisse, ce qui clarifie la structure du site. Les pages zombies sont les premières concernées.
- Pages de résultats de recherche interne
- Formulaires sans valeur ajoutée
- PDF déjà présents en HTML
- Contenus dupliqués ou obsolètes
Comment désindexer une page web ?
La balise meta robots avec la valeur noindex reste la méthode de référence pour retirer une page de l’index. Depuis 2019, la directive noindex n’est plus prise en compte dans le fichier robots.txt.
Pour un fichier non HTML, on emploie l’en-tête HTTP X-Robots-Tag. La Search Console permet ensuite de suivre l’effet de la désindexation et le taux de pages encore présentes dans l’index. Un audit SEO aide à repérer les pages à traiter en priorité.
Erreurs fréquentes à éviter
Bloquer une page dans le robots.txt n’équivaut pas à la désindexer. Cumuler un blocage de crawl et une balise noindex empêche le moteur de lire la consigne, et l’effet attendu ne se produit pas.
Mieux vaut laisser la page accessible le temps que le changement soit pris en compte par la recherche. C’est un point clé d’une stratégie de référencement naturel bien menée.
« Tout ce qui mérite d’être indexé mérite d’être utile ; le reste encombre. » Faire le tri dans son index, c’est déjà faire du SEO.
Questions fréquentes
Désindexer une page la supprime-t-elle du site ?
Non. La désindexation retire seulement la page des résultats de recherche. Elle reste en ligne et accessible via son URL.
Combien de temps prend une désindexation ?
Tout dépend de la fréquence de crawl. Comptez de quelques jours à plusieurs semaines, le temps que Google revisite la page et lise la balise noindex.
Faut-il bloquer la page dans le robots.txt pour la désindexer ?
Non, c’est même contre-productif. Si la page est bloquée au crawl, Google ne peut pas lire la balise noindex et ne désindexe donc pas la page.
Comment désindexer un PDF ou un fichier non HTML ?
On utilise l’en-tête HTTP X-Robots-Tag avec la valeur noindex, configuré au niveau du serveur, puisqu’un PDF ne peut pas contenir de balise meta robots.
Bien menée, la désindexation assainit un site et oriente le budget de crawl vers les pages qui comptent. Pour piloter ce tri sur l’ensemble de votre site, faites-vous accompagner par une agence de search marketing.
Discutez avec un expert du SEO pour améliorer la visibilité de votre site internet
Gratuit et sans engagement
Definitions liées
Et si notre histoire commençait par la Premiere.Page ?
Vous souhaitez en savoir plus sur la mise en place d’une stratégie SEO ?