← Tous les articles

Forcer ou empêcher l’indexation d’une page

Google ne se laisse pas forcer : on peut demander l'indexation d'une page et interdire celle d'une autre, à condition de le faire dans le bon ordre. Sur notre propre site, 106 pages attendaient sans avoir jamais été explorées, voici ce qui les a fait entrer dans l'index.

Couverture Dots Papers de l'article sur l'indexation d'une page par Google : ce qu'on peut demander et ce qu'on peut interdire

En bref

  • Le bouton « Demander une indexation » de la Search Console place une page dans une file prioritaire, sans garantie d’indexation.
  • La balise noindex retire une page des résultats de Google, à condition que Google puisse explorer la page pour lire la balise.
  • Le fichier robots.txt bloque l’exploration : une page bloquée peut quand même apparaître dans Google si d’autres sites renvoient vers elle.
  • Le guide de Google sur le budget d’exploration vise les très grands sites.
  • Sur notre propre site, 106 pages attendaient sans avoir jamais été téléchargées. En trois semaines de demandes ciblées, le nombre de pages indexées est passé de 18 à 90.

On ne peut pas forcer l’indexation d’une page par Google, seulement la demander, dans l’outil d’inspection d’URL de la Search Console ou par un sitemap, et Google décide ensuite seul. Pour empêcher l’indexation, posez une balise noindex sur une page que Google peut explorer, sans la bloquer dans robots.txt. Reste à choisir, page par page, ce que vous voulez voir dans l’index.

Le 27 août 2026, après la refonte de dotsland.com, nous avons resoumis nos sitemaps à Google, qui ne les avait plus relus depuis le 7 novembre 2025. Douze jours plus tard, la Search Console comptait 18 pages indexées et 123 non indexées, dont 106 « Détectées, actuellement non indexées », sans aucune date d’exploration. Le 29 septembre, elle en comptait 90 indexées.

Peut-on vraiment forcer Google à indexer une page ?

Non, et la documentation de Google le dit sans détour. Google trouve d’abord une adresse, par un lien ou un sitemap. Il la télécharge quand il le juge utile. Puis il décide de la garder ou non : selon sa documentation, une page explorée est d’abord évaluée, et toutes ne finissent pas dans l’index. L’aide de la Search Console le résume d’une phrase : « Ne vous attendez pas à ce que toutes les URL de votre site soient indexées. »

Le bouton « Demander une indexation » de l’outil d’inspection d’URL est limité chaque jour et par propriété. Google précise qu’une demande ne garantit pas l’indexation et que redemander la même URL ne l’accélère pas. L’exploration peut prendre de quelques jours à quelques semaines, et le sitemap n’est qu’une indication. Quant aux raccourcis, l’API d’indexation de Google est réservée aux offres d’emploi et aux vidéos en direct, et Google ne figure pas parmi les moteurs participants que liste le protocole IndexNow.

Interdire, en revanche, fonctionne. Une balise noindex dans le code de la page, ou le même ordre dans l’entête HTTP, fait sortir la page des résultats de Google, même si d’autres sites pointent vers elle. Mais seulement une fois que Google l’a explorée et a lu l’ordre.

Robots.txt ne retire pas une page de Google

L’erreur est logique en apparence : si le robot n’entre pas, la page n’est pas indexée. Google dit l’inverse. Le fichier robots.txt indique aux robots quelles adresses ils peuvent visiter, et Google précise que ce fichier ne sert pas à tenir une page hors de ses résultats. Une page interdite dans robots.txt peut être indexée si d’autres sites y renvoient. Elle apparaît alors sans description. Le rapport de la Search Console a même un statut pour ce cas : « Indexée malgré le blocage par le fichier robots.txt ».

Le piège se referme quand on combine les deux. Une page en noindex et bloquée dans robots.txt ne sera jamais explorée, donc Google ne lira jamais son noindex, et elle pourra rester dans les résultats. Pour nos copies de test du site, nous avons donc posé un entête noindex et volontairement aucun blocage dans robots.txt : si un lien extérieur les faisait découvrir, Google devait pouvoir lire l’interdiction.

Le second piège tient au contrôle. Quand nous avons passé nos 11 archives de catégorie en noindex, l’extension SEO du site les a retirées du sitemap immédiatement. La page, elle, continuait d’annoncer « index, follow » dans son code, tant que chaque catégorie n’avait pas été enregistrée une seconde fois. Le sitemap donnait le travail pour fait alors que seul le code de la page disait où il en était.

Robots.txt a pourtant son usage. Pour les URL de filtres d’un catalogue qui n’ont pas vocation à apparaître dans la recherche, Google recommande de bloquer leur exploration, parce que ses robots en visitent un grand nombre avant de comprendre qu’elles sont inutiles. À notre lecture, l’ordre compte : si ces URL sont déjà indexées, posez d’abord le noindex et ne bloquez qu’une fois qu’elles sont sorties.

Nos 106 pages en attente d’exploration

Dans la Search Console, « Explorée, actuellement non indexée » et « Détectée, actuellement non indexée » se ressemblent et appellent des traitements opposés. Dans le premier cas, Google a téléchargé la page et ne l’a pas retenue, le plus souvent, à notre lecture, pour une question de contenu ou de doublon. Dans le second, Google connaît l’adresse et a reporté l’exploration. Nos 106 pages étaient toutes dans le second cas.

Le réflexe est d’accuser le maillage interne. Nous avons compté avant d’y toucher : nos pages contact, expertises et ressources recevaient 78 liens internes chacune, autant que notre page « à propos », indexée. La technique était saine aussi : 126 URL sur 126 répondaient normalement, avec un temps de réponse médian de 0,40 seconde, et le test en direct confirmait que Google pouvait indexer la page.

Restait la demande. Le rapport « Statistiques sur l’exploration » a tranché : 710 requêtes de Google en 90 jours, soit environ 8 par jour, dont 99 % pour relire des pages connues et moins de 1 % pour en découvrir de nouvelles. Les pages HTML ne comptaient que pour 19 % de ces requêtes, soit environ trois pages par jour. Nous ne saturions aucun plafond : le moteur ne venait presque pas, parce qu’un domaine longtemps endormi et presque sans liens venus d’ailleurs ne génère pas de demande.

Nous avons donc demandé, une dizaine de pages par période de 24 heures, soit 100 demandes du 8 au 25 septembre. Le 15 septembre, les 49 pages demandées pendant la première semaine ont été inspectées une par une : les 49 étaient indexées, et l’une d’elles avait été explorée dans l’heure suivant la demande. Une page que nous n’avions pas encore demandée, et qui servait de témoin, n’avait toujours pas été explorée. Le rapport d’indexation, lui, affichait encore une mise à jour datée du 4 septembre, antérieure à la première demande. Il a rattrapé le 17 septembre : 66 pages indexées, puis 86 le 22, puis 90.

Une réserve toutefois. Au 25 septembre, des pages que nous n’avions jamais demandées s’indexaient aussi : sur 41 adresses publiées absentes de notre liste, 40 étaient déjà indexées sans demande. Nos nouveaux articles entrent désormais seuls dans l’index en un à trois jours. À notre lecture, les demandes manuelles ont lancé le mouvement sans traiter la cause, le manque de liens venus d’autres sites, sur laquelle revient la méthode plus bas.

Le budget d’exploration vise les très grands sites

L’argument habituel pour écarter des pages de l’index est le budget d’exploration. Google adresse son guide aux sites d’un million de pages qui changent chaque semaine, ou de plus de 10 000 pages qui changent chaque jour. Quand nous avons retiré nos archives de catégorie de l’index, nous avons noté un gain de budget nul : nous l’avons fait pour la qualité.

Pour une PME, choisir sert à décider ce que Google voit de vous. Les pages à exclure sont celles qui n’ont aucune raison d’être trouvées par une recherche : page de remerciement, résultats de votre moteur de recherche interne, panier et compte client, combinaisons de filtres. Les déclinaisons d’un même produit relèvent plutôt de la canonique, et c’est souvent là que se joue la visibilité des fiches produits qui ne ressortent pas. Les pages à pousser sont celles qui répondent à une question qu’on tape dans Google : vos pages de service et vos nouveaux contenus.

Nos pages anglaises formaient plus de la moitié des adresses en attente : nous avons mis le quota de demandes sur le français d’abord, la langue qui compte commercialement. Si vous ouvrez un deuxième pays, la même logique d’ordre s’applique.

Quel moyen agit sur quelle étape ?

Chaque moyen agit à une étape différente. Voici ce qu’il fait vraiment, et quand s’en servir.

Moyen Ce qu’il fait vraiment Quand s’en servir
Demande dans l’inspection d’URL Place une page dans une file prioritaire, avec un quota quotidien et sans garantie Quelques pages importantes, neuves ou modifiées
Sitemap Signale des adresses à Google, qui n’utilise la date de modification que si elle est exacte Toujours, pour les pages à indexer et elles seules
Liens internes Aident Google à trouver et à situer les pages Quand les pages ignorées reçoivent moins de liens que les pages indexées
Liens depuis d’autres sites Font venir le robot, donc créent la demande d’exploration Site peu cité, ou qui sort d’une longue pause
Balise noindex Retire la page des résultats, une fois que Google l’a explorée Pages utiles aux visiteurs mais sans valeur de recherche
robots.txt Bloque l’exploration, pas l’indexation Filtres et paramètres qui n’ont jamais été indexés
Canonique Signal fort pour désigner la page de référence, que Google peut ne pas suivre Déclinaisons et quasi-doublons
Suppression temporaire Masque une URL des résultats pendant environ six mois Urgence, le temps de poser un noindex ou un code 404 ou 410

Google précise que les signaux qui désignent la page de référence se renforcent quand ils disent la même chose. À l’inverse, un noindex bloqué par robots.txt ou une page en noindex listée dans le sitemap envoient des signaux opposés, et c’est Google qui tranche.

Le travail de la semaine dans la Search Console

Voici la méthode que nous appliquons, avec la Search Console et un tableur.

  1. Lisez la date avant le chiffre. En haut du rapport d’indexation des pages figure une date de dernière mise à jour. Le 31 août, la nôtre indiquait le 21 août, comme deux autres propriétés sans rapport entre elles : le retard venait de Google. Un compteur figé ne prouve pas que rien ne bouge.
  2. Séparez les deux files. « Détectée » appelle de la demande d’exploration. « Explorée » appelle un travail sur la page, ou l’acceptation qu’elle ne sera pas indexée : Google écrit qu’il est inutile de la resoumettre.
  3. Dressez une liste courte des pages à pousser, une vingtaine classées par valeur commerciale, et une autre des pages à retirer, avec pour chacune le moyen retenu parmi ceux du tableau. Pour chaque page des deux listes, notez dans l’inspection la date de dernière exploration et comparez l’URL canonique sélectionnée par Google à celle que vous avez déclarée.
  4. Retirez proprement. Posez le noindex en vérifiant que robots.txt ne bloque pas ces pages, puis contrôlez sur la page elle-même, avec le code source ou le bouton « Tester l’URL active », puisque le sitemap peut changer avant elle.
  5. Demandez, puis vérifiez par l’inspection, quelques jours plus tard, sans attendre le rapport. Une demande interrompue avant confirmation se vérifie aussi par l’inspection avant d’être refaite.
  6. Traitez la cause. Dans les statistiques d’exploration, regardez la part de « Découverte ». Si elle est proche de zéro, la solution durable est hors de votre site : des liens depuis des sites que Google visite déjà, partenaires, fournisseurs, annuaires professionnels, presse locale. Google indique qu’il utilise les liens pour trouver les pages à explorer. À notre lecture, il en va de même pour les moteurs d’IA, qui ne citent que ce qu’ils ont trouvé. Sur notre propre site, leurs robots ont très peu lu notre fichier llms.txt, comme nous l’avons mesuré dans notre article sur llms.txt v2.
  7. Suivez chaque URL dans le temps. Notre propre suivi tient dans un fichier texte, une ligne par URL avec sa date de demande. Un outil de suivi doit confronter le sitemap au statut réel de chaque URL et à son entête HTTP, garder l’historique de chacune et dater ses propres données, puisque le rapport de Google peut avoir plusieurs jours de retard.

Si une page qui compte pour vos ventes reste hors de l’index après ces vérifications, confiez-nous son URL : nous chercherons avec vous ce qui la retient. Le suivi de l’indexation fait partie de notre expertise SEO, SEA et SMO.

Sources

Pages lues le 30 septembre 2026. Les chiffres de dotsland.com sont ceux de notre Search Console, relevés du 27 août au 29 septembre 2026.

  1. Google Search Central, « Ask Google to Recrawl Your Website », mis à jour le 10 décembre 2025. Consulter
  2. Aide Search Console, « Outil d’inspection d’URL ». Consulter
  3. Aide Search Console, « Rapport sur l’indexation des pages ». Consulter
  4. Google Search Central, « Block Search Indexing with noindex », mis à jour le 10 décembre 2025. Consulter
  5. Google Search Central, « Robots.txt Introduction and Guide », mis à jour le 10 décembre 2025. Consulter
  6. Google Search Central, « Build and Submit a Sitemap », mis à jour le 8 juillet 2026. Consulter
  7. Google Search Central, « How to Specify a Canonical with rel= »canonical » and Other Methods », mis à jour le 10 juillet 2026. Consulter
  8. Aide Search Console, « Suppressions et outil de création de rapports SafeSearch ». Consulter
  9. Google, « Crawl Budget Management », mis à jour le 22 juillet 2026. Consulter
  10. Aide Search Console, « Rapport « Statistiques sur l’exploration » ». Consulter
  11. Google, « Managing crawling of faceted navigation URLs », mis à jour le 18 décembre 2025. Consulter
  12. Google Search Central, « SEO Link Best Practices for Google », mis à jour le 10 décembre 2025. Consulter
  13. Google Search Central, « Indexing API Quickstart », mis à jour le 16 juillet 2026. Consulter
  14. IndexNow.org, « FAQ ». Consulter

FAQ

Combien de demandes d’indexation peut-on faire par jour ?

Google ne publie pas de chiffre, il parle seulement d’une limite quotidienne par propriété. Sur la nôtre, nous avons obtenu une dizaine de demandes par période de 24 heures, chaque unité revenant environ un jour après avoir été utilisée. Un message d’erreur générique isolé n’était pas le quota : la même page est passée au tour suivant. Le refus pour quota, lui, s’affiche en toutes lettres.

Ma page est « Explorée, actuellement non indexée » : dois-je redemander son indexation ?

Non. Google indique qu’elle sera peut-être indexée plus tard et qu’il est inutile de la resoumettre. Google l’a lue et ne l’a pas retenue : si elle double une autre page ou ne répond vraiment à aucune question, fusionnez-la avec une page plus complète et redirigez.

Comment faire disparaître vite une page publiée par erreur ?

Utilisez l’outil de suppression de la Search Console, qui masque l’URL pendant environ six mois, et posez en même temps la solution définitive : noindex, protection par mot de passe, ou suppression de la page avec un code 404 ou 410. Sans cette seconde étape, la page peut revenir à l’expiration du délai.

Envie d'appliquer ça à votre activité ?

Contactez-nous →

À lire aussi

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *

17 − onze =