Indexation Google : pourquoi vos pages n’apparaissent pas
Publié le 16 septembre 2026 mis à jour le 23 septembre 2026
« Ma page est en ligne depuis trois semaines et elle n’apparaît nulle part. » C’est probablement la phrase la plus fréquente en référencement, et elle mélange deux problèmes très différents : ne pas être indexé, et être indexé mais mal classé. Cet article traite uniquement du premier, qui est un sujet purement technique — il complète les autres chantiers de notre dossier sur les bases du SEO technique.
Indexée, classée, visible : trois choses différentes
Une page indexée est une page que Google a analysée et rangée dans son index, avec une compréhension de son sujet. Elle est alors éligible à apparaître sur des requêtes. Une page classée est une page qui, pour une requête donnée, remonte suffisamment haut pour être vue. Vous pouvez très bien être indexé et n’apparaître que sur des expressions ultra-précises, ce qui donne l’impression trompeuse de ne pas exister.
La vérification de base consiste à interroger le moteur sur une URL exacte. Si elle ressort, elle est indexée : le problème est alors éditorial ou concurrentiel, pas technique. Si elle ne ressort pas, la suite de cet article vous concerne.
Le trajet d’une URL, étape par étape
Comprendre le trajet évite de chercher au mauvais endroit. Il comporte quatre moments distincts :
- La découverte. Google apprend l’existence de l’URL, en suivant un lien depuis une page déjà connue ou en lisant un fichier de sitemap. Une URL que rien ne cite et que rien ne déclare peut rester inconnue indéfiniment.
- L’exploration (crawl). Googlebot demande la page au serveur. Il obtient un code de réponse et, si tout va bien, du HTML.
- Le rendu. La page est exécutée dans un navigateur sans interface pour obtenir le contenu final, JavaScript compris. Cette phase peut intervenir avec un décalage.
- L’indexation. Le contenu est analysé, dédoublonné, associé à une URL canonique, puis retenu — ou non.
Chaque étape a ses propres causes de blocage, et un diagnostic sérieux consiste à remonter le fil de la dernière étape franchie.
Les quatre raisons qui expliquent presque tous les cas
Dans la pratique, une page absente relève de l’une de ces familles :
- Interdiction d’explorer. Une règle du fichier robots.txt empêche Googlebot d’accéder à l’URL. Elle peut malgré tout apparaître dans les résultats, sans description, si d’autres sites y renvoient.
- Interdiction d’indexer. Une directive noindex est présente, dans le HTML ou dans un en-tête HTTP.
- Doublon. Google estime que la page reproduit une autre URL du site et retient la version qu’il juge canonique. Votre page existe alors dans l’index sous une autre adresse.
- Valeur insuffisante. La page a été explorée, puis écartée. C’est un jugement sur le contenu : fiche vide, texte générique, page de filtre sans intérêt propre.
La quatrième est la plus frustrante parce qu’aucun réglage ne la corrige. Elle appelle une réponse éditoriale, pas technique.
Ces motifs ne sont pas théoriques : nous interrogeons Google fiche par fiche sur nos propres annuaires et nous publions le résultat, méthode et limites comprises, dans notre relevé du taux d’indexation.
Les directives que vous contrôlez vous-même
Trois mécanismes déterminent le sort d’une URL, et il faut savoir les distinguer.
La balise meta robots
Placée dans l’en-tête HTML, elle s’adresse aux moteurs :
<meta name="robots" content="noindex, follow">
L’équivalent côté serveur est l’en-tête HTTP X-Robots-Tag, indispensable pour les fichiers non HTML comme les PDF :
X-Robots-Tag: noindex
Le piège classique : bloquer et interdire en même temps
Si vous interdisez l’exploration d’une URL dans le robots.txt et que vous y placez un noindex, la directive ne sera jamais lue : le robot n’a pas le droit d’ouvrir la page. Pour désindexer, il faut au contraire laisser explorer la page pour que la consigne soit vue. C’est contre-intuitif, et c’est la source d’un nombre considérable de désindexations qui n’aboutissent jamais.
Le lien canonique
L’élément <link rel="canonical"> déclare l’URL de référence pour un contenu. Il s’agit d’une indication, pas d’un ordre : Google peut retenir une autre URL s’il a de bonnes raisons. Une canonique pointant vers la page d’accueil sur tout un site est une erreur fréquente, et elle vide littéralement l’index.
Les robots découvrent vos pages par les liens qui y mènent : une fiche d’annuaire en est un, stable et daté. Créer mon compte
Le rendu JavaScript, cause silencieuse
Sur un site où le contenu principal est injecté côté navigateur, le HTML initial peut être quasiment vide. Google sait exécuter du JavaScript, mais cette exécution consomme des ressources et peut être différée. Si l’affichage dépend d’une requête qui échoue, d’un script bloqué au crawl ou d’une interaction utilisateur, le contenu n’existe tout simplement pas pour le moteur.
Le test le plus parlant consiste à comparer le code source brut et le rendu final. Tout ce qui n’apparaît que dans le second doit être considéré comme fragile. Si votre contenu essentiel est dans ce cas, un rendu côté serveur ou une pré-génération règle le problème plus sûrement que n’importe quel réglage annexe.
Les redirections, le HTTPS et les doublons d’adresses
Un même contenu accessible en http et en https, avec et sans www, avec et sans barre oblique finale, ce sont quatre à huit URL pour une seule page. Google finit par choisir, mais il choisit sans vous, et les signaux se dispersent en attendant. La migration vers un protocole chiffré fait partie des chantiers à traiter proprement de ce point de vue : notre article sur HTTPS et la sécurité du site détaille les redirections permanentes à mettre en place et les vérifications à faire après bascule.
Autre point d’attention : les chaînes de redirections. Une URL qui renvoie vers une autre, qui renvoie vers une troisième, dilue le signal et ralentit l’exploration. Une seule étape suffit, toujours.
Diagnostiquer sans deviner
L’outil de référence est l’inspection d’URL, qui indique pour une adresse précise si elle est dans l’index, quand elle a été explorée pour la dernière fois, quelle canonique a été retenue et ce que le robot a réellement vu. Les rapports d’indexation complètent le tableau en regroupant les URL par motif d’exclusion. Notre guide de Google Search Console explique comment lire ces états et lesquels doivent vous inquiéter — car beaucoup d’« exclusions » sont parfaitement normales et voulues.
Deux libellés méritent d’être distingués. « Découverte, actuellement non indexée » signifie que l’URL est connue mais n’a pas encore été explorée : c’est souvent un signal de priorité faible ou de serveur lent. « Explorée, actuellement non indexée » signifie que la page a été vue puis écartée : là, c’est le contenu qui est en cause.
Aider la découverte, sans forcer
Vous ne pouvez pas obliger un moteur à indexer, mais vous pouvez faciliter son travail :
- Déclarer un sitemap propre, ne contenant que des URL indexables et à jour. Notre article dédié explique comment structurer un sitemap XML et ce qu’il ne faut surtout pas y mettre.
- Soigner le maillage interne : une page atteignable en trois clics depuis l’accueil est explorée bien plus volontiers qu’une page orpheline.
- Obtenir quelques citations externes. Un lien depuis un site tiers déjà exploré régulièrement est un chemin de découverte réel. Un annuaire thématique ou local sérieux, modéré, peut jouer ce rôle pour un site neuf — à condition de rester dans une démarche mesurée, la soumission de masse relevant du schéma de liens et n’apportant rien ici.
- Répondre vite. Un serveur qui rame réduit mécaniquement le nombre de pages explorées par visite.
Ce qui ne marche pas
Quelques croyances tenaces méritent d’être écartées. Demander l’indexation d’une même URL tous les jours ne change rien : la fonction sert à signaler une mise à jour, pas à insister. Multiplier les sitemaps identiques n’a aucun effet. Publier trente pages faibles d’un coup dégrade plutôt la perception globale du site qu’elle ne l’améliore. Quant aux services promettant une indexation « garantie en 24 heures », ils n’ont aucun levier réel sur la décision du moteur.
La logique de fond est simple : Google indexe ce qu’il juge utile de proposer à ses utilisateurs. Un site rapide, cohérent, correctement maillé et porteur d’un contenu qui apporte quelque chose franchit l’étape sans difficulté. Les autres cherchent des astuces.
Questions fréquentes
Combien de temps faut-il pour qu’une page soit indexée ?
Cela varie de quelques heures à plusieurs semaines selon la notoriété du site, sa fréquence de mise à jour et la qualité du maillage. Aucun délai n’est garanti, et un site neuf demande généralement plus de patience.
Comment savoir si une page est indexée ?
Le plus fiable est l’inspection d’URL dans Search Console, qui donne l’état exact et la date de dernière exploration. Une recherche sur l’URL complète dans Google donne une indication rapide mais moins précise.
Pourquoi Google a-t-il désindexé une page qui fonctionnait ?
Les causes les plus courantes sont une balise noindex ajoutée par erreur, un changement de canonique, une refonte ayant modifié les URL sans redirection, ou une page devenue jugée redondante avec une autre.
Faut-il indexer toutes les pages de son site ?
Non. Les pages de filtres, de recherche interne, les archives sans valeur propre et les pages techniques gagnent souvent à rester hors index. Un index resserré et pertinent vaut mieux qu’un index gonflé.
Sources
- Google Search Central — Fonctionnement de la recherche Google : exploration, indexation et diffusion.
- Google Search Central — Documentation sur les balises meta robots et l’en-tête X-Robots-Tag.
- Google Search Central — Consolidation des URL en double et éléments canoniques.
- Documentation de l’outil d’inspection d’URL de Google Search Console.
L’indexation n’est qu’un maillon : reprenez le panorama complet du socle technique, et pour donner à un site neuf un premier chemin de découverte, vous pouvez proposer votre site à notre annuaire.
Trois sites où l’indexation se surveille au quotidien : un média en ligne, un imprimeur et une galerie d’art.
Article informatif. Le SEO évolue et aucun résultat n’est garanti : privilégiez toujours des pratiques conformes aux consignes de Google.