L'indexation concentre le vocabulaire le plus mal employé du SEO. « Indexé » et « crawlé » sont couramment confondus alors qu'ils décrivent deux étapes séparées par des semaines. Cette page définit chaque terme dans son sens strict, et signale pour chacun l'erreur de raisonnement qu'il provoque le plus souvent.
La base de données dans laquelle Google stocke les pages qu'il a décidé de conserver après analyse. Y figurer est la condition nécessaire — mais pas suffisante — pour apparaître dans les résultats de recherche.
Approfondir : Indexation Google : crawl, budget de crawl et pages « explorées non indexées » →
L'étape où un robot télécharge le contenu d'une URL. Elle précède l'analyse et l'indexation, et peut en être séparée par un délai allant de quelques minutes à plusieurs semaines.
Approfondir : Indexation Google : crawl, budget de crawl et pages « explorées non indexées » →
Le volume d'exploration que Google consacre à un site sur une période donnée. Il résulte de deux facteurs : la capacité du serveur à répondre sans se dégrader, et l'intérêt que Google porte au site.
Approfondir : Indexation Google : crawl, budget de crawl et pages « explorées non indexées » →
Motif de Search Console signifiant que Google a téléchargé la page, l'a analysée, et a décidé de ne pas la conserver. C'est un verdict rendu après examen, pas une file d'attente.
Approfondir : Lire le rapport d'indexation Search Console sans se tromper de diagnostic →
Motif signifiant que Google connaît l'URL — par un lien ou un sitemap — mais ne l'a pas encore téléchargée. Il n'a donc aucune opinion sur son contenu.
Approfondir : Lire le rapport d'indexation Search Console sans se tromper de diagnostic →
Le processus par lequel Google choisit, parmi plusieurs URL au contenu équivalent, celle qui représentera le groupe dans l'index. La balise rel=canonical permet d'indiquer sa préférence.
Approfondir : noindex, canonical et robots.txt : le trio de contrôle de l'indexation →
Directive, servie par balise meta ou par en-tête HTTP, demandant à un moteur de ne pas conserver la page dans son index. Contrairement à la canonicalisation, elle est impérative.
Approfondir : noindex, canonical et robots.txt : le trio de contrôle de l'indexation →
Le retrait de pages de l'index, volontaire ou subi. Une désindexation massive et non voulue traduit généralement une réévaluation de la qualité du site par les systèmes automatiques.
Approfondir : Désindexation massive sur Google : anatomie d'un crash et méthode de récupération →
Fichier listant les URL qu'un site souhaite soumettre à l'indexation, avec des métadonnées facultatives comme la date de dernière modification.
Approfondir : Sitemap XML : à quoi ça sert vraiment et comment le construire correctement →
Approche consistant à ne soumettre que les URL dont la valeur est confirmée, plutôt que l'intégralité des pages générées par le site.
Approfondir : Sitemap XML : à quoi ça sert vraiment et comment le construire correctement →
Motif signalant que Google a identifié plusieurs URL au contenu équivalent sans qu'aucune préférence n'ait été exprimée. Il en choisit une seul.
Approfondir : noindex, canonical et robots.txt : le trio de contrôle de l'indexation →
Principe selon lequel Google évalue et indexe la version mobile d'une page, y compris pour le classement des résultats affichés sur ordinateur.
Approfondir : Core Web Vitals : mesurer et améliorer la vitesse d'un site WordPress →
Fonction de Search Console permettant de soumettre une URL pour exploration prioritaire. Elle accélère la découverte, sans influencer la décision d'indexer.
Approfondir : Lire le rapport d'indexation Search Console sans se tromper de diagnostic →
Procédure de Search Console déclenchant la réexploration d'un échantillon d'URL affectées par un motif, afin de vérifier qu'un problème a bien été résolu.
Approfondir : Lire le rapport d'indexation Search Console sans se tromper de diagnostic →
Pages accessibles par leur URL mais vers lesquelles aucun lien interne ne pointe. Elles n'existent, pour un robot, que si un sitemap ou un lien externe les signale.
Approfondir : Le maillage interne : structurer les liens d'un site pour le référencement →
Ces définitions s'appuient sur la documentation officielle référencée dans nos ressources. Une définition vous paraît inexacte ou datée ? Signalez-la — les corrections sont vérifiées, datées et créditées.