Trois étapes qu'on confond
- L'exploration. Un robot charge l'URL. Cela peut se vérifier dans les journaux du serveur.
- L'indexation. Le moteur décide de conserver la page dans sa base. Une page explorée peut être écartée — contenu jugé trop mince, quasi-doublon, directive contraire.
- Le classement. Parmi les pages indexées, le moteur choisit celles qu'il montre ou reprend pour une question donnée.
Un diagnostic qui saute l'étape 2 conclut à un problème de contenu là où il n'y a qu'un problème d'enregistrement.
Ce qui empêche une indexation
Les causes les plus fréquentes sont rarement spectaculaires : une directive
noindex restée d'une préproduction, un robots.txt hérité d'une refonte, une
page accessible par plusieurs adresses sans canonique claire, une URL servant une
erreur serveur à un robot alors qu'elle s'affiche normalement dans un navigateur,
un sitemap qui liste des adresses qui n'existent plus.
Pourquoi il faut compter par moteur
Les index ne se recouvrent pas. Un site peut être largement connu de l'un et quasi absent de l'autre, et les moteurs génératifs ne s'appuient pas tous sur la même base. En tirer un seul chiffre global, c'est masquer précisément l'écart qu'on cherche à corriger : le compte se relève moteur par moteur, et se publie tel quel.
FAQ Questions fréquentes
Comment compter les pages réellement indexées ?
Un site neuf est-il indexé automatiquement ?
Pour aller plus loin
- Votre site est-il lisible par les IA ? Le test en 6 points
- Premier sur Google, invisible dans les IA : le lien s'est brisé en sept mois
Savez-vous ce que les IA disent de votre marque ?
Recevez un audit de votre visibilité dans ChatGPT, Perplexity, Gemini et Claude.