Crawl et indexation
Niveau · Débutant
Lecture 6 min

Inspection d’URL

Définition, différence entre la version indexée et le test en direct, et lecture correcte du résultat.

Définition courte

L’inspection d’URL est l’outil de la Search Console qui renseigne sur la version indexée par Google d’une page précise, et permet de tester si cette page peut être indexée. Il donne l’URL canonique retenue par Google, l’état d’indexation, les ressources chargées et le rendu obtenu.

L’outil répond en réalité à deux questions distinctes, et les confondre est l’erreur la plus courante : ce que Google a retenu lors de sa dernière exploration, et ce qu’il obtiendrait s’il explorait la page maintenant.

À retenir
01Deux modes distincts : la version indexée, qui date de la dernière exploration, et le test en direct.
02Le test en direct est effectué par Google-InspectionTool, un robot documenté distinct de Googlebot.
03C’est le seul endroit qui révèle l’URL canonique choisie par Google, qui peut différer de la vôtre.

Comment fonctionne l’inspection d’URL ?

Vous saisissez une URL de la propriété ouverte et Google renvoie l’état de cette page dans son index. L’outil est accessible depuis la barre de recherche en haut de la Search Console, ou par le lien Inspecter présent à côté des URL dans la plupart des rapports.

Le rapport par défaut décrit la version indexée. Il indique si la page figure dans l’index, l’URL canonique sélectionnée par Google, le robot qui a exploré la page, la date de la dernière exploration, l’état des données structurées détectées et la présence éventuelle d’une page AMP associée. Ces informations décrivent un état passé, celui de la dernière visite de Googlebot.

Le test en direct est une seconde action, déclenchée à la demande. Google va chercher la page immédiatement, la rend, et affiche le résultat : capture d’écran de la page telle qu’il la voit, code HTML obtenu après exécution des scripts, liste des ressources chargées, sortie JavaScript et messages de la console. Ce test ne modifie pas l’index, il montre ce qui se passerait.

Niveau expert : le test en direct est mené par Google-InspectionTool, dont Google documente le user-agent et le jeton robots.txt. Ce robot obéit aussi aux règles adressées à Googlebot. Une règle qui viserait spécifiquement Googlebot s’applique donc au test, ce qui explique qu’une page bloquée au crawl échoue à l’inspection alors qu’elle s’affiche parfaitement dans un navigateur.

Version indexée ou test en direct, laquelle lire ?

Les deux, dans cet ordre, et jamais l’une à la place de l’autre. La confusion entre ces deux réponses produit la moitié des faux diagnostics d’indexation.

La version indexée répond à la question du présent : que contient l’index aujourd’hui, et sur quelle base. Si elle signale un problème, ce problème existe réellement dans l’index, quel que soit l’état actuel de la page. Un correctif déployé la veille n’y figure pas encore.

Le test en direct répond à la question du futur : si Google revenait maintenant, que trouverait-il. Un test en direct qui réussit ne prouve donc rien sur l’état indexé, et un état indexé défaillant ne prouve rien sur la page telle qu’elle est aujourd’hui. Lire les deux permet de savoir si l’on regarde une panne encore active ou la trace d’une panne déjà réparée qui attend une réexploration.

Le raccourci à éviter. « J’ai demandé l’indexation, donc la page va être indexée. » La demande d’indexation place l’URL dans une file d’exploration prioritaire. Elle ne garantit ni l’exploration immédiate, ni l’indexation, et la répéter sur la même URL ne change rien. Si la page n’est pas indexée, la cause est dans la page ou dans le site, pas dans le nombre de demandes.

CritèreVersion indexéeTest en direct
Ce qu’elle décritL’état retenu lors de la dernière explorationCe que Google obtiendrait maintenant
Robot concernéGooglebot, lors de sa dernière visiteGoogle-InspectionTool
Effet sur l’indexAucun, c’est une lectureAucun, sauf demande d’indexation explicite
À quoi elle sertConstater un problème réel dans l’indexValider un correctif avant réexploration
Audit technique

Savoir ce que Google retient réellement de vos pages.

Le contrôle croise la version indexée, le test en direct et les règles d’exploration, gabarit par gabarit plutôt que page par page. Je le mène dans le cadre d’un audit technique.

Demander un audit →

Comment diagnostiquer une page non indexée ?

Quatre contrôles, dans cet ordre. Chacun élimine une famille de causes, ce qui évite de demander l’indexation d’une page qui ne pouvait de toute façon pas être indexée.

01

Lire l’URL canonique retenue

Si Google a retenu une autre URL que celle inspectée, la page n’est pas absente de l’index, elle y est sous un autre nom. Le problème est un problème de duplication, pas d’exploration.

02

Vérifier l’autorisation d’exploration

Une règle du fichier robots.txt visant Googlebot s’applique aussi au test en direct. Une page interdite au crawl ne pourra jamais être diagnostiquée autrement.

03

Lancer le test en direct et lire les ressources

La liste des ressources chargées et la sortie JavaScript montrent ce qui a échoué pendant le rendu. Un script bloqué explique un contenu absent du HTML obtenu.

04

Comparer le rendu au contenu attendu

Chercher dans le HTML obtenu le texte censé porter la page. S’il n’y figure pas, la cause est le rendu, et aucune demande d’indexation n’y changera quoi que ce soit.

Inspecter à l’échelle d’un site

L’interface traite une URL à la fois, ce qui la rend inutilisable sur un catalogue. L’API d’inspection d’URL renvoie les mêmes données de façon programmatique, dans des limites que Google publie.

Le quota documenté est de 2 000 requêtes par jour et 600 par minute pour une même propriété. Sur un site de quelques milliers d’URL, cela impose de raisonner par échantillon représentatif, un lot par gabarit, plutôt que de viser l’exhaustivité. C’est de toute façon la bonne méthode : sur un catalogue, les problèmes d’indexation sont des problèmes de gabarit, pas de page.

GET https://searchconsole.googleapis.com/v1/urlInspection/index:inspect

L’API ne remplace pas l’interface pour un diagnostic fin, car elle ne renvoie ni capture d’écran ni sortie JavaScript. Elle sert à repérer où regarder, l’interface sert à comprendre pourquoi.

Erreur fréquente observée en audit

Indexation · audit technique

Cas réel. Le motif se répète sur les sites à gabarits : une équipe demande l’indexation des mêmes URL semaine après semaine, alors que l’inspection affiche une URL canonique différente de celle inspectée. Les pages n’étaient pas absentes de l’index, elles y figuraient regroupées sous une autre adresse. Lire d’abord le champ canonique aurait évité des mois de demandes sans effet.

L’inspection d’URL sert-elle au GEO ?

Indirectement. L’outil décrit ce que voit Google, pas ce que voient les moteurs génératifs, qui n’exposent aucun équivalent. Le rendu obtenu reste toutefois le meilleur indicateur disponible de ce qu’un robot lit sans exécuter d’interaction.

Deux idées reçues sur l’inspection d’URL

Mythe

Demander l’indexation plusieurs fois accélère les choses. La demande place l’URL dans une file, sans garantie d’exploration ni d’indexation. Répéter la demande sur la même adresse ne la fait pas remonter. Si la page reste absente, la cause est ailleurs.

Mythe

Un test en direct réussi signifie que la page est bien indexée. Le test décrit ce que Google obtiendrait s’il venait maintenant. Il ne dit rien de ce que contient l’index aujourd’hui, information que seule la version indexée fournit.

Questions fréquentes

Qu’est-ce que l’outil d’inspection d’URL ?

C’est l’outil de la Search Console qui fournit des informations sur la version indexée par Google d’une page donnée, et permet de tester si cette page peut être indexée. Il donne notamment l’état d’indexation, l’URL canonique retenue par Google, les données structurées détectées et le rendu obtenu.

Quelle différence entre la version indexée et le test en direct ?+

La version indexée décrit l’état retenu lors de la dernière exploration par Googlebot. Le test en direct va chercher la page immédiatement, avec le robot Google-InspectionTool, et montre ce que Google obtiendrait maintenant. Un correctif récent n’apparaît que dans le second.

Peut-on inspecter l’URL d’un site qui ne nous appartient pas ?+

Non. L’URL saisie doit appartenir à la propriété actuellement ouverte dans la Search Console, donc à un site dont la propriété a été validée. L’outil n’est pas un service d’analyse de la concurrence.

Combien d’inspections peut-on faire par jour ?+

L’interface applique une limite quotidienne par propriété, que Google mentionne sans la chiffrer. L’API d’inspection d’URL, elle, publie son quota : 2 000 requêtes par jour et 600 par minute pour une même propriété.

Aller plus loin

Faire expliquer ce terme par une IA

Ouvre le moteur de ton choix avec un prompt pré-rempli sur ce terme.

Sources

Termes liés

Damien Hernandez, consultant SEO senior
Auteur

Damien Hernandez

Consultant SEO senior, 17 ans d'expérience (Accor, Louvre Hotels, Infopro Digital). Spécialiste SEO technique, analyse de logs et optimisation pour les moteurs génératifs (GEO).