Gratuit · Analyse côté serveur
Inspecteur d’indexabilité et de canonical
Collez une URL. Nous la récupérons en toute sécurité, vérifions robots.txt, meta robots, X-Robots-Tag, rel=canonical et hreflang pour un profil de navigateur ou de robot, et expliquons chaque blocage, conflit et problème de canonical — sans jamais affirmer qu’un moteur l’indexera ou la classera.
En bref
- Retracez la chaîne de redirection, le statut final et la règle robots.txt qui correspond à votre chemin.
- Lisez meta robots, X-Robots-Tag, canonical et hreflang pour un navigateur, Googlebot ou Bingbot.
- Obtenez un verdict en langage clair avec le signal exact observé et une correction concrète pour chaque constat.
Ce que cela signifie
Les signaux guident les robots — ils ne garantissent jamais l’indexation
robots.txt, meta robots, X-Robots-Tag, rel=canonical et hreflang indiquent aux robots ce qu’ils peuvent récupérer, quelle URL traiter comme canonical et où se trouvent les équivalents linguistiques. Cet inspecteur lit ces signaux dans la réponse brute et rapporte ce qu’ils disent. Seul le moteur de recherche décide de ce qu’il explore, indexe, classe ou sélectionne réellement.
Que changent les profils navigateur, Googlebot et Bingbot ?
Le profil définit le User-Agent et les règles qui s’appliquent. Googlebot correspond aux groupes robots.txt de Googlebot ainsi qu’à ses directives meta name="robots" et X-Robots-Tag propres à googlebot ; Bingbot correspond aux règles et directives Bingbot/MSNBot ; un navigateur ne correspond qu’aux groupes robots génériques. Tous trois lisent les mêmes balises rel="canonical" et hreflang.
Que signifient indexable, bloqué, contradictoire et inconnu ?
Indexable signifie qu’aucun signal observé n’empêche cette URL. Bloqué signifie que robots.txt ou une directive noindex l’empêche explicitement. Contradictoire signifie que les signaux se contredisent — par exemple robots.txt bloque la page, si bien que le robot ne peut jamais voir son noindex meta name="robots", ou un rel="canonical" pointe vers une URL elle-même en noindex. Inconnu signifie qu’un signal n’a pas pu être confirmé, comme un robots.txt illisible.
Cela m’indique-t-il si Google a indexé la page ?
Non. Il ne lit que les signaux de la page et de robots.txt — ce qu’un moteur pourrait voir s’il l’explorait. Pour un statut d’indexation faisant autorité côté moteur, utilisez l’inspection d’URL de Google Search Console et de Bing Webmaster Tools, vers lesquelles ce rapport renvoie.
Le JavaScript est-il rendu ?
Non. Il inspecte uniquement la réponse HTML brute. Les balises canonical, robots ou hreflang injectées par du JavaScript côté client ne sont pas évaluées, et le rapport le précise.
Les URL vérifiées sont-elles conservées ?
Non. Le serveur récupère votre URL, son robots.txt et au plus une cible canonical en mémoire, car les règles CORS du navigateur bloquent les vérifications directes. Les requêtes passent par des protections contre les réseaux privés, ainsi que des protections DNS, de délai, de redirection et de taille de réponse, et rien de ce que vous soumettez n’est enregistré ni intégré dans les liens de partage.