urldiagnostics.com

Kostenlos · Serverseitiger Scan

Indexierbarkeit & Canonical-Inspektor

Fügen Sie eine URL ein. Wir rufen sie sicher ab, prüfen robots.txt, meta robots, X-Robots-Tag, rel=canonical und hreflang für ein Browser- oder Bot-Profil und erklären jeden Blocker, Konflikt und jedes Canonical-Problem — ohne jemals zu behaupten, dass eine Suchmaschine sie indexiert oder rankt.

Auf einen Blick

  • Verfolgen Sie die Weiterleitungskette, den endgültigen Status und die robots.txt-Regel, die zu Ihrem Pfad passt.
  • Lesen Sie meta robots, X-Robots-Tag, canonical und hreflang für Browser, Googlebot oder Bingbot.
  • Erhalten Sie ein verständliches Urteil mit dem exakt beobachteten Signal und einer praktischen Korrektur für jeden Befund.
Anfrageprofil

🔒 Serverseitiger Scan: Ihre Seite, ihre robots.txt und höchstens ein Canonical-Ziel werden im Arbeitsspeicher abgerufen. Private, lokale und reservierte Ziele werden blockiert, Antworten und Weiterleitungen sind begrenzt, und übermittelte URLs werden nicht gespeichert oder in Share-Links eingebettet.

Was das bedeutet

Signale leiten Crawler — sie garantieren niemals eine Indexierung

robots.txt, meta robots, X-Robots-Tag, rel=canonical und hreflang teilen Crawlern mit, was sie abrufen dürfen, welche URL als canonical zu behandeln ist und wo die sprachlichen Entsprechungen liegen. Dieser Inspektor liest diese Signale aus der Rohantwort und meldet, was sie aussagen. Nur die Suchmaschine entscheidet, was sie tatsächlich crawlt, indexiert, rankt oder auswählt.

Was ändern die Profile Browser, Googlebot und Bingbot?

Das Profil legt den User-Agent fest und welche Regeln gelten. Googlebot passt zu Googlebot-robots.txt-Gruppen sowie seinen meta name="robots"- und googlebot-bezogenen X-Robots-Tag-Direktiven; Bingbot passt zu Bingbot-/MSNBot-Regeln und -Direktiven; ein Browser passt nur zu Wildcard-robots-Gruppen. Alle drei lesen dieselben rel="canonical"- und hreflang-Tags.

Was bedeuten indexierbar, blockiert, widersprüchlich und unbekannt?

Indexierbar bedeutet, dass kein beobachtetes Signal diese URL stoppt. Blockiert bedeutet, dass robots.txt oder eine noindex-Direktive sie ausdrücklich verhindert. Widersprüchlich bedeutet, dass Signale einander widersprechen — zum Beispiel blockiert robots.txt die Seite, sodass der Crawler ihr meta name="robots" noindex niemals sehen kann, oder ein rel="canonical" verweist auf eine URL, die selbst noindex ist. Unbekannt bedeutet, dass ein Signal nicht bestätigt werden konnte, etwa eine nicht lesbare robots.txt.

Sagt mir das, ob Google die Seite indexiert hat?

Nein. Es liest nur Signale aus der Seite und der robots.txt — das, was eine Suchmaschine sehen könnte, wenn sie sie crawlt. Für den verbindlichen Indexstatus der Suchmaschine nutzen Sie die URL-Prüfung in Google Search Console und Bing Webmaster Tools, auf die dieser Bericht verlinkt.

Rendert es JavaScript?

Nein. Es prüft nur die rohe HTML-Antwort. Canonical-, robots- oder hreflang-Tags, die von clientseitigem JavaScript eingefügt werden, werden nicht ausgewertet, und der Bericht weist darauf hin.

Werden geprüfte URLs gespeichert?

Nein. Der Server ruft Ihre URL, ihre robots.txt und höchstens ein Canonical-Ziel im Arbeitsspeicher ab, weil CORS-Regeln des Browsers direkte Prüfungen blockieren. Anfragen durchlaufen Schutzmechanismen für private Netzwerke, DNS, Zeitlimit, Weiterleitung und Antwortgröße, und nichts, was Sie übermitteln, wird gespeichert oder in Share-Links eingebettet.