urldiagnostics.com

Безплатно · Сканиране от сървъра

Инспектор за индексируемост и canonical

Поставете един URL адрес. Ние го извличаме безопасно, проверяваме robots.txt, meta robots, X-Robots-Tag, rel=canonical и hreflang за профил на браузър или бот и обясняваме всеки блокиращ фактор, конфликт и проблем с canonical — без никога да твърдим, че дадена търсачка ще го индексира или класира.

Накратко

  • Проследете веригата от пренасочвания, крайния статус и правилото в robots.txt, което съответства на вашия път.
  • Прочетете meta robots, X-Robots-Tag, canonical и hreflang за браузър, Googlebot или Bingbot.
  • Получете присъда на разбираем език с точния наблюдаван сигнал и практична корекция за всеки резултат.
Профил на заявката

🔒 Сканиране от сървъра: вашата страница, нейният robots.txt и най-много една canonical цел се извличат в паметта. Частни, локални и резервирани дестинации се блокират, отговорите и пренасочванията са ограничени, а подадените URL адреси не се съхраняват или вграждат във връзки за споделяне.

Какво означава това

Сигналите насочват обхождащите ботове — те никога не гарантират индексиране

robots.txt, meta robots, X-Robots-Tag, rel=canonical и hreflang казват на обхождащите ботове какво може да извлекат, кой URL адрес да третират като canonical и къде се намират езиковите еквиваленти. Този инспектор чете тези сигнали от суровия отговор и докладва какво казват те. Само търсачката решава какво реално обхожда, индексира, класира или избира.

Какво променят профилите за браузър, Googlebot и Bingbot?

Профилът задава User-Agent и кои правила се прилагат. Googlebot съответства на groups за Googlebot в robots.txt и на неговите meta name="robots" плюс X-Robots-Tag директиви с обхват googlebot; Bingbot съответства на правила и директиви за Bingbot/MSNBot; браузър съответства само на wildcard robots groups. И трите четат едни и същи rel="canonical" и hreflang тагове.

Какво означават indexable, blocked, conflicting и unknown?

Indexable означава, че никакъв наблюдаван сигнал не спира този URL адрес. Blocked означава, че robots.txt или noindex директива изрично го предотвратява. Conflicting означава, че сигналите си противоречат — например robots.txt блокира страницата, така че обхождащият бот никога не може да види нейния meta name="robots" noindex, или rel="canonical" сочи към URL адрес, който самият той е noindex. Unknown означава, че даден сигнал не е могъл да бъде потвърден, например нечетим robots.txt.

Показва ли ми това дали Google е индексирал страницата?

Не. То само чете сигнали от страницата и robots.txt — какво би могла да види дадена търсачка, ако я обходи. За авторитетен статус на индексиране от търсачката използвайте URL Inspection в Google Search Console и Bing Webmaster Tools, към които този отчет води с връзки.

Изпълнява ли JavaScript?

Не. То инспектира само суровия HTML отговор. Canonical, robots или hreflang тагове, инжектирани от клиентски JavaScript, не се оценяват и отчетът го посочва.

Съхраняват ли се проверените URL адреси?

Не. Сървърът извлича вашия URL адрес, неговия robots.txt и най-много една canonical цел в паметта, защото браузърните CORS правила блокират директни проверки. Заявките преминават през защити срещу частни мрежи, както и с DNS, timeout, пренасочвания и ограничения за размер на отговора, а нищо подадено от вас не се запазва или вгражда във връзки за споделяне.