Безплатно · Сканиране от сървъра
Инспектор за индексируемост и canonical
Поставете един URL адрес. Ние го извличаме безопасно, проверяваме robots.txt, meta robots, X-Robots-Tag, rel=canonical и hreflang за профил на браузър или бот и обясняваме всеки блокиращ фактор, конфликт и проблем с canonical — без никога да твърдим, че дадена търсачка ще го индексира или класира.
Накратко
- Проследете веригата от пренасочвания, крайния статус и правилото в robots.txt, което съответства на вашия път.
- Прочетете meta robots, X-Robots-Tag, canonical и hreflang за браузър, Googlebot или Bingbot.
- Получете присъда на разбираем език с точния наблюдаван сигнал и практична корекция за всеки резултат.
Какво означава това
Сигналите насочват обхождащите ботове — те никога не гарантират индексиране
robots.txt, meta robots, X-Robots-Tag, rel=canonical и hreflang казват на обхождащите ботове какво може да извлекат, кой URL адрес да третират като canonical и къде се намират езиковите еквиваленти. Този инспектор чете тези сигнали от суровия отговор и докладва какво казват те. Само търсачката решава какво реално обхожда, индексира, класира или избира.
Какво променят профилите за браузър, Googlebot и Bingbot?
Профилът задава User-Agent и кои правила се прилагат. Googlebot съответства на groups за Googlebot в robots.txt и на неговите meta name="robots" плюс X-Robots-Tag директиви с обхват googlebot; Bingbot съответства на правила и директиви за Bingbot/MSNBot; браузър съответства само на wildcard robots groups. И трите четат едни и същи rel="canonical" и hreflang тагове.
Какво означават indexable, blocked, conflicting и unknown?
Indexable означава, че никакъв наблюдаван сигнал не спира този URL адрес. Blocked означава, че robots.txt или noindex директива изрично го предотвратява. Conflicting означава, че сигналите си противоречат — например robots.txt блокира страницата, така че обхождащият бот никога не може да види нейния meta name="robots" noindex, или rel="canonical" сочи към URL адрес, който самият той е noindex. Unknown означава, че даден сигнал не е могъл да бъде потвърден, например нечетим robots.txt.
Показва ли ми това дали Google е индексирал страницата?
Не. То само чете сигнали от страницата и robots.txt — какво би могла да види дадена търсачка, ако я обходи. За авторитетен статус на индексиране от търсачката използвайте URL Inspection в Google Search Console и Bing Webmaster Tools, към които този отчет води с връзки.
Изпълнява ли JavaScript?
Не. То инспектира само суровия HTML отговор. Canonical, robots или hreflang тагове, инжектирани от клиентски JavaScript, не се оценяват и отчетът го посочва.
Съхраняват ли се проверените URL адреси?
Не. Сървърът извлича вашия URL адрес, неговия robots.txt и най-много една canonical цел в паметта, защото браузърните CORS правила блокират директни проверки. Заявките преминават през защити срещу частни мрежи, както и с DNS, timeout, пренасочвания и ограничения за размер на отговора, а нищо подадено от вас не се запазва или вгражда във връзки за споделяне.