Gratis · Análisis en el servidor
Comprobador de acceso de bots de IA
Pega un dominio y comprueba si robots.txt permite GPTBot, ChatGPT-User, ClaudeBot, Perplexity, Googlebot, Bingbot y otros crawlers — con la evidencia exacta de cada regla y correcciones listas para copiar y pegar.
De un vistazo
- Comprueba los principales crawlers de búsqueda, bots de respuesta de IA y user-agents de entrenamiento de modelos en un solo análisis.
- Descubre la regla Allow o Disallow exacta —y el número de línea— detrás de cada decisión de acceso.
- Genera plantillas prácticas de robots.txt manteniendo el acceso de búsqueda separado del acceso de entrenamiento.
Qué significa esto
robots.txt, sin mitos
robots.txt es un archivo de instrucciones de cumplimiento voluntario ubicado en la raíz de un sitio. Los crawlers lo leen antes de obtener las páginas y luego comparan su user-agent con las reglas Allow y Disallow. La regla coincidente más larga gana, y un Allow gana en caso de empate. Este comprobador hace visible esa decisión para los bots por los que la gente pregunta actualmente.
¿Qué comprueba realmente esta herramienta?
Obtiene el archivo público /robots.txt del sitio y aplica las reglas estándar de coincidencia más larga de robots.txt a los principales crawlers de búsqueda, de respuesta en directo y de entrenamiento. Muestra la directiva y el número de línea que motivaron cada decisión cuando es posible.
¿Permitir un bot garantiza la visibilidad en IA?
No. Solo significa que robots.txt no está bloqueando el acceso. Que un producto de IA cite, indexe o entrene con tu contenido depende de los sistemas y las políticas de ese proveedor.
¿Por qué separar los bots de respuesta en directo de los crawlers de entrenamiento?
Muchos propietarios de sitios quieren que las páginas públicas estén disponibles para los motores de búsqueda y de respuesta, a la vez que limitan los rastreos amplios de entrenamiento. La plantilla refleja esa política habitual: permitir los bots de recuperación/cita en directo y bloquear los crawlers orientados al entrenamiento si esa es tu preferencia.
¿Se almacena la URL comprobada?
No. El servidor obtiene robots.txt porque CORS bloquea a los navegadores en muchos sitios. La comprobación se ejecuta en memoria, rechaza los objetivos privados o internos, y no almacena ni registra las URL enviadas.