ESC

Configuracion Robots.txt

Bloques User-Agent
URLs de Sitemap
Retraso de Rastreo
Agregar Rutas Rapidas

robots.txt Generado

Configura las reglas para generar robots.txt...
Todo el procesamiento ocurre en tu navegador. No se envia ningun dato al servidor.

Ejemplos de Uso

Permitir Todo

Un robots.txt simple que permite a todos los motores de busqueda rastrear todas las paginas con un sitemap.

Bloquear Carpetas Sensibles

Bloquea carpetas de admin, privadas, API y temporales mientras permite el resto del sitio.

Reglas Multi-Agente

Diferentes reglas para diferentes motores de busqueda con multiples bloques y sitemaps.

Caracteristicas

Constructor Visual

Construye tu robots.txt visualmente con una interfaz intuitiva

Multiples User-Agents

Soporte para multiples bloques user-agent con reglas diferentes

Validacion

Valida tu robots.txt para problemas comunes y errores de sintaxis

Privacidad Primero

Todo el procesamiento ocurre localmente en tu navegador

Como Usar?

1

Configurar Reglas

Selecciona user-agents y agrega reglas de permitir/bloquear para las rutas que quieras controlar.

2

Agregar Sitemaps

Agrega tus URLs de sitemap para que los motores de busqueda descubran tus paginas.

3

Copiar o Descargar

Copia o descarga el robots.txt generado. Colocalo en el directorio raiz de tu sitio web.

Preguntas Frecuentes

robots.txt es un archivo de texto plano ubicado en la raíz de tu sitio web que indica a los rastreadores de motores de búsqueda qué páginas o secciones pueden o no acceder. Sigue el Protocolo de Exclusión de Robots, el cual todos los rastreadores principales (Googlebot, Bingbot, DuckDuckBot) respetan por convención. No es estrictamente necesario — si el archivo está ausente, los rastreadores consideran que todo está permitido. Sin embargo, tener un robots.txt te permite bloquear páginas de bajo valor (áreas de administración, páginas de resultados de búsqueda, contenido duplicado), añadir la URL de tu sitemap para que los rastreadores la encuentren automáticamente y establecer el crawl-delay para proteger los recursos del servidor.

robots.txt bloquea el rastreo, no la indexación. Una página bloqueada por Disallow todavía puede aparecer en los resultados de búsqueda de Google si otros sitios enlazan a ella — Google puede indexar la URL sin rastrear su contenido, mostrando un resultado sin título ni descripción. Para evitar completamente que una página aparezca en los resultados de búsqueda, usa la meta etiqueta noindex: <meta name="robots" content="noindex">. Para una cobertura máxima, usa ambas: bloquea el rastreo en robots.txt y añade noindex para prevenir la indexación mediante descubrimiento directo.

Debe estar en el directorio raíz de tu sitio web y ser accesible en https://yourdomain.com/robots.txt. Los rastreadores lo buscan exactamente en esa URL — un archivo en un subdirectorio (por ejemplo, /blog/robots.txt) será ignorado. Para un subdominio, cada subdominio necesita su propio robots.txt en su propia raíz (por ejemplo, https://blog.yourdomain.com/robots.txt). Después de subirlo, verifícalo visitando la URL directamente en tu navegador.

Disallow indica a los rastreadores que no accedan a una ruta específica. Allow sobrescribere un Disallow para una ruta más específica dentro del mismo bloque de user-agent — útil cuando quieres bloquear una carpeta pero permitir un archivo específico dentro de ella. Por ejemplo: Disallow: /private/ y luego Allow: /private/public.html permite solo esa página. Cuando ambas reglas coinciden con una URL con la misma especificidad, Allow tiene prioridad. Sin ninguna directiva Allow o Disallow, todo está permitido por defecto.

No. Un error común es añadir Disallow: /*.css y Disallow: /*.js al robots.txt. Googlebot necesita obtener el CSS y el JavaScript para renderizar tus páginas y comprender su contenido. Bloquear estos archivos puede hacer que Google vea una versión rota de tu sitio, lo que podría perjudicar tu posicionamiento. Solo bloquea los archivos y rutas que realmente no quieras que sean rastreados — áreas de administración, páginas internas de resultados de búsqueda, URLs filtradas duplicadas, rutas de staging.

Crawl-delay establece un número mínimo de segundos que un rastreador debe esperar entre las peticiones a tu servidor. Por ejemplo, Crawl-delay: 10 le indica al bot que se detenga 10 segundos entre las capturas de páginas. Esto reduce la carga del servidor de los rastreadores agresivos. Ten en cuenta que Googlebot ignora el Crawl-delay en robots.txt — para controlar la tasa de rastreo de Googlebot, usa la configuración de frecuencia de rastreo en Google Search Console en su lugar. Crawl-delay es respetado por Bingbot, Yandex y muchos otros rastreadores más pequeños.

Sí. Cada bloque de User-agent se aplica solo a ese rastreador. User-agent: * se aplica a todos los rastreadores por defecto. Luego puedes añadir bloques específicos que sobrescriban los valores predeterminados — por ejemplo, User-agent: Googlebot con su propio conjunto de reglas Allow/Disallow, y User-agent: Bingbot con reglas diferentes. Cuando un rastreador encuentra múltiples bloques coincidentes (uno específico y el comodín), sigue la coincidencia más específica. Añade múltiples bloques de user-agent usando el botón "Add User-Agent Block".

No. Toda la configuración y generación de archivos ocurre en tu navegador con JavaScript. Tus URLs, rutas y direcciones de sitemaps nunca salen de tu máquina. No hay procesamiento en el servidor, ni almacenamiento, ni cuentas. Copia el resultado o usa Download para guardar el archivo — una vez que cierres la pestaña, la configuración desaparecerá.

Que es un generador de robots.txt?

Un generador de robots.txt te ayuda a construir el archivo que controla que partes de tu sitio pueden acceder los rastreadores. En vez de escribir la sintaxis a mano, seleccionas user agents, agregas reglas allow/disallow, pones tus URLs de sitemap y la herramienta genera el archivo.

Funciones principales

Multiples bloques de user-agent con reglas diferentes por rastreador. Botones rapidos para rutas comunes como /admin/, /api/ y /tmp/. Gestion de URLs de sitemap. Configuracion de crawl-delay. Validacion integrada para detectar errores de sintaxis. Preajustes para escenarios comunes.

Casos de uso comunes

Bloquear paneles de admin y endpoints API de los rastreadores. Agregar URLs de sitemap para que los buscadores encuentren todas tus paginas. Establecer reglas diferentes para Googlebot vs otros bots.

Consejos

Siempre incluye tu URL de sitemap. No bloquees archivos CSS y JS que los buscadores necesitan para renderizar tus paginas. Recuerda que robots.txt es publico, no lo uses para ocultar URLs sensibles.

Privacidad

Todo funciona en tu navegador. Ninguna URL ni regla se envia a ningun servidor.

Seguridad y Privacidad

La seguridad de tus datos es nuestra prioridad

Procesamiento Local

Todo el procesamiento ocurre en tu navegador

Sin Transferencia de Datos

Tus datos no se envían a nuestros servidores

Sin Almacenamiento de Datos

No se almacenan ni comparten datos

Cifrado SSL

Cifrado SSL para conexión segura

Siguiente Paso

También en MoreOnlineTools