Ir al contenido
WoowTools

Generador de robots.txt

Crea un archivo robots.txt con reglas Allow y Disallow por bot, enlaces al sitemap y retraso de rastreo. Plantillas para WordPress y tiendas online, con validación.

Gratis Funciona en tu navegador Sin registro

Cargando Generador de robots.txt…

Tus archivos nunca salen de tu dispositivo

Cómo usar Generador de robots.txt

  1. 1

    Abre Generador de robots.txt en esta página. Se carga directamente en tu navegador.

  2. 2

    Añade tu archivo, texto o valores y ajusta la configuración.

  3. 3

    Copia o descarga el resultado. No se sube ni se guarda nada.

Acerca de esta herramienta

El archivo robots.txt está en la raíz de tu sitio web e indica a los rastreadores de los buscadores qué partes del sitio pueden visitar. Este generador de robots.txt crea el archivo por ti a partir de un formulario sencillo: elige los bots, añade reglas Allow y Disallow, enlaza tu sitemap y copia o descarga un archivo que se revisa en busca de errores mientras trabajas.

Cómo crear un archivo robots.txt

  1. Empieza con una plantilla: Open to all, Block all, WordPress o E-commerce.
  2. Elige los user agents: todos los bots (*) o algunos concretos como Googlebot, Bingbot, DuckDuckBot, YandexBot, Baiduspider, Slurp, facebookexternalhit, Twitterbot, LinkedInBot o un nombre personalizado.
  3. Añade reglas Disallow y Allow para rutas, o elige entre rutas habituales que bloquear.
  4. Añade la URL de tu sitemap y, si hace falta, un retraso de rastreo y un host preferido.
  5. Revisa la validación y la vista previa, descarga robots.txt y súbelo a la raíz de tu sitio.

La sintaxis en resumen

ReglaSignificado
User-agent: *Las reglas siguientes se aplican a todos los bots
Disallow: /admin/No rastrear nada dentro de /admin/
Allow: /admin/helpExcepción a un Disallow más amplio
Disallow: /*.pdf$Bloquear todas las URL que terminan en .pdf
Disallow: /*?Bloquear URL con parámetros
Sitemap: https://example.com/sitemap.xmlDónde está tu sitemap

Importante

  • Robots.txt controla el rastreo, no la indexación. Una página bloqueada puede seguir apareciendo en Google si otros sitios enlazan a ella. Para dejar una página fuera de los resultados, usa una metaetiqueta noindex y deja que se rastree.
  • No es seguridad. El archivo es público y cualquiera puede leerlo. Protege las zonas privadas con un inicio de sesión.
  • No bloquees CSS, JavaScript ni imágenes que tus páginas necesitan; Google renderiza las páginas y de lo contrario podría evaluarlas mal.
  • Google ignora Crawl-delay; Bing y algunos otros lo respetan.
  • Un archivo por host, en https://yourdomain.com/robots.txt, con el nombre en minúsculas.

Después de subirlo, prueba el archivo en Google Search Console. Luego crea un sitemap con el generador de sitemap XML y define las etiquetas adecuadas de cada página con el generador de metaetiquetas.

Preguntas frecuentes

¿Dónde pongo el archivo robots.txt?

En la raíz de tu dominio, para que esté disponible en https://yourdomain.com/robots.txt. Cada subdominio necesita su propio archivo.

¿Robots.txt impide que una página aparezca en Google?

No. Impide el rastreo, no la indexación. Usa una metaetiqueta noindex en la página y no la bloquees en robots.txt, para que Google pueda ver el noindex.

¿Cómo bloqueo todos los bots?

Usa la plantilla Block all, que escribe User-agent: * seguido de Disallow: /. Úsala solo en sitios de pruebas o privados.

¿Qué diferencia hay entre Allow y Disallow?

Disallow bloquea una ruta; Allow crea una excepción dentro de una ruta bloqueada. Cuando las reglas se solapan, Google sigue la más específica.

¿Debo añadir mi sitemap a robots.txt?

Sí. Una línea Sitemap ayuda a todos los buscadores a encontrarlo, además de enviarlo en Search Console.

¿Puedo bloquear los rastreadores de IA?

Sí. Añade un user agent personalizado como GPTBot o CCBot con Disallow: /. Los bots bien diseñados lo respetan; otros puede que no.