tomai
Entrar
Gratis · Herramientas SEO

Generador de robots.txt

Reglas Allow/Disallow por rastreador y enlaces de sitemap, listos para pegar

Preajustes
Reglas
robots.txt

Semántica de directivas que suele confundir

Reglas expresadas tal como las analizan los rastreadores

Grupos User-agent, ordenación allow/disallow, crawl-delay y declaración de sitemap — ensamblado desde casillas de verificación con vista previa del archivo en vivo.

Tres ajustes iniciales

Los ajustes permitir todo, bloquear todo y WordPress llenan los grupos de reglas al instante, cada uno con su User-agent y líneas Allow o Disallow correctas.

🔒

Reglas por rastreador

Cada User-agent tiene sus propias filas editables de rutas Allow y Disallow, y las líneas Sitemap se añaden desde un campo aparte para que no se mezclen.

🎯

El archivo se regenera al editar

El texto del archivo se reconstruye con cada cambio en un cuadro monoespaciado, así el contenido final de robots.txt se ve antes de copiarlo o descargarlo.

Preguntas frecuentes

¿Qué significa una línea Disallow vacía?

Un simple "Disallow:" sin nada después significa "no bloquear nada", es decir, este rastreador tiene acceso a todo. Eso es justo lo que genera el preajuste Permitir todo.

¿robots.txt realmente impide que las páginas se indexen?

No de forma fiable por sí solo: solo pide a los rastreadores que se comportan correctamente que no accedan a una ruta. Una página puede seguir indexándose (por ejemplo, si hay enlaces desde otro sitio) aunque esté bloqueada. Para mantener realmente una página fuera de los resultados de búsqueda, usa en su lugar una meta etiqueta noindex o una cabecera HTTP.

¿Se sube mi contenido a algún sitio?

No: todo se ejecuta en tu navegador con JavaScript puro. Nada de lo que escribes se envía nunca a un servidor.

¿robots.txt elimina páginas de Google?

No — Disallow bloquea el rastreo, no la indexación. Las URL bloqueadas todavía pueden aparecer como enlaces desnudos. Para eliminar de verdad use noindex o la herramienta de eliminaciones.

Herramientas relacionadas

¿Qué es un generador de robots.txt?

robots.txt es un archivo de texto plano situado en la raíz de un sitio web que indica a los rastreadores de los motores de búsqueda y a otros bots qué partes del sitio pueden consultar. Un archivo típico contiene grupos de reglas —una línea User-agent seguida de rutas Allow y Disallow— y a menudo una referencia al sitemap. Escribirlo a mano es sencillo, pero los errores sutiles son fáciles, como una regla Disallow que oculta una regla Allow que sí debería aplicarse. Este generador monta el archivo a partir de filas de reglas editables y ajustes predefinidos, de modo que los propietarios de sitios y los profesionales del SEO parten siempre de un inicio correcto.

Lo que construye el generador

  • 🤖 Grupos de reglas por rastreador, de un bot concreto al comodín *
  • 🚫 Varias rutas Disallow y ✅ Allow por grupo
  • ⏱️ Línea Crawl-delay opcional
  • 🗺️ Una o varias líneas Sitemap
  • 🧩 Predefinidos de inicio: permitir todo, bloquear todo, valores de WordPress
  • 📋 Copia el archivo terminado o descárgalo directamente

Cuándo escribir uno

  • Excluir un entorno de pruebas o vista previa de los resultados de búsqueda
  • Impedir que un scraper concreto golpee tu sitio sin descanso
  • Configurar las reglas de rastreo de una instalación nueva de WordPress
  • Dirigir a los rastreadores hacia tu nuevo sitemap tras un rediseño

El archivo se monta por completo en tu navegador; no se sube nada. Dos cosas que debes saber: tienes que subir el archivo terminado a la raíz de tu sitio y comprobar que es accesible, y robots.txt es una petición, no una imposición: los rastreadores bien educados la respetan, pero no puede obligar a ningún bot a detenerse.

Última actualización · 2026-09-01

Herramientas relacionadas