Generador de archivos Robots.txt

Genera fácilmente un archivo robots.txt SEO profesional para tu sitio web.

Introduzca la URL del mapa del sitio de su sitio web.
Introduce las URL que quieres bloquear para los bots (una por línea).

Robots.txt generado

Generador gratuito de archivos Robots.txt

Nuestro generador gratuito de archivos robots.txt crea un archivo robots.txt limpio y válido para tu sitio web en segundos. Añade la URL de tu mapa del sitio, indica las rutas que deseas bloquear y genera un archivo listo para usar que puedes copiar o descargar. No necesitas conocimientos de sintaxis, ni registrarte, y sin riesgo de errores tipográficos que puedan provocar la desindexación de un sitio web cuando el archivo se escribe manualmente.

Un archivo robots.txt controla cómo los motores de búsqueda indexan tu sitio web. Un solo carácter incorrecto puede bloquear tu sitio web por completo en Google sin previo aviso. Este generador elimina ese riesgo creando el archivo a partir de tus datos de entrada en lugar de texto libre.

¿Qué es un archivo robots.txt?

 El archivo robots.txt es un archivo de texto plano ubicado en la raíz de tu dominio que indica a los rastreadores de los motores de búsqueda qué URL pueden solicitar. Se encuentra en yoursite.com/robots.txt y es el primer archivo que la mayoría de los bots revisan antes de rastrear. Controla el rastreo, no la indexación, por lo que una página bloqueada aún puede aparecer en los resultados de búsqueda si otros sitios enlazan a ella.

El archivo cumple con el Estándar de Exclusión de Robots (ROS), un protocolo que respetan todos los motores de búsqueda importantes. Googlebot, Bingbot y otros rastreadores confiables lo leen antes de solicitar cualquier otra cosa en tu sitio. Los programas de extracción de datos y los bots maliciosos suelen ignorarlo por completo, por lo que robots.txt nunca es una herramienta de seguridad.

Según Google, una página bloqueada en robots.txt aún puede indexarse ​​si se enlaza desde otros sitios, generalmente sin descripción. Si su objetivo es evitar que una página aparezca en los resultados de búsqueda, la etiqueta noindex o la protección con contraseña son el método correcto, no una regla de bloqueo.

Cómo usar este generador de robots.txt

 Para crear un archivo robots.txt, introduce la URL de tu mapa del sitio, añade las rutas que quieras bloquear (una por línea) y haz clic en Generar. La herramienta creará un archivo con el formato correcto que podrás copiar o descargar. Súbelo a la raíz de tu sitio web para que sea accesible en tudominio.com/robots.txt y, a continuación, pruébalo en Google Search Console.

  1. Introduce la URL de tu mapa del sitio. Esto dirige a los rastreadores directamente a tus páginas más importantes, por ejemplo, https://yoursite.com/sitemap_index.xml.
  2. Agregar rutas para deshabilitar. Indique una ruta por línea, como /wp-admin/ o /cart/. Deje este campo en blanco para permitir el rastreo completo.
  3. Haz clic en Generar. La herramienta genera un archivo robots.txt limpio y válido, con la sintaxis y el espaciado correctos.
  4. Copia o descarga el archivo. Guárdalo como robots.txt con codificación UTF-8.
  5. Súbelo a la raíz de tu sitio. y confirma que se carga en yoursite.com/robots.txt, luego prueba las URL clave en Search Console.

Sintaxis de Robots.txt: Explicación de las directivas

 Un archivo robots.txt se compone de cuatro directivas principales. User-agent selecciona un rastreador específico, Disallow bloquea una ruta, Allow permite el acceso a una ruta dentro de una carpeta bloqueada y Sitemap apunta a tu mapa del sitio XML. Cada regla se coloca en una línea independiente, las rutas distinguen entre mayúsculas y minúsculas, y los rastreadores aplican la regla que mejor coincide con la ruta, en lugar de la primera que aparece en la lista.

Directiva

Qué hace

Ejemplo

Agente de usuario

Nombra al rastreador al que se aplica un bloque de reglas

Agente de usuario: *

Rechazar

Bloquea el paso para impedir que se pueda gatear.

No permitir: /wp-admin/

Permitir

Permite una ruta dentro de una carpeta bloqueada.

Permitir: /wp-admin/admin-ajax.php

Mapa del sitio

Indica a los rastreadores dónde se encuentra tu mapa del sitio.

Mapa del sitio: https://site.com/sitemap.xml

retraso de arrastre

Solicita a los bots que esperen entre solicitudes (Google lo ignora).

Retraso de rastreo: 10

El asterisco en Agente de usuario: * es un comodín que significa todos los rastreadores. Para apuntar a un bot, nómbrelo directamente, como Agente de usuario: Googlebot. Un valor Disallow en blanco permite todo, mientras que No permitir: / Bloquea todo el sitio.

Qué permitir y qué prohibir

 Bloquea las rutas sin valor de búsqueda que desperdician recursos de rastreo, como las páginas de administración, las URL del carrito y del proceso de pago, los resultados de búsqueda internos y las URL de filtros duplicados. Nunca bloquees las carpetas de CSS, JavaScript o imágenes que los motores de búsqueda necesitan para renderizar tus páginas, ya que una página que no se renderiza correctamente puede ser evaluada erróneamente en cuanto a su calidad durante la indexación.

Las rutas comunes que conviene bloquear en la mayoría de los sitios incluyen:

  • /wp-admin/ al tiempo que permite /wp-admin/admin-ajax.php
  • Páginas de resultados de búsqueda interna como /?s=
  • URLs del carrito, del proceso de pago y de la cuenta en tiendas de comercio electrónico
  • Carpetas de preparación o desarrollo
  • Páginas de agradecimiento y confirmación sin intención de búsqueda

Los motores de búsqueda funcionan con un presupuesto de rastreo, que es la cantidad de páginas que un bot rastreará en un período de tiempo determinado. Bloquear las secciones de bajo valor ayuda a los rastreadores a gastar ese presupuesto en las páginas que realmente generan tráfico. Esto cobra mayor importancia a medida que un sitio crece, ya que el 91% de las páginas no reciben tráfico orgánico de Google, según Google. Ahrefsy los desechos que se arrastran no hacen más que ampliar esa brecha.

Controlar los rastreadores de IA en 2026

 Un archivo robots.txt moderno ya no se limita solo a Googlebot y Bingbot. Ahora puedes permitir o bloquear rastreadores de IA como GPTBot, ClaudeBot, Google-Extended y PerplexityBot, además de rastreadores SEO como AhrefsBot y SemrushBot. Cada uno se controla con su propio bloqueo de agente de usuario, lo que te permite decidir directamente qué bots pueden acceder a tu contenido para entrenamiento o indexación.

Si quieres impedir que un rastreador de IA específico utilice tu contenido, añade un bloqueo específico para él:

  • Agente de usuario: GPTBot entonces No permitir: / Bloquea el rastreador de OpenAI
  • Agente de usuario: Google-Extended entonces No permitir: / Opta por no participar en el entrenamiento de IA de Google, pero mantiene el rastreo de búsqueda normal.
  • Agente de usuario: CCBot entonces No permitir: / Bloquea el bot Common Crawl utilizado por muchos conjuntos de datos de IA.

Bloquear estas funciones no afecta a tu posicionamiento habitual en las búsquedas de Google o Bing, ya que utilizan agentes de usuario distintos. Se trata simplemente de un control sobre la IA y el acceso a datos de terceros.

Robots.txt para WordPress

 WordPress genera automáticamente un archivo robots.txt virtual, pero subir un archivo personalizado te da un control total. Una configuración segura de WordPress bloquea el área de administración y la búsqueda interna, permitiendo admin-ajax.php y mostrando el mapa del sitio. Nunca bloquees /wp-content/ por completo, ya que contiene archivos de temas y plugins que Google necesita para renderizar tus páginas.

Una plantilla básica y limpia para un sitio de WordPress tiene este aspecto:

Agente de usuario: *
No permitir: /wp-admin/
No permitir: /?s=
Permitir: /wp-admin/admin-ajax.php
Mapa del sitio: https://tudominio.com/sitemap_index.xml

Sustituye la URL del mapa del sitio por la tuya, genera el archivo mencionado anteriormente y súbelo a tu directorio raíz. Si tienes una tienda online, añade las rutas de carrito, pago y mi cuenta a la lista de rutas prohibidas.

Errores comunes en Robots.txt que se deben evitar

 El error más perjudicial en robots.txt es dejar la línea Disallow: / en el archivo activo, lo que bloquea todo el sitio. Otros errores frecuentes incluyen bloquear archivos CSS y JavaScript, listar páginas sensibles que luego el archivo publicita públicamente y asumir que robots.txt elimina páginas del índice de Google cuando solo controla el rastreo.

  • El bloqueo completo accidental. Un extraviado No permitir: / Indica a todos los rastreadores que ignoren todo tu sitio. Esto suele ocurrir cuando se sube un archivo de prueba al sitio web durante una migración.
  • Bloqueando archivos críticos para la renderización. Deshabilitar el CSS o el JavaScript del tema impide que Google vea tu página como lo hace un usuario, lo que puede perjudicar el posicionamiento, especialmente en constructores visuales como Elementor.
  • Uso de robots.txt para la privacidad. El archivo es público, por lo que indicar una ruta sensible simplemente revela su ubicación. En su lugar, utilice protección con contraseña o la opción noindex.
  • Distinción entre mayúsculas y minúsculas. Las rutas distinguen entre mayúsculas y minúsculas, por lo que /Foto/ y /foto/ se tratan como directorios diferentes.

Utilizar un generador en lugar de escribir el archivo manualmente elimina casi todos estos riesgos, ya que la sintaxis se construye correctamente a partir de tus datos de entrada en cada ocasión.

Robots.txt vs Sitemap vs Noindex

 Estos tres elementos cumplen funciones distintas. El archivo robots.txt controla las rutas a las que pueden acceder los rastreadores, el mapa del sitio enumera las URL que se desean rastrear e indexar, y la etiqueta noindex impide que una página rastreable aparezca en los resultados de búsqueda. Una buena configuración de SEO técnico utiliza robots.txt y un mapa del sitio conjuntamente, y reserva la etiqueta noindex para las páginas que deben permanecer fuera de Google.

Un error común es contradecir estas señales, por ejemplo, incluir una URL en el mapa del sitio mientras se bloquea en robots.txt. Si desea que una página se elimine de la búsqueda, permita el rastreo y agregue una etiqueta noindex, ya que Google no puede leer una etiqueta noindex en una página que no tiene permitido rastrear. Para obtener un análisis más detallado, consulte nuestras guías sobre el Blog de SEO.

Por qué un archivo robots.txt adecuado ayuda a tu SEO

 Un archivo robots.txt bien configurado mejora el SEO al guiar a los rastreadores hacia tus páginas valiosas y alejarlas de las de bajo valor, lo que optimiza el presupuesto de rastreo y ayuda a que el contenido importante se indexe más rápido. Si bien robots.txt no es un factor de posicionamiento directo, la eficiencia del rastreo afecta directamente la rapidez y la exhaustividad con que se procesa tu sitio.

Los backlinks siguen siendo uno de los tres principales factores de clasificación de Google, y nada de esa autoridad ganada importa si los problemas de rastreo impiden que tus mejores páginas se procesen correctamente. Autoridad de dominioLa puntuación de Moz de 1 a 100, basada principalmente en señales de backlinks, crece más rápido en sitios donde el rastreo y la indexación funcionan correctamente. Una vez configurado su archivo robots.txt, compruebe su autoridad con nuestra herramienta. Herramienta DA PA gratuita y escanear en busca de enlaces muertos que desperdician recursos de rastreo utilizando nuestro Comprobador masivo de enlaces rotos.

Preguntas frecuentes

¿Este generador de robots.txt es gratuito?

Sí, nuestro generador de archivos Robots.txt es completamente gratuito, sin registro ni límites. Ingrese su mapa del sitio y las rutas no permitidas, genere el archivo y cópielo o descárguelo al instante. Puede volver y regenerar un archivo actualizado cada vez que cambie la estructura de su sitio, junto con nuestra suite completa de Herramientas SEO gratuitas.

¿Dónde debo colocar el archivo robots.txt después de generarlo?

Súbelo al directorio raíz de tu sitio para que se cargue en yoursite.com/robots.txt. No funcionará en una subcarpeta. En WordPress, puedes subirlo por FTP o pegar el contenido en el editor de robots.txt de tu plugin de SEO, como Yoast o Rank Math.

¿El archivo robots.txt elimina mis páginas de Google?

No. El archivo robots.txt solo controla el rastreo, no la indexación. Una página bloqueada aún puede aparecer en los resultados de búsqueda si otros sitios enlazan a ella, generalmente sin descripción. Para eliminar una página de la búsqueda, utilice la etiqueta noindex en una página rastreable o protéjala con contraseña.

¿Puedo bloquear rastreadores de IA como GPTBot con robots.txt?

Sí. Añade un bloqueo de agente de usuario específico para el bot, como GPTBot, ClaudeBot o Google-Extended, seguido de Disallow: / para bloquearlo. Esto impide que el rastreador de IA acceda a tu contenido sin afectar tu posicionamiento habitual en las búsquedas de Google o Bing, ya que estas utilizan agentes de usuario diferentes.

¿Cómo puedo probar mi archivo robots.txt después de subirlo?

Abre Google Search Console y usa la herramienta de inspección de URL en algunas páginas clave para confirmar que no estén bloqueadas inesperadamente. Siempre prueba antes y después de los cambios, ya que un solo carácter mal colocado puede bloquear mucho más de lo previsto. Combina esto con una comprobación rápida de autoridad usando nuestra comprobador de autoridad de dominio masivo.

Genera tu archivo Robots.txt ahora

Desplácese hacia arriba, ingrese la URL de su mapa del sitio y las rutas que desea bloquear, y genere un archivo robots.txt limpio y válido en segundos. Es gratis, no requiere registro y elimina el riesgo de errores tipográficos que conlleva escribir el archivo manualmente. Una vez que su configuración de rastreo esté limpia, explore nuestra conjunto completo de herramientas SEO o bien, obtenga una segunda opinión de nuestro equipo. consultor experto en SEO servicio.



¿Necesitas ayuda?
Scroll al inicio