Elige qué rastreadores quieres dejar fuera y qué rutas no debe rastrear nadie. El generador escribe el archivo y después lo comprueba rastreador por rastreador con las reglas de Google, para que bloquear el entrenamiento de IA no te saque sin avisar de la búsqueda con IA.
Gratis, sin email28 rastreadoresSolo se registra el uso
Qué hace el archivo
Comprobado, no supuesto: cada rastreador evaluado contra el archivo de arriba con el motor del probador.
Bloquear el entrenamiento de IA sin salir de la búsqueda con IA
Todas las grandes empresas de IA usan ya más de un rastreador, y cada uno hace un trabajo distinto. Los de entrenamiento recogen contenido para modelos futuros. Los de búsqueda llevan tus páginas a respuestas que enlazan a tu web. Bloquear los segundos para frenar a los primeros te cuesta visibilidad y no protege nada.
Empresa
Entrenamiento: se puede bloquear
Búsqueda y respuestas: bloquearlo cuesta visibilidad
Google
Google-Extended (un token, no un rastreador)
Googlebot, que también cubre las vistas creadas con IA y el Modo IA
OpenAI
GPTBot
OAI-SearchBot (búsqueda de ChatGPT)
Anthropic
ClaudeBot
Claude-SearchBot, Claude-User
Apple
Applebot-Extended (un token, no un rastreador)
Applebot (Spotlight, Siri, Safari)
Perplexity
—
PerplexityBot, que Perplexity dice que no se usa para entrenar
Meta
Meta-ExternalAgent
Meta-WebIndexer (búsqueda de Meta AI)
Amazon
Amazonbot
Amzn-SearchBot (Alexa y otras experiencias de búsqueda)
Mistral AI
MistralAI-Training
MistralAI-Index
CCBot, de Common Crawl, va aparte: construye un archivo abierto de la web que cualquiera puede descargar y reutilizar, y por eso muchos sitios que bloquean a los rastreadores de entrenamiento también lo bloquean. La plantilla «Bloquear entrenamiento de IA» lo incluye.
Por qué el generador comprueba su propio archivo
Dos reglas de robots.txt rompen los archivos escritos a mano sin ningún mensaje de error, y el generador está construido alrededor de las dos:
Un rastreador con nombre ignora el grupo *. Si escribes un grupo para GPTBot, las rutas que prohibiste para todos dejan de aplicarse a GPTBot. Por eso el generador solo nombra a un rastreador para bloquearlo del todo; el resto hereda las reglas de rutas compartidas.
Algunos rastreadores toman prestado el grupo de otro. Applebot sigue las reglas de Googlebot si ningún grupo nombra a Applebot, y Googlebot-Image y Googlebot-News hacen lo mismo. Si bloqueas Googlebot, los tres se van con él; así que, si deben seguir permitidos, el generador les da su propio grupo con las reglas compartidas copiadas.
AdsBot, de Google, también ignora por completo el grupo *. La plantilla «Bloquear todo» lo nombra, porque un sitio de pruebas que solo bloquea * sigue abierto para él.
Lo que robots.txt no puede hacer
Sacar una página del índice. Una URL bloqueada puede indexarse igualmente si otras páginas la enlazan; Google simplemente no puede leerla. Para dejarla fuera, permite el rastreo y usa noindex.
Frenar a los rastreadores que lo ignoran. OpenAI dice que las reglas de robots.txt pueden no aplicarse a ChatGPT-User, y Perplexity dice que Perplexity-User en general lo ignora, porque una persona pidió la página. Para bloquearlos de verdad hace falta una regla en el firewall.
Sacarte solo de las vistas creadas con IA. Forman parte de la Búsqueda de Google. Desde el 31 de agosto de 2026, el control de IA generativa de la Búsqueda en Search Console excluye un sitio de ellas sin bloquear Googlebot.
Proteger nada privado. El archivo es público y orientativo. Lo que deba ser privado necesita autenticación.
Bloquea por su nombre los rastreadores y tokens de entrenamiento —GPTBot, ClaudeBot, Google-Extended, Applebot-Extended, Meta-ExternalAgent, Amazonbot, CCBot— y deja en paz a los de búsqueda: Googlebot, Bingbot, Applebot, OAI-SearchBot, Claude-SearchBot, PerplexityBot. La plantilla «Bloquear entrenamiento de IA» hace exactamente eso.
No sin salir de la Búsqueda: las vistas creadas con IA y el Modo IA forman parte de ella y usan Googlebot. Desde el 31 de agosto de 2026, el control de IA generativa de la Búsqueda en Search Console excluye un sitio de ellas sin bloquear Googlebot. Google-Extended no afecta a la Búsqueda.
En la raíz de cada dominio, como https://www.example.com/robots.txt. Solo se aplica al protocolo, dominio y puerto desde el que se sirve, así que un subdominio necesita el suyo.
No. El archivo se construye en tu navegador y las rutas que escribes se quedan ahí. La página sí registra cómo se ha usado la herramienta: qué preset elegiste, qué rastreadores bloqueaste y cuántas reglas y sitemaps tiene el archivo. Ese registro no lleva ningún identificador, y con Do Not Track o Global Privacy Control no se envía.