llms.txt: qué hace y qué no hace

Visibilidad en IA 14 de septiembre de 2026·8 min de lectura

Todas las listas de «visibilidad en IA» del último año dicen que añadas un archivo llms.txt. Los registros de servidor dicen que casi nadie lo lee. Las dos cosas son ciertas, y aun así yo publico uno en esta web. Esto es lo que es, lo que muestran los datos y por qué creo que merece diez minutos, pero no una estrategia.

Qué es el llms.txt

Es un archivo de texto en markdown que se sirve desde la raíz del dominio, en /llms.txt. Lo propuso Jeremy Howard el 3 de septiembre de 2024 como forma de dar a los modelos de lenguaje un mapa breve y seleccionado de una web, en lugar de obligarlos a atravesar menús, scripts y avisos de cookies.

El formato es deliberadamente flexible. Según la propuesta, solo el primero de estos elementos es obligatorio:

  • Un H1 con el nombre del sitio o del proyecto. Es lo único obligatorio.
  • Una cita (blockquote) con un resumen breve de lo esencial.
  • Texto o listas sin encabezados, para el detalle.
  • Secciones bajo H2 con listas de enlaces, cada uno con una nota opcional.
  • Una sección llamada «Optional», por convención, para lo secundario.

Un archivo mínimo sería así. La sección «Optional» se deja con su nombre en inglés, porque la propuesta la define con ese nombre:

# Ejemplo Consultoría

> Consultoría independiente para marcas que venden en varios países.

## Servicios

- [SEO internacional](https://example.com/es/seo/): hreflang, estructura
- [Auditoría](https://example.com/es/auditoria/): cinco módulos

## Optional

- [Notas](https://example.com/es/notas/): artículos largos

Dos cosas que no es. No es un robots.txt: no permite ni bloquea nada, y un rastreador que lo ignora no pierde nada. No es un sitemap: el sitemap intenta listarlo todo, y el llms.txt es una selección editorial.

Qué dicen los datos

Es la parte que casi todos los artículos sobre llms.txt se saltan, así que es la que merece leerse despacio.

Google, junio de 2025 y junio de 2026

John Mueller, de Google, escribió en Bluesky el 17 de junio de 2025: «FWIW no AI system currently uses llms.txt», es decir, que ningún sistema de IA usa el llms.txt. Añadió que los chatbots sí descargan las páginas, para entrenar y para fundamentar sus respuestas, pero que ninguno descarga el llms.txt, y que cualquiera puede comprobarlo en sus registros de servidor.

La documentación de Google ya lo dice por escrito. Su guía para optimizar un sitio para las funciones de IA generativa de la Búsqueda pone los archivos llms.txt en primer lugar entre lo que se puede ignorar, porque la propia Búsqueda de Google no los utiliza, y el 15 de junio de 2026 Google añadió una nota: crear uno «no perjudicará ni beneficiará a la visibilidad ni al posicionamiento de tu sitio en la Búsqueda de Google, ya que la Búsqueda de Google los ignora por completo». Mantenerlo para otros servicios que sí lo usen, añade la nota, no supone ningún problema.

137.210 dominios, mayo de 2026

Ahrefs lo comprobó a gran escala con los registros de servidor de 137.210 dominios en mayo de 2026. El 28 % —38.360 sitios— tenía un llms.txt válido. El 97 % de esos archivos no recibió ni una sola petición en todo el mes. Y ningún bot de IA pidió el archivo en una web que no lo tuviera: nadie sale a buscarlo.

83 sitios, doce semanas, 2026

La prueba más detallada que he visto es la de EZY Research: 83 sitios con llms.txt, monitorizados durante doce semanas entre el 27 de abril y el 19 de julio de 2026. El rastreador de Meta pidió el archivo 193 veces; Googlebot, 67; ClaudeBot, 9; GPTBot, 7; Perplexity, ninguna. Hubo además 1.001 peticiones de bots que no se pudieron verificar.

Gráfico de barras horizontales con las peticiones del archivo llms.txt en 83 sitios durante doce semanas de 2026. El rastreador de Meta hizo 193 peticiones, Googlebot 67, ClaudeBot 9, GPTBot 7 y Perplexity ninguna. Una nota añade 1.001 peticiones de bots no verificados.
El que más leyó el archivo fue Meta, no ninguno de los buscadores en los que se suele pensar al hablar de IA. Datos: EZY Research, de abril a julio de 2026.

Que un archivo se descargue no significa que se use. Googlebot descarga casi todo lo que encuentra, y la guía de Google lo aclara: que rastree un archivo no significa que lo trate de forma especial. Para la Búsqueda de Google, la cuestión ya está respondida por escrito. Para todo lo demás, no he visto ninguna evidencia publicada que relacione el llms.txt con más citas, más tráfico desde la IA o mejores posiciones.

En resumen

El llms.txt es una propuesta razonable que, de momento, los sistemas que más importan apenas han adoptado. Trátalo como una apuesta barata y especulativa, no como una táctica.

Por qué publico uno igualmente

  • Cuesta casi nada. Solo cambia cuando cambian los servicios o el posicionamiento, que es rara vez.
  • Algunos lo piden. El rastreador de Meta es el que más lo solicita en los datos de EZY, y los agentes a los que una persona dirige a una web también lo piden: en el recuento de Ahrefs, un agente de programación lo solicitó más que cualquier bot de búsqueda con IA.
  • Escribirlo obliga a ordenar los hechos. Reunir todo lo esencial de un negocio en un único documento destapa contradicciones entre páginas que nadie había visto, y esa coherencia pesa en la visibilidad en IA mucho más que el archivo.

El archivo de esta web se puede leer aquí. Tiene el cuerpo en inglés y una sección en español que enlaza a las páginas en español: un solo archivo, no dos. Es una decisión mía, porque hoy ningún rastreador da motivos para preferir una opción u otra.

Si lo escribes, escríbelo así

  • Una ficha de datos, no una copia de la web. Quién eres, qué vendes, cuánto cuesta, para quién es, y enlaces a las páginas que lo demuestran.
  • Cada dato tiene que coincidir con su página. Un precio distinto en el llms.txt y en la página del servicio es una contradicción publicada. Yo cambio los dos en el mismo commit.
  • Enlaza, no copies. El archivo tiene que apuntar a las páginas, no duplicarlas.
  • No digas nada que no digan tus páginas. Contarles a las máquinas algo distinto de lo que ven las personas sigue la lógica del cloaking, y es la forma más rápida de que una fuente seleccionada deje de ser fiable.

Si lo que buscas es aparecer en las respuestas de ChatGPT, lo que decide es otra cosa, y lo explico en SEO para ChatGPT.

Fuentes

Preguntas

Un archivo en markdown en la raíz de una web, propuesto por Jeremy Howard en septiembre de 2024, con un resumen breve del sitio para los modelos de lenguaje: título, resumen y listas de enlaces. No permite ni bloquea nada; eso sigue siendo cosa del robots.txt.
No para la Búsqueda. La guía de Google sobre sus funciones de IA generativa dice que la Búsqueda de Google no usa los archivos llms.txt, y una nota añadida el 15 de junio de 2026 aclara que tener uno no perjudica ni beneficia a tu visibilidad ni a tu posicionamiento. Googlebot puede descargarlo igualmente, pero descargar no es usar.
Lleva minutos y hace poco daño, así que no hay un motivo fuerte para no hacerlo, siempre que cada dato coincida con tus páginas. Pero no esperes que mueva nada, y no le dediques presupuesto que corresponde al rastreo, al contenido o a las menciones.