Emirodgar

llms.txt para qué sirve y si merece la pena en tu web

Publicado el 08/10/2026 5 minutos de lectura GEO

Cada pocas semanas me preguntan si hay que crear un llms.txt. La respuesta corta: no es una prioridad, y no esperes que te traiga citas ni tráfico. La larga tiene matices, porque en algunos casos sí lo haría.

Qué es llms.txt

Es una propuesta de Jeremy Howard, de septiembre de 2024, para que los sitios publiquen en /llms.txt un archivo en Markdown con una versión limpia y resumida de lo que ofrecen. Está pensado para inferencia, no para entrenamiento: que un agente de IA que necesita información sobre tu web la encuentre sin tener que procesar todo el HTML.

El formato es sencillo, con estas partes en orden:

  1. Un encabezado H1 con el nombre del sitio (lo único obligatorio).
  2. Una cita breve que resume de qué va.
  3. Información adicional en texto, si hace falta.
  4. Secciones con H2 que contienen listas de enlaces a los recursos importantes, cada uno con una breve descripción.

Un ejemplo ilustrativo, con una tienda inventada:

# Tienda Acme

> Tienda online de material de escalada con envío a toda España.

Vendemos cuerdas, arneses y calzado. Todos los precios incluyen IVA.

## Guías
- [Cómo elegir un arnés](https://acme.example/guias/arnes): tallas, tipos y mantenimiento

## Envíos y devoluciones
- [Política de envíos](https://acme.example/envios): plazos y costes por zona

No es un estándar oficial de ningún organismo. Es una convención propuesta que cada sitio decide si adopta.

Qué dice Google

John Mueller lo dejó claro en abril de 2025, según recogió Search Engine Journal: que él sepa, ninguno de los servicios de IA ha dicho usar llms.txt, y en los logs del servidor se ve que ni siquiera lo consultan. Lo comparó con la etiqueta meta de keywords.

Su razonamiento: es lo que el dueño afirma que es su sitio, y para comprobarlo hay que ir al sitio igualmente. El análisis de Search Engine Journal añade un riesgo, que es servir una cosa a los bots y otra a las personas.

Qué dicen los datos

El estudio más citado es el de SE Ranking, de noviembre de 2025, sobre 300.000 dominios:

  • El 10,13 % tenía llms.txt, y la adopción era parecida con independencia del tamaño del sitio (los de mucho tráfico, algo menos).
  • No encontraron relación entre tenerlo y que te citen más en las respuestas de los principales modelos. De hecho, quitar esa variable de su modelo predictivo mejoró su precisión.
  • Su conclusión: tiene poco coste y poco riesgo, pero hoy no aporta un beneficio medible en visibilidad. Lo recomiendan como preparación para el futuro, no como prioridad.

Cautelas: es un estudio de un proveedor de herramientas, con citas de un conjunto concreto de modelos y en un momento dado. Que no haya correlación hoy no prueba que no vaya a haberla mañana.

Dónde sí se usa

Hay un uso real, pero es de nicho. La propia propuesta señala que plataformas de documentación como Mintlify generan estos archivos de forma automática y que algunos laboratorios de IA publican el suyo. Tiene sentido allí: documentación técnica y APIs que consultan agentes y asistentes de programación, donde alguien apunta explícitamente a ese archivo.

Y hay una señal de por dónde va el ecosistema: Lighthouse agrupa una auditoría de llms.txt en la categoría Agent Discoverability, junto a la de catálogo de recursos para agentes que expliqué en el SEO en la era de la IA. Es una comprobación de descubribilidad, no una promesa de que un modelo lo lea.

Mi criterio

Lo haría si:

  • Tienes documentación, una API o un producto técnico que los agentes consultan.
  • Puedes generarlo automáticamente desde tu CMS o tu documentación, sin mantenimiento manual.
  • Quieres dejar preparada la web a coste mínimo, sabiendo que no esperas retorno.

No lo priorizaría si:

  • Tu web es un blog, un ecommerce o una web de servicios y aún no has resuelto lo básico.
  • Alguien te lo vende como “la clave para aparecer en ChatGPT”. Pide la fuente.

Antes que llms.txt, yo revisaría esto, por este orden:

  1. Que el contenido esté en el HTML inicial.
  2. Que los rastreadores que te interesan no estén bloqueados por error.
  3. Que los datos estructurados coincidan con lo visible.
  4. Que cada tema tenga pasajes citables.

Mi guía de SEO técnico en la era de la IA ordena el resto.

Si decides crearlo

  • Que coincida con la web. Cada resumen tiene que decir lo mismo que la página enlazada. Un archivo que contradice al sitio es peor que no tenerlo.
  • Solo páginas públicas y útiles, no todo el sitemap. La gracia es la selección.
  • Descripciones concretas, con lo que la página resuelve, no eslóganes.
  • Mantenlo. Si cambias precios, políticas o enlaces, cambia también el archivo.
  • Comprueba si alguien lo lee. Busca llms.txt en tus logs del servidor. Es la única forma de saber si alguien lo pide, y es coherente con lo que cuento en cómo medir tu visibilidad en la IA.

Lo que no es

Ni bloquea ni autoriza nada. No sustituye a robots.txt: si quieres controlar qué rastreadores acceden, lo explico en cómo bloquear el rastreador de las IA. Y tampoco es un sitemap para IA, aunque a veces se explica así.

Conclusiones

  • llms.txt es un archivo Markdown propuesto en 2024 para que los agentes entiendan tu web. No es un estándar oficial.
  • Google dice que los servicios de IA no lo usan, y un estudio de 300.000 dominios no encontró relación con las citas.
  • Tiene sentido en documentación y productos técnicos, y como preparación a coste casi cero si se genera solo.
  • Para el resto de webs, hay cuatro cosas que mover antes.

Si lo creas, que sea porque te cuesta poco, no porque esperes un resultado.

Este artículo forma parte de la guía SEO técnico en la era de la inteligencia artificial.