Ir al contenido

Glosario llms.txt

Qué es llms.txt

Definición

llms.txt es una propuesta de archivo de texto en formato Markdown, alojado en la raíz del dominio, que ofrece a los modelos de lenguaje un índice curado de las páginas más útiles del sitio; se publicó en septiembre de 2024 y hoy carece de estatus de norma.

En esta página 5
  1. Qué significa llms.txt
  2. Cómo se construye y quién lo lee
  3. Por qué importa
  4. Buenas prácticas
  5. Errores frecuentes
En breve

Propuesta de archivo Markdown alojado en la raíz del dominio que indexa el contenido clave para modelos de lenguaje, sin adopción demostrada por parte de buscadores ni proveedores de IA.

Qué significa llms.txt

El nombre imita al de robots.txt, y esa semejanza genera la primera confusión. robots.txt regula permisos: indica a un rastreador qué rutas puede pedir. El sitemap XML resuelve el descubrimiento: enumera las URL que el propietario quiere que se encuentren. llms.txt no hace ninguna de las dos cosas. Es un índice de orientación, escrito en Markdown, pensado para que un modelo de lenguaje que ya tiene el sitio delante entienda de un vistazo qué documentos importan y para qué sirve cada uno.

La propuesta procede de Jeremy Howard y se publicó el 3 de septiembre de 2024. Desde entonces circula como especificación viva, con una segunda versión del texto. No ha pasado por ningún organismo de normalización, no existe un registro oficial de la extensión y ningún buscador la ha incorporado a su documentación de rastreo. Llamarla estándar es un error de categoría: es una convención que un autor propuso y que una parte de la comunidad adoptó.

Conviene separarla también de llms-full.txt, un volcado del contenido completo en un solo archivo. Esa variante circula por costumbre de la comunidad y no figura en la especificación, de modo que ni siquiera comparte con llms.txt el respaldo de un documento publicado.

Cómo se construye y quién lo lee

El archivo vive en la raíz del dominio, en la ruta /llms.txt, y sigue una estructura fija. Empieza con un encabezado H1 con el nombre del proyecto, único elemento obligatorio. Debajo va una cita en bloque con un resumen breve. A continuación puede aparecer prosa libre sin encabezados. El resto son secciones H2, cada una con una lista de enlaces Markdown; tras cada enlace se admite un signo de dos puntos y una nota que explica el documento. Una sección llamada Optional recoge por convención lo secundario, aquello que un modelo puede saltarse si va justo de contexto.

# Acme Docs

> Documentación de producto de Acme.

## Guías
- [Inicio](https://acme.com/inicio)
- [API](https://acme.com/api): referencia

## Optional
- [Changelog](https://acme.com/changelog)

Hasta aquí llega el mecanismo documentado. La parte que casi nunca se cuenta es la del consumo. Google se pronunció el 23 de julio de 2025, por boca de Gary Illyes en un evento Search Central Deep Dive: no admite llms.txt y no tiene previsto hacerlo.

Los registros de servidor apuntan en la misma dirección. Un análisis de 137.210 dominios referido a mayo de 2026 encontró que el 97 % de los archivos llms.txt publicados no recibió ni una sola petición ese mes. De las peticiones que sí llegaron, la mayoría procedía de herramientas de auditoría SEO y de perfiladores tecnológicos, no de sistemas de IA. Y en los dominios sin el archivo, ningún bot de IA fue a buscarlo: no sondean su existencia. El mismo análisis encontró que el 28 % de esos 137.210 dominios, todos ellos usuarios de una misma herramienta de analítica y por tanto una población más técnica que la media, publica un archivo llms.txt. La adopción existe; lo que falta es la lectura.

Por qué importa

La decisión que cuelga de este término es fácil de enunciar y fácil de contestar mal: ¿merece la pena publicar el archivo? La respuesta honesta no es sí ni no. Crearlo cuesta poco, del orden de una hora para un sitio mediano, y a fecha de hoy no hay evidencia pública de que mejore la visibilidad en respuestas generadas. Quien lo publique debe hacerlo sabiendo eso, no esperando tráfico.

El riesgo real no está en el archivo, sino en lo que desplaza. Un equipo que dedica su presupuesto de visibilidad en IA a mantener un índice Markdown, mientras deja el HTML detrás de JavaScript sin renderizar o bloquea sin querer al rastreador de búsqueda de un proveedor, está optimizando la parte que nadie lee y descuidando la que todos rastrean. Los sistemas de IA que citan páginas llegan a ellas por la vía normal: rastreo, índice, recuperación.

Hay un segundo coste, el de mantenimiento. Un llms.txt desactualizado apunta a URL que ya no existen y describe secciones que cambiaron de nombre. Si algún día los proveedores empiezan a leerlo, el archivo abandonado será una fuente de errores y no una ventaja. Publicarlo obliga a incluirlo en la rutina de revisión del sitio, junto al sitemap y a las redirecciones.

Buenas prácticas

  • Publica el archivo solo si vas a mantenerlo: añádelo a la misma revisión periódica que el sitemap, las redirecciones y los canónicos.
  • Sírvelo como texto plano en UTF-8 y comprueba que responde 200 en la raíz del dominio, no en un subdirectorio ni tras una redirección.
  • Enlaza únicamente URL canónicas y accesibles sin sesión iniciada; una lista de enlaces rotos es peor que no tener archivo.
  • Escribe la nota de cada enlace pensando en alguien que no conoce el sitio: qué contiene el documento y para qué caso sirve.
  • Mide antes de opinar: filtra tus registros de acceso por la ruta /llms.txt y comprueba qué agentes la piden en tu propio dominio.
  • Trátalo como un extra posterior, después de que el HTML renderice sin JavaScript y de que robots.txt permita el acceso a los rastreadores de búsqueda de los proveedores de IA.

Errores frecuentes

  • Presentarlo como estándar en una propuesta o en una auditoría de cliente, cuando es una propuesta sin adopción por parte de los buscadores.
  • Sustituir el sitemap XML por llms.txt. Son mecanismos distintos y el sitemap sí lo consumen los buscadores.
  • Generarlo con un plugin y no volver a mirarlo, de modo que envejece con cada cambio de estructura del sitio.
  • Atribuirle subidas de menciones en ChatGPT o Perplexity que coinciden en el tiempo con otros cambios; sin grupo de control no hay causa demostrada.
  • Volcar el sitio entero en llms-full.txt creyendo que así se entrena al modelo, cuando el entrenamiento depende del rastreo y de los permisos.
Manuel Riveiro Rodriguez CEO & Digital Strategist

Una auditoría técnica revisa esto y el resto en un solo paso.

Solicitar auditoría

Preguntas frecuentes

¿Google lee llms.txt?

No. Gary Illyes lo dijo en un evento de Search Central el 23 de julio de 2025: Google no admite el archivo ni tiene previsto hacerlo. Para aparecer en AI Overviews el camino sigue siendo el rastreo normal de Googlebot y la indexación, igual que para los resultados clásicos del buscador.

¿Lo leen OpenAI, Anthropic o Perplexity?

Ninguno lo documenta en sus páginas de rastreadores. Un análisis de registros de mayo de 2026 sobre 137.210 dominios encontró que el 97 % de los archivos no recibió petición alguna, y que los bots de IA no van a buscarlo en dominios donde no existe. Alguna petición suelta sí aparece, pero es residual.

¿Entonces lo creo o no?

Cuesta poco y no perjudica, así que crearlo es defendible como apuesta barata. Lo que no se puede prometer es un efecto: hoy no hay evidencia pública de que mejore la presencia en respuestas generadas. Si lo publicas, incorpóralo al mantenimiento y no lo vendas como palanca de resultados.

¿En qué se diferencia de robots.txt?

robots.txt concede o deniega acceso, y los rastreadores de los grandes proveedores declaran obedecerlo. llms.txt no concede ni deniega nada: solo sugiere qué conviene leer primero. Bloquear con llms.txt es imposible, y un sitio puede tener ambos archivos sin que entren en conflicto.

¿Dónde se coloca y qué formato tiene?

En la raíz del dominio, en /llms.txt, servido como texto plano en UTF-8. El contenido es Markdown: un H1 con el nombre del sitio, una cita en bloque con el resumen, prosa opcional y secciones H2 con listas de enlaces, cada uno con una nota breve que explica el documento.

Fuentes

  1. Documento original de la propuesta, firmado por Jeremy Howard y publicado el 3 de septiembre de 2024; define la estructura del archivo y se describe a sí mismo como propuesta, no como norma.
  2. Recoge la declaración de Gary Illyes en el Search Central Deep Dive del 23 de julio de 2025: Google no admite llms.txt ni tiene previsto hacerlo.
  3. Análisis de registros de servidor de 137.210 dominios en mayo de 2026, publicado el 15 de junio de 2026: el 28 % de esos dominios publica un archivo llms.txt y el 97 % de esos archivos no recibió ninguna petición. La población estudiada son dominios que usan una herramienta de analítica SEO, más técnica que la media del web, de modo que el 28 % es un techo y no una tasa de adopción general.