Si vendes algo y una persona le pregunta a ChatGPT por proveedores de tu sector, el modelo no va a leerse tu web entera para decidir si te menciona. Va a apoyarse en lo que ya sabe y en lo que puede extraer rapido. El fichero llms.txt nace justo de ese problema: darle a un modelo, en un solo sitio y en lenguaje claro, la version buena de quien eres.
Que es exactamente llms.txt
llms.txt es un fichero de texto plano que se coloca en la raiz de un dominio, en /llms.txt, y que resume de forma estructurada que es el sitio y que informacion contiene. Esta pensado para que lo lean modelos de lenguaje, no personas.
La comparacion util es con robots.txt, pero conviene entender bien la diferencia porque se confunden constantemente:
| robots.txt | llms.txt | |
|---|---|---|
| Responde a | ¿Puedes entrar aqui? | ¿De que va esto? |
| Naturaleza | Control de acceso | Contexto semantico |
| Formato | Directivas | Markdown en lenguaje natural |
| Publico | Rastreadores | Modelos de lenguaje |
No compiten: hacen cosas distintas y lo sensato es tener los dos.
Por que un modelo lo agradece
Una web moderna es un problema para una maquina. El contenido esta repartido entre menus, pestanas, secciones que cargan con JavaScript y textos escritos para persuadir mas que para informar. Extraer de ahi una respuesta precisa a "¿que hace esta empresa y para quien?" es sorprendentemente dificil.
llms.txt corta ese nudo: le das la respuesta ya masticada. Y hay un efecto de segundo orden que importa mas de lo que parece: si tu no defines como te describen, lo define el modelo por su cuenta, mezclando tu web con lo que haya leido de terceros. Escribir tu propio resumen es la forma mas barata de controlar tu narrativa.
Como se escribe: la estructura
El formato es Markdown y la convencion basica es sencilla:
# Nombre de la marca > Resumen de una linea: que hace y para quien. ## Sobre nosotros Parrafo autocontenido explicando la empresa. ## Servicios - Servicio 1: descripcion concreta - Servicio 2: descripcion concreta ## Preguntas frecuentes P: ¿Pregunta real que hace la gente? R: Respuesta completa que se entienda sin leer nada mas. ## Contacto - Web, ubicacion, correo
Las cuatro reglas que marcan la diferencia
- Escribe respuestas autocontenidas. Cada parrafo debe entenderse solo. Un modelo va a extraer fragmentos sueltos, no a leer de arriba abajo. Si una frase depende de la anterior para tener sentido, no sirve.
- Nada de marketing vacio. "Lideres en soluciones innovadoras" no aporta ni un dato. "Agencia de GEO en Zaragoza que trabaja con pymes industriales" si. Lo concreto se cita; lo generico se descarta.
- Incluye preguntas con sus respuestas. Es el formato que mejor encaja con como funciona un modelo conversacional: le estas dando literalmente el par pregunta-respuesta que necesita.
- Mantenlo actualizado. Un llms.txt con precios viejos o servicios que ya no prestas es peor que no tenerlo: estas alimentando activamente informacion falsa sobre ti.
Un detalle que vemos fallar mucho: hay webs cuyo robots.txt invita explicitamente a los bots de IA a leer sus datos estructurados... y luego no tienen ni llms.txt ni JSON-LD mas alla de lo minimo. Es una promesa incumplida a la primera visita.
¿Funciona de verdad?
Aqui toca ser honesto, porque hay mucho humo. llms.txt es un estandar emergente: ningun proveedor de modelos garantiza publicamente que lo lea ni lo pondera. Cualquiera que te venda que ponerlo te mete en ChatGPT te esta enganando.
Ahora bien, el calculo es favorable: cuesta una tarde escribirlo, no rompe nada y produce un beneficio colateral inmediato: te obliga a redactar en lenguaje claro que haces y para quien. Ese ejercicio mejora tu web, tus fichas y hasta tus correos comerciales. Y si el estandar se consolida, ya lo tienes.
Un ejemplo real
El de esta misma web esta publico en geoyseo.es/llms.txt. Incluye el resumen, los servicios, las preguntas frecuentes con respuestas completas y una seccion de normativa con fechas verificadas. Copialo como plantilla si te sirve.
Y si quieres el cuadro completo de como se optimiza una web para que la citen los modelos, esto es solo una pieza: lo desarrollamos en SEO para IA.
Preguntas frecuentes
¿Que es el fichero llms.txt?
llms.txt es un fichero de texto plano situado en la raiz de un dominio, en /llms.txt, que resume en lenguaje natural y de forma estructurada que es el sitio y que informacion contiene, pensado para que lo lean modelos de lenguaje. Funciona como un robots.txt semantico: no controla el acceso, facilita la comprension.
¿Es lo mismo llms.txt que robots.txt?
No. robots.txt dice a los rastreadores a que rutas pueden acceder: es control de acceso. llms.txt explica de que va el sitio y donde esta lo importante: es contexto. Son complementarios y conviene tener los dos, porque resuelven problemas distintos.
¿Sirve de algo llms.txt hoy?
Es un estandar emergente y ningun proveedor garantiza que lo lea. Dicho eso, el coste de tenerlo es practicamente cero y el beneficio potencial es alto: un fichero que resume tu propuesta en lenguaje claro es util para cualquier sistema que rastree tu web, lo consuma como llms.txt o no. Lo que no tiene sentido es prometer resultados garantizados por ponerlo.
¿Donde se coloca el fichero llms.txt?
En la raiz del dominio, accesible en https://tudominio.com/llms.txt, servido como texto plano con content-type text/plain. Si tu web esta en un subdominio, va en la raiz de ese subdominio.
¿Que se escribe dentro de llms.txt?
Un titulo con el nombre de la marca, un resumen de una linea en formato cita, y despues secciones en Markdown: quienes sois, que servicios ofreceis, preguntas frecuentes con respuestas completas, enlaces a vuestro contenido clave y datos de contacto. La clave es escribir respuestas autocontenidas que se puedan citar sin mas contexto.