Guía técnica · GEO
El archivo llms.txt Contarle a la máquina quién eres.
Qué es, en qué se diferencia del robots.txt y del sitemap, y cómo se escribe uno que sirva de algo. Incluida la parte que casi nadie cuenta: que no es un estándar y aun así merece la pena.
Empecemos por lo honesto
No es un estándar. Y aun así conviene tenerlo.
Se propuso en 2024, no lo ha aprobado ningún organismo y ninguna gran empresa de IA se ha comprometido públicamente a leerlo. Quien te lo venda como obligatorio, o te prometa posiciones por tenerlo, te está vendiendo humo.
Entonces, ¿por qué ponerlo? Porque cuesta una hora escribirlo, no tiene ningún inconveniente, y hace una cosa que ninguna otra parte de tu web puede hacer: decir en texto plano y sin ambigüedad qué eres y qué no eres. Cuando un modelo tiene que resumir tu negocio, la diferencia entre acertar y equivocarse suele estar justo ahí.
Qué es
Un resumen de tu negocio, escrito para que lo lea una máquina.
Un archivo de texto en Markdown, en la raíz de tu dominio, que explica de qué va tu sitio sin que nadie tenga que atravesar tu menú, tus banners de cookies y tus tres niveles de div para averiguarlo.
La idea de fondo: un modelo que llega a tu web se encuentra HTML pensado para humanos, con navegación, formularios y ruido. Extraer de ahí «esta empresa hace X, en Y, para Z» es trabajo, y el trabajo se hace mal o no se hace. El llms.txt le da esa respuesta ya masticada.
Que no se confunda
Tres archivos, tres trabajos distintos.
Se mezclan constantemente, y no se sustituyen entre sí: los tres viven en la raíz y cada uno responde a una pregunta diferente.
| Archivo | Responde a | Para quién | Formato |
|---|---|---|---|
| robots.txt | ¿Quién puede entrar? | Rastreadores | Directivas |
| sitemap.xml | ¿Qué páginas hay? | Buscadores | XML |
| llms.txt | ¿De qué va esto? | Modelos de lenguaje | Markdown |
El orden importa: si tu robots.txt bloquea a los rastreadores de IA, el llms.txt no sirve para nada porque nadie llegará a leerlo. Antes de escribirlo, comprueba a qué bots de IA les dejas entrar.
Cómo se escribe
La anatomía, sección por sección.
Markdown normal. Un # con el nombre, una cita > con el resumen en una frase, y a partir de ahí secciones con ##. Corto: entre 40 y 100 líneas basta para un negocio de servicios.
# Nombre de la empresa > Una sola frase que diga qué hace, para quién y dónde. > Si un modelo solo lee esto, tiene que bastarle. ## Qué hace, en concreto - **[Servicio uno](https://tudominio.com/servicio-uno/).** Qué incluye y qué no. - **[Servicio dos](https://tudominio.com/servicio-dos/).** Igual. ## Dónde trabaja Zonas, modalidad, idiomas. ## Condiciones - **Precio:** cómo se calcula. - **Plazos:** los reales, no los de folleto. - **Lo que no promete:** aquí es donde ganas credibilidad. ## Contacto ## Páginas
Dos reglas que marcan la diferencia. Enlaza cada afirmación a la página donde se sostiene: el modelo puede seguir el enlace y confirmar. Y escribe lo que no haces. Un llms.txt que solo se elogia es indistinguible de un folleto; uno que dice «no gestionamos campañas de Meta» le da al modelo información que puede usar, y eso es exactamente lo que hace que te cite.
La sección que casi nadie pone
Decir cuál de todas eres tú.
Si tu nombre lo comparten otras empresas — y lo comparten más veces de las que crees — este archivo es el único sitio de tu web donde puedes decirlo de forma explícita.
Es nuestro propio caso y lo tenemos escrito ahí: buscando «Elevate Digital» aparecen ocho empresas distintas en la primera página de Google, varias de ellas agencias de marketing. Un modelo que intente resumirnos tiene ocho candidatas y ninguna razón para elegir bien.
## Cuál de todas las «Elevate» es esta
Esta es **Elévate Digital, elevatedigital.tech**, agencia de
marketing digital en español con sede en Valencia (España).
No es elevate-digital.com (consultora estadounidense, en inglés),
ni elevatedigital.es (agencia para clínicas dentales).
Nombrar explícitamente a las otras es contraintuitivo y funciona: le estás dando al modelo los rasgos que os separan. Si tu marca es única, sáltate esta sección. Si compartes nombre, es probablemente la más valiosa de todo el archivo.
Dónde va
Publicarlo no basta: hay que anunciarlo.
- Súbelo a la raíz. Tiene que responder en
tudominio.com/llms.txt, igual que el robots.txt. - No lo cites con una directiva inventada. Circula por foros una línea
LLM-Content:en el robots.txt: no es válida, Lighthouse la marca como error y no la lee nadie. Si quieres dejar constancia ahí, ponla como comentario con#delante. - Enlázalo desde alguna página. Si no lo cita nadie y no lo enlaza nadie, no lo encuentra nadie. Es el fallo más común, y lo cometimos aquí antes de darnos cuenta.
- Revísalo cuando cambie el negocio. Un llms.txt desfasado es peor que no tenerlo: le estás dando a la máquina información falsa con toda la confianza del mundo.
Preguntas
Lo que siempre se pregunta.
¿Es llms.txt un estándar oficial?
No. Es una propuesta abierta de 2024, no un estándar aprobado por nadie, y ninguna gran empresa de IA se ha comprometido públicamente a leerlo. Quien te lo venda como obligatorio te está vendiendo humo. Dicho eso, cuesta una hora escribirlo y no tiene ningún inconveniente.
¿Sustituye al robots.txt?
No, hacen cosas distintas. El robots.txt dice quién puede entrar. El llms.txt explica de qué va tu negocio a quien ya ha entrado. Si el robots.txt bloquea a los rastreadores de IA, el llms.txt no sirve absolutamente de nada porque nadie llegará a leerlo.
¿Dónde se coloca el archivo?
En la raíz del dominio, igual que el robots.txt: tudominio.com/llms.txt. Se descubre por convención en esa ruta. Cuidado con la línea LLM-Content que circula por foros para citarlo desde el robots.txt: no es una directiva válida y Lighthouse la marca como error. Para que se encuentre, enlázalo desde alguna página del sitio.
¿Qué longitud debe tener?
Lo bastante corto para leerse entero de una vez. Entre 40 y 100 líneas suele bastar para un negocio de servicios. No es un volcado del sitio: es el resumen que le darías a alguien que tiene treinta segundos.
¿Sirve de algo si mi web ya está bien hecha?
Sirve sobre todo para desambiguar. Si tu nombre lo comparten otras empresas, o si vendes algo que se confunde con facilidad, el llms.txt es el único sitio donde puedes decir explícitamente cuál eres tú y cuál no. Eso ninguna otra parte de la web lo permite.
¿Se puede comprobar si funciona?
De forma indirecta. Pregúntale a ChatGPT o a Perplexity por tu negocio y mira si lo que contestan se parece a lo que pone en tu llms.txt. Si repiten justo tus formulaciones, algo está llegando. Aquí está el método para hacerlo bien, que tiene más truco del que parece.
El llms.txt es una pieza pequeña del posicionamiento en buscadores de IA. Ayuda a que te entiendan; que además te citen depende de la estructura y los datos de las páginas que hay detrás.
Empecemos
¿Qué contesta la IA cuando le preguntan por lo tuyo?
En la auditoría gratuita lo comprobamos delante de ti: qué saben hoy los modelos de tu negocio, de dónde lo han sacado y qué se está confundiendo.
Pedir auditoría gratuita