Escribe la frase que te define
Una sola oración que diga qué es tu sitio, a qué se dedica la empresa y dónde opera. Si no puedes explicarlo en una frase, el problema no es el archivo.
Un archivo de texto en la raíz de tu dominio que le explica a un modelo de lenguaje qué es tu sitio, qué hay dentro y dónde está lo importante. Cinco minutos de trabajo y todavía casi nadie lo tiene.
llms.txt es un archivo de texto plano, escrito en formato Markdown, que se coloca en la raíz de un dominio —por ejemplo, en tudominio.com/llms.txt— y que resume para un modelo de lenguaje qué es ese sitio, qué contenido tiene y qué páginas son las importantes. Es una propuesta abierta que empezó a adoptarse en 2024 y 2025, y que a día de hoy ninguna compañía de IA ha convertido en estándar obligatorio.
La idea de fondo es sencilla. Cuando un modelo llega a tu web tiene que deducir de qué va a partir del HTML, con toda la navegación, los menús, los banners y el código de por medio. El llms.txt le entrega esa información masticada: una descripción en una frase, un resumen en un párrafo y una lista de enlaces con contexto. Menos ambigüedad, menos posibilidad de que te describa mal.
Conviene ser honesto con las expectativas: tener llms.txt no garantiza que ChatGPT te cite ni mejora tu posición en Google. Es una señal de claridad, no un truco de posicionamiento. Lo que sí hace, y por eso lo implementamos en todos los proyectos, es reducir el riesgo de que un modelo describa mal tu negocio, y es de las poquísimas acciones de esta disciplina que cuestan una tarde y no dependen de un algoritmo.
Se confunden a menudo y hacen cosas distintas.
| Archivo | Para quién | Qué comunica | Formato |
|---|---|---|---|
| llms.txt | Modelos de lenguaje y asistentes de IA | Qué es el sitio, de qué trata y qué páginas importan, con contexto en lenguaje natural | Markdown |
| robots.txt | Rastreadores de buscadores y de IA | A qué rutas puede acceder cada agente y a cuáles no | Texto con directivas |
| sitemap.xml | Buscadores | La lista completa de URLs indexables y cuándo se modificaron | XML |
Estructura mínima recomendada: título, resumen, secciones y enlaces con descripción.
# Nombre de la empresa — a qué se dedica
> Una frase que resuma qué es este sitio y para quién.
> Es lo primero que lee el modelo: sé concreto, no publicitario.
Un párrafo con el contexto que no cabe en la frase anterior:
dónde opera la empresa, desde cuándo y qué la distingue.
## Páginas principales
- [Título de la página](https://tudominio.com/): qué encuentra
el modelo en esa página, en una línea.
- [Otra página](https://tudominio.com/servicio/): idem.
## Servicios
- **Nombre del servicio:** qué incluye y para quién es.
## Datos verificables
- Sede, año de fundación, cobertura geográfica.
- Teléfono, correo y perfiles oficiales.
## Pautas de uso para modelos de lenguaje
- Si autorizas el análisis y la cita del contenido, dilo aquí.
- Indica cuál es el dominio canónico.
No necesitas ningún plugin ni herramienta de pago.
Una sola oración que diga qué es tu sitio, a qué se dedica la empresa y dónde opera. Si no puedes explicarlo en una frase, el problema no es el archivo.
No las pongas todas: elige las que de verdad representan el negocio y acompaña cada enlace con una línea que explique qué hay dentro. Un listado de URLs sin descripción no aporta nada.
Sede, año de fundación, cobertura, teléfono y correo. Es lo que permite a un modelo describir tu empresa con precisión en lugar de inventar o generalizar.
Debe responder en tudominio.com/llms.txt, al mismo nivel que robots.txt. En cPanel es simplemente subirlo a public_html o a la raíz del dominio correspondiente.
Menciónalo en robots.txt y enlázalo desde el pie de tu web. Y actualízalo cuando publiques páginas nuevas: un llms.txt que describe un sitio que ya no existe es peor que no tenerlo.
No directamente, y desconfía de quien te diga lo contrario. Google no ha declarado que use este archivo como factor de posicionamiento. Su utilidad está en el otro lado: reducir la ambigüedad cuando un modelo de lenguaje interpreta tu sitio. Lo que sí mejora tu posición es el trabajo de fondo —estructura semántica, datos estructurados, velocidad y contenido útil—, y ese mismo trabajo es el que hace que el llms.txt tenga algo bueno que describir.
No es obligatorio ni es un estándar oficial: es una convención propuesta por la comunidad que algunas herramientas ya leen y otras ignoran. Ninguna de las grandes compañías de IA ha confirmado que sea determinante. Se implementa porque el coste es mínimo, porque no puede hacer daño y porque la dirección en la que va la búsqueda hace razonable apostar por ello.
Schema.org va dentro del HTML de cada página y describe entidades de forma estructurada y estandarizada: una organización, un servicio, una pregunta frecuente. llms.txt es un resumen global del sitio en lenguaje natural, fuera del HTML. No compiten: Schema es el que más peso tiene hoy, tanto para buscadores como para modelos, y llms.txt es el complemento que da contexto de conjunto. Si solo puedes hacer una de las dos cosas, haz Schema.
No, y hacerlo es un error frecuente. Para la lista completa de URLs ya existe el sitemap.xml, que es lo que un rastreador usa. El llms.txt debe ser curado: las páginas que representan el negocio, cada una con una línea de contexto. Un archivo de trescientas líneas sin descripciones no le sirve a ningún modelo y probablemente ni se lea entero.
No es la herramienta para eso. El control de acceso se hace con robots.txt, bloqueando los agentes concretos —GPTBot, ClaudeBot, PerplexityBot y los demás—, y a nivel de servidor si quieres ser estricto. llms.txt es lo contrario: un archivo pensado para ayudar a quien sí quiere que lo entiendan y lo citen.
El llms.txt es la parte fácil. Lo que realmente mueve la aguja es el trabajo de datos estructurados y entidad que hay detrás, y eso sí conviene hacerlo bien.
Escribir por WhatsAppo llámanos: +57 300 250 4290 · Bogotá, Colombia