llms.txt: qué contiene y para qué sirve
llms.txt es un archivo markdown en la raíz del sitio que da a un agente de IA un mapa breve y curado de lo que importa. Es una propuesta del 3 de septiembre de 2024, no un estándar, y ningún asistente está obligado a leerla. Cuesta una hora y no puede perjudicar, ese es el argumento honesto a su favor.

Qué contiene realmente el archivo
La especificación es corta. El archivo empieza con un encabezado H1, el único elemento que la especificación llama realmente obligatorio. Debajo va una cita en bloque con un resumen breve, después párrafos opcionales de detalle y luego cero o más secciones H2, cada una con una lista de enlaces.
Cada entrada sigue un patrón: un enlace markdown obligatorio con la forma [nombre](url) y, opcionalmente, dos puntos y una nota sobre el archivo. Esa es toda la gramática. El archivo puede estar en la raíz como /llms.txt o en cualquier ruta, cubriendo las páginas por debajo.
Por qué markdown y no XML
La propuesta dice expresamente que usa markdown para estructurar la información en lugar de un formato estructurado clásico como XML, algo inusual en un archivo legible por máquina. El motivo es quién lee. Un sitemap lo lee un rastreador, un llms.txt lo lee un modelo de lenguaje, y un modelo lee markdown de forma nativa mientras que el XML le cuesta tokens sin aportar nada.
Como finalidad, la propuesta cita reunir información concisa de nivel experto en un único lugar accesible, para que un agente no gaste su ventana de contexto recorriendo un menú de navegación. De ahí se deduce qué va dentro: el puñado de páginas que le enseñarías a un desconocido competente, no un volcado de todas tus URL.
| robots.txt | sitemap.xml | llms.txt | |
|---|---|---|---|
| Formato | Directivas de texto | XML | Markdown |
| Lo lee | Rastreadores | Rastreadores | Agentes de IA, voluntariamente |
| Dice | Qué se puede descargar | Qué existe | Qué importa y por qué |
| Se hace cumplir | Ampliamente respetado | Ampliamente respetado | Por nadie |
| Antigüedad | Desde 1994 | Desde 2005 | Propuesto en 2024 |
Lo que encontramos en 187 hosts activos
Auditamos nuestra propia red en julio de 2026, 187 hosts activos en total, y el resultado quedó desequilibrado. llms.txt existía en 6 de ellos. Ningún host bloqueaba un rastreador de IA y 25 de los 187 no servían robots.txt alguno, una carencia de más peso que la falta de llms.txt.
De ahí se siguen dos cosas. La primera es que llms.txt todavía es tan raro que escribirlo no cuesta nada en términos competitivos, no estás alcanzando a nadie. La segunda es el orden del trabajo. Un robots.txt ausente afecta a cada rastreador de la web abierta, un llms.txt ausente afecta a una convención voluntaria propuesta en 2024. Si tienes una hora, dedícala al archivo que se respeta desde 1994.
Los límites honestos
Nadie está obligado a leerlo. No hay buscador que prometa respetarlo, no hay penalización por omitirlo y nadie ha publicado un efecto medible en posiciones. Quien venda llms.txt como factor de posicionamiento en IA vende algo que no existe.
Lo que sí hace es barato y real. Ofrece una declaración limpia y curada de qué es tu sitio y qué páginas importan, en un lugar donde un agente la encuentra sin adivinar. Para una web de empresa con nueve páginas son veinte líneas. Escríbelo una vez, mantenlo honesto y trátalo como un seguro, no como una palanca.
Preguntas y respuestas
¿Mejora llms.txt mi posicionamiento?
¿Dónde va exactamente el archivo?
¿Cuál es el archivo mínimo viable?
¿Debo listar todas las páginas?
Fuentes
- La propuesta llms.txt, llmstxt.org Especificación, estructura y finalidad; versión 2 del 10 de agosto de 2026
- Google Search Central, Google crawlers and user agents Como contraste, sobre lo que controlan realmente las directivas de robots.txt


