llms.txt explicado: qué es y si lo necesitas
llms.txt es un archivo markdown propuesto en la raíz de tu sitio que da a los sistemas de IA un resumen corto y curado de tu contenido clave, similar en espíritu a robots.txt o sitemap.xml, pero para modelos de lenguaje.
Propuesto por Jeremy Howard (Answer.AI) en septiembre de 2024, llms.txt tiene hoy una adopción real pero limitada: miles de sitios publican uno, y OpenAI, Anthropic y Google publican archivos para su propia documentación para desarrolladores, pero todavía no es un requisito que ningún rastreador de IA importante siga de forma confirmada.
Puntuar tu página¿Qué es llms.txt?
llms.txt es un estándar propuesto para un archivo markdown sencillo, colocado en /llms.txt en la raíz de un sitio (o en cualquier subruta), que da a un agente de IA una visión general corta y estructurada de un sitio o una sección de él: qué es el sitio, y una lista curada de enlaces a las páginas que vale la pena leer. La idea resuelve un problema real: una página HTML normal está construida para personas, envuelta en navegación, anuncios y JavaScript, y volver a convertirla en texto limpio que un modelo de IA pueda usar de forma eficiente es costoso e impreciso.
Sigue la convención de nombres de robots.txt y sitemap.xml, un nombre de archivo fijo en una ubicación predecible, pero cumple una función distinta a ambos. robots.txt indica a las herramientas automatizadas a qué pueden acceder. sitemap.xml lista cada página indexable para los motores de búsqueda. llms.txt ofrece en cambio un resumen corto, curado, legible por humanos y máquinas, pensado para leerse bajo demanda, cuando un agente de IA necesita entender un sitio o encontrar algo específico en él, no rastrearse por completo.
La adopción es real pero no universal, y es importante ser preciso sobre qué tipo de adopción existe. Miles de sitios publican ahora un archivo llms.txt, algunas plataformas de documentación generan uno automáticamente, y la herramienta Lighthouse de Chrome audita su presencia como parte de sus comprobaciones de navegación agéntica. OpenAI, Anthropic y Google Gemini publican todos archivos llms.txt para su propia documentación para desarrolladores. Lo que aún no está confirmado es que los rastreadores de IA de propósito general usados para la navegación y el entrenamiento cotidianos, GPTBot, ClaudeBot, PerplexityBot y similares, realmente obtengan y prioricen el contenido de llms.txt de la forma en que los motores de búsqueda respetan de forma fiable robots.txt. El caso de uso más claramente confirmado hoy es el de los agentes de codificación y las herramientas de documentación, que sí siguen los archivos llms.txt para encontrar referencias de API y tutoriales.
Qué hace y qué no hace llms.txt
Un resumen curado, no un rastreo completo
A diferencia de sitemap.xml, que lista todo, llms.txt está pensado para contener solo lo que un agente de IA realmente necesita: una breve descripción más enlaces a las páginas más importantes.
No es una señal confirmada de posicionamiento o citación
Ninguna gran empresa de IA ha confirmado que publicar un archivo llms.txt mejore si tu contenido acaba siendo citado. Trátalo como un archivo de conveniencia para agentes que eligen leerlo, no como una palanca de crecimiento por sí sola.
Un complemento de robots.txt y sitemap.xml, no un sustituto
llms.txt no reemplaza a ninguno de los dos archivos. robots.txt sigue controlando el acceso de los rastreadores, y sitemap.xml sigue listando cada página para los motores de búsqueda. llms.txt añade encima una capa curada y legible por IA.
¿Deberías crear uno?
Poco esfuerzo para crearlo
Un llms.txt mínimo es un archivo markdown corto: un título, un resumen de una línea, y una lista de enlaces a tus páginas más importantes. Lleva mucho menos tiempo que la mayoría del otro trabajo de GEO.
Una apuesta razonable sobre hacia dónde van las cosas
La adopción ha pasado de una propuesta en 2024 a miles de sitios que publican uno y el apoyo de Lighthouse de Chrome en menos de dos años. Publicar uno ahora cuesta poco y te posiciona por delante de cualquier futuro soporte de rastreadores.
El caso más sólido para sitios de documentación y API
El caso de uso más claro y confirmado hoy es el de agentes de codificación leyendo documentación para desarrolladores. Si gestionas documentación, una referencia de API, o un portal para desarrolladores, llms.txt tiene ahora mismo el beneficio más demostrado.
Crea tu llms.txt en 3 pasos
Enumera tus páginas más importantes
Elige las páginas que querrías que un agente de IA leyera primero: tu página de inicio, páginas clave de producto o documentación, y cualquier cosa que explique qué haces.
Escribe el archivo
Empieza con un título H1 y un resumen en cita de una línea, luego añade una lista markdown de enlaces bajo una o más secciones H2. Mantenlo breve. Todo el sentido es que quepa fácilmente en el contexto de un modelo.
Publícalo en /llms.txt y vuelve a comprobar tu GEO Score
Coloca el archivo en la raíz de tu sitio. Luego asegúrate de que las páginas a las que enlaza sean a su vez rastreables, estén bien estructuradas y sean citables. llms.txt solo apunta a un agente hacia tu contenido, no arregla lo que le falta al contenido.
llms.txt — preguntas frecuentes
¿Qué es llms.txt?
llms.txt es un archivo markdown propuesto colocado en la raíz de un sitio (/llms.txt) que da a los agentes de IA un resumen corto y curado del sitio más enlaces a sus páginas más importantes. Fue propuesto por Jeremy Howard de Answer.AI en septiembre de 2024.
¿Realmente usan llms.txt ChatGPT, Claude y Perplexity?
No está confirmado como regla general. OpenAI, Anthropic y Google publican archivos llms.txt para su propia documentación para desarrolladores, y los agentes de codificación siguen de forma fiable los archivos llms.txt para encontrar referencias de API. Pero ninguna gran empresa de IA ha confirmado que su rastreador de propósito general (GPTBot, ClaudeBot, PerplexityBot) obtenga y priorice el llms.txt de un sitio cualquiera durante la navegación o el entrenamiento normales. Trátalo como algo emergente y opcional, no como un requisito confirmado.
¿En qué se diferencia llms.txt de robots.txt?
robots.txt indica a los rastreadores a qué pueden acceder y es un estándar bien establecido y ampliamente respetado. llms.txt en cambio ofrece un resumen curado, legible por humanos y por IA, del contenido clave de un sitio, pensado para leerse bajo demanda en lugar de rastrearse. Cumplen propósitos distintos y están pensados para coexistir.
¿No es esto lo mismo que sitemap.xml?
No. Un mapa del sitio lista cada página indexable, principalmente para motores de búsqueda, y rara vez incluye versiones en markdown adaptadas a la IA de las páginas. llms.txt es deliberadamente corto y curado, un puñado de las páginas más importantes, no una lista exhaustiva.
¿Debería crear un archivo llms.txt para mi sitio?
Es una incorporación de bajo esfuerzo y bajo riesgo, especialmente si gestionas documentación o una referencia de API, donde el caso de uso confirmado (agentes de codificación) ya existe. Para un sitio de marketing general, trátalo como una pequeña incorporación orientada al futuro en lugar de una prioridad por encima de la rastreabilidad, los datos estructurados y la claridad del contenido, que hoy tienen un efecto demostrado en la visibilidad de IA.
¿Qué debe contener un archivo llms.txt válido?
Un H1 con el nombre del sitio o proyecto es la única sección obligatoria. Normalmente le sigue un resumen en cita de una línea, párrafos de contexto opcionales, y una o más secciones con encabezado H2 que contienen una lista markdown de enlaces, cada uno con una breve descripción.
Comprueba si tu sitio está listo para ser citado
Un archivo llms.txt solo ayuda si las páginas detrás de él son realmente rastreables y citables. Primero puntúa tu página en 22 métricas. Cinco comprobaciones por dominio son gratis cada 30 días.
Puntuar tu página