llms.txt: qué es, si lo necesita y cómo crearlo
Sergey Carp de Damasco, Cofundador / CTO
Recibimos la misma pregunta en casi todas las auditorías de visibilidad en IA: «Nos han dicho que necesitamos un archivo llms.txt. ¿Qué es? ¿Es cierto que sin él la IA no ve nuestro sitio web?». Es una pregunta razonable. Se presenta llms.txt como un interruptor mágico para aparecer en ChatGPT, los generadores de llms.txt en línea prometen un archivo listo en un minuto y cuesta encontrar información sólida y práctica.
La respuesta corta: llms.txt es una tarjeta de presentación en texto plano de su sitio web, escrita para los grandes modelos de lenguaje. Es útil, pero no es magia. A continuación explicamos qué es el archivo, de dónde viene, qué incluir en él, en qué se diferencia llms-full.txt, si conviene fiarse de los generadores, cómo publicar el archivo en WordPress, Shopify, Webflow, Wix, Squarespace o en su propio hosting y cómo comprobar que funciona.
Lo esencial
llms.txt es un resumen en texto plano de su sitio para la IA. Añadirlo es barato y seguro, pero no garantiza nada y solo sirve si los rastreadores de IA acceden a su sitio.
Lo primero: cómo lee la IA su sitio web
Cuando alguien pregunta a ChatGPT, Perplexity, Gemini o Claude «qué CRM es mejor para un equipo de ventas pequeño», recibe una respuesta de la IA: un texto coherente y ya elaborado, con recomendaciones y, a menudo, enlaces a los sitios web de los que procede la información. En Google, una respuesta similar aparece como AI Overview (en la interfaz en español, «Resumen creado con IA») por encima de los resultados normales; en los asistentes conversacionales, aparece en la conversación con citas. Muchas personas nunca miran más allá de esa respuesta.
Para redactarla, la IA encuentra páginas relevantes, las abre y extrae su sentido. Una página web típica resulta incómoda para una máquina: menús de navegación, banners, ventanas emergentes, scripts y bloques repetidos. El único dato que importa queda enterrado entre elementos de la plantilla, y el modelo dispone de un tiempo limitado y de una cantidad limitada de texto que puede procesar. De ahí surgió la idea: darle al modelo un resumen limpio.
¿Qué es llms.txt?
Un archivo llms.txt es un sencillo documento de texto escrito en Markdown. Se ubica en la raíz de su sitio web y se abre en una dirección como example.com/llms.txt. En su interior explica brevemente qué es la empresa o el proyecto y enumera enlaces a las páginas más importantes, cada uno con una descripción de una línea. La idea es sencilla: un modelo de lenguaje no tiene que averiguar cómo está estructurado su sitio web, porque todo lo importante está reunido en un solo lugar.
El formato se propuso en 2024 como iniciativa abierta. Aquí es importante ser claros: llms.txt no es un estándar oficial, y los principales proveedores de IA no han confirmado oficialmente que lo utilicen al generar respuestas. El archivo no garantiza que ChatGPT le cite ni que aparezca en Google AI Overviews, y cualquier proveedor que se lo prometa le está engañando.
Entonces, ¿por qué lo creamos igualmente para nuestros clientes?
- Es barato. Un buen archivo para una empresa de servicios lleva una o dos horas.
- Es seguro. El archivo no interfiere con nada ni afecta a la indexación normal.
- Obliga a ser claros. Para escribir un llms.txt hay que responder a «quiénes somos, qué vendemos, qué páginas importan más». Muchas empresas no tienen esas respuestas por escrito.
- Algunas herramientas ya lo leen. Los asistentes de IA para programación y los agentes que navegan por sitios web pueden usarlo. Si los principales buscadores con IA empiezan a tenerlo en cuenta, usted ya lo tendrá preparado.
llms.txt frente a robots.txt y sitemap.xml
Estos archivos se confunden a menudo, pero cumplen funciones distintas.
| Archivo | Destinatarios | Qué hace | Estado |
|---|---|---|---|
| robots.txt | Todos los rastreadores | Indica a los rastreadores a qué partes del sitio pueden acceder y a cuáles no | Estándar ampliamente aceptado |
| sitemap.xml | Rastreadores de los buscadores | Enumera las páginas que quiere que se indexen | Estándar ampliamente aceptado |
| llms.txt | Modelos de lenguaje y agentes de IA | Explica el sentido: quién es usted y qué páginas importan más | Formato propuesto, sin confirmación oficial de los principales proveedores de IA |
| llms-full.txt | Modelos de lenguaje y agentes de IA | Ofrece el texto completo del contenido clave en un solo archivo | Extensión del mismo formato |
Lo esencial: llms.txt no permite ni bloquea nada. Si robots.txt o la protección contra bots de su servidor dejan fuera a los rastreadores de IA, un llms.txt perfectamente redactado no sirve de nada, porque nadie llegará nunca a él. Primero abra el acceso; explicamos cómo en nuestra guía sobre GPTBot, ClaudeBot, PerplexityBot y otros rastreadores de IA.
Qué incluir en un archivo llms.txt
El formato está pensado para que resulte igual de fácil de leer para las personas y para las máquinas. La estructura básica es la siguiente:
- Un encabezado de primer nivel con el nombre de la empresa o del proyecto. Es el único elemento obligatorio.
- Un resumen en forma de cita (blockquote) de una a tres líneas: a qué se dedica, para quién y dónde.
- Un breve párrafo de datos: año de fundación, zona de servicio, condiciones clave.
- Secciones de segundo nivel como Servicios, Precios, Sobre nosotros, Preguntas frecuentes y Contacto.
- Enlaces dentro de cada sección: título de la página, URL y una línea sobre lo que contiene esa página.
- Una sección Optional para las páginas secundarias que pueden omitirse cuando el espacio es limitado.
Ejemplo de llms.txt
A continuación, un ejemplo hipotético para una empresa ficticia de climatización comercial. El nombre de la empresa, las URL y las condiciones son inventados. Sustitúyalos por sus propios datos, tomados de una única ficha de datos verificada sobre su empresa.
# NorthAir HVAC
> Diseño e instalación de sistemas de ventilación y aire acondicionado para restaurantes, cafeterías y oficinas. Al servicio del área metropolitana desde 2010.
Visita técnica de evaluación gratuita. Instalación llave en mano con 3 años de garantía sobre la mano de obra. Los precios del sitio web no incluyen los equipos.
## Servicios
- [Ventilación para restaurantes](https://example.com/services/restaurant-ventilation): diseño, instalación, permisos, plazos y precios
- [Aire acondicionado para oficinas](https://example.com/services/office-air-conditioning): selección de equipos, instalación, mantenimiento
- [Planes de mantenimiento](https://example.com/services/maintenance): calendario de servicio, precios del contrato, avisos de emergencia
## Precios
- [Lista de precios](https://example.com/pricing): costos de diseño e instalación según la superficie
## Sobre nosotros
- [Quiénes somos](https://example.com/about): licencias, equipo, año de fundación
- [Proyectos](https://example.com/projects): instalaciones realizadas con fotos y detalles del proyecto
## Preguntas frecuentes
- [Preguntas frecuentes](https://example.com/faq): si necesita un proyecto, cuánto tarda la instalación, qué cubre la garantía
## Contacto
- [Contacto](https://example.com/contact): dirección de la oficina, teléfono, horario de atención
## Optional
- [Blog](https://example.com/blog): artículos sobre cómo elegir equipos y requisitos normativos para restaurantes
Fíjese en lo que falta en este ejemplo. Nada de eslóganes como «líder del sector» o «la mejor calidad». Ninguna lista de todas y cada una de las páginas, porque para eso está sitemap.xml. Ni páginas de servicio, ni carrito de compra, ni área de cliente. Solo lo necesario para entender la empresa y responder a las preguntas de un cliente.
Las reglas que más se incumplen
- los enlaces apuntan a URL canónicas con HTTPS, sin parámetros UTM ni redirecciones;
- los datos coinciden con su sitio web, las fichas de mapas y los directorios: los mismos precios, las mismas direcciones, el mismo nombre de empresa;
- la descripción de cada enlace explica qué contiene la página en lugar de repetir su título;
- el archivo se guarda en UTF-8; de lo contrario, las letras acentuadas y los caracteres especiales se convierten en símbolos ilegibles;
- el archivo se actualiza junto con el sitio web: nuevos precios o un nuevo servicio implican actualizar el llms.txt.
llms-full.txt: cuándo necesita la versión completa
El formato tiene una extensión llamada llms-full.txt. Si llms.txt es un índice con enlaces, llms-full.txt es el propio contenido: el texto de sus páginas clave reunido en un único documento Markdown. El modelo no necesita seguir enlaces, porque todo está ya dentro.
Esta versión se diseñó originalmente para la documentación de software, donde un desarrollador o un asistente de IA para programación necesita cargar de una vez toda una referencia de API. Una empresa de servicios típica la necesita con menos frecuencia. Tiene sentido cuando:
- tiene un producto complejo con documentación, guías, planes y limitaciones;
- el contenido importante está repartido en muchas páginas cortas que pierden sentido por separado;
- su sitio web tiene una base de conocimientos técnica en la que se apoyan los clientes.
El principal riesgo de llms-full.txt es que se quede desactualizado. Es una segunda copia de su contenido y, a menos que se regenere automáticamente cada vez que cambia el sitio web, en un par de meses contendrá precios antiguos. Para el sitio web de una empresa típica, basta con un llms.txt bien elaborado.
Generadores de llms.txt: ahorran tiempo, pero no sustituyen al criterio
Existen generadores de llms.txt en línea, plugins para CMS y scripts que rastrean un sitio web y crean el archivo automáticamente. Un generador le ayuda a obtener un primer borrador rápido, sobre todo en un sitio grande. Pero el resultado automático tiene problemas previsibles:
- Todo acaba en el archivo. Etiquetas, filtros, paginación y archivos de noticias: un generador no sabe qué importa para su negocio.
- Las descripciones salen de las metaetiquetas. Si sus meta descriptions se escribieron para los buscadores hace años, eso es lo que acaba en el llms.txt.
- Faltan los datos de la empresa. Un generador no conocerá su zona de servicio, sus condiciones ni su año de fundación, y si los adivina, es aún peor.
- El archivo nunca se actualiza. Una exportación puntual se aleja del sitio web en cuestión de meses.
Nuestro enfoque: en sitios web grandes usamos un generador para el primer borrador; después conservamos los 15–40 enlaces que realmente importan, redactamos a mano el resumen y los datos y los contrastamos con la ficha de datos de la empresa.
Cómo añadir llms.txt a su sitio web
El archivo debe abrirse exactamente en example.com/llms.txt, no en una subcarpeta ni en un subdominio. Cómo llevarlo hasta ahí depende de su plataforma.
Sitio web a medida en su propio hosting o servidor
Suba el archivo al directorio raíz del sitio web, el mismo lugar donde está robots.txt, mediante SFTP, SSH o el administrador de archivos de su proveedor de hosting. Si su sitio funciona con un framework que tiene un directorio público separado, coloque el archivo ahí. Después asegúrese de que sus reglas de enrutamiento y su capa de caché sirven el archivo tal cual, en lugar de interceptar la solicitud y devolver una página 404 con diseño.
WordPress
En WordPress autoalojado normalmente tiene acceso al directorio raíz a través de su cuenta de hosting, así que puede subir directamente un archivo terminado. También hay plugins que generan llms.txt; si utiliza uno, revise el resultado con las mismas reglas que cualquier otro generador. En los planes de WordPress gestionado o alojado, el acceso a los archivos de la raíz puede estar restringido, así que compruebe qué permite su plan.
Shopify, Wix, Squarespace y Webflow
Los creadores de sitios web alojados y las plataformas de comercio electrónico no suelen darle acceso directo al directorio raíz, y lo que es posible depende de la plataforma, de su plan y de ajustes que cambian con el tiempo. Empiece por consultar la documentación actual o los ajustes de la plataforma para ver si hay alguna forma de añadir un archivo personalizado o una ruta personalizada en la raíz de su dominio. Si no la hay, las soluciones alternativas habituales son:
- servir el archivo a través de una CDN o un proxy inverso situado delante de su dominio que devuelva llms.txt en la dirección raíz;
- redirigir /llms.txt a una copia alojada en otro lugar, algo más sencillo pero menos fiable, porque no todas las herramientas siguen las redirecciones;
- utilizar una aplicación o integración del marketplace de la plataforma, si existe, y comprobar qué publica realmente.
La opción adecuada depende de cómo esté configurado su proyecto, así que conviene decidirla junto con quien gestiona su sitio web y su dominio.
llms.txt y robots.txt: ¿hay que hacer referencia a él?
No. No existe ninguna directiva especial de robots.txt para llms.txt. El archivo se encuentra en su dirección estándar, igual que el propio robots.txt se encuentra en example.com/robots.txt. Aun así, abra su robots.txt y compruebe dos cosas. Primero, que no bloquea a los rastreadores de IA que quiere que lleguen a su sitio web. Segundo, que no contiene una regla general que bloquee los archivos .txt, algo que a veces aparece en plantillas antiguas.
llms.txt y SEO: ¿influye en el posicionamiento?
Ningún buscador ha confirmado que use llms.txt como señal de posicionamiento, y no sustituye a robots.txt, sitemap.xml ni al marcado Schema. Considérelo una pequeña pieza de apoyo del posicionamiento en IA, más que una táctica de SEO. Lo que sí puede hacer es ofrecer a las herramientas de IA un resumen limpio y exacto de su empresa. Lo que no puede hacer es convertir un sitio web débil en uno sólido.
Comprobador de llms.txt: cómo verificar que funciona
Los comprobadores y validadores de llms.txt en línea pueden confirmar que el archivo sigue el formato. No pueden decirle si el contenido es exacto o útil. Tras publicarlo, repase usted mismo esta breve lista de comprobación:
- example.com/llms.txt se abre en una ventana de incógnito del navegador, sin inicios de sesión ni redirecciones;
- el servidor devuelve un código de estado 200 (puede verlo en la pestaña Red de las herramientas para desarrolladores de su navegador);
- el archivo se muestra como texto plano, los caracteres se ven correctamente y el navegador no intenta descargarlo;
- cada enlace del archivo se abre y devuelve un código de estado 200;
- su firewall, su CDN o su protección contra bots no bloquean las solicitudes de los rastreadores al archivo, algo que puede confirmar en los registros del servidor;
- tras la publicación, los registros del servidor muestran qué bots han solicitado el archivo.
Este último punto es la única forma honesta de saber si alguien lee su llms.txt. Preguntarle a un asistente de IA «¿has leído mi llms.txt?» no tiene sentido: su respuesta no demuestra nada.
Lo que llms.txt hace y lo que no hace
Seamos realistas. El archivo por sí solo no hará que su empresa aparezca en las respuestas de la IA. Si su sitio web no tiene páginas que respondan directamente a las preguntas de los clientes, si el contenido solo se carga mediante scripts, si nadie escribe sobre su empresa en sitios de terceros, llms.txt no cambiará nada. Los asistentes de IA se basan principalmente en la búsqueda, el contenido de las páginas y la autoridad de las fuentes. El GEO (optimización para motores generativos) se construye sobre el buen SEO de siempre, no sobre un conjunto de archivos técnicos.
Sin embargo, combinado con el resto del trabajo, llms.txt se convierte en un detalle útil: un resumen limpio de datos que coincide con su sitio web, su marcado Schema y las fuentes de terceros. Puede ver dónde encaja en el panorama general en nuestro checklist de posicionamiento en IA.
Cómo creamos llms.txt y todo lo que lo rodea
En Posicionamiento en IA hacemos SEO desde 2002. Tenemos más de 100 clientes en todo el mundo, certificaciones de Google y Yandex y un solo equipo que se ocupa de su sitio web y de su visibilidad en IA de principio a fin. Trabajamos con empresas en Damasco y en mercados internacionales.
Redactamos y publicamos el llms.txt como parte de las mejoras técnicas del sitio web, pero es solo una tarea entre muchas. El servicio incluye:
- una auditoría de visibilidad en IA de su sitio web y de las respuestas de la IA en su sector;
- investigación de prompts: las preguntas que sus clientes hacen a los asistentes de IA;
- mejoras técnicas: acceso de los rastreadores de IA, llms.txt, marcado Schema, velocidad, corrección de errores;
- nuevo contenido pensado para las respuestas de la IA;
- menciones de marca en sitios de terceros;
- publicación de artículos en fuentes externas para construir la autoridad de su empresa y de sus expertos;
- seguimiento continuo de la visibilidad en IA.
La IA evalúa su sitio web en conjunto, así que nos ocupamos del sitio completo desde el primer día, desde las mejoras técnicas hasta el GEO. Garantizamos la ejecución de las tareas de GEO, la corrección de errores y la rápida adaptación de su sitio web a los cambios en los requisitos de la búsqueda con IA. No prometemos una posición en las respuestas de la IA: nadie puede prometerlo honestamente.
La tarifa mensual es de 290 USD al mes, con las primeras 10 horas de trabajo incluidas. Cada hora adicional cuesta 45 USD. El trabajo de GEO se factura por horas trabajadas: solo facturamos el trabajo realizado y entregado ese mes. Sin descuentos ni meses gratuitos.
Agende una llamada. Comprobaremos si los rastreadores de IA pueden llegar a su sitio web, crearemos un archivo llms.txt a partir de datos verificados y le mostraremos qué más le impide aparecer en las respuestas de la IA.