Saltar al contenido

llms.txt: guía práctica 2026

Qué es el llms.txt, cómo montarlo paso a paso y hasta qué punto sirve hoy para que los buscadores con IA entiendan tu web.

geo
Pantalla de código mostrando un archivo de texto para rastreadores de inteligencia artificial

El llms.txt es un archivo de texto en formato markdown que colocas en la raíz de tu web (en tudominio.com/llms.txt) para decirle a los modelos de inteligencia artificial qué contenido tuyo es importante y dónde encontrarlo. La idea es sencilla: en vez de obligar a una IA a rastrear tu web entera llena de menús, banners y JavaScript, le entregas un índice limpio de tus páginas clave en el formato que mejor entiende. Es la versión para la era de la IA de algo que ya conoces, el robots.txt, pero con un objetivo distinto.

Llevo años montando posicionamiento orgánico y campañas de pago para pymes, y desde que aparecieron los buscadores con IA me llega esta pregunta cada dos por tres: oye, ¿tengo que poner el famoso archivo ese de las IA? Este artículo es mi respuesta completa y honesta. Te explico qué es el llms.txt, cómo se configura paso a paso, y algo que casi nadie te cuenta: si hoy, en 2026, de verdad sirve para que te citen. Te adelanto que la respuesta tiene matices.

Puntos clave

  • El llms.txt es un índice en markdown que le dice a las IA qué páginas tuyas leer y dónde están, a diferencia del robots.txt, que solo dice qué no rastrear
  • Lo propuso Jeremy Howard, de Answer.AI, el 3 de septiembre de 2024 (Answer.AI), y la especificación vive en llmstxt.org
  • Verdad incómoda: un estudio de Ahrefs sobre 137.210 dominios encontró que el 97% de los archivos llms.txt no recibió ni una sola petición en mayo de 2026 (Ahrefs)
  • Google no lo respalda: John Mueller lo calificó de “puramente especulativo por ahora” y recordó que el archivo lleva años existiendo sin que ningún sistema de IA lo use (Search Engine Journal, junio de 2026)
  • Aun así lo monto en las webs que gestiono, porque cuesta diez minutos, no hace daño y te posiciona para el día en que sí lo lean. Es una apuesta barata, no una bala mágica

Si lo que buscas es el contexto grande de cómo conseguir que las IA te citen, tengo una guía sobre qué es el GEO y cómo funciona que te recomiendo leer antes o después de esta. El llms.txt es una pieza pequeña de ese puzzle, y conviene entender dónde encaja para no venderle a nadie (ni comprarte a ti) que un archivo de texto te va a meter en ChatGPT.

Qué es el llms.txt exactamente

El llms.txt es un archivo markdown pensado para que un modelo de lenguaje entienda tu web de un vistazo. El problema que intenta resolver es concreto: las IA tienen una ventana de contexto limitada, o sea, solo pueden leer una cantidad de texto de golpe. Una web moderna, con su HTML, su navegación, sus anuncios y su código, es ruidosa y pesada para una máquina que solo quiere el contenido. El llms.txt le da ese contenido masticado.

La diferencia con lo que ya conoces la explica bien la propia especificación. El robots.txt le dice a un rastreador qué no puede leer. El sitemap enumera todas tus URL sin distinguir importancia. El llms.txt hace algo distinto: le dice a la IA qué debería leer, y en el formato que lee mejor, que es markdown. Es la diferencia entre darle a alguien una llave maestra de todo el edificio o entregarle un plano con las tres salas que de verdad le interesan.

El término y la propuesta no me los invento yo. Los publicó Jeremy Howard, cofundador de Answer.AI y una figura muy respetada en el mundo del machine learning, el 3 de septiembre de 2024. Que la idea venga de alguien así, y no de una agencia de marketing vendiendo humo, es un punto a favor de que hay lógica técnica detrás. Otra cosa es que el sector la haya adoptado, y ahí es donde la historia se complica.

Cómo se ve un archivo llms.txt

Antes de montarlo conviene ver la pinta que tiene, porque es más simple de lo que la palabra “especificación” sugiere. La estructura básica que define llmstxt.org es esta:

# Nombre de tu negocio

> Una frase que resume a qué te dedicas y qué ofreces.

Un párrafo corto de contexto opcional para orientar al modelo.

## Servicios

- [Consultor SEO](https://tudominio.com/consultor-seo/): posicionamiento orgánico para pymes
- [Consultor GEO](https://tudominio.com/consultor-geo/): visibilidad en buscadores con IA

## Contenido

- [Guía de Google Ads](https://tudominio.com/blog/google-ads-pymes/): estrategia completa
- [Qué es el SEO](https://tudominio.com/blog/que-es-el-seo/): fundamentos para negocios

## Contacto

- [Contacto](https://tudominio.com/contacto/): cómo trabajar conmigo

Nada más. Un título con el nombre, una cita con el resumen, y secciones con enlaces markdown donde cada enlace lleva una descripción breve detrás de los dos puntos. Esa descripción es la parte importante, porque es la que le dice al modelo de qué va cada página sin que tenga que abrirla. La especificación también contempla una versión ampliada, el llms-full.txt, que en vez de enlazar incluye el texto completo de tus páginas en un solo archivo, pensado para que la IA lo trague entero.

Cómo configurar tu llms.txt paso a paso

Montar un llms.txt bien hecho lleva menos de lo que crees. Estos son los pasos que sigo yo.

1. Elige tus páginas clave. No metas todo. El sentido del archivo es la curaduría, así que selecciona las 10 o 20 páginas que de verdad definen tu negocio: servicios, guías potentes, página de contacto. Si vuelcas tu web entera, pierdes la ventaja de darle a la IA lo importante filtrado.

2. Escribe una descripción clara para cada enlace. Una frase por página que explique qué encuentra ahí quien la lea. Aquí es donde muchos fallan: copian el título y ya. Piensa que esa línea es tu resumen ante una máquina que decide si le merece la pena leerte.

3. Crea el archivo y súbelo a la raíz. Tiene que quedar accesible en tudominio.com/llms.txt, con la extensión .txt aunque el contenido sea markdown. En una web estática lo pones como archivo. En un CMS o un framework como Astro, lo habitual es generarlo con una ruta dinámica que lo construya a partir de tus páginas, así se mantiene solo cuando publicas contenido nuevo. En esta web, por ejemplo, lo genero de forma automática para no tener que tocarlo a mano cada vez.

4. Compruébalo. Abre tudominio.com/llms.txt en el navegador y verifica que se sirve como texto plano y que los enlaces son absolutos y funcionan. Existen validadores online que confirman que cumple la estructura de llmstxt.org.

5. No bloquees a los agentes. Esto es lo que más se olvida. De poco sirve el llms.txt si tu robots.txt o tu firewall bloquean a GPTBot, ClaudeBot y compañía. Como dice Mueller, la optimización agéntica más básica es no bloquear a los agentes. Revisa que tu web deja pasar a los rastreadores de IA que te interesan.

La verdad incómoda: hoy casi nadie lo lee

Aquí es donde me toca ser honesto, porque prefiero que te enfades conmigo ahora a que me pagues por decorar tu web. A día de hoy, mediados de 2026, el llms.txt apenas se usa.

El dato más demoledor lo publicó Ahrefs. Analizaron los registros de servidor de 137.210 dominios con tráfico en mayo de 2026 y encontraron que el 97% de los archivos llms.txt no recibió ni una sola petición (Ahrefs). De los cerca de 38.000 dominios con un archivo válido, solo unos 1.100 recibieron alguna visita. Y de ese puñado que sí tuvo tráfico, buena parte venía de herramientas de la propia industria estudiándose a sí misma (comprobadores de llms.txt, herramientas de GEO) más que de IA de verdad leyéndolo para responder a un usuario.

Google tampoco ayuda. John Mueller, de su equipo de búsqueda, lo despachó en junio de 2026 con una frase que lo resume todo: nadie sabe si sirve, es puramente especulativo por ahora, el archivo lleva años existiendo y ningún sistema de IA lo usa (Search Engine Journal). Lo comparó con la vieja etiqueta meta keywords, esa que los buscadores llevan más de una década ignorando porque la controla el dueño de la web y se presta a manipulación. Ni OpenAI, ni Anthropic, ni Perplexity documentan el llms.txt como una señal que suba tus opciones de que te citen.

Sí es cierto que la adopción crece. El mismo estudio de Ahrefs vio que cerca del 28% de los dominios ya publica uno, y cuando alguna IA sí lo lee, el rastreador que más aparece es GPTBot de OpenAI, seguido de Claude-Code de Anthropic. Pero una cosa es que unos pocos bots de herramientas para desarrolladores lo lean y otra muy distinta es que aparecer en él te meta en las respuestas que ChatGPT le da a tu cliente.

Entonces, ¿lo pongo o no?

Mi recomendación después de ver los datos es esta: sí, ponlo, pero con las expectativas en su sitio.

Lo monto en las webs que gestiono por tres razones. Primera, cuesta muy poco: si lo generas de forma automática, son diez minutos de trabajo una sola vez y se mantiene solo. Segunda, no hace daño: no penaliza en Google, no rompe nada, no compite con tu SEO. Tercera, y la más importante, es una apuesta barata sobre el futuro. El estándar existe, tiene lógica y algunos actores empiezan a mirarlo. El día que un buscador de IA que te trae clientes decida usarlo, ya lo tendrás puesto sin haber hecho un esfuerzo extra.

Lo que no voy a hacer es venderte que el llms.txt te va a posicionar en ChatGPT, porque hoy no hay ni un dato que lo respalde. Si alguien te cobra una fortuna por “optimizar tu llms.txt” prometiéndote citas en la IA, desconfía. El trabajo de verdad para que te citen está en otro sitio: contenido claro que responda preguntas concretas, autoridad, y que tu web sea rastreable. De eso hablo en mi guía sobre cómo aparecer en ChatGPT search y en la de cómo aparecer en las AI Overviews de Google. El llms.txt es la guinda, no el pastel.

llms.txt, robots.txt y sitemap: quién hace qué

Como los tres son archivos en la raíz de tu web y suenan parecido, conviene tener claro que no compiten, hacen cosas distintas:

  • robots.txt: le dice a los rastreadores qué partes de tu web no deben rastrear. Es una prohibición.
  • sitemap.xml: enumera todas tus URL para que los buscadores no se dejen ninguna. Es un inventario completo.
  • llms.txt: le señala a las IA qué contenido es el importante y en qué formato leerlo. Es una recomendación curada.

Los tres pueden convivir. De hecho lo ideal es que convivan: el robots.txt para controlar el acceso, el sitemap para que Google lo indexe todo, y el llms.txt como cortesía hacia los modelos de IA por si algún día lo aprovechan.

Preguntas frecuentes

¿El llms.txt mejora mi posicionamiento en Google? No. Google ha dicho de forma explícita que no lo usa para clasificar. Tu SEO en Google depende de otras cosas (contenido, enlaces, experiencia técnica), no de este archivo.

¿Dónde va exactamente el archivo? En la raíz del dominio, accesible en tudominio.com/llms.txt. Siempre en la raíz, no en una subcarpeta.

¿Necesito también el llms-full.txt? No es obligatorio. El llms.txt con enlaces es el estándar base. El llms-full.txt, con el texto completo volcado, es opcional y tiene sentido sobre todo en webs de documentación técnica.

¿Cada cuánto lo actualizo? Si lo generas de forma automática a partir de tus páginas, se actualiza solo. Si lo mantienes a mano, revísalo cuando publiques contenido importante nuevo.

Lo monto por ti, con las expectativas claras

El llms.txt es una de esas cosas que conviene tener puestas, entendiendo que hoy es una apuesta a futuro y no un interruptor mágico de visibilidad en IA. Si quieres que revise tu web, monte el archivo bien hecho y de paso me asegure de que no estás bloqueando a los rastreadores de IA que te interesan, cuéntame tu caso en la página de contacto o mira cómo trabajo la visibilidad en buscadores con IA en mi página de consultor GEO. Te digo con datos lo que mueve la aguja y lo que es pura decoración.

Raúl Veneri
Raúl Veneri · Consultor de Agentic Marketing en Málaga

Consultor independiente. Automatizo SEO, GEO, campañas SEM y tracking con agentes IA. Ayudo a negocios a escalar su marketing sin multiplicar el equipo ni depender de intermediarios.