≡En resumen
- llms.txt es un índice en Markdown para agentes de IA: resume tu web y enlaza lo importante. No controla el acceso de ningún bot.
- Google afirma que su buscador no usa llms.txt y que crearlo ni ayuda ni perjudica tu visibilidad, también en AI Overviews.
- Según Ahrefs, el 97 % de los llms.txt publicados no recibió ni una petición en mayo de 2026; quienes más los leen son bots de programación.
- Donde sí aporta es en documentación técnica, APIs y SaaS, que consultan agentes y asistentes de código.
- Para decidir qué IA puede leer tu web, lo que funciona es robots.txt con los user agents de cada plataforma.
01 Qué es llms.txt y para qué sirve
El archivo llms.txt es una propuesta de Jeremy Howard, cofundador de Answer.AI y fast.ai, publicada el 3 de septiembre de 2024. La idea es sencilla: las páginas web están pensadas para personas y llevan menús, scripts, banners y anuncios que a un modelo de lenguaje le sobran. Un llms.txt le ofrece, en un único archivo pequeño, qué es el sitio y dónde está la información que merece la pena leer.
Se escribe en Markdown porque es el formato que mejor entienden los modelos y, a la vez, sigue una estructura fija que un programa puede analizar. En agosto de 2026 la propuesta pasó a una versión 2 que recoge cómo se está usando en la práctica, sobre todo en documentación técnica.
Su hueco natural es el momento de la inferencia, no el del entrenamiento: un asistente de programación que necesita la referencia de una API o un chat con búsqueda que quiere entender un producto. Por eso encaja en el trabajo para aparecer en las respuestas de la IA, lo que se conoce como SEO para LLM o GEO y explicamos en nuestra comparativa de SEO vs GEO, pero es una pieza pequeña de ese trabajo.
02 llms.txt, robots.txt y sitemap.xml: qué hace cada uno
El nombre invita a confundirlo con el archivo robots.txt, pero no tienen nada que ver. Esta tabla resume las diferencias con los dos archivos que ya conoces.
| llms.txt | robots.txt | sitemap.xml | |
|---|---|---|---|
| Para qué sirve | Orientar a agentes de IA con un resumen y enlaces clave | Indicar qué pueden rastrear los bots | Listar las URL indexables para buscadores |
| Formato | Markdown | Texto con directivas User-agent, Allow y Disallow | XML |
| Contenido | Selección curada, puede incluir enlaces externos | Reglas de acceso | Todas las páginas indexables |
| ¿Bloquea bots? | No | Sí, a los bots que lo respetan | No |
| ¿Lo usa Google Search? | No | Sí | Sí |
| Estado | Propuesta comunitaria | Estándar (RFC 9309) | Protocolo sitemaps.org |
03 La especificación de llms.txt paso a paso
La especificación define un orden estricto de elementos. Solo el título es obligatorio; el resto es opcional, pero cuanto mejor lo sigas, más fácil será que un agente lo aproveche.
-
1
Un H1 con el nombre
Una línea que empieza por # con el nombre del proyecto o de la empresa. Es la única sección obligatoria.
-
2
Un resumen en cita
Un bloque que empieza por > con la información esencial para entender el resto del archivo: qué haces, para quién y dónde.
-
3
Detalles opcionales
Párrafos o listas, sin encabezados, con matices útiles: qué no ofreces, zonas de servicio, cómo interpretar los enlaces.
-
4
Secciones con listas de enlaces
Encabezados ## seguidos de listas con el formato [nombre](url): nota opcional. Cada enlace debería llevar a contenido limpio.
-
5
Sección Optional
Por convención, un ## Optional agrupa enlaces secundarios que el agente puede saltarse si va corto de contexto.
04 Plantilla de llms.txt lista para copiar
Esta plantilla está pensada para una empresa de servicios. Sustituye los datos por los tuyos, enlaza solo páginas indexables y actualizadas y mantén el archivo corto: la gracia es que quepa entero en el contexto de un modelo.
# Nombre de tu empresa> Empresa de en desde [año]. Ayudamos a a . Atendemos en y trabajamos en .- No ofrecemos .- Los precios dependen de ; pide presupuesto en la página de contacto.## Servicios- (https://www.tudominio.es/servicio/): qué incluye y para quién es- (https://www.tudominio.es/servicio-2/): resumen en una línea## Empresa- [Quiénes somos](https://www.tudominio.es/quienes-somos/): equipo, experiencia y oficinas- (https://www.tudominio.es/contacto/): teléfono, email y horario## Guías- [Guía principal del sector](https://www.tudominio.es/guia/): la respuesta más completa a la duda más frecuente## Optional- (https://www.tudominio.es/blog/): artículos y novedades
- ✓Guárdalo como texto plano en UTF-8 y sírvelo con código 200 en https://tudominio.es/llms.txt.
- ✓Usa URL absolutas y canónicas, sin parámetros ni redirecciones.
- ✓No enlaces páginas con noindex, bloqueadas en robots.txt o que den error.
- ✓Escribe notas descriptivas: al agente le sirve más «precios y plazos del servicio» que «más información».
- ✓Revísalo cada vez que cambie tu oferta o tu estructura de URL.
- ✓Pruébalo pidiendo a un asistente que responda preguntas sobre tu empresa usando solo ese archivo.
05 Cómo crear un llms.txt en WordPress, Laravel o una web estática
Crear el archivo cuesta poco. Lo que conviene decidir es si lo escribes a mano (mejor control de lo que incluyes) o dejas que un plugin lo genere solo (se actualiza sin esfuerzo, pero puede meter páginas irrelevantes).
WordPress con Yoast SEO
En Yoast SEO, Ajustes, Características del sitio, apartado de herramientas de IA, activa llms.txt. Puedes dejar que elija las páginas de forma automática, priorizando el contenido fundamental y actualizándose cada semana, o seleccionarlas a mano. No está disponible en multisite.
WordPress con Rank Math
Activa el módulo LLMS Txt en el panel de Rank Math y configúralo en Ajustes generales, Editar llms.txt. El archivo se genera de forma dinámica al visitar /llms.txt; eliges qué tipos de contenido incluir.
Web estática o a medida
Sube un archivo llms.txt a la carpeta pública del servidor, junto a robots.txt. Es la opción más simple y la que te da control total sobre cada línea.
Plataformas de documentación
Herramientas como Mintlify o GitBook lo generan automáticamente para los sitios de documentación que alojan, y Wix lo genera para sus webs.
Si tu contenido cambia a menudo, puedes generarlo desde una ruta y cachearlo un día:
Route::get('/llms.txt', function () { $body = Cache::remember('llms-txt', 86400, fn () => view('llms')->render()); return response($body, 200, ['Content-Type' => 'text/plain; charset=UTF-8']);});
La vista llms.blade.php recorre tus servicios y guías publicados y escribe cada enlace con el formato de la especificación. Si el contenido apenas cambia, un archivo en public/llms.txt es suficiente.
En proyectos donde la documentación es parte del producto, como un SaaS o una API, merece la pena ir más allá y publicar también la versión Markdown de cada página. Es el tipo de ajuste que resolvemos en proyectos de desarrollo web a medida, porque exige tocar rutas, plantillas y cabeceras.
06 Qué bots leen llms.txt hoy: lo que dicen los datos
Aquí está la parte que casi nadie cuenta. Ninguna de las grandes plataformas de IA se ha comprometido públicamente a leer llms.txt para sus respuestas. El estudio más amplio publicado hasta ahora es de Ahrefs (junio de 2026): analizó los registros de servidor de 137.000 dominios durante mayo de 2026.
28 %
de los dominios analizados publicaba un llms.txt
Fuente: Ahrefs, junio de 2026
97 %
de esos archivos no recibió ninguna petición en todo el mes
Fuente: Ahrefs, junio de 2026
19,5 %
de las lecturas que sí hubo procedían de herramientas de IA identificadas
Fuente: Ahrefs, junio de 2026
0
peticiones de bots de IA buscando un llms.txt en webs que no lo tienen
Fuente: Ahrefs, junio de 2026
Entre los bots de IA que sí lo leían, los primeros eran GPTBot y Claude-Code, un asistente de programación, por delante de los bots de búsqueda de ChatGPT o Perplexity. Encaja con lo que ha explicado John Mueller, de Google: llms.txt no se hizo para la búsqueda, sino como apoyo temporal para que las herramientas de código ahorren tokens al leer documentación.
07 ¿Ayuda llms.txt a aparecer en ChatGPT o en Google?
Respuesta corta: hoy no hay evidencia de que tener un llms.txt aumente las citas en ChatGPT, Perplexity o los AI Overviews. Google lo dice de forma explícita en su guía para las funciones de IA generativa: su buscador no utiliza estos archivos y crearlos no ayuda ni perjudica. Para ChatGPT no hay declaración oficial, pero los datos de rastreo no muestran que su bot de búsqueda los consulte.
| Acción | Efecto demostrado | Prioridad |
|---|---|---|
| Permitir OAI-SearchBot, PerplexityBot y Claude-SearchBot en robots.txt | Requisito para aparecer en las búsquedas de esas IA | Alta |
| Páginas indexadas, rápidas y con el texto en HTML | Base para que cualquier motor te lea | Alta |
| Respuestas directas, datos con fuente y autoría clara | Mejora la probabilidad de ser citado | Alta |
| Menciones de tu marca en fuentes de terceros | Influye en qué marcas recomiendan las IA | Media-alta |
| Publicar un llms.txt | Sin efecto medido en citas; útil para agentes y documentación | Baja |
Si tu objetivo es salir en las respuestas de ChatGPT, empieza por lo que explicamos en la guía sobre cómo aparecer en ChatGPT y en nuestra guía de SEO para IA. Cuando eso esté resuelto, añadir el llms.txt es un extra barato.
08 robots.txt para IA: lo que sí controla qué bots te leen
Cada plataforma separa sus bots según el uso: entrenar modelos, indexar para su buscador o visitar una página porque un usuario lo ha pedido. Bloquear uno no bloquea los demás, así que puedes, por ejemplo, impedir el entrenamiento y seguir apareciendo en las búsquedas.
| User agent | Plataforma | Para qué se usa |
|---|---|---|
| GPTBot | OpenAI | Recoger contenido para entrenar modelos |
| OAI-SearchBot | OpenAI | Mostrar webs en las búsquedas de ChatGPT |
| ChatGPT-User | OpenAI | Visitas iniciadas por un usuario; OpenAI advierte que robots.txt puede no aplicarse |
| ClaudeBot | Anthropic | Recoger contenido para entrenar modelos |
| Claude-SearchBot y Claude-User | Anthropic | Indexar para búsquedas y visitar páginas a petición del usuario |
| PerplexityBot y Perplexity-User | Perplexity | Mostrar webs en sus resultados y visitar páginas a petición del usuario |
| Google-Extended | Controlar el uso en el entrenamiento de Gemini y en el grounding de Gemini Apps y Vertex AI; no afecta a Google Search |
User-agent: GPTBotDisallow: /User-agent: ClaudeBotDisallow: /User-agent: Google-ExtendedDisallow: /User-agent: OAI-SearchBotAllow: /User-agent: *Allow: /
Antes de bloquear, valora el coste: impedir el entrenamiento no te quita citas hoy, pero bloquear un bot de búsqueda sí te saca de las respuestas de esa IA. OpenAI indica que sus sistemas tardan unas 24 horas en aplicar un cambio en robots.txt.
Revisar qué bots llegan de verdad a tu web, qué bloqueas sin querer y si tus páginas clave son rastreables es una de las comprobaciones que incluimos en una auditoría SEO técnica, junto con el sitemap y los errores de rastreo.
09 Cuándo merece la pena crear un llms.txt
Sí, claramente
Documentación técnica, APIs, librerías, SaaS y productos que usan desarrolladores. Es donde los agentes de código lo leen de verdad.
Opcional
Empresas de servicios, ecommerce y medios. Si tu CMS lo genera con un clic, actívalo y revísalo; no le dediques horas.
No es prioridad
Webs con problemas de indexación, contenido pobre o poca autoridad. Ahí cualquier hora rinde más en SEO técnico y contenido.
Nuestra recomendación como equipo técnico: trátalo como documentación, no como SEO. Si ya tienes bien resueltos los factores SEO on page y una entidad de marca clara, que Google y las IA reconocen gracias a elementos como el Knowledge Panel, añadir un llms.txt cuesta menos de una hora y no tiene riesgos. Lo que no tiene sentido es esperar que sustituya a ese trabajo.
Preguntas frecuentes
Es un archivo en Markdown que se publica en tudominio.com/llms.txt con un resumen de la web y enlaces a su contenido más importante, pensado para que los modelos de lenguaje y los agentes de IA encuentren rápido la información útil.
En la raíz del dominio, igual que robots.txt, para que responda en https://tudominio.es/llms.txt. Desde la versión 2 de la propuesta también puede ir en una subruta, como /docs/llms.txt, y cubre las páginas que cuelgan de ella.
No. Google afirma que su buscador, incluidos los AI Overviews y el Modo IA, no usa llms.txt y que crearlo no ayuda ni perjudica la visibilidad o el ranking.
No. llms.txt no contiene permisos. Para controlar el acceso usa robots.txt con los user agents de cada plataforma, como GPTBot para el entrenamiento u OAI-SearchBot para las búsquedas de ChatGPT.
Es otra forma de llamar al GEO: optimizar tu web y tu marca para que los modelos de lenguaje las encuentren, entiendan y citen. llms.txt es una herramienta menor dentro de ese trabajo, no su base.
No tiene riesgos conocidos si enlaza solo páginas públicas y correctas. El único coste es mantenerlo actualizado para que no apunte a URL que ya no existen o a información antigua.
Cada vez que cambien tus servicios, precios de referencia o estructura de URL. Si lo genera un plugin, revisa igualmente qué páginas incluye cada pocos meses.
Fuentes consultadas
Sobre el autor
Germán Gutiérrez
Development Manager en appyweb
Dirige el equipo de desarrollo de appyweb: aplicaciones web y móviles, SaaS, integraciones y arquitectura de software.
Ver perfil en LinkedIn ↗