llms.txt: qué es y cómo añadirlo en WordPress
llms.txt es un mapa en Markdown de tu sitio para asistentes de IA. Qué hace realmente en 2026, qué no, y cómo publicarlo en WordPress con un solo clic.
Cada pocos meses aparece un archivo nuevo que promete dejar tu sitio “listo para la IA”. La mayoría es ruido. Aun así, llms.txt merece que lo entiendas: no porque sea magia, sino porque es barato, honesto y apunta hacia donde va la web. Añadí uno a mis propios sitios la semana en que apareció la idea, observé qué lo descargaba de verdad, y te voy a contar sin adornos qué hizo y qué no hizo. Después te muestro la forma de publicar el tuyo en WordPress con un solo clic.
Lo esencial
- llms.txt es una propuesta comunitaria (Answer.AI, septiembre de 2024), no un estándar del W3C ni del IETF. Ninguna empresa de IA está obligada a respetarlo.
- Es un archivo Markdown en
tusitio.com/llms.txt: el título del sitio, un resumen de una línea y luego una lista curada de tus páginas clave con descripciones cortas. - La adopción ronda el 5–15 % de los sitios técnicos y de documentación en 2026, y aproximadamente el 97 % de los llms.txt publicados no recibe ninguna petición de IA; trátalo como una apuesta de futuro, no como una palanca de tráfico.
- Los usuarios más claros hoy son los asistentes de programación (Cursor, Continue, Cline) y las herramientas de agentes; Anthropic confirmó su soporte y Perplexity lo recupera, mientras que OpenAI y Google siguen remitiendo a robots.txt.
- En Blaminhor Essentials se genera en vivo a partir de tu contenido, se cachea 12 horas, se sirve como texto plano con noindex y lista hasta 100 entradas recientes por tipo de contenido, excluyendo todo lo que marcaste como noindex.
¿Qué es llms.txt, exactamente?
llms.txt es un archivo curado, con formato Markdown, que le dice a un modelo de lenguaje de qué trata tu sitio y qué páginas importan más. Piensa en él como una recepción amable para máquinas: en vez de obligar a una IA a rastrear y adivinar, le entregas un resumen de una página—el nombre de tu sitio, una frase de contexto y una lista ordenada de enlaces con descripciones cortas.
El formato es simple a propósito. Un encabezado de primer nivel con el nombre de tu sitio, una cita opcional que resume lo que haces, y luego secciones (una por tipo de contenido) que listan páginas como enlaces Markdown, cada una con una nota breve. Eso es todo. Un humano lo lee en diez segundos; un modelo también, y mucho más barato que analizar tu sitio entero.
La idea viene de Jeremy Howard, cofundador de Answer.AI, que publicó la propuesta en septiembre de 2024. Su razonamiento era práctico: la ventana de contexto de un LLM es pequeña y cara, y las páginas HTML crudas están llenas de navegación, scripts y relleno que la desperdician. Un mapa limpio en Markdown permite que el modelo gaste su atención en tu contenido de verdad.
¿Es llms.txt lo mismo que robots.txt o un sitemap?
No: los tres hacen trabajos distintos, y llms.txt es el único que va de invitación, no de inventario ni de permiso. Conviven lado a lado, y un sitio bien llevado puede tener los tres.
Esta es la diferencia, sin rodeos. robots.txt es un portero: dice qué rastreadores pueden entrar y qué pasillos están vetados. sitemap.xml es una guía telefónica: todas tus URL, listadas exhaustivamente para máquinas, sin ningún criterio editorial. llms.txt es un conserje: un “esto es lo que vale tu tiempo” corto y elegido a mano, escrito para un lector que piensa en lenguaje, no en XML.
| Archivo | Propósito | Audiencia | ¿Curado? |
|---|---|---|---|
| robots.txt | Permisos: quién puede rastrear qué | Todos los rastreadores | No (solo reglas) |
| sitemap.xml | Lista exhaustiva de todas las URL | Rastreadores de buscadores | No (todo) |
| llms.txt | Un mapa legible de tu mejor contenido | Asistentes de IA, agentes | Sí |
Esa columna de “curado” es todo el punto. Tu sitemap puede tener 4.000 URL; tu llms.txt debería tener las veinte páginas que de verdad querrías que un asistente citara.
¿ChatGPT lee realmente llms.txt en 2026?
¿Con honestidad? En su mayoría no—al menos no para visibilidad en búsqueda, y prefiero decírtelo antes que venderte un mito. En 2026, ningún gran proveedor de IA se ha comprometido a usar llms.txt en búsqueda en producción. OpenAI y Google recomiendan robots.txt para el control de rastreadores, y Google aclaró en junio de 2026 que llms.txt no es necesario para Search.
La realidad medida es aleccionadora. En un estudio de 90 días, los archivos llms.txt atrajeron alrededor del 0,1 % de todo el tráfico de rastreadores de IA; otro encontró que aproximadamente el 97 % de los llms.txt publicados no recibió ni una sola petición de IA. Si alguien te promete posicionamiento gracias a un llms.txt, va por delante de la evidencia.
Entonces, ¿quién sí lo usa? Dos grupos. Primero, las herramientas de programación y de agentes: Cursor, Continue, Cline y varias integraciones MCP leen llms.txt para entender un proyecto o un sitio de documentación. Segundo, un par de motores de respuestas empiezan a moverse: Anthropic ha confirmado públicamente su soporte, y Perplexity dice que recupera llms.txt para ayudarse a priorizar qué páginas mirar.
¿Cómo añades llms.txt a WordPress?
En WordPress no escribes ni subes un llms.txt a mano: dejas que el módulo SEO genere uno desde tu contenido publicado y lo sirva en la raíz. Con Blaminhor Essentials instalado, es un interruptor más dos decisiones. Paso a paso:
- Activa el módulo SEO y abre su pestaña GEO / AEO, la misma que gestiona el control de rastreadores de IA y los datos estructurados.
- Marca “Enable llms.txt”. En cuanto guardas, el archivo está en vivo en
https://tusitio.com/llms.txt; la pantalla de ajustes muestra el enlace para que lo abras en otra pestaña y lo compruebes. - Elige tus tipos de contenido. Decide qué tipos de entrada pertenecen al mapa—normalmente entradas y páginas, más productos o un portafolio si son tu sustancia. Cada tipo se convierte en su propia sección.
- Escribe un resumen del sitio (Site Summary). Una o dos frases que describan de qué trata tu sitio. Se convierte en la cita del principio: lo primero que lee un modelo. Si lo dejas vacío, se usa el lema de tu sitio en su lugar.
No hay ningún archivo físico que mantener. Una regla de reescritura responde /llms.txt al vuelo, así que el mapa siempre está al día: publicas una entrada y aparece, la despublicas y desaparece. Todo lo que hayas marcado como noindex queda fuera, exactamente igual que en tu sitemap, para que las dos superficies nunca se contradigan.
Un interruptor publica un llms.txt en vivo; tú eliges los tipos de contenido y escribes un resumen de una línea.
¿Qué contiene un buen llms.txt?
Un buen llms.txt es corto, curado y se explica solo: el nombre de tu sitio, una línea de contexto y tus páginas genuinamente útiles, cada una con una frase que se sostiene por sí misma. El generador sigue la especificación: un H1 con el nombre de tu sitio, una cita con el resumen, y luego secciones ## por tipo de contenido que listan hasta las 100 entradas actualizadas más recientemente, cada una como enlace con una descripción recortada a 25 palabras tomada de tu extracto o tu contenido.
También añade al final una sección Optional que enlaza a tu sitemap XML—la forma que tiene la especificación de decir “aquí está el índice exhaustivo si quieres más”. El resultado se lee como el índice que escribiría un editor cuidadoso, no como un volcado de base de datos. Si solo recuerdas una regla: llms.txt es donde eres selectivo. Tu sitemap es donde eres completo.
Esto es lo que vi después de publicar el mío
Lo activé en un puñado de sitios y luego hice lo aburrido y honesto: mirar los logs. Durante semanas, el archivo quedó casi intacto—las cifras de adopción de arriba no son abstractas, coincidían con lo que yo veía. Las peticiones que sí llegaron venían sobre todo de herramientas de agentes y de alguna descarga ocasional de Perplexity, no de una avalancha de tráfico de ChatGPT.
¿Lo desactivé? No. Publicarlo me costó un clic y cero mantenimiento, el archivo se mantiene perfectamente sincronizado con lo que escribo, y el día en que un asistente de verdad se apoye en él, yo ya estaré ahí en lugar de correr a improvisar. Ese es el marco correcto para llms.txt en 2026: una apuesta barata sobre hacia dónde va la web, hecha con honestidad, no un atajo que alguien te pueda vender.
Entonces, ¿vale la pena?
Si es un interruptor y se mantiene sincronizado solo—sí. No pierdes nada y quedas listo para una adopción que claramente crece aunque siga siendo pequeña. Eso sí, acompáñalo de intención: si quieres que los motores de IA te citen, mantén permitidos sus rastreadores, porque un bot que bloqueaste en robots.txt tampoco puede leer tu invitación. Esa disyuntiva es exactamente de lo que trata la guía complementaria sobre bloquear los rastreadores de IA en WordPress.
llms.txt es una de las más de 20 herramientas de Blaminhor Essentials—gratuito y open source en WordPress.org, hecho para quien quiere SEO de la era de la IA sin un plugin pesado.
FAQ
¿Es llms.txt un estándar oficial?
No. llms.txt es una propuesta comunitaria presentada por Jeremy Howard, de Answer.AI, en septiembre de 2024, no un estándar ratificado por el W3C ni por el IETF. Eso significa que ninguna empresa de IA está obligada a leerlo. Algunas lo hacen por decisión propia; la mayoría lo trata como opcional. Adoptarlo es una apuesta barata y con visión de futuro, no una palanca de posicionamiento garantizada.
¿ChatGPT y Google leen realmente llms.txt?
En su mayoría, todavía no, al menos para búsqueda. En 2026, OpenAI y Google remiten a los dueños de sitios a robots.txt, y Google declaró en junio de 2026 que llms.txt no es necesario para Search. Anthropic ha confirmado su soporte y Perplexity lo recupera para ayudarse a elegir páginas. Los usuarios más claros hoy son los asistentes de programación como Cursor y Continue.
¿Cuál es la diferencia entre llms.txt, robots.txt y sitemap.xml?
robots.txt establece permisos (quién puede rastrear qué). sitemap.xml es una lista exhaustiva, hecha para máquinas, de todas tus URL. llms.txt no es ninguna de las dos cosas: es un mapa corto, curado y legible en Markdown que le dice a una IA de qué trata tu sitio y le señala tus mejores páginas. Se complementan entre sí en lugar de reemplazarse.
¿Dónde debe vivir el archivo llms.txt?
En la raíz de tu dominio, accesible en https://tusitio.com/llms.txt, exactamente igual que robots.txt. En Blaminhor Essentials se sirve ahí automáticamente mediante una regla de reescritura: no hay ningún archivo físico que subir ni mantener sincronizado, y se regenera a partir de tu contenido publicado.
¿llms.txt hará más lento mi sitio o Google lo indexará?
No. Se cachea durante doce horas y se sirve como texto plano ligero, deliberadamente fuera de la caché de páginas para que su formato quede intacto. Se envía con una cabecera noindex, así que no aparecerá como página en los resultados de Google: está pensado para máquinas que leen tu contenido, no para la búsqueda humana.
¿Debería añadir llms.txt si también estoy bloqueando los rastreadores de IA?
Sé coherente. Un bot que bloqueas en robots.txt tampoco puede descargar tu llms.txt, así que bloquear a ChatGPT mientras le publicas un mapa se anula solo. Decide motor por motor: si quieres que una IA te cite, deja entrar a su rastreador y dale un llms.txt; si la quieres fuera, bloquéala y ahórrate la invitación.
Comentarios