llms.txt : c'est quoi, et comment l'ajouter à WordPress
llms.txt est une carte Markdown de votre site pour les IA. Ce qu'il fait vraiment (et pas) en 2026, et comment le publier en un clic dans WordPress.
Tous les quelques mois, un nouveau fichier promet de rendre votre site « prêt pour l’IA ». La plupart ne sont que du bruit. Le llms.txt mérite quand même qu’on le comprenne — non parce qu’il serait magique, mais parce qu’il est peu coûteux, honnête, et qu’il pointe vers la direction que prend le web. J’en ai ajouté un sur mes propres sites la semaine où l’idée est sortie, j’ai observé qui venait vraiment le chercher, et je vais vous dire sans détour ce qu’il a fait et n’a pas fait. Puis je vous montrerai comment publier le vôtre en un clic dans WordPress.
L’essentiel
- llms.txt est une proposition communautaire (Answer.AI, septembre 2024) — pas un standard W3C ou IETF. Aucune entreprise d’IA n’est obligée de l’honorer.
- C’est un fichier Markdown à l’adresse
votresite.com/llms.txt: un titre de site, un résumé d’une ligne, puis une liste éditorialisée de vos pages clés avec de courtes descriptions. - L’adoption tourne autour de 5 à 15 % des sites techniques et de documentation en 2026, et environ 97 % des llms.txt publiés ne reçoivent aucune requête d’IA — voyez-le comme un pari d’avenir, pas comme un levier de trafic.
- Ses utilisateurs les plus nets aujourd’hui sont les assistants de code (Cursor, Continue, Cline) et l’outillage d’agents ; Anthropic a confirmé le prendre en charge et Perplexity le récupère, tandis qu’OpenAI et Google renvoient toujours vers robots.txt.
- Dans Blaminhor Essentials, il est généré en direct depuis votre contenu, mis en cache 12 heures, servi en texte brut noindex, et liste jusqu’à 100 entrées récentes par type de contenu, en excluant tout ce que vous avez marqué noindex.
Qu’est-ce que le llms.txt, exactement ?
llms.txt est un fichier éditorialisé, au format Markdown, qui dit à un modèle de langage de quoi parle votre site et quelles pages comptent le plus. Voyez-le comme un accueil chaleureux pour les machines : au lieu de laisser une IA crawler et deviner, vous lui tendez un brief d’une page — le nom de votre site, une phrase de contexte, et une liste propre de liens accompagnés de courtes descriptions.
Le format est volontairement simple. Un titre de premier niveau avec le nom de votre site, une citation optionnelle qui résume ce que vous faites, puis des sections (une par type de contenu) listant les pages sous forme de liens Markdown, chacun avec une note brève. C’est tout. Un humain le lit en dix secondes ; un modèle aussi, et pour bien moins cher que d’analyser votre site entier.
L’idée vient de Jeremy Howard, cofondateur d’Answer.AI, qui a publié la proposition en septembre 2024. Son raisonnement était pratique : la fenêtre de contexte d’un LLM est petite et coûteuse, et les pages HTML brutes regorgent de navigation, de scripts et d’habillage qui la gaspillent. Une carte Markdown propre permet au modèle de consacrer son attention à votre vraie substance.
Le llms.txt, est-ce la même chose que robots.txt ou un sitemap ?
Non — les trois font des métiers différents, et llms.txt est le seul qui relève de l’invitation plutôt que de l’inventaire ou de la permission. Ils cohabitent, et un site bien tenu peut avoir les trois.
Voici le partage honnête. robots.txt est un videur : il dit quels crawlers peuvent entrer et quels couloirs sont interdits. sitemap.xml est un annuaire : toutes vos URL, listées exhaustivement pour les machines, sans aucun jugement éditorial. llms.txt est un concierge : un « voilà ce qui vaut votre temps » court, choisi à la main, écrit pour un lecteur qui pense en langage, pas en XML.
| Fichier | Rôle | Public | Éditorialisé ? |
|---|---|---|---|
| robots.txt | Permissions — qui peut crawler quoi | Tous les crawlers | Non (règles uniquement) |
| sitemap.xml | Liste exhaustive de toutes les URL | Crawlers des moteurs de recherche | Non (tout) |
| llms.txt | Une carte lisible de votre meilleur contenu | Assistants IA, agents | Oui |
Cette colonne « éditorialisé » est tout l’enjeu. Votre sitemap peut contenir 4 000 URL ; votre llms.txt devrait contenir les vingt pages que vous voudriez réellement voir citées par un assistant.
ChatGPT lit-il vraiment le llms.txt en 2026 ?
Honnêtement ? Essentiellement non — du moins pas pour la visibilité en recherche, et je préfère vous le dire plutôt que de vous vendre un mythe. En 2026, aucun grand fournisseur d’IA ne s’est engagé à utiliser llms.txt en production pour la recherche. OpenAI et Google recommandent tous deux robots.txt pour le contrôle des crawlers, et Google a précisé en juin 2026 que llms.txt n’est pas requis pour la recherche.
La réalité mesurée fait redescendre sur terre. Dans une étude sur 90 jours, les fichiers llms.txt ont attiré environ 0,1 % de tout le trafic des crawlers d’IA ; une autre a constaté qu’environ 97 % des llms.txt publiés ne recevaient aucune requête d’IA du tout. Si quelqu’un vous promet des positions grâce à un llms.txt, il est en avance sur les preuves.
Alors qui l’utilise vraiment ? Deux groupes. D’abord, les outils de code et d’agents — Cursor, Continue, Cline et diverses intégrations MCP lisent llms.txt pour comprendre un projet ou un site de documentation. Ensuite, deux moteurs de réponse se réchauffent : Anthropic a publiquement confirmé le prendre en charge, et Perplexity dit le récupérer pour prioriser les pages à examiner.
Comment ajouter un llms.txt à WordPress ?
Sous WordPress, vous n’écrivez ni ne téléversez un llms.txt à la main — vous laissez le module SEO en générer un depuis votre contenu en ligne et le servir à la racine. Avec Blaminhor Essentials installé, c’est un interrupteur plus deux choix. Pas à pas :
- Activez le module SEO et ouvrez son onglet GEO / AEO — le même onglet qui gère le contrôle des crawlers d’IA et les données structurées (article en anglais).
- Cochez Enable llms.txt. Dès l’enregistrement, le fichier est en ligne à l’adresse
https://votresite.com/llms.txt; l’écran de réglages affiche le lien pour l’ouvrir dans un nouvel onglet et vérifier. - Choisissez vos types de contenu. Sélectionnez les types de publication qui méritent la carte — typiquement articles et pages, plus les produits ou un portfolio s’ils sont votre substance. Chaque type devient sa propre section.
- Rédigez un Site Summary (résumé du site). Une ou deux phrases décrivant de quoi parle votre site. Elles deviennent la citation en tête de fichier — la première chose qu’un modèle lit. Laissez le champ vide et c’est le slogan de votre site qui est utilisé.
Il n’y a aucun fichier physique à maintenir. Une règle de réécriture répond à /llms.txt à la volée, la carte est donc toujours à jour : publiez un article et il apparaît, dépubliez-le et il disparaît. Tout ce que vous avez marqué noindex en est exclu, exactement comme de votre sitemap, si bien que les deux surfaces ne se contredisent jamais.
Un interrupteur publie un llms.txt vivant ; vous choisissez les types de contenu et rédigez un résumé du site en une ligne.
Que contient un bon llms.txt ?
Un bon llms.txt est court, éditorialisé et se suffit à lui-même — le nom de votre site, une ligne de contexte, et vos pages réellement utiles, chacune avec une phrase qui tient debout toute seule. Le générateur suit la spécification : un H1 avec le nom de votre site, une citation de résumé, puis des sections ## par type de contenu listant jusqu’aux 100 entrées les plus récemment mises à jour, chacune sous forme de lien avec une description tronquée à 25 mots tirée de votre extrait ou de votre contenu.
Il ajoute aussi une section Optional pointant vers votre sitemap XML — la façon qu’a la spécification de dire « voici l’index exhaustif si vous en voulez plus ». Le résultat se lit comme une table des matières écrite par un éditeur attentif, pas comme un vidage de base de données. Si vous ne retenez qu’une règle : le llms.txt est l’endroit où vous êtes sélectif. Votre sitemap est l’endroit où vous êtes complet.
Voici ce que j’ai observé après avoir publié le mien
Je l’ai activé sur une poignée de sites, puis j’ai fait la chose ennuyeuse et honnête : j’ai regardé les logs. Pendant des semaines, le fichier est resté quasi intouché — les chiffres d’adoption cités plus haut ne sont pas abstraits, ils correspondent à ce que j’ai vu. Les requêtes qui sont bel et bien venues provenaient surtout d’outillage d’agents et d’un passage occasionnel de Perplexity, pas d’un déluge de trafic ChatGPT.
L’ai-je désactivé ? Non. Le publier m’a coûté un clic et zéro maintenance, le fichier reste parfaitement synchronisé avec ce que j’écris, et le jour où un assistant s’appuiera vraiment dessus, je serai déjà là au lieu de courir après. C’est le bon cadre pour le llms.txt en 2026 : un pari peu coûteux sur la direction que prend le web, posé honnêtement — pas un raccourci que quiconque pourrait vous vendre.
Alors, faut-il s’y mettre ?
Si c’est un interrupteur et que le fichier se synchronise tout seul — oui. Vous ne perdez rien et vous êtes prêt(e) pour une adoption qui monte clairement, même si elle reste modeste. Accompagnez-le simplement d’une intention : si vous voulez que les moteurs d’IA vous citent, laissez leurs crawlers entrer, car un robot bloqué dans robots.txt ne peut pas non plus lire votre invitation. Ce compromis est exactement le sujet du guide compagnon sur le blocage des robots d’IA dans WordPress.
Le llms.txt est l’un des plus de 20 outils de Blaminhor Essentials — gratuit et open source sur WordPress.org, pensé pour celles et ceux qui veulent un SEO de l’ère IA sans plugin mastodonte.
– blaminhor
FAQ
Le llms.txt est-il un standard officiel ?
Non. llms.txt est une proposition communautaire lancée par Jeremy Howard, d'Answer.AI, en septembre 2024 — pas un standard ratifié par le W3C ou l'IETF. Aucune entreprise d'IA n'est donc obligée de le lire. Certaines le font ; la plupart le considèrent comme optionnel. L'adopter est un pari peu coûteux et tourné vers l'avenir, pas un levier de classement garanti.
ChatGPT et Google lisent-ils vraiment le llms.txt ?
Pour la recherche, essentiellement pas encore. En 2026, OpenAI et Google renvoient les propriétaires de sites vers robots.txt, et Google a précisé en juin 2026 que llms.txt n'est pas requis pour la recherche. Anthropic a confirmé le prendre en charge et Perplexity le récupère pour choisir ses pages. Les utilisateurs les plus nets aujourd'hui sont les assistants de code comme Cursor et Continue.
Quelle différence entre llms.txt, robots.txt et sitemap.xml ?
robots.txt fixe des permissions (qui peut crawler quoi). sitemap.xml est une liste machine exhaustive de toutes vos URL. llms.txt n'est ni l'un ni l'autre : c'est une carte Markdown courte, éditorialisée et lisible par un humain, qui dit à une IA de quoi parle votre site et pointe vers vos meilleures pages. Les trois se complètent plutôt qu'ils ne se remplacent.
Où le fichier llms.txt doit-il se trouver ?
À la racine de votre domaine, accessible à l'adresse https://votresite.com/llms.txt, exactement comme robots.txt. Dans Blaminhor Essentials, il y est servi automatiquement par une règle de réécriture : aucun fichier physique à téléverser ni à synchroniser, il est régénéré à partir de votre contenu réellement en ligne.
Le llms.txt va-t-il ralentir mon site ou être indexé par Google ?
Non. Il est mis en cache douze heures et servi en texte brut léger, délibérément hors du cache de pages pour préserver sa mise en forme. Il est envoyé avec un en-tête noindex, il n'apparaîtra donc pas comme une page dans les résultats de Google — il est destiné aux machines qui lisent votre contenu, pas à la recherche humaine.
Faut-il ajouter un llms.txt si je bloque aussi les robots d'IA ?
Soyez cohérent(e). Un robot que vous bloquez dans robots.txt ne peut pas non plus récupérer votre llms.txt : bloquer ChatGPT tout en publiant une carte à son intention s'annule. Décidez moteur par moteur : si vous voulez qu'une IA vous cite, laissez entrer son crawler et donnez-lui un llms.txt ; si vous la voulez dehors, bloquez-la et gardez l'invitation pour d'autres.
Commentaires