En bref
- La proposition llms.txt est passée en version 2 le 10 août 2026. Elle ajoute trois choses : des liens standard pour qu’un agent trouve le fichier et la version Markdown d’une page, des versions Markdown des pages elles-mêmes, et des fichiers par sous-répertoire.
- C’est toujours une proposition, pas un standard. L’audit de Chrome qui la contrôle ne signale qu’une erreur serveur ; un fichier absent y est classé non applicable, parce que le fournir reste optionnel.
- Nous l’avons appliquée sur dotsland.com, et nous publions ici ce que nous avons mesuré : nos articles et nos expertises existent désormais en Markdown, trois à cinq fois plus légers que leur page HTML. Nous publions aussi ce que montrent nos journaux serveur : pour l’instant, très peu d’agents viennent lire ces fichiers.
- La règle la plus mal comprise est celle des sous-répertoires : un fichier ne couvre que les pages placées sous son chemin. Copier l’arborescence d’un autre site revient souvent à publier des fichiers qui ne couvrent rien.
Faites le test. Tapez l’adresse de votre site suivie de /llms.txt. Puis prenez un de vos articles et ajoutez index.md à la fin de son adresse. Chez nous, le premier renvoie un index de 72 liens, et le second renvoie le texte de l’article, sans menu, sans pied de page, sans script. Si le vôtre renvoie deux fois une erreur 404, cet article vous dit ce que la version 2 change, et ce qu’elle ne change pas.
Ce qu’est llms.txt, en trois idées
Un index en Markdown, pour les agents. La proposition, publiée par Jeremy Howard en septembre 2024, consiste à placer à la racine d’un site un fichier /llms.txt qui présente le site en quelques lignes et pointe vers ses contenus utiles. Le format est simple et fixé : un titre, un résumé, des sections, et des liens accompagnés d’une courte description. L’idée de départ n’a pas changé : une page web est faite pour un humain, emballée dans de la navigation et du code, et un agent gaspille du temps et du contexte à la nettoyer.
Concrètement, un fichier llms.txt ressemble à ceci :
# Atelier Exemple
> Mobilier en bois massif. Guides d'achat et d'entretien.
## Guides
- [Choisir une essence de bois](https://example.com/guides/essences/index.md): chêne, noyer, frêne, ce qui change à l'usage
- [Entretenir un meuble huilé](https://example.com/guides/entretien/index.md): fréquence, produits, erreurs courantes
Un titre, une phrase de résumé, puis des liens rangés par section, chacun avec quelques mots qui disent ce qu’on y trouve. L’agent lit ces quelques lignes et choisit la page à ouvrir.
Il s’est répandu dans la documentation technique. La version 2 s’ouvre sur ce constat, qui est celui de son auteur : des milliers de sites publient un fichier, des plateformes de documentation le génèrent automatiquement, et les grands laboratoires d’IA en publient un pour leur propre documentation développeur. Nous ne pouvons pas vérifier le nombre de sites. Nous avons vérifié le dernier point : OpenAI, Anthropic et Google en servent chacun un pour leur documentation.
La version 2 part de l’usage réel. Là où la première version, en 2024, prédisait que les agents liraient les sites, la seconde décrit ce qu’ils font : consulter l’index, puis suivre les liens utiles. D’où ses nouveautés, qui visent toutes à rendre ce trajet plus direct.
D’où ça vient, en quatre dates
- 3 septembre 2024. Jeremy Howard publie la proposition sur llmstxt.org.
- Les deux années qui suivent. Selon la version 2, le fichier s’installe dans la documentation technique : des plateformes de documentation le génèrent automatiquement, les grands laboratoires d’IA en publient un pour leur documentation développeur.
- 10 août 2026. La version 2 paraît, réécrite à partir de ces deux ans d’usage.
- 22 août 2026. Nous publions notre audit de citabilité, où nous écrivons qu’aucun élément public ne montre que le fichier fait citer un site. C’est toujours vrai.
- 24 septembre 2026. Nous appliquons la version 2 sur dotsland.com, un mois et demi après sa parution.
Deux ans entre la proposition et sa première refonte, puis quelques semaines pour qu’un site comme le nôtre se retrouve en retard. Un fichier posé une fois puis oublié vieillit vite : la question n’est pas seulement d’en avoir un, mais de savoir quelle version il suit.
Ce que la version 2 change
| Question | Version 1 (2024) | Version 2 (10 août 2026) |
|---|---|---|
| Comment un agent trouve le fichier ou la version Markdown d’une page ? | Il applique une règle d’adresse, mais rien dans la page ne signale la version Markdown | Par des relations de lien standard : describedby vers le llms.txt qui couvre la page, alternate de type text/markdown vers sa version Markdown. En balise dans la page, ou en en-tête HTTP |
| Où se trouve la version Markdown ? | page.html.md, et index.html.md pour une adresse sans nom de fichier |
Une seconde forme admise, page.md, et index.md à côté de index.html.md |
| Que vaut un llms.txt placé dans un sous-répertoire ? | Permis, sans règle | Il couvre les pages sous son chemin, et le fichier le plus spécifique s’applique |
| Et la section « Optional » ? | Indiquait aux outils ce qu’ils pouvaient omettre | Toujours permise, mais sans effet mécanique : l’outil d’expansion en contexte ne fait plus partie de la proposition |
Pourquoi une version Markdown de chaque page
C’est la nouveauté la plus concrète, et la moins expliquée. Un agent ne lit pas une page comme vous : il récupère son code en entier, menu, pied de page, scripts et bannière de consentement compris, puis il doit en extraire le texte. La proposition le résume ainsi : une page HTML « enveloppe son information dans la navigation, la publicité et le JavaScript, et la reconvertir en texte propre est difficile et imprécis » (notre traduction). La version Markdown, c’est le texte seul, avec sa structure : titres, listes, tableaux, liens.
- Moins de bruit. L’agent lit ce que vous avez écrit, pas votre menu, et risque moins de mélanger votre propos avec le reste de la page.
- Moins de poids. Un agent travaille dans une fenêtre de lecture limitée, et chaque élément inutile lui coûte du temps et de l’argent. Chez nous, une page pèse trois à cinq fois moins en Markdown qu’en HTML.
- Plus de pages lues pour le même effort. Un agent qui consulte plusieurs pages pour répondre à une question en lit davantage quand elles sont légères.
La limite est la même que pour le fichier : cela aide un agent qui vient déjà chez vous, cela ne le fait pas venir.
L’angle mort : ce que le fichier ne fait pas
La version 2 affirme que l’outil d’audit de Chrome, Lighthouse, vérifie la présence d’un llms.txt dans ses contrôles de navigation par les agents. C’est exact, et c’est souvent cité comme la preuve que le fichier est devenu indispensable. La documentation de Lighthouse dit autre chose quand on la lit en entier : l’audit ne signale qu’une erreur serveur au moment de récupérer le fichier. S’il n’existe pas, l’audit est classé non applicable, « parce que le fournir est optionnel pour le moment » (notre traduction). Lighthouse le décrit lui-même comme une convention émergente.
Autrement dit, rien n’a changé depuis ce que nous écrivions en août sur la citabilité par les IA : aucun élément public ne montre que le fichier déclenche des citations. Ce que la version 2 améliore, c’est le confort d’un agent qui vient déjà chercher quelque chose sur votre site. Pas la probabilité qu’il vienne.
Nous l’avons mesuré chez nous. Du 31 août au 24 septembre 2026, nos journaux serveur montrent quatre lectures de notre llms.txt par un robot d’IA dont nous avons vérifié l’adresse IP (le nom qu’un robot se donne se falsifie, son adresse beaucoup moins) : trois par le robot de recherche d’OpenAI, une par GPTBot. Aucune par un robot se présentant comme celui d’Anthropic ou de Perplexity. La plupart des autres lectures venaient de nos propres outils de vérification. Quant à nos versions Markdown, mises en ligne le 24 septembre, aucun agent ne les avait encore lues ce jour-là. Nous referons la mesure dans un mois.
L’erreur qu’on voit venir Copier l’arborescence d’un autre site. La règle des sous-répertoires dit qu’un fichier couvre les pages placées sous son chemin. Un site dont les articles sont rangés sous /2026/ gagne à publier un /2026/llms.txt. Sur un site dont les articles sont à la racine de l’adresse, comme le nôtre, un /blog/llms.txt ne couvrirait aucun article. Avant de créer un fichier par répertoire, regardez où vivent réellement vos adresses.
La méthode, et ce que nous avons fait chez nous
Nous avons appliqué la version 2 sur dotsland.com en septembre 2026. Les chiffres ci-dessous ont été relevés le 24 septembre, sur le site en ligne.
- Garder l’index court. Notre
/llms.txtfrançais pèse 28 Ko pour 72 liens, l’anglais 21 Ko. C’est l’ordre de grandeur que la version 2 recommande : assez petit pour tenir dans le contexte d’un agent, le détail vivant derrière les liens. 69 de nos 72 liens pointent désormais vers la version Markdown de la page plutôt que vers son HTML. - Publier la version Markdown des pages qui comptent. Nos articles et nos expertises répondent à
index.md, entext/markdown. L’article sur l’ordre des produits en catégorie pèse 87 Ko en HTML et 24 Ko en Markdown, soit 3,6 fois moins ; la page de l’expertise e-commerce passe de 64 Ko à 12 Ko, soit 5,1 fois moins. Ces versions sont servies avec un en-têtenoindex, qui demande aux moteurs de ne pas les indexer à côté de la page HTML. - Poser les deux relations de lien, en en-tête HTTP et dans la page. Chaque article déclare sa version Markdown et le llms.txt qui le couvre. La règle du fichier le plus spécifique est respectée : une expertise renvoie à
/expertise/llms.txt, un article anglais à/en/llms.txt. - Créer des sous-répertoires seulement là où les adresses en ont. Chez nous, seules les expertises sont rangées sous un chemin,
/expertise/et/en/expertise/: ce sont les deux seuls fichiers de sous-répertoire que nous avons créés.
Auto-diagnostic en cinq minutes : ouvrez /llms.txt sur votre site, comptez les liens et vérifiez qu’aucun ne renvoie une erreur. Puis regardez l’adresse de trois de vos pages les plus importantes : sont-elles sous un répertoire commun, ou à la racine ? La réponse dit si des fichiers par sous-répertoire ont un sens chez vous. Enfin, si vous avez accès à vos journaux serveur, cherchez qui lit votre llms.txt : c’est la seule façon de savoir s’il sert, et à qui.
Les approches, et ce qu’elles valent
| Approche | Ce que ça donne | Pour qui |
|---|---|---|
| Ne rien publier | Aucun signal négatif dans l’audit de Chrome, qui classe l’absence en non applicable. Un agent qui vient chez vous doit nettoyer votre HTML lui-même | Les sites dont le contenu n’est pas consulté par des agents |
| Un index llms.txt seul, façon version 1 | Peu de travail, un point d’entrée propre. Les liens pointent vers des pages HTML lourdes | Tout site qui veut un minimum sans chantier technique |
| La version 2 complète | Index, versions Markdown, relations de lien, sous-répertoires utiles. Demande un développement ou une extension qui génère le Markdown à chaque publication | Les sites riches en contenu de référence, documentation, fiches, guides |
| Un gros fichier unique avec tout le contenu | Pratique à produire, mais contraire à l’orientation de la version 2, qui ne mentionne pas ce format | À éviter comme élément central |
L’outillage
Si vous cherchez une extension ou un développement pour votre CMS, quatre critères suffisent : il génère la version Markdown à partir du contenu publié, sans la saisir à la main ; il pose les relations de lien dans l’en-tête HTTP et dans la page ; il pointe vers le fichier le plus spécifique pour chaque adresse ; et il tient l’index à jour à chaque publication, sans qu’on y pense.
La méthode prime sur l’outil : un générateur qui crée un fichier par répertoire sans regarder où vivent vos adresses produit exactement les fichiers vides de sens que la règle des sous-répertoires permet d’éviter.
Ce que ça dit de plus grand
La version 2 acte un changement réel : les agents lisent les sites tous les jours, et un site peut leur rendre la tâche plus ou moins facile. Mais elle reste une proposition, et l’outil de Chrome qui la contrôle la traite comme optionnelle. Les deux sont vrais en même temps, et c’est ce qui rend le sujet mal raconté : on le présente tantôt comme un gadget, tantôt comme une obligation, alors que c’est une politesse technique devenue bien outillée.
Notre lecture, dans notre expertise intelligence artificielle : faites-le, parce que c’est peu coûteux et que cela sert réellement les agents qui vous lisent déjà. Ne l’attendez pas pour être cité : la citation se joue ailleurs, sur ce que d’autres écrivent de vous.
Sources
Les affirmations vérifiables de cet article renvoient à leur source primaire, ouvertes le 24 septembre 2026. Les mesures sur dotsland.com ont été relevées le même jour. Nous ne citons pas de source que nous n’avons pas lue.
- Jeremy Howard, « The /llms.txt file, v2 », llmstxt.org, publié le 3 septembre 2024, modifié le 10 août 2026. Consulter
- llmstxt.org, « Changes », détail des changements de la version 2. Consulter
- Chrome for Developers, Lighthouse, audit « llms.txt » des contrôles de navigation par les agents. Consulter
- Fichiers llms.txt de la documentation développeur d’OpenAI, d’Anthropic et de Google. OpenAI, Anthropic, Google
FAQ
Faut-il aussi un fichier llms-full.txt ?
La version 2 ne le mentionne pas. Elle recommande l’inverse : un index court, et le contenu détaillé dans des versions Markdown des pages, que l’agent suit selon son besoin. Un gros fichier unique peut exister en complément, mais il ne remplace pas cette structure.
Les versions Markdown créent-elles du contenu dupliqué ?
C’est le risque à traiter. Nous servons les nôtres avec un en-tête noindex, qui demande aux moteurs de ne pas les indexer, et chaque page HTML reste la version de référence. Ne publiez pas de versions Markdown sans cette précaution.
Est-ce que ça aide mon site à être cité par les IA ?
Aucun élément public ne le montre, et l’audit de Chrome traite le fichier comme optionnel. Ce qu’il améliore, c’est la lecture de votre site par un agent qui y vient déjà. La citation se joue surtout sur ce que d’autres sources disent de vous, comme nous l’expliquions dans notre audit de citabilité.
Dotsland peut-il m’accompagner ?
Oui. Diagnostic de ce que votre site sert aujourd’hui aux agents, choix entre l’index seul et la version complète selon vos contenus, puis mise en place et contrôle. C’est un chantier de notre expertise intelligence artificielle. Parlons-en, ou commencez par taper /llms.txt après l’adresse de votre site.

