Écrire un llms.txt : ce qu'il fera et ce qu'il ne fera pas

Un llms.txt est un court fichier Markdown qui dit à un modèle de langue ce qu'est votre site et où se trouvent les pages importantes. Il s'écrit vite. Savoir si les robots d'IA s'en servent est une autre question, bien moins certaine.

Publié le 2 octobre 2026 · 6 min de lecture

llms.txt est une proposition, publiée sur llmstxt.org en 2024, pour un fichier Markdown unique à la racine d'un site, qui donne à un modèle de langue une carte concise du site : ce qu'il est, et quelles pages comptent. L'idée est qu'un modèle qui travaille avec une fenêtre de contexte limitée ne devrait pas avoir à traverser la navigation, les scripts et le balisage pour découvrir ce que fait votre produit.

Cet article présente le format, un exemple complet, la façon de bien rédiger chaque partie, puis ce que la plupart des guides sautent : ce que le fichier fera et ne fera pas.

Le format

Le fichier se trouve à l'adresse /llms.txt et s'écrit en Markdown. La proposition définit sa structure dans cet ordre :

  1. Un titre H1 avec le nom du site ou du projet. C'est la seule partie obligatoire.
  2. Une citation (blockquote) avec un court résumé : les informations clés dont on a besoin pour comprendre le reste du fichier.
  3. Éventuellement, d'autres paragraphes ou listes avec des détails. Pas de titres dans cette partie.
  4. Éventuellement, autant de sections que vous voulez sous des titres H2, chacune contenant une liste de liens. Chaque élément est un lien Markdown, éventuellement suivi d'un deux-points et d'une courte note sur la page.

Un nom de section a une signification particulière. Une section intitulée ## Optional contient des liens qui peuvent être ignorés quand il faut un contexte plus court : c'est donc l'endroit pour les pages secondaires. C'est ce nom exact qui porte ce sens dans la spécification, donc gardez-le en anglais même dans un fichier rédigé en français.

La proposition suggère aussi que les pages offrent une version Markdown propre à la même URL, avec .md ajouté. Cette partie est facultative, et beaucoup de sites publient un llms.txt sans elle.

Un exemple complet

Voici un fichier complet pour un produit inventé, un outil de comptabilité appelé Tallybook. Il est rédigé en français, puisqu'un llms.txt peut être écrit dans n'importe quelle langue :

# Tallybook

> Tallybook transforme le fichier CSV exporté par votre banque en un
> tableur catégorisé qu'un expert-comptable acceptera. C'est une application
> web pour les indépendants de l'UE, gratuite jusqu'à 200 transactions par mois.

Tallybook ne se connecte pas aux comptes bancaires : vous importez un export.
Il lit les fichiers CSV et OFX et exporte en CSV et XLSX. Il ne fait pas
vos déclarations fiscales et ne produit pas de factures.

## Documentation

- [Prise en main](https://tallybook.example/docs/start.md): importer un fichier, vérifier les catégories, exporter
- [Banques et formats pris en charge](https://tallybook.example/docs/formats.md): quels exports fonctionnent et lesquels non
- [Catégories](https://tallybook.example/docs/categories.md): les catégories par défaut et comment les modifier

## Tarifs

- [Tarifs](https://tallybook.example/pricing): les limites de l'offre gratuite et l'offre payante

## Optional

- [Journal des modifications](https://tallybook.example/changelog): la liste datée des changements
- [À propos](https://tallybook.example/about): qui construit Tallybook
Un exemple inventé. Le domaine .example est réservé et ne pointe nulle part.

Comment rédiger chaque partie

Le résumé est la ligne la plus importante. Écrivez-le en commençant par l'affirmation, pour qu'il ait encore du sens si un modèle ne cite que cette phrase : ce qu'est le produit, à qui il s'adresse et le fait qui le distingue. Évitez le vocabulaire tout fait qui remplit tant de landing pages ; « plateforme tout-en-un fluide » en dit aussi peu à un modèle qu'à une personne. L'article sur les formules toutes faites en donne une liste.

Mettez vos limites dans la partie détails. Ce que le produit ne fait pas est exactement le genre de fait qui se perd quand un modèle résume une page marketing. Le dire clairement rend plus probable qu'une réponse sur votre produit soit exacte plutôt que flatteuse, ce qui vous sert davantage sur la durée.

Liez les pages qui répondent à de vraies questions. Le fonctionnement, les tarifs, les plateformes prises en charge, les limites, une FAQ. Pas toutes les pages du sitemap : le fichier est censé être une carte choisie, et une liste de deux cents URL n'est qu'un sitemap dans un autre format.

Écrivez une note après chaque lien. C'est la note qui permet à un modèle de décider si une page vaut la peine d'être lue sans aller la chercher. « Documentation » est une note inutile ; « quels formats de fichier fonctionnent et lesquels non » est une note utile.

Tenez-le à jour. Un fichier qui décrit le produit de l'an dernier est pire que pas de fichier du tout, parce qu'il se trompe avec assurance. Mettez-y une date, ou tenez une courte section de journal des modifications, et mettez-le à jour quand le produit change.

Servez-le en texte brut à la racine de votre domaine, puis ouvrez-le dans un navigateur pour vérifier qu'il est réellement accessible et qu'il n'est pas avalé par la route attrape-tout d'une application monopage. Si vous voulez un point de départ, le générateur de llms.txt, gratuit, en rédige un dans ce format à partir de votre page d'accueil, de votre sitemap et de jusqu'à douze de vos pages. Ce qu'il produit est un brouillon à retravailler, pas un fichier fini. Le fichier d'IntentGrid se trouve à l'adresse /llms.txt, si vous voulez en voir un avec un paragraphe sur l'état du produit et une section de limites énoncées.

Ce qu'il fera

  • Donner à tout outil ou toute personne qui le récupère une description courte et exacte de votre site, dans un format qu'un modèle lit facilement. Cela inclut les développeurs qui collent le llms.txt d'un projet dans un assistant de code IA, et les outils qui cherchent délibérément ce fichier.
  • Vous obliger à écrire une description claire et citable de votre propre produit, ce qui améliore en général aussi votre page d'accueil et vos meta descriptions.
  • Coûter très peu : quelques centaines de mots et une liste de liens.

Ce qu'il ne fera pas

C'est la partie sur laquelle il faut être lucide. llms.txt est une proposition, pas un standard adopté par les moteurs de recherche ou les entreprises d'IA. Savoir si les robots qui alimentent les assistants IA et les moteurs de réponse le récupèrent, et si ce qu'ils y trouvent influence leurs réponses, reste incertain et largement non documenté. En publier un ne garantit pas de changer quoi que ce soit.

  • Il n'améliorera pas votre classement dans les moteurs de recherche. Les moteurs classent des pages, et ce fichier n'est pas un signal de classement.
  • Il ne fera pas qu'un assistant IA vous cite. Être cité dépend de l'utilité, de l'accessibilité et de la fiabilité de vos pages, pas d'un fichier de résumé.
  • Il ne remplacera pas un bon HTML. Si vos pages n'affichent leur texte que dans le navigateur, un robot qui n'exécute pas JavaScript risque de ne voir qu'une coquille vide, avec ou sans llms.txt.
  • Il ne contrôlera pas qui explore votre site. C'est le rôle d'un autre fichier.

Avant de compter dessus pour quoi que ce soit, consultez la documentation actuelle des produits d'IA précis qui vous intéressent, plutôt que de croire un article de blog sur parole, celui-ci compris.

llms.txt n'est pas robots.txt

On les confond facilement, parce que les deux se trouvent à la racine et que les deux parlent d'IA. Ils n'ont pas le même rôle.

robots.txt indique aux robots les chemins qu'ils peuvent récupérer. La plupart des entreprises d'IA documentent les user agents de leurs robots, comme GPTBot et OAI-SearchBot pour OpenAI, ClaudeBot pour Anthropic et PerplexityBot pour Perplexity, et Google utilise un jeton robots.txt distinct, Google-Extended, pour permettre aux sites de refuser certains usages de leur contenu par l'IA. Plusieurs entreprises distinguent les robots qui collectent des données d'entraînement de ceux qui récupèrent des pages pour répondre à la question d'un utilisateur, donc bloquer l'un ne bloque pas forcément l'autre. robots.txt est une demande que les robots bien élevés respectent, pas un mécanisme de contrainte.

llms.txt n'autorise ni ne bloque rien. C'est une description, offerte à qui choisit de la lire. Décidez dans robots.txt ce que vous voulez voir exploré, et utilisez llms.txt pour décrire ce qui s'y trouve.

Pour une vue d'ensemble de la façon dont les moteurs de réponse lisent un site, et de ce qui les distingue du SEO classique, voyez la personnalisation nuit-elle au SEO ?, qui consacre une section au GEO, le generative engine optimization.