Glossaire

llms.txt

Un fichier texte déposé à la racine d'un site, rédigé en Markdown, qui résume le contenu du site à l'intention des modèles de langage et des agents de navigation.

Synonymes

fichier llms.txt, llms-full.txt

Origine et format

La proposition a été publiée le 3 septembre 2024 par Jeremy Howard sur llmstxt.org. Elle prévoit un fichier /llms.txt à la racine d'un site, contenant le titre du site, un résumé et des liens vers ses pages principales, rédigé en Markdown. Une version étendue, /llms-full.txt, peut détailler le contenu page par page.

Ce format n'est pas un standard du W3C ni une spécification reconnue par les moteurs de recherche. C'est une convention adoptée volontairement. La page de la proposition a été modifiée en dernier le 10 août 2026. Son usage reste libre, sans garantie de traitement par les moteurs.

Ce que les moteurs en font

Google Search n'utilise pas llms.txt et ne prévoit pas de le faire. Son guide publié en mai 2026 et mis à jour le 10 juillet 2026 le confirme par écrit : les fondamentaux du SEO classique déterminent la lisibilité d'une page par ses fonctions d'IA générative.

Lighthouse 13.3, publié le 7 mai 2026, inclut un audit de présence du fichier dans une catégorie expérimentale intitulée « Agentic Browsing ». Cette catégorie est sans note sur 100 et sans lien avec le classement dans Google Search. Elle concerne les agents de navigation, pas la recherche.

Les documentations officielles d'OpenAI, d'Anthropic et de Perplexity relevées en septembre 2026 ne mentionnent pas llms.txt comme source de lecture pour leurs moteurs de recherche ou de réponse.

llms.txt dans un projet

Le fichier est utile pour les agents de navigation qui lisent une carte du site avant de l'explorer. Sa présence n'a pas d'effet démontré sur le classement ni sur la fréquence des citations dans les réponses générées par les moteurs actuels.

Ce qui pèse davantage : un robots.txt qui règle chaque robot de recherche par son nom, des pages rendues côté serveur pour que le texte soit lisible sans JavaScript, et des contenus sourcés qui répondent à des questions précises.

Pour un site Next.js ou Strapi, le fichier llms.txt peut être généré côté serveur à partir de la liste des pages du dépôt, ce qui garantit sa mise à jour automatique à chaque publication. Il regroupe les pages par famille, les actualités et les ressources disponibles. Sa valeur est celle d'un index précis, pas d'un argument de classement.

La priorité reste la lisibilité des pages elles-mêmes : un texte servi dès le premier chargement, des titres hiérarchisés, des liens internes cohérents et un robots.txt qui distingue les robots de recherche des robots d'entraînement. Ce sont ces éléments qui déterminent la présence dans les moteurs, qu'ils soient classiques ou fondés sur l'IA.