llms.txt
Déclarer ne suffit pas si le contenu n'est pas exploitable.
Définition
Le llms.txt est un fichier texte au format Markdown, placé à la racine d'un domaine (/llms.txt), qui propose aux IA une carte structurée du site : une liste curatée des contenus importants, avec de courtes descriptions. Proposé en septembre 2024 par Jeremy Howard (Answer.AI), c'est une convention communautaire, pas un standard officiel : aucun organisme ne le régit, et aucune IA n'est tenue de le lire. Un fichier compagnon, llms-full.txt, en pousse la logique en concaténant tout le contenu en un seul document.
Pourquoi ça compte (et pourquoi la promesse SEO est fausse)
C'est le point crucial, à contre-courant du discours ambiant : llms.txt n'améliore pas votre visibilité dans la recherche IA. Google l'a confirmé sur le fond - il n'est pas utilisé pour les AI Overviews ni l'AI Mode, et ses responsables l'ont comparé au meta keywords tag, un signal déclaratif et discrédité. Aucun grand modèle ne s'en sert comme critère de citation, les crawlers de recherche ne le récupèrent quasiment jamais, et son adoption reste faible. Le vendre comme un levier GEO, c'est vendre du vent.
Sa vraie valeur est ailleurs : c'est un levier B2A (business-to-agent). Les agents - assistants de code, agents de navigation, workflows outillés - le récupèrent pour comprendre un site sans avoir à parser tout le HTML. C'est une brique du web agentique, pas de la recherche : à ranger du côté de l'actionnabilité, pas de la découvrabilité.
Ce qu'il fait / ce qu'il ne fait pas
| llms.txt | |
|---|---|
| Améliore le classement Google | ❌ Non (confirmé par Google) |
| Améliore la citation dans AI Overviews / ChatGPT | ❌ Non prouvé, corrélation nulle |
| Aide les agents de code / navigation à lire le site | ✅ Oui, usage réel |
| Utile pour un site de documentation / API / produit agent-ready | ✅ Oui |
| Coût / risque de le publier | Faible (≈30 min, sans danger) |
Comment l'aborder
- Ne pas l'attendre comme un gain SEO : la vraie recherche IA se gagne par du contenu citable et de l'autorité, pas par ce fichier.
- Le publier si vous avez un enjeu agent : documentation, API, produit consommé par des agents, ou trafic d'agents IA mesurable dans vos logs.
- Éviter le piège du doublon : générer une copie Markdown indexable de chaque page crée du contenu dupliqué qui gaspille le budget d'exploration.
- Le tenir à jour : un llms.txt périmé envoie aux agents une carte fausse - pire que pas de fichier.
Erreurs fréquentes
- Le traiter comme un levier de visibilité IA alors qu'aucun moteur génératif ne l'utilise comme signal.
- L'ériger en priorité au détriment de ce qui compte vraiment (contenu non substituable, autorité, structure).
- Confondre llms.txt (fichier d'inclusion, une carte) et robots.txt (fichier de restriction) : ce sont des rôles opposés.
- Le générer automatiquement sans le maintenir, puis laisser les agents s'appuyer sur une carte obsolète.
Termes liés
- Actionnabilité (couche GEO « agent »)
- Agent IA
- Commerce agentique
- MCP (Model Context Protocol)
- Données structurées (Schema.org / JSON-LD)
- GEO (Generative Engine Optimization)
FAQ
Le llms.txt améliore-t-il mon référencement dans l'IA ? Non. Google a confirmé qu'il ne l'utilise pas pour ses fonctionnalités IA, aucun grand modèle ne s'en sert comme signal de citation, et aucune étude n'a montré de corrélation. La visibilité IA se gagne par le contenu et l'autorité, pas par ce fichier.
À quoi sert-il alors ? À l'outillage agent : les assistants de code et les agents de navigation le récupèrent pour comprendre rapidement un site. C'est un levier « business-to-agent », utile surtout aux sites de documentation, d'API ou aux produits pensés pour être consommés par des agents.
Faut-il en publier un ? Si vous avez un enjeu agent (doc, API, produit agent-ready) : oui, c'est rapide et sans risque. Sinon, ce n'est pas une priorité, et surtout pas un substitut au travail qui, lui, gagne réellement des citations IA.