Un fichier texte à la racine du site, quelques liens bien choisis, et les IA comprendraient enfin qui vous êtes. C’est la promesse du llms.txt, présenté depuis deux ans comme le « robots.txt des modèles de langage ». Les plugins SEO le génèrent en un clic, les agences le vendent comme un levier GEO. Les logs serveur racontent une autre histoire.

Ce que contient un fichier llms.txt

Le llms.txt est une convention proposée le 3 septembre 2024 par Jeremy Howard, cofondateur d’Answer.AI et de fast.ai. L’idée part d’un constat simple : une page web moderne est encombrée de menus, de scripts et de bandeaux, alors qu’un modèle de langage travaille avec une fenêtre de contexte limitée. Autant lui fournir un résumé propre, en markdown.

La spécification publiée sur llmstxt.org décrit un fichier placé à la racine (/llms.txt) et structuré dans cet ordre :

  1. Un titre H1 avec le nom du site, seul élément obligatoire.
  2. Une citation en blockquote qui résume l’activité en quelques lignes.
  3. Des paragraphes libres, sans titres, pour préciser le contexte.
  4. Des sections H2 qui listent les pages clés au format [nom](url): description.
  5. Une section « Optional » pour les contenus secondaires, qu’un agent peut ignorer.

La spec suggère aussi de proposer une version .md de chaque page. Une variante, le llms-full.txt, regroupe toute une documentation dans un seul fichier. Mintlify et Anthropic l’ont popularisée.

Attention à la confusion fréquente. Le llms.txt n’autorise rien et n’interdit rien. Il ne remplace pas le robots.txt, qui reste le seul fichier où vous décidez quels robots d’IA générative peuvent parcourir vos pages . L’un contrôle l’accès, l’autre propose un sommaire.

Aucun moteur de réponse ne s’engage à le lire

C’est le point qui fâche. Deux ans après la proposition, aucun éditeur d’IA n’a annoncé officiellement lire les llms.txt des sites tiers pour construire ses réponses ou choisir ses citations. Ni OpenAI, ni Anthropic, ni Perplexity. Les blogs qui affirment le contraire ne citent jamais de documentation primaire.

Google, lui, a été clair. John Mueller comparait dès avril 2025 le fichier à la balise meta keywords, ce vestige que plus aucun moteur ne consulte. Puis Google a tranché noir sur blanc : depuis juin 2026, son guide d’optimisation pour la recherche IA précise que ces fichiers ne nuisent ni n’aident à la visibilité dans Google Search, parce que Google Search les ignore.

Le signal est brouillé par un paradoxe. En mai 2026, Chrome a ajouté à Lighthouse 13.3 une catégorie « Agentic Browsing » qui vérifie la présence et la forme d’un llms.txt. Un fichier absent y apparaît comme « non applicable », pas comme une erreur. Autrement dit, un outil de Google contrôle un fichier que Google Search déclare ignorer. De quoi alimenter bien des malentendus.

Le llms.txt est aujourd’hui un standard proposé, pas un standard adopté. Aucun moteur de réponse ne s’est engagé à le lire.

Ce que montrent les logs serveur

Les déclarations ne suffisent pas, les logs tranchent. Et ils convergent.

Ahrefs a analysé les fichiers llms.txt de son parc de clients en mai 2026 : 97 % n’avaient reçu aucune requête sur le mois. Sur les rares visites enregistrées, les outils d’audit SEO pesaient plus lourd (21,7 %) que l’ensemble des bots IA (19,5 %), et GPTBot à lui seul ne représentait que 4,51 % du total, selon l’étude publiée par Ahrefs .

OtterlyAI a mené l’expérience sur 90 jours, avec des résultats publiés en février 2026. Sur plus de 62 100 visites de bots IA, le fichier en a reçu 84. Soit 0,1 %. Une page de contenu moyenne, sur la même période, recevait environ 265 visites de ces mêmes robots. Côté français, SEOMix a suivi six sites pendant soixante jours au printemps 2026 : sur 33 092 passages de bots IA, aucun n’a demandé le llms.txt.

Reste la question qui compte vraiment : le fichier améliore-t-il les citations ? SE Ranking a croisé présence du llms.txt et citations IA sur 300 000 domaines en novembre 2025. Aucune corrélation. Pire, leur modèle statistique devenait plus précis une fois la variable llms.txt retirée.

Résultat : les robots des IA lisent vos pages, pas votre sommaire.

Pourquoi l’adoption progresse malgré tout

Les chiffres d’adoption, eux, montent. D’après Rankability, 9,3 % des 1 000 domaines les plus visités publiaient un llms.txt en septembre 2026, contre 0,3 % en juin 2025. Cloudflare, GitHub, Adobe et Dropbox en font partie. Originality.ai, qui suit plus de 3 millions de sites, a vu le nombre de fichiers passer de 4 088 à 36 120 en un an.

Trois raisons expliquent ce décalage entre usage réel et adoption :

Ce raisonnement se tient, pour peu qu’on n’attende rien du fichier en matière de visibilité.

Là où il sert vraiment : la documentation technique

Il existe un usage concret, et il n’a rien à voir avec ChatGPT ou Perplexity. Les assistants de développement (Cursor, Cline, Continue) et les intégrations MCP consomment des llms.txt, mais seulement quand un développeur les pointe explicitement vers la documentation d’une API ou d’un SDK.

Le cas d’usage est précis : un développeur veut que son agent de code connaisse l’API Stripe ou la documentation de Claude. Plutôt que de parcourir des dizaines de pages HTML, l’agent récupère un fichier markdown propre et complet. Stripe et Anthropic publient d’ailleurs le leur, Stripe avec une version .md de chaque page.

La nuance est de taille. Ici, c’est un humain qui va chercher le fichier et le fournit à son outil. Aucun robot ne le découvre seul pour décider qui citer dans une réponse.

Pour un éditeur de logiciel, une plateforme SaaS ou toute entreprise qui publie une API, le llms.txt a donc une vraie utilité. Pour un site vitrine qui présente des prestations, beaucoup moins.

Les risques d’un fichier mal pensé

Déployer un llms.txt ne coûte presque rien. Mal le déployer peut coûter un peu plus.

La duplication de contenu

Certains plugins génèrent une copie markdown de chaque page, accessible et parfois indexable. Vous créez alors des doublons de vos propres contenus. John Mueller a suggéré d’appliquer un en-tête X-Robots-Tag: noindex au fichier pour éviter qu’il n’apparaisse dans les résultats.

Le contenu réservé aux machines

La tentation existe : rédiger pour les IA une version enrichie, bourrée de mots-clés et d’arguments absents des pages visibles. C’est la définition même du cloaking. Un fichier qui décrit une offre différente de celle du site envoie des signaux contradictoires, à supposer qu’un robot le lise un jour.

Le fichier périmé

Le coût caché, c’est la maintenance. Une offre qui évolue, une page supprimée, une refonte : le llms.txt doit suivre. Un sommaire qui pointe vers des 404 ou décrit d’anciens services fait pire que pas de sommaire du tout.

Un llms.txt ne rendra pas votre site plus visible. Un llms.txt oublié peut en revanche le rendre moins cohérent.

Faut-il le déployer sur votre site B2B ?

La réponse dépend de la nature du site, pas de la mode. Concrètement :

Car le reste pèse bien plus lourd. Un HTML lisible sans JavaScript, des données structurées cohérentes, des passages qui répondent nettement à une question et une marque citée sur des sites tiers influencent réellement ce que les IA retiennent de vous. Le vrai chantier consiste à structurer vos contenus pour qu’un LLM puisse les citer , page par page.

Avant de décider, regardez vos logs. Filtrez les requêtes sur /llms.txt si le fichier existe déjà, et comparez avec les visites de GPTBot, ClaudeBot ou PerplexityBot sur vos pages de contenu. Deux mois de données suffisent pour savoir si quelqu’un le lit.

Questions fréquentes

Combien de temps faut-il pour créer un fichier llms.txt ?

Quelques minutes avec Yoast ou Rank Math, qui le génèrent automatiquement. Pour un site statique, prévoyez environ une heure pour sélectionner les pages clés et rédiger des descriptions utiles.

Le llms.txt peut-il empêcher ChatGPT d’utiliser mes contenus ?

Non. Le fichier ne contient aucune directive d’accès. Pour autoriser ou bloquer un robot d’IA, il faut passer par le robots.txt ou par un blocage au niveau du serveur ou du CDN.

Un llms.txt peut-il pénaliser mon référencement Google ?

Google indique que son moteur ignore ces fichiers, sans effet positif ni négatif. Le seul risque vient des copies markdown indexables que génèrent certains outils, d’où l’intérêt d’un en-tête noindex.

Comment savoir si des IA lisent mon llms.txt ?

Consultez vos logs serveur et filtrez les requêtes vers /llms.txt en identifiant les user-agents. Dans la plupart des études publiées, les visites viennent surtout d’outils d’audit SEO et très rarement des robots des IA.


Le llms.txt illustre bien un travers du moment : adopter un format avant de savoir s’il sert. Pour une documentation technique, il rend un service réel. Pour un site B2B classique, c’est une ligne de plus dans la checklist, loin derrière la qualité des pages que les IA lisent vraiment.

Retour au blog