llms.txt : à quoi sert ce fichier, et faut-il vraiment le créer ?

llms.txt : à quoi sert ce fichier, et faut-il vraiment le créer ?
llms.txt est un fichier texte que l’on dépose à la racine d’un site pour offrir aux intelligences artificielles un résumé propre de son contenu. L’idée est séduisante. Deux ans après sa proposition, Google écrit que son moteur l’ignore, aucun autre grand acteur ne déclare le lire, et une étude sur 137 000 domaines montre que 97 % des fichiers publiés n’ont reçu aucune requête. Voici ce qu’il en reste, et le seul cas où il sert encore.
Définition
Un fichier markdown à la racine, pour résumer un site à une machine
La proposition vient de Jeremy Howard, publiée le 3 septembre 2024. Le principe : déposer un fichier
/llms.txt écrit en markdown, avec un titre, un paragraphe de résumé et des listes de liens
commentés, pour éviter à un modèle de langage de devoir analyser du HTML encombré.
La spécification a été révisée en version 2 le 10 août 2026, avec cette mention de son auteur : « updated based on what I learned from two years of adoption ». Un seul élément y est obligatoire, le titre de premier niveau.
Ce n’est pas une norme
llms.txt est une proposition individuelle. Elle ne passe ni par le W3C ni par l’IETF, et aucun
fournisseur d’intelligence artificielle ne s’est engagé à la respecter. La différence avec
robots.txt, que tous les moteurs lisent depuis trente ans, n’est pas un détail.
Le point de départ
Aucun grand acteur ne déclare lire le fichier sur votre site
| Acteur | Position publiée au 25 septembre 2026 |
|---|---|
| écrit que Google Search ignore le fichier | |
| OpenAI | aucune position publiée, le fichier n’apparaît pas dans sa documentation |
| Anthropic | aucune position publiée |
| Perplexity | aucune position publiée |
| Microsoft | aucune mention dans ses annonces sur les citations IA |
Une précaution de formulation s’impose : une absence est plus difficile à prouver qu’une présence. Disons donc les choses telles qu’elles sont vérifiables. Aucun de ces quatre acteurs ne documente lire llms.txt. Seul Google a écrit une position, et elle est négative.
Source officielle
Google écrit que le fichier n’aide ni ne nuit, parce qu’il l’ignore
La phrase figure dans le guide d’optimisation pour l’IA générative publié par Google, mis à jour le 10 juillet 2026 : « It’s completely fine if you decide to create and maintain LLMS.txt files (or other similar files) for other services or systems that use these files. Doing so won’t harm (nor help) your visibility or rankings in Google Search, as Google Search ignores them. »
La même page est plus large encore : « You don’t need to create new machine readable files, AI text files, markup, or Markdown to appear in Google Search ». John Mueller, de la même équipe, avait résumé la chose plus tôt en une comparaison qui dit tout à qui a connu les années 2000 : à ses yeux, le fichier est « comparable to the keywords meta tag ».
La nuance qui mérite d’être connue
Chrome ne dit pas exactement la même chose que Google Search. Depuis mai 2026, l’outil Lighthouse ajoute un contrôle llms.txt dans sa catégorie « navigation agentique », en expliquant que sans ce fichier, les agents « may spend more time crawling the site to understand its high-level structure ». Ce n’est pas un signal de référencement, et l’absence du fichier n’y est pas pénalisée : elle est marquée « non applicable ».
La donnée
Sur 137 000 domaines, 97 % des fichiers n’ont reçu aucune requête
C’est le résultat d’une étude publiée par Ahrefs le 15 juin 2026, à partir des journaux serveur et du trafic réel de 137 210 domaines au cours du mois de mai 2026. Les fichiers ont été vérifiés un par un pour écarter les fausses pages d’erreur.
28 %
des domaines observés publient un llms.txt
97 %
de ces fichiers n’ont reçu aucune requête en mai 2026
1,1 %
des requêtes viennent des robots qui produisent les citations
Le détail est encore plus parlant que le total. Sur le peu de trafic que ces fichiers reçoivent, la première source n’est pas l’intelligence artificielle : ce sont des outils d’audit SEO, à 21 %. Les robots d’IA toutes catégories confondues pèsent 19,5 %, et la part de ceux qui servent réellement à produire des citations tombe à 1,1 %.
Une dernière observation de l’étude vaut mieux qu’un long raisonnement : aucune requête n’a été enregistrée pour un llms.txt inexistant. Les robots d’IA ne vont pas le chercher. Quand ils le lisent, c’est qu’ils sont tombés dessus.
Une réserve de méthode, que l’auteur signale lui-même : l’échantillon est composé de sites équipés d’un outil SEO, donc bien plus outillés que la moyenne du web. Le taux d’adoption de 28 % ne se lit pas comme « 28 % du web ».
L’argument à démonter
Publier un llms.txt n’est pas la même chose que lire celui des autres
L’argument que l’on rencontre le plus souvent en faveur du fichier tient en une phrase : les laboratoires d’IA eux-mêmes en publient un pour leur documentation. C’est exact et vérifiable, la documentation d’Anthropic en expose un.
Mais publier un fichier destiné aux machines qui lisent sa propre documentation technique ne dit strictement rien de ce que fait son moteur avec le fichier des autres sites. Aucun de ces acteurs ne déclare consommer les llms.txt du web. L’argument tourne en rond.
Les risques
Le vrai coût du fichier n’est pas sa création, c’est son entretien
Sur Google, la réponse est écrite et sans ambiguïté : le fichier ne nuit pas. Il n’y a donc aucune urgence à retirer celui que vous avez déjà.
Deux réserves méritent toutefois d’être connues. La première est structurelle. Un fichier déclaratif que personne ne vérifie est, par construction, manipulable : rien n’empêche d’y décrire un site différent de celui que voient les visiteurs. Duane Forrester posait la question dans les termes qu’il fallait : comment une plateforme saurait-elle que ce qui est listé correspond au contenu réel ? C’est exactement la raison pour laquelle la balise meta keywords a fini par être ignorée.
La seconde est beaucoup plus prosaïque, et c’est celle que nous voyons sur le terrain. Un llms.txt généré une fois puis oublié décrit, six mois plus tard, un site qui n’existe plus. Il devient une ligne d’entretien de plus, pour un bénéfice qui n’a jamais été mesuré.
Notre position
Ne construisez pas votre visibilité IA sur ce fichier, mettez l’effort ailleurs
- Vous n’en avez pasNe vous précipitez pas. Aucun moteur qui produit des citations ne le réclame, et Google écrit qu’il l’ignore. Le temps est mieux investi ailleurs.
- Vous en avez déjà unGardez-le, il ne vous pénalise pas. Mettez-le simplement à jour quand la structure du site change, ou retirez-le plutôt que de le laisser mentir.
- Vous publiez de la documentation techniqueC’est le seul cas où le fichier a un usage mesuré : les agents de codage lisent ce genre d’index. Si votre produit s’adresse à des développeurs, il a du sens.
Le temps gagné se réinvestit dans ce qui est documenté par les moteurs eux-mêmes : laisser leurs robots entrer, et publier des pages qu’une machine peut résumer sans se tromper. Nous détaillons le premier point dans notre guide du référencement dans ChatGPT, et le second dans ce que recouvre vraiment le GEO.
Si vous ne savez pas si les robots d’IA atteignent votre site aujourd’hui, l’audit vérifie l’accès des robots IA en même temps qu’il relève ce que les moteurs répondent sur votre activité.
llms.txt remplace-t-il le fichier robots.txt ?
Non, et les deux n’ont rien à voir. robots.txt dit à un robot ce qu’il a le droit de lire, et tous les grands moteurs le respectent. llms.txt propose un résumé du site, et aucun grand moteur ne déclare le lire. Si vous ne devez tenir qu’un seul des deux fichiers à jour, c’est robots.txt.
Faut-il retirer un llms.txt déjà en place ?
Rien ne l’impose. Google écrit que le fichier n’aide ni ne nuit au classement. Le seul cas où le retirer est préférable, c’est quand il décrit une version du site qui n’existe plus et que personne ne le met à jour.
Les générateurs automatiques de llms.txt servent-ils à quelque chose ?
Ils produisent un fichier valide, ce qui est déjà ça. Mais ils ne changent pas le problème de fond : le fichier n’est réclamé par aucun moteur de réponse. Et un fichier généré une fois vieillit aussi vite que le site.
Cela peut-il changer dans les prochains mois ?
C’est possible, et c’est pour cette raison que cet article est daté. Le signal à surveiller n’est pas une annonce marketing mais vos propres journaux serveur : le jour où des robots de citation viendront chercher le fichier, cela s’y verra avant d’être écrit ailleurs.
Sources, consultées le 25 septembre 2026
- Jeremy Howard, spécification llms.txt, proposée le 3 septembre 2024, version 2 du 10 août 2026.
- Google Search Central, Google’s Guide to Optimizing for Generative AI Features on Google Search, mise à jour du 10 juillet 2026.
- Chrome for Developers, audit llms.txt dans Lighthouse, catégorie navigation agentique, mise à jour du 5 mai 2026.
- Ahrefs, étude sur 137 210 domaines, données de mai 2026, publiée le 15 juin 2026.
- Duane Forrester, llms.txt: the web’s next great idea, 9 novembre 2025.
- Propos de John Mueller rapportés par Search Engine Journal, 17 avril 2025 et 2 juin 2026.
Pour aller plus loin
Vérifier ce qui bloque vraiment vos pages du côté des IA
Accès des robots, pare-feu, structure des pages sources, et ce que les moteurs répondent aujourd’hui sur votre activité. Des faits relevés, pas des hypothèses.
Web’up · Agence SEO et IA à La Garde, dans le Var · Interventions partout en France