Vous êtes une entreprise ?
Ordiama, c'est aussi une agence IA à Strasbourg : on crée votre site, on vous rend visible dans l'IA et on automatise vos tâches.
Reponse directe (a jour au 2 juillet 2026) : non, llms.txt n’est pas prouve comme un levier de visibilite dans les reponses des IA. C’est un fichier texte que vous placez a la racine de votre site pour lister vos pages importantes a destination des modeles de langage. Ses promoteurs le presentent comme le robots.txt des IA. Mais a ce jour, aucun grand moteur (Google, OpenAI, Perplexity) ne confirme le lire pour classer ou citer un contenu. Google dit explicitement ne pas le prendre en charge, et une etude sur 300 000 domaines ne trouve aucun lien entre sa presence et les citations par les IA. Le mettre en place coute peu et ne nuit pas. En attendre des resultats sur votre visibilite, oui, c’est un mythe.
llms.txt est un simple fichier texte, au format Markdown, place a la racine d’un site (par exemple votresite.fr/llms.txt). Il contient une liste ordonnee de vos pages importantes, chacune accompagnee d’une courte description. L’idee tient en une phrase : donner aux modeles de langage une carte propre de votre site, sans le bruit du HTML (menus, scripts, publicites).
La proposition vient de Jeremy Howard, cofondateur d’Answer.AI, publiee le 3 septembre 2024. Son constat de depart : quand une IA veut comprendre un site, elle doit deviner quelles pages comptent, et le HTML brut gaspille des tokens en elements inutiles. llms.txt propose donc une version curatee. La specification prevoit meme un second fichier, llms-full.txt, qui regroupe le contenu complet des pages listees dans un seul document.
Le raisonnement est seduisant, et l’analogie avec robots.txt parle a tout dirigeant qui gere un site. Reste une question simple : est-ce que les IA lisent vraiment ce fichier ? C’est la que ca coince.
llms.txt en bref
Source : Answer.AI, proposition originale de llms.txt (2024)
Les arguments en faveur de llms.txt sont coherents sur le papier :
Notez la nuance : ces benefices supposent qu’une IA lise le fichier. Le premier argument est reel dans un cas precis, la documentation technique consultee par des outils de developpement. Les deux autres sont des paris sur l’avenir. Aucun ne prouve un gain de visibilite aujourd’hui pour un site classique de TPE ou PME. Cette distinction, entre publier un fichier et le voir utilise, est au coeur du malentendu.
Ici, il faut separer trois choses que la plupart des articles melangent : qui publie le fichier, qui le telecharge, et qui l’utilise reellement pour classer ou citer un contenu. Le passage de l’un a l’autre n’a rien d’automatique.
C’est la position la plus claire du marche. John Mueller, de l’equipe Google Search, a repondu sans ambiguite aux questions repetees sur llms.txt : le sujet est purement speculatif pour l’instant. Sa formule resume tout : le fichier existe depuis des annees, et aucun systeme d’IA ne l’utilise, alors qu’est-ce que cela signifie ? Il le compare a la balise meta keywords, que les moteurs ignorent depuis plus d’une decennie parce qu’elle est controlee par le proprietaire du site, donc manipulable. Google Search precise de son cote qu’aucun fichier special de ce type n’est necessaire pour apparaitre dans les experiences de recherche generative.
La position de Google, en clair
OpenAI n’a pris aucun engagement public a lire ou exploiter llms.txt dans ses systemes de production. Les journaux de serveurs montrent que son robot GPTBot telecharge parfois le fichier, mais principalement dans une logique d’entrainement, pas de classement ni de citation. Telecharger un fichier n’est pas la meme chose que s’en servir comme signal. La preuve manque du cote OpenAI, et il faut le dire tel quel.
Anthropic publie un llms.txt pour sa propre documentation, et son agent Claude-Code compte parmi les robots qui telechargent ce type de fichier dans un contexte de developpement. Mais publier un fichier pour sa doc ne prouve pas que Claude lise le llms.txt de votre site pour repondre a un utilisateur. Aucune declaration publique ne confirme cette lecture des sites tiers. Meme constat pour Perplexity : pas de position officielle, et un trafic de son robot PerplexityBot sur ces fichiers qualifie de negligeable par les analyses de logs. En l’absence de source primaire, on ne comble pas le vide par une affirmation flatteuse.
Deux mesures serieuses vont dans le meme sens.
SE Ranking a analyse pres de 300 000 domaines. Resultat : 10,13 % ont un llms.txt, soit environ un site sur dix. Surtout, l’etude ne trouve aucun lien mesurable entre la presence du fichier et la frequence des citations par les IA. Dans leur modele statistique, retirer la variable llms.txt ameliorait meme la precision, ce qui suggere qu’elle ajoute du bruit plutot que de l’information. Leur conclusion : llms.txt n’influence pas la facon dont les systemes d’IA voient ou citent votre contenu aujourd’hui.
Une seconde analyse, sur 137 210 domaines ayant recu du trafic en mai 2026, regarde le probleme sous l’angle des journaux de serveur. Parmi les domaines equipes d’un llms.txt, 97 % n’ont recu aucune requete sur ce fichier de tout le mois. Les rares lectures venaient surtout de GPTBot (entrainement) et de Claude-Code (agent de code), pas des robots qui pilotent les citations en recherche. Le trafic de PerplexityBot y etait plus faible que celui de Slackbot. Et aucun robot d’IA ne va spontanement chercher le fichier : le test sur les domaines sans llms.txt n’a releve aucune tentative de requete vers ce fichier.
Ce que disent les chiffres
| Mesure | Chiffre | Ce que ca dit |
|---|---|---|
| Adoption (300 000 domaines) | 10,13 % | Environ 1 site sur 10 publie le fichier. |
| Lien avec les citations IA | Aucun mesurable | Presence du fichier sans effet sur les citations. |
| Fichiers jamais lus (137 210 domaines, mai 2026) | 97 % | Le fichier existe mais n’est presque jamais requete. |
| Robots qui le cherchent spontanement | Aucun | Pas de decouverte proactive du fichier. |
Sources : Search Engine Journal, etude sur 300 000 domaines · SE Ranking, analyse llms.txt · BeeOS, 137 210 domaines analyses
Etre honnete, c’est aussi ne pas jeter le fichier avec l’eau du bain. Il existe un usage ou llms.txt fonctionne : les outils de developpement et les agents de code. Des editeurs comme les assistants de programmation ou les frameworks qui alimentent des IA en documentation lisent effectivement ces fichiers quand ils sont presents. C’est logique, car un agent qui doit lire une doc technique a un interet direct a recuperer une version Markdown propre plutot que des pages HTML lourdes.
Autrement dit, si vous editez une documentation technique, un produit SaaS ou une API destinee a des developpeurs, publier un llms.txt peut aider les agents qui consultent votre doc. C’est un cas d’usage reel, mais tres eloigne de la promesse marketing qui vous vend le fichier comme un levier de referencement dans ChatGPT ou Perplexity. Pour un site de TPE ou de PME classique, ce n’est pas le meme monde.
Faisons la part des choses, sans hype ni rejet paresseux.
La conclusion pratique : si vous avez cinq minutes et une doc technique, publiez-le, cela ne coute rien. Mais n’en faites pas une priorite, ne payez pas cher pour ca, et surtout n’en attendez pas de gains de trafic ou de citations. Votre energie est bien mieux investie dans un contenu clair, structure et factuel, qui reste, lui, le vrai levier pour etre cite par les IA. Pour cela, voyez notre guide du GEO 2026, la methode des faits atomiques et l’usage des donnees structurees Schema.org, trois leviers dont l’effet, lui, est documente.
Si vous voulez une strategie de visibilite a l’ere de l’IA construite sur ce qui marche vraiment, et non sur les fichiers a la mode, notre agence de referencement IA peut vous aider a trancher les priorites.
Ce n’est pas indispensable. C’est un effort optionnel, a faible priorite. Si votre site publie une documentation technique lue par des agents ou des outils de developpement, cela peut aider. Pour un site vitrine ou e-commerce classique, n’en attendez aucun gain de visibilite dans les IA a ce jour.
Non. L’equipe Google Search a confirme ne pas prendre en charge llms.txt et n’a pas de projet en ce sens. Google precise qu’aucun fichier special de ce type n’est necessaire pour apparaitre dans sa recherche generative.
Aucune preuve a ce jour. OpenAI ne s’engage pas a l’utiliser, Perplexity non plus, et une etude sur 300 000 domaines ne trouve aucun lien entre la presence du fichier et la frequence des citations par les IA.
Aucun risque connu pour votre referencement. C’est un fichier statique et neutre. Le seul cout est le temps de le creer et de le maintenir a jour.
robots.txt est un standard reconnu et respecte par les moteurs pour indiquer ce qu’un robot peut explorer. llms.txt n’a pas ce statut : c’est une proposition qui liste des pages a destination des modeles, mais qu’aucun grand moteur ne confirme utiliser. L’analogie du robots.txt des IA est une facon de communiquer, pas une equivalence technique.
Sur un contenu clair, structure et factuel : reponses directes extractibles, faits chiffres et sources, donnees structurees Schema.org. Ce sont les leviers dont l’effet sur la visibilite dans les reponses generatives est documente, contrairement a llms.txt.
Ordiama, c'est aussi une agence IA à Strasbourg : on crée votre site, on vous rend visible dans l'IA et on automatise vos tâches.