llms.txt : un sommaire pour les IA, utile à poser, inutile à surestimer
Un fichier llms.txt présente votre site aux IA. Ce que Google en dit, ce que mesurent les journaux de serveur, un exemple et comment le poser.

Le llms.txt est un petit fichier texte, posé à la racine d’un site (à l’adresse votresite.fr/llms.txt), qui présente le site aux intelligences artificielles comme un sommaire : qui vous êtes, ce que vous faites, et les pages à lire en priorité. Il tient en quelques lignes de texte. Mais aucune des sources lues pour cet article, en octobre 2026, ne montre qu’il fasse citer une PME par ChatGPT ou par Google.
Les faits sont nets. Google écrit, dans son guide sur l’IA générative dans la recherche mis à jour le 13 juillet 2026, qu’il est « inutile » de créer ce type de fichier pour apparaître dans sa recherche, réponses IA comprises, car « la recherche Google elle-même ne les utilise pas ». Et une étude d’EZY Research publiée le 27 juillet 2026, menée sur 83 sites pendant 12 semaines, a compté 7 lectures du llms.txt par les robots d’OpenAI, contre 3 990 lectures du robots.txt sur les mêmes sites.
Ma position, de consultant qui accompagne des PME sur leur visibilité dans les IA : je conseille de poser un llms.txt propre parce qu’il coûte peu, jamais comme un levier magique. Pour la recherche de ChatGPT, OpenAI indique que c’est dans le robots.txt, avec le nom de son robot OAI-SearchBot, que se règle l’exclusion de ses réponses : je le vérifie en premier. Et pour être cité, je fais passer avant tout des pages qui répondent clairement aux questions de vos clients.
Un mot de vocabulaire avant d’aller plus loin. Le GEO (Generative Engine Optimization) désigne le travail qui augmente les chances qu’une IA comme ChatGPT reprenne votre contenu dans sa réponse. Un robot d’exploration est le programme qu’un moteur ou une IA envoie lire les pages des sites.
llms.txt, c’est quoi ?
Le llms.txt est un fichier texte qui présente un site aux IA comme un sommaire, à l’adresse /llms.txt. C’est une proposition, pas une norme officielle : Jeremy Howard l’a publiée le 3 septembre 2024 dans sa proposition « The /llms.txt file, v2 » (texte modifié le 10 août 2026) pour, selon ses mots, « fournir des informations qui aident les agents à utiliser un site web ». Un agent, c’est une IA qui agit pour quelqu’un : elle va chercher une information, compare, résume.
La proposition admet aussi un fichier placé dans un sous-dossier (par exemple /docs/llms.txt) ; quand plusieurs fichiers s’appliquent, l’agent prend le plus précis. Pour une PME, la racine suffit.
Il s’écrit en Markdown, une mise en forme de texte très simple où un dièse # marque un titre et un tiret marque une ligne de liste. La proposition fixe quatre blocs :
- Un titre avec le nom du site ou du projet. C’est la seule partie obligatoire.
- Un résumé court, présenté en citation (une ligne qui commence par
>), avec l’essentiel à savoir pour comprendre la suite. - Du texte libre, facultatif, pour préciser le contexte.
- Des sections de liens, facultatives, chacune avec un intertitre et une liste de pages, suivies si besoin d’une courte note. Une section nommée « Optional » regroupe ce qu’une IA peut sauter quand elle manque de place.
D’où vient l’idée ? Le texte de llmstxt.org indique que le fichier sert d’abord à la documentation des logiciels, où les agents de programmation le suivent pour trouver les bonnes pages. Il évoque aussi, comme usage possible, une entreprise qui y décrirait « sa structure et ses règles », sans aucun chiffre de résultat. L’auteur écrit que « des milliers de sites » publient un llms.txt : c’est son affirmation, pas une mesure.
Un llms.txt aide-t-il à être cité par ChatGPT ou par Google ?
Pour Google, non : sa recherche, réponses IA comprises, n’utilise pas ce fichier (guide mis à jour le 13 juillet 2026). Pour ChatGPT, rien ne le montre en octobre 2026 : les deux relevés cités ici comptent des lectures, pas des citations, et l’étude d’EZY Research n’a relevé que 7 lectures par les robots d’OpenAI en 12 semaines sur 83 sites.
Ce que dit Google
Le guide de Google sur l’IA générative range « la création de fichiers texte d’IA superflus (comme llms.txt) » parmi les tactiques qu’on peut ignorer pour sa recherche. Il ajoute qu’on peut tout à fait en créer « pour d’autres services », mais que cela « n’aura aucune incidence sur la visibilité ou le classement » dans Google, qui les ignore. Cette position vaut pour Google seulement : elle ne dit rien de ChatGPT.
Ce que mesurent les journaux de serveur
Les journaux de serveur sont le registre où un site note chaque visite, robot compris. Deux relevés indépendants les ont lus.
L’étude d’EZY Research, publiée le 27 juillet 2026, a suivi 83 sites qui avaient un llms.txt en ligne, du 27 avril au 19 juillet 2026. Voici, robot par robot et sous les noms que donne l’étude, le nombre de lectures de chaque fichier sur la même période :
| Robot (nom dans l’étude) | Lectures du llms.txt | Lectures du robots.txt |
|---|---|---|
| OpenAI (famille GPT) | 7 | 3 990 |
| Anthropic (ClaudeBot) | 9 | 3 120 |
| PerplexityBot | 0 | 775 |
| Googlebot | 67 | 5 125 |
| Meta-ExternalAgent | 193 | 172 |
Deux précautions. L’éditeur de l’étude précise lui-même que son panel penche vers de petites entreprises qui cherchaient ce genre d’outil. Et l’étude compte des lectures du fichier, pas des citations : un robot qui lit un fichier ne cite pas forcément le site. Seul le robot de Meta lit le llms.txt plus souvent que le robots.txt. Sa conclusion : le fichier est « une assurance peu coûteuse », mais qui le vend « comme ce qui vous fait citer » vend au-delà des preuves.
L’agence SeoMix a fait le même genre de test, publié dans un article de son blog (mis à jour le 16 juin 2026). Sur 6 de ses sites, pendant 60 jours en avril et mai 2026, elle a relevé 33 092 passages de robots d’IA, 2 249 adresses lues par les robots, et aucun appel au fichier llms.txt.
Ce que disent les éditeurs d’IA
Google dit ne pas utiliser le fichier. SeoMix écrit qu’OpenAI, Perplexity, Mistral et Meta n’en parlent jamais. L’agence Adimeo écrivait le 5 janvier 2026, dans « LLMS.txt : nouveau fichier miracle ou fausse bonne idée ? », qu’OpenAI et Anthropic « n’ont pour l’instant pas annoncé de support officiel ». Les deux articles reprennent une phrase de John Mueller, de Google, que SeoMix date d’avril 2025 : « Autant que je sache, aucun des services d’IA n’a dit qu’il utilisait LLMS.txt » (traduction d’Adimeo).
C’est quoi le robots.txt, et quelle différence avec le llms.txt ?

Le robots.txt est le fichier qui dit aux robots quelles pages ils ont le droit de lire. Selon la présentation du fichier robots.txt par Google (page mise à jour le 18 décembre 2025), il « indique aux robots d’exploration d’un moteur de recherche les URL auxquelles il peut accéder sur votre site ». Le llms.txt, lui, ne donne ni n’interdit aucun accès : il présente le site à une IA qui le consulte.
La proposition llmstxt.org fait elle-même la différence : le robots.txt dit quels accès sont jugés acceptables, le llms.txt sert « à la demande », quand un agent a besoin d’une information pour aider quelqu’un. Pour un dirigeant, la conséquence est simple :
- Le robots.txt peut vous retirer des réponses de ChatGPT. La page d’OpenAI sur ses robots l’écrit : « les sites qui ont exclu OAI-SearchBot n’apparaîtront pas dans les réponses de recherche de ChatGPT, mais peuvent encore apparaître comme liens de navigation ». OpenAI recommande de l’autoriser.
- OpenAI propose deux réglages à ne pas confondre. Le réglage OAI-SearchBot concerne la recherche de ChatGPT. Le réglage GPTBot concerne l’entraînement des modèles. Les deux sont indépendants : vous pouvez refuser GPTBot et rester visible dans la recherche si OAI-SearchBot est autorisé. Un troisième robot, ChatGPT-User, visite une page quand un utilisateur le demande ; OpenAI précise que le robots.txt peut ne pas s’appliquer à lui et qu’il ne sert pas à décider de l’apparition dans la recherche.
- Une correction met un peu de temps. OpenAI indique qu’il faut environ 24 heures après une modification du robots.txt pour que sa recherche en tienne compte.
- Le robots.txt ne cache pas une page de Google. Google précise qu’il « ne sert pas à empêcher qu’une page Web figure dans les résultats de recherche Google ». Pour cela, il faut bloquer l’indexation avec noindex ou protéger la page par un mot de passe.
À quoi ressemble un blocage ? Dans les règles de Google pour rédiger un robots.txt, l’exemple « bloquer seulement Googlebot » tient en deux lignes : User-agent: Googlebot, puis Disallow: /.
Comment trouver le robots.txt (et le llms.txt) d’un site ?
Ajoutez /robots.txt après le nom de domaine, par exemple https://www.votresite.fr/robots.txt, et ouvrez l’adresse dans votre navigateur. Google impose cet emplacement : le fichier se trouve à la racine, jamais dans un sous-dossier, et il n’y en a qu’un par site. Le llms.txt se cherche à l’adresse /llms.txt : c’est à la racine que la page de l’audit Lighthouse de Chrome conseille de le placer, et la proposition llmstxt.org admet aussi un sous-dossier.
Les mêmes règles de Google pour rédiger un robots.txt (page mise à jour le 4 décembre 2025) conseillent d’ouvrir l’adresse dans une fenêtre de navigation privée. Votre contrôle tient en trois points :
- Le fichier s’affiche. Une page introuvable (erreur 404) signifie qu’il n’est pas à cet endroit.
- Aucune ligne ne ferme le site aux robots de recherche. Cherchez les noms OAI-SearchBot et Googlebot, et regardez s’ils sont suivis d’un
Disallow: /. - Le llms.txt, s’il existe, répond sans erreur. L’outil d’audit Lighthouse de Chrome contrôle ce point : d’après sa page sur l’audit llms.txt (mise à jour le 5 mai 2026), il signale une erreur de serveur, et note un fichier absent comme « Non applicable », car sa présence est « facultative pour le moment ».
Si votre site est suivi dans Google Search Console, l’outil de Google pour surveiller sa présence dans la recherche, Google y propose un « rapport robots.txt » pour contrôler un fichier déjà en ligne.
Faut-il mettre un llms.txt sur le site de votre PME ?
Je recommande de le mettre, à une condition : qu’il ne passe ni avant le robots.txt, ni avant vos pages. Trois faits fondent ce conseil. Google le juge inutile pour sa recherche (guide du 13 juillet 2026). Les robots d’OpenAI, d’Anthropic et de Perplexity le lisent très peu (EZY, 27 juillet 2026). Mais il tient en quelques lignes, et le robot de Meta le lit déjà plus souvent que le robots.txt.
SeoMix tranche dans l’autre sens : à la question « Faut-il créer le fichier llms.txt ? », l’agence répond « Non », et ajoute qu’il aide vos concurrents à comprendre votre stratégie de visibilité. Je comprends l’argument, mais je ne le suis pas pour une PME : à mon avis, un fichier qui ne liste que des pages déjà publiques montre peu de chose qu’un concurrent ne voie déjà en visitant le site. Ce que je refuse, c’est qu’on vous le vende comme la clé des réponses de ChatGPT. Ce n’est pas ce que mesurent les sources.
L’ordre que je conseille à un dirigeant de PME :
- Vérifier le robots.txt : OAI-SearchBot et Googlebot doivent pouvoir lire le site. D’après OpenAI, exclure OAI-SearchBot retire le site des réponses de recherche de ChatGPT.
- Soigner les pages qui répondent aux questions de vos clients : une réponse claire en tête de chaque intertitre, des chiffres datés, des preuves. C’est la méthode détaillée dans le guide pratique du GEO pour être cité par les IA, et c’est là que je place l’effort pour être cité.
- Poser un llms.txt propre, sans rien en attendre de mesurable.
Si le point 2 bloque, regardez d’abord si les pages du site décrivent l’entreprise au lieu de répondre aux questions que les clients tapent dans Google ou posent à ChatGPT. C’est précisément ce que je reprends avec les dirigeants dans l’accompagnement SEO et GEO pour PME : vérifier l’accès des robots, puis réécrire les pages qui doivent être citées. Si vous préférez que votre équipe sache le faire elle-même, le sujet existe aussi en formation IA appliquée au référencement. Pour savoir quoi confier à ChatGPT dans ce travail et quoi vérifier soi-même, cet autre guide sur ChatGPT et le référencement détaille la méthode.
Comment écrire un llms.txt simple ?

Ouvrez un éditeur de texte brut, écrivez un titre avec le nom de l’entreprise, une ligne de résumé, puis deux ou trois listes de liens vers vos pages clés avec une courte note chacune. Enregistrez le fichier sous le nom llms.txt, déposez-le à la racine du site, et ouvrez votresite.fr/llms.txt pour vérifier qu’il s’affiche.
Un exemple : le llms.txt d’une menuiserie de 12 salariés
Scénario imaginé pour l’exemple : l’entreprise, son nom et son adresse web sont inventés.
Prenons une menuiserie de 12 salariés qui fabrique et pose des fenêtres, des portes, des escaliers et des agencements sur mesure. Son site compte une dizaine de pages. Voici à quoi pourrait ressembler son fichier :
# Menuiserie Exemple
> Menuiserie de 12 salariés : fabrication en atelier et pose de fenêtres, portes, escaliers et agencements sur mesure, pour les particuliers et les professionnels. Devis gratuit sur rendez-vous.
Toutes les pièces sont fabriquées dans notre atelier. Nous intervenons en neuf et en rénovation.
## Nos réalisations et services
- [Fenêtres et portes-fenêtres](https://www.menuiserie-exemple.fr/fenetres/): bois, aluminium et mixte, en neuf et en rénovation
- [Escaliers sur mesure](https://www.menuiserie-exemple.fr/escaliers/): droits, quart tournant, hélicoïdaux, avec photos de chantiers
- [Agencement intérieur](https://www.menuiserie-exemple.fr/agencement/): dressings, cuisines, bibliothèques
## Infos pratiques
- [Demander un devis](https://www.menuiserie-exemple.fr/devis/): formulaire, délai de réponse, zone d'intervention
- [Questions fréquentes](https://www.menuiserie-exemple.fr/faq/): garanties, délais de fabrication, entretien du bois
## Optional
- [Notre histoire](https://www.menuiserie-exemple.fr/a-propos/): l'atelier, l'équipe, les savoir-faire
Ligne par ligne :
# Menuiserie Exemple: le titre, seule ligne obligatoire. Le nom tel que les clients le cherchent.- La ligne qui commence par
>: le résumé. Une IA qui ne lirait que cette ligne doit comprendre qui vous êtes, ce que vous faites et pour qui. - Le paragraphe libre : un fait utile qui ne tient pas dans le résumé, ici la fabrication en atelier.
## Nos réalisations et services: une section de liens. Chaque ligne donne une page et, après les deux-points, ce qu’on y trouve.## Infos pratiques: les pages qui servent à la décision du client, devis et questions fréquentes.## Optional: ce qu’une IA peut sauter. Le nom anglais est la convention prévue par la proposition.
Les conseils d’écriture de llmstxt.org se résument en peu de mots : langage concis, une courte description pour chaque lien. Je conseille de n’y mettre que des pages déjà publiques.
Poser le fichier : cinq gestes
- Écrire le texte dans un éditeur de texte brut, jamais dans un traitement de texte.
- Enregistrer sous le nom exact
llms.txt. - Déposer le fichier à la racine du site, au même niveau que la page d’accueil, par le gestionnaire de fichiers de votre hébergeur ou par votre prestataire. Sur WordPress, les extensions Yoast SEO et AIOSEO peuvent le générer, d’après la liste d’outils de llmstxt.org.
- Vérifier en ouvrant
votresite.fr/llms.txtdans une fenêtre de navigation privée. - Le tester comme le propose llmstxt.org : donnez à une IA ce seul fichier comme point de départ et posez-lui des questions sur votre entreprise.
Et si ce dernier test révèle que vos pages elles-mêmes répondent mal, c’est là que se trouve le vrai chantier, bien plus que dans le fichier.
Sources
- Jeremy Howard, « The /llms.txt file, v2 », proposition du 3 septembre 2024, modifiée le 10 août 2026.
- Google Search Central, guide sur l’IA générative dans la recherche Google, mise à jour le 13 juillet 2026.
- EZY Research, « We put llms.txt on 83 websites. In 12 weeks, OpenAI’s crawler read it 7 times », 27 juillet 2026.
- SeoMix, Daniel Roch, article sur le fichier llms.txt et le GEO, mise à jour le 16 juin 2026.
- Adimeo, Guénaëlle Retourné, « LLMS.txt : nouveau fichier miracle ou fausse bonne idée ? », 5 janvier 2026.
- OpenAI, « Overview of OpenAI Crawlers », page non datée, lue le 2 octobre 2026.
- Google Search Central, présentation du fichier robots.txt, mise à jour le 18 décembre 2025.
- Google Search Central, règles pour rédiger un fichier robots.txt, mise à jour le 4 décembre 2025.
- Chrome for Developers, « llms.txt », audit Lighthouse, mise à jour le 5 mai 2026.
Questions fréquentes
Le llms.txt fait-il citer mon site par ChatGPT ?
Aucune des sources lues pour cet article ne le montre (octobre 2026). Sur 83 sites suivis pendant 12 semaines (EZY Research, étude du 27 juillet 2026), les robots d’OpenAI ont lu le llms.txt 7 fois, contre 3 990 fois le robots.txt, et l’étude compte des lectures, pas des citations.
Google utilise-t-il le fichier llms.txt ?
Non. Son guide sur l’IA générative dans la recherche, mis à jour le 13 juillet 2026, écrit qu’il est inutile de créer ce type de fichier pour apparaître dans la recherche Google, réponses IA comprises, car la recherche Google ne l’utilise pas. Google ajoute qu’on peut en publier un pour d’autres services, sans effet sur la visibilité dans Google.
Quelle différence entre le robots.txt et le llms.txt ?
Le robots.txt dit aux robots quelles pages ils ont le droit de lire : bloquer OAI-SearchBot, le robot de recherche de ChatGPT, retire par exemple un site des réponses de recherche de ChatGPT, d’après OpenAI. Le llms.txt ne donne ni n’interdit aucun accès : il présente le site à une IA qui le consulte, comme un sommaire.
Où se trouve le llms.txt d’un site ?
À la racine, l’emplacement que conseille Lighthouse : ajoutez /llms.txt après le nom de domaine (par exemple votresite.fr/llms.txt) et ouvrez l’adresse dans une fenêtre de navigation privée. La proposition admet aussi un fichier dans un sous-dossier, par exemple /docs/llms.txt. Une page introuvable (erreur 404) à la racine signifie que le site n’en a pas à cet endroit. Le fichier reste facultatif : l’audit Lighthouse de Chrome note son absence comme « Non applicable ».