llms.txt, le fichier que Google ignore
Un fichier circule depuis plus d’un an comme la clé pour être cité par ChatGPT. Google a confirmé ne pas le lire, aucun grand moteur d’IA n’a annoncé le prendre en charge, et son effet mesuré sur les citations reste proche de zéro. Pendant ce temps, un réglage bien plus déterminant rend des sites entiers invisibles aux mêmes IA, sans que personne s’en aperçoive.
Ce que le fichier promet
L’idée part d’un problème réel, et c’est ce qui la rend crédible.
Une page web moderne contient une quantité considérable de code de mise en forme pour une quantité modeste de texte utile. Une machine qui veut comprendre votre site doit trier tout cela, ce qui coûte du temps et de la puissance de calcul.
Le fichier llms.txt propose une solution simple. Un document texte déposé à la racine du site, écrit dans un format lisible, qui présente l’activité et liste les pages importantes avec une phrase de description. Un plan de lecture écrit pour les machines plutôt qu’un site à déchiffrer.
Le concept est honnête, porté par un chercheur identifié, et adopté par quelques entreprises sérieuses qui l’utilisent surtout pour documenter leurs interfaces techniques. Rien de tout cela ne relève de la magie ou de l’arnaque.

Ce que le fichier fait réellement
Le décalage entre la promesse et les faits est net.
- Google a confirmé ne pas l’utiliser. John Mueller, porte-parole du moteur sur les sujets de référencement, a indiqué qu’il n’était pas nécessaire pour la visibilité dans les réponses générées.
- Aucun grand acteur de l’IA n’a annoncé le prendre en charge, plus d’un an après la publication de la spécification.
- Les mesures d’impact sur les citations donnent un effet faible à nul.
Faut-il pour autant le jeter ? Non, et notre position tient en une ligne. Nous en avons un sur ce site, nous ne le facturons à personne.
La raison est simple. Créer ce fichier prend 20 minutes, ne présente aucun risque, et documente proprement le site pour le jour où un moteur déciderait de s’en servir. C’est un pari à coût quasi nul.
En revanche, dès qu’un prestataire le présente comme un levier de visibilité et le facture à ce titre, la conversation change de nature. On vous vend une certitude sur un sujet où il n’y en a aucune, pendant que le vrai problème reste en place.

Le vrai coupable, invisible dans le navigateur
Voici le réglage qui décide vraiment, et il n’a rien à voir avec un fichier.
Les robots de ChatGPT, de Claude et de Perplexity n’exécutent pas le JavaScript. Ils lisent le code HTML brut renvoyé par votre serveur, et ils s’arrêtent là.
Si votre site affiche son contenu seulement une fois les scripts exécutés dans le navigateur, ces machines voient une page vide. Vous pouvez avoir le meilleur article du web sur votre sujet, avec un llms.txt impeccable, elles ne liront rien.
La nuance qui suit est importante, parce qu’elle explique des situations qui paraissent incohérentes.
- Ne rendent pas le JavaScript. Les robots d’OpenAI, d’Anthropic et de Perplexity.
- Rendent le JavaScript. Google-Extended, qui alimente Gemini, et AppleBot-Extended, qui utilisent le même moteur de rendu que leurs versions classiques. Plusieurs modèles comme Mistral, DeepSeek ou Qwen l’exécutent également.
Autrement dit, une entreprise peut être correctement citée par Gemini et parfaitement absente de ChatGPT, pour une raison purement technique. Le contenu n’est pas en cause, sa livraison l’est.
C’est aussi pour cette raison que ce site est construit en pages générées à l’avance plutôt qu’assemblées dans le navigateur. Le serveur renvoie le texte complet dès la première réponse.

Le test en 30 secondes
Vous pouvez vérifier votre situation vous-même, sans outil et sans compétence technique.
- Ouvrez une page importante de votre site, une page de service plutôt que l’accueil.
- Affichez le code source, avec un clic droit puis l’option d’affichage du code source de la page. Attention, ce n’est pas l’inspecteur d’éléments, qui montre la page après exécution des scripts et vous donnerait une fausse bonne nouvelle.
- Cherchez une phrase de votre texte avec la fonction de recherche du navigateur.
- Si la phrase apparaît, votre contenu est livré directement et toutes les IA le voient.
- Si elle n’apparaît pas, votre contenu est assemblé dans le navigateur, et une partie des moteurs d’IA ne le lit pas.
Deuxième vérification, tout aussi rapide. Ouvrez l’adresse de votre site suivie de robots.txt et cherchez-y les noms GPTBot, ClaudeBot, PerplexityBot et Google-Extended. Beaucoup de sites bloquent ces robots sans le savoir, par héritage d’une ancienne configuration ou d’une extension de sécurité installée pour d’autres raisons.
Bloquer ces robots reste un choix défendable si vous refusez que vos contenus alimentent les modèles. Il doit simplement être délibéré.

Les 5 réglages qui comptent à la place
Voici où va l’effort, par ordre de rendement.
- Livrez le texte dès la première réponse du serveur. C’est le réglage numéro 1, et le seul qui puisse faire passer un site de l’invisibilité complète à la lisibilité totale. Sur un site vitrine, la génération de pages à l’avance suffit.
- Placez la réponse en tête de page. Les modèles prélèvent des passages qui se suffisent à eux-mêmes. Une phrase qui répond directement à la question, juste après le titre, sans dépendre du paragraphe précédent, a bien plus de chances d’être reprise.
- Rendez votre identité impossible à confondre. Nom exact, métier, ville, preuves vérifiables. Une machine qui hésite sur qui vous êtes cite celui qui était clair. Les données structurées servent précisément à cela.
- Publiez régulièrement plutôt que massivement. Interrogés sur ce qui déclenche une citation, les professionnels du contenu placent la fraîcheur en tête à 91%, et l’ancienneté du domaine en dernier à 17%. Une petite structure active passe devant un site installé qui dort.
- Soignez ce qui se dit de vous ailleurs. Ce que le reste du web raconte sur votre entreprise pèse davantage, dans le choix d’une IA, que ce que vous écrivez sur votre propre site. C’est le prolongement direct du travail sur les mentions et les liens.
Aucun de ces 5 points ne dépend d’un fichier à la mode. Tous relèvent du même travail de fond, celui qui explique pourquoi certaines marques traversent l’effondrement du trafic Google sans perdre leur chiffre d’affaires. C’est ce que couvre notre prestation d’optimisation pour les IA.

Les liens utiles à garder sous la main
Gardez ces pages ouvertes pendant votre vérification.
Questions fréquentes
Un site sur mesure, piloté par des experts
À Montpellier, on conçoit, développe et pilote votre présence web. Vous restez concentré sur vos clients, on gère la technique et le contenu.
Faire le point sur votre siteUne équipe IA qui accélère votre visibilité
SEO, rédaction, réseaux sociaux, publicité et veille. 12 agents IA métier travaillent en continu pour générer du trafic et des leads.
Voir les 12 agents