Depuis un an, le fichier llms.txt est présenté comme le passage obligé pour « être lu par ChatGPT ». Des prestations entières de référencement IA se vendent sur cette promesse. Le 1er octobre 2026, dans le podcast officiel de Google Search Central, John Mueller a donné un avis nettement plus sobre : l'espoir placé dans llms.txt est « plus grand que la réalité ». Et ce qu'il observe vraiment dans ses journaux de serveur, ce sont des robots d'IA qui lisent deux fichiers beaucoup plus anciens : le plan de site XML et le flux RSS.
Ce n'est pas une révolution, plutôt un rappel à l'ordre utile. Voici ce qui a été dit, ce qu'il ne faut pas en conclure, et la liste des réglages à vérifier sur votre site avant de dépenser un euro en « GEO ».
Ce que Google a dit, mot pour mot
L'épisode 114 de Search Off the Record, intitulé « Do sitemaps still matter? », réunit John Mueller et Martin Splitt, de l'équipe Search Relations de Google. Il dure environ 26 minutes et Google en a publié la transcription. Trois passages concernent directement les robots d'IA :
- Ce qu'il voit dans ses journaux. « J'ai vu ça dans mes journaux de serveur : un robot d'IA accède à mon fichier sitemap, le lit, et en fait quelque chose. » Il dit avoir observé la même chose avec ses flux RSS.
- Pourquoi le nom du fichier compte pour eux. Les robots d'entraînement des IA « n'ont en général aucune console » où l'on pourrait soumettre un sitemap, contrairement à Google ou Bing. Ils trouvent donc ce qui est trouvable. Son conseil : « soit vous gardez le nom générique, sitemap.xml, soit vous misez sur les flux RSS ». Un flux RSS est facile à découvrir parce qu'il est en général déclaré dans l'en-tête HTML des pages.
- Sur llms.txt. Interrogé sur le remplacement du sitemap XML par llms.txt, il répond « non ». Il le compare à un plan de site HTML (une page de liens pour humains), sans format strict, donc inutilisable comme sitemap par Google. « Je pense que l'espoir est plus grand que la réalité », puis : « pour l'instant, rien de tout ça ne se produit ». Il n'interdit pas d'essayer, mais ne s'y fierait pas.
Ce qu'il ne faut pas en conclure
Deux nuances, pour rester honnête.
Mueller ne dit pas que le sitemap vous fait citer par ChatGPT. Il constate que des robots d'IA le lisent, et précise lui-même qu'il ignore ce que les éditeurs d'IA en font. Un sitemap aide à être découvert, pas à être choisi.
Mueller parle pour Google, pas pour OpenAI, Anthropic ou Perplexity. Son avis sur llms.txt est celui d'un observateur très bien placé, pas une documentation de ChatGPT. Mais aucun grand éditeur d'IA n'a publié, à notre connaissance, d'engagement à suivre ce fichier. La charge de la preuve reste du côté de ceux qui le vendent.
Les six réglages qui comptent vraiment
La bonne nouvelle : tout ce qui suit est gratuit ou presque, et sert à la fois Google, Bing et les robots d'IA.
| Réglage | Ce que Google en a dit | À vérifier chez vous |
| Un sitemap au nom standard | Les robots d'IA n'ont pas de console : un nom générique est trouvable, un nom exotique ne l'est pas. | Que votresite.re/sitemap.xml réponde, et qu'il soit déclaré dans robots.txt. |
| Des URL propres dans le sitemap | Lister les URL canoniques, sans paramètres de suivi. Une URL listée a « un peu plus de chances » d'être retenue comme canonique. | Aucune URL avec ?utm_, aucune page redirigée ou en erreur. |
| Une date de modification honnête | Google utilise lastmod quand les dates sont crédibles, et l'ignore quand toutes les pages portent la date du jour. Les champs priority et changefreq ne sont plus utilisés. | Que la date corresponde à une vraie modification du contenu, pas à la date de génération du fichier. |
| Un flux RSS pour vos actualités | Un flux RSS peut être soumis comme sitemap dans la Search Console, et il est facile à découvrir pour les robots. | Que votre blog ou vos actualités aient un flux, déclaré dans l'en-tête des pages (balise link rel="alternate"). |
| Ne pas fermer la porte par erreur | Hors podcast, mais logique : un robot bloqué ne lit rien. | Que votre hébergeur ou votre pare-feu ne bloque pas les robots d'IA sans que vous l'ayez décidé. |
| La qualité avant la technique | Un statut « Impossible de récupérer » sur un sitemap valide peut venir de la charge du serveur, mais aussi de la qualité perçue du site : « ce n'est pas purement technique ». | Si le problème persiste dans la Search Console, regarder le contenu avant le fichier. |
Sur le cinquième point, nous avons expliqué en septembre comment Cloudflare bloque désormais les robots d'IA par défaut : c'est la première vérification à faire si votre site passe par ce service. Un sitemap parfait ne sert à rien derrière une porte fermée.
Et llms.txt, faut-il le supprimer ?
Non. S'il existe déjà, il ne coûte rien et ne nuit à rien. Le problème n'est pas le fichier, c'est ce qu'on lui fait porter. Un llms.txt ne compense pas un sitemap qui liste des pages mortes, un site lent ou un contenu qui ne répond à aucune question précise.
Notre position est simple : si une prestation de « référencement IA » commence par llms.txt et ne vous parle ni de votre sitemap, ni de vos pages canoniques, ni de la qualité de vos contenus, elle commence par la fin. Demandez ce qui est mesuré, et comment.
Pour une entreprise réunionnaise, concrètement
Les CMS et plateformes courants (WordPress, Shopify, Wix) génèrent déjà un sitemap. Le travail consiste rarement à en créer un, mais à vérifier qu'il dit la vérité : pas de pages de test oubliées, pas d'anciennes adresses d'avant la refonte, des dates qui bougent quand le contenu bouge. Si vous avez changé de site récemment, notre guide sur la refonte sans perdre son référencement détaille la partie redirections.
Pour la suite, deux lectures complètent celle-ci : ce que change la recherche « zéro clic » et le référencement IA, et comment mesurer ce que l'IA vous rapporte dans la Search Console.
Ces réglages sont la base de chaque site vitrine que nous livrons depuis notre studio à La Réunion. Si vous voulez savoir ce que votre site montre réellement aux robots, un audit gratuit fait le tour de la question, ou écrivez-nous directement.
Sources : Google Search Central, podcast Search Off the Record, épisode 114 « Do sitemaps still matter? », 1er octobre 2026 ; Search Engine Journal, octobre 2026 ; PPC Land, 5 octobre 2026 ; Relevant Audience, octobre 2026.