GEO technique : llms.txt, rendu, accès des robots

Mise à jour : 2026-09-21 · 654 mots · 3 min

Définition

Le GEO technique regroupe les réglages — accès des robots, rendu des pages, vitesse, fichiers d’orientation comme llms.txt — qui permettent aux moteurs génératifs d’atteindre et de lire un site, condition préalable à toute citation.

À quoi ça sert

  • Lever une invisibilité qu’on ignore : 73 % des sites opposeraient une barrière technique aux robots d’IA (OtterlyAI, 2026 — chiffre d’un éditeur d’outils de suivi, à lire comme un ordre de grandeur).
  • Arbitrer entre visibilité et charge serveur : les robots d’IA pèsent 51,69 % du trafic des robots, contre 34,46 % pour ceux des moteurs classiques (Search Engine Journal, 2026). Tous ne rendent pas ce qu’ils prennent.
  • Ne pas en attendre la citation : la technique ouvre la porte, rien de plus. Un site parfaitement accessible dont aucun passage ne mérite d’être retenu reste hors des réponses.

Comment faire

  1. Cherchez les robots dans vos journaux serveur : GPTBot, OAI-SearchBot, ChatGPT-User, PerplexityBot, ClaudeBot. GPTBot sert surtout l’entraînement, OAI-SearchBot la recherche : voir passer le premier ne prouve pas que ChatGPT Search vous lit.
  2. Tranchez votre robots.txt avec l’arbre ci-dessous. Plancher commun : OAI-SearchBot, ChatGPT-User, PerplexityBot, Googlebot et Bingbot autorisés. Un éditeur qui protège un contenu payant peut tout fermer, en acceptant de disparaître des réponses.
  3. Contrôlez le pare-feu et le CDN. Cloudflare, Akamai et d’autres bloquent parfois les robots d’IA par défaut ; un robots.txt irréprochable ne sert à rien derrière.
  4. Servez le texte dans le HTML. GPTBot, OAI-SearchBot, ClaudeBot, PerplexityBot et Bytespider téléchargent les fichiers JavaScript sans les exécuter ; seuls Gemini et AppleBot rendent la page. Chargez-la scripts désactivés : ce qui manque n’existe pas pour la plupart d’entre eux.
  5. Tenez le serveur rapide et le site peu profond. Le seuil de la fiche SEO technique s’applique ici aussi : 0,8 seconde avant le premier octet, et le contenu important à trois clics de l’accueil. Un robot abandonne un site lent avant d’en avoir fait le tour.
  6. Posez un llms.txt si cela vous coûte une heure, pas davantage : un fichier Markdown à la racine, avec un titre, un résumé en citation, puis des sections de liens décrits, les contenus secondaires sous « Optional ».
  7. Datez vos pages dans le balisage (dateModified) : les modèles y lisent la fraîcheur. Le reste relève de la fiche sur les données structurées.
Quels robots d’IA laisser entrerArbre de décision. Si le crawl des robots d’IA pèse sur le serveur ou sur les droits d’auteur : bloquer les robots d’entraînement GPTBot et ClaudeBot, garder OAI-SearchBot et PerplexityBot. Sinon : autoriser tous les robots, ce qui est le cas de la plupart des PME.Le crawl des robots d’IA pèse-t-il survotre serveur ou vos droits d’auteur ?OuiBloquez GPTBot et ClaudeBotGardez OAI-SearchBotGardez PerplexityBotNonAutorisez tous les robotsCas de la plupart des PME
Bloquer un robot de recherche, c’est sortir des réponses de son moteur

Les 3 erreurs

  • Fermer la porte à tous les robots d’IA d’un seul Disallow. Bloquer GPTBot se défend ; bloquer OAI-SearchBot ou PerplexityBot revient à quitter les réponses. La frontière entre entraînement et recherche reste floue chez certains fournisseurs : c’est un compromis, pas une garantie.
  • Attendre un gain de llms.txt. L’étude SE Ranking, sur 300 000 domaines, ne trouve aucun lien entre le fichier et la fréquence de citation ; le retirer du modèle en améliorait même la précision. Aucun grand fournisseur n’a confirmé le lire.
  • Conclure de « le robot passe » à « je suis cité ». Le crawl n’est que l’entrée. Sans passage autonome ni donnée propre, le robot indexe et l’évaluation écarte.

Repères

Repère Valeur Source
Sites opposant une barrière aux robots d’IA 73 % OtterlyAI 2026, éditeur d’outils
Pages lues par visite renvoyée, GPTBot 1 276 SEOmator 2026
Pages lues par visite renvoyée, PerplexityBot 111 SEOmator 2026
Crawl de ChatGPT rapporté à celui de Googlebot 3,6 fois Search Engine Journal 2026
Domaines dotés d’un llms.txt 10,13 % SE Ranking, 300 000 domaines
Robots d’IA qui exécutent JavaScript Gemini et AppleBot seulement Vercel et MERJ, décembre 2024
Délai du premier octet visé 0,8 s seuil Google, voir SEO technique ; aucun fournisseur d’IA ne publie le sien

Critère de réussite : vos journaux montrent OAI-SearchBot et PerplexityBot sur vos pages clés, et ces pages affichent tout leur texte une fois JavaScript désactivé.

Voir aussi