GEO technique : llms.txt, rendu, accès des robots
Définition
Le GEO technique regroupe les réglages — accès des robots, rendu des pages, vitesse,
fichiers d’orientation comme llms.txt — qui permettent aux moteurs génératifs
d’atteindre et de lire un site, condition préalable à toute citation.
À quoi ça sert
- Lever une invisibilité qu’on ignore : 73 % des sites opposeraient une barrière technique aux robots d’IA (OtterlyAI, 2026 — chiffre d’un éditeur d’outils de suivi, à lire comme un ordre de grandeur).
- Arbitrer entre visibilité et charge serveur : les robots d’IA pèsent 51,69 % du trafic des robots, contre 34,46 % pour ceux des moteurs classiques (Search Engine Journal, 2026). Tous ne rendent pas ce qu’ils prennent.
- Ne pas en attendre la citation : la technique ouvre la porte, rien de plus. Un site parfaitement accessible dont aucun passage ne mérite d’être retenu reste hors des réponses.
Les 3 erreurs
- Fermer la porte à tous les robots d’IA d’un seul
Disallow. Bloquer GPTBot se défend ; bloquer OAI-SearchBot ou PerplexityBot revient à quitter les réponses. La frontière entre entraînement et recherche reste floue chez certains fournisseurs : c’est un compromis, pas une garantie. - Attendre un gain de
llms.txt. L’étude SE Ranking, sur 300 000 domaines, ne trouve aucun lien entre le fichier et la fréquence de citation ; le retirer du modèle en améliorait même la précision. Aucun grand fournisseur n’a confirmé le lire. - Conclure de « le robot passe » à « je suis cité ». Le crawl n’est que l’entrée. Sans passage autonome ni donnée propre, le robot indexe et l’évaluation écarte.
Repères
| Repère | Valeur | Source |
|---|---|---|
| Sites opposant une barrière aux robots d’IA | 73 % | OtterlyAI 2026, éditeur d’outils |
| Pages lues par visite renvoyée, GPTBot | 1 276 | SEOmator 2026 |
| Pages lues par visite renvoyée, PerplexityBot | 111 | SEOmator 2026 |
| Crawl de ChatGPT rapporté à celui de Googlebot | 3,6 fois | Search Engine Journal 2026 |
Domaines dotés d’un llms.txt |
10,13 % | SE Ranking, 300 000 domaines |
| Robots d’IA qui exécutent JavaScript | Gemini et AppleBot seulement | Vercel et MERJ, décembre 2024 |
| Délai du premier octet visé | 0,8 s | seuil Google, voir SEO technique ; aucun fournisseur d’IA ne publie le sien |
Critère de réussite : vos journaux montrent OAI-SearchBot et PerplexityBot sur vos pages clés, et ces pages affichent tout leur texte une fois JavaScript désactivé.
Comment faire
robots.txtavec l’arbre ci-dessous. Plancher commun : OAI-SearchBot, ChatGPT-User, PerplexityBot, Googlebot et Bingbot autorisés. Un éditeur qui protège un contenu payant peut tout fermer, en acceptant de disparaître des réponses.robots.txtirréprochable ne sert à rien derrière.llms.txtsi cela vous coûte une heure, pas davantage : un fichier Markdown à la racine, avec un titre, un résumé en citation, puis des sections de liens décrits, les contenus secondaires sous « Optional ».dateModified) : les modèles y lisent la fraîcheur. Le reste relève de la fiche sur les données structurées.