Une fondation commune avant de parler de GEO
Les moteurs de réponse ne remplacent pas les fondamentaux du référencement. Une page doit pouvoir être explorée, renvoyer un code HTTP correct, déclarer une URL canonique cohérente et être autorisée à apparaître dans les extraits.
Google indique que les pratiques SEO habituelles restent valables pour ses fonctionnalités IA. Il n'existe pas de balisage spécial à ajouter pour y apparaître. Une page bloquée, en noindex ou absente de l'index part donc avec le même handicap dans la recherche classique et dans une réponse générative.
Le bon ordre de travail est simple : corriger l'indexation, clarifier l'intention de chaque page, renforcer les preuves, puis mesurer la visibilité. Ajouter des fichiers destinés aux LLM sur un site que Google indexe mal ne traite pas la cause.
Autoriser les bons robots sans confondre recherche et entraînement
Chaque fournisseur distingue plusieurs usages. Les noms ci-dessous doivent être vérifiés dans la documentation officielle avant toute modification, car ils peuvent évoluer :
| Fournisseur | Recherche ou réponse | Autre usage |
|---|---|---|
| Googlebot | Google-Extended concerne certains usages d'entraînement, pas le classement dans Google Search | |
| OpenAI | OAI-SearchBot et ChatGPT-User | GPTBot concerne l'entraînement |
| Anthropic | Claude-SearchBot et Claude-User | ClaudeBot concerne l'entraînement |
| Perplexity | PerplexityBot | Consulter la documentation pour les autres agents |
Le contrôle technique à faire URL par URL
Un robots.txt permissif ne suffit pas. La page elle-même et tout ce qu'elle charge doivent rester exploitables. Pour chaque URL prioritaire, vérifiez :
- Code HTTP 200 sur l'URL canonique et une seule redirection pour les anciennes variantes
- Meta robots en index, follow et absence d'en-tête X-Robots-Tag contradictoire
- Canonical absolu qui pointe vers la page elle-même
- Présence dans un sitemap propre, sans URL redirigée, en erreur ou en noindex
- Contenu principal disponible dans le HTML, sans dépendre d'une interaction JavaScript
- Robots de recherche autorisés dans robots.txt et réponses serveur non bloquées par un pare-feu
- Données structurées conformes au contenu visible, sans adresse locale ou avis inventé
- Liens internes depuis des pages déjà indexées et réellement liées au sujet
Ce que llms.txt peut faire, et ce qu'il ne fait pas
Un fichier llms.txt peut offrir un sommaire lisible aux outils qui choisissent de le consulter. Il peut lister l'identité du site, ses services, ses ressources et ses URL canoniques. C'est un complément documentaire pratique.
Ce fichier n'est toutefois ni un standard de classement universel ni un raccourci vers Google AI. La documentation Google précise que Google n'utilise pas llms.txt pour ses fonctionnalités de recherche IA. Le fichier ne remplace donc jamais un sitemap, des liens internes, une page indexable ou une source externe qui confirme l'expertise du site.
S'il est publié, gardez-le court, exact et synchronisé avec les pages publiques. Une offre supprimée ou une promesse obsolète dans llms.txt crée une contradiction au lieu d'améliorer la compréhension.
Écrire une page que les moteurs peuvent citer
Une page citable ne répète pas vingt fois un mot-clé. Elle permet d'identifier rapidement une question, une réponse et la preuve qui la soutient.
Commencez les sections importantes par une réponse directe. Ajoutez ensuite la méthode, les limites, la date et la source. Les tableaux sont utiles pour comparer des options ; les listes sont utiles pour une procédure ; les paragraphes restent préférables quand une nuance doit être expliquée.
La différence se fait surtout sur ce que les autres pages ne peuvent pas résumer sans vous citer : données propriétaires datées, méthode originale, photos réelles, résultats vérifiables, outils interactifs, définitions précises ou étude d'un marché local fondée sur une source publique. Une reformulation générique de dix articles existants n'apporte aucune raison de choisir votre site comme source.
Rendre l'entreprise et ses preuves faciles à relier
Les moteurs doivent comprendre qui publie, sur quel sujet et avec quelles preuves. Cette cohérence se construit sur le site et hors du site :
- Nom de l'entreprise, activité, zone réelle et coordonnées cohérents sur les pages publiques
- Page À propos qui explique la méthode, les limites et les responsabilités de l'agence
- Réalisations accessibles avec contexte, actions menées et éléments vérifiables
- Sources externes primaires reliées aux chiffres et aux affirmations sensibles
- Données structurées Organization, Article, Service ou Breadcrumb adaptées à la page
- Citations et liens provenant de partenaires, médias, associations ou répertoires légitimes
- Aucune fausse implantation locale, aucune citation client fabriquée et aucune garantie de position
Pour une recherche locale, la fiche Google reste centrale
Une réponse locale dépend de signaux géographiques que le site ne porte pas seul. La fiche d'établissement Google doit décrire une activité et une implantation réelles, avec la bonne catégorie, des horaires exacts, des services, des photos et des avis auxquels l'entreprise répond.
Les pages locales du site doivent ensuite couvrir les zones réellement desservies. Une page par ville n'est utile que si elle apporte un contexte propre : secteurs présents, questions locales, modalités d'intervention, réalisations proches ou données publiques citées. Copier le même argumentaire en changeant le nom de la ville produit des pages interchangeables que Google peut choisir de ne pas indexer.
Le balisage Service avec areaServed décrit une zone couverte. Le balisage LocalBusiness avec une adresse ne doit être utilisé que pour un véritable établissement à cette adresse.
Mesurer ce qui est observé, sans inventer une attribution
Aucun outil ne donne à lui seul une mesure complète. Search Console montre les clics, impressions et positions dans Google. Les outils d'analyse peuvent identifier certains référents, par exemple les visites marquées utm_source=chatgpt.com. Les journaux serveur montrent le passage des robots autorisés. Les formulaires et appels mesurent enfin les demandes.
Gardez ces niveaux séparés. Une visite depuis ChatGPT prouve une visite, pas une citation. Une citation visible prouve que la page a été utilisée dans une réponse donnée, pas qu'elle générera un contact. Une hausse d'impressions Google ne prouve pas un chiffre d'affaires. Le suivi doit donc conserver la source, la date et le niveau de confiance de chaque signal.
Plan d'action sur 30 jours
Travaillez sur un petit nombre d'URL prioritaires avant d'étendre le périmètre :
- Semaine 1 : exporter Search Console, classer les URL indexées, exclues, redirigées et en erreur
- Semaine 1 : vérifier robots.txt, canonicals, sitemap, rendu HTML et codes HTTP
- Semaine 2 : choisir les pages qui ont déjà des impressions et répondre plus clairement à leur intention
- Semaine 2 : ajouter des sources primaires, preuves datées et liens internes contextuels
- Semaine 3 : corriger la fiche Google et les citations locales réellement utiles
- Semaine 3 : obtenir des mentions externes légitimes plutôt que publier de nouvelles pages faibles
- Semaine 4 : contrôler l'indexation, les requêtes, les référents IA, les logs et les conversions
- Fin du mois : conserver ce qui progresse, fusionner ou retirer ce qui reste sans valeur démontrée