Glossaire du GEO
85 termes de la visibilité dans les réponses des IA, définis en français. Du crawler au balisage, de la part de voix à l'ancrage : ce que chaque mot veut dire, et ce qu'il change concrètement.
Comment lire ce glossaire :
- Chaque définition va à l'essentiel et dit, quand c'est utile, ce que le terme change pour vous.
- Quand un terme est contesté ou instable, c'est écrit : le vocabulaire du GEO n'est pas stabilisé.
- Chaque entrée a son ancre — vous pouvez lier un terme précis.
Les fondamentaux
- GEO (Generative Engine Optimization)
- Ensemble des pratiques visant à être recommandé par les moteurs de réponse génératifs (ChatGPT, Gemini, Perplexity). Le GEO ne cherche pas une position dans une liste de liens : il cherche à faire partie de la réponse elle-même.
- AEO (Answer Engine Optimization)
- Terme employé comme synonyme de GEO par une partie du marché. Quand une nuance est faite, l'AEO insiste sur la réponse directe à une question, le GEO sur la génération d'un texte de synthèse.
- LLMO (Large Language Model Optimization)
- Troisième appellation du même sujet, centrée sur le modèle de langage plutôt que sur le moteur. Aucune des trois n'a encore de définition normalisée.
- SEO (Search Engine Optimization)
- Optimisation pour les moteurs de recherche classiques. Le GEO ne le remplace pas : les moteurs de réponse s'appuient largement sur les résultats de recherche, donc un site qui ne ranke pas part avec un handicap.
- LLM (grand modèle de langage)
- Modèle entraîné à prédire du texte, capable de rédiger une réponse en langage naturel. C'est le composant qui rédige la réponse, pas celui qui décide seul des sources.
- Moteur de réponse
- Système qui rend une réponse rédigée plutôt qu'une liste de liens. Il combine généralement une recherche web, une sélection de passages et un modèle de langage qui synthétise.
- Citation
- Fait, pour une marque ou une page, d'être nommée ou liée dans la réponse générée. C'est l'unité de mesure du GEO — l'équivalent fonctionnel de la position en SEO.
- Mention
- Apparition du nom d'une marque dans un contenu, sans lien nécessairement. Les mentions sur des sites tiers alimentent ce que le modèle sait d'une marque.
- Sélection
- Étape où le moteur choisit quelles sources entreront dans la réponse. C'est là que se joue le GEO : être indexé ne garantit pas d'être sélectionné.
- Zero-click
- Recherche qui se termine sans visite de site, l'utilisateur ayant obtenu sa réponse directement. Le trafic disparaît, la citation devient le seul point de contact.
- Query fan-out (éclatement de requête)
- Mécanisme par lequel un moteur transforme une question en plusieurs recherches distinctes avant de synthétiser. Une seule question utilisateur peut donc déclencher cinq à dix recherches.
- Grounding (ancrage)
- Fait de fonder une réponse sur des documents récupérés en direct plutôt que sur la seule mémoire du modèle. Une réponse ancrée cite des sources ; une réponse non ancrée restitue ce que le modèle a appris à l'entraînement.
- Mémoire du modèle
- Ce que le modèle restitue sans consulter le web, à partir de son entraînement. Mesurer une visibilité sur cette base renseigne sur la notoriété acquise, pas sur la citation en conditions réelles.
- RAG (génération augmentée par récupération)
- Architecture qui récupère des documents pertinents puis demande au modèle de rédiger à partir d'eux. C'est le schéma qui sous-tend la plupart des moteurs de réponse.
- Hallucination
- Affirmation inventée par le modèle, présentée avec assurance. Pour une marque, le risque est double : être absente, ou être décrite de travers.
- Date de coupure des connaissances
- Date au-delà de laquelle un modèle n'a rien appris lors de son entraînement. Sans recherche web, il ignore tout ce qui s'est passé après.
- Intention de recherche
- Ce que la personne cherche réellement à obtenir. En GEO, une requête d'achat (« meilleur outil pour… ») a une valeur commerciale sans commune mesure avec une requête d'information.
Moteurs et surfaces de réponse
- ChatGPT
- Assistant d'OpenAI. Selon le mode, il répond de mémoire ou effectue une recherche web avant de synthétiser, auquel cas il affiche des sources.
- ChatGPT Search
- Mode de ChatGPT qui interroge le web en direct. C'est dans ce mode qu'une marque récente peut être citée sans figurer dans les données d'entraînement.
- Perplexity
- Moteur de réponse qui affiche systématiquement ses sources numérotées. Sa transparence en fait un terrain d'observation commode pour comprendre ce qui est sélectionné.
- Gemini
- Assistant de Google, capable d'activer une recherche Google en direct. Sans cette activation, ses réponses proviennent de la mémoire du modèle.
- AI Overviews
- Réponse générée affichée par Google au-dessus des résultats classiques, avec quelques liens. Elle capte une partie des clics qui allaient aux premiers résultats.
- AI Mode
- Interface de recherche conversationnelle de Google, où l'échange remplace la page de résultats.
- Claude
- Assistant d'Anthropic, avec des capacités de récupération web selon le contexte d'usage.
- Copilot
- Assistant de Microsoft, adossé à l'index de Bing.
- Bing
- Moteur de recherche de Microsoft. Son index alimente plusieurs surfaces de réponse, ce qui lui donne une importance supérieure à sa part de marché apparente.
Crawlers et contrôle d'accès
- Crawler IA
- Robot d'un fournisseur d'IA qui parcourt le web. Il faut distinguer ceux qui collectent pour l'entraînement de ceux qui récupèrent une page au moment de répondre.
- Bot d'entraînement
- Robot qui collecte des pages pour entraîner un modèle. Le bloquer protège le contenu mais ne réduit pas la visibilité immédiate dans les réponses.
- Bot de recherche
- Robot qui récupère des pages pour construire une réponse en direct. Le bloquer revient à s'exclure des réponses : c'est l'erreur la plus coûteuse.
- GPTBot
- Robot d'OpenAI dédié à la collecte pour l'entraînement.
- OAI-SearchBot
- Robot d'OpenAI associé à la recherche. Le bloquer nuit à la présence dans les réponses de ChatGPT.
- ChatGPT-User
- Agent déclaré quand ChatGPT va chercher une page pendant une conversation, à la demande de l'utilisateur.
- PerplexityBot
- Robot d'indexation de Perplexity.
- ClaudeBot
- Robot d'Anthropic dédié à la collecte.
- Google-Extended
- Contrôle proposé par Google pour l'usage d'un site par ses produits d'IA générative, distinct de l'indexation classique.
- Applebot-Extended
- Équivalent chez Apple pour les usages d'IA générative.
- robots.txt
- Fichier à la racine d'un site qui indique aux robots ce qu'ils peuvent parcourir. En GEO, la vérification prioritaire est simple : aucun bot de recherche ne doit y être interdit.
- User-agent
- Identifiant qu'un robot déclare en se connectant. C'est la clé utilisée dans robots.txt pour cibler une règle.
- Disallow
- Directive de robots.txt interdisant un chemin. Un « Disallow: / » visant un bot de recherche IA rend le site invisible dans ses réponses.
- Rendu JavaScript
- Fait de devoir exécuter du JavaScript pour voir le contenu. La plupart des crawlers IA ne l'exécutent pas : un contenu ou un balisage injecté côté navigateur leur reste invisible.
- Rendu côté serveur (SSR)
- Génération du HTML par le serveur, livré complet dès la première réponse. C'est la configuration la plus sûre pour être lu par un crawler IA.
Données structurées et entités
- schema.org
- Vocabulaire partagé permettant de décrire un contenu de façon lisible par une machine : une entreprise, un produit, un article, une question.
- JSON-LD
- Format recommandé pour insérer ce balisage, dans un bloc de script séparé du contenu visible. Il n'altère pas l'affichage de la page.
- Organization
- Type de balisage décrivant l'entreprise : nom, site, logo, profils officiels. C'est la brique d'identité de base.
- SoftwareApplication
- Type décrivant un logiciel : nom, catégorie, plateforme, tarif. Pertinent pour un éditeur, hors sujet pour un artisan ou un cabinet.
- FAQPage
- Balisage d'une série de questions et de réponses. Il n'a de sens que si ces questions figurent réellement sur la page.
- Article
- Balisage d'un contenu éditorial : titre, auteur, dates de publication et de modification.
- sameAs
- Propriété listant les profils officiels d'une entité : page entreprise, encyclopédie, annuaire métier, répertoire professionnel. C'est ce qui permet de distinguer une marque de ses homonymes.
- @id
- Identifiant stable donné à un nœud du balisage, qui permet de relier plusieurs blocs entre eux plutôt que de les laisser isolés.
- @graph
- Structure regroupant plusieurs nœuds liés dans un seul bloc : l'entreprise, le produit, la page, l'auteur.
- Entité
- Objet du monde réel — une entreprise, une personne, un produit — que le moteur cherche à identifier de façon univoque.
- Désambiguïsation
- Fait de distinguer deux entités portant le même nom. Un nom de marque générique, partagé avec d'autres organisations, est un handicap direct en GEO.
- Graphe de connaissances
- Base reliant des entités entre elles et leurs attributs. Y figurer, ou être cohérent avec ce qu'il contient, aide un modèle à savoir de qui l'on parle.
- E-E-A-T
- Grille d'évaluation de la qualité fondée sur l'expérience, l'expertise, l'autorité et la fiabilité. Un auteur identifiable et joignable pèse plus qu'un article anonyme.
- Cohérence des faits
- Fait que le nom, l'activité, l'adresse ou le tarif soient identiques sur le site et sur les sources tierces. Une contradiction entre les deux affaiblit la confiance accordée à la marque.
Fichiers et protocoles
- llms.txt
- Fichier texte placé à la racine d'un site pour résumer son contenu et lister ses pages importantes à l'intention des modèles. C'est une convention proposée par la communauté, pas un standard officiel, et son adoption par les moteurs reste limitée.
- sitemap.xml
- Liste des URL d'un site destinée aux moteurs. Elle reste la façon la plus fiable de faire découvrir de nouvelles pages.
- IndexNow
- Protocole permettant de signaler immédiatement une page nouvelle ou modifiée aux moteurs qui le supportent, sans attendre le prochain passage d'un robot.
- URL canonique
- URL de référence déclarée pour un contenu accessible par plusieurs adresses. Elle évite de disperser les signaux entre des doublons.
- hreflang
- Indication des versions linguistiques d'une page, pour que la bonne soit servie selon la langue.
Mesurer sa visibilité
- Part de voix (SoV)
- Proportion des réponses d'un jeu de requêtes où une marque apparaît, comparée à ses concurrents. Elle n'a de sens que rapportée à un jeu de requêtes stable dans le temps.
- Taux de citation
- Proportion des exécutions d'une requête donnée où la marque est nommée. À interpréter avec le nombre d'exécutions : un seul essai ne prouve rien.
- Jeu de requêtes
- Ensemble des questions suivies dans la durée. C'est la décision la plus structurante d'un programme GEO : une requête mal choisie produit des mesures inexploitables.
- Position dans la réponse
- Rang auquel une marque est citée dans une liste de recommandations. Être nommée en premier n'a pas la même valeur qu'être citée en dernier.
- Sentiment
- Tonalité associée à la marque dans la réponse. Être cité comme une option économique ou comme une référence n'a pas les mêmes conséquences commerciales.
- Variance entre exécutions
- Écart de réponse d'un modèle à une même question posée plusieurs fois. Elle impose de répéter les mesures avant de conclure quoi que ce soit.
- Faux négatif
- Conclusion erronée qu'une marque n'est pas citée, alors que la requête était mal formulée, hors sujet, ou que la mesure a échoué silencieusement.
- Search Console
- Outil de Google donnant les requêtes, impressions et positions réelles d'un site. C'est la source la plus fiable pour savoir ce qui ramène déjà de la demande.
- Position moyenne
- Rang moyen d'une page sur une requête dans les résultats de recherche. Une position entre 4 et 20 signale un contenu proche du seuil de visibilité.
- Baromètre
- Mesure répétée à intervalles réguliers sur un même échantillon, qui permet de lire une tendance plutôt qu'un instantané.
Contenu, autorité et hors-site
- On-page
- Tout ce qui se trouve sur votre site : contenu, structure, balisage. Nécessaire pour être compris, insuffisant pour être recommandé.
- Off-page
- Tout ce qui se dit de vous ailleurs : discussions, comparatifs, avis, vidéos, articles. C'est ce matériau que les moteurs de réponse restituent.
- Contenu citable
- Contenu construit pour être repris tel quel : une réponse directe en tête, des faits vérifiables, des chiffres sourcés, des intertitres qui posent des questions.
- TL;DR
- Résumé de quelques lignes placé juste après le titre, qui répond directement à la question. C'est souvent le passage extrait par un moteur.
- Passage / chunk
- Fragment de page traité isolément par le moteur. Une page est rarement citée en entier : c'est un passage qui l'est, d'où l'importance de sections autonomes.
- Extraction
- Opération par laquelle le moteur isole le fragment utile d'une page. Un texte dense sans structure claire s'extrait mal.
- Attribution
- Fait, pour le moteur, de rattacher une information à une source nommée. Sans attribution, l'information sert la réponse sans servir la marque.
- Listicle
- Article en forme de liste (« les meilleurs outils de… »). Format très repris par les moteurs de réponse sur les requêtes de comparaison.
- Page comparative
- Page confrontant deux solutions. Elle capte une intention d'achat tardive et fournit au moteur un matériau directement exploitable.
- Page alternative
- Page répondant à « alternatives à X ». Elle cible des personnes déjà en recherche active d'un remplacement.
- Autorité thématique
- Fait de couvrir un sujet en profondeur plutôt que de l'effleurer. Une couverture cohérente pèse plus qu'un article isolé.
- Fraîcheur
- Actualité d'un contenu. Sur un sujet qui évolue vite, une donnée de plusieurs mois perd sa valeur d'argument.
- UGC (contenu généré par les utilisateurs)
- Contenu produit par des tiers : forums, avis, questions-réponses. Il pèse dans ce que les modèles ont appris d'une marque.
- Backlink
- Lien entrant depuis un autre site. Il reste un signal d'autorité, mais en GEO la mention nommée compte même sans lien.
- Plateforme d'avis
- Site recensant des évaluations d'utilisateurs. Une fiche complète et alimentée y est une source de mention régulière.
Questions fréquentes
- GEO, AEO et LLMO désignent-ils la même chose ?
- En pratique, oui : les trois sigles décrivent le fait d'être recommandé par les moteurs de réponse génératifs. Aucun n'a de définition normalisée, et le choix de l'un ou l'autre relève surtout du vocabulaire de chaque éditeur.
- Le GEO remplace-t-il le SEO ?
- Non. Les moteurs de réponse s'appuient largement sur les résultats de recherche pour choisir leurs sources. Un site qui ne ranke pas part avec un handicap, mais bien ranker ne suffit pas à être cité.
- Faut-il mettre en place un fichier llms.txt ?
- C'est une convention proposée par la communauté, pas un standard officiel, et son adoption par les moteurs reste limitée. Le coût de mise en place est faible, l'effet démontré aussi : à traiter comme de l'hygiène, pas comme un levier.
- Bloquer les robots d'IA protège-t-il mon contenu ?
- Cela dépend du robot. Bloquer un robot de collecte pour l'entraînement limite la réutilisation de vos textes. Bloquer un robot de recherche vous exclut des réponses générées : c'est la confusion la plus coûteuse.
- Comment savoir si une IA cite ma marque ?
- En posant les questions que posent vos prospects, sans nommer votre marque, et en notant qui est recommandé. La mesure doit être répétée : un modèle ne répond pas deux fois exactement la même chose.
Pour aller plus loin : les signaux qui rendent un site citable, la méthode pour vérifier si l'IA vous cite, et l'état de la visibilité des SaaS français.
Et vous, êtes-vous cité ?
L'analyse gratuite vous montre la réponse réelle de ChatGPT sur une requête de votre marché, et qui il recommande à votre place.
Analyser mon site gratuitement