GEO et recherche IA
Qu'est-ce que le GEO (Generative Engine Optimization) et en quoi diffère-t-il du SEO ?
Le generative engine optimization expliqué simplement : l'origine du terme, la façon dont la recherche IA trouve et cite les pages, ce qu'en dit Google, quels robots autoriser, ce que vous pouvez influencer ou non, et comment le mesurer.
L'essentiel
- Le GEO consiste à rendre vos contenus faciles à trouver, à lire et à citer pour les systèmes d'IA qui répondent aux questions en cherchant sur le web et en résumant ce qu'ils trouvent.
- Selon Google, AI Overviews et AI Mode n'imposent aucune exigence supplémentaire : optimiser pour ses fonctionnalités d'IA générative, c'est toujours du SEO. Les différences tiennent aux robots des autres moteurs et à la mesure.
- La recherche IA décompose une question en plusieurs sous-requêtes (query fan-out) : une page est en concurrence sur les sous-questions de l'acheteur, pas seulement sur la requête d'origine.
- Vous maîtrisez l'accès des robots, la qualité des contenus et la cohérence de vos informations. Vous ne maîtrisez pas les sources qu'un modèle choisit pour un utilisateur donné, et personne ne peut garantir une citation.
- Mesurez avec les rapports d'IA générative de la Search Console, le marquage des liens de ChatGPT dans vos statistiques, les logs des robots et une série fixe de prompts de test lancés à intervalles réguliers.
Le generative engine optimization (GEO) consiste à rendre vos contenus faciles à trouver, à lire et à citer pour les systèmes d’IA qui répondent aux questions en cherchant sur le web et en résumant ce qu’ils trouvent : ChatGPT search, Perplexity, Google AI Overviews (les « Aperçus IA ») et AI Mode (le « mode IA »), Claude et d’autres. Le terme vient d’un article de recherche de 2023. Pour la plupart des entreprises, le GEO, c’est du SEO avec quelques vérifications en plus : l’accès pour les robots autres que ceux de Google, des pages qui répondent aux sous-questions des acheteurs, des faits faciles à citer et à vérifier, et de nouvelles façons de mesurer la visibilité. Google affirme lui-même qu’optimiser pour ses fonctionnalités d’IA reste du SEO ; les vraies différences se situent du côté des autres moteurs et de la mesure.
Qu’est-ce que le generative engine optimization (GEO) ?
Le GEO vise à augmenter la probabilité qu’un système de recherche IA récupère votre page et l’utilise, avec un lien ou une mention, dans la réponse qu’il rédige. Le SEO classique vise un lien bleu bien classé. Le GEO vise une place à l’intérieur de la réponse. Les deux se recoupent largement, car la plupart des systèmes de recherche IA lancent d’abord des recherches web ordinaires, puis rédigent à partir des résultats.
Le terme a été forgé dans l’article GEO: Generative Engine Optimization de Pranjal Aggarwal et de ses collègues de l’Université de Princeton et de l’IIT Delhi, publié pour la première fois en novembre 2023 et présenté à la conférence KDD 2024. Les auteurs ont constitué un benchmark de 10’000 requêtes et testé comment la réécriture d’une source modifie sa visibilité dans les réponses générées.
Trois résultats sont utiles pour les entreprises :
- Les preuves aident le plus. Ajouter des citations textuelles, des statistiques ou des références à des sources crédibles a augmenté la visibilité d’environ 30 % à 40 % sur l’un des deux indicateurs de visibilité de l’article. Sur Perplexity, le moteur réel également testé, les citations textuelles ont apporté une amélioration de 22 % et les statistiques jusqu’à 37 %.
- Le bourrage de mots-clés ne fonctionne pas. Ajouter davantage de termes de recherche n’a apporté que peu ou pas d’amélioration.
- Les petits sites y gagnent davantage. Citer des sources a augmenté la visibilité de 115 % pour les pages classées en cinquième position dans les résultats de recherche sous-jacents, bien plus que pour les pages déjà classées en première position.
Lisez ces chiffres comme des tendances. Les expériences reposaient, en 2023, sur un moteur de test construit sur GPT-3.5 et sur un seul moteur réel, et les systèmes actuels fonctionnent différemment. Le domaine porte aussi d’autres noms : AEO (answer engine optimization), LLMO, « SEO IA » ou, tout simplement, référencement IA.
Comment les systèmes de recherche IA trouvent-ils et citent-ils leurs sources ?
Les systèmes de recherche IA cherchent avant d’écrire. Ils transforment votre question en une ou plusieurs recherches, récupèrent des pages dans un index, choisissent les passages qui répondent à chaque partie et rédigent une réponse avec des liens vers les pages utilisées. Google appelle l’étape de recherche « query fan-out » : le système lance plusieurs recherches liées sur des sous-thèmes et combine leurs résultats.
Google a décrit le fan-out au lancement d’AI Mode en mai 2025 : le système découpe une question en sous-thèmes et lance de nombreuses recherches en parallèle. Son guide de 2026 en donne un exemple. Une question sur la manière de remettre en état une pelouse envahie de mauvaises herbes se décompose en recherches sur les meilleurs désherbants pour gazon, sur l’élimination des mauvaises herbes sans produits chimiques et sur leur prévention. Une page peut être citée pour l’une de ces sous-requêtes même si elle ne se classerait jamais sur la question d’origine.
Comment les principaux systèmes obtiennent leurs sources :
- Google AI Overviews et AI Mode utilisent l’index et les systèmes de classement de Google. Une page doit être indexée et pouvoir s’afficher avec un extrait. La documentation de Google sur les fonctionnalités d’IA précise qu’il n’y a aucune exigence supplémentaire et aucune optimisation particulière à prévoir.
- ChatGPT search utilise OAI-SearchBot, le robot d’exploration d’OpenAI. La présentation des robots d’OpenAI indique que les sites qui refusent OAI-SearchBot n’apparaissent pas dans les réponses de ChatGPT search.
- Perplexity utilise PerplexityBot pour faire remonter des sites web dans ses réponses et y renvoyer par un lien. Perplexity affirme que ce robot ne sert pas à entraîner des modèles d’IA.
- Claude utilise Claude-SearchBot pour la recherche, et Claude-User lorsqu’une personne lui demande d’ouvrir une page.
En quoi le GEO diffère-t-il du SEO ?
Du point de vue de Google, pas beaucoup : son guide sur les fonctionnalités d’IA générative indique qu’optimiser pour celles-ci revient à optimiser pour la recherche, donc à faire du SEO. Les différences apparaissent ailleurs : davantage de robots à gérer, des réponses construites à partir de passages plutôt que de pages entières, une visibilité sans clic, et une mesure que le suivi de positions classique ne couvre pas.
| SEO classique | GEO | |
|---|---|---|
| Objectif | Un lien bien classé sur lequel on clique | Être récupéré, puis cité ou mentionné, dans une réponse d’IA |
| Ce qui est en concurrence | Des pages entières pour une requête saisie | Des passages, des faits et des marques pour les sous-requêtes derrière une question |
| Requêtes | Les mots saisis par l’utilisateur | Des sous-requêtes de fan-out, souvent plus précises, parfois dans une autre langue |
| Robots à autoriser | Googlebot, Bingbot | Aussi OAI-SearchBot, PerplexityBot, Claude-SearchBot et les robots déclenchés par les utilisateurs |
| Contenus qui l’emportent | Des pages pertinentes, utiles et bien maillées | Les mêmes, avec des réponses directes, des données originales, des sources et des dates claires |
| Signaux externes | Liens, avis, fiches locales | Mentions dans des sources auxquelles les moteurs font confiance, informations d’entreprise cohérentes sur le web |
| Mesure | Positions, clics et impressions dans la Search Console | Rapports d’IA générative de la Search Console, trafic en provenance des IA, échantillonnage de prompts, logs des robots |
| Visibilité sans clic | Extraits optimisés (featured snippets) | Fréquente : la réponse peut suffire à l’utilisateur, qui n’a plus besoin de cliquer |
Le tableau montre un déplacement des priorités, pas une discipline à part. Un site qui a des problèmes d’exploration, des pages pauvres ou des informations incohérentes aura du mal dans les deux cas.
Quels robots d’IA autoriser dans le robots.txt ?
Autorisez les robots qui alimentent les réponses de recherche si vous voulez être cité, et décidez séparément pour ceux qui collectent des données d’entraînement. Bloquer un robot d’entraînement ne vous retire pas de la recherche de la même entreprise. Vérifiez aussi que votre CDN ou votre pare-feu ne bloque pas ces robots ; Google et OpenAI le mentionnent tous les deux.
| User agent | Opérateur | Rôle | Si vous le bloquez |
|---|---|---|---|
| Googlebot | Recherche, y compris AI Overviews et AI Mode | Vous disparaissez de la recherche Google | |
| Google-Extended | Entraînement des modèles Gemini et ancrage (grounding) dans les applications Gemini et Vertex AI | Aucun effet sur la présence ou le classement dans la recherche Google | |
| OAI-SearchBot | OpenAI | ChatGPT search | Votre site n’apparaît pas dans les réponses de ChatGPT search |
| GPTBot | OpenAI | Entraînement des modèles d’OpenAI | Vos contenus sont exclus de l’entraînement |
| ChatGPT-User | OpenAI | Pages qu’un utilisateur demande à ChatGPT d’ouvrir | Peut rester sans effet : les règles du robots.txt ne s’appliquent pas forcément aux actions des utilisateurs |
| PerplexityBot | Perplexity | Faire remonter des sites dans les réponses de Perplexity et y renvoyer par un lien | Moins de visibilité dans Perplexity |
| Perplexity-User | Perplexity | Pages récupérées pour la question d’un utilisateur | En général sans effet : ce robot ignore généralement le robots.txt |
| Claude-SearchBot | Anthropic | Résultats de recherche dans Claude | Moins de visibilité dans les réponses de recherche de Claude |
| ClaudeBot | Anthropic | Entraînement des modèles d’Anthropic | Vos futurs contenus sont exclus de l’entraînement |
| Claude-User | Anthropic | Pages récupérées lorsqu’un utilisateur le demande à Claude | Claude ne peut pas ouvrir vos pages pour ses utilisateurs |
Les noms et les comportements changent. La documentation des opérateurs figure dans les sources ci-dessous ; consultez-la avant de modifier votre robots.txt.
Sur quoi pouvez-vous agir, et sur quoi pas ?
Vous pouvez agir sur l’accès, les contenus et la cohérence : les robots peuvent-ils atteindre vos pages, chaque page répond-elle clairement à une question avec des faits qu’un modèle peut citer, et vos informations d’entreprise concordent-elles partout ? Vous ne pouvez influencer ni les sources qu’un modèle choisit pour un utilisateur donné, ni la formulation de la réponse, ni le moment où les systèmes changent.
Ce qui dépend de vous :
- L’exploration et l’indexation, y compris les règles du CDN et du pare-feu.
- Des pages qui commencent par la réponse, construites autour des questions que vos acheteurs posent réellement.
- Du contenu original : vos propres données, les prix que vous pratiquez réellement, des exemples concrets, des résultats de tests avec leur méthode et leur date.
- Des informations d’entreprise identiques sur votre site, dans votre fiche Google Business Profile, dans les annuaires et dans les données structurées.
- Une vraie présence sur des sites tiers : avis, fiches, articles et annuaires de partenaires.
Ce qui ne dépend pas de vous : la personnalisation, les variations entre deux exécutions du même prompt, les mises à jour des modèles et les choix commerciaux de chaque plateforme.
Le guide 2026 de Google liste aussi des tactiques inutiles pour la recherche Google. Google ignore llms.txt et les fichiers texte similaires destinés à l’IA. Découper les contenus en tout petits morceaux n’est pas nécessaire, il n’y a pas besoin d’écrire dans un style particulier pour l’IA, et courir après des mentions artificielles « n’est pas aussi utile qu’il n’y paraît ». Créer des pages distinctes pour chaque variante de fan-out afin de manipuler les réponses de l’IA enfreint la règle de Google sur l’abus de contenu à grande échelle. D’autres services lisent peut-être llms.txt : un tel fichier ne nuit pas, mais il ne remplace pas de bonnes pages.
Comment mesurer le GEO ?
Combinez quatre sources : les rapports d’IA générative de Google dans la Search Console, le trafic en provenance des IA dans vos statistiques, les logs de votre serveur pour les visites des robots, et une série fixe de prompts de test lancés à intervalles réguliers. Aucune n’est complète à elle seule, et aucun outil tiers ne voit l’intérieur des systèmes de classement de Google, comme Google le souligne lui-même.
- Search Console. Google a lancé les rapports de performances de l’IA générative le 3 juin 2026 et les a étendus à tous les sites le 31 août 2026. Ils affichent les impressions dans AI Overviews, AI Mode et les fonctionnalités d’IA de Discover, par page, pays, appareil et date.
- Trafic entrant. ChatGPT ajoute
utm_source=chatgpt.comaux liens qu’il envoie, selon la FAQ d’OpenAI pour les éditeurs. Isolez les visites venues des IA dans vos statistiques et suivez leur taux de conversion, pas seulement leur volume. - Logs des robots. Comptez les visites d’OAI-SearchBot, de PerplexityBot et de Claude-SearchBot sur vos pages clés. S’ils ne passent jamais, le travail sur les contenus ne servira à rien.
- Échantillonnage de prompts. Rédigez 20 à 50 questions que posent vos acheteurs, lancez chacune plusieurs fois par moteur chaque mois, et notez si vous êtes cité ou mentionné, quels concurrents apparaissent et vers quelles pages pointent les liens. Les réponses varient d’une exécution à l’autre : regardez les tendances, pas les résultats isolés.
Comment nous menons nos recherches de fan-out
Nous reconstituons les recherches que les moteurs d’IA lancent derrière une question. Nous partons d’une question d’acheteur, en rédigeons cinq reformulations et envoyons chacune aux modèles d’OpenAI et de Google via leurs API, avec la recherche web activée et la localisation réglée sur la Suisse, en plusieurs passes. Nous enregistrons chaque sous-requête, chaque source récupérée et chaque source citée. Ensuite, nous écartons les recherches qui visent un seul site, regroupons les requêtes par sous-thème et en tirons un plan de contenu.
Trois constats tirés de nos passes de septembre 2026 sur nos propres sujets :
- La localisation et la langue orientent la recherche. Interrogé en anglais sur le coût d’un site d’entreprise en Suisse, le modèle GPT a rédigé plusieurs de ses recherches en allemand et limité 8 de ses 10 exécutions aux domaines .ch. Sur ses 27 citations, 26 renvoyaient vers des sites suisses, presque tous des guides de prix d’agences.
- Les moteurs ne s’appuient pas sur les mêmes sources. Pour une question sur le GEO lui-même, 42 des 59 recherches du modèle GPT visaient la documentation officielle de Google, d’OpenAI et de Perplexity, et il a aussi cherché l’article publié sur arXiv. Gemini a plutôt cité des blogs marketing.
- Récupéré ne veut pas dire cité. Des discussions Reddit ont été récupérées de quelques dizaines à plus de cent fois par sujet, sans jamais être citées lors de ces passes.
Ces passes simulent les modèles via leurs API ; elles ne reproduisent pas la recherche de Google en production. Nous nous en servons pour orienter les contenus, pas comme un classement.
Par où commencer
Commencez par un audit rapide : accès des robots, indexation, les dix questions que vos acheteurs posent le plus souvent, et concordance de vos informations d’entreprise sur le web. Corrigez ensuite les pages qui devraient répondre à ces questions, et mettez en place la mesure avant de changer quoi que ce soit d’autre. Notre liste de contrôle pour préparer les contenus de votre entreprise pour la recherche IA détaille le volet contenu, étape par étape.
Sur l’annuaire d’API de communication que nous avons développé, chaque information comporte un lien vers sa source, un niveau de preuve et la date de sa vérification. Cette structure sert d’abord les lecteurs, et il se trouve qu’elle convient aussi aux systèmes d’IA. Si vous souhaitez de l’aide pour l’audit ou pour le travail dans la durée, découvrez nos services GEO et visibilité dans la recherche IA et SEO.
Sources
- Aggarwal et al. : GEO: Generative Engine Optimization (arXiv 2311.09735, KDD 2024)
- Google Search Central : les fonctionnalités d'IA et votre site web (mis à jour le 10 décembre 2025)
- Google Search Central : optimiser votre site pour les fonctionnalités d'IA générative de la recherche Google (mis à jour le 10 juillet 2026)
- Blog Google Search Central : une nouvelle ressource pour optimiser pour l'IA générative dans la recherche Google (15 mai 2026)
- Blog Google Search Central : lancement des rapports de performances de l'IA générative dans la Search Console (3 juin 2026)
- Google : l'IA dans la recherche, de l'information à l'intelligence (AI Mode et query fan-out, 20 mai 2025)
- Google Search Central : les robots d'exploration courants de Google (Google-Extended)
- OpenAI : présentation des robots d'exploration d'OpenAI
- Centre d'aide OpenAI : FAQ pour les éditeurs et les développeurs
- Perplexity : les robots d'exploration de Perplexity
- Anthropic : Anthropic explore-t-il le web, et comment les propriétaires de sites peuvent-ils bloquer son robot ?