Retour au blog

Référencement & IA

Référencement GEO (ou GEI) : ce qui fait vraiment citer un site par les IA

Depuis le 22 juillet 2026, Google affiche en France ses Aperçus IA (AI Overviews) : une réponse rédigée en tête des résultats, avec quelques sites cités en source. ChatGPT, Perplexity et Claude fonctionnent ainsi depuis plus longtemps. Travailler son site pour devenir l'une de ces sources s'appelle le référencement GEO — un sujet sur lequel circulent beaucoup d'affirmations sans preuve. Voici ce qu'en disent les sources qui comptent : Google, les éditeurs des IA, et la recherche.

Article révisé le 17 septembre 2026. Il tient compte de l'arrivée des Aperçus IA en France et du guide publié par Google en mai 2026, qui dément plusieurs pratiques encore largement recommandées — dont certaines figuraient dans la première version de ce texte. Chaque chiffre renvoie désormais à sa source, listée en fin d'article.

GEO, GEI, AEO : de quoi parle-t-on ?

Le GEO, pour Generative Engine Optimization, désigne le travail qui vise à faire citer un site par les moteurs de réponse génératifs, et plus seulement à le faire classer dans une liste de liens. Le terme vient d'une étude de recherche publiée fin 2023 et présentée à la conférence KDD en 2024.

On croise aussi AEO (Answer Engine Optimization), SEO IA ou, plus rarement, GEI (Generative Engine Indexing) : ces mots recouvrent la même idée. L'usage, y compris chez Google, a retenu GEO et AEO.

Pour Google, la distinction reste d'ailleurs secondaire. Son guide de mai 2026 l'écrit sans détour : de son point de vue, optimiser pour la recherche générative, c'est encore du SEO. Ses Aperçus IA reposent sur les mêmes systèmes de classement et de qualité que les résultats classiques.

Pourquoi le sujet devient concret en 2026

La tendance se mesure, et les chiffres sont publics :

  • Les Aperçus IA sont arrivés en France. Google les a lancés le 22 juillet 2026, avec le mode IA, deux ans après les États-Unis — le temps de régler un contentieux avec les éditeurs de presse sur les droits voisins. Le déploiement est progressif.
  • Une recherche sur deux se termine déjà sans clic. En 2024, 59,7 % des recherches Google effectuées dans l'Union européenne ne débouchaient sur aucun clic (SparkToro, données Datos). Aux États-Unis, la proportion atteint 68 % sur les quatre premiers mois de 2026 (SparkToro, données Similarweb — un panel différent, la comparaison est donc à prendre avec prudence).
  • Encore moins quand l'IA répond. Le Pew Research Center a suivi la navigation de 900 adultes américains en mars 2025 : face à un résumé IA, ils cliquaient sur un résultat classique lors de 8 % des visites, contre 15 % sans résumé. Les liens cités dans le résumé lui-même n'étaient cliqués que dans 1 % des cas.

Une part croissante des internautes lit donc la réponse sans visiter aucun site. Être la source citée ne garantit pas la visite — mais ne pas l'être garantit de ne pas être lu du tout.

Ce que Google dit officiellement

En mai 2026, Google a publié un guide consacré à l'optimisation pour ses fonctions d'IA générative, mis à jour en juillet. Son message principal : il n'existe ni exigence supplémentaire, ni optimisation spéciale pour apparaître dans les Aperçus IA. Et il démonte une à une plusieurs recettes vendues sous l'étiquette GEO :

Idée reçue Ce qu'en dit Google
Il faut un fichier llms.txt ou une version Markdown pour les IA Google Search n'utilise pas ces fichiers : ils n'aident ni ne nuisent.
Il faut découper le contenu en petits blocs Inutile : ses systèmes comprennent une page qui aborde plusieurs sujets et en extraient le passage utile.
Il faut un balisage schema.org spécial IA Les données structurées ne sont pas requises, et aucun balisage particulier n'existe pour la recherche générative.
Il faut écrire pour les IA Aucun style d'écriture n'est propre à la recherche générative : on écrit pour ses lecteurs.
Il faut multiplier les mentions sur le web Les mentions artificielles servent moins qu'on ne le croit.

Ce que Google recommande, en revanche, n'a rien de nouveau : un contenu original, qui apporte une expérience ou un point de vue introuvable ailleurs plutôt qu'un résumé de ce qui existe déjà ; un site techniquement facile à explorer ; et, pour une entreprise locale, une fiche Google Business Profile soignée. Pour mesurer les résultats, Google renvoie à un rapport de performances consacré à ses fonctions d'IA générative, dans la Search Console.

Deux idées à corriger. Les résultats enrichis FAQ ont disparu de Google en mai 2026 : une FAQ balisée ne s'affiche plus sous forme dépliable dans les résultats — ses réponses restent utiles aux lecteurs, et donc aux IA. Et le jeton Google-Extended du robots.txt ne règle que l'usage de vos pages par Gemini et d'autres systèmes d'IA de Google : il n'a aucun effet sur votre présence dans Google Search, Aperçus IA compris. Pour limiter ce que Google reprend de vos pages, ce sont les directives nosnippet, max-snippet et noindex qui comptent.

ChatGPT, Claude, Perplexity : d'autres robots, d'autres règles

Hors de Google, la question se pose autrement. Chaque éditeur envoie ses propres robots, et le fichier robots.txt de votre site décide lesquels peuvent le lire. Un point essentiel est souvent ignoré : les robots qui entraînent les modèles ne sont pas ceux qui alimentent la recherche. On peut refuser les premiers sans disparaître des réponses.

Robot Éditeur Rôle
OAI-SearchBot OpenAI Recherche. Fait apparaître les sites dans la recherche de ChatGPT. Le bloquer, c'est ne plus y être cité.
GPTBot OpenAI Entraînement des modèles.
ChatGPT-User OpenAI Visite une page à la demande d'un utilisateur. OpenAI précise que le robots.txt peut alors ne pas s'appliquer.
Claude-SearchBot Anthropic Recherche. Indexe les contenus pour les réponses de recherche de Claude. Le bloquer peut réduire votre visibilité.
ClaudeBot Anthropic Collecte de contenus pouvant servir à l'entraînement.
PerplexityBot Perplexity Recherche. Fait apparaître et lie les sites dans les résultats de Perplexity. Non utilisé pour l'entraînement.

Deux points techniques pèsent ensuite plus lourd que tout le reste :

  • Ces robots ne lisent pas le JavaScript. Une analyse publiée par Vercel en décembre 2024 a constaté qu'aucun des grands robots d'IA — ceux d'OpenAI, d'Anthropic et de Perplexity compris — n'exécutait le JavaScript des pages. Un texte affiché par un script après chargement leur reste invisible. Les robots de Google et d'Apple font exception.
  • Bing compte autant que Google. La documentation d'OpenAI indique que ChatGPT transmet des requêtes, rendues anonymes, au moteur Bing pour obtenir ses résultats web. Un site mal indexé par Bing part donc avec un handicap. Déclarer son site dans Bing Webmaster Tools et signaler ses mises à jour par le protocole IndexNow — pris en charge par Bing, pas par Google — sont deux gestes gratuits.

Ce que la recherche a mesuré

L'étude qui a donné son nom au GEO (Aggarwal et al., KDD 2024) a testé neuf façons de retravailler un contenu, sur un banc d'essai de 10 000 requêtes puis sur Perplexity en conditions réelles. Ses conclusions vont dans le même sens que Google :

  • Ce qui fonctionne : ajouter des citations attribuées, des statistiques et des références à des sources. Ces trois méthodes arrivent en tête, avec des gains de visibilité allant jusqu'à 40 % sur le banc d'essai et jusqu'à 37 % sur Perplexity.
  • Ce qui ne fonctionne pas : le bourrage de mots-clés, hérité du vieux SEO. Il fait même légèrement moins bien que le texte d'origine.
  • Qui en profite le plus : les sites moins bien classés. Citer ses sources a plus que doublé la visibilité (+115 %) des sites placés en cinquième position des résultats — une bonne nouvelle pour une entreprise locale face aux grands annuaires.

Une réserve s'impose : ces mesures datent de 2023-2024, et les moteurs évoluent vite. Elles indiquent une direction — des faits vérifiables plutôt que des formules —, pas une recette garantie.

Ce que nous appliquons, à commencer par ce site

Nous préférons montrer que promettre. Tout ce qui suit se vérifie en quelques secondes sur ce site :

  1. Le contenu est dans le HTML. Chaque page est construite par le serveur : son texte se lit sans exécuter le moindre script, par Google comme par les robots d'OpenAI ou de Perplexity.
  2. Un robots.txt assumé. Les robots de recherche d'OpenAI, d'Anthropic et de Perplexity y sont autorisés nommément. C'est une décision écrite, pas un réglage par défaut qu'une extension pourrait inverser sans bruit.
  3. Des extraits longs autorisés. La directive max-snippet:-1 laisse Google reprendre autant de texte qu'il le juge utile — c'est l'un des réglages qu'il cite pour ses fonctions d'IA.
  4. Des réponses toujours présentes dans la page. Nos FAQ utilisent l'accordéon natif du HTML : une réponse repliée reste dans le code, donc lisible par les robots. Chacune se comprend sans le reste de la page.
  5. Des données structurées fidèles. Elles décrivent l'agence, ses services et ses coordonnées, et ne déclarent jamais rien qui ne soit visible à l'écran. Ce n'est pas un ticket d'entrée dans les Aperçus IA — Google le dit —, mais elles lèvent toute ambiguïté sur qui nous sommes.
  6. Un llms.txt, sans illusion. Nous en publions un, parce qu'il ne coûte rien. Google a confirmé l'ignorer : c'est un pari, pas un levier.

Comment savoir si une IA vous cite ?

Le test le plus parlant reste manuel. Posez à ChatGPT, Claude, Perplexity et Google les questions de vos clients — « location de chalet à Megève avec sauna », « électricien à Sallanches » — et notez dans quel cas vous vous trouvez :

  • Votre site est cité avec un lien : l'objectif est atteint.
  • Votre entreprise est nommée sans lien : l'IA vous connaît, mais ne vous tient pas pour la meilleure source.
  • Vous n'apparaissez pas : regardez qui est cité à votre place, et ce que ces pages disent que la vôtre ne dit pas.

Les réponses varient d'une session à l'autre : refaites le test régulièrement plutôt que de conclure sur un essai unique. Des outils payants automatisent ce suivi sur des centaines de questions (Otterly, Peec AI, Profound…) ; pour une entreprise locale, la Search Console et quelques tests mensuels suffisent le plus souvent.

Par où commencer ?

  1. Vérifiez que vous êtes indexé — sur Google (Search Console) et sur Bing (Bing Webmaster Tools). Une page absente des index ne sera citée nulle part.
  2. Contrôlez votre robots.txt — et les réglages de votre hébergeur ou de vos extensions de sécurité : les robots de recherche des IA ne doivent pas être bloqués par accident.
  3. Complétez votre fiche Google Business Profile — même nom, même adresse, même téléphone que sur votre site. Pour une entreprise locale, c'est la source que Google met lui-même en avant.
  4. Écrivez ce que vous seul savez — vos délais réels, vos saisons, les communes où vous intervenez, les questions que vos clients vous posent vraiment. C'est exactement le contenu original que réclame Google, et celui qu'aucun concurrent ne peut recopier.
  5. Appuyez-vous sur des faits — chiffres, sources, exemples concrets. Ce sont les ajouts que la recherche a mesurés comme les plus efficaces.
  6. Vérifiez que votre texte s'affiche sans JavaScript — sinon, il reste invisible pour ChatGPT, Claude et Perplexity.

En résumé

Le GEO n'est pas une discipline à part, avec ses astuces secrètes. Pour Google, c'est du SEO ; pour les autres IA, c'est du SEO plus quelques réglages précis — robots autorisés, contenu lisible sans script, présence sur Bing. La différence se fait ailleurs : dans un contenu qui apporte des faits, une expérience et des sources, là où tant de pages se contentent de reformuler les mêmes généralités.

Vous voulez savoir où en est votre site ? Découvrez notre accompagnement en référencement SEO & GEO, ou demandez-nous un audit gratuit — nous accompagnons les entreprises de Saint-Gervais, Chamonix, Megève et Sallanches.

Sources

Préparez votre site à l’ère de l’IA

Audit GEO gratuit sous 48h — sans engagement.

Demander un audit