Stea Web

Référencement IA (GEO) : un site lisible par ChatGPT, Perplexity et Google

Le référencement IA, qu’on appelle aussi GEO (Generative Engine Optimization) ou AEO, rend un site accessible, compréhensible et vérifiable pour les moteurs de réponse. Ce sont ChatGPT, Perplexity, les AI Overviews et le mode IA de Google, Gemini, Copilot ou Claude. Je suis Vasile Boulay, fondateur de Stea Web, installé à Fresnes (41700), près de Blois, et je travaille à distance partout en France. Ce travail repose sur le même socle que le référencement naturel. Aucune citation par une IA ne peut être garantie : ce qui se travaille, c’est l’accès des robots, la clarté des pages et la mesure.

Le référencement IA, en clair

Le référencement IA vise à ce qu’un assistant d’IA puisse lire votre site, le comprendre et vérifier ce qu’il affirme quand il rédige une réponse. On parle aussi de SEO IA, au sens de la visibilité : il ne s’agit pas de produire des pages avec l’IA, mais de rendre les vôtres lisibles par elle.

Le terme GEO vient d’un article de recherche de novembre 2023 (Aggarwal et al., arXiv 2311.09735), dont les résultats, obtenus sur un banc d’essai, varient selon les domaines. AEO (Answer Engine Optimization) est un terme de métier, sans définition officielle.

SEO, GEO, AEO : trois noms, un même socle

Le référencement IA repose sur les bases du référencement naturel : un site explorable, des pages indexées, du texte clair, des liens internes et des données structurées fidèles au texte. Google l’écrit : ses fonctions d’IA n’ont aucune exigence technique supplémentaire.

Pour servir de lien dans les AI Overviews ou le mode IA, une page doit être indexée et éligible à un extrait. Aucun fichier ni balisage nouveau réservé à l’IA n’est nécessaire (Google, page « AI features », mise à jour du 10 décembre 2025). Le référencement classique et local a sa page : le référencement naturel (SEO) et local.

Comment ChatGPT, Google, Perplexity, Claude et Copilot trouvent leurs sources

Pour appuyer une réponse sur des sources, les assistants passent par un index de recherche, par des pages lues au moment de la question, ou par les deux. Les éditeurs documentent leurs robots, pas leurs critères de choix d’une source.

  • ChatGPT : OAI-SearchBot alimente la recherche de ChatGPT et respecte robots.txt, le fichier qui dit aux robots ce qu’ils peuvent lire. Un site qui le refuse n’apparaît pas dans les réponses de recherche, tout au plus comme lien de navigation. GPTBot collecte des contenus pouvant servir à l’entraînement. ChatGPT-User lit une page à la demande d’un utilisateur ; pour lui, robots.txt peut ne pas s’appliquer, écrit OpenAI.
  • Google : les AI Overviews et le mode IA lancent plusieurs recherches liées (query fan-out) et s’appuient sur l’index de Google. Google-Extended contrôle l’entraînement de Gemini et l’ancrage dans les applis Gemini, sans effet sur la recherche Google.
  • Perplexity : PerplexityBot fait apparaître et lie des sites dans les résultats, et respecte robots.txt. Perplexity-User, qui répond aux questions des utilisateurs, l’ignore généralement.
  • Claude : ClaudeBot sert à l’entraînement, Claude-SearchBot à la recherche et Claude-User aux questions des utilisateurs ; tous respectent robots.txt. Selon Anthropic, bloquer les deux derniers peut réduire la visibilité. Sa documentation ne dit pas quel index de recherche Claude utilise.
  • Copilot : l’offre professionnelle de Microsoft envoie une requête au service de recherche Bing pour ancrer sa réponse (Microsoft Learn, page mise à jour le 18 août 2026). Ce document ne porte pas sur le Copilot grand public.

Documentations consultées le 21 septembre 2026.

Exploration et robots d’IA : lesquels j’autorise, et pourquoi

Pour servir de source à un assistant, une page doit d’abord avoir été lue par un robot. Google recommande que l’exploration soit permise par robots.txt, mais aussi par le CDN ou l’hébergeur : un pare-feu peut bloquer ce que robots.txt autorise.

Je l’ai constaté chez moi : jusqu’au 27 août 2026, un réglage de Cloudflare empêchait GPTBot de lire les pages de stea-web.com. Dans les journaux examinés depuis le 23 juillet, son premier passage authentique date du 28 août. Le pare-feu et Cloudflare sont aussi abordés sur ma page maintenance WordPress.

Mon robots.txt autorise nommément 17 robots ou jetons liés à l’IA. Selon OpenAI et Anthropic, refuser un robot de recherche peut coûter la visibilité dans l’assistant concerné ; refuser un robot d’entraînement reste un choix. Seul Bytespider, le robot de ByteDance, est refusé depuis le 11 septembre 2026 : je n’ai trouvé aucune documentation officielle à son sujet. Mes journaux montrent ensuite une seule page lue, le 13 septembre, puis aucune jusqu’au 21 septembre.

Dire qui vous êtes : entités et données structurées

Les données structurées décrivent en code qui est l’entreprise, ce qu’elle propose et où. Elles servent la cohérence sans être une condition : Google n’exige aucun balisage nouveau pour ses fonctions d’IA.

Google s’en sert pour comprendre une page et les personnes ou entreprises qu’elle décrit. Il recommande que ce balisage corresponde au texte visible. Sur stea-web.com, le code décrit l’entreprise (ProfessionalService, avec SIRET et adresse à Fresnes), son fondateur (Person) et le service de chaque page de service. Le nom, l’adresse et le téléphone y sont les mêmes que dans les mentions légales.

Des pages qui répondent : contenu factuel et réponses directes

Une page utile à un moteur de réponse répond nettement, en texte, à une question précise, avec des faits vérifiables. Google recommande d’ailleurs de garder le contenu important sous forme de texte.

Sur les pages que je rédige, chaque section commence par une réponse courte, compréhensible seule. Les chiffres, les zones, les conditions et les limites y sont écrits noir sur blanc. Je pars des questions réelles de vos clients.

Réputation : fiche Google, annuaires, avis

Les assistants lisent aussi d’autres sites que le vôtre, mais aucune documentation officielle ne dit comment ils pèsent une fiche d’établissement, un annuaire ou un avis. Ce qui se travaille, c’est la cohérence de ces informations.

Pour ses fonctions d’IA, Google conseille de tenir à jour sa fiche Business Profile. Le nom, l’adresse et le téléphone s’écrivent à l’identique partout. Les avis se demandent à tous vos clients, sans les rédiger à leur place ni offrir de contrepartie, et chacun reçoit une réponse.

Le maillage : relier les réponses entre elles

Le maillage, ce sont les liens entre vos pages. Google les recommande pour que le contenu soit trouvé ; ils mènent aussi le lecteur, humain ou robot, d’une réponse à la suivante.

Une page de service gagne à renvoyer vers ses prix, vers les réalisations qui l’illustrent et vers les articles qui détaillent la méthode. Ici, les prix de départ des sites sont sur la page des tarifs de création de site internet.

Mesurer, et savoir ce qu’on ne mesure pas

Les journaux du serveur montrent quels robots lisent un site, à condition de vérifier leurs adresses IP ; ils ne disent pas si une IA a cité ce site. Un passage de robot n’est pas une visite.

Sur stea-web.com, j’ai contrôlé les adresses IP des journaux Apache auprès des listes publiées par les opérateurs, ou par un DNS inverse confirmé :

  • du 23 juillet au 21 septembre 2026 (60 jours), 4 854 requêtes se présentaient comme venant d’un robot d’IA. Parmi elles, 3 225 étaient authentiques ou cohérentes avec les adresses connues de l’opérateur et 1 155 venaient d’imposteurs (23,8 %) ; les 474 autres venaient de mes propres tests ou d’adresses impossibles à vérifier ;
  • sur la même période, ChatGPT-User a fait 18 lectures à la demande d’utilisateurs, sur 6 pages, dont aucune page de service ; PerplexityBot a lu robots.txt 39 fois et aucune page, pour une raison non établie ;
  • entre sa mise en ligne, le 11 septembre 2026, et le 21 septembre, llms.txt n’a été lu par aucun robot d’IA authentifié ;
  • du 15 juillet au 21 septembre 2026 (68 jours, 299 504 lignes de journaux), aucune visite n’est arrivée d’un assistant d’IA : aucun référent ni paramètre de suivi de ce type.

Limites : une citation sans clic ne laisse aucune trace, et une visite sans référent ni paramètre ne peut pas être attribuée. La Search Console mêle le trafic des fonctions d’IA de Google au trafic « Web ». Le cache de Cloudflare et les blocages en amont masquent des lectures. Méthode et détail : les robots d’IA mesurés sur mon site WordPress.

Ce que je fais concrètement

Je vérifie que les robots d’IA peuvent lire votre site, que les informations sur votre entreprise sont exactes et cohérentes, et que vos pages répondent. Puis je mesure. Le travail est chiffré sur devis ; ce devis est détaillé et gratuit.

  1. Exploration : robots.txt, CDN, pare-feu, codes HTTP renvoyés aux robots, indexation dans la Search Console.
  2. Données structurées fidèles au texte visible.
  3. Pages qui répondent : passages flous réécrits en réponses nettes.
  4. Mesure dans les journaux du serveur, adresses IP vérifiées, si l’hébergement y donne accès.

Un fichier llms.txt peut s’ajouter : il coûte peu et reste facultatif. Les échanges se font par téléphone et en visioconférence. Pour commencer, décrivez-moi votre site.

Ce qu’aucun prestataire ne peut garantir

Je ne promets ni citation par une IA, ni position, ni délai. Aucun prestataire ne peut garantir qu’une IA citera une entreprise : aucun éditeur d’assistant ne publie ses critères.

Pas de faux avis, pas de pages par ville, pas de chiffres invérifiables. Je vous dis ce que j’ai corrigé, pourquoi, et ce que la mesure montre, même quand elle ne montre rien.

Vos questions sur le référencement IA

Qui peut faire à la fois du SEO classique et du SEO IA ?

Stea Web fait les deux : je suis Vasile Boulay, installé à Fresnes (41700), dans le Loir-et-Cher, et je travaille à distance partout en France. Le socle est commun : un site que les robots lisent, indexé par Google et Bing, des pages qui répondent, des données structurées fidèles au texte. Le référencement naturel et local a sa propre page.

Comment rendre mon entreprise plus visible dans ChatGPT et Perplexity ?

Trois points se vérifient. OAI-SearchBot et PerplexityBot doivent pouvoir lire le site, dans robots.txt comme chez l’hébergeur ou le CDN. Vos pages doivent répondre nettement, en texte, aux questions de vos clients. Les informations sur votre entreprise doivent être les mêmes partout. Le choix des sources, lui, n’est documenté ni par OpenAI ni par Perplexity : rien de tout cela ne garantit une citation.

Peut-on garantir d’être cité par une IA ?

Non, aucun prestataire ne peut le garantir. Pour ses fonctions d’IA, Google exige qu’une page soit indexée et éligible à un extrait : c’est une condition, pas une assurance. Aucun éditeur d’assistant ne publie ses critères. Sur stea-web.com, du 15 juillet au 21 septembre 2026, aucune visite n’est arrivée d’un assistant d’IA avec un référent ou un paramètre de suivi. Je vous montre ce genre de mesure, pas une promesse.

Faut-il bloquer GPTBot ?

C’est un choix, pas une obligation technique. GPTBot collecte des contenus pouvant servir à entraîner les modèles d’OpenAI ; OAI-SearchBot sert à la recherche de ChatGPT, et OpenAI précise que les deux réglages sont indépendants. De même, Google-Extended n’a aucun effet sur la recherche Google. Sur stea-web.com, GPTBot et OAI-SearchBot sont autorisés ; seul Bytespider, sans documentation officielle trouvée, est refusé.

À quoi sert llms.txt ?

C’est une proposition de Jeremy Howard, publiée le 3 septembre 2024 : un fichier Markdown qui résume un site pour les modèles de langage. Ce n’est pas une norme, et Google écrit ne pas en avoir besoin pour ses fonctions d’IA. Sur stea-web.com, le fichier est en ligne depuis le 11 septembre 2026 ; jusqu’au 21 septembre, aucun robot d’IA authentifié ne l’a lu, d’après mes journaux. Je le garde, sans en attendre d’effet.

Comment mesurer les visites venues des IA ?

Trois sources se complètent. Les journaux du serveur montrent les passages des robots, si l’on vérifie leurs adresses IP. Le référent, ou un paramètre de suivi dans l’adresse d’arrivée, peut signaler une visite venue d’un assistant. La Search Console compte le trafic des fonctions d’IA de Google dans le trafic Web, sans le séparer. Une citation sans clic, elle, ne laisse aucune trace.

Parlons de votre visibilité dans les moteurs de réponse

Décrivez-moi votre activité et votre site : après un premier échange, je vous adresse un devis détaillé et gratuit, sans engagement. Ou appelez le 06 76 47 28 47.

Retour en haut