
Le Pew Research Center a analysé 68 879 recherches Google réelles effectuées par 900 adultes américains en mars 2025. Sur les pages de résultats comportant un résumé IA, les utilisateurs ont cliqué sur un lien classique dans 8 % des visites. Sur les pages sans résumé IA, 15 %. Quand un résumé IA était présent, les sources citées à l'intérieur n'ont été cliquées que dans 1 % des visites.
Le problème commercial tient dans ce paragraphe. Être la réponse vaut désormais davantage qu'être le dixième lien bleu, et la mécanique pour devenir cette réponse n'est pas celle que vend la majorité du marché.
Il n'existe pas de levier distinct qui produise des citations IA. Il existe un socle d'exigences documentées (être crawlable, être indexé, être éligible), un ensemble de pratiques raisonnables cohérentes avec le fonctionnement des systèmes de récupération (entités claires, structure extractible, information de première main), et un large corpus de tactiques non prouvées commercialisées sous l'étiquette GEO.
L'action technique la plus rentable pour la plupart des sites en 2026 n'est pas d'ajouter un fichier. C'est de vérifier que vous n'avez pas bloqué par accident les robots qui alimentent les réponses IA.
SEO : optimiser pour la récupération et le classement dans un index de recherche.
AEO (answer engine optimization) : travailler pour apparaître à l'intérieur d'une réponse générée plutôt que dans une liste de liens.
GEO (generative engine optimization) : employé de façon largement interchangeable avec AEO, avec un accent plus marqué sur les surfaces LLM comme ChatGPT, Claude et Perplexity.
La position de Google mérite d'être rapportée avec précision, car elle est sans ambiguïté. Dans son guide de mai 2026, Google indique que de son point de vue, optimiser pour la recherche générative revient à optimiser pour l'expérience de recherche, et relève donc toujours du SEO. Le guide renvoie ensuite vers sa page sur l'évaluation des conseils SEO tiers, ce qui constitue un signal assez explicite.
Cela ne rend pas l'AEO vide de sens. Cela en fait une question de périmètre. Les fonctionnalités génératives de Google et les produits assistants reposent sur des plomberies différentes, et c'est dans cet écart que se situe le travail utile.
Presque toute la confusion du secteur vient du fait que l'on traite « la recherche IA » comme un objet unique. Il y en a au moins deux.
Google AI Overviews et AI ModeChatGPT, Claude, PerplexitySource du contenuL'index GoogleCrawl propre de l'éditeur, index partenaires, récupérations en directContrôle d'accèsGooglebot, robots.txt, Search ConsoleRobots spécifiques à chaque éditeur, contrôlables séparémentÉligibilitéPage indexée et éligible à un extrait, site inclus dans les fonctionnalités génératives via Search ConsoleDépend de l'accès du robot de l'éditeur à la pageMéthode de récupérationRAG (grounding) et query fan-outRécupération dans l'index de l'éditeur, plus navigation à la demandeMesureRapport de performance IA générative dans Search ConsoleLogs serveur, plus outils tiers de fiabilité variablellms.txt compte-t-ilNon. Google indique que Search l'ignoreNon démontré. Certains outils le lisent
Deux conséquences. Pour la visibilité IA côté Google, le travail est du SEO bien fait. Pour la visibilité côté assistants, le travail relève pour partie de l'accès des robots, pour partie du type de contenu que ces systèmes récupèrent, et pour partie d'une présence hors site que vous ne maîtrisez pas.
Google documente deux mécanismes. Le retrieval-augmented generation, qu'il appelle aussi grounding, s'appuie sur les systèmes de classement de Search pour récupérer des pages pertinentes et à jour dans l'index, puis génère une réponse à partir des informations précises de ces pages, avec des liens cliquables. Le query fan-out génère un ensemble de requêtes connexes simultanées pour élargir la collecte. Exemple donné par Google : pour « comment traiter une pelouse envahie de mauvaises herbes », les requêtes dérivées peuvent porter sur les herbicides, le désherbage sans produits chimiques et la prévention.
La règle d'éligibilité est concrète. Pour apparaître dans les fonctionnalités génératives de Google, une page doit être indexée et éligible à l'affichage avec un extrait, en respectant les exigences techniques de Search. En complément, le site doit être inclus dans les fonctionnalités génératives via Search Console. Google précise aussi que respecter toutes les exigences ne garantit ni le crawl, ni l'indexation, ni l'affichage.
Conséquence directe du fan-out : Google met explicitement en garde contre la création d'une page par variante de requête. Le faire principalement pour influencer le classement ou les réponses génératives relève de sa politique anti-spam sur le contenu produit à grande échelle. Plusieurs méthodologies GEO recommandent aujourd'hui exactement cela.
OpenAI et Anthropic documentent leurs robots, et les séparent par finalité. C'est le point que la plupart des propriétaires de sites traitent mal.
RobotÉditeurFinalitéLe bloquer signifieGPTBotOpenAIEntraînement des modèlesVos contenus sont exclus des données d'entraînementOAI-SearchBotOpenAIRecherche ChatGPTVous perdez l'éligibilité à la recherche ChatGPTChatGPT-UserOpenAIRécupération à l'initiative de l'utilisateurChatGPT ne peut pas récupérer votre page à la demandeClaudeBotAnthropicEntraînement des modèlesContenus futurs exclus des jeux d'entraînementClaude-SearchBotAnthropicQualité de la rechercheVisibilité et exactitude réduites dans les résultats ClaudeClaude-UserAnthropicRécupération à l'initiative de l'utilisateurVisibilité réduite pour la recherche pilotée par l'utilisateur
Les contrôles sont indépendants. La documentation d'OpenAI indique explicitement qu'un éditeur peut autoriser OAI-SearchBot pour apparaître dans la recherche tout en interdisant GPTBot. Anthropic indique que ses robots respectent les directives robots.txt et l'extension non standard Crawl-delay, et que le blocage par plages d'IP est peu fiable puisqu'il empêche le robot de lire votre robots.txt.
Un grand nombre de sites ont bloqué la mauvaise moitié de ce tableau. Le scénario est classique : en 2024 ou 2025, quelqu'un a décidé que l'entreprise ne voulait pas alimenter l'entraînement des modèles, et a soit écrit une règle robots.txt globale, soit activé un bouton « bloquer les robots IA » chez le CDN. Résultat : un site qui s'est effectivement retiré de l'entraînement, ce qui était l'intention, et aussi des citations dans ChatGPT et Claude, ce qui ne l'était pas.
C'est la demi-heure d'AEO la plus rentable disponible pour la plupart des entreprises, et elle ne coûte rien. Traitez la question de l'entraînement et celle de la citation séparément, puis écrivez le robots.txt en conséquence. Une configuration défendable pour une entreprise B2B qui veut de la visibilité sans nourrir les corpus d'entraînement : interdire GPTBot, ClaudeBot et CCBot, autoriser OAI-SearchBot, Claude-SearchBot, Claude-User, ChatGPT-User et PerplexityBot. C'est une décision d'entreprise, pas un réglage technique, et elle doit être prise par quelqu'un qui en comprend l'arbitrage.
Deux réserves. Bloquer les robots d'entraînement peut réduire à long terme la présence de la marque dans la connaissance des modèles, surface distincte de la récupération en direct et non mesurable de votre côté. Et robots.txt reste indicatif : il n'engage que les robots qui choisissent de le respecter.
C'est le levier documenté le plus fort, et le moins technique. La formulation de Google est inhabituellement directe : produire un contenu que les lecteurs jugent unique, convaincant et utile influencera probablement la présence dans la recherche générative davantage que tout le reste de son guide. Google oppose le contenu générique, illustré par un titre du type « 7 conseils pour un premier achat immobilier », au contenu non générique porteur d'une expertise ou d'une expérience réelle, en donnant pour contre-exemple un retour d'expérience sur une inspection écartée et ce que la canalisation a révélé.
Traduction pour une entreprise B2B : un système génératif qui résume du savoir commun n'a pas besoin de vous, puisque ce savoir est déjà dans le modèle. Il a besoin de vous quand vous détenez ce qu'il ne peut pas produire. Des chiffres issus de votre propre production, une méthodologie que vous appliquez réellement, des cas d'échec, des fourchettes de prix réelles, des références mesurées sur votre portefeuille clients. Anonymisez ce qu'il faut, mais publiez la substance.
C'est aussi le seul levier AEO qu'un concurrent ne peut pas copier en une après-midi.
Les systèmes de récupération doivent identifier qui vous êtes avant de décider de vous citer. Cela relève davantage de la cohérence que du balisage : même raison sociale, même descripteur, mêmes implantations et même vocabulaire de services sur votre site, votre page LinkedIn, vos annuaires et les articles qui vous mentionnent. Un schéma Organization avec des champs name, url, sameAs et description exacts aide les machines à relier ces enregistrements. Il ne crée pas une autorité qui n'existe pas.
Quand une marque est réellement ambiguë (nom commun, homonymie avec une entreprise plus grande, changement de nom récent), lever cette ambiguïté vaut plus que n'importe quelle tactique on-page.
Une réponse générée est assemblée à partir de passages. Un passage autoporteur est plus facilement réutilisable qu'un passage dont le sens dépend de trois paragraphes situés plus haut. D'où l'intérêt d'une réponse directe placée immédiatement sous le titre qui pose la question, de définitions autonomes, et de tableaux lorsque la comparaison est réellement tabulaire.
Cela ne justifie pas de découper le contenu en fragments. Google indique qu'il n'est pas nécessaire de fractionner le contenu en petits morceaux, que ses systèmes gèrent plusieurs sujets sur une même page, et qu'il n'existe pas de longueur idéale. Écrivez pour un lecteur qui scanne, pas pour un parseur imaginaire. L'article 4 de cette série détaille l'architecture des titres et l'écriture answer-first.
Banal, et toujours le blocage le plus fréquent. Google exécute JavaScript avec une version evergreen de Chromium, mais sa documentation rappelle que le rendu côté serveur ou le pré-rendu reste préférable, notamment parce que tous les robots n'exécutent pas JavaScript. Les robots des assistants sont en général moins capables que Googlebot sur ce point. Si votre contenu principal n'existe qu'après hydratation côté client, vous misez tout sur le robot le plus généreux du lot.
Vérifiez les codes HTTP, un sitemap à jour, l'absence de noindex accidentel, et la présence du contenu principal dans la réponse HTML brute.
Les systèmes de récupération privilégient l'information récente sur les requêtes où l'actualité compte. Des dates de publication et de mise à jour exactes et visibles, et de vraies mises à jour plutôt qu'un simple changement de date, valent plus qu'on ne le croit. C'est décisif pour les prix, les versions, la réglementation et tout ce qu'un lecteur formulerait par « à date ».
Inconfortable mais réel : une part significative de ce que citent les assistants ne vient pas de votre site. Les études sectorielles sur les citations montrent de façon récurrente une surreprésentation des plateformes communautaires, des sites de référence et des réseaux professionnels par rapport à leur poids réel sur le web ouvert. Ces études sont produites par des éditeurs qui vendent des outils de visibilité IA, leurs méthodologies diffèrent, et leurs chiffres doivent être lus comme des tendances et non comme des mesures. La tendance reste suffisamment constante pour en tirer une conclusion : l'endroit où votre catégorie se discute publiquement compte.
Google trace ici une ligne nette. La recherche de mentions artificielles est explicitement qualifiée d'inefficace, et ses systèmes anti-spam la ciblent. Participer sincèrement aux espaces où votre marché échange est une stratégie légitime. Acheter des mentions ne l'est pas.
Les données structurées méritent d'être implémentées. Elles ne constituent pas un mécanisme de visibilité IA, et un type largement recommandé vient de cesser de produire le moindre effet chez Google.
Le 7 mai 2026, Google a déprécié l'intégralité des résultats enrichis FAQ. La note de documentation indique qu'ils n'apparaissent plus dans Google Search, l'apparence FAQ, le rapport de résultats enrichis et la prise en charge dans le Rich Results Test étant supprimés au cours de 2026. Cela achève une restriction entamée en août 2023, quand les résultats enrichis FAQ avaient été limités aux sites gouvernementaux et de santé faisant autorité.
FAQPage reste un type Schema.org valide. Une donnée structurée inutilisée ne nuit pas. D'autres systèmes peuvent la lire. Ce qu'elle ne produit plus, c'est une apparence de recherche chez Google, pour personne. Si une agence vous vend aujourd'hui le schéma FAQ comme une tactique de visibilité IA, cette affirmation n'a jamais été documentée et, depuis mai 2026, sa justification côté Google a disparu également.
La position générale de Google dans le guide de mai 2026 : les données structurées ne sont pas requises pour la recherche générative, il n'existe pas de balisage schema.org spécifique à ajouter, et leur maintien reste une bonne idée dans une stratégie SEO globale parce qu'elles conditionnent l'éligibilité aux résultats enrichis.
Gardez la distinction nette en rendez-vous client. L'éligibilité est ce qu'achète un balisage valide. La visibilité est ce que le moteur décide d'afficher. Ce sont deux choses différentes, et une seule dépend de vous.
Pour la plupart des sites B2B, l'ensemble utile est : Organization, BlogPosting ou Article, BreadcrumbList, et Person quand un auteur réel dispose d'un profil public vérifiable. C'est tout.
llms.txt est une convention proposée : un fichier texte ou Markdown placé à la racine du domaine, qui décrit le site et pointe vers ses pages importantes, afin d'aider les modèles de langage à comprendre de quoi le site traite.
État des lieux en septembre 2026 :
Recommandation défendable : publiez-en un si c'est peu coûteux, tenez-le à jour, et ne le présentez pas à un client comme une stratégie de citation. C'est plus proche d'une carte de visite que d'un facteur de classement. Si votre CMS en fait l'affaire de cinq minutes, faites-le. Si cela impose un contournement CDN, consacrez plutôt cette heure à l'accès des robots.
Côté Google. Le rapport de performance IA générative dans Search Console est la seule mesure de première main qui existe. Utilisez-le. Google met par ailleurs directement en garde contre les outils tiers qui promettent des résultats de classement ou prétendent exploiter des métriques internes de Google, en rappelant qu'aucun outil tiers n'a accès à ses systèmes de classement ou d'IA.
Côté assistants. Il n'existe pas de console de première main. Les options honnêtes sont l'analyse des logs serveur pour voir quels robots IA récupèrent réellement vos pages et à quelle fréquence, la segmentation du trafic référent quand les assistants transmettent un referrer, et le test manuel d'un panel de requêtes fixe consigné dans la durée. Les outils tiers de visibilité IA sont utiles pour la tendance et ne doivent pas être pris pour la mesure d'un système auquel ils n'ont pas accès.
Fixez les attentes correctement. La part de citation est volatile, varie fortement d'un moteur à l'autre, et n'est pas directement pilotable. Un jeu d'indicateurs raisonnable : accès des robots vérifié, indexation et éligibilité aux extraits propres, contenu propriétaire publié à un rythme tenu, entité de marque cohérente, et un panel de requêtes réelles revu chaque trimestre.
Issu de la section « mythes » de Google, et abandonnable pour Google Search :
Ajoutons-en une qui découle du même guide : ne construisez pas une page par requête dérivée. C'est le schéma même du contenu produit à grande échelle sanctionné par Google.
Bloquer GPTBot m'empêche-t-il d'apparaître dans ChatGPT ?Pas en soi. GPTBot est le robot d'entraînement d'OpenAI. La visibilité dans la recherche ChatGPT dépend d'OAI-SearchBot, et la récupération à l'initiative de l'utilisateur de ChatGPT-User. Les contrôles sont indépendants : bloquer l'entraînement n'implique pas de bloquer la citation, à condition d'écrire le robots.txt avec précision.
Faut-il un contenu différent pour l'IA et pour Google ?Non. Google indique que les bonnes pratiques SEO restent valables parce que ses fonctionnalités génératives reposent sur ses systèmes de classement et de qualité, et qu'il n'est pas nécessaire d'écrire d'une manière particulière pour la recherche générative. Ce qui change, c'est l'accent : un contenu qui se contente de reformuler du savoir commun a moins de raisons d'être récupéré, puisque le modèle le contient déjà.
Le schéma FAQ vaut-il encore la peine ?Pour les résultats enrichis Google, non. Ils ont été dépréciés le 7 mai 2026. FAQPage reste un type Schema.org valide et sans effet négatif, d'autres systèmes peuvent le lire, mais aucune plateforme ne le documente comme facteur de citation IA. Écrivez de vraies questions-réponses parce que vos lecteurs s'en servent, et considérez le balisage comme facultatif.
Sources consultées le 21 septembre 2026.
Vous avez une idée ou un projet à concrétiser ? Décrivez-nous vos attentes en matière de création web, de design ou de solutions IA, et recevez une proposition personnalisée dédiée à votre croissance.