September 21, 2026

Auditer la visibilité IA d'un site client en 30 minutes

Solutions
Auditer la visibilité IA d'un site client en 30 minutes

La plupart des audits de visibilité IA échouent de la même façon. Ils consacrent vingt minutes à la structure du contenu sans jamais vérifier si les systèmes IA concernés peuvent seulement accéder à la page. Résultat : une présentation pleine de recommandations pour un site invisible dans ChatGPT depuis que quelqu'un a coché une case chez le CDN il y a dix-huit mois.

Voici une méthode en sept étapes construite dans l'autre sens. Elle commence par les questions binaires, passe aux questions de diagnostic, et se termine par trois correctifs priorisés plutôt qu'une liste de quarante. Elle tient en trente minutes, fonctionne sans accès aux consoles du client, et gagne en précision quand on les a.

Ce qu'il faut avant de lancer le chronomètre

Un navigateur avec ses outils de développement. C'est le minimum. Le reste est optionnel et gratuit :

  • Google Search Console et Bing Webmaster Tools, si le client a donné les accès
  • Un crawler type Screaming Frog ou Sitebulb au-delà de cinquante pages
  • Le validateur Schema.org et le test des résultats enrichis de Google
  • PageSpeed Insights
  • Des comptes ChatGPT, Gemini, Claude et Perplexity pour le panel de requêtes
  • L'accès aux logs serveur, rarement possible en trente minutes et précieux sur trente jours

Avant de démarrer, écrivez les dix questions les plus importantes commercialement, formulées avec les mots du client final. Pas des mots-clés. Des questions. « Qui produit des sites Webflow en marque blanche pour les agences en Europe » plutôt que « agence webflow marque blanche ». Elles serviront à l'étape 6, et les définir mal ruine tout l'audit.

Étape 1 (0 à 3 min) : périmètre et référentiel d'entité

À vérifier. La raison sociale et le nom commercial exacts. Toute ambiguïté : nom courant, homonymie avec une entreprise plus grande, changement de nom récent. L'architecture linguistique et de marchés du site. L'existence ou non d'une vente en ligne.

Pourquoi c'est important. Les systèmes de récupération doivent identifier l'entreprise avant de décider de la citer. Une entité qu'on ne distingue pas d'un homonyme plus visible perdra toutes les requêtes ambiguës, et aucun travail on-page n'y remédie.

Questions d'audit. Comment cette entreprise se nomme-t-elle sur son site, sur LinkedIn, et dans les trois dernières citations presse ? Ces trois occurrences sont-elles identiques ? Si je demande à un assistant qui est cette entreprise, décrit-il la bonne ?

Signal d'alerte. Trois descripteurs différents pour la même entreprise sur trois supports.

Étape 2 (3 à 8 min) : accès machine

Le bloc le plus rentable de l'audit, et le plus souvent sauté.

À vérifier.

  1. Récupérer /robots.txt directement et le lire en entier. Pas le résumé d'un outil.
  2. Identifier les agents IA autorisés et bloqués, en les séparant par finalité :
  1. Vérifier l'absence de blocage au niveau CDN. Cloudflare et ses équivalents proposent un blocage des robots IA en un clic, invisible dans robots.txt. Si le client est derrière un proxy, posez la question ou testez avec un user-agent modifié.
  2. Confirmer que /sitemap.xml existe, renvoie 200 et est à jour.
  3. Vérifier que Google-Extended n'a pas été confondu avec Googlebot. Bloquer Google-Extended concerne l'entraînement de Gemini. Cela ne retire pas le site de Google Search ni des AI Overviews. L'erreur est très fréquente.

Pourquoi c'est important. OpenAI et Anthropic documentent ces contrôles comme indépendants. Un site peut être exclu de l'entraînement tout en restant pleinement éligible à la citation, et inversement. La plupart des sites qui ont bloqué « les robots IA » en 2024 ou 2025 l'ont fait avec un instrument grossier et ont bloqué les deux.

Signaux d'alerte. Un Disallow: / global sur un agent de recherche ou de récupération. Un robots.txt écrit par quelqu'un qui a traité tous les robots IA comme une seule catégorie. Un blocage Cloudflare activé sans décision documentée.

Gain rapide. Si les robots de recherche et de récupération sont bloqués et que personne ne peut citer la raison métier, c'est une correction du jour même sans inconvénient. C'est généralement l'élément le plus rentable de l'audit, pour le coût d'un déploiement.

Questions d'audit. Qui a décidé ce blocage, quand, et quel était l'objectif ? La décision sur l'entraînement est-elle distincte de celle sur la citation, et le fichier le reflète-t-il ? Qui est propriétaire de ce fichier ?

Étape 3 (8 à 13 min) : rendu et indexabilité

À vérifier.

  1. Consulter la réponse HTML brute, pas le DOM rendu. Dans les DevTools Chrome, désactiver JavaScript et recharger, ou simplement afficher le code source. Le contenu principal est-il présent ?
  2. Chercher un noindex accidentel dans les balises meta ou les en-têtes HTTP.
  3. Vérifier les canoniques sur trois gabarits : accueil, page de service, article. Sont-elles autoréférentes et absolues ?
  4. Sur un site multilingue, vérifier la réciprocité hreflang sur une paire de pages.
  5. Contrôler les codes HTTP par sondage. Les soft 404 sur une application monopage sont un classique.
  6. Lancer PageSpeed Insights sur une page représentative.

Pourquoi c'est important. Google exécute JavaScript avec une version evergreen de Chromium, mais sa documentation rappelle que le rendu côté serveur ou le pré-rendu reste préférable, notamment parce que tous les robots n'exécutent pas JavaScript. Les robots des assistants sont en général moins capables que Googlebot. Si le contenu principal n'apparaît qu'après hydratation côté client, le site mise tout sur le robot le plus généreux du lot.

Signaux d'alerte. Un <body> vide dans le code source avec injection par script. Des canoniques pointant vers un domaine de préproduction. Un noindex oublié après une migration. Du contenu chargé uniquement au scroll ou au clic.

Gain rapide. Toute page dont la réponse principale est enfermée dans un accordéon qui ne se remplit qu'au clic. Rendre le texte dans le HTML et garder l'accordéon comme comportement d'affichage.

Avec accès console. L'inspection d'URL dans Search Console montre exactement ce que Google a rendu. À utiliser sur les deux pages qui comptent commercialement.

Étape 4 (13 à 18 min) : signaux d'entité et de marque

À vérifier.

  1. Existe-t-il un nœud Organization en JSON-LD sur la page d'accueil ? Le valider avec le validateur Schema.org.
  2. Porte-t-il des name, url, description, sameAs et adresse exacts ?
  3. Les liens sameAs pointent-ils vers des profils actifs et réellement contrôlés par l'entreprise ?
  4. Le nom, le descripteur et le vocabulaire de services sont-ils cohérents entre le site, LinkedIn et les annuaires ?
  5. Existe-t-il une entité auteur, et s'agit-il d'une personne réelle avec un profil public vérifiable ?

Pourquoi c'est important. Les données structurées ne sont pas requises pour la recherche générative, et Google indique qu'il n'existe pas de balisage schema.org spécifique à ajouter. Ce que font les données structurées, c'est aider les machines à relier des enregistrements appartenant à la même entité. Bénéfice réel, et modeste. La cohérence de nommage entre supports travaille davantage que le balisage.

Signaux d'alerte. Aucun schéma Organization. Un sameAs pointant vers un compte Twitter mort. Un auteur fictif sans existence externe. Trois descriptions d'entreprise différentes sur trois supports.

Gain rapide. Un nœud Organization correct représente vingt minutes de travail, et c'est la seule donnée structurée dont la plupart des sites B2B ont réellement besoin, à côté d'Article ou BlogPosting et de BreadcrumbList.

Remarque sur le schéma FAQ. Si l'audit trouve un balisage FAQPage, ne le comptez pas comme un point positif. Google a déprécié les résultats enrichis FAQ le 7 mai 2026. Le balisage reste un type Schema.org valide et sans effet négatif, mais il ne produit plus aucune apparence de recherche chez Google, et aucune plateforme ne le documente comme facteur de citation IA. Si l'agence précédente l'a présenté comme une tactique de visibilité IA, l'information en dit long.

Étape 5 (18 à 23 min) : capacité du contenu à répondre

À vérifier.

  1. Prendre les trois pages les plus importantes commercialement. Sur chacune, la réponse directe à la question centrale apparaît-elle dans les cent premiers mots, ou après quatre paragraphes de mise en contexte ?
  2. Hiérarchie des titres : un seul H1, H2 et H3 logiques, titres qui décrivent le contenu au lieu de courir après un mot-clé.
  3. Autonomie : prendre une section H2 au hasard. La lire seule. A-t-elle du sens sans les trois sections précédentes ?
  4. Test du générique : un modèle de langage pourrait-il produire cette page à partir du savoir commun, sans que le site du client existe ? Si oui, la page n'a aucune raison d'être récupérée.
  5. Fraîcheur : les dates de publication et de mise à jour sont-elles présentes, exactes et visibles ? Les pages sur les prix, les versions ou la réglementation portent-elles une date récente ?
  6. Preuve de première main : le site contient-il un chiffre, un référentiel, une méthode ou un détail de cas qui n'existe nulle part ailleurs ?

Pourquoi c'est important. Les recommandations de Google de mai 2026 sont inhabituellement directes : produire un contenu que les lecteurs jugent unique, convaincant et utile influencera probablement la présence dans la recherche générative davantage que toute autre suggestion du guide. Google oppose le contenu générique au contenu porteur d'une expertise ou d'une expérience réelle. Un système qui résume du savoir commun n'a pas besoin du client. Il en a besoin quand le client détient ce qu'il ne peut pas produire.

Signaux d'alerte. Toutes les pages répondent à une question que le modèle connaît déjà. Aucune donnée propriétaire sur le site. Des titres écrits comme des chaînes de mots-clés. Un « guide 2024 » encore publié en 2026. Des réponses incompréhensibles sans la section précédente.

Gain rapide. Ajouter une réponse directe de deux phrases juste sous le H1 des trois pages principales. Une heure de travail à l'échelle du site, et le changement de contenu au plus fort effet de levier.

Ce qu'il ne faut pas recommander. Ne recommandez pas de découper le contenu en fragments pour le parsing IA, de réécrire les pages dans un style spécifique pour les systèmes IA, ni de créer une page par variante de requête. Google indique qu'aucun de ces points n'est requis, et le dernier relève de sa politique anti-spam sur le contenu produit à grande échelle.

Étape 6 (23 à 28 min) : surfaces de mesure et tests en direct

Sans accès console. Lancez vos dix requêtes. Utilisez au moins trois surfaces : ChatGPT, Google AI Mode et Perplexity ou Claude. Notez pour chaque requête si le client apparaît, si un concurrent apparaît, et quels domaines sont cités. Faites des captures. Dix requêtes sur trois moteurs prennent environ cinq minutes si vous êtes discipliné et ne lisez pas les réponses en entier.

Ce que vous cherchez n'est pas un score. C'est un motif : quel concurrent revient, et qu'y a-t-il sur son site qui n'est pas sur celui du client.

Avec accès console. L'étape devient nettement plus forte.

  • Bing Webmaster Tools, rapport AI Performance. L'outil gratuit le plus utile de la catégorie. Il donne le nombre total de citations, les pages citées, les grounding queries et l'activité de citation page par page sur Microsoft Copilot, les résumés IA de Bing et certaines expériences partenaires, avec Intents, Topics, Citation Share et Compare ajoutés en juin 2026. Les grounding queries sont les formulations de récupération que le modèle construit en interne : elles indiquent ce que le système pense que le client fait. Aucune information équivalente n'est déductible par un outil tiers. Périmètre à énoncer clairement : surfaces Microsoft uniquement, ni ChatGPT, ni Perplexity, ni Google AI Overviews.
  • Google Search Console, rapport de performance IA générative. Impressions dans AI Overviews, AI Mode et les fonctionnalités génératives de Discover, ventilées par page, pays, appareil et date. Sans données de clics. Vérifiez également le réglage d'inclusion dans les fonctionnalités génératives : un site exclu à cet endroit n'est pas éligible à l'affichage.

Signaux d'alerte. Aucune propriété Search Console. Le réglage d'inclusion désactivé sans que personne sache pourquoi. Bing Webmaster Tools jamais configuré, ce qui est courant et coûte désormais de l'information réelle.

Sur les outils tiers de visibilité IA. Utiles pour la tendance. Google précise qu'aucun outil tiers n'a accès à ses systèmes internes de classement ou d'IA et met en garde contre ceux qui prétendent le contraire. Présentez leurs sorties comme des tendances, jamais comme une mesure.

Étape 7 (28 à 30 min) : trois correctifs, classés

Deux minutes. Trois correctifs. Pas une liste de quarante.

Classez dans cet ordre, qui reflète le caractère binaire de la contrainte :

  1. Tout ce qui bloque l'accès. Robot de recherche ou de récupération bloqué, réglage CDN, noindex, contenu qui n'existe qu'après hydratation. Absolu. Rien en aval ne fonctionne avant correction.
  2. Tout ce qui bloque la compréhension. Données Organization absentes ou fausses, incohérence de nommage entre supports, aucune propriété de mesure configurée.
  3. Tout ce qui bloque la citabilité. Contenu générique, absence de réponses directes, aucune preuve de première main, dates périmées.

Attribuez à chaque correctif un responsable, une estimation de charge et une méthode de vérification. Une recommandation sans étape de vérification est un avis.

Ce que cet audit ne dira pas

À énoncer au client avant qu'il ne pose la question.

Il ne produira pas de score de citation, parce qu'aucun chiffre de ce type ne repose sur une méthodologie défendable. Il ne dira pas pourquoi un concurrent est cité, parce que la présence hors site et l'historique dans les données d'entraînement ne sont pas observables de l'extérieur. Il ne prédira pas de résultats, parce que le comportement de citation est volatil et varie fortement d'un moteur à l'autre. Et il ne réglera pas le problème le plus difficile : un site qui n'a rien d'original n'a aucune raison structurelle d'être cité, aussi propre soit son balisage.

Ce qu'il fait, c'est supprimer toutes les raisons mécaniques pour lesquelles un site ne peut pas être cité, en trente minutes, avec des outils gratuits. C'est une promesse plus modeste que celle du marché, et c'est une promesse que vous pouvez tenir.

Sources et lectures complémentaires

Sources consultées le 21 septembre 2026.

Projets liés
No items found.
Accueil
Perspectives
Auditer la visibilité IA d'un site client en 30 minutes

Concevons ensemble votre futur projet digital

Vous avez une idée ou un projet à concrétiser ? Décrivez-nous vos attentes en matière de création web, de design ou de solutions IA, et recevez une proposition personnalisée dédiée à votre croissance.

Obtenir un devis