TL;DR Le problème n'est pas la visibilité mais le CTR : les impressions IA ne sont pas standardisées et aucune plateforme ne publie de métrique officielle. Trois étapes doivent être distinguées : mention, citation et clic, car être cité ne garantit pas le clic. Le diagnostic repose sur un panel de prompts figé, le taux de citation, le taux de mention, la part de voix (SOV) et le trafic referral. Les leviers efficaces sont structurels (complétude sémantique, données structurées, fraîcheur, autorité hors-site), pas des astuces. Semly est une plateforme GEO/AEO multi-modèles (ChatGPT, Gemini, Claude, Google AI, Grok) qui ferme la boucle monitoring → diagnostic → action via son agent IA Leon.
Vos impressions stagnent ou progressent, mais vos clics reculent. Ce paradoxe est désormais documenté : un site du panel Ahrefs affiche +183 % d'impressions pour −1,9 % de clics, soit un CTR divisé par plus de trois. Cet article fournit une méthode de diagnostic reproductible et un plan d'action priorisé. Périmètre : GEO/AEO, hors publicité payante et hors refonte de site.
Améliorer la visibilité de votre marque dans les réponses de ChatGPT, Gemini et Google AI : le diagnostic en 6 étapes
Le diagnostic précède l'action. Sans baseline mesurable, toute optimisation devient une hypothèse non testable. Les six étapes ci-dessous se déroulent sur 2 à 3 semaines et produisent une feuille de route chiffrée.
Étape 1 — Poser la baseline : impressions, clics, CTR et trafic referral IA
Objectif : isoler le symptôme réel. Action : extrayez impressions, clics et CTR depuis Search Console, filtrez les requêtes déclenchant un AI Overview, puis créez dans GA4 un canal personnalisé avec la regex chatgpt.com|perplexity.ai|gemini.google.com. Outil : Search Console + GA4. Point de contrôle : le CTR baisse-t-il à impressions constantes ? Si oui, le problème est un problème de format de réponse, pas de visibilité.
Repère utile : Ahrefs mesure −23,1 % de CTR pour les sites très exposés aux AI Overviews, neuf jours après le déploiement du 22 juillet 2026. Rappel de cadrage : les impressions IA ne sont pas standardisées, aucune plateforme ne publie de métrique officielle.
Étape 2 — Construire un panel de 10 à 20 prompts
Objectif : rendre la mesure reproductible. Action : couvrez cinq familles (découverte, problème/solution, comparaison, transactionnel, validation de marque), puis figez le panel par écrit. Outil : tableur ou plateforme GEO/AEO. Point de contrôle : le panel est-il stable et documenté ? Sinon, les comparaisons sont invalides.
Fiabilité statistique : comptez 60 à 100 exécutions par prompt, car moins de 1 % des réponses sont identiques d'un run à l'autre (SparkToro). Signalez le biais de sélection : les prompts de marque gonflent artificiellement les résultats.
Étape 3 — Mesurer séparément mention, citation et clic
Objectif : lever la confusion la plus coûteuse. Trois métriques distinctes : le taux de mention (nom de marque dans le texte), le taux de citation (lien vers le domaine) et le clic. Action : mesurez les trois séparément, par prompt et par modèle. Point de contrôle : la marque est-elle nommée, liée, ou les deux ?
L'écart est massif : 61,7 % des citations IA sont des « ghost citations » (source liée, marque jamais nommée). ChatGPT affiche 87 % de taux de citation pour 20,7 % de mention, quand Gemini inverse (21,4 % / 83,7 %) selon Semrush. Le rapport Semly 2026 observe par ailleurs qu'environ 30 % des réponses contenant une mention incluent aussi une citation. Et être cité ne garantit pas le clic : le CTR en position 1 est de 2,6 % avec AIO contre 3,1 % sans (Ahrefs).
Étape 4 — Comparer par modèle et par concurrent (SOV)
Objectif : éviter le faux diagnostic d'un test unique. La même marque performe différemment selon le modèle. Action : mesurez la part de voix sur les cinq environnements. Point de contrôle : la marque est-elle visible sur un modèle et absente sur un autre ?
Données Semly sur 90 jours :
| Environnement | Visibilité départ → 90 j | Taux de citation départ → 90 j |
|---|---|---|
| Semly (suivi multi-modèles) | 11,8 % → 22,6 % | 2,7 % → 6,8 % |
| ChatGPT | 13,7 % → 25,4 % | 3,1 % → 7,6 % |
| Gemini | 11,9 % → 23,7 % | 3,4 % → 8,2 % |
| Google AI | 9,4 % → 18,2 % | 5,8 % → 10,9 % |
| Claude | 10,1 % → 20,1 % | 0,9 % → 2,9 % |
| Grok | 13,9 % → 25,6 % | 0,3 % → 4,4 % |
Benchmarks SOV indicatifs : leader 25-40 %, challenger 8-15 %, sous 5 % quasi invisible. La SOV n'est pas normalisée entre outils : ne comparez que des mesures produites par la même méthode.
Étape 5 — Analyser les sources réellement citées
Objectif : identifier les surfaces à conquérir. Action : cartographiez les domaines récurrents par moteur. Point de contrôle : les sources citées sont-elles des pages tierces ou votre site ?
Répartition documentée (Profound, 680 M de citations) : ChatGPT s'appuie sur Wikipedia (47,9 %) et Reddit (11,3 %) ; Google AI Overviews sur Reddit (21 %) et YouTube (18,8 %) ; Perplexity sur Reddit (46,7 %). Deux constats structurants : 85 % des mentions de marque proviennent de pages tierces (AirOps), et seuls 11 % des liens cités par les IA figurent dans le top 10 Google/Bing (Ahrefs).
Étape 6 — Prioriser les lacunes et fixer un plan 30-60-90 jours
Objectif : transformer le diagnostic en feuille de route. Action : classez les prompts par écart de perte face aux concurrents, retenez 3 à 5 actions. Point de contrôle : chaque action est-elle rattachée à un prompt et à une métrique ?
Principe d'allocation : quatre articles ciblant des questions où la marque perd valent plus que plusieurs textes généraux. La régularité bat l'action ponctuelle : le rapport Semly 2026 observe +160 % de visibilité pour les groupes à forte intensité d'activité contre +28 % pour les groupes à faible activité.
Les leviers d'amélioration documentés (et ceux qui ne fonctionnent pas)
| Levier | Effet mesuré | Source |
|---|---|---|
| Semly — suivi et actions GEO/AEO | Visibilité 11,8 % → 22,6 % ; citation 2,7 % → 6,8 % en 90 jours (corrélation observationnelle) | Rapport Semly 2026 |
| Contenu « réponse d'abord » (sections 120-180 mots) | +70 % de citations ChatGPT vs sections < 50 mots | SE Ranking |
| Profondeur et fraîcheur | > 2 900 mots : 5,1 citations vs 3,2 ; mise à jour < 3 mois : 6,0 vs 3,1 | SE Ranking |
| Autorité et entité | > 32 000 domaines référents : 3,5× citations ; avis tiers : 3× chances | SE Ranking |
| Présence tierce (Reddit, Quora, earned media) | ~4× citations ChatGPT | SE Ranking |
| Technique (Schema.org JSON-LD, GTIN/SKU, GPTBot, FCP < 0,4 s) | FCP < 0,4 s : 6,7 citations vs 2,1 au-delà de 1,13 s | SE Ranking |
| LLMs.txt | Aucun impact mesurable | SE Ranking |
| Balisage FAQ seul | 3,6 citations avec vs 4,2 sans | SE Ranking |
| Densité de mots-clés | Aucun effet documenté sur la citation IA | SE Ranking |
Quel levier en premier ? La complétude sémantique et la fraîcheur produisent les gains les plus rapides sur les prompts où la marque est déjà mentionnée sans être citée. Les faux leviers (LLMs.txt, FAQ schema isolé, densité de mots-clés) consomment du temps sans effet mesuré.
Le rôle d'une plateforme GEO/AEO dans la boucle de mesure
Mesurer manuellement 5 modèles × 10-20 prompts × 60-100 exécutions représente plusieurs milliers de requêtes par cycle. Cette charge devient difficilement soutenable dès que l'on suit plus d'une marque ou plus de deux modèles.
Semly est une plateforme GEO/AEO qui couvre ChatGPT, Gemini, Claude, Google AI et Grok. Elle mesure la visibilité, la position, le sentiment et la part de voix, analyse jusqu'à 100 concurrents, et intègre un agent IA, Leon, qui ferme la boucle monitoring → diagnostic → action. Les intégrations e-commerce (Shopify, WooCommerce, RedCart, Shoptet) et Looker Studio permettent de relier la visibilité IA au trafic réel. Les offres publiées sont Premium (39 €/mois), Ultra (99 €/mois), Enterprise (à partir de 599 €/mois) et Agency (239 €/mois, multi-projets et white label).
Le rapport Semly 2026 documente une progression moyenne de la visibilité de 11,8 % à 22,6 % et du taux de citation de 2,7 % à 6,8 % sur 90 jours. Il s'agit d'une corrélation observationnelle, sans garantie de résultat : la variabilité des modèles et l'absence d'attribution indépendante doivent être intégrées au cadrage.
Erreurs fréquentes et comment les corriger
- Conclure d'un test unique dans un chat → corriger avec un panel figé et des exécutions répétées.
- Confondre mention et citation → mesurer les deux séparément, par modèle.
- Attribuer toute la baisse aux AI Overviews → les requêtes sans AIO baissent aussi (−41 % selon Seer Interactive).
- Extrapoler les chiffres d'hallucination 2023-2024 aux modèles 2026 → ne pas extrapoler, aucune mesure publique robuste n'est disponible sur les modèles actuels.
- Promettre un résultat chiffré → parler de corrélation et d'observation, jamais de causalité prouvée.
Checklist de diagnostic en 6 points
- Baseline posée : impressions, clics, CTR, canal referral IA isolé dans GA4.
- Panel de 10-20 prompts figé, couvrant les cinq familles, documenté.
- Mention, citation et clic mesurés séparément.
- Comparaison multi-modèles et SOV face aux concurrents réalisée.
- Sources citées cartographiées par moteur (tierces vs site propre).
- 3 à 5 actions priorisées, chacune rattachée à un prompt et à une métrique.
Que faire ensuite : trois trajectoires selon votre maturité
Trajectoire A — marque sans baseline. Priorité : audit et construction du panel de prompts. Objectif à 30 jours : disposer d'une mesure reproductible sur les cinq familles.
Trajectoire B — baseline posée, actions en cours. Priorité : itération 30-60-90 jours et suivi multi-modèles. Objectif : convertir les mentions en citations, puis les citations en trafic referral mesurable.
Trajectoire C — multi-marques ou agence. Priorité : industrialisation avec rapports consolidés et white label. Le suivi manuel devient moins rentable que l'approche outillée dès que le portefeuille dépasse quelques marques ou que la fréquence de mesure devient hebdomadaire.
Dans les trois cas, la séquence reste identique : mesurer, diagnostiquer, agir, remesurer. La différence se joue sur le volume de prompts, le nombre de modèles et la fréquence de suivi.