Un audit GEO (generative engine optimization, optimisation pour les moteurs génératifs) fait à la main tient en un tableur. Ouvrez ChatGPT, Gemini, Perplexity et Google dans des sessions vierges, posez dix questions d’acheteur sans citer votre marque et répétez chacune trois à cinq fois. Consignez chaque réponse : marque mentionnée, recommandée, citée, erreur. Calculez ensuite la part des réponses où vous apparaissez : vous saurez si vous êtes visible sur ChatGPT et ce que les assistants IA disent de votre marque.
Points clés
- Posez des questions de catégorie (« meilleur X pour Y »), pas « que savez-vous de [marque] ? ».
- Testez dans des sessions vierges : sans être connecté ou dans un chat temporaire non personnalisé, avec une nouvelle conversation à chaque exécution.
- Répétez chaque prompt (la question posée à l’IA). Dans l’étude de SparkToro et Gumshoe (janvier 2026), deux réponses de ChatGPT donnaient la même liste de marques moins d’une fois sur 100.
- Présentez la part des réponses qui vous nomment, jamais une « position ».
- Un test manuel donne un premier aperçu ; suivre l’évolution dans le temps exige d’automatiser.
Étape 1 : quelles questions poser aux assistants IA ?
Ne commencez pas par « Que savez-vous de [marque] ? ». Cette question montre seulement ce que répond un assistant à qui l’on a soufflé votre nom. Le vrai test : votre marque apparaît-elle quand personne ne la mentionne ?
Rédigez dix questions de catégorie avec les mots de vos clients, par exemple :
- « Quel [type de produit] choisir pour [usage] ? »
- « Quelles alternatives à [concurrent] pour une petite équipe ? »
En France, cela donne « Quel logiciel de facturation choisir pour un auto-entrepreneur, à moins de 20 € par mois ? » ou « Quelle agence web choisir à Lyon pour une PME ? ».
Ajoutez deux ou trois questions sur la marque (« Combien coûte [marque] ? ») et comptez-les à part : les questions de catégorie montrent si l’on vous recommande, les questions de marque si les faits sont exacts.
Figez la formulation, sinon les exécutions ne sont plus comparables. Un jeu de départ classé par étape d’achat figure dans quels prompts suivre.
Étape 2 : quels assistants IA tester ?
Testez les assistants qu’utilisent vos clients, plus Google. Le classement des chatbots IA de Statcounter pour septembre 2026 attribue 80,48 % à ChatGPT dans le monde, 10,91 % à Gemini, 5,85 % à Perplexity, 1,79 % à Microsoft Copilot et 0,95 % à Claude.
Dans son communiqué du 7 mai 2026, Statcounter décrit cet indicateur comme la part de chaque chatbot dans le trafic référent (referrals) vers les sites web, mesurée sur plus d’un million de sites. Il compte des visites envoyées à des sites, pas des utilisateurs ni des conversations. Grok en est absent, car il ne transmet aucune donnée de référent, indique le communiqué. Les AI Overviews (Aperçus IA) de Google n’y figurent pas non plus.
En France, le même classement donne 79,03 % à ChatGPT et 11,82 % à Gemini en septembre 2026. Et dans un sondage OpinionWay pour SEO.fr publié le 17 août 2026 (1 013 adultes interrogés en février 2026), 54 % des personnes interrogées disent utiliser ChatGPT, 33 % Gemini, 17 % Copilot et 13 % Le Chat de Mistral. Pour le marché français, ajoutez donc Mistral Le Chat à votre liste.
Les assistants diffèrent aussi par l’origine de leurs réponses. Le tableau résume la documentation des éditeurs, consultée le 1er octobre 2026.
| Assistant | D’où vient la réponse | À noter dans votre tableur |
|---|---|---|
| ChatGPT | Peut chercher de lui-même sur le web des informations récentes ; les réponses issues d’une recherche peuvent comporter des citations (aide d’OpenAI) | Des citations sont-elles apparues ? |
| Gemini | Peut ajouter des liens vers ses sources ; toutes les réponses n’en ont pas (aide des applications Gemini) | Y a-t-il un bouton « Sources » ? |
| Google AI Overviews | Générés dans la recherche Google, parfois à partir de plusieurs recherches associées ; « souvent, ils ne se déclenchent pas » (Google Search Central, mis à jour le 10 décembre 2025) | « Aucun aperçu affiché » est un résultat valable |
| Perplexity | Cherche sur Internet en temps réel et numérote ses citations (centre d’aide de Perplexity) | Quels domaines sont cités ? |
| Claude | Cherche sur le web quand c’est utile ou quand la recherche web est activée ; les réponses issues d’une recherche comportent des citations (centre d’aide de Claude) | A-t-il fait une recherche ? |
Quand une réponse affiche des liens vers ses sources, relevez-les : ils montrent sur quelles pages l’assistant s’est appuyé.
Étape 3 : comment obtenir des réponses neutres, non personnalisées ?
Les assistants peuvent adapter leurs réponses à la personne qui les interroge. Pour voir ce que voit un nouveau client, effacez-vous du test.
- ChatGPT : utilisez une fenêtre de navigation privée sans vous connecter, ou un chat temporaire (Temporary Chat) réglé sur « Unpersonalized » (non personnalisé). La page d’aide d’OpenAI sur le chat temporaire indique que cette option n’utilise ni la mémoire ni les instructions personnalisées, alors que l’option « Personalized » peut utiliser les deux.
- Gemini : utilisez un chat temporaire (il exige d’être connecté à un compte Google personnel). La page d’aide de Google range les réponses personnalisées parmi ce qu’un chat temporaire ne peut pas fournir.
- Google AI Overviews : cherchez dans une fenêtre de navigation privée, sans être connecté. L’aide de la recherche Google liste les pays et les langues où ces aperçus sont proposés à tous les utilisateurs ; en France, ils sont déployés depuis le 22 juillet 2026 (Abondance).
- Tous les assistants : ouvrez une nouvelle conversation à chaque exécution, pour que les réponses précédentes n’orientent pas les suivantes. Notez votre pays et votre langue : la page d’aide d’OpenAI sur la recherche précise que ChatGPT peut estimer votre position à partir de votre adresse IP.
Une étude de Profound publiée le 9 septembre 2026 a soumis à ChatGPT, Claude et Gemini des prompts sur les vêtements, les meubles et les cartes de crédit pendant 14 jours (du 11 au 24 août 2026 ; 71 147 réponses). Chaque prompt commençait par un persona d’une ligne, par exemple un âge ou une profession. Les réponses destinées à des personas différents partageaient environ 1 marque recommandée sur 4 ; celles destinées au même persona, environ 2 sur 5.
Deux réserves : ce sont les données d’un seul éditeur, et le persona était saisi dans le prompt, non enregistré dans la mémoire du compte. La liste variait pourtant même à persona identique.
Étape 4 : que noter pour chaque réponse ?
Notez une ligne par réponse. Les lignes ci-dessous sont un exemple, pas des données réelles.
| Date | Assistant | Prompt | Exécution | Mentionnée ? | Recommandée ? | Nommées à la place | Sources citées | Erreurs |
|---|---|---|---|---|---|---|---|---|
| 5 oct. | ChatGPT | quel logiciel de facturation choisir pour un auto-entrepreneur | 1 | Oui | Seulement mentionnée | marque A, marque B | site d’avis | Prix obsolète |
| 5 oct. | ChatGPT | même prompt | 2 | Non | Non | marque A, marque C | aucune | Aucune |
| 5 oct. | Perplexity | même prompt | 1 | Oui | Oui | marque B | notre page de tarifs | Aucune |
- Distinguez mentionnée, recommandée et citée. Mentionnée : la marque apparaît quelque part dans la réponse. Recommandée : l’assistant conseille de vous choisir dans le cas de la personne qui l’interroge. Citée : votre site figure parmi les sources. Définitions complètes : ce que recouvre la visibilité IA (AI visibility).
- Conservez le texte intégral des réponses dans une seconde feuille.
- Relevez chaque erreur factuelle : prix faux, fonctionnalité oubliée, confusion avec une entreprise au nom proche.
Étape 5 : comment lire les résultats ?
Calculez une part, pas une position. Pour chaque assistant, divisez le nombre de réponses qui nomment votre marque par le total des réponses à vos prompts de catégorie.
Dans une étude de SparkToro et Gumshoe publiée le 28 janvier 2026, 600 volontaires ont exécuté 12 prompts 2 961 fois au total sur ChatGPT, Claude et les AI Overviews de Google (AI Mode, ou Mode IA, quand aucun aperçu ne s’affichait). Pour ChatGPT et l’IA de Google, la probabilité que deux réponses contiennent la même liste de marques était inférieure à 1 sur 100. Claude n’était qu’à peine plus régulier. La même liste dans le même ordre revenait environ une fois sur 1 000 exécutions. L’auteur, Rand Fishkin, en conclut qu’un pourcentage de visibilité calculé sur de nombreux prompts répétés est un indicateur raisonnable, et qu’une position dans un classement ne l’est pas.
Une capture d’écran isolée ne prouve rien, ni dans un sens ni dans l’autre.
Un exemple chiffré (un calcul, pas des données) : dix prompts exécutés cinq fois donnent 50 réponses par assistant. Si votre marque figure dans 15 d’entre elles, le taux de mention est de 30 %, et l’intervalle de confiance à 95 %, c’est-à-dire la fourchette plausible de la valeur réelle (méthode de Wilson, réponses supposées indépendantes), va d’environ 19 % à 44 %. Cet échantillon distingue « jamais », « parfois » et « la plupart du temps ». Il ne départage pas 30 % et 40 %.
Une prépublication de Schulte, Bleeker et Kaufmann, déposée sur arXiv le 8 avril 2026, a soumis huit prompts en allemand, dans chacun de quatre secteurs suisses, à ChatGPT, Gemini, Google AI Mode et Perplexity : chaque jour du 24 janvier au 20 mars 2026, puis jusqu’à dix fois de suite du 21 au 25 mars. Dans ces exécutions répétées, l’erreur type du taux de détection d’une marque passait sous 0,10 à sept exécutions (soit un intervalle à 95 % d’environ ± 16 points de pourcentage). Les auteurs recommandent au moins sept exécutions par prompt et par jour. Un seul pays, quelques secteurs, des prompts en allemand : voyez dans ce chiffre de sept un plancher, pas une loi. Voir aussi pourquoi les réponses IA changent à chaque fois.
Quelles sont les limites d’un audit GEO manuel ?
La méthode manuelle répond bien à deux questions : les assistants savent-ils que vous existez, et les faits sont-ils exacts ? Elle montre ses limites sur quatre points.
- Le volume. Dix prompts, quatre assistants et cinq exécutions : 200 réponses à lire et à consigner.
- La taille de l’échantillon. Rand Fishkin, de SparkToro, estime qu’il faut en général au moins 60 à 100 exécutions d’un prompt pour connaître l’ensemble des recommandations d’un assistant.
- La personnalisation et la localisation. Vous testez depuis un seul appareil et un seul pays. Ailleurs, un acheteur peut obtenir une autre réponse.
- Le temps. Un test est un instantané. Les auteurs de la prépublication arXiv recommandent une fenêtre glissante de deux à quatre semaines.
Pour un premier aperçu, aucun outil n’est nécessaire. Automatisez quand vous devez comparer des mois, couvrir plusieurs pays ou langues, ou présenter les chiffres à quelqu’un qui demandera comment ils ont été mesurés.
Lancez votre premier test
Commencez par la méthode manuelle : dix prompts et un tableur. Ou lancez le test gratuit ponctuel sur la page d’accueil de Brandometer.
Brandometer, un service de suivi de la visibilité IA, automatise la répétition. Il envoie chaque prompt à 9 moteurs IA, plusieurs fois et dans des sessions vierges, puis indique le taux de mention avec son intervalle de confiance, si votre marque est recommandée ou seulement mentionnée, quels concurrents sont nommés à sa place et quelles sources sont citées. Il mesure et propose des hypothèses ; il ne peut pas changer ce que dit un assistant. Consultez la méthodologie.
Pour l’essayer, créez un compte. Les nouveaux comptes reçoivent 200 crédits bonus après confirmation de l’adresse e-mail. Le service est sans abonnement : les crédits sont prépayés, n’expirent jamais, et vous ne payez que lorsque vous mesurez.
FAQ
Existe-t-il un outil GEO gratuit pour tester sa visibilité IA ?
Oui. Ahrefs et Backlinko, entre autres, proposaient des outils gratuits en ligne au 1er octobre 2026, et Brandometer propose un test gratuit ponctuel sur sa page d’accueil. Voyez dans tout test gratuit un instantané de quelques réponses un jour donné, pas une tendance.
Pourquoi ChatGPT nous a-t-il mentionnés hier et plus aujourd’hui ?
À lui seul, cet écart ne prouve aucun changement. Les assistants génèrent chaque réponse de zéro : dans l’étude de SparkToro et Gumshoe (janvier 2026), deux réponses de ChatGPT donnaient la même liste de marques moins d’une fois sur 100. Jugez sur la part mesurée sur de nombreuses exécutions, pas sur une seule réponse.
Faut-il tester tous les assistants IA ?
Non. Commencez par ChatGPT, Gemini et Google AI Overviews, puis ajoutez les assistants que vos clients mentionnent ou qui vous envoient des visites.