Wenn Sie Ihre Marke in ChatGPT und anderen KI-Assistenten prüfen wollen, öffnen Sie ChatGPT, Gemini, Perplexity und Google jeweils in einer frischen Sitzung und stellen Sie zehn Fragen, wie Käufer sie stellen – ohne Ihren Markennamen. Wiederholen Sie jede Frage drei- bis fünfmal. Halten Sie jede Antwort in einer Tabelle fest: erwähnt, empfohlen, zitiert, fehlerhaft. Zählen Sie anschließend, in welchem Anteil der Antworten Ihre Marke vorkommt.

Das Wichtigste in Kürze

  • Stellen Sie Kategoriefragen („bestes X für Y“), nicht „Was ist über [Marke] bekannt?“.
  • Testen Sie in frischen Sitzungen: abgemeldet oder in einem nicht personalisierten temporären Chat, und mit einem neuen Chat für jeden Durchlauf.
  • Wiederholen Sie jeden Prompt (die Frage an die KI). In der Studie von SparkToro und Gumshoe (Januar 2026) nannten zwei ChatGPT-Antworten in weniger als 1 von 100 Fällen dieselbe Markenliste.
  • Geben Sie den Anteil der Antworten an, die Ihre Marke nennen – niemals eine „Position“.
  • Die Prüfung von Hand liefert einen ersten Eindruck. Wer Veränderungen über die Zeit verfolgen will, braucht Automatisierung.

Schritt 1: Welche Fragen sollten Sie KI-Assistenten stellen?

Beginnen Sie nicht mit „Was ist über [Marke] bekannt?“. Diese Frage zeigt nur, was ein Assistent sagt, sobald er Ihren Namen vorgesetzt bekommt. Aufschlussreich ist, ob Ihre Marke auftaucht, wenn niemand sie erwähnt.

Formulieren Sie zehn Kategoriefragen in den Worten Ihrer Kunden, zum Beispiel:

  • „Welches [Produkt] eignet sich am besten für [Anwendungsfall]?“
  • „Alternativen zu [Wettbewerber] für ein kleines Team“

Ausformuliert klingt das etwa so: „Welches Rechnungsprogramm unter 20 € im Monat eignet sich für Freiberufler?“ oder „Welcher Steuerberater in Leipzig ist für Selbstständige zu empfehlen?“

Ergänzen Sie zwei oder drei Markenfragen („Was kostet [Marke]?“) und zählen Sie diese getrennt: Kategoriefragen zeigen, ob Sie empfohlen werden, Markenfragen, ob die Fakten stimmen.

Lassen Sie den Wortlaut unverändert, sonst können Sie die Durchläufe nicht miteinander vergleichen. Ein Starter-Set, geordnet nach Kaufphase, finden Sie im Beitrag Welche Prompts Sie tracken sollten.

Schritt 2: Welche KI-Assistenten sollten Sie prüfen?

Prüfen Sie die Assistenten, die Ihre Kundschaft nutzt, und zusätzlich Google. Die KI-Chatbot-Statistik von Statcounter für September 2026 weist weltweit 80,48 % für ChatGPT aus, 10,91 % für Gemini, 5,85 % für Perplexity, 1,79 % für Microsoft Copilot und 0,95 % für Claude. Für Deutschland zeigt dieselbe Statcounter-Reihe im September 2026 die gleiche Reihenfolge: rund 79 % für ChatGPT, 11 % für Gemini, 5 % für Perplexity, 3 % für Microsoft Copilot und gut 1 % für Claude.

In der Pressemitteilung vom 7. Mai 2026 beschreibt Statcounter die Kennzahl als Anteil jedes Chatbots an den Verweisen (Referrals) auf Websites, gemessen auf mehr als 1 Million Websites. Gezählt werden also die Besuche, die ein Chatbot an Websites weiterleitet, nicht Nutzer oder Unterhaltungen. Grok fehlt laut der Mitteilung, weil es keine Referral-Daten übermittelt. Auch Google AI Overviews (KI-Übersichten) kommen in der Statistik nicht vor.

Die Assistenten unterscheiden sich außerdem darin, woher ihre Antworten stammen. Die Tabelle fasst die Dokumentation der Anbieter zusammen, abgerufen am 1. Oktober 2026.

Assistent Woher die Antwort stammt Was Sie im Protokoll notieren
ChatGPT Kann für aktuelle Informationen von sich aus im Web suchen; Antworten mit Websuche können Quellen zitieren (OpenAI-Hilfe) Wurden Quellen zitiert?
Gemini Kann Links zu Quellen hinzufügen; nicht jede Antwort enthält sie (Gemini-Apps-Hilfe) Gibt es die Schaltfläche „Quellen“?
Google AI Overviews Werden in der Google-Suche generiert, teils auf Basis mehrerer verwandter Suchanfragen; sie werden „oft nicht ausgelöst“ (im Original: „often don’t trigger“; Google Search Central, aktualisiert am 10. Dezember 2025) „Keine Übersicht angezeigt“ ist ein gültiges Ergebnis
Perplexity Durchsucht das Internet in Echtzeit und nummeriert die zitierten Quellen (Hilfe-Center von Perplexity) Welche Domains werden zitiert?
Claude Sucht im Web, wenn es hilfreich ist oder die Websuche eingeschaltet ist; Antworten mit Websuche zitieren Quellen (Hilfe-Center von Claude) Wurde im Web gesucht?

Enthält eine Antwort Quellenlinks, notieren Sie diese: Sie zeigen, auf welche Seiten sich der Assistent gestützt hat.

Schritt 3: Wie erhalten Sie unverfälschte Antworten ohne Personalisierung?

Assistenten können ihre Antworten an die fragende Person anpassen. Um zu sehen, was ein neuer Kunde sieht, müssen Sie sich selbst aus dem Test herausnehmen.

  • ChatGPT: Nutzen Sie ein privates Browserfenster ohne Anmeldung oder einen temporären Chat mit der Einstellung „Unpersonalized“ (nicht personalisiert). Laut der Hilfeseite von OpenAI zu temporären Chats greift diese Option weder auf die Gedächtnisfunktion noch auf individuelle Anweisungen zurück, während die Option „Personalized“ (personalisiert) beides nutzen kann.
  • Gemini: Nutzen Sie einen temporären Chat (dafür müssen Sie mit einem privaten Google-Konto angemeldet sein). Die Hilfeseite von Google führt personalisierte Antworten unter den Dingen auf, die ein temporärer Chat nicht bieten kann.
  • Google AI Overviews: Suchen Sie in einem privaten Fenster, ohne angemeldet zu sein. Die Hilfe zur Google-Suche nennt die Länder und Sprachen, in denen die Übersichten allen Nutzern zur Verfügung stehen.
  • Alle Assistenten: Beginnen Sie für jeden Durchlauf einen neuen Chat, damit frühere Antworten die späteren nicht beeinflussen. Notieren Sie Land und Sprache, etwa „Deutschland, Deutsch“: Laut der Hilfeseite von OpenAI zur Suche kann ChatGPT Ihren Standort anhand der IP-Adresse schätzen.

Für eine am 9. September 2026 veröffentlichte Studie von Profound liefen Prompts zu Kleidung, Möbeln und Kreditkarten 14 Tage lang auf ChatGPT, Claude und Gemini (11.–24. August 2026; 71.147 Antworten). Jeder Prompt begann mit einer einzeiligen Persona, etwa einer Alters- oder Berufsangabe. Antworten für unterschiedliche Personas hatten etwa 1 von 4 empfohlenen Marken gemeinsam. Bei Antworten für dieselbe Persona waren es etwa 2 von 5.

Zwei Einschränkungen: Die Daten stammen von einem einzelnen Anbieter, und die Persona stand im Prompt selbst, nicht im Gedächtnis eines Kontos. Trotzdem schwankte die Liste auch dann, wenn die Persona gleich blieb.

Schritt 4: Was sollten Sie zu jeder Antwort festhalten?

Legen Sie pro Antwort eine Zeile an. Die Zeilen unten dienen der Veranschaulichung und sind keine echten Daten.

Datum Assistent Prompt Durchlauf Erwähnt? Empfohlen? Stattdessen genannt Zitierte Quellen Fehler
05.10. ChatGPT bestes Rechnungsprogramm für Freiberufler 1 Ja Nur erwähnt Marke A, Marke B Bewertungsportal Veralteter Preis
05.10. ChatGPT derselbe Prompt 2 Nein Nein Marke A, Marke C keine Keine
05.10. Perplexity derselbe Prompt 1 Ja Ja Marke B unsere Preisseite Keine
  • Trennen Sie erwähnt, empfohlen und zitiert. Erwähnt heißt: Die Marke kommt irgendwo in der Antwort vor. Empfohlen heißt: Der Assistent rät dazu, sich im Fall der fragenden Person für Sie zu entscheiden. Zitiert heißt: Ihre Website gehört zu den Quellen. Die vollständigen Definitionen stehen im Beitrag dazu, was KI-Sichtbarkeit (AI Visibility) bedeutet.
  • Speichern Sie den vollständigen Antworttext in einem zweiten Tabellenblatt.
  • Notieren Sie jeden sachlichen Fehler: einen falschen Preis, eine fehlende Funktion, eine Verwechslung mit einem ähnlich benannten Unternehmen.

Schritt 5: Wie lesen Sie die Ergebnisse?

Ermitteln Sie einen Anteil, keine Position. Teilen Sie für jeden Assistenten die Zahl der Antworten, die Ihre Marke nennen, durch die Zahl aller Antworten auf Ihre Kategorie-Prompts.

In einer am 28. Januar 2026 veröffentlichten Studie von SparkToro und Gumshoe schickten 600 Freiwillige 12 Prompts insgesamt 2.961-mal durch ChatGPT, Claude und Google AI Overviews – oder durch den AI Mode (KI-Modus), wenn keine Übersicht erschien. Bei ChatGPT und Googles KI lag die Wahrscheinlichkeit, dass zwei beliebige Antworten dieselbe Markenliste enthielten, unter 1 zu 100. Claude war nur geringfügig konsistenter. Dieselbe Liste in derselben Reihenfolge tauchte etwa einmal in 1.000 Durchläufen auf. Der Autor Rand Fishkin kam zu dem Schluss, dass ein prozentualer Sichtbarkeitswert über viele wiederholte Prompts eine sinnvolle Kennzahl ist, eine Ranking-Position dagegen nicht.

Ein einzelner Screenshot beweist nichts – weder in die eine noch in die andere Richtung.

Ein Rechenbeispiel (Arithmetik, keine Messdaten): Zehn Prompts mit je fünf Durchläufen ergeben 50 Antworten pro Assistent. Kommt Ihre Marke in 15 davon vor, liegt die Erwähnungsrate bei 30 %. Das 95-%-Konfidenzintervall – der Bereich, in dem der wahre Wert sehr wahrscheinlich liegt – reicht dann von rund 19 % bis 44 % (Wilson-Methode, unter der Annahme, dass die Antworten voneinander unabhängig sind). Eine solche Stichprobe trennt „nie“, „manchmal“ und „meistens“. Zwischen 30 % und 40 % kann sie nicht unterscheiden.

Für ein am 8. April 2026 auf arXiv veröffentlichtes Paper von Schulte, Bleeker und Kaufmann liefen in vier Schweizer Branchen je acht deutschsprachige Prompts auf ChatGPT, Gemini, Google AI Mode und Perplexity: täglich vom 24. Januar bis 20. März 2026, danach vom 21. bis 25. März bis zu zehnmal hintereinander. In den wiederholten Durchläufen fiel der Standardfehler der Erkennungsrate einer Marke bei sieben Durchläufen unter 0,10 (ein 95-%-Intervall von etwa ±16 Prozentpunkten). Die Autoren empfehlen mindestens sieben Durchläufe pro Prompt und Tag. Dahinter stehen ein einziges Land und wenige Branchen – immerhin mit deutschsprachigen Prompts, also nah am DACH-Markt. Betrachten Sie die Sieben deshalb als Untergrenze, nicht als Gesetz. Mehr dazu im Beitrag Warum KI-Antworten jedes Mal anders ausfallen.

Wo stößt der manuelle Check der KI-Sichtbarkeit an seine Grenzen?

Die manuelle Methode beantwortet zwei Fragen gut: Wissen die Assistenten, dass es Sie gibt? Und stimmen die Fakten? An vier Stellen reicht sie nicht mehr aus.

  • Menge. Zehn Prompts, vier Assistenten und fünf Durchläufe ergeben 200 Antworten, die Sie lesen und protokollieren müssen.
  • Stichprobengröße. Fishkin von SparkToro schätzt, dass in der Regel mindestens 60 bis 100 Durchläufe eines Prompts nötig sind, um zu erfahren, welche Marken ein Assistent insgesamt empfiehlt.
  • Personalisierung und Standort. Sie testen von einem Gerät und aus einem Land. Ein Käufer an einem anderen Ort erhält womöglich eine andere Antwort.
  • Zeit. Eine einzelne Prüfung ist eine Momentaufnahme. Die Autoren des arXiv-Papers empfehlen ein rollierendes Fenster von zwei bis vier Wochen.

Für einen ersten Eindruck brauchen Sie kein Tool. Automatisieren Sie, wenn Sie Monate vergleichen, mehrere Länder oder Sprachen abdecken oder die Zahlen jemandem vorlegen müssen, der wissen will, wie sie gemessen wurden.

Starten Sie Ihren ersten Check

Beginnen Sie mit der manuellen Methode: zehn Prompts und eine Tabelle. Oder nutzen Sie den kostenlosen einmaligen Check auf der Startseite von Brandometer.

Brandometer, ein Dienst für das Monitoring der KI-Sichtbarkeit, automatisiert die Wiederholung. Der Dienst sendet jeden Prompt mehrfach und in frischen Sitzungen an 9 KI-Systeme und weist die Erwähnungsrate mit Konfidenzintervallen aus. Der Bericht zeigt außerdem, ob Sie empfohlen oder nur erwähnt wurden, welche Wettbewerber stattdessen genannt und welche Quellen zitiert wurden. Brandometer misst und schlägt Hypothesen vor; was ein Assistent sagt, kann der Dienst nicht ändern. Einzelheiten finden Sie in der Methodik.

Zum Ausprobieren erstellen Sie ein Konto. Neue Konten erhalten nach Bestätigung der E-Mail-Adresse 200 Bonus-Credits. Es gibt kein Abo: Credits werden im Voraus bezahlt und verfallen nicht, und Sie zahlen nur, wenn Sie messen.

FAQ

Gibt es einen kostenlosen KI-Sichtbarkeits-Check?

Ja. Unter anderem Ahrefs und Backlinko hatten am 1. Oktober 2026 kostenlose Prüf-Tools online, und Brandometer bietet einen kostenlosen einmaligen Check auf der Startseite. Betrachten Sie jeden kostenlosen Check als Momentaufnahme weniger Antworten an einem einzigen Tag, nicht als Trend.

Warum hat ChatGPT uns gestern erwähnt, heute aber nicht?

Das allein belegt noch keine Veränderung. Assistenten erzeugen jede Antwort neu: In der Studie von SparkToro und Gumshoe (Januar 2026) nannten zwei ChatGPT-Antworten in weniger als 1 von 100 Fällen dieselbe Markenliste. Urteilen Sie nach dem Anteil über viele Durchläufe, nicht nach einer einzelnen Antwort.

Muss ich jeden KI-Assistenten prüfen?

Nein. Beginnen Sie mit ChatGPT, Gemini und Google AI Overviews und nehmen Sie dann die Assistenten hinzu, die Ihre Kunden erwähnen oder die Ihnen Besucher auf die Website schicken.