Zum Inhalt springen
Abstraktes Dashboard mit Messkurven und Datenpunkten als Symbol für das Messen von Sichtbarkeit in KI-Antworten

Knowledge Case

KI-Sichtbarkeit messen: Was sich belastbar reporten lässt – und was nicht

Ihre Marke taucht in ChatGPT auf – heute. Morgen vielleicht nicht. Was davon lässt sich eigentlich messen?

Von Veröffentlicht am 18 Min. Lesezeit

Start / Leistungen / Reporting & Monitoring / Knowledge Cases / KI-Sichtbarkeit messen: Was sich belastbar reporten lässt – und was nicht
Inhalt im Überblick

Wie misst man KI-Sichtbarkeit – und welche Kennzahlen sind belastbar?

KI-Sichtbarkeit misst man nicht über Positionen, sondern über drei Datenquellen: Plattformdaten (Google Search Console, Bing Webmaster Tools), Stichproben aus einem festen Prompt-Set und die Wirkung auf der eigenen Website (GA4, Anfragen, Markensuchen). Belastbar sind vor allem Häufigkeiten über viele Abfragen und Trends über Monate – nicht einzelne Antworten. Ordnet man jeder Stufe des Meusel Visibility Framework (SEO → GEO → AEO → Trust) eine eigene Kennzahl zu, entsteht ein Reporting, das Ursache und Wirkung trennt.

Warum reicht klassisches SEO-Reporting für KI-Antworten nicht mehr?

Klassisches SEO-Reporting misst Rankings, Impressionen und Klicks. Bei Suchanfragen mit KI-Antwort erklären diese Zahlen nur noch einen Teil dessen, was passiert: Ein Inhalt kann in der Antwort verarbeitet werden, ohne dass daraus ein Klick entsteht.

Die Größenordnung ist inzwischen gut dokumentiert. Das Pew Research Center hat das Browsing-Verhalten von 900 US-Erwachsenen im März 2025 ausgewertet: Erschien eine KI-Zusammenfassung, klickten Nutzer in 8 % der Besuche auf ein klassisches Ergebnis, ohne Zusammenfassung in 15 %. Auf Links innerhalb der Zusammenfassung klickten sie in rund 1 % der Besuche. Ahrefs kommt in einer Auswertung von 300.000 Keywords (Daten Dezember 2025) auf eine um 58 % niedrigere Klickrate für das erstplatzierte Ergebnis, wenn eine AI Overview erscheint – im Vorjahr waren es 34,5 %.

Beide Studien zeigen Zusammenhänge, keinen sauber isolierten Kausaleffekt. Die Richtung ist aber eindeutig: Ein stabiles Ranking garantiert keine stabilen Besuche mehr.

In SEO-Projekten haben wir uns lange daran gewöhnt, dass „oben stehen“ und „besucht werden“ ungefähr dasselbe bedeuten. Für Suchanfragen mit KI-Antwort stimmt diese Gleichung nicht mehr. Ein Reporting, das nur Klicks zählt, meldet dann einen Rückgang – ohne sagen zu können, ob die Marke unsichtbar geworden ist oder nur anders sichtbar.

Was lässt sich an KI-Sichtbarkeit überhaupt messen?

KI-Sichtbarkeit lässt sich heute aus drei Datenquellen erheben, die unterschiedlich belastbar sind: Plattformdaten, Stichproben aus einem Prompt-Set und die Wirkung auf der eigenen Website. Keine Quelle deckt alles ab – zusammen ergeben sie ein brauchbares Bild.

Plattformdaten: was Google und Microsoft selbst berichten

Google hat im Juni 2026 eigene Berichte für generative KI in die Search Console aufgenommen; seit dem 31. August 2026 stehen sie weltweit zur Verfügung. Sie zeigen, wie oft Seiten in AI Overviews, im AI Mode und in KI-Funktionen von Discover erscheinen – aufgeschlüsselt nach Seite, Land, Gerät und Datum. Klicks und Suchanfragen enthält der Bericht nicht. Erscheinen zwei Ergebnisse derselben Website in einer KI-Antwort, zählt das im Diagramm als eine Impression.

Microsoft bietet in den Bing Webmaster Tools seit Februar 2026 den Bericht „AI Performance“ als Public Preview an. Er zeigt, wie oft Inhalte in Antworten von Copilot, in KI-Zusammenfassungen von Bing und bei ausgewählten Partnern als Quelle zitiert werden, welche Seiten zitiert werden und über welche Grounding Queries das geschieht. Grounding Queries sind die Suchbegriffe, die das KI-System intern formuliert, um Quellen für eine Antwort zu finden. Der Bericht misst Zitierhäufigkeit, nicht Position oder Prominenz in der Antwort.

Plattformdaten sind die belastbarste Quelle, weil sie echte Nutzung abbilden. Ihre Grenze: Sie decken nur die Systeme des jeweiligen Anbieters ab. Für ChatGPT, Claude oder Perplexity gibt es bislang keine vergleichbaren Berichte.

Stichproben: was ein festes Prompt-Set zeigt

Für alle anderen Systeme bleibt die Stichprobe: ein festes Set von Fragen, das regelmäßig in mehreren KI-Systemen abgefragt und ausgewertet wird – manuell oder mit spezialisierten Monitoring-Tools. Gemessen wird, ob die eigene Marke genannt, ob eigene Inhalte als Quelle zitiert und ob die Marke empfohlen wird.

Wie vorsichtig man dabei sein muss, zeigt eine Studie von SparkToro und Gumshoe.ai (Januar 2026): Rund 600 Freiwillige stellten zwölf identische Prompts knapp 3.000 Mal an ChatGPT, Claude und Googles KI. Die Wahrscheinlichkeit, zweimal dieselbe Markenliste zu erhalten, lag unter 1 zu 100; dieselbe Reihenfolge noch deutlich seltener. Stabiler war dagegen, wie häufig eine Marke über viele Durchläufe vorkam.

KI-Antworten sind keine Rangliste, sondern Stichproben. Messbar ist nicht die Position, sondern wie oft Sie vorkommen – und was danach passiert.

maxonline

Wirkung: was auf der eigenen Website ankommt

Die dritte Quelle misst nicht Sichtbarkeit, sondern ihre Folgen. Google Analytics 4 führt seit dem 13. Mai 2026 einen eigenen Standardkanal „AI Assistant“ für Besuche von erkannten KI-Assistenten wie ChatGPT, Gemini oder Claude. Die Umstellung wirkt nicht rückwirkend, ältere Daten bleiben unter „Referral“.

Vollständig ist auch dieser Kanal nicht. Die mobilen Apps von ChatGPT öffnen Links häufig so, dass der Referrer verloren geht; solche Besuche erscheinen in GA4 als „Direct“. Klicks aus AI Overviews und AI Mode laufen als organische Google-Besuche ein und lassen sich dort nicht separat ausweisen. Gemessene KI-Besuche sind deshalb eine Untergrenze, keine Gesamtzahl.

Welche Kennzahl gehört zu welcher Stufe des Meusel Visibility Framework?

Ein belastbares KI-Reporting ordnet jeder Stufe des Meusel Visibility Framework eine eigene Leitfrage und Kennzahl zu. So wird sichtbar, auf welcher Stufe ein Inhalt hängen bleibt – statt nur festzustellen, dass „die KI-Sichtbarkeit sinkt“.

Das Framework liest sich von unten nach oben; jede Stufe setzt die vorherige voraus: Gefunden zu werden ist nicht dasselbe wie verstanden, beantwortet oder ausgewählt zu werden. Die folgende Zuordnung ist unser Arbeitsmodell für Reportings, keine Branchennorm.

SEO – Findability: Wird der Inhalt gefunden, gecrawlt und eingeordnet? Kennzahlen: indexierte Kernseiten, klassische Impressionen und Klicks in der Search Console, Zugriffe von Such- und KI-Crawlern in den Server-Logfiles. Ohne diese Basis erscheinen alle folgenden Werte zufällig.

In den Logfiles lohnt sich eine Unterscheidung, die viele Reportings auslassen: Crawler, die Inhalte für das Training von Modellen sammeln, sind etwas anderes als Abrufe, die ein KI-System im Moment einer Nutzerfrage auslöst – etwa über Such- und Nutzer-Agenten wie OAI-SearchBot, ChatGPT-User, Perplexity-User oder Claude-SearchBot. Für die Sichtbarkeit in Antworten sind vor allem die zweiten relevant. Blockiert die robots.txt sie, kann ein Inhalt nicht als Quelle erscheinen, egal wie gut er ist.

GEO – Processability: Kann ein KI-System den Inhalt als eigenständige Wissenseinheit verarbeiten? Direkt messbar ist das nicht. Ein brauchbarer Näherungswert ist der Anteil der indexierten Kernseiten, die in den KI-Berichten von Google oder Bing überhaupt als Quelle auftauchen. GEO verwenden wir hier im engen Sinn; in der Branche wird der Begriff teils als Sammelbegriff für KI-Sichtbarkeit gebraucht.

AEO – Answerability: Liefert der Inhalt eine direkte, belastbare Antwort? Kennzahl: die Citation Rate im Prompt-Set – bei wie vielen Fragen eigene Inhalte als Beleg herangezogen werden. Ergänzend zeigen die Grounding Queries aus Bing, zu welchen Fragen ein Inhalt bereits als Antwortquelle dient.

Trust – Selectability: Wird der Inhalt, wird die Marke als Quelle ausgewählt? Kennzahlen: Mention Rate und Recommendation Rate im Prompt-Set sowie der Anteil an allen Nennungen im Wettbewerbsumfeld (Share of Voice). Trust entscheidet am Ende – aufgebaut wird er auf jeder Ebene.

Action – Wirkung: Was entsteht daraus? Kennzahlen: Sitzungen und Conversions im Kanal „AI Assistant“, die Entwicklung von Markensuchen in der Search Console und Anfragen, in denen Kunden KI-Systeme als Informationsquelle angeben. Action ist keine fünfte Stufe, sondern das Ergebnis: Sichtbarkeit ist kein Geschäftsziel. Wirkung ist das Geschäftsziel.

Wichtig ist die saubere Trennung von Nennung, Zitat und Empfehlung. Eine Mention bedeutet, dass die Marke genannt wird. Eine Citation bedeutet, dass ein Inhalt als Beleg herangezogen wird. Eine Recommendation bedeutet, dass die Marke als Lösung empfohlen wird. Wer die drei in einer Zahl zusammenfasst, verliert genau die Information, die für Maßnahmen gebraucht wird.

Mess-Stack entlang des Meusel Visibility Framework: pro Stufe SEO, GEO, AEO und Trust sowie für die Wirkung je eine Leitfrage, Kennzahl und Datenquelle
Jede Stufe braucht ihre eigene Kennzahl – erst zusammen zeigen sie, wo Sichtbarkeit entsteht und wo sie verloren geht.

Warum sind Positionen in KI-Antworten kein belastbarer KPI?

Positionen in KI-Antworten sind kein belastbarer KPI, weil sich Reihenfolge und Zusammensetzung von Antworten bei identischer Frage fast jedes Mal ändern. Wer „Platz 2 in ChatGPT“ berichtet, beschreibt eine einzelne Ziehung, keinen Zustand.

Die SparkToro-Studie zeigt das deutlich: Dieselbe Frage lieferte unterschiedliche Marken, unterschiedliche Reihenfolgen und unterschiedlich lange Listen. Eine Auswertung von Ahrefs aus dem Dezember 2025 kam zu einem verwandten Ergebnis auf anderer Ebene: AI Mode und AI Overviews zitieren für dieselbe Anfrage in 87 % der Fälle unterschiedliche Quellen.

Daraus folgen zwei Regeln für das Reporting. Erstens: Häufigkeiten statt Positionen – also „in 42 von 60 Durchläufen genannt“ statt „auf Platz 3“. Zweitens: ausreichend viele Durchläufe pro Frage. In der Diskussion um die Studie werden 60 bis 100 Durchläufe pro Prompt als Orientierung genannt; eine feste Untergrenze für jede Branche lässt sich daraus nicht ableiten.

Es gibt eine Einschränkung, die Mut macht: In engen Märkten sind Antworten stabiler. Eine Replikation der Methode für Hotelanfragen im Google AI Mode fand, dass dasselbe Hotel in rund der Hälfte der Durchläufe an erster Stelle stand. Je begrenzter das Angebot und je klarer die Frage, desto eher lässt sich Sichtbarkeit auch in kleineren Stichproben verfolgen.

Ein einzelner Screenshot aus ChatGPT ist deshalb ungefähr so aussagekräftig wie ein einzelnes Wetterfoto für das Klima eines Jahres.

Warum 20 Durchläufe selten reichen: eine einfache Rechnung

Warum so viele Durchläufe nötig sind, zeigt eine einfache Faustrechnung aus der Statistik. Wird eine Marke in der Hälfte der Durchläufe genannt, liegt die Unsicherheit dieser Quote (95-%-Intervall, Normalnäherung) bei 20 Durchläufen bei etwa ±22 Prozentpunkten, bei 60 Durchläufen bei etwa ±13 und bei 100 Durchläufen bei etwa ±10 Prozentpunkten.

Praktisch heißt das: Ein Anstieg der Mention Rate von 45 % auf 55 % ist bei 20 Durchläufen nicht von Zufall zu unterscheiden. Bei 100 Durchläufen wird er zumindest plausibel. Wer kleine Stichproben monatlich vergleicht, berichtet deshalb häufig Bewegungen, die es nicht gibt. Die Rechnung ist eine Vereinfachung – KI-Antworten sind keine perfekt unabhängigen Zufallsziehungen –, aber sie zeigt die Größenordnung des Problems.

Es gibt noch einen zweiten Hebel neben mehr Durchläufen: Fragen bündeln. Die SparkToro-Auswertung deutet darauf hin, dass KI-Systeme eher die Absicht hinter einer Frage erfassen als ihren Wortlaut. Es ist deshalb sinnvoll, mehrere Formulierungen derselben Absicht zu einem Cluster zusammenzufassen und die Quote pro Cluster zu berichten statt pro Einzelfrage.

Praxisbeispiel: Wie sieht ein Monatsreporting für KI-Sichtbarkeit aus?

Ein praxistaugliches KI-Reporting passt auf eine Seite, folgt den Stufen des Meusel Visibility Framework und zeigt Trends statt Einzelwerte. Das folgende Beispiel beschreibt den Aufbau für einen mittelständischen B2B-Anbieter; es enthält bewusst keine Ergebniszahlen, weil diese je Markt stark schwanken.

Schritt 1 – Prompt-Set festlegen. 30 Fragen aus echten Kundengesprächen, Vertriebs-E-Mails und der Search Console, gegliedert in drei Cluster: Problem („Wie reduziere ich …?“), Vergleich („Was ist besser: … oder …?“) und Anbieter („Welche Anbieter für … gibt es in Deutschland?“). Das Set bleibt mindestens ein Quartal unverändert, sonst sind Trends nicht vergleichbar.

Zwei Details entscheiden über die Qualität des Sets. Erstens: Markenfragen („Was bietet Firma X?“) und markenfreie Fragen („Welche Anbieter für … gibt es?“) gehören in getrennte Auswertungen. Markenfragen zeigen, wie korrekt eine KI über das Unternehmen spricht; nur markenfreie Fragen zeigen, ob es von sich aus genannt wird. Zweitens: Jede Frage bekommt zwei bis drei Formulierungsvarianten, die im selben Cluster ausgewertet werden.

Schritt 2 – Stichprobe planen. Jede Frage wird in drei KI-Systemen regelmäßig abgefragt, sodass pro Frage und System im Quartal rund 60 Durchläufe zusammenkommen. Ausgewertet wird pro Durchlauf: genannt ja/nein, als Quelle zitiert ja/nein, empfohlen ja/nein, genannte Wettbewerber.

Damit die Durchläufe vergleichbar bleiben, wird das Setting festgehalten: Sprache und Land, ob mit oder ohne Anmeldung abgefragt wird, ob die Websuche des Systems aktiv ist, Datum und – soweit sichtbar – das verwendete Modell. Personalisierte Konten mit langer Chat-Historie verzerren die Ergebnisse (mehr dazu im Knowledge Case Query Memory Effect); für das Monitoring sind neutrale Konten oder die Abfrage über ein Tool die sauberere Wahl.

Schritt 3 – Plattformdaten ergänzen. Aus der Search Console kommen die KI-Impressionen je Seite, aus den Bing Webmaster Tools die zitierten Seiten und Grounding Queries. Grounding Queries, die zu keiner Frage im Prompt-Set passen, sind Kandidaten für die nächste Version des Sets.

Schritt 4 – Wirkung erfassen. In GA4 werden der Kanal „AI Assistant“ und die Direct-Einstiege auf Fachseiten beobachtet. Im Anfrageformular fragt ein optionales Feld „Wie sind Sie auf uns aufmerksam geworden?“ auch KI-Assistenten ab – eine einfache Selbstauskunft, die keine Technik ersetzen kann.

Schritt 5 – Auf einer Seite verdichten. Fünf Zeilen, eine pro Stufe plus Wirkung, jeweils mit Kennzahl, Trend gegenüber Vorquartal und einem Satz Einordnung. Eine Zeile mit „keine Veränderung“ ist ein Ergebnis, kein Versäumnis.

Nach unserer Beobachtung ist Schritt 1 der, an dem die meisten Reportings scheitern: Das Prompt-Set wird am Schreibtisch erfunden statt aus echten Kundenfragen abgeleitet. Dann misst man sehr präzise etwas, das niemand fragt.

Wie liest man ein KI-Reporting? Typische Muster entlang der Stufen

Der Nutzen eines stufenweisen Reportings liegt in der Diagnose: Weil jede Stufe die vorherige voraussetzt, zeigt die erste schwache Stufe von unten, wo die Arbeit ansetzt. Die folgenden Muster sind Interpretationshilfen aus unserer Praxis, keine Gesetzmäßigkeiten – sie geben die Richtung vor, nicht die Maßnahme.

Muster 1 – Gute Findability, kaum KI-Impressionen. Die Seiten sind indexiert und ranken, tauchen in den KI-Berichten von Google und Bing aber kaum als Quelle auf. Häufige Ursache: Die Inhalte sind für Menschen lesbar, aber schwer als Wissenseinheit zu verarbeiten – lange Einleitungen, Kernaussagen tief im Text, Begriffe wechseln. Ansatz: Processability (GEO) – Antwort zuerst, klar abgegrenzte Abschnitte, einheitliche Begriffe.

Muster 2 – Hohe Citation Rate, niedrige Mention Rate. Inhalte werden als Beleg herangezogen, die Marke wird im Antworttext aber selten genannt. Das System nutzt das Wissen, verbindet es jedoch nicht mit einem Absender. Ansatz: Trust – Autor und Marke sichtbar machen, Entität konsistent beschreiben, Erwähnungen außerhalb der eigenen Website aufbauen.

Muster 3 – Hohe Mention Rate bei Markenfragen, niedrige bei markenfreien Fragen. Die KI kennt das Unternehmen, wenn man danach fragt, bringt es aber nicht von selbst ins Spiel. Die Marke ist bekannt, aber nicht mit dem Thema verknüpft. Ansatz: thematische Tiefe (Themen-Hubs) und Erwähnungen im Kontext der Kernthemen statt allgemeiner Markenpräsenz.

Muster 4 – Gute Sichtbarkeit, keine messbare Wirkung. Nennungen und Impressionen steigen, Sitzungen im Kanal „AI Assistant“ und Anfragen bleiben flach. Das kann an der Messlücke liegen (Referrer-Verlust, siehe oben) – oder daran, dass die Antwort die Frage bereits vollständig löst und kein Grund zum Klicken bleibt. Ansatz: zuerst Markensuchen und Direct-Einstiege auf Fachseiten prüfen, dann die Frage stellen, ob die zitierten Inhalte einen nächsten Schritt anbieten, den die KI-Antwort nicht ersetzt.

Welches Muster vorliegt, lässt sich nur erkennen, wenn Nennung, Zitat, Empfehlung und Wirkung getrennt erhoben werden. Eine einzelne „KI-Sichtbarkeitsquote“ würde alle vier Fälle gleich aussehen lassen.

Was bedeutet das für Ihr Reporting?

KI-Sichtbarkeit gehört ins bestehende Reporting, nicht in ein separates Dashboard mit eigenen Heldengeschichten. Fünf Konsequenzen:

  1. Plattformdaten zuerst nutzen. Die KI-Berichte in Google Search Console und Bing Webmaster Tools sind kostenlos, bilden echte Nutzung ab und sollten fester Teil jedes Monatsreportings sein.
  2. Positionen streichen, Häufigkeiten berichten. Mention Rate, Citation Rate und Recommendation Rate über ausreichend viele Durchläufe ersetzen „Platz in ChatGPT“.
  3. Nennung, Zitat und Empfehlung getrennt ausweisen. Nur so lässt sich erkennen, ob Inhalte fehlen (AEO) oder das Vertrauen in die Marke (Trust).
  4. Wirkung als Untergrenze lesen. Der GA4-Kanal „AI Assistant“ zeigt nicht alle KI-Besuche. Steigende Direct-Einstiege auf Fachseiten und Markensuchen gehören mit ins Bild.
  5. Quartale statt Wochen vergleichen. Die Streuung von KI-Antworten ist groß. Wer wöchentlich reagiert, optimiert auf Rauschen.

Wichtigste Erkenntnisse auf einen Blick

  • KI-Sichtbarkeit lässt sich aus drei Datenquellen messen: Plattformdaten (Google Search Console, Bing Webmaster Tools), Stichproben aus einem festen Prompt-Set und die Wirkung auf der eigenen Website.
  • Die KI-Berichte der Google Search Console zeigen seit 2026 Impressionen in AI Overviews und AI Mode, aber weder Klicks noch Suchanfragen; Bing Webmaster Tools weist zusätzlich Zitierungen und Grounding Queries aus, allerdings nur für Microsofts eigene Systeme.
  • Positionen in KI-Antworten sind kein belastbarer KPI: Identische Fragen liefern laut SparkToro in weniger als 1 von 100 Fällen dieselbe Markenliste – und Quoten aus 20 Durchläufen schwanken rechnerisch um rund ±20 Prozentpunkte.
  • Belastbar sind Häufigkeiten über viele Durchläufe – getrennt nach Nennung (Mention), Zitat (Citation) und Empfehlung (Recommendation).
  • Ein stufenweises Reporting entlang SEO → GEO → AEO → Trust dient der Diagnose: Die erste schwache Stufe von unten zeigt, wo die Arbeit ansetzt.
  • Der GA4-Kanal „AI Assistant“ zeigt nur eine Untergrenze der KI-Besuche, weil Apps oft den Referrer verlieren und Klicks aus AI Overviews als organischer Google-Traffic einlaufen.
Expertenmeinung

Fazit: KI-Sichtbarkeit ist messbar – als Häufigkeit, nicht als Platzierung

KI-Sichtbarkeit ist messbar – nur nicht so, wie wir es aus zwanzig Jahren Ranking-Reports gewohnt sind. Statt einer Position gibt es Häufigkeiten, statt einer Datenquelle drei, und keine davon ist vollständig. Das ist kein Grund, auf Messung zu verzichten, sondern ein Grund, sie sauberer aufzubauen.

Der wichtigste Schritt ist die Zuordnung: Jede Stufe des Meusel Visibility Framework bekommt ihre eigene Kennzahl – von der Auffindbarkeit (SEO) über die Verarbeitbarkeit (GEO) und die Beantwortbarkeit (AEO) bis zur Auswahl als Quelle (Trust), gefolgt von der Wirkung. Erst dann zeigt ein Reporting, wo Sichtbarkeit verloren geht, und nicht nur, dass sie es tut.

Messbar ist nicht die Position in einer KI-Antwort, sondern wie oft Sie vorkommen – und was danach passiert.

Key Terms – kurz erklärt

SEO (Findability)

Alle Maßnahmen, die sicherstellen, dass ein Inhalt von Suchmaschinen gefunden, technisch korrekt erfasst und thematisch eingeordnet wird. Im Reporting: Indexierung, klassische Impressionen und Klicks, Crawler-Zugriffe.

GEO (Processability)

Optimierung von Inhalten, damit KI-Systeme sie nicht nur lesen, sondern als eigenständige Wissenseinheiten verstehen und verarbeiten können. In der Branche wird GEO teils weiter gefasst und als Sammelbegriff für KI-Sichtbarkeit verwendet; im Meusel Visibility Framework steht er nur für Processability.

AEO (Answerability)

Optimierung von Inhalten, damit sie eine konkrete Frage direkt, eindeutig und belastbar beantworten. Im Reporting: Citation Rate im Prompt-Set und Grounding Queries.

Trust (Selectability)

Alle Signale, die zeigen, dass ein Inhalt von einer kompetenten, transparenten und aktuellen Quelle stammt – und damit entscheiden, ob er als Quelle ausgewählt, zitiert oder empfohlen wird. Im Reporting: Mention Rate, Recommendation Rate, Share of Voice.

Grounding Query

Ein Suchbegriff, den ein KI-System intern formuliert, um Quellen für eine Antwort abzurufen. Er ist nicht identisch mit der Frage des Nutzers; Bing Webmaster Tools weist Grounding Queries für zitierte Seiten aus.

Mention, Citation, Recommendation

Drei verschiedene Arten, in einer KI-Antwort vorzukommen: Mention = die Marke wird genannt; Citation = ein Inhalt wird als Beleg herangezogen; Recommendation = die Marke oder Lösung wird empfohlen. Im Reporting werden sie getrennt als Rate über viele Durchläufe ausgewiesen.

Prompt-Set

Eine feste Liste von Fragen, die regelmäßig in mehreren KI-Systemen abgefragt wird, um Stichproben zur KI-Sichtbarkeit zu erheben. Aussagekräftig wird es erst, wenn es aus echten Kundenfragen abgeleitet und über längere Zeit unverändert bleibt.

Share of Voice in KI-Antworten

Der Anteil der eigenen Marke an allen Markennennungen, die in den Antworten eines Prompt-Sets vorkommen. Die Kennzahl zeigt die relative Präsenz im Wettbewerbsumfeld, nicht die absolute Reichweite.

Deep Dive

FAQ – Die wichtigsten Fragen zum Messen von KI-Sichtbarkeit

Kann man sehen, wie oft ChatGPT die eigene Website zitiert?

Nicht direkt – OpenAI stellt dafür bisher keinen Bericht bereit. Messbar sind Besuche aus ChatGPT in GA4 (Kanal „AI Assistant“, Quelle chatgpt.com) und Nennungen oder Zitate über ein eigenes Prompt-Set. Beides zusammen ergibt ein Näherungsbild, keine vollständige Zählung.

Zeigt die Google Search Console Klicks aus AI Overviews?

Nein, der KI-Bericht der Search Console zeigt nur Impressionen, aufgeschlüsselt nach Seite, Land, Gerät und Datum. Klicks aus AI Overviews und AI Mode sind in den gesamten organischen Daten enthalten, lassen sich dort aber nicht getrennt ausweisen.

Warum erscheint KI-Traffic in GA4 oft als Direct?

Weil mobile KI-Apps Links häufig in eingebetteten Browsern öffnen und dabei die Herkunftsangabe (Referrer) verloren geht. GA4 kann den Besuch dann keiner Quelle zuordnen. Ein Anstieg direkter Einstiege auf Fachseiten kann deshalb ein Hinweis auf KI-Besuche sein, ist aber kein Beweis.

Wie viele Prompts braucht ein aussagekräftiges KI-Monitoring?

Entscheidender als die Zahl der Prompts ist die Zahl der Durchläufe pro Prompt. Für Kategorien mit vielen Anbietern werden 60 bis 100 Durchläufe pro Frage als Orientierung genannt; rechnerisch schrumpft die Unsicherheit einer Quote von rund ±22 Prozentpunkten bei 20 Durchläufen auf rund ±10 bei 100. In engen Märkten reichen oft weniger. Für den Einstieg sind 20 bis 40 gut gewählte Fragen aus echten Kundengesprächen sinnvoller als hunderte erfundene.

Lohnt sich ein kostenpflichtiges KI-Monitoring-Tool?

Das hängt davon ab, wie viele Prompts, Systeme und Wettbewerber verfolgt werden sollen. Tools automatisieren die Stichproben und machen große Durchlaufzahlen erst praktikabel. Sie lösen aber nicht die Grundprobleme: Positionen bleiben instabil, und ohne ein sinnvolles Prompt-Set misst auch das beste Tool das Falsche.

Kann man die eigenen Inhalte aus AI Overviews ausschließen?

Ja, Google bietet in der Search Console seit 2026 eine Einstellung, mit der Websites ihre Inhalte von generativen KI-Funktionen wie AI Overviews und AI Mode ausschließen können. Laut Google erhalten Websites, die das nutzen, aus diesen Funktionen dann weder Impressionen noch Traffic. Ob das sinnvoll ist, ist eine geschäftliche Abwägung, keine technische.

Abstraktes Dashboard mit Messkurven und Datenpunkten als Symbol für das Messen von Sichtbarkeit in KI-Antworten

Messen statt raten

Next Level Search Experience

PDF-Version herunterladen

Der komplette Knowledge Case inklusive Mess-Stack und MVI-Check als Arbeitsblatt.

PDF herunterladen →

Weitere Knowledge Cases