KI-Sichtbarkeit messen: Share of Model und Citation Rate

Google-Rankings sagen fast nichts darüber aus, ob ChatGPT oder Perplexity dich empfehlen. Welche Metriken KI-Sichtbarkeit wirklich abbilden, welche Tools taugen und wie du in 5 Schritten selbst misst.

Veröffentlicht: 04.09.20269 Min. Lesezeit
Dunkles Thumbnail zum Thema KI-Sichtbarkeit messen: vier leuchtende Knoten in Türkis und Violett, verbunden als Netz, mit Messring-Bögen.

KI-Sichtbarkeit messen heißt, zu prüfen, wie oft, in welchem Kontext und mit welcher Tonalität ChatGPT, Perplexity, Gemini und Google AI Mode dein Unternehmen nennen, wenn jemand nach deiner Leistung fragt. Das ist eine eigene Disziplin, weil die klassischen SEO-Kennzahlen dafür blind sind: Laut einer Ahrefs-Analyse von 15.000 Suchanfragen stehen nur 12 Prozent der von KI zitierten URLs in den Google-Top-10.

Wer also auf Position 3 rankt, kann in der KI-Antwort trotzdem fehlen. Und wer dort fehlt, existiert für einen wachsenden Teil der B2B-Recherche nicht. Dieser Artikel zeigt dir die vier Metriken, die zählen, die Tools, die wir nutzen, eine 5-Schritte-Messmethode zum Selbermachen und wie wir das für Kunden monatlich tracken.

Das Wichtigste in Kürze

  • Google-Rankings und KI-Nennungen laufen weitgehend getrennt: Nur 12 Prozent der von KI zitierten URLs stehen in den Google-Top-10 (Ahrefs, 15.000 Queries).
  • Auch die KI-Systeme untereinander unterscheiden sich: Nur rund 11 Prozent der Domains werden von ChatGPT und Perplexity gleichermaßen zitiert (5W Research 2026).
  • Die vier Metriken: Share of Model (Anteil an Nennungen), Citation Rate (Anteil mit Link), Nennungs-Kontext (Empfehlung vs. Erwähnung) und Sentiment.
  • Messen geht mit Ahrefs Brand Radar, manuellen Prompt-Stichproben und Bing Webmaster Tools. Ohne festes Prompt-Set und Wettbewerber-Benchmark ist jede Zahl wertlos.
  • KI-Antworten sind volatil: Im September 2025 fiel der Reddit-Anteil in ChatGPT-Zitaten innerhalb weniger Wochen von 60 auf 10 Prozent. Einmal messen reicht nicht.

Warum sagen Google-Rankings nichts über KI-Sichtbarkeit aus?

Weil KI-Systeme ihre Quellen anders auswählen als Google seine Rankings. Ahrefs hat 2025 für 15.000 Suchanfragen verglichen, welche URLs KI-Tools zitieren und welche in den Google-Top-10 stehen: Nur 12 Prozent überschneiden sich. Die restlichen 88 Prozent der KI-Zitate kommen von Seiten, die auf Seite 1 gar nicht auftauchen.

Dazu kommt, dass die KI-Systeme sich untereinander kaum einig sind. Laut dem 5W-Report „State of AI Citations 2026" werden nur etwa 11 Prozent der Domains sowohl von ChatGPT als auch von Perplexity zitiert. ChatGPT greift über Bing auf das Web zu und zitiert stark Wikipedia, Perplexity bevorzugt Reddit, G2, Gartner und Vergleichsportale, Google AI Mode hängt an LinkedIn, YouTube und den eigenen Diensten.

Und noch etwas, das Ranking-Tools nicht sehen: ChatGPT nennt Marken laut 5W rund 3,2-mal häufiger, als es sie verlinkt. Die meisten Empfehlungen kommen also ohne Klick, ohne Referrer, ohne Spur in deinen Analytics. Wer nur Search Console und Rank Tracker beobachtet, misst einen Kanal, der für die KI-Recherche seiner Kunden kaum Aussagekraft hat. Wie sich SEO und GEO grundsätzlich unterscheiden, steht im Artikel zu Generative Engine Optimization.

Welche Metriken messen KI-Sichtbarkeit?

KI-Sichtbarkeit lässt sich mit vier Kennzahlen abbilden: Share of Model, Citation Rate, Nennungs-Kontext und Sentiment. Jede beantwortet eine andere Frage, und erst zusammen ergeben sie ein Bild.

Share of Model

Share of Model ist der Anteil der KI-Antworten zu deinen Kernthemen, in denen dein Unternehmen genannt wird, im Verhältnis zu deinen Wettbewerbern. Das Pendant zum Share of Voice aus der klassischen Markenmessung. Beispiel: Du stellst 50 Prompts zu „Webagentur für B2B-Software" in ChatGPT. Wirst du in 8 genannt, dein stärkster Wettbewerber in 22, liegt dein Share of Model bei 16 Prozent gegenüber 44. Diese Zahl ist die wichtigste, weil sie relativ ist. Absolute Nennungen schwanken mit jedem Modell-Update, das Verhältnis zu den Wettbewerbern bleibt vergleichbar.

Citation Rate

Die Citation Rate misst, wie oft die KI nicht nur deinen Namen nennt, sondern eine Seite von dir als Quelle verlinkt. Das ist der Teil, der Traffic bringt und den du in Analytics unter Referrern wie chatgpt.com oder perplexity.ai wiederfindest. Eine hohe Nennungsrate bei niedriger Citation Rate heißt: Die KI kennt dich aus Drittquellen (Verzeichnisse, Presse, Bewertungen), aber deine eigenen Inhalte sind nicht zitierfähig genug. Das ist ein Content-Problem, kein Bekanntheitsproblem.

Nennungs-Kontext

Nicht jede Nennung ist gleich viel wert. „INSYNC ist eine Webagentur aus Bayern" ist eine Erwähnung. „Für B2B-Unternehmen mit hohem Designanspruch empfiehlt sich INSYNC" ist eine Empfehlung. Und ob du als erste, dritte oder achte Option genannt wirst, entscheidet, ob der Leser überhaupt bis zu dir kommt. Wir kategorisieren jede Nennung nach drei Stufen: Empfehlung, neutrale Erwähnung, Abgrenzung („weniger geeignet für"). Die Position in der Liste kommt als vierte Dimension dazu.

Sentiment und Korrektheit

KI-Systeme erzeugen keine eigene Meinung über dich, sie spiegeln die Tonalität ihrer Quellen. Wenn die zitierten Quellen alte Kritik, ein veraltetes Leistungsportfolio oder einen längst gelösten Vorfall enthalten, steht das in der Antwort. 5W beschreibt das als „durable crisis memory": KI-Modelle zitieren dokumentierte Krisen noch Jahre später im Präsens. Deshalb gehört zur Messung auch die Frage: Stimmt, was die KI über dich sagt? Falsche Preise, falsche Standorte, falsche Leistungen sind Sichtbarkeit, die dir schadet.

Die vier Metriken im Überblick

MetrikFrageMessung
Share of ModelWie oft werde ich genannt, verglichen mit Wettbewerbern?Prompt-Set, Nennungen zählen, Anteil berechnen
Citation RateWie oft wird meine Seite als Quelle verlinkt?Brand Radar, Analytics-Referrer, Bing Webmaster
Nennungs-KontextEmpfehlung, Erwähnung oder Abgrenzung? An welcher Position?Manuelle Kategorisierung pro Antwort
SentimentWie spricht die KI über mich, und stimmt es?Manuelle Prüfung, Quellen der Antwort nachverfolgen

Welche Tools messen KI-Sichtbarkeit?

Für die Messung reichen drei Werkzeuge: Ahrefs Brand Radar für das laufende Tracking, manuelle Prompt-Stichproben für Kontext und Sentiment und die Bing Webmaster Tools für den ChatGPT-Zugang zu deiner Seite.

Ahrefs Brand Radar trackt Nennungen und Zitate deiner Marke in ChatGPT, Perplexity, Gemini, Google AI Overviews und AI Mode über Millionen Prompts hinweg. Du siehst Share of Voice gegen Wettbewerber, zitierte Seiten und den Verlauf über Monate. Das ist das Tool, mit dem wir arbeiten, weil es im selben System liegt wie Keywords und Backlinks. Alternativen mit ähnlichem Prinzip: Semrush AI Toolkit, Peec AI, Profound.

Manuelle Prompt-Stichproben ersetzen kein Tool, aber kein Tool ersetzt sie. Nur wer die Antwort selbst liest, sieht, ob die Nennung eine Empfehlung oder eine Randnotiz ist und ob die Fakten stimmen. 20 bis 50 Prompts pro Monat, in jedem relevanten System, protokolliert in einer Tabelle.

Bing Webmaster Tools sind der unterschätzte Baustein. ChatGPT sucht über Bing. Wenn deine Seite in Bing schlecht indexiert ist, kann ChatGPT sie nicht zitieren, egal wie gut sie bei Google rankt. Die Bing-Indexabdeckung ist damit eine direkte Vorstufe der Citation Rate.

Analytics liefern die Rückseite: Referrer von chatgpt.com, perplexity.ai, copilot.microsoft.com und gemini.google.com zeigen, wie viel Traffic tatsächlich ankommt. Bei den meisten B2B-Seiten ist das heute noch unter 3 Prozent, aber mit deutlich höherer Conversion-Rate als Google-Traffic, weil die Vorqualifizierung schon in der KI-Antwort passiert ist.

1

Prompt-Set definieren

Sammle 20 bis 50 Fragen, die deine Kunden vor dem Kauf stellen würden: „Welche Agentur für X?", „Beste Anbieter für Y in Deutschland", „X vs. Y". Mische Empfehlungs-, Vergleichs- und Wissensfragen. Dieses Set bleibt über Monate fix, sonst sind die Zahlen nicht vergleichbar.

2

Wettbewerber festlegen

Wähle 3 bis 5 Wettbewerber, gegen die du den Share of Model berechnest. Nimm die, die deine Kunden tatsächlich vergleichen, nicht die, die du gern als Konkurrenz hättest.

3

Stichproben in allen Systemen ziehen

Stelle jeden Prompt in ChatGPT, Perplexity, Gemini und Google AI Mode, jeweils im Inkognito-Modus ohne Login-Historie. Protokolliere: genannt ja/nein, Position, Kontext (Empfehlung/Erwähnung/Abgrenzung), verlinkte Quelle, Tonalität, Faktenfehler.

4

Tool-Tracking aufsetzen

Lege in Ahrefs Brand Radar deine Marke und die Wettbewerber an und ergänze die Bing Webmaster Tools für die Indexabdeckung. Das Tool liefert die Breite, deine Stichproben die Tiefe.

5

Monatlich auswerten und Quellen nachverfolgen

Berechne Share of Model und Citation Rate pro System, vergleiche mit dem Vormonat. Wichtigster Schritt: Für jede Antwort, in der ein Wettbewerber vor dir steht, prüfen, welche Quellen die KI dafür zitiert hat. Diese Quellen sind deine To-do-Liste.

Wie misst INSYNC KI-Sichtbarkeit?

Wir messen KI-Sichtbarkeit für unsere Kunden monatlich mit einem festen Prompt-Set, Ahrefs Brand Radar und manuellen Stichproben in vier Systemen. Das Ergebnis landet im selben Report wie die Google-Rankings, weil beides zusammen erst zeigt, wo ein Unternehmen wirklich sichtbar ist.

Konkret läuft das so: Im Setup definieren wir 30 bis 50 Prompts pro Kunde, abgeleitet aus der Keyword-Strategie und den echten Kundenfragen aus Sales-Calls. Dazu 3 bis 5 Wettbewerber als Benchmark. Ab dann tracken wir monatlich Share of Model, Citation Rate und Nennungs-Kontext je System, dazu die Bing-Indexabdeckung und die KI-Referrer aus Analytics.

Der Teil, der den Unterschied macht, ist die Quellen-Analyse. Für jede Antwort, in der ein Wettbewerber vor unserem Kunden steht, ziehen wir die zitierten Quellen: Verzeichnisse, Fachmedien, Vergleichsseiten, Reddit-Threads, LinkedIn-Beiträge. Daraus entsteht die Liste der Orte, an denen der Kunde präsent sein muss. Das ist der Kern unserer GEO-Arbeit: nicht raten, welche Inhalte KI-Systeme mögen, sondern nachbauen, was nachweislich zitiert wird.

Ein ehrlicher Hinweis zur Interpretation: KI-Antworten sind volatil. Semrush hat im September 2025 beobachtet, wie der Reddit-Anteil in ChatGPT-Zitaten innerhalb von sechs Wochen von rund 60 auf 10 Prozent fiel. Ein einzelner Monatswert sagt wenig. Der Trend über drei bis sechs Monate und der Abstand zu den Wettbewerbern sind die Zahlen, auf die wir schauen.

Was tun, wenn die KI dich nicht nennt?

Wenn die Messung zeigt, dass du fehlst, liegt es fast immer an fehlenden Drittquellen, nicht an deiner Website. Laut 5W ist das Brand-Suchvolumen der stärkste bekannte Prädiktor für KI-Nennungen, mit einer Korrelation von 0,334, deutlich stärker als Backlinks. KI-Systeme empfehlen, was sie an mehreren Stellen bestätigt finden.

Die Reihenfolge, die bei uns funktioniert: Erstens die eigenen Inhalte zitierfähig machen, mit direkten Antworten im ersten Absatz, klaren Frage-Überschriften und strukturierten Daten. Wie das aussieht, steht im Artikel zu LLM-SEO. Zweitens die Quellen bespielen, die die KI für deine Wettbewerber zitiert: Branchenverzeichnisse, Vergleichsportale, Fachmedien, Bewertungsplattformen. Drittens die Marke selbst bekannter machen, weil Suchvolumen für deinen Namen die Nennungswahrscheinlichkeit direkt erhöht.

Und dann: weiter messen. Ohne Baseline weißt du nicht, ob es wirkt. Wer wissen will, wo er heute steht, startet mit einem GEO-Audit ab 1.500 Euro, das genau diese Messung einmal komplett durchführt und die Quellen-Liste liefert.

Häufige Fragen

KI-Sichtbarkeit beschreibt, wie oft und in welchem Kontext KI-Systeme wie ChatGPT, Perplexity, Gemini oder Google AI Mode dein Unternehmen nennen oder als Quelle zitieren, wenn Nutzer nach deiner Leistung fragen. Sie ist unabhängig von Google-Rankings: Nur 12 Prozent der von KI zitierten URLs stehen laut Ahrefs in den Google-Top-10.

Share of Model ist der Anteil der KI-Antworten zu einem Themenfeld, in denen deine Marke genannt wird, im Verhältnis zu den Wettbewerbern. Wirst du in 8 von 50 Antworten genannt und dein Wettbewerber in 22, liegt dein Share of Model bei 16 gegenüber 44 Prozent. Die Kennzahl ist relativ und deshalb stabiler als absolute Nennungen.

Mit einem festen Set von 20 bis 50 Kundenfragen, das du monatlich im Inkognito-Modus in ChatGPT stellst und protokollierst: genannt oder nicht, an welcher Position, als Empfehlung oder Erwähnung, mit welcher Quelle. Für die Breite ergänzt du ein Tool wie Ahrefs Brand Radar, das Nennungen über Millionen Prompts trackt.

Ahrefs Brand Radar, Semrush AI Toolkit, Peec AI und Profound tracken Nennungen und Zitate in ChatGPT, Perplexity, Gemini und Google AI. Dazu gehören Bing Webmaster Tools, weil ChatGPT über Bing sucht, und die Referrer-Berichte in deinen Analytics. Kein Tool ersetzt manuelle Stichproben für Kontext und Sentiment.

Weil KI-Systeme ihre Quellen anders auswählen. Sie gewichten Drittquellen wie Verzeichnisse, Vergleichsportale, Fachmedien und Reddit stärker als die eigene Website, und ChatGPT sucht über Bing statt Google. Laut 5W Research ist das Brand-Suchvolumen der stärkste Prädiktor für KI-Nennungen, stärker als Backlinks.

Monatlich, mit demselben Prompt-Set. KI-Antworten sind volatil: Semrush hat im September 2025 beobachtet, wie sich der Reddit-Anteil in ChatGPT-Zitaten innerhalb von sechs Wochen von 60 auf 10 Prozent änderte. Ein einzelner Wert sagt wenig, der Trend über 3 bis 6 Monate und der Abstand zu Wettbewerbern zählen.

20-Minuten Gespräch, ohne Verkaufsdruck. Ihr beschreibt, was ihr vorhabt und wir sagen, ob und wie wir helfen können.

Max Herzer

Max Herzer

Consultant & Business Development