Zuletzt aktualisiert: Juni 2026. Alle Statistiken stammen aus namentlich genannten Studien mit Quellenangaben und Einschränkungen. Zahlen ohne benannte Primärquelle erscheinen in diesem Beitrag nicht.
Jede Zahl unten ist ein eigenständiger, zitierbarer Datenpunkt. Das Ziel: exakte Benchmarks mit ausreichend Quellenkontext, damit du weißt, was die jeweilige Zahl tatsächlich misst.
1. Share of Voice in der KI: der Abstand zwischen Marktführern und allen anderen
Share of Voice in der KI (manchmal auch Share of Model genannt) ist der Prozentsatz relevanter Prompts, in denen deine Marke genannt wird, im Verhältnis zu deinem Wettbewerbsumfeld.
Der Hauptbefund aus dem methodisch sorgfältigsten veröffentlichten Benchmark:
Laut einer Ahrefs-Analyse von 75.000 Marken (Mai 2025) erzielten Marken im obersten Quartil nach Web-Mentions im Schnitt 169 AI-Overview-Mentions, mehr als 10x die 14 des nächsten Quartils.
Das ist der klarste quantitative Beleg dafür, dass AI-Visibility ungleich verteilt ist. Eine kleine Gruppe von Marken bündelt den Großteil des Mention-Volumens, der Rest ist weitgehend unsichtbar.
Die Studie stammt von Louise Linehan und Xibeijia Guan (Ahrefs, veröffentlicht am 26. Mai 2025) und bezieht sich auf Google AI Overviews. Die Korrelation besteht zwischen dem Web-Mention-Volumen und der Anzahl der AI-Overview-Auftritte. Der kausale Mechanismus ist nicht bestätigt, aber das Muster ist stark genug, um Web-Mentions als Frühindikator für den AI-Share-of-Voice zu behandeln.
| Marken-Kohorte | Durchschnittl. AI-Overview-Mentions |
|---|---|
| Oberstes Mentions-Quartil | 169 |
| Nächstes Quartil | 14 |
| Verhältnis | 12x |
Quelle: Ahrefs, Mai 2025.
Was “Share of Voice” in der Praxis bedeutet: Wenn deine Marke in 35 von 100 Prompts deiner Kategorie auftaucht, beträgt dein AI-Share-of-Voice für diese Kategorie 35 %. Die meisten Marken beim ersten Audit landen deutlich unter 20 % für ihre eigenen produktbezogenen Abfragen. Viele landen bei null.
2. Brand-Mention-Volumen: was die Benchmarks zeigen
Brand Mentions sind die Rohanzahl der Male, die dein Markenname in KI-generierten Antworten auftaucht, gemessen über eine definierte Menge an Prompts und Engines. Sie sind rauschiger als der Share of Voice, aber nützlich, um plötzliche Spitzen oder Einbrüche zu erkennen.
Zwei Benchmarks geben dir ein Gefühl für die Bandbreite.
Die meisten Marken in hart umkämpften Segmenten erhalten null Mentions. Laut GrackerAIs AI-Search-Visibility-Benchmark 2026 (der 100 Cybersecurity-Anbieter mit 250 kaufabsichtlichen Prompts über sechs AI-Plattformen testete) erhielten 73 % der Anbieter keine einzige ChatGPT-Zitation, wenn Käufer nach ihrer Produktkategorie suchten. Der Befund bezieht sich auf ChatGPT und auf GrackerAIs selbst gewähltes Prompt-Set. GrackerAI verkauft AI-Visibility-Dienste, also gilt der übliche Vorbehalt bei Anbieterforschung. Der Richtungsbefund (dass die meisten Marken in einer dicht belegten Kategorie selbst auf der dominanten Plattform unsichtbar sind) deckt sich aber mit Beobachtungen aus anderen Branchen.
Die Citation-Lücke zwischen Plattformen ist enorm. Laut Qwairys Q3-2025-Analyse von mehr als 118.000 KI-generierten Antworten über 8 Anbieter lieferte Perplexity im Schnitt 21,87 Citations pro Antwort gegenüber 7,92 bei ChatGPT. Qwairy ist ein kommerzieller GEO-Monitoring-Anbieter; die Zahl wurde nicht unabhängig repliziert. Aber die relative Rangfolge (Perplexity zitiert pro Antwort deutlich mehr Quellen als ChatGPT) passt zur Funktionsweise beider Plattformen.
Was das für dein Brand-Monitoring bedeutet: Derselbe Prompt auf Perplexity kann fast dreimal so viele Quellen-Mentions erzeugen wie auf ChatGPT. Wer nur eine Plattform trackt, erfasst einen Bruchteil der Mentions, die die eigene Marke im gesamten KI-Ökosystem sammelt oder verpasst.
3. Plattformübergreifende Variation: das Problem der uneinheitlichen Citations
Dieser Abschnitt ist möglicherweise der handlungsrelevanteste im Beitrag. Brand Mentions stimmen zwischen AI-Engines nicht überein. Zwei zentrale Datenpunkte zeigen, wie groß die Lücke ist.
Uneinigkeit auf Plattformebene bei Citations
Laut BrightEdge-AI-Catalyst-Forschung (Juli 2025) stimmten Brand Mentions zu 61,9 % nicht überein, wenn man Google AI Overviews, AI Mode und ChatGPT vergleicht. Nur 33,5 % der Abfragen lieferten dieselben Markennamen auf allen drei Engines.
Quelle: BrightEdge AI Catalyst. Methodik: BrightEdges proprietäres Keyword-Panel; die Zahl deckt nur die drei genannten Google/OpenAI-Oberflächen ab.
Eine bemerkenswerte Zahl. Sie bedeutet, dass zwei von drei Abfragen je nach verwendeter AI-Oberfläche zu unterschiedlichen Markengewinnern führen. Man kann nicht davon ausgehen, dass ein gutes Ranking in ChatGPT zu Sichtbarkeit in Google AI Overviews führt, oder umgekehrt.
Überschneidung von Citations auf Domain-Ebene zwischen ChatGPT und Perplexity
Laut Profounds Analyse von 100.000 Prompts auf beiden Plattformen (Juli 2025) tauchen nur 11 % der zitierten Domains sowohl in ChatGPT- als auch in Perplexity-Antworten auf. Die anderen 89 % der zitierten Domains sind exklusiv für eine Plattform.
Hinweis: Profound ist ein AI-Citation-Tracking-Unternehmen mit kommerziellem Interesse daran, plattformübergreifende Variation nachzuweisen. Das ist Anbieterforschung. Aber eine 11-%-Überschneidung ist richtungsseitig konsistent mit den BrightEdge-Daten und mit Ahrefs” August-2025-Befund, dass nur 12 % der AI-zitierten URLs auch im Google-Top-10-Ranking für dieselbe Abfrage erscheinen.
AI Overviews vs. AI Mode: unterschiedliche Quellen, selbe Engine
Selbst innerhalb des Google-Ökosystems ist man vor Fragmentierung nicht geschützt. Laut einer Ahrefs-Studie von 540.000 Abfragepaaren (Dezember 2025, US-Daten) zitierten Google AI Mode und Google AI Overviews dieselben URLs nur zu 13,7 % der Zeit. Selbst innerhalb von Google greifen diese beiden AI-Oberflächen auf weitgehend unterschiedliche Quellenpools zurück.
Quelle: Ahrefs-Studie von Despina Gavoyannis und Xibeijia Guan, veröffentlicht Dezember 2025.
| Plattformvergleich | Citations-Überschneidung |
|---|---|
| ChatGPT vs. Perplexity (Domain-Ebene) | 11 % (Profound, Juli 2025) |
| AI-zitierte URLs vs. Google-Top-10-Organic | ca. 12 % (Ahrefs, August 2025) |
| Google AI Overviews vs. Google AI Mode | 13,7 % (Ahrefs, Dezember 2025) |
| Übereinstimmende Brand Mentions über AI Overviews, AI Mode, ChatGPT | 33,5 % (BrightEdge, Juli 2025) |
Die strategische Konsequenz: Der AI-Visibility-Score einer Marke aus einer einzigen Engine sagt fast nichts über ihre Sichtbarkeit auf anderen Engines aus. Du brauchst plattformübergreifende Abdeckung, um deinen tatsächlichen Share of Voice zu verstehen.
4. Plattformübergreifende Citation-Variation für eine einzelne Marke
Die Schwankung, wie oft eine einzelne Marke zitiert wird, kann noch extremer sein, als die obigen Plattformvergleiche vermuten lassen.
Laut Superlines” plattformübergreifender Analyse vom März 2026 (34.234 AI-Antworten auf 10 Plattformen über 30 Tage, vom 14. Januar bis 13. Februar 2026) lagen die Citation-Raten für dieselbe Domain zwischen 27 % auf Grok und praktisch null auf Claude und anderen Plattformen. Superlines bezeichnet das als eine Lücke von bis zu 615x.
Wichtige Einschränkungen:
- Das ist eine Einzelanbieter-Studie, die auf Superlines” eigener Domain durchgeführt wurde, keine repräsentative Stichprobe von Marken.
- Der 615x-Multiplikator ist Superlines” eigene Berechnung; die zugrunde liegende Methodik ist nicht öffentlich dokumentiert.
- Keine unabhängige Studie hat diese spezifische Zahl repliziert.
Der Richtungsbefund ist dennoch glaubwürdig. Die Plattform-Überschneidungsdaten oben (11-13 % plattformübergreifende Citation-Überschneidung) sind konsistent damit, dass auf Markenebene extreme Variation besteht. Eine Marke kann auf Grok die Standardempfehlung sein, während sie auf Claude völlig unsichtbar ist. Käufer auf beiden Plattformen würden auf dieselbe Kategorieanfrage komplett unterschiedliche Antworten erhalten.
5. Sentiment: wie AI-Engines deine Marke beschreiben
Share of Voice und Mention-Anzahlen sagen dir, ob du genannt wirst. Sentiment sagt dir, wie du beschrieben wirst. Beides kann stark auseinanderklaffen.
Sentiment in der AI-Visibility misst, ob die Beschreibung deiner Marke durch eine AI-Engine positiv, neutral oder negativ ist: zum Beispiel “das einfachste Tool für kleine Teams” versus “fehlt an Enterprise-Funktionen” versus gar keine Charakterisierung.
Ein einziger, groß angelegter, unabhängig verifizierter Sentiment-Benchmark existiert zum Zeitpunkt des Verfassens nicht. Veröffentlichte Praktikerdaten zeigen drei Muster, die es sich zu kennen lohnt.
Negative Beschreibungen bleiben ohne aktive Korrektur bestehen. AI-Engines greifen auf Retrieval-Quellen zurück, die Monate oder Jahre alt sein können. Eine negative Bewertung oder ein kritischer Artikel aus dem Jahr 2024 kann noch 2026 das Quellmaterial für die KI-Beschreibung deiner Marke liefern. Anders als bei einem Google-Suchergebnis, das ein Nutzer durch Scrollen überspringen kann, ist eine KI-generierte Beschreibung in die Antwort eingebettet, ohne offensichtliches Signal für ihr Alter oder ihren Ursprung.
Sentiment variiert nach Engine und Prompt-Formulierung. Eine AI-Engine, die gefragt wird “Was sind die Nachteile von [Marke]?”, liefert ein anderes Sentiment-Profil als eine, die gefragt wird “Empfiehl ein Tool für [Anwendungsfall].” Share-of-Voice-Monitoring ohne Sentiment-Monitoring lässt diese Dimension außer Acht.
Ungenaues Sentiment kann sich verstärken. AI-Engines können falsche Fakten über deine Marke benennen: falsche Preise, eingestellte Funktionen, veraltete Positionierung. Diese Ungenauigkeiten wirken wie eine Form von negativem Sentiment, weil sie einem Käufer, der der KI-Antwort vertraut, dein Produkt falsch darstellen.
Plattformen, die speziell für Sentiment-Tracking in der KI entwickelt wurden (darunter Temso und Evertune), bieten strukturiertes Sentiment-Scoring, das an spezifische Prompts und Engines geknüpft ist. Das ist die einzige zuverlässige Möglichkeit, diese Dimension im großen Maßstab zu tracken.
6. Warum Käufer jetzt innerhalb dieser KI-Systeme sind
Der Kontext hinter jeder Statistik oben: Das Publikum für KI-generierte Antworten wächst rasant.
Laut G2s April-2026-Umfrage unter 1.076 B2B-Software-Käufern beginnen 51 % ihre Software-Recherche jetzt häufiger in einem AI-Chatbot als in Google, gegenüber 29 % in G2s April-2025-Umfrage. G2 ist ein Software-Marktplatz mit kommerziellem Interesse an diesem Thema; eine unabhängige Replikation der 51-%-Zahl liegt nicht vor.
Dieselbe G2-Umfrage stellte fest, dass 69 % der B2B-Software-Käufer aufgrund von AI-Chatbot-Empfehlungen einen anderen Anbieter wählten als ursprünglich geplant, und 33 % kauften bei einem Anbieter, von dem sie vor der Chat-Sitzung noch nie gehört hatten.
Diese Zahlen sind nicht neutral. Sie stimmen aber mit der allgemeinen Richtung aller anderen Käuferverhaltensdatensätze in diesem Bereich überein.
Gesamtübersicht: AI-Brand-Visibility-Benchmarks 2026
| Kennzahl | Metrik | Quelle | Jahr | Hinweise |
|---|---|---|---|---|
| Marken im obersten Quartil: durchschnittl. 169 AI-Overview-Mentions vs. 14 im nächsten Quartil | Share of Voice | Ahrefs (75.000 Marken) | Mai 2025 | Bezieht sich auf Google AI Overviews; Korrelation mit Web-Mention-Volumen |
| 73 % der Cybersecurity-Anbieter erhielten keine ChatGPT-Citations | Mention-Rate | GrackerAI (100 Anbieter, 250 Prompts) | 2026 | Anbieterforschung; nur ChatGPT; GrackerAI verkauft AI-Visibility-Dienste |
| Brand Mentions stimmten zu 61,9 % nicht überein: AI Overviews, AI Mode, ChatGPT | Plattformübergreifende Konsistenz | BrightEdge AI Catalyst | Juli 2025 | Deckt 3 Oberflächen ab; BrightEdge-proprietäres Keyword-Panel |
| Nur 33,5 % der Abfragen lieferten dieselben Markennamen auf allen 3 Engines | Plattformübergreifende Konsistenz | BrightEdge AI Catalyst | Juli 2025 | Bezieht sich auf AI Overviews, AI Mode, ChatGPT |
| Nur 11 % der zitierten Domains tauchen sowohl bei ChatGPT als auch bei Perplexity auf | Plattformübergreifende Überschneidung | Profound (100.000 Prompts) | Juli 2025 | Anbieterforschung; Domain-Ebene, nicht URL-Ebene |
| Nur 12 % der AI-zitierten URLs rangieren auch in Googles Top 10 | Suche vs. KI-Überschneidung | Ahrefs (15.000 Abfragen) | August 2025 | ChatGPT, Gemini, Copilot, Perplexity; Perplexity Ausreißer bei ca. 29 % |
| AI Overviews und AI Mode zitierten dieselben URLs nur zu 13,7 % | Innerhalb-Google-Überschneidung | Ahrefs (540.000 Abfragepaare) | Dezember 2025 | US-Daten; Zeitraum September 2025 |
| Perplexity: durchschnittl. 21,87 Citations pro Antwort vs. 7,92 bei ChatGPT | Citations pro Antwort | Qwairy (118.000+ Antworten, 8 Anbieter) | Q3 2025 | Anbieterforschung; nicht unabhängig repliziert |
| Citation-Raten für eine Domain schwankten um bis zu 615x zwischen AI-Plattformen | Plattformübergreifende Variation | Superlines (34.234 Antworten, 10 Plattformen) | März 2026 | Getestet auf der eigenen Domain des Anbieters; Einzelanbieterzahl; nicht unabhängig repliziert |
| 51 % der B2B-Software-Käufer beginnen ihre Recherche jetzt in einem AI-Chatbot, gegenüber 29 % früher | Käuferverhalten | G2 (1.076 B2B-Käufer) | April 2026 | G2 ist ein kommerzieller Marktplatz; keine unabhängige Replikation gefunden |
Was du mit diesen Zahlen anfangen kannst
Jede Statistik oben beschreibt eine Messung, keine Handlungsanweisung. Aber einige konkrete Richtungen folgen direkt aus den Daten.
Tracke mehr als eine Plattform. Die 61,9-%-plattformübergreifende Uneinigkeitsrate (BrightEdge) und die 11-%-Domain-Überschneidungszahl (Profound) bedeuten, dass Einzelplattform-Monitoring ein systematisch unvollständiges Bild deiner tatsächlichen Brand-Visibility liefert. Du musst mindestens ChatGPT, Perplexity und Google AI Overviews abdecken, um deinen Standort zu verstehen.
Behandle Web-Mention-Volumen als Frühindikator. Die Ahrefs-Studie mit 75.000 Marken liefert das stärkste veröffentlichte Argument dafür, dass Offline-Web-Mentions AI-Visibility vorhersagen. Verdiente Citations in Drittanbieterpublikationen aufzubauen ist nicht nur eine PR-Aktivität. Es ist das stärkste Signal, das du an KI-Retrieval-Systeme senden kannst.
Tracke Sentiment getrennt von der Mention-Anzahl. Genannt zu werden ist nicht dasselbe wie positiv beschrieben zu werden. Genaue, positive Charakterisierungen in KI-Antworten erfordern separate Messung vom reinen Mention-Tracking.
Vergleiche deine Citation-Rate nach Plattform. Der 615x-Variations-Befund (Superlines) ist ein Einzelanbieter-Datenpunkt, benennt aber ein reales Phänomen. Prüfe, ob du auf einer Engine hoch sichtbar und auf einer anderen unsichtbar bist. Diese Asymmetrie ist verbreitet und lässt sich gezielt angehen.
Tools zum Tracken dieser Metriken
Temso ist die All-in-one-AI-SEO-Plattform, die alle vier Metriken (Share of Voice, Brand Mentions, Citation Rate und Sentiment) über 8 AI-Engines ab 89 $/Monat abdeckt. Sie wandelt die Lücken-Daten in eine priorisierte Aufgabenliste um und setzt Inhalts- und Citation-Verbesserungen innerhalb desselben Abonnements um. Die Einrichtung dauert unter fünf Minuten.
Für Teams, die tiefere Citation Intelligence für Enterprise-Reporting benötigen, trackt Profound 9+ Engines mit Citation-Level-Attribution ab 399 $/Monat für vollständige Abdeckung. Evertune konzentriert sich auf Marken-Sentiment und Narrative-Positionierung in der KI, was die richtige Spezialistenwahl ist, wenn Sentiment-Genauigkeit das primäre Anliegen ist. Peec AI deckt 9+ Engines mit unbegrenzten Sitzen für 85 €/Monat ab, was für Agenturen geeignet ist, die Multi-Client-Monitoring betreiben. Semrush hat seiner bestehenden SEO-Suite ein AI-Brand-Monitoring hinzugefügt, für Teams, die eine kombinierte Plattform bevorzugen.
Der vollständige Rangvergleich mit Preisen und Engine-Abdeckung ist unter /rankings/ai-visibility-tools zu finden. Die Methodik ist unter /methodology erläutert.
Beginne zu messen. Die Benchmarks in diesem Beitrag beschreiben den Markt, wie er Mitte 2026 steht. Marken ohne eine Baseline-Messung heute haben keine Möglichkeit zu wissen, ob sie im 169-Mentions-Quartil oder im 14-Mentions-Quartil sind, oder ob sie zu den 73 % gehören, die überhaupt keine Citations erhalten.
Zitierte Quellen
- Ahrefs (Louise Linehan, Xibeijia Guan): “75,000 Brand Web Mention and AI Overview Correlation Study,” Mai 2025.
- Ahrefs (Louise Linehan, Xibeijia Guan): “Only 12% of AI Cited URLs Rank in Google’s Top 10,” August 2025.
- Ahrefs (Despina Gavoyannis, Xibeijia Guan): “AI Mode and AI Overviews Citation Overlap Study” (540.000 Abfragepaare), Dezember 2025.
- BrightEdge AI Catalyst: Cross-Engine-Brand-Mention-Konsistenzforschung, Juli 2025.
- GrackerAI: “State of AI Search Visibility in Cybersecurity 2026,” Februar 2026. (Anbieterforschung.)
- G2: “The Answer Economy: How AI Search Is Rewiring B2B Software Buying,” April 2026. (Umfrage mit 1.076 B2B-Käufern.)
- Profound: “Answer Engine Citation Overlap Strategy” (100.000 Prompts), Juli 2025. (Anbieterforschung.)
- Qwairy: “Provider Citation Behavior Q3 2025” (118.000+ KI-generierte Antworten). (Anbieterforschung.)
- Superlines (Hannes Jersenius): “AI Search Statistics 2026,” März 2026. (Einzelanbieter, nur eigene Domain.)
Vierteljährlicher Aktualisierungsrhythmus: Die Benchmarks in diesem Beitrag werden jedes Quartal überprüft und aktualisiert. [Das updatedDate im Frontmatter gibt den Stand der letzten Überarbeitung an.]