AEO-Benchmarking: Wie du dich gegen die Konkurrenz vergleichst
Recherche
Q2 2026
Lesezeit
8 Min
Niveau
Praxis
Engines
Multi
Dieser Artikel kann Affiliate-Links enthalten. Wenn du über diese Links einkaufst, erhalten wir möglicherweise eine kleine Provision — ohne Mehrkosten für dich. Das hilft uns, weiterhin kostenlose Inhalte zu erstellen.
AEO-Benchmarking funktioniert anders als klassisches SEO-Benchmarking. Statt Rankings pro Keyword vergleichst du Citation-Share in ChatGPT, Gemini, Perplexity und Claude, und das pro Themen-Cluster, nicht pauschal. Ein Wettbewerber kann in einem Cluster bei 35% Citation-Share liegen und im Nachbar-Cluster bei 5%, ohne dass die Durchschnittszahl das verrät.
Ein belastbarer Benchmark braucht sechs Dimensionen: Citation-Share, Schema-Coverage, Content-Tiefe, Crawler-Frequenz, Topical-Authority und Brand-Mention-Tonalität. Wer eine Dimension auslässt, bekommt ein verzerrtes Bild, und entscheidet auf falscher Basis über Budget.
Dimension 1: Citation-Share als Kernmetrik
Citation-Share ist der prozentuale Anteil aller relevanten Prompts in deinem Set, in denen die Marke als Quelle genannt wird. Tools wie Otterly, Profound und Peec liefern diese Daten täglich für die großen LLMs. Ein robuster Wert braucht mindestens 100 Prompts pro Cluster.
Beim Wettbewerbsvergleich gehst du immer pro Cluster vor. Definiere für jeden Cluster ein eigenes Prompt-Set mit 20 bis 50 typischen User-Fragen. Diese Sets müssen über alle Wettbewerber identisch bleiben, sonst sind die Ergebnisse nicht vergleichbar.
Dokumentiere für jeden Wettbewerber drei Werte: aktueller Citation-Share, Trend über 30 Tage und Anzahl der Mit-Nennungen pro Antwort. Letzteres ist ein Frühindikator, wer häufig genannt wird, ohne dass die Konkurrenz weicht, baut Marktanteil organisch auf.
Dimension 2: Schema-Coverage und strukturierte Daten
Schema-Coverage ist die Quote der Wettbewerber-URLs, die mindestens ein Schema-Markup ausspielen. Du erhebst sie über Crawl-Tools wie Screaming Frog (kostenlos bis 500 URLs) oder Sitebulb (Enterprise). Eine hohe Coverage korreliert mit höherem Citation-Share, weil LLMs strukturierte Daten leichter zitieren können.
| Schema-Typ | Wettbewerber A | Wettbewerber B | Deine Domain |
|---|---|---|---|
| Article | 95% | 88% | 72% |
| FAQPage | 62% | 41% | 28% |
| HowTo | 35% | 22% | 12% |
| Product | 81% | 76% | 58% |
Die Lücke zur Konkurrenz ist der wichtigste Output dieser Dimension. Wenn Wettbewerber A bei FAQPage 62% Coverage hat und du bei 28%, weißt du sofort, wo der Hebel liegt. Schließe die Lücke schrittweise, 10 Prozentpunkte pro Monat ist ein realistisches Ziel.
Vergleiche zusätzlich die Schema-Qualität. Tools wie der Schema.org-Validator und das Google Rich Results Test prüfen, ob die Markups fehlerfrei sind. Ein fehlerhaftes FAQ-Schema wird von LLMs ignoriert, auch wenn es vorhanden ist.
Dimension 3: Content-Tiefe pro Cluster
Content-Tiefe misst, wie umfassend ein Wettbewerber ein Thema abdeckt. Zwei Werte sind relevant: Anzahl der Artikel pro Cluster und Median-Wortzahl pro Artikel. Beide Werte ziehst du aus einem Sitemap-Crawl plus manueller Cluster-Zuordnung.
Ein typischer Wert für gut performende AEO-Domains liegt bei 30 bis 80 Artikeln pro Cluster mit einer Median-Wortzahl zwischen 1.200 und 2.000 Wörtern. Unter 15 Artikeln pro Cluster reicht die topische Tiefe meist nicht für stabile Citations.
Pass auf bei der Content-Qualität: Wortzahl allein sagt wenig. Ergänze die Analyse um Faktoren wie strukturelle Elemente (H2-Anzahl, Listen, Tabellen) und Aktualisierungsfrequenz. Ein Artikel, der alle 6 Monate aktualisiert wird, schlägt einen 3.000-Wörter-Text aus 2022.
Dimension 4: Crawler-Frequenz und Bot-Behandlung
Crawler-Frequenz ist nicht direkt messbar für fremde Domains, aber indirekt über Citation-Recency. Wenn ein Wettbewerber-Artikel zwei Wochen nach Veröffentlichung in ChatGPT zitiert wird, ist sein GPTBot-Crawl gesund. Dauert es vier Wochen oder mehr, gibt es ein Indexierungsproblem.
Prüfe zusätzlich die robots.txt der Wettbewerber. Ein gezielter Block von GPTBot, Google-Extended oder ClaudeBot ist eine strategische Entscheidung, meist mit Schutz vor Trainingsdaten-Nutzung verbunden. Diese Domains verlieren langsam, aber stetig Citation-Share.
# Beispiel robots.txt (Wettbewerber-Check)
User-agent: GPTBot
Disallow: /
User-agent: ClaudeBot
Disallow: /
User-agent: Google-Extended
Disallow: /
# Bedeutung: Wettbewerber verweigert AI-Training
# Folge: Citation-Share sinkt langsam, aber Live-Citations
# über Perplexity und SearchGPT bleiben möglich
Dieser Check ist Pflicht, weil er die strategische Ausrichtung des Wettbewerbers verrät. Eine offene robots.txt signalisiert eine aktive AEO-Strategie. Eine geschlossene robots.txt eröffnet dir die Chance, in betroffenen Clustern Marktanteil zu gewinnen.
Dimension 5: Topical Authority Score
Topical Authority bewertet, wie tief und konsistent eine Domain ein Thema abdeckt. Tools wie AEORadar, Profound und SurferSEO berechnen diesen Score über semantische Coverage, interne Verlinkung und Aktualisierungsfrequenz. Werte über 70 gelten als stark, unter 40 als gefährdet.
- Wettbewerber-Domain in das Tool laden
- Cluster-spezifische Authority-Werte exportieren
- Eigene Authority-Werte gegenüberstellen
- Größte Delta-Werte priorisieren (über 20 Punkte Unterschied)
- Pro priorisierten Cluster eine Content-Roadmap aufstellen
Der Authority-Score ist kein absoluter Wert, sondern Tool-spezifisch. Vergleiche Wettbewerber immer mit demselben Tool, sonst entstehen Methodenfehler. Wenn du Profound nutzt, müssen alle Wettbewerber in Profound bewertet werden, nicht in einer Mischung aus drei Tools.
Dimension 6: Brand-Mention-Tonalität
Wie wird die Marke in AI-Antworten beschrieben? Neutral, positiv, kritisch, kontextlos? Diese qualitative Dimension misst keine Zahl, sondern den Sprach-Stil. Du extrahierst sie über manuelle Stichproben, pro Wettbewerber 20 bis 30 tatsächliche AI-Antworten lesen und kategorisieren.
Konkrete Kategorien: "Marktführer", "Spezialist für X", "günstige Alternative", "kritisch gesehen", "ohne Bewertung erwähnt". Diese Tonalitätscluster sind strategisch wichtig, ein Wettbewerber, der als "Marktführer" beschrieben wird, profitiert von einem AEO-Halo-Effekt, den reine Citation-Zahlen nicht zeigen.
Das Wichtigste: Welche Tools du brauchst
Der pragmatische Stack besteht aus drei Tools: Otterly oder Profound für Citation-Share, AEORadar für Topical-Authority und Screaming Frog (kostenlose Version bis 500 URLs) für Schema-Crawls. Damit deckst du fünf von sechs Dimensionen ab. Die sechste, Tonalität, bleibt manuelle Arbeit.
Plane den Benchmark als monatliches Ritual ein, nicht als einmalige Übung. AEO-Märkte bewegen sich schnell, und ein 3 Monate alter Benchmark ist meist überholt. Idealerweise läuft die Citation-Messung automatisiert täglich, die anderen Dimensionen monatlich.
Ein häufiger Fallstrick beim Tool-Vergleich: Otterly, Profound und Peec messen Citation-Share unterschiedlich. Otterly nutzt ein eigenes Prompt-Set mit täglicher Rotation, Profound erlaubt das Hochladen eigener Prompt-Listen, Peec arbeitet mit branchenspezifischen Vorlagen. Diese methodischen Unterschiede führen zu Werten, die um 5 bis 15 Prozentpunkte auseinanderliegen können, kein Tool ist "falsch", sondern jedes misst eine etwas andere Frage.
Entscheide dich für ein Tool und bleibe mindestens 6 Monate dabei. Tool-Wechsel mitten in einer Benchmark-Phase zerstören die Vergleichbarkeit deiner Trendlinien. Wenn ein Wechsel unvermeidlich ist, miss zwei Monate parallel und dokumentiere den Versatz zwischen beiden Tools. Diese Übergangsphase kostet Aufwand, ist aber die einzige saubere Methode, den Methodenwechsel später nachvollziehbar zu erklären, gegenüber dem Marketing-Direktor und gegenüber dir selbst, wenn du in 12 Monaten die Daten wieder auswertest.
Veröffentlicht durch die AEO Guide-Redaktion. Veröffentlicht am 4. September 2026.
Verantwortlich i.S.d. § 18 MStV: siehe Impressum.
Fehler entdeckt oder ergänzende Erfahrung? korrektur@aeoguide.de
AEO-Briefing wöchentlich
Schema-Templates, Tool-Reviews und Case-Studies — einmal pro Woche, kein Buzzword-Salat.
🎁 Gratis dazu: Schema-Templates für AEO (PDF)
Das könnte dich auch interessieren
AEO-Tracking-Tools 2026: 6 Anbieter im DACH-Vergleich
Welches Tool trackt deine Marke in ChatGPT und Perplexity wirklich? Sechs Anbieter im direkten Vergleich nach Engines, Preis, DACH-Fokus und API-Zugang.