Retrieved, Mentioned und Cited in KI

Retrieved, mentioned und cited sind drei verschiedene Dinge, die die KI-Suche mit Ihren Inhalten tun kann – jedes erfordert ein anderes Tool zur Messung und einen anderen Hebel zur Behebung.

Erstveröffentlicht: 24. Juni 2026 · Zuletzt aktualisiert: 3. Aug. 2026 · Fortgeschritten
Sprachen

Retrieved, mentioned und cited sind separate beobachtbare Zustände. Logs können einen verifizierten Abruf belegen, nicht jedoch, dass der Inhalt in den Modellkontext gelangt ist oder eine Zitierung erhalten hat. Antwort-Captures belegen Erwähnungen und Zitierungen; Analysen belegen Besuche. Messen Sie jede Ebene unabhängig und stufen Sie einen Trainings-Crawl, Suchindex-Crawl oder nutzerinitiierten Abruf nicht als Beleg für ein späteres Ergebnis ein.

TL;DR – Abgerufen, erwähnt und zitiert sind drei verschiedene Zustände mit drei verschiedenen Erkennungsmethoden. Abgerufen lebt in Ihren Server-Logs – und die dokumentierten benutzergesteuerten Fetcher wie ChatGPT-User, Claude-User und Perplexity-User sind näher an einer Live-Anfrage als Trainings-Crawler wie GPTBot, aber ein Fetch beweist immer noch keine Nutzung oder Zitierung. Erwähnt ist ein Markennamen-String-Match in der Antwort (Brand Radar). Zitiert ist eine verlinkte URL (Brand Radar Cited Pages, Bing WMT AI Performance). Sie bewegen sich nicht zusammen: 99,6 % des KI-Einflusses ist unsichtbar (OtterlyAI), ChatGPT zitiert ~15 % dessen, was es abruft, ~82,9 % der B2B-Zitate stammen von Drittanbieter-Websites, und selbst ein Zitat bringt etwa 1 % der Zeit einen Klick. Kein einziges Tool sieht alle drei; Sie brauchen einen Stack.

Die drei Zustände – und warum ihre Vermischung Sie etwas kostet

Retrieved, mentioned, and cited are separate observations with separate evidence. Quelle: /ai-search/measurement-and-reporting/retrieved-mentioned-cited/

Retrieved means a system fetched or selected the content as candidate context, evidenced by logs or retrieval traces. Mentioned means the answer used the brand, entity, or facts in its prose, evidenced by the answer text. Cited means the interface exposed a source link or citation to the page, evidenced by a visible source URL. A later state does not make every earlier state directly observable.

© Patrick Stox LLC · CC BY 4.0 ·

Ein Modell kann abgerufene Informationen verwenden, ohne einen Link anzuzeigen, daher kann externe Messung den internen Quellenpfad nicht immer beweisen. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: ChatGPT search Crawler-Berechtigungen zeigen Zugriffsrichtlinien an, nicht garantierten Abruf, Erwähnung oder Zitat. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: Crawlers

Die meisten Gespräche über „KI-Sichtbarkeit“ vermischen drei verschiedene Ereignisse in einem Wort. Sie sind nicht dasselbe, und sie als eines zu behandeln, führt dazu, dass man auf das falsche Signal optimiert und die falsche Zahl misst.

Abgerufen – das Retrieval-System einer KI hat Ihre Seite als Quellenmaterial abgerufen, während es eine Antwort generierte. Dies ist die Retrieval-/Grounding-Phase von RAG (Retrieval-Augmented Generation). Das Modell hat Sie „gelesen“. Sie erhalten möglicherweise keine Erwähnung und keinen Link daraus. Der einzige Ort, an dem dies auftaucht, sind Ihre Server-Logs – kein Antwort-Analyse-Tool kann es sehen, weil nichts davon in der Antwort erscheint.

Erwähnt – Ihre Marke, Ihr Produkt oder Ihr Name erscheint im generierten Text, jedoch ohne Hyperlink und ohne Quellenangabe. Das Modell wusste von Ihnen, oft allein aus Trainingsdaten, und hat Ihren Namen eingestreut. „Tools like Ahrefs, Semrush, and Moz can help with keyword research“ – das sind drei erwähnte Marken, null Links. Erkennbar durch String-Matching des Antwortkorpus (Brand Radar).

Zitiert – Ihre URL ist als attribuierte Quelle enthalten: ein klickbarer Link, eine nummerierte Referenz, ein benanntes Quellenfeld. Dies erfordert, dass die KI sowohl Ihre Inhalte abgerufen als auch entschieden hat, dass sie eine Zuschreibung wert sind. Das ist es, was alle „KI-SEO-Erfolg“ nennen – und es ist nur die Spitze des Eisbergs.

Die entscheidende Lücke: Inhalte können abgerufen werden, ohne erwähnt zu werden, und erwähnt werden, ohne zitiert zu werden. Jeder Zustand benötigt ein anderes Messwerkzeug und einen anderen Optimierungshebel.

Der wichtigste Unterschied: Training-Crawl vs. Live-Inferenz

Das ist das Nützlichste, was man über die Erkennung von Retrieval verstehen kann, und es ist das, was meiner Erfahrung nach ständig übersprungen wird.

KI-Systeme legen mehrere Anfragezwecke offen, und sie bedeuten in Logs unterschiedliche Dinge:

  • Training-/Modellentwicklungs-CrawlerGPTBot und ClaudeBot. Ein verifizierter Treffer beweist einen Abruf unter dieser Crawler-Identität, nicht die Aufnahme in das Training oder ein Zitationsereignis.
  • Such-/Indexierungs-CrawlerOAI-SearchBot, Claude-SearchBot, PerplexityBot und Googlebot für Google-Suchfunktionen. Diese unterstützen die Sucherkennung oder das Retrieval, aber ein Index-Crawl ist immer noch keine Zitation.
  • Benutzergesteuerte AbruferChatGPT-User, Claude-User und Perplexity-User. Diese sind als benutzerinitiierte oder benutzerunterstützende Anfragen dokumentiert. Sie sind näher an einer Live-Aufgabe, aber die Anfrage allein zeigt nicht, ob die Antwort in den Modellkontext einging oder eine sichtbare Zitation erzeugte.
  • Kontroll-TokensGoogle-Extended hat keinen dedizierten Anfrage-User-Agent. Es steuert bestimmte Gemini-Trainings- und Grounding-Nutzungen von Google-gedrängten Inhalten; es ist nicht der Crawler für KI-Übersichten oder den KI-Modus.

Das -User-Suffix ist eine nützliche Konvention unter diesen benannten Anbietern, kein Webstandard. Ein 404, CDN-Block oder Timeout verhindert, dass dieser Abruf erfolgreich ist; es ist ein echter Zugriffsfehler, aber kein Beweis dafür, dass eine Zitation anderweitig garantiert war.

Verwechseln Sie die beiden nicht. „GPTBot hat mich gecrawlt, also wird ChatGPT mich zitieren“ ist ein Mythos – es sind grundlegend unterschiedliche Signale.

Warum die Lücke so groß ist – das Problem der unsichtbaren Beeinflussung

Die Zustände weichen weit mehr voneinander ab, als die meisten erwarten:

  • 99,6 % des KI-Einflusses sind unsichtbar. OtterlyAIs Analyse der Grounding-Daten von Bing Webmaster Tools ergab, dass die überwältigende Mehrheit der Abrufe nie als eine für Nutzer sichtbare, attribuierte Quellenangabe erscheint. Dies ist die konkreteste veröffentlichte Zahl zur Lücke zwischen abgerufen und nicht zitiert.
  • ChatGPT zitiert nur etwa 15 % der Seiten, die es abruft (Leapd / Discovered Labs). Im Abrufpool zu sein, ist notwendig, aber bei weitem nicht ausreichend.
  • Ihre eigene Website ist selten die Quelle. Etwa 82,9 % der B2B-Zitate stammen von Drittanbieter-Websites (Discovered Labs); McKinsey beziffert die eigene Website einer Marke auf nur 5–10 % der Quellen, die KI über sie referenziert. Das Internet, das über Sie spricht, ist wichtiger als Ihre eigenen Seiten.
  • Selbst ein Zitat führt selten zu einem Klick. In Pews Studie zum US-Surfverhalten vom März 2025 klickten Nutzer in 8 % der Google-Besuche mit einer KI-Zusammenfassung auf ein Standardergebnis (gegenüber 15 % ohne) und in 1 % auf eine zitierte Quelle. In Semrushs separater Clickstream-Stichprobe führten 92–94 % der Google-AI-Mode-Sitzungen nicht zu einem Besuch einer externen Domain.

Die Lücke verstärkt sich also: abgerufen → erwähnt → zitiert → geklickt, und an jedem Schritt verlieren Sie Volumen.

Das Gegengewicht – und der Grund, warum es sich trotzdem lohnt – ist Qualität. Bei Ahrefs zeigten interne Daten vom Juni 2025, dass sich KI-Traffic mit der 23-fachen Rate des traditionellen organischen Traffics konvertierte: etwa 0,5 % der Besucher kamen von KI, machten aber während des 30-Tage-Zeitraums etwa 12,1 % der Anmeldungen aus. Wenige Klicks, aber die, die Sie erhalten, sind außergewöhnlich.

So handhabt jede Plattform Abruf und Zitierung

Gleicher Inhalt, gleiche Suchanfrage, sehr unterschiedliche Attributionsergebnisse je nach Plattform:

  • ChatGPT (OpenAI) – Basistrainingsdaten plus eine Abrufschicht, wenn die Suche aktiviert ist. Die ChatGPT-Suche startete auf dem Bing-Index, aber OpenAI betreibt auch einen eigenen Crawler (OAI-SearchBot) für unabhängiges Abrufen und Indizieren und hat die aktuelle Mischung aus beiden nicht veröffentlicht – behandeln Sie „es ist im Grunde Bing“ als Vereinfachung, nicht als dokumentierte Tatsache. Zitiert etwa 15 % dessen, was es abruft; etwa 0,59 % Zitierrate über getestete Themen – die niedrigste der großen Anbieter. Es wird Ihre Marke gerne aus Trainingsdaten diskutieren, ohne Abruf und ohne Zitierung – der reinste Fall von „erwähnt, aber nicht abgerufen oder zitiert“.
  • Perplexity – führt bei jeder Suchanfrage eine Echtzeitsuche mit seinem eigenen PerplexityBot durch. Durchschnittlich 21,87 Zitate pro Antwort, die höchste aller großen Plattformen, und ist am wenigsten geneigt, ohne Zitierung zu erwähnen. Die transparenteste Plattform.
  • Google AI Overviews / AI Mode – Ihr organischer Index + Knowledge Graph, wobei Gemini die Antwort generiert. Verwendet Query-Fan-out (eine Nutzeranfrage → viele interne Unterabfragen), sodass Seiten für Unterabfragen abgerufen werden, die nie in der sichtbaren Antwort erscheinen – Dark Retrieval by Design. Zitate werden über url_citation-Annotationen an bestimmte Textsegmente angehängt.
  • Bing Copilot – Bing-Index + GPT-Schicht; durchschnittlich 6,89 Zitate pro Antwort. Seit Februar 2026 verfügt es über das erste offizielle Webmaster-Tool, das Grounding-/Zitierdaten offenlegt (siehe Offizielle Dokumentation).
  • Claude (Anthropic) – antwortet häufig aus Trainingsdaten ohne Abruf und mit 0 Zitaten, aber wenn es doch abruft, gehört es zu den höchsten Qualitäten und zitiert am ehesten klare, gut strukturierte Inhalte. Niedrigste Abruffrequenz, höchstes Verhältnis von Abruf zu Zitat.

So erkennen Sie jeden Zustand

Abgerufen → Server-Logs. Logs erfassen jede Bot-Anfrage, auch von KI-Crawlern, die meist rohes HTML abrufen, ohne JavaScript zu rendern – das variiert jedoch je nach Anbieter: Googles Gemini-basierte Antworten nutzen den Renderer von Googlebot, also gehen Sie nicht davon aus, dass jeder KI-Crawler das Rendering überspringt. Nichts davon erscheint in GA. Achten Sie auf die User Agents und trennen Sie vor allem -User (Live-Inferenz) von den Basis-Crawlern (Training). Tools: Screaming Frog Log File Analyser, Botify, Ahrefs Bot Analytics, Cloudflare. Die Einschränkung: Logs beweisen, dass ein Abruf stattfand, nicht, dass Sie zitiert wurden. Und Standard-Analytics klassifizieren die Mehrheit der KI-Referrals fälschlich als direkten Traffic – Logs sind der einzige Ort, an dem das vollständige Bild der Abrufe sichtbar ist.

Erwähnt → Markenüberwachung. Ahrefs Brand Radar gleicht Ihre Marke per String-Matching mit einem großen, suchbasierten Prompt-Korpus über ChatGPT, Gemini, Copilot, Perplexity, AI Overviews, AI Mode und Grok ab. Der Filter, der hier zählt, ist Response contains {your brand}. Der Haken: Es läuft mit einer statischen Prompt-Bibliothek und kann die KI-internen „Dark Queries“ nicht sehen, die den Großteil der tatsächlichen Abruffläche ausmachen, und KI-Antworten sind von Lauf zu Lauf extrem inkonsistent (SparkToro: <1 von 100 Chance auf identische Markenlisten über 100 Läufe desselben Prompts). Behandeln Sie es als Richtungstrend, nicht als präzise Zählung.

Offenlegung: Ich bin ehemaliger Ahrefs-Mitarbeiter und erhalte kostenlosen Ahrefs-Zugang. Brand Radar wird hier als Anbieter-Datensatz behandelt, nicht als vollständige Aufzeichnung einer Plattform, und Ahrefs überprüft die Schlussfolgerungen dieser Website nicht.

Zitiert → Zitat-Tracking. Brand Radars Berichte „Cited Pages“ (Ihre Seiten, die zitiert werden) und „Cited Domains“ (welche Drittanbieter-Domains zitiert werden, wenn über Sie gesprochen wird); Bing Webmaster Tools AI Performance für offizielle Copilot-Daten; und GSCs Generative-AI-Bericht für Impressionen auf teilnehmenden Properties. Der Schritt „gefunden, aber nicht zitiert“ – Response contains {your brand} AND citation does not contain {your domain} – isoliert genau die Lücke: Antworten, die von Ihnen geprägt sind, ohne Link zu Ihnen.

Zwei umgekehrte Lücken, die Sie kennen sollten

  • Erwähnt, nie abgerufen oder zitiert. Ein Modell nennt Ihre Marke direkt aus den Trainingsdaten, ohne Live-Abruf, ohne Link. Häufig bei bekannten Marken.
  • Zitiert, nie erwähnt („Geisterzitate“). Superlines fand heraus, dass Gemini eine Domain in 30 Tagen 182-mal zitierte, während der Markenname null Mal genannt wurde – 73 % der KI-Präsenz dieser Marke waren Zitate ohne Namensnennung. Sie versorgen die Antwort mit autoritativen Signalen, während der Nutzer sie nie mit Ihnen verbindet.

Deshalb müssen Erwähnungs-Tracking und Zitat-Tracking parallel laufen – keines impliziert das andere.

Was tun gegen die Lücken

  • Abgerufen, aber nicht zitiert – verlieren Sie es zunächst nicht an der Tür: keine Fehler oder CDN-Blockaden für -User-Bots. Verbessern Sie dann Vollständigkeit und Struktur (klare, direkte Antworten weit oben auf der Seite; Fragen spiegelnde Überschriften). In der Analyse von Discovered Labs vom Januar 2026 korrelierte semantische Vollständigkeit mit ~0,89 mit der Wahrscheinlichkeit einer Zitierung in Google AI Overviews – deren eigene angegebene Zahl, nicht unabhängig geprüft.
  • Erwähnt, aber nicht zitiert – bauen Sie explizitere Attributionssignale auf der Seite auf und nutzen Sie den größeren Hebel: Bringen Sie das Internet dazu, über Sie zu sprechen. Der wichtigste Prädiktor von Ahrefs für das Erscheinen in AI Overviews sind Marken-Web-Erwähnungen (Korrelation 0,664 – deutlich über Domain Rating mit 0,326 oder Backlinks mit 0,218), aus der Studie mit 75 000 Marken von Louise Linehan und Xibeijia Guan. Sechzehn Seiten auf Zapier, die Ahrefs erwähnen, reichten aus, um uns in 1 431 KI-Antworten zu platzieren.
  • Zitiert, aber kein Traffic – das ist größtenteils die aktuelle Realität; optimieren Sie darauf, neben der Zitierung genannt zu werden (damit Markenerinnerung auch ohne Klick entsteht) und auf die wertvolleren Anfragearten, bei denen KI-Traffic konvertiert.

Das ist der strategische Wandel in einem Satz: SEO war „Optimieren Sie Ihre Website.“ Jetzt ist es „Optimieren Sie, wie das Internet über Sie spricht.“ Die Optimierung Ihrer eigenen Seiten beeinflusst, ob Sie abgerufen und zitiert werden können; die Optimierung des Gesprächs über Sie beeinflusst, ob Sie erwähnt werden und ob Drittzitate Ihre Reichweite vervielfachen.

Der Mess-Stack, den Sie tatsächlich brauchen

Kein einzelnes Tool deckt das alles ab. Die ehrliche Antwort ist ein Stack:

  • Logs → die Abrufebene (Screaming Frog, Botify, Ahrefs Bot Analytics).
  • Markenüberwachung → die Erwähnungsebene (Brand Radar, manuelles Prompt-Testen).
  • Zitierverfolgung → die zitiere Ebene (Brand Radar Cited-Berichte, Bing WMT AI Performance).
  • GSC + GA4 → die Trafficebene (und denken Sie daran: GA4 versteckt die meisten KI-Verweise als direkt).

Eine letzte Warnung: KI-Antworten ändern sich stark – etwa 40–60 % der zitierten Quellen ändern sich monatlich, und etwa 70 % des Inhalts von AI Overviews ändern sich für dieselbe Anfrage. Verfolgen Sie Trends über viele Läufe, nicht einzelne Schnappschüsse, und passen Sie sich nicht übermäßig an eine Zahl an, die so volatil ist.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.