Retrieved, Mentioned und Cited in KI
Retrieved, mentioned und cited sind drei verschiedene Dinge, die die KI-Suche mit Ihren Inhalten tun kann – jedes erfordert ein anderes Tool zur Messung und einen anderen Hebel zur Behebung.
Sprachen
Retrieved, mentioned und cited sind separate beobachtbare Zustände. Logs können einen verifizierten Abruf belegen, nicht jedoch, dass der Inhalt in den Modellkontext gelangt ist oder eine Zitierung erhalten hat. Antwort-Captures belegen Erwähnungen und Zitierungen; Analysen belegen Besuche. Messen Sie jede Ebene unabhängig und stufen Sie einen Trainings-Crawl, Suchindex-Crawl oder nutzerinitiierten Abruf nicht als Beleg für ein späteres Ergebnis ein.
TL;DR – „In KI auftauchen“ bedeutet eigentlich drei verschiedene Dinge. Abgerufen heißt, eine KI hat Ihre Seite gelesen. Erwähnt heißt, Ihr Name ist in der Antwort erschienen. Zitiert heißt, Ihr Link war in der Antwort. Das passiert nicht immer zusammen – Sie können gelesen, aber nie genannt, oder genannt, aber nie verlinkt werden – und Sie brauchen ein anderes Werkzeug, um jedes davon zu erkennen.
Drei Dinge, nicht eines
Abruf, Erwähnung und Zitat sind klar unterscheidbare beobachtbare Ergebnisse; keine Plattform gewährleistet, dass Crawler-Zugriff eines davon hervorbringt. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: ChatGPT search OpenAI dokumentiert separate Crawler-User-Agents und Steuerungen für Such- versus Trainingskontexte. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: Crawlers
Wenn jemand sagt: „Ich möchte in ChatGPT auftauchen“, stellt er sich meist eines vor: seinen Link in der Antwort. Aber es gibt tatsächlich drei verschiedene Dinge, die eine KI mit Ihren Inhalten tun kann, und die Leute werfen sie alle unter „KI-Sichtbarkeit“ in einen Topf. Da beginnt die Verwirrung.
- Abgerufen – die KI hat Ihre Seite abgerufen und gelesen, während sie die Antwort erstellte. Sie könnte das Gelernte nutzen, muss es aber nicht. Sie sehen das nicht in Google Analytics; der einzige Ort, an dem es auftaucht, sind Ihre Server-Logs.
- Erwähnt – Ihre Marke oder Ihr Name erscheint im Text der Antwort, aber ohne Link. Die KI „wusste einfach von Ihnen“ – oft aus ihrem Training, nicht vom gleichzeitigen Lesen Ihrer Website.
- Zitiert – Ihre tatsächliche URL ist in der Antwort als Quelle, auf die Sie klicken können.
Warum der Unterschied wichtig ist
Hier ist der Punkt, den die Leute übersehen: Diese Dinge bewegen sich nicht zusammen. Ihre Seite kann gelesen ohne genannt und genannt ohne verlinkt werden. Eine Analyse von Microsofts Grounding-Daten ergab, dass 99,6 % des KI-Einflusses unsichtbar ist – Inhalte werden ständig hinter den Kulissen genutzt, werden aber fast nie zu einem sichtbaren Zitat.
Wenn Ihr KI-Tool also nur Zitate (Links) zählt, zeigt es Ihnen nur einen Bruchteil des Bildes. Sie könnten den ganzen Tag Antworten prägen, und dieses Tool würde sagen, Sie sind nirgendwo.
Was das für Sie bedeutet
- Möchten Sie wissen, ob KIs Sie lesen? Prüfen Sie Ihre Server-Logs auf KI-Bots.
- Möchten Sie wissen, ob Sie genannt werden? Nutzen Sie ein Markenüberwachungstool, das KI-Antworten liest.
- Möchten Sie wissen, ob Sie verlinkt werden? Nutzen Sie einen Zitat-Tracker (und Bing hat inzwischen einen offiziellen Bericht für seine eigenen KI-Antworten).
Und noch etwas, das Sie früh verinnerlichen sollten: Selbst ein Zitat bringt Ihnen normalerweise keinen Klick. Pew fand heraus, dass nur etwa 1 % der Leute die zitierten Quellen in einer KI-Zusammenfassung anklicken. „In KI auftauchen“ geht es also heute weniger um Traffic und mehr darum, im Gespräch zu sein. Möchten Sie die vollständige Aufschlüsselung – die Bots, die Plattformen und wie Sie jede Ebene messen? Wechseln Sie zum Erweitert-Tab.
TL;DR – Abgerufen, erwähnt und zitiert sind drei verschiedene Zustände mit drei verschiedenen Erkennungsmethoden. Abgerufen lebt in Ihren Server-Logs – und die dokumentierten benutzergesteuerten Fetcher wie
ChatGPT-User,Claude-UserundPerplexity-Usersind näher an einer Live-Anfrage als Trainings-Crawler wieGPTBot, aber ein Fetch beweist immer noch keine Nutzung oder Zitierung. Erwähnt ist ein Markennamen-String-Match in der Antwort (Brand Radar). Zitiert ist eine verlinkte URL (Brand Radar Cited Pages, Bing WMT AI Performance). Sie bewegen sich nicht zusammen: 99,6 % des KI-Einflusses ist unsichtbar (OtterlyAI), ChatGPT zitiert ~15 % dessen, was es abruft, ~82,9 % der B2B-Zitate stammen von Drittanbieter-Websites, und selbst ein Zitat bringt etwa 1 % der Zeit einen Klick. Kein einziges Tool sieht alle drei; Sie brauchen einen Stack.
Die drei Zustände – und warum ihre Vermischung Sie etwas kostet
Retrieved means a system fetched or selected the content as candidate context, evidenced by logs or retrieval traces. Mentioned means the answer used the brand, entity, or facts in its prose, evidenced by the answer text. Cited means the interface exposed a source link or citation to the page, evidenced by a visible source URL. A later state does not make every earlier state directly observable.
© Patrick Stox LLC · CC BY 4.0 ·
Ein Modell kann abgerufene Informationen verwenden, ohne einen Link anzuzeigen, daher kann externe Messung den internen Quellenpfad nicht immer beweisen. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: ChatGPT search Crawler-Berechtigungen zeigen Zugriffsrichtlinien an, nicht garantierten Abruf, Erwähnung oder Zitat. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: Crawlers
Die meisten Gespräche über „KI-Sichtbarkeit“ vermischen drei verschiedene Ereignisse in einem Wort. Sie sind nicht dasselbe, und sie als eines zu behandeln, führt dazu, dass man auf das falsche Signal optimiert und die falsche Zahl misst.
Abgerufen – das Retrieval-System einer KI hat Ihre Seite als Quellenmaterial abgerufen, während es eine Antwort generierte. Dies ist die Retrieval-/Grounding-Phase von RAG (Retrieval-Augmented Generation). Das Modell hat Sie „gelesen“. Sie erhalten möglicherweise keine Erwähnung und keinen Link daraus. Der einzige Ort, an dem dies auftaucht, sind Ihre Server-Logs – kein Antwort-Analyse-Tool kann es sehen, weil nichts davon in der Antwort erscheint.
Erwähnt – Ihre Marke, Ihr Produkt oder Ihr Name erscheint im generierten Text, jedoch ohne Hyperlink und ohne Quellenangabe. Das Modell wusste von Ihnen, oft allein aus Trainingsdaten, und hat Ihren Namen eingestreut. „Tools like Ahrefs, Semrush, and Moz can help with keyword research“ – das sind drei erwähnte Marken, null Links. Erkennbar durch String-Matching des Antwortkorpus (Brand Radar).
Zitiert – Ihre URL ist als attribuierte Quelle enthalten: ein klickbarer Link, eine nummerierte Referenz, ein benanntes Quellenfeld. Dies erfordert, dass die KI sowohl Ihre Inhalte abgerufen als auch entschieden hat, dass sie eine Zuschreibung wert sind. Das ist es, was alle „KI-SEO-Erfolg“ nennen – und es ist nur die Spitze des Eisbergs.
Die entscheidende Lücke: Inhalte können abgerufen werden, ohne erwähnt zu werden, und erwähnt werden, ohne zitiert zu werden. Jeder Zustand benötigt ein anderes Messwerkzeug und einen anderen Optimierungshebel.
Der wichtigste Unterschied: Training-Crawl vs. Live-Inferenz
Das ist das Nützlichste, was man über die Erkennung von Retrieval verstehen kann, und es ist das, was meiner Erfahrung nach ständig übersprungen wird.
KI-Systeme legen mehrere Anfragezwecke offen, und sie bedeuten in Logs unterschiedliche Dinge:
- Training-/Modellentwicklungs-Crawler –
GPTBotundClaudeBot. Ein verifizierter Treffer beweist einen Abruf unter dieser Crawler-Identität, nicht die Aufnahme in das Training oder ein Zitationsereignis. - Such-/Indexierungs-Crawler –
OAI-SearchBot,Claude-SearchBot,PerplexityBotund Googlebot für Google-Suchfunktionen. Diese unterstützen die Sucherkennung oder das Retrieval, aber ein Index-Crawl ist immer noch keine Zitation. - Benutzergesteuerte Abrufer –
ChatGPT-User,Claude-UserundPerplexity-User. Diese sind als benutzerinitiierte oder benutzerunterstützende Anfragen dokumentiert. Sie sind näher an einer Live-Aufgabe, aber die Anfrage allein zeigt nicht, ob die Antwort in den Modellkontext einging oder eine sichtbare Zitation erzeugte. - Kontroll-Tokens –
Google-Extendedhat keinen dedizierten Anfrage-User-Agent. Es steuert bestimmte Gemini-Trainings- und Grounding-Nutzungen von Google-gedrängten Inhalten; es ist nicht der Crawler für KI-Übersichten oder den KI-Modus.
Das -User-Suffix ist eine nützliche Konvention unter diesen benannten Anbietern, kein Webstandard. Ein 404, CDN-Block oder Timeout verhindert, dass dieser Abruf erfolgreich ist; es ist ein echter Zugriffsfehler, aber kein Beweis dafür, dass eine Zitation anderweitig garantiert war.
Verwechseln Sie die beiden nicht. „GPTBot hat mich gecrawlt, also wird ChatGPT mich zitieren“ ist ein Mythos – es sind grundlegend unterschiedliche Signale.
Warum die Lücke so groß ist – das Problem der unsichtbaren Beeinflussung
Die Zustände weichen weit mehr voneinander ab, als die meisten erwarten:
- 99,6 % des KI-Einflusses sind unsichtbar. OtterlyAIs Analyse der Grounding-Daten von Bing Webmaster Tools ergab, dass die überwältigende Mehrheit der Abrufe nie als eine für Nutzer sichtbare, attribuierte Quellenangabe erscheint. Dies ist die konkreteste veröffentlichte Zahl zur Lücke zwischen abgerufen und nicht zitiert.
- ChatGPT zitiert nur etwa 15 % der Seiten, die es abruft (Leapd / Discovered Labs). Im Abrufpool zu sein, ist notwendig, aber bei weitem nicht ausreichend.
- Ihre eigene Website ist selten die Quelle. Etwa 82,9 % der B2B-Zitate stammen von Drittanbieter-Websites (Discovered Labs); McKinsey beziffert die eigene Website einer Marke auf nur 5–10 % der Quellen, die KI über sie referenziert. Das Internet, das über Sie spricht, ist wichtiger als Ihre eigenen Seiten.
- Selbst ein Zitat führt selten zu einem Klick. In Pews Studie zum US-Surfverhalten vom März 2025 klickten Nutzer in 8 % der Google-Besuche mit einer KI-Zusammenfassung auf ein Standardergebnis (gegenüber 15 % ohne) und in 1 % auf eine zitierte Quelle. In Semrushs separater Clickstream-Stichprobe führten 92–94 % der Google-AI-Mode-Sitzungen nicht zu einem Besuch einer externen Domain.
Die Lücke verstärkt sich also: abgerufen → erwähnt → zitiert → geklickt, und an jedem Schritt verlieren Sie Volumen.
Das Gegengewicht – und der Grund, warum es sich trotzdem lohnt – ist Qualität. Bei Ahrefs zeigten interne Daten vom Juni 2025, dass sich KI-Traffic mit der 23-fachen Rate des traditionellen organischen Traffics konvertierte: etwa 0,5 % der Besucher kamen von KI, machten aber während des 30-Tage-Zeitraums etwa 12,1 % der Anmeldungen aus. Wenige Klicks, aber die, die Sie erhalten, sind außergewöhnlich.
So handhabt jede Plattform Abruf und Zitierung
Gleicher Inhalt, gleiche Suchanfrage, sehr unterschiedliche Attributionsergebnisse je nach Plattform:
- ChatGPT (OpenAI) – Basistrainingsdaten plus eine Abrufschicht, wenn die Suche
aktiviert ist. Die ChatGPT-Suche startete auf dem Bing-Index, aber OpenAI betreibt auch einen eigenen
Crawler (
OAI-SearchBot) für unabhängiges Abrufen und Indizieren und hat die aktuelle Mischung aus beiden nicht veröffentlicht – behandeln Sie „es ist im Grunde Bing“ als Vereinfachung, nicht als dokumentierte Tatsache. Zitiert etwa 15 % dessen, was es abruft; etwa 0,59 % Zitierrate über getestete Themen – die niedrigste der großen Anbieter. Es wird Ihre Marke gerne aus Trainingsdaten diskutieren, ohne Abruf und ohne Zitierung – der reinste Fall von „erwähnt, aber nicht abgerufen oder zitiert“. - Perplexity – führt bei jeder Suchanfrage eine Echtzeitsuche mit seinem eigenen
PerplexityBotdurch. Durchschnittlich 21,87 Zitate pro Antwort, die höchste aller großen Plattformen, und ist am wenigsten geneigt, ohne Zitierung zu erwähnen. Die transparenteste Plattform. - Google AI Overviews / AI Mode – Ihr organischer Index + Knowledge Graph, wobei
Gemini die Antwort generiert. Verwendet Query-Fan-out (eine Nutzeranfrage → viele
interne Unterabfragen), sodass Seiten für Unterabfragen abgerufen werden, die nie in der sichtbaren
Antwort erscheinen – Dark Retrieval by Design. Zitate werden über
url_citation-Annotationen an bestimmte Textsegmente angehängt. - Bing Copilot – Bing-Index + GPT-Schicht; durchschnittlich 6,89 Zitate pro Antwort. Seit Februar 2026 verfügt es über das erste offizielle Webmaster-Tool, das Grounding-/Zitierdaten offenlegt (siehe Offizielle Dokumentation).
- Claude (Anthropic) – antwortet häufig aus Trainingsdaten ohne Abruf und mit 0 Zitaten, aber wenn es doch abruft, gehört es zu den höchsten Qualitäten und zitiert am ehesten klare, gut strukturierte Inhalte. Niedrigste Abruffrequenz, höchstes Verhältnis von Abruf zu Zitat.
So erkennen Sie jeden Zustand
Abgerufen → Server-Logs. Logs erfassen jede Bot-Anfrage, auch von KI-Crawlern, die meist rohes HTML abrufen, ohne JavaScript zu rendern – das variiert jedoch je nach Anbieter: Googles Gemini-basierte Antworten nutzen den Renderer von Googlebot, also gehen Sie nicht davon aus, dass jeder KI-Crawler das Rendering überspringt. Nichts davon erscheint in GA. Achten Sie auf die User Agents und trennen Sie vor allem -User (Live-Inferenz) von den Basis-Crawlern (Training).
Tools: Screaming Frog Log File Analyser, Botify, Ahrefs Bot Analytics, Cloudflare.
Die Einschränkung: Logs beweisen, dass ein Abruf stattfand, nicht, dass Sie zitiert wurden. Und Standard-Analytics klassifizieren die Mehrheit der KI-Referrals fälschlich als direkten Traffic – Logs sind der einzige Ort, an dem das vollständige Bild der Abrufe sichtbar ist.
Erwähnt → Markenüberwachung. Ahrefs Brand Radar gleicht Ihre Marke per String-Matching mit einem großen, suchbasierten Prompt-Korpus über ChatGPT, Gemini, Copilot, Perplexity, AI Overviews, AI Mode und Grok ab. Der Filter, der hier zählt, ist Response contains {your brand}. Der Haken: Es läuft mit einer statischen Prompt-Bibliothek und kann die KI-internen „Dark Queries“ nicht sehen, die den Großteil der tatsächlichen Abruffläche ausmachen, und KI-Antworten sind von Lauf zu Lauf extrem inkonsistent (SparkToro: <1 von 100 Chance auf identische Markenlisten über 100 Läufe desselben Prompts). Behandeln Sie es als Richtungstrend, nicht als präzise Zählung.
Zitiert → Zitat-Tracking. Brand Radars Berichte „Cited Pages“ (Ihre Seiten, die zitiert werden) und „Cited Domains“ (welche Drittanbieter-Domains zitiert werden, wenn über Sie gesprochen wird); Bing Webmaster Tools AI Performance für offizielle Copilot-Daten; und GSCs Generative-AI-Bericht für Impressionen auf teilnehmenden Properties. Der Schritt „gefunden, aber nicht zitiert“ – Response contains {your brand} AND citation does not contain {your domain} – isoliert genau die Lücke: Antworten, die von Ihnen geprägt sind, ohne Link zu Ihnen.
Zwei umgekehrte Lücken, die Sie kennen sollten
- Erwähnt, nie abgerufen oder zitiert. Ein Modell nennt Ihre Marke direkt aus den Trainingsdaten, ohne Live-Abruf, ohne Link. Häufig bei bekannten Marken.
- Zitiert, nie erwähnt („Geisterzitate“). Superlines fand heraus, dass Gemini eine Domain in 30 Tagen 182-mal zitierte, während der Markenname null Mal genannt wurde – 73 % der KI-Präsenz dieser Marke waren Zitate ohne Namensnennung. Sie versorgen die Antwort mit autoritativen Signalen, während der Nutzer sie nie mit Ihnen verbindet.
Deshalb müssen Erwähnungs-Tracking und Zitat-Tracking parallel laufen – keines impliziert das andere.
Was tun gegen die Lücken
- Abgerufen, aber nicht zitiert – verlieren Sie es zunächst nicht an der Tür: keine Fehler oder CDN-Blockaden für
-User-Bots. Verbessern Sie dann Vollständigkeit und Struktur (klare, direkte Antworten weit oben auf der Seite; Fragen spiegelnde Überschriften). In der Analyse von Discovered Labs vom Januar 2026 korrelierte semantische Vollständigkeit mit ~0,89 mit der Wahrscheinlichkeit einer Zitierung in Google AI Overviews – deren eigene angegebene Zahl, nicht unabhängig geprüft. - Erwähnt, aber nicht zitiert – bauen Sie explizitere Attributionssignale auf der Seite auf und nutzen Sie den größeren Hebel: Bringen Sie das Internet dazu, über Sie zu sprechen. Der wichtigste Prädiktor von Ahrefs für das Erscheinen in AI Overviews sind Marken-Web-Erwähnungen (Korrelation 0,664 – deutlich über Domain Rating mit 0,326 oder Backlinks mit 0,218), aus der Studie mit 75 000 Marken von Louise Linehan und Xibeijia Guan. Sechzehn Seiten auf Zapier, die Ahrefs erwähnen, reichten aus, um uns in 1 431 KI-Antworten zu platzieren.
- Zitiert, aber kein Traffic – das ist größtenteils die aktuelle Realität; optimieren Sie darauf, neben der Zitierung genannt zu werden (damit Markenerinnerung auch ohne Klick entsteht) und auf die wertvolleren Anfragearten, bei denen KI-Traffic konvertiert.
Das ist der strategische Wandel in einem Satz: SEO war „Optimieren Sie Ihre Website.“ Jetzt ist es „Optimieren Sie, wie das Internet über Sie spricht.“ Die Optimierung Ihrer eigenen Seiten beeinflusst, ob Sie abgerufen und zitiert werden können; die Optimierung des Gesprächs über Sie beeinflusst, ob Sie erwähnt werden und ob Drittzitate Ihre Reichweite vervielfachen.
Der Mess-Stack, den Sie tatsächlich brauchen
Kein einzelnes Tool deckt das alles ab. Die ehrliche Antwort ist ein Stack:
- Logs → die Abrufebene (Screaming Frog, Botify, Ahrefs Bot Analytics).
- Markenüberwachung → die Erwähnungsebene (Brand Radar, manuelles Prompt-Testen).
- Zitierverfolgung → die zitiere Ebene (Brand Radar Cited-Berichte, Bing WMT AI Performance).
- GSC + GA4 → die Trafficebene (und denken Sie daran: GA4 versteckt die meisten KI-Verweise als direkt).
Eine letzte Warnung: KI-Antworten ändern sich stark – etwa 40–60 % der zitierten Quellen ändern sich monatlich, und etwa 70 % des Inhalts von AI Overviews ändern sich für dieselbe Anfrage. Verfolgen Sie Trends über viele Läufe, nicht einzelne Schnappschüsse, und passen Sie sich nicht übermäßig an eine Zahl an, die so volatil ist.
KI-Zusammenfassung
Eine komprimierte Darstellung der erweiterten Version:
- Drei verschiedene Zustände, drei verschiedene Werkzeuge. Abgerufen (eine KI hat Ihre Seite abgerufen) erscheint nur in Server-Logs. Erwähnt (Ihr Name in der Antwort, ohne Link) erfordert Markenüberwachung. Zitiert (Ihre URL verlinkt) erfordert Zitier-Tracking. Sie bewegen sich nicht gemeinsam.
- Training oder Index-Crawl ≠ Live-Inferenz.
GPTBot,ClaudeBotund Suchindex-Crawler belegen unterschiedliche Abrufzwecke, keine Zitierereignisse. Die-User-Bots (ChatGPT-User,Perplexity-User) rufen live, während eines Gesprächs ab – dieser Treffer ist ein Beleg für einen nutzergesteuerten Abruf, nicht der Beweis, dass die Seite verwendet oder zitiert wurde. Ein Fehler blockiert diesen Abruf und sollte untersucht werden. - Die Lücke ist riesig. 99,6 % des KI-Einflusses sind unsichtbar (OtterlyAI/Bing-Grounding); ChatGPT zitiert etwa 15 % dessen, was es abruft; etwa 82,9 % der B2B-Zitate stammen von Drittanbieter-Websites; und selbst ein Zitat führt nur in etwa 1 % der Fälle zu einem Klick (Pew).
- Plattformen weichen stark voneinander ab. Perplexity etwa 21,87 Zitate/Antwort (zitiert fast alles); ChatGPT etwa 0,59 % Zitierrate (Erwähnungen aus Training ohne Zitat); Claude antwortet oft mit 0 Abrufen; Google verwendet Query-Fan-out (dunkler Abruf); Bing Copilot etwa 6,89, jetzt mit einem offiziellen Bericht.
- Zwei umgekehrte Lücken: erwähnt, aber nie abgerufen (aus Trainingsdaten) und Geisterzitate (zitiert ohne Nennung der Marke – Superlines: 73 % der KI-Präsenz einer Marke).
- Hebel zur Behebung: Entsperren Sie
-User-Bots und verbessern Sie die Vollständigkeit (abgerufen→zitiert); bauen Sie markenbezogene Web-Erwähnungen auf, den #1-AIO-Prädiktor mit 0,664 Korrelation (erwähnt→zitiert); optimieren Sie für benannte Ko-Zitation (zitiert→Erinnerung). - Messen Sie mit einem Stack (Logs + Markenüberwachung + Zitier-Tracking + GSC/GA4), verfolgen Sie Trends, nicht Momentaufnahmen – KI-Antworten ändern sich monatlich um 40–60 %.
Offizielle Dokumentation
Wie die Suchmaschinen RAG-Abruf und Zitatauswahl beschreiben, aus den Primärquellen.
- KI-Funktionen in der Google Suche – wie KI-Übersichten und der KI-Modus die Kernsuche verwenden, um Quellen abzurufen und zuzuordnen.
- KI-Optimierungsleitfaden – Googles Standpunkt, dass die üblichen SEO-Best Practices gelten; keine speziellen AIO-Optimierungen.
- Grounding mit der Google Suche (Gemini API) – der fünfstufige Grounding-Prozess und die
url_citation-Annotationen, die ein Textsegment mit einer Quell-URL verknüpfen; dasgoogle_search_call-Objekt protokolliert alles Abgerufene, während Annotationen nur das Verworfene protokollieren.
Bing / Microsoft
- Einführung der KI-Leistung in Bing Webmaster Tools (öffentliche Vorschau, Februar 2026) – das erste offizielle Plattform-Tool, das Abruf-/Grounding-Signale offenlegt: Zitate, Grounding-Abfragen und durchschnittlich zitierte Seiten.
- Bing Webmaster Tools – Hilfe zur KI-Leistung – Definitionen der Metriken für den Bericht.
- Search Engine Land-Berichterstattung über den Bing-KI-Leistungsbericht – Kontext dazu, was er zeigt und was nicht.
Zitate aus der Quelle
Aussagen der Suchmaschinen auf dem Record, wie Abruf und Zitatauswahl funktionieren. Deep Links springen zur zitierten Passage, wo die Seite dies zulässt.
Google – der Grounding-/Abrufmechanismus
- “The model analyzes the prompt and determines if a Google Search can improve the answer.” — Gemini API-Grounding-Dokumentation (Schritt eins des dokumentierten Fünf-Schritte-Prozesses). Quelle
- “If needed, the model automatically generates one or multiple search queries and executes them.” — die Query-Fan-out, die Dark Retrieval erzeugt: Seiten, die für Unterabfragen abgerufen werden, die nie in der sichtbaren Antwort erscheinen. Quelle
- “Each
url_citationannotation links a text segment (defined bystart_indexandend_index) to a source URL.” — Zitate hängen an bestimmten Segmenten; die vollständige Liste der abgerufenen Quellen wird Endnutzern nicht angezeigt. Quelle - “There are no additional requirements to appear in AI Overviews or AI Mode, nor other special optimizations necessary.” — Googles offizielle Haltung zur Optimierung. Quelle
Bing / Microsoft — der KI-Leistungsbericht
- Zitate: “Shows the total number of citations that are displayed as sources in AI-generated answers during the selected time frame.” — der Zustand Zitiert. Quelle
- Grounding-Abfragen: “Shows the key phrases the AI used when retrieving content that was referenced in AI-generated answers.” — die offizielle Oberfläche, die dem Zustand Abgerufen am nächsten kommt. Quelle
- Durchschnittlich zitierte Seiten: “Shows the average number of unique pages from your site that are displayed as sources in AI-generated answers per day.” Quelle
So prüfen Sie jede Ebene
Eine Prüfung, um zu bestätigen, in welchem der drei Zustände Sie sich tatsächlich befinden — jede Ebene benötigt ihre eigene Prüfung.
Abgerufen? (Server-Logs)
- Server-Logs (oder Cloudflare/CDN-Logs) abrufen und nach KI-User-Agents filtern.
- Trainings-Crawler (
GPTBot,ClaudeBot), Such-/Indexierungs-Crawler (OAI-SearchBot,Claude-SearchBot,PerplexityBot, Googlebot) und nutzergesteuerte Abrufer (ChatGPT-User,Claude-User,Perplexity-User) trennen. - Bestätigen, dass die vorgesehenen nutzergesteuerten Abrufer die korrekte Antwort erhalten und nicht einen 404/403/5xx oder eine CDN-Herausforderung. Behandeln Sie Fehler als blockierte Abrufmöglichkeiten, nicht als garantiert verlorene Zitate.
- Verifizieren, dass die Bots echt sind (Reverse + Forward-DNS / veröffentlichte IP-Bereiche) — die User-Agent-Zeichenfolge allein ist fälschbar.
Erwähnt? (Markenüberwachung)
-
Response contains {your brand}in Brand Radar über die Plattformen hinweg ausführen. - Manuell stichprobenartig prüfen: Markenbezogene Fragen auf jeder KI stellen und darauf achten, ob Ihr Name ohne Link erscheint.
- Dieselbe Eingabeaufforderung viele Male ausführen — Antworten sind von Lauf zu Lauf inkonsistent; eine Momentaufnahme ist keine Datenbasis.
Zitiert? (Zitatverfolgung)
- Zitierte Seiten (Ihre URLs) und zitierte Domains (Drittseiten, die zitiert werden, wenn über Sie gesprochen wird) in Brand Radar prüfen.
- Bing Webmaster Tools → KI-Leistung auf offizielle Copilot-Zitatzahlen und Grounding-Abfragen prüfen.
- Den Generative-AI-Bericht der GSC auf Impressionen für teilnehmende Properties prüfen; keine Klicks oder Abfragen ableiten, die er nicht offenlegt.
- Den Filter gefunden, aber nicht zitiert ausführen:
Response contains {your brand} AND citation does not contain {your domain}— das ist Ihre Lücke bei der Prägung ohne Anerkennung.
Querprüfungen
- Achten Sie auf Geisterzitate – zitierte URLs, in denen Ihr Markenname im Text nie vorkommt. Erwähnungs- und Zitat-Tracking müssen parallel laufen.
- Stellen Sie sicher, dass Sie KI-Bots nicht in
robots.txtblockiert haben – eine Blockierung entfernt Sie aus allen drei Zuständen gleichzeitig.
Abgerufen vs. Erwähnt vs. Zitiert – Spickzettel
Die drei Zustände im Vergleich
| Abgerufen | Erwähnt | Zitiert | |
|---|---|---|---|
| Bedeutung | Eine KI hat Ihre Seite als Quellenmaterial abgerufen (RAG-Retrieval/Grounding) | Ihre Marke/Ihr Name erscheint im Antworttext – ohne Link | Ihre URL ist eine zugeordnete, klickbare Quelle |
| Erkennung | Server-Log-Analyse | String-Matching im KI-Antwortkorpus | Zitatberichte + Prüfung verlinkter URLs |
| Werkzeuge | Screaming Frog Log File Analyser, Botify, Ahrefs Bot Analytics, Cloudflare | Ahrefs Brand Radar (Response contains {brand}), manuelle Prompts | Brand Radar Cited Pages/Domains, Bing WMT AI Performance, GSC |
| Warum wichtig | Notwendig für Zitate; der -User-Bot-Treffer ist Ihr frühestes echtes Signal | Markenbekanntheit in der Antwort, auch ohne Klick | Das stärkste Signal – Autorität + (seltene) Klicks |
| Der Haken | Ein Abruf ≠ ein Zitat; für GA unsichtbar | Oft aus Trainingsdaten ohne Retrieval; inkonsistent von Lauf zu Lauf | ~82,9 % der Zitate sind Drittanbieter; ~1 % Klickrate |
Bots in Ihren Logs – was jeder bedeutet
| Bot | Eigentümer | Typ | Signal |
|---|---|---|---|
GPTBot | OpenAI | Trainings-Crawl | Wird für Training/Indexierung in Betracht gezogen – kein Zitat-Signal |
OAI-SearchBot | OpenAI | Such-Indexierung | Für die ChatGPT-Suchabfrage indiziert |
ChatGPT-User | OpenAI | Live-Inferenz | In Echtzeit während eines Gesprächs abgerufen – das Signal, das „kurz vor dem Zitieren“ steht |
ClaudeBot | Anthropic | Trainings-Crawl | Für das Claude-Training gecrawlt |
Claude-User | Anthropic | Live-Inferenz | In Echtzeit während eines Claude-Gesprächs abgerufen |
PerplexityBot | Perplexity | Such-Indexierung | Für den Perplexity-Korpus indiziert |
Perplexity-User | Perplexity | Live-Inferenz | In Echtzeit während einer Perplexity-Abfrage abgerufen |
Googlebot | Such-Crawl/Rendering | Versorgt den Google-Suchindex, der von AI Overviews und AI Mode verwendet wird | |
Google-Extended | Kontroll-Token, keine Request-UA | Steuert bestimmte Gemini-Trainings-/Grounding-Nutzungen; nicht für die Google-Suche-Inklusion oder das Ranking |
Schnelle Fakten
- 99,6 % des KI-Einflusses sind unsichtbar (OtterlyAI / Bing-Grounding-Daten).
- ChatGPT zitiert ~15 % der Seiten, die es abruft; insgesamt ~0,59 % Zitatrate.
- Perplexity durchschnittlich 21,87 Zitate/Antwort (am transparentesten); Bing Copilot 6,89.
- ~82,9 % der B2B-Zitate sind Drittanbieter; die eigene Website einer Marke macht 5–10 % der Referenzen aus (McKinsey).
- 1 % der Google-Besuche mit einer KI-Zusammenfassung enthielten einen Klick auf eine zitierte Quelle (Pew); 92–94 % der Google-AI-Mode-Sitzungen führten in Semrushs separater Clickstream-Stichprobe zu keinem Besuch einer externen Domain.
- Die Regel: Trainings-/Index-Crawl ≠ Zitat-Signal; ein dokumentierter, nutzerveranlasster Abruf beweist eine Anfrage, nicht Modellnutzung, Erwähnung oder Zitat.
Messfehler in der Trichterphase
Einen Crawler-Treffer als Zitat bezeichnen
Ein Abruf zeigt Retrieval-Aktivität, nicht dass die Antwort die Quelle genannt oder verlinkt hat. Verwenden Sie Antwort-Erfassungen für Erwähnungen und Zitate, anstatt Log-Beweise in eine spätere Trichterphase zu befördern.
Retrieval aus einer Erwähnung ableiten
Das Modell kann einen Markennamen aus parametrischem Wissen oder anderen Quellen erzeugen. Markieren Sie Retrieval nur, wenn die relevanten Log- oder Produktbeweise dies stützen.
Allen Bot-Traffic als nutzerveranlasstes Retrieval behandeln
Training, Indexierung, Überwachung und nutzerveranlasste Agenten erfüllen unterschiedliche Aufgaben. Segmentieren Sie dokumentierte Bot-Identitäten und vermeiden Sie es, jede KI-Crawler-Anfrage als Nutzung zur Antwortzeit zu kennzeichnen.
Die Beweisleiter
| Status | Mindestnachweis | Was er nicht beweist |
|---|---|---|
| Abgerufen | Eine relevante, nutzerausgelöste Abrufanfrage in Protokollen oder gleichwertiger Produktnachweis | Dass die Marke in der Antwort erschien |
| Erwähnt | Erfasster Antworttext nennt die Marke oder Entität | Dass eine URL verlinkt oder angeklickt wurde |
| Zitiert | Erfasste Antwort enthält einen Link zur URL der Website | Dass der Nutzer geklickt oder konvertiert hat |
| Besucht | Analyse- oder Serverereignis zeichnet die Landing-Session auf | Dass der Besuch einen vollständigen Referrer erhielt |
| Konvertiert | First-Party-Ereignis zeichnet das definierte Ergebnis auf | Dass der KI-Touchpoint alleinige Anerkennung verdient |
Steigen Sie die Leiter nur dann hinauf, wenn Nachweise für diesen Status vorliegen. Melden Sie Lücken als Lücken, statt sie mit Annahmen zur Attribution zu füllen.
Testen Sie sich: Abgerufen, erwähnt und zitiert
Ressourcen, die Ihre Zeit wert sind
Meine verwandten Artikel & Vorträge
- GEO? AEO? LLMO? What’s With All This AI Stuff? (Ahrefs Evolve 2025) — mein Vortrag, aus dem das Abgerufen/Erwähnt/Zitiert-Framework, die Korrelation mit Markenerwähnungen und die Geschichte mit der halluzinierten URL stammen. Folien · Webinar-Version.
- Cutting-Edge AEO Strategies with Patrick Stox (Marketing Speak, Folge 539).
- The Complete Guide to AI Visibility — das größere Bild, in das dieser Artikel eingebettet ist.
- How to Track AI Overviews — die Seite zur Zitierverfolgung, praktisch umgesetzt.
- AI Visibility Audit — Prüfung aller drei Ebenen.
- Brand Radar Methodology und 10 Ways to Use Brand Radar — einschließlich des Anwendungsfalls „gefunden, aber nicht zitiert“.
- Meet the New Web Crawlers: AI Bots Are Closing in on Search Engine Bots — die Bot-Landschaft hinter der Abrufebene.
Von anderen
- Screaming Frog – KI-Bots im Log File Analyser überwachen – das praktische Tutorial zu
-Uservs. Training-Bots. - Botify – KI-Bots mit Logfile-Analyse verfolgen.
- Peec AI – Ein Anfängerleitfaden zur Quellenlücken-Analyse – Quellen (abgerufen) vs. Zitate (verwendet), dargestellt als messbare Lücke.
- Discovered Labs – Wie jede Plattform Quellen unterschiedlich zitiert.
- OtterlyAI – KI-Zitate-Bericht 2026 – über 1 Million Datenpunkte aus Bing-Grounding-Daten; die Primärquelle für die 99,6-%-Statistik zur unsichtbaren Beeinflussung und die 73-%-Erkenntnis zu Crawling-Problemen.
- SparkToro – KIs sind bei der Empfehlung von Marken höchst inkonsistent – die Forschung hinter „<1 von 100 Chancen auf identische Markenlisten bei 100 Durchläufen.“
- Superlines – KI-Suchstatistiken 2026 – plattformbezogene Zitierraten und das Phänomen der Geisterzitate (zitiert, ohne genannt zu werden).
- BrightEdge – Markensichtbarkeit in ChatGPT und Google AI – ein Vergleich, wie ChatGPT und Google AI Mode auf handlungsorientierte Aufforderungen in vier Branchen reagieren.
- AiBoost – Logfile-Analyse für KI-Bot-Traffic – Crawl-zu-Referral-Verhältnisse: GPTBot ~1 276 Crawls pro Referral-Klick, ClaudeBot ~23 951.
Statistiken, die sich zu zitieren lohnen
- 99,6 % des KI-Einflusses sind unsichtbar. OtterlyAIs Analyse der Grounding-Daten von Bing Webmaster Tools – Inhalte werden umfassend im Hintergrund genutzt, erscheinen aber selten als sichtbare Quellenangabe. Die wichtigste Kennzahl zur Lücke zwischen abgerufen und nicht zitiert. Quelle
- Nur 51,5 % der KI-generierten Sätze werden vollständig durch Quellenangaben gestützt (und nur 74,5 % der Quellenangaben stützen ihren Satz tatsächlich) – Stanford, Evaluating Verifiability in Generative Search Engines, EMNLP 2023. Quelle
- ChatGPT zitiert nur etwa 15 % der Seiten, die es abruft – Leapd / Discovered Labs. Quelle
- Nutzer klickten in 1 % der Google-Besuche mit einer KI-Zusammenfassung auf eine zitierte Quelle in Pews Browser-Studie vom März 2025 (USA); 92–94 % der Google-AI-Mode-Sitzungen in Semrushs separater Clickstream-Stichprobe führten nicht zu einer externen Domain. Und dennoch konvertierte der gemessene KI-Traffic von Ahrefs in der internen Studie vom Juni 2025 mit der 23-fachen Rate des traditionellen organischen Traffics – wenige Klicks, aber außergewöhnliche.
- Perplexity kommt auf durchschnittlich 21,87 Quellenangaben pro Antwort (am höchsten, am transparentesten); Bing Copilot etwa 6,89; ChatGPT etwa 0,59 % Zitierrate (am niedrigsten der großen Anbieter). Quelle
- Etwa 82,9 % der B2B-Zitate stammen aus Drittquellen (Discovered Labs); die eigene Website einer Marke macht nur 5–10 % der Quellen aus, auf die KI sich über sie bezieht (McKinsey). Das Internet, das über Sie spricht, wiegt schwerer als Ihre eigenen Seiten.
- Markenerwähnungen im Web sind der wichtigste Prädiktor für das Erscheinen in KI-Übersichten (Korrelation 0,664 – über Domain Rating 0,326 und Backlinks 0,218), in Ahrefs’ Studie mit 75 000 Marken von Louise Linehan und Xibeijia Guan. Quelle
- Geisterzitate: Gemini zitierte eine Domain 182-mal in 30 Tagen, nannte die Marke jedoch kein einziges Mal; 73 % der KI-Präsenz dieser Marke waren Zitate ohne Erwähnungen (Superlines). Quelle
- KI-Antworten wechseln: Etwa 40–60 % der zitierten Quellen ändern sich monatlich, etwa 70 % des Inhalts von KI-Übersichten ändern sich bei derselben Abfrage, und die Wahrscheinlichkeit, dass zwei Läufe derselben Eingabeaufforderung identische Markenlisten zurückgeben, liegt bei unter 1 zu 100 (SparkToro). Verfolgen Sie Trends, nicht Momentaufnahmen. Quelle
Änderungsprotokoll
Aktualisiert am 28. Juli 2026.
Redaktionelle Zusammenfassung und aufgezeichnete Änderungsdetails.Änderungsdetails
-
Detaillierte Änderungsangaben sind derzeit auf Englisch verfügbar.
-
Detaillierte Änderungsangaben sind derzeit auf Englisch verfügbar.
-
Detaillierte Änderungsangaben sind derzeit auf Englisch verfügbar.
Vollständiger Vergleich nicht verfügbar — für diese Version wurde kein früherer Schnappschuss archiviert.
Aktualisiert am 22. Juli 2026.
Redaktionelle Zusammenfassung und aufgezeichnete Änderungsdetails.Änderungsdetails
-
Detaillierte Änderungsangaben sind derzeit auf Englisch verfügbar.
Vollständiger Vergleich nicht verfügbar — für diese Version wurde kein früherer Schnappschuss archiviert.
Aktualisiert am 20. Juli 2026.
Redaktionelle Zusammenfassung und aufgezeichnete Änderungsdetails.Änderungsdetails
-
Detaillierte Änderungsangaben sind derzeit auf Englisch verfügbar.
Vollständiger Vergleich nicht verfügbar — für diese Version wurde kein früherer Schnappschuss archiviert.
Aktualisiert am 19. Juli 2026.
Redaktionelle Zusammenfassung und aufgezeichnete Änderungsdetails.Änderungsdetails
-
Detaillierte Änderungsangaben sind derzeit auf Englisch verfügbar.
-
Detaillierte Änderungsangaben sind derzeit auf Englisch verfügbar.
-
Detaillierte Änderungsangaben sind derzeit auf Englisch verfügbar.
-
Detaillierte Änderungsangaben sind derzeit auf Englisch verfügbar.
Vollständiger Vergleich nicht verfügbar — für diese Version wurde kein früherer Schnappschuss archiviert.