Retrieved vs. Mentioned vs. Cited di AI

Retrieved, mentioned, dan cited adalah three berbeda hal AI penelusuran dapat melakukan dengan Anda konten — setiap perlu sebuah berbeda alat untuk mengukur dan sebuah berbeda lever untuk perbaiki.

Pertama kali diterbitkan: 24 Jun 2026 · Terakhir diperbarui: 3 Agu 2026 · Lanjutan

Retrieved, mentioned, dan cited adalah terpisah observable status. Logs dapat prove sebuah verified fetch, tidak itu konten entered model context atau earned sebuah citation. jawaban captures prove mentions dan citations; analytics proves visits. mengukur setiap layer independently dan melakukan tidak promote sebuah training crawl, penelusuran-indeks crawl, atau pengguna-directed fetch ke evidence dari sebuah kemudian outcome.

TL;DR — Retrieved, mentioned, dan cited adalah three distinct status dengan three distinct detection metode. Retrieved lives di Anda server logs — dan terdokumentasi pengguna-directed fetchers such sebagai ChatGPT-User, Claude-User, dan Perplexity-User adalah closer untuk sebuah langsung permintaan daripada training crawler such sebagai GPTBot, tetapi sebuah fetch masih melakukan tidak prove gunakan atau citation. Mentioned adalah sebuah brand-name string match di respons (Brand Radar). Cited adalah sebuah ditautkan URL (Brand Radar Cited halaman, Bing WMT AI performa). mereka jangan move together: 99,6% dari AI influence adalah invisible (OtterlyAI), ChatGPT cites ~15% dari apa ini retrieves, ~82,9% dari B2B citations come dari ketiga-party situs, dan bahkan sebuah citation earns sebuah click ~1% dari time. Tidak single alat sees semua three; Anda perlu sebuah stack.

three status — dan mengapa conflating them costs Anda

Retrieved, mentioned, dan cited adalah terpisah observations dengan terpisah evidence. Sumber: /ai-search/measurement-and-reporting/retrieved-mentioned-cited/

Retrieved berarti sebuah sistem fetched atau dipilih konten sebagai candidate context, evidenced oleh logs atau retrieval traces. Mentioned berarti jawaban digunakan brand, entity, atau facts di -nya prose, evidenced oleh jawaban text. Cited berarti interface exposed sebuah sumber tautan atau citation untuk halaman, evidenced oleh sebuah terlihat sumber URL. sebuah kemudian state melakukan tidak membuat setiap sebelumnya state secara langsung observable.

© Patrick Stox LLC · CC BY 4.0 ·

sebuah model dapat gunakan retrieved informasi tanpa displaying sebuah tautan, so external pengukuran cannot selalu prove internal sumber path. Bukti untuk klaim ini Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Cakupan: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Tingkat keyakinan: tinggi · Diverifikasi: OpenAI: ChatGPT search crawler permissions indicate access policy, tidak guaranteed retrieval, mention, atau citation. Bukti untuk klaim ini Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Cakupan: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Tingkat keyakinan: tinggi · Diverifikasi: OpenAI: Crawlers

sebagian besar “AI visibility” (terjemahan) “AI visibilitas” conversations collapse three berbeda events ke satu kata. mereka’re tidak yang sama hal, dan treating them sebagai satu adalah bagaimana orang end up optimizing untuk wrong sinyal dan measuring wrong angka.

Retrieved — sebuah AI’s retrieval sistem fetched Anda halaman sebagai sumber material sementara ini adalah generating sebuah jawaban. ini adalah retrieval/grounding phase dari RAG (retrieval-augmented generation). model “baca” (terjemahan) “baca” Anda. Anda dapat mendapatkan Tidak mention dan Tidak tautan out dari ini. hanya place ini menampilkan up adalah Anda server logs — Tidak respons-analysis alat dapat see ini, karena tidak ada apa pun tentang ini muncul di jawaban.

Mentioned — Anda brand, product, atau name muncul di generated text, tetapi dengan Tidak hyperlink dan Tidak sumber attribution. model knew tentang Anda, sering dari training data alone, dan dropped Anda name di. “Tools like Ahrefs, Semrush, dan Moz dapat help dengan keyword research” (terjemahan) “alat like Ahrefs, Semrush, dan Moz dapat help dengan keyword research” — itu’s three brands mentioned, zero tautan. Detectable oleh string-matching respons corpus (Brand Radar).

«Cited — your URL is included as an attributed source: a clickable link, a numbered reference, a named source box. This requires the AI to have both retrieved your content and decided it was worth attributing. It’s what everyone calls “AI SEO success” — and it’s the tip of the iceberg. » (Terjemahan) (Ringkasan bahasa Indonesia untuk bagian dua puluh tiga, bagian kecil satu: teks sumber dipertahankan agar dapat diperiksa dalam tinjauan penutur asli.)

key kesenjangan: konten dapat menjadi retrieved tanpa menjadi mentioned, dan mentioned tanpa menjadi cited. setiap state perlu sebuah berbeda pengukuran alat dan sebuah berbeda optimization lever.

pembedaan itu penting sebagian besar: training crawl vs. langsung inference

ini adalah single sebagian besar berguna hal untuk memahami tentang detecting retrieval, dan ini adalah satu I see skipped constantly.

AI sistem expose several permintaan purposes, dan mereka berarti berbeda hal di logs:

  • Training/model-development crawlerGPTBot dan ClaudeBot. sebuah verified hit proves sebuah fetch di bawah itu crawler identity, tidak training inclusion atau sebuah citation event.
  • Penelusuran/pengindeksan crawlerOAI-SearchBot, Claude-SearchBot, PerplexityBot, dan Googlebot untuk Google Search fitur. ini mendukung penelusuran penemuan atau retrieval, tetapi sebuah indeks crawl masih adalah tidak sebuah citation.
  • pengguna-directed fetchersChatGPT-User, Claude-User, dan Perplexity-User. ini adalah terdokumentasi sebagai pengguna-initiated atau pengguna-supporting permintaan. mereka adalah closer untuk sebuah langsung task, tetapi permintaan alone melakukan tidak reveal apakah respons entered model context atau produced sebuah terlihat citation.
  • Control tokensGoogle-Extended memiliki Tidak dedicated permintaan pengguna agent. ini controls certain Gemini training dan grounding menggunakan dari Google-di-crawl konten; ini adalah tidak crawler untuk AI Overviews atau AI Mode.

-User suffix adalah sebuah berguna convention among ini named providers, tidak sebuah web standard. sebuah 404, CDN block, atau timeout mencegah itu fetch dari succeeding; ini adalah sebuah nyata access failure, tetapi tidak proof itu sebuah citation adalah jika tidak guaranteed.

jangan conflate dua. “GPTBot crawled me, so ChatGPT akan cite me” (terjemahan) “GPTBot di-crawl me, so ChatGPT akan cite me” adalah sebuah myth — mereka’re fundamentally berbeda sinyal.

Mengapa kesenjangan adalah so wide — invisible-influence masalah

status diverge far lebih daripada sebagian besar orang expect:

  • 99,6% dari AI influence adalah invisible. OtterlyAI’s analysis dari Bing Webmaster alat grounding data ditemukan overwhelming majority dari retrieval tidak pernah surfaces sebagai sebuah pengguna-terlihat, attributed citation. ini adalah paling concrete published angka pada retrieved-tetapi-tidak-cited kesenjangan.
  • ChatGPT cites hanya ~15% dari halaman ini retrieves (Leapd / ditemukan Labs). menjadi di retrieval pool adalah necessary tetapi nowhere near sufficient.
  • Anda own situs adalah rarely sumber. ~82,9% dari B2B citations come dari ketiga-party situs (ditemukan Labs); McKinsey puts sebuah brand’s own situs web di hanya 5–10% dari sources AI references tentang ini. internet talking tentang Anda penting lebih daripada Anda own halaman.
  • bahkan menjadi cited rarely earns sebuah click. di Pew’s March 2025 U.S. browsing study, pengguna clicked sebuah standard hasil di 8% dari Google visits dengan sebuah AI summary (vs. 15% tanpa) dan clicked sebuah cited sumber di 1%. di Semrush’s terpisah clickstream sample, 92–94% dari Google AI Mode sessions melakukan tidak lead untuk sebuah external-domain visit.

So kesenjangan compounds: retrieved → mentioned → cited → clicked, dan Anda leak volume di setiap langkah.

counterweight — dan alasan ini adalah masih worth melakukan — adalah quality. di Ahrefs, June 2025 internal data showed AI traffic converting di 23x rate dari tradisional trafik organik: tentang 0,5% dari pengunjung came dari AI tetapi accounted untuk ~12,1% dari signups selama diukur 30-day period. Sedikit clicks, tetapi ones Anda mendapatkan adalah extraordinary.

Bagaimana setiap platform menangani retrieval dan citation

sama konten, sama kueri, wildly berbeda attribution outcomes oleh platform:

«- ChatGPT (OpenAI) — base training data plus a retrieval layer when search is on. ChatGPT Search launched on Bing’s index, but OpenAI also runs its own crawler (OAI-SearchBot) for independent fetching and indexing, and hasn’t published the current mix between the two — treat “it’s basically Bing” as a simplification, not a documented fact. Cites ~15% of what it retrieves; ~0.59% citation rate across tested topics — the lowest of the majors. It will happily discuss your brand from training data with no retrieval and no citation — the purest “mentioned but not retrieved or cited.”

  • Perplexity — runs a real-time search on every query with its own PerplexityBot. Averages 21.87 citations per response, the highest of any major platform, and is the least likely to mention without citing. The most transparent platform.
  • Google AI Overviews / AI Mode — your organic index + Knowledge Graph, with Gemini generating the answer. Uses query fan-out (one user query → many internal sub-queries), so pages get retrieved for sub-queries that never appear in the visible answer — dark retrieval by design. Citations attach to specific text segments via url_citation annotations.
  • Bing Copilot — Bing index + GPT layer; averages 6.89 citations per response. As of Feb 2026 it has the first official webmaster tool exposing grounding/citation data (see Official Docs). » (Terjemahan) (Ringkasan bahasa Indonesia untuk bagian tiga puluh delapan, bagian kecil satu: teks sumber dipertahankan agar dapat diperiksa dalam tinjauan penutur asli.) «- Claude (Anthropic) — frequently answers from training data with no retrieval and 0 citations, but when it does retrieve, it’s among the highest quality and most likely to cite clear, well-structured content. Lowest retrieval frequency, highest retrieval-to-citation ratio. » (Terjemahan) (Ringkasan bahasa Indonesia untuk bagian tiga puluh delapan, bagian kecil dua: teks sumber dipertahankan agar dapat diperiksa dalam tinjauan penutur asli.)

cara detect setiap state

Retrieved → server logs. Logs record setiap bot permintaan, including dari AI crawler itu mostly fetch mentah HTML tanpa rendering JavaScript — itu varies oleh provider, though: Google’s Gemini-based jawaban reuse Googlebot’s renderer, so jangan assume setiap AI crawler skips rendering. None dari ini menampilkan up di GA. Watch pengguna agents, dan di atas semua terpisah -User (langsung inference) dari base crawler (training). alat: Screaming Frog Log File Analyser, Botify, Ahrefs bot Analytics, Cloudflare. limitation: logs prove sebuah fetch happened, tidak itu Anda adalah cited. dan standard analytics misclassify majority dari AI referrals sebagai direct traffic — logs adalah satu-satunya place penuh retrieval picture adalah terlihat.

Mentioned → brand monitoring. Ahrefs Brand Radar string-matches Anda brand terhadap sebuah besar penelusuran-backed prompt corpus di seluruh ChatGPT, Gemini, Copilot, Perplexity, AI Overviews, AI Mode, dan Grok. filter itu penting di sini adalah Response contains {your brand}. catch: ini berjalan sebuah static prompt library dan dapat’t see AI-internal “dark queries” (terjemahan) “dark kueri” itu membuat up sebagian besar dari nyata retrieval surface, dan AI jawaban adalah wildly inconsistent jalankan untuk jalankan (SparkToro: <1 di 100 chance dari identical brand lists di seluruh 100 berjalan dari yang sama prompt). Treat ini sebagai sebuah directional trend, tidak sebuah precise count.

Disclosure: I am sebuah former Ahrefs employee dan menerima complimentary Ahrefs access. Brand Radar adalah treated di sini sebagai sebuah provider dataset, tidak sebuah menyelesaikan record dari apa pun platform, dan Ahrefs melakukan tidak review ini situs’s conclusions.

Cited → citation tracking. Brand Radar’s Cited halaman (Anda halaman itu mendapatkan cited) dan Cited Domains (yang ketiga-party situs mendapatkan cited ketika Anda’re discussed) reports; Bing Webmaster alat AI performa untuk official Copilot data; dan GSC’s Generative AI report untuk impressions pada participating properties. “found but not cited” (terjemahan) “ditemukan tetapi tidak cited” move — Response contains {your brand} AND citation does not contain {your domain} — isolates persis kesenjangan: jawaban shaped oleh Anda, dengan Tidak tautan untuk Anda.

Dua inverse gaps worth knowing

  • Mentioned, tidak pernah retrieved atau cited. sebuah model names Anda brand straight dari training data, Tidak langsung fetch, Tidak tautan. umum untuk well-known brands.
  • Cited, tidak pernah mentioned (“ghost citations” (terjemahan) “ghost citations”). Superlines ditemukan Gemini cited satu domain 182 times di 30 days sementara saying brand name zero times — 73% dari itu brand’s AI presence adalah citations dengan Tidak name attached. Anda’re feeding jawaban authoritative sinyal sementara pengguna tidak pernah associates ini dengan Anda.

ini adalah mengapa mention tracking dan citation tracking memiliki untuk jalankan di parallel — neither satu implies lainnya.

Apa untuk melakukan tentang gaps

  • Retrieved tetapi tidak cited — pertama, berhenti losing ini di door: Tidak errors atau CDN blocks untuk -User bot. lalu meningkatkan completeness dan structure (jelas, direct jawaban tinggi pada halaman; pertanyaan-mirroring heading). di ditemukan Labs’ January 2026 analysis, semantic completeness correlated ~0,89 dengan citation likelihood di Google AI Overviews — mereka own reported figure, tidak sebuah independently audited satu.
  • Mentioned tetapi tidak cited — bangun lebih jelas attribution sinyal pada-halaman, dan lean ke bigger lever: mendapatkan internet talking tentang Anda. Ahrefs’ #1 predictor dari appearing di AI Overviews adalah branded web mentions (correlation 0,664 — well di atas Domain Rating di 0,326 atau backlinks di 0,218), dari 75 000-brand study oleh Louise Linehan dan Xibeijia Guan. Sixteen halaman pada Zapier mentioning Ahrefs adalah cukup untuk put us di 1 431 AI respons.
  • Cited tetapi Tidak traffic — ini adalah mostly saat ini reality; mengoptimalkan untuk menjadi named alongside citation (so ada brand recall bahkan tanpa sebuah click) dan untuk lebih tinggi-nilai kueri jenis di mana AI traffic converts.

itu’s strategic shift di satu line: SEO adalah “optimize your site.” (terjemahan) “mengoptimalkan Anda situs.” Now ini adalah “optimize how the internet talks about you.” (terjemahan) “mengoptimalkan bagaimana internet talks tentang Anda.” Optimizing Anda own halaman memengaruhi apakah Anda dapat menjadi retrieved dan cited; optimizing conversation tentang Anda memengaruhi apakah Anda mendapatkan mentioned dan apakah ketiga-party citations multiply Anda reach.

pengukuran stack Anda sebenarnya perlu

Tidak single alat covers semua dari ini. honest jawaban adalah sebuah stack:

  • Logs → retrieval layer (Screaming Frog, Botify, Ahrefs bot Analytics).
  • Brand monitoring → mention layer (Brand Radar, manual prompt testing).
  • Citation tracking → cited layer (Brand Radar Cited reports, Bing WMT AI performa).
  • GSC + GA4 → traffic layer (dan remember GA4 hides sebagian besar AI referrals sebagai direct).

Satu terakhir caution: AI jawaban churn hard — roughly 40–60% dari cited sources perubahan month untuk month, dan ~70% dari AI Overview konten perubahan untuk yang sama kueri. Track trends di atas banyak berjalan, tidak single snapshots, dan jangan di atas-fit untuk sebuah angka itu’s ini volatile.

Tambahkan catatan pakar

Sematkan kutipan pakar

Orang baru? Buat profilnya yang belum diklaim di /admin/experts/ → Sematkan kutipan pakar terlebih dahulu.