Recuperado vs. mencionado vs. citado na IA

Recuperado, mencionado e citado são três ações diferentes que a busca com IA pode realizar com seu conteúdo — cada uma exige uma ferramenta de medição e uma forma de otimização diferente.

Publicado pela primeira vez: 24 de jun. de 2026 · Última atualização: 22 de ago. de 2026 · Avançado
Idiomas

Recuperado, mencionado e citado são estados observáveis distintos. Os logs podem comprovar uma busca verificada, mas não que o conteúdo entrou no contexto do modelo ou recebeu uma citação. Capturas das respostas comprovam menções e citações; dados analíticos comprovam visitas. Meça cada camada de forma independente e não transforme um rastreamento de treinamento, uma indexação de busca ou uma busca acionada pelo usuário em evidência de um resultado posterior.

TL;DR — Recuperado, mencionado e citado são três estados distintos, com três métodos de detecção diferentes. Recuperado aparece nos logs do servidor — e buscadores documentados acionados pelo usuário, como ChatGPT-User, Claude-User e Perplexity-User, estão mais próximos de uma solicitação em tempo real do que rastreadores de treinamento como GPTBot; ainda assim, uma busca não comprova uso nem citação. Mencionado é a correspondência do nome da marca na resposta (Brand Radar). Citado é uma URL vinculada (Brand Radar Cited Pages, Bing WMT AI Performance). Esses estados não avançam juntos: 99,6% da influência da IA é invisível (OtterlyAI), o ChatGPT cita cerca de 15% do que recupera, aproximadamente 82,9% das citações B2B vêm de sites de terceiros e até uma citação gera clique em cerca de 1% dos casos. Nenhuma ferramenta enxerga os três; você precisa de um conjunto.

Os três estados — e por que confundi-los custa caro

Retrieved, mentioned, and cited are separate observations with separate evidence. Fonte: /ai-search/measurement-and-reporting/retrieved-mentioned-cited/

Retrieved means a system fetched or selected the content as candidate context, evidenced by logs or retrieval traces. Mentioned means the answer used the brand, entity, or facts in its prose, evidenced by the answer text. Cited means the interface exposed a source link or citation to the page, evidenced by a visible source URL. A later state does not make every earlier state directly observable.

© Patrick Stox LLC · CC BY 4.0 ·

Um modelo pode usar informações recuperadas sem exibir um link; por isso, medições externas nem sempre comprovam o caminho interno da fonte. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: ChatGPT search Permissões de rastreamento indicam uma política de acesso, não garantem recuperação, menção ou citação. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: Crawlers

A maioria das conversas sobre “visibilidade em IA” reduz três eventos diferentes a uma só expressão. Eles não são iguais; tratá-los como um só leva a otimizar o sinal errado e medir o número errado.

Recuperado — o sistema de recuperação de uma IA buscou sua página como material de fonte durante a geração da resposta. Essa é a etapa de recuperação e fundamentação do RAG (geração aumentada por recuperação). O modelo “leu” seu conteúdo. Isso pode não gerar menção nem link. O único lugar em que aparece são os logs do servidor — ferramentas que analisam respostas não conseguem vê-lo, porque nada desse evento aparece na resposta.

Mencionado — sua marca, produto ou nome aparece no texto gerado, mas sem hiperlink nem atribuição da fonte. O modelo conhecia você, muitas vezes apenas pelos dados de treinamento, e incluiu seu nome. “Ferramentas como Ahrefs, Semrush e Moz podem ajudar na pesquisa de palavras-chave” — três marcas mencionadas, nenhum link. Isso pode ser detectado pela correspondência de texto no corpus de respostas (Brand Radar).

Citado — sua URL aparece como fonte atribuída: um link clicável, uma referência numerada ou uma caixa de fonte nomeada. Para isso, a IA precisa ter recuperado seu conteúdo e decidido que valia a pena atribuí-lo. É o que todos chamam de “sucesso em SEO para IA” — e é apenas a ponta do iceberg.

A lacuna central: o conteúdo pode ser recuperado sem ser mencionado e mencionado sem ser citado. Cada estado exige uma ferramenta de medição e uma forma de otimização própria.

A distinção mais importante: rastreamento para treinamento vs. inferência em tempo real

Este é o ponto mais útil para entender a detecção da recuperação — e um dos que vejo serem ignorados com mais frequência.

Sistemas de IA expõem várias finalidades de solicitação, com significados diferentes nos logs:

  • Rastreadores de treinamento e desenvolvimento de modelosGPTBot e ClaudeBot. Um acesso verificado comprova uma busca sob aquela identidade, não a inclusão no treinamento nem um evento de citação.
  • Rastreadores de busca e indexaçãoOAI-SearchBot, Claude-SearchBot, PerplexityBot e o Googlebot para recursos da Busca do Google. Eles apoiam a descoberta ou a recuperação, mas um rastreamento de índice ainda não é uma citação.
  • Buscadores acionados pelo usuárioChatGPT-User, Claude-User e Perplexity-User. Eles são documentados como solicitações iniciadas por usuários ou que dão suporte a usuários. Estão mais próximos de uma tarefa em tempo real, mas a solicitação isolada não revela se a resposta entrou no contexto do modelo ou gerou uma citação visível.
  • Tokens de controleGoogle-Extended não possui um agente de usuário de solicitação dedicado. Ele controla determinados usos de conteúdo rastreado pelo Google no treinamento e na fundamentação do Gemini; não é o rastreador das Visões Gerais de IA nem do Modo IA.

O sufixo -User é uma convenção útil entre esses provedores, não um padrão da web. Um erro 404, um bloqueio da CDN ou um tempo limite impede a conclusão daquela busca; é uma falha real de acesso, mas não prova que, sem ela, uma citação seria garantida.

Não confunda os sinais. “O GPTBot me rastreou, então o ChatGPT vai me citar” é um mito — são sinais fundamentalmente diferentes.

Por que a lacuna é tão grande — o problema da influência invisível

Os estados divergem muito mais do que a maioria das pessoas espera:

  • 99,6% da influência da IA é invisível. A análise da OtterlyAI sobre dados de fundamentação do Bing Webmaster Tools mostrou que a imensa maioria das recuperações nunca aparece como citação atribuída e visível ao usuário. É o número publicado mais concreto sobre a lacuna entre recuperação e citação.
  • O ChatGPT cita apenas cerca de 15% das páginas que recupera (Leapd / Discovered Labs). Entrar no conjunto de recuperação é necessário, mas está longe de ser suficiente.
  • Seu próprio site raramente é a fonte. Aproximadamente 82,9% das citações B2B vêm de sites de terceiros (Discovered Labs); a McKinsey estima que o site da própria marca representa apenas 5–10% das fontes que a IA referencia sobre ela. O que a internet diz sobre você importa mais do que suas próprias páginas.
  • Mesmo uma citação raramente gera clique. No estudo do Pew sobre navegação nos EUA em março de 2025, usuários clicaram em um resultado comum em 8% das visitas ao Google com resumo de IA (contra 15% sem resumo) e em uma fonte citada em 1%. Na amostra independente de cliques da Semrush, 92–94% das sessões no Modo IA do Google não resultaram em visita a um domínio externo.

Assim, a perda se acumula: recuperado → mencionado → citado → clicado, com redução de volume em cada etapa.

O contraponto — e o motivo para continuar investindo — é a qualidade. Na Ahrefs, dados internos de junho de 2025 mostraram que o tráfego de IA converteu a uma taxa 23 vezes maior do que o tráfego orgânico tradicional: cerca de 0,5% dos visitantes vieram da IA, mas responderam por aproximadamente 12,1% dos cadastros no período medido de 30 dias. Poucos cliques, mas os que chegam são extraordinários.

Como cada plataforma lida com recuperação e citação

O mesmo conteúdo e a mesma consulta produzem resultados de atribuição muito diferentes conforme a plataforma:

  • ChatGPT (OpenAI) — dados básicos de treinamento mais uma camada de recuperação quando a busca está ativada. O ChatGPT Search foi lançado sobre o índice do Bing, mas a OpenAI também opera seu próprio rastreador (OAI-SearchBot) para busca e indexação independentes, sem publicar a combinação atual dos dois. Trate “é basicamente o Bing” como simplificação, não como fato documentado. Cita cerca de 15% do que recupera e apresenta taxa de citação de aproximadamente 0,59% nos temas testados — a menor entre as principais plataformas. Pode falar sobre sua marca com base nos dados de treinamento, sem recuperação nem citação — o caso mais puro de “mencionado, mas não recuperado nem citado”.
  • Perplexity — realiza busca em tempo real em toda consulta com seu próprio PerplexityBot. Tem média de 21,87 citações por resposta, a maior entre as principais plataformas, e é a que menos tende a mencionar sem citar. É a plataforma mais transparente.
  • Visões Gerais de IA / Modo IA do Google — o índice orgânico e o Knowledge Graph, com o Gemini gerando a resposta. Usa expansão de consulta (uma consulta do usuário → muitas subconsultas internas), portanto páginas são recuperadas para subconsultas que nunca aparecem na resposta visível — recuperação obscura por projeto. As citações são associadas a trechos específicos por anotações url_citation.
  • Bing Copilot — índice do Bing mais uma camada GPT; média de 6,89 citações por resposta. Desde fevereiro de 2026, possui a primeira ferramenta oficial para webmasters que expõe dados de fundamentação e citação (veja Documentação oficial).
  • Claude (Anthropic) — frequentemente responde a partir de dados de treinamento, sem recuperação e com zero citação; quando recupera, porém, apresenta qualidade elevada e grande propensão a citar conteúdo claro e bem estruturado. Menor frequência de recuperação, maior proporção entre recuperação e citação.

Como detectar cada estado

Recuperado → logs do servidor. Os logs registram toda solicitação de bot, inclusive de rastreadores de IA que, em sua maioria, buscam HTML bruto sem renderizar JavaScript — mas isso varia por provedor: respostas do Google baseadas no Gemini reutilizam o renderizador do Googlebot, portanto não presuma que todo rastreador de IA ignore a renderização. Nada disso aparece no GA. Observe os agentes de usuário e, sobretudo, separe -User (inferência em tempo real) dos rastreadores básicos (treinamento). Ferramentas: Screaming Frog Log File Analyser, Botify, Ahrefs Bot Analytics e Cloudflare. A limitação: os logs comprovam uma busca, não uma citação. Além disso, ferramentas analíticas comuns classificam a maioria das referências de IA como tráfego direto — os logs são o único lugar em que o quadro completo da recuperação fica visível.

Mencionado → monitoramento de marca. O Ahrefs Brand Radar procura sua marca em um grande corpus de prompts apoiado por busca no ChatGPT, Gemini, Copilot, Perplexity, Visões Gerais de IA, Modo IA e Grok. O filtro relevante é Response contains {your brand}. A ressalva: ele usa uma biblioteca estática de prompts e não enxerga as “consultas obscuras” internas da IA que compõem grande parte da superfície real de recuperação. Respostas de IA também variam muito entre execuções (SparkToro: probabilidade inferior a 1 em 100 de obter listas de marcas idênticas em 100 execuções do mesmo prompt). Trate o resultado como tendência direcional, não contagem exata.

Divulgação: sou ex-funcionário da Ahrefs e recebo acesso gratuito à plataforma. O Brand Radar é tratado aqui como um conjunto de dados do provedor, não como registro completo de qualquer plataforma, e a Ahrefs não revisa as conclusões deste site.

Citado → rastreamento de citações. Use os relatórios Cited Pages do Brand Radar (suas páginas citadas) e Cited Domains (sites de terceiros citados quando falam de você), o Bing Webmaster Tools AI Performance para dados oficiais do Copilot e o relatório de IA generativa do GSC para impressões em propriedades participantes. O filtro “found but not cited” (“encontrado, mas não citado”) — Response contains {your brand} AND citation does not contain {your domain} — isola exatamente a lacuna: respostas influenciadas por você, sem link para você.

Duas lacunas inversas que vale conhecer

  • Mencionado, mas nunca recuperado nem citado. O modelo menciona sua marca diretamente dos dados de treinamento, sem busca em tempo real nem link. É comum com marcas conhecidas.
  • Citado, mas nunca mencionado (“citações fantasma”). A Superlines constatou que o Gemini citou um domínio 182 vezes em 30 dias sem dizer o nome da marca uma única vez — 73% da presença dessa marca na IA eram citações sem nome associado. Você fornece sinais confiáveis à resposta, mas o usuário nunca os associa a você.

Por isso, o monitoramento de menções e o rastreamento de citações precisam funcionar em paralelo — um não implica o outro.

O que fazer com essas lacunas

  • Recuperado, mas não citado — primeiro, pare de perder oportunidades na entrada: evite erros e bloqueios de CDN para bots -User. Depois, melhore a completude e a estrutura (respostas claras e diretas no alto da página; títulos que espelham as perguntas). Na análise da Discovered Labs de janeiro de 2026, a completude semântica teve correlação aproximada de 0,89 com a probabilidade de citação nas Visões Gerais de IA do Google — valor informado pela própria empresa, não auditado de modo independente.
  • Mencionado, mas não citado — crie sinais mais explícitos de atribuição na página e use a alavanca maior: faça a internet falar sobre você. O principal preditor da Ahrefs para aparecer nas Visões Gerais de IA são menções de marca na web (correlação de 0,664 — muito acima do Domain Rating, 0,326, ou de backlinks, 0,218), segundo o estudo de 75 000 marcas de Louise Linehan e Xibeijia Guan. Dezesseis páginas da Zapier mencionando a Ahrefs bastaram para colocá-la em 1 431 respostas de IA.
  • Citado, mas sem tráfego — essa é, em grande parte, a realidade atual; otimize para que o nome apareça junto da citação (gerando lembrança de marca mesmo sem clique) e para tipos de consulta de maior valor, nos quais o tráfego de IA converte.

A mudança estratégica em uma frase: antes, SEO era “otimize seu site”. Agora é “otimize a forma como a internet fala sobre você”. Otimizar suas páginas afeta a possibilidade de serem recuperadas e citadas; otimizar a conversa sobre você afeta a possibilidade de ser mencionado e de ampliar o alcance por citações de terceiros.

O conjunto de medição de que você realmente precisa

Nenhuma ferramenta cobre tudo. A resposta honesta é um conjunto:

  • Logs → camada de recuperação (Screaming Frog, Botify, Ahrefs Bot Analytics).
  • Monitoramento de marca → camada de menção (Brand Radar, testes manuais de prompts).
  • Rastreamento de citações → camada de citação (relatórios Cited do Brand Radar, Bing WMT AI Performance).
  • GSC + GA4 → camada de tráfego (lembrando que o GA4 oculta a maioria das referências de IA como tráfego direto).

Uma última cautela: respostas de IA mudam muito — cerca de 40–60% das fontes citadas variam de um mês para outro, e aproximadamente 70% do conteúdo das Visões Gerais de IA muda para a mesma consulta. Acompanhe tendências ao longo de muitas execuções, não capturas isoladas, e não ajuste demais sua estratégia a um número tão volátil.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.