Recuperado vs. mencionado vs. citado na IA
Recuperado, mencionado e citado são três ações diferentes que a busca com IA pode realizar com seu conteúdo — cada uma exige uma ferramenta de medição e uma forma de otimização diferente.
Idiomas
Recuperado, mencionado e citado são estados observáveis distintos. Os logs podem comprovar uma busca verificada, mas não que o conteúdo entrou no contexto do modelo ou recebeu uma citação. Capturas das respostas comprovam menções e citações; dados analíticos comprovam visitas. Meça cada camada de forma independente e não transforme um rastreamento de treinamento, uma indexação de busca ou uma busca acionada pelo usuário em evidência de um resultado posterior.
TL;DR — “Aparecer na IA” significa, na verdade, três coisas diferentes. Recuperado significa que uma IA leu sua página. Mencionado significa que seu nome apareceu na resposta. Citado significa que seu link apareceu na resposta. Esses eventos nem sempre acontecem juntos — seu conteúdo pode ser lido sem ser nomeado, ou nomeado sem receber link — e cada um exige uma ferramenta diferente para ser detectado.
Três coisas, não uma
Recuperação, menção e citação são resultados observáveis distintos; nenhuma plataforma garante que permitir o rastreamento produza qualquer um deles. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: ChatGPT search A OpenAI documenta agentes de usuário e controles separados para contextos de busca e treinamento. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: Crawlers
Quando alguém diz “quero aparecer no ChatGPT”, normalmente imagina uma coisa: seu link na resposta. Na prática, porém, uma IA pode fazer três coisas distintas com seu conteúdo, e as pessoas agrupam todas sob o rótulo “visibilidade em IA”. É aí que a confusão começa.
- Recuperado — a IA buscou e leu sua página enquanto montava a resposta. Ela pode usar o que aprendeu ou não. Isso não aparece no Google Analytics; o único lugar em que fica registrado são os logs do servidor.
- Mencionado — sua marca ou seu nome aparece no texto da resposta, mas sem link. A IA simplesmente “conhecia você”, muitas vezes pelos dados de treinamento, não porque leu seu site naquele momento.
- Citado — sua URL aparece na resposta como uma fonte clicável.
Por que essa diferença importa
Aqui está o ponto que muita gente ignora: esses estados não avançam juntos. Sua página pode ser lida sem ser nomeada e nomeada sem receber link. Uma análise dos dados de fundamentação da Microsoft concluiu que 99,6% da influência da IA é invisível — o conteúdo é usado constantemente nos bastidores, mas quase nunca se transforma em uma citação visível.
Portanto, se sua ferramenta de IA contabiliza apenas citações (links), ela mostra uma pequena parte do quadro. Você pode influenciar respostas o dia inteiro e ainda assim a ferramenta indicar que não há presença alguma.
O que isso significa para você
- Quer saber se as IAs estão lendo seu conteúdo? Consulte os logs do servidor em busca de bots de IA.
- Quer saber se sua marca está sendo mencionada? Use uma ferramenta de monitoramento de marca que analise respostas de IA.
- Quer saber se seu site está sendo citado? Use um rastreador de citações (o Bing já oferece um relatório oficial para as próprias respostas de IA).
E vale entender mais uma coisa desde já: mesmo uma citação geralmente não gera um clique. O Pew constatou que apenas cerca de 1% das pessoas clicam nas fontes citadas em um resumo de IA. Portanto, “aparecer na IA” hoje tem menos relação com tráfego e mais com participar da conversa. Quer a análise completa — bots, plataformas e formas de medir cada camada? Mude para a guia Avançado.
TL;DR — Recuperado, mencionado e citado são três estados distintos, com três métodos de detecção diferentes. Recuperado aparece nos logs do servidor — e buscadores documentados acionados pelo usuário, como
ChatGPT-User,Claude-UserePerplexity-User, estão mais próximos de uma solicitação em tempo real do que rastreadores de treinamento comoGPTBot; ainda assim, uma busca não comprova uso nem citação. Mencionado é a correspondência do nome da marca na resposta (Brand Radar). Citado é uma URL vinculada (Brand Radar Cited Pages, Bing WMT AI Performance). Esses estados não avançam juntos: 99,6% da influência da IA é invisível (OtterlyAI), o ChatGPT cita cerca de 15% do que recupera, aproximadamente 82,9% das citações B2B vêm de sites de terceiros e até uma citação gera clique em cerca de 1% dos casos. Nenhuma ferramenta enxerga os três; você precisa de um conjunto.
Os três estados — e por que confundi-los custa caro
Retrieved means a system fetched or selected the content as candidate context, evidenced by logs or retrieval traces. Mentioned means the answer used the brand, entity, or facts in its prose, evidenced by the answer text. Cited means the interface exposed a source link or citation to the page, evidenced by a visible source URL. A later state does not make every earlier state directly observable.
© Patrick Stox LLC · CC BY 4.0 ·
Um modelo pode usar informações recuperadas sem exibir um link; por isso, medições externas nem sempre comprovam o caminho interno da fonte. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: ChatGPT search Permissões de rastreamento indicam uma política de acesso, não garantem recuperação, menção ou citação. Evidence for this claim Official or primary documentation supporting the adjacent article claim, with scope limited to the source's published description. Scope: No ranking guarantee or undisclosed system mechanics are inferred beyond the cited source. Confidence: high · Verified: OpenAI: Crawlers
A maioria das conversas sobre “visibilidade em IA” reduz três eventos diferentes a uma só expressão. Eles não são iguais; tratá-los como um só leva a otimizar o sinal errado e medir o número errado.
Recuperado — o sistema de recuperação de uma IA buscou sua página como material de fonte durante a geração da resposta. Essa é a etapa de recuperação e fundamentação do RAG (geração aumentada por recuperação). O modelo “leu” seu conteúdo. Isso pode não gerar menção nem link. O único lugar em que aparece são os logs do servidor — ferramentas que analisam respostas não conseguem vê-lo, porque nada desse evento aparece na resposta.
Mencionado — sua marca, produto ou nome aparece no texto gerado, mas sem hiperlink nem atribuição da fonte. O modelo conhecia você, muitas vezes apenas pelos dados de treinamento, e incluiu seu nome. “Ferramentas como Ahrefs, Semrush e Moz podem ajudar na pesquisa de palavras-chave” — três marcas mencionadas, nenhum link. Isso pode ser detectado pela correspondência de texto no corpus de respostas (Brand Radar).
Citado — sua URL aparece como fonte atribuída: um link clicável, uma referência numerada ou uma caixa de fonte nomeada. Para isso, a IA precisa ter recuperado seu conteúdo e decidido que valia a pena atribuí-lo. É o que todos chamam de “sucesso em SEO para IA” — e é apenas a ponta do iceberg.
A lacuna central: o conteúdo pode ser recuperado sem ser mencionado e mencionado sem ser citado. Cada estado exige uma ferramenta de medição e uma forma de otimização própria.
A distinção mais importante: rastreamento para treinamento vs. inferência em tempo real
Este é o ponto mais útil para entender a detecção da recuperação — e um dos que vejo serem ignorados com mais frequência.
Sistemas de IA expõem várias finalidades de solicitação, com significados diferentes nos logs:
- Rastreadores de treinamento e desenvolvimento de modelos —
GPTBoteClaudeBot. Um acesso verificado comprova uma busca sob aquela identidade, não a inclusão no treinamento nem um evento de citação. - Rastreadores de busca e indexação —
OAI-SearchBot,Claude-SearchBot,PerplexityBote o Googlebot para recursos da Busca do Google. Eles apoiam a descoberta ou a recuperação, mas um rastreamento de índice ainda não é uma citação. - Buscadores acionados pelo usuário —
ChatGPT-User,Claude-UserePerplexity-User. Eles são documentados como solicitações iniciadas por usuários ou que dão suporte a usuários. Estão mais próximos de uma tarefa em tempo real, mas a solicitação isolada não revela se a resposta entrou no contexto do modelo ou gerou uma citação visível. - Tokens de controle —
Google-Extendednão possui um agente de usuário de solicitação dedicado. Ele controla determinados usos de conteúdo rastreado pelo Google no treinamento e na fundamentação do Gemini; não é o rastreador das Visões Gerais de IA nem do Modo IA.
O sufixo -User é uma convenção útil entre esses provedores, não um padrão da web. Um
erro 404, um bloqueio da CDN ou um tempo limite impede a conclusão daquela busca; é uma
falha real de acesso, mas não prova que, sem ela, uma citação seria garantida.
Não confunda os sinais. “O GPTBot me rastreou, então o ChatGPT vai me citar” é um mito — são sinais fundamentalmente diferentes.
Por que a lacuna é tão grande — o problema da influência invisível
Os estados divergem muito mais do que a maioria das pessoas espera:
- 99,6% da influência da IA é invisível. A análise da OtterlyAI sobre dados de fundamentação do Bing Webmaster Tools mostrou que a imensa maioria das recuperações nunca aparece como citação atribuída e visível ao usuário. É o número publicado mais concreto sobre a lacuna entre recuperação e citação.
- O ChatGPT cita apenas cerca de 15% das páginas que recupera (Leapd / Discovered Labs). Entrar no conjunto de recuperação é necessário, mas está longe de ser suficiente.
- Seu próprio site raramente é a fonte. Aproximadamente 82,9% das citações B2B vêm de sites de terceiros (Discovered Labs); a McKinsey estima que o site da própria marca representa apenas 5–10% das fontes que a IA referencia sobre ela. O que a internet diz sobre você importa mais do que suas próprias páginas.
- Mesmo uma citação raramente gera clique. No estudo do Pew sobre navegação nos EUA em março de 2025, usuários clicaram em um resultado comum em 8% das visitas ao Google com resumo de IA (contra 15% sem resumo) e em uma fonte citada em 1%. Na amostra independente de cliques da Semrush, 92–94% das sessões no Modo IA do Google não resultaram em visita a um domínio externo.
Assim, a perda se acumula: recuperado → mencionado → citado → clicado, com redução de volume em cada etapa.
O contraponto — e o motivo para continuar investindo — é a qualidade. Na Ahrefs, dados internos de junho de 2025 mostraram que o tráfego de IA converteu a uma taxa 23 vezes maior do que o tráfego orgânico tradicional: cerca de 0,5% dos visitantes vieram da IA, mas responderam por aproximadamente 12,1% dos cadastros no período medido de 30 dias. Poucos cliques, mas os que chegam são extraordinários.
Como cada plataforma lida com recuperação e citação
O mesmo conteúdo e a mesma consulta produzem resultados de atribuição muito diferentes conforme a plataforma:
- ChatGPT (OpenAI) — dados básicos de treinamento mais uma camada de recuperação
quando a busca está ativada. O ChatGPT Search foi lançado sobre o índice do Bing, mas
a OpenAI também opera seu próprio rastreador (
OAI-SearchBot) para busca e indexação independentes, sem publicar a combinação atual dos dois. Trate “é basicamente o Bing” como simplificação, não como fato documentado. Cita cerca de 15% do que recupera e apresenta taxa de citação de aproximadamente 0,59% nos temas testados — a menor entre as principais plataformas. Pode falar sobre sua marca com base nos dados de treinamento, sem recuperação nem citação — o caso mais puro de “mencionado, mas não recuperado nem citado”. - Perplexity — realiza busca em tempo real em toda consulta com seu próprio
PerplexityBot. Tem média de 21,87 citações por resposta, a maior entre as principais plataformas, e é a que menos tende a mencionar sem citar. É a plataforma mais transparente. - Visões Gerais de IA / Modo IA do Google — o índice orgânico e o Knowledge Graph,
com o Gemini gerando a resposta. Usa expansão de consulta (uma consulta do usuário
→ muitas subconsultas internas), portanto páginas são recuperadas para subconsultas
que nunca aparecem na resposta visível — recuperação obscura por projeto. As citações
são associadas a trechos específicos por anotações
url_citation. - Bing Copilot — índice do Bing mais uma camada GPT; média de 6,89 citações por resposta. Desde fevereiro de 2026, possui a primeira ferramenta oficial para webmasters que expõe dados de fundamentação e citação (veja Documentação oficial).
- Claude (Anthropic) — frequentemente responde a partir de dados de treinamento, sem recuperação e com zero citação; quando recupera, porém, apresenta qualidade elevada e grande propensão a citar conteúdo claro e bem estruturado. Menor frequência de recuperação, maior proporção entre recuperação e citação.
Como detectar cada estado
Recuperado → logs do servidor. Os logs registram toda solicitação de bot, inclusive
de rastreadores de IA que, em sua maioria, buscam HTML bruto sem renderizar JavaScript —
mas isso varia por provedor: respostas do Google baseadas no Gemini reutilizam o
renderizador do Googlebot, portanto não presuma que todo rastreador de IA ignore a
renderização. Nada disso aparece no GA. Observe os agentes de usuário e, sobretudo,
separe -User (inferência em tempo real) dos rastreadores básicos (treinamento).
Ferramentas: Screaming Frog Log File Analyser, Botify, Ahrefs Bot Analytics e Cloudflare.
A limitação: os logs comprovam uma busca, não uma citação. Além disso, ferramentas
analíticas comuns classificam a maioria das referências de IA como tráfego direto — os
logs são o único lugar em que o quadro completo da recuperação fica visível.
Mencionado → monitoramento de marca. O Ahrefs Brand Radar procura sua marca em um
grande corpus de prompts apoiado por busca no ChatGPT, Gemini, Copilot, Perplexity,
Visões Gerais de IA, Modo IA e Grok. O filtro relevante é
Response contains {your brand}. A ressalva: ele usa uma biblioteca estática de prompts
e não enxerga as “consultas obscuras” internas da IA que compõem grande parte da
superfície real de recuperação. Respostas de IA também variam muito entre execuções
(SparkToro: probabilidade inferior a 1 em 100 de obter listas de marcas idênticas em 100
execuções do mesmo prompt). Trate o resultado como tendência direcional, não contagem exata.
Citado → rastreamento de citações. Use os relatórios Cited Pages do Brand Radar
(suas páginas citadas) e Cited Domains (sites de terceiros citados quando falam de você),
o Bing Webmaster Tools AI Performance para dados oficiais do Copilot e o relatório de
IA generativa do GSC para impressões em propriedades participantes. O filtro
“found but not cited” (“encontrado, mas não citado”) —
Response contains {your brand} AND citation does not contain {your domain} — isola
exatamente a lacuna: respostas influenciadas por você, sem link para você.
Duas lacunas inversas que vale conhecer
- Mencionado, mas nunca recuperado nem citado. O modelo menciona sua marca diretamente dos dados de treinamento, sem busca em tempo real nem link. É comum com marcas conhecidas.
- Citado, mas nunca mencionado (“citações fantasma”). A Superlines constatou que o Gemini citou um domínio 182 vezes em 30 dias sem dizer o nome da marca uma única vez — 73% da presença dessa marca na IA eram citações sem nome associado. Você fornece sinais confiáveis à resposta, mas o usuário nunca os associa a você.
Por isso, o monitoramento de menções e o rastreamento de citações precisam funcionar em paralelo — um não implica o outro.
O que fazer com essas lacunas
- Recuperado, mas não citado — primeiro, pare de perder oportunidades na entrada:
evite erros e bloqueios de CDN para bots
-User. Depois, melhore a completude e a estrutura (respostas claras e diretas no alto da página; títulos que espelham as perguntas). Na análise da Discovered Labs de janeiro de 2026, a completude semântica teve correlação aproximada de 0,89 com a probabilidade de citação nas Visões Gerais de IA do Google — valor informado pela própria empresa, não auditado de modo independente. - Mencionado, mas não citado — crie sinais mais explícitos de atribuição na página e use a alavanca maior: faça a internet falar sobre você. O principal preditor da Ahrefs para aparecer nas Visões Gerais de IA são menções de marca na web (correlação de 0,664 — muito acima do Domain Rating, 0,326, ou de backlinks, 0,218), segundo o estudo de 75 000 marcas de Louise Linehan e Xibeijia Guan. Dezesseis páginas da Zapier mencionando a Ahrefs bastaram para colocá-la em 1 431 respostas de IA.
- Citado, mas sem tráfego — essa é, em grande parte, a realidade atual; otimize para que o nome apareça junto da citação (gerando lembrança de marca mesmo sem clique) e para tipos de consulta de maior valor, nos quais o tráfego de IA converte.
A mudança estratégica em uma frase: antes, SEO era “otimize seu site”. Agora é “otimize a forma como a internet fala sobre você”. Otimizar suas páginas afeta a possibilidade de serem recuperadas e citadas; otimizar a conversa sobre você afeta a possibilidade de ser mencionado e de ampliar o alcance por citações de terceiros.
O conjunto de medição de que você realmente precisa
Nenhuma ferramenta cobre tudo. A resposta honesta é um conjunto:
- Logs → camada de recuperação (Screaming Frog, Botify, Ahrefs Bot Analytics).
- Monitoramento de marca → camada de menção (Brand Radar, testes manuais de prompts).
- Rastreamento de citações → camada de citação (relatórios Cited do Brand Radar, Bing WMT AI Performance).
- GSC + GA4 → camada de tráfego (lembrando que o GA4 oculta a maioria das referências de IA como tráfego direto).
Uma última cautela: respostas de IA mudam muito — cerca de 40–60% das fontes citadas variam de um mês para outro, e aproximadamente 70% do conteúdo das Visões Gerais de IA muda para a mesma consulta. Acompanhe tendências ao longo de muitas execuções, não capturas isoladas, e não ajuste demais sua estratégia a um número tão volátil.
Resumo de IA
Uma versão condensada da guia Avançado:
- Três estados distintos, três ferramentas distintas. Recuperado (uma IA buscou sua página) aparece apenas nos logs do servidor. Mencionado (seu nome aparece na resposta sem link) exige monitoramento de marca. Citado (sua URL vinculada) exige rastreamento de citações. Eles não avançam juntos.
- Rastreamento de treinamento ou indexação ≠ inferência em tempo real.
GPTBot,ClaudeBote rastreadores de índice comprovam finalidades de busca distintas, não eventos de citação. Bots-User(ChatGPT-User,Perplexity-User) fazem buscas em tempo real durante uma conversa — o acesso comprova uma busca acionada pelo usuário, não que a página foi usada ou citada. Um erro bloqueia essa busca e deve ser investigado. - A lacuna é enorme. 99,6% da influência da IA é invisível (OtterlyAI/Bing); o ChatGPT cita cerca de 15% do que recupera; aproximadamente 82,9% das citações B2B vêm de sites de terceiros; e até uma citação gera clique em cerca de 1% dos casos (Pew).
- As plataformas divergem muito. Perplexity: cerca de 21,87 citações por resposta; ChatGPT: taxa de citação aproximada de 0,59%; Claude frequentemente responde com zero recuperação; o Google usa expansão de consulta (recuperação obscura); Bing Copilot: cerca de 6,89 citações, agora com relatório oficial.
- Duas lacunas inversas: mencionado sem nunca ter sido recuperado (dados de treinamento) e citações fantasma (citado sem nomear a marca — Superlines: 73% da presença de uma marca na IA).
- Formas de corrigir: desbloqueie bots
-Usere melhore a completude (recuperado→citado); conquiste menções de marca na web, principal preditor de AIO com correlação de 0,664 (mencionado→citado); otimize para que o nome acompanhe a citação (citado→lembrança). - Meça com um conjunto (logs + monitoramento de marca + rastreamento de citações + GSC/GA4) e acompanhe tendências, não capturas isoladas — 40–60% das respostas de IA mudam a cada mês.
Documentação oficial
Como os mecanismos descrevem a recuperação RAG e a seleção de citações, segundo as fontes primárias.
- Recursos de IA na Busca do Google — como as Visões Gerais de IA e o Modo IA usam a Busca principal para recuperar e atribuir fontes.
- Guia de otimização para IA — posição do Google de que as práticas recomendadas comuns de SEO se aplicam, sem otimizações especiais para AIO.
- Fundamentação com a Busca do Google (API Gemini) — processo de fundamentação em cinco etapas e anotações
url_citationque vinculam um trecho a uma URL de fonte; o objetogoogle_search_callregistra tudo que foi recuperado, enquanto as anotações registram apenas o que foi usado.
Bing / Microsoft
- Apresentação do AI Performance no Bing Webmaster Tools (prévia pública, fev. de 2026) — primeira ferramenta oficial de plataforma a expor sinais de recuperação e fundamentação: Citations, Grounding Queries e Average Cited Pages.
- Bing Webmaster Tools — ajuda sobre AI Performance — definições das métricas do relatório.
- Cobertura do Search Engine Land sobre o relatório AI Performance do Bing — contexto sobre o que ele mostra e o que não mostra.
Citações das fontes
Declarações registradas dos mecanismos sobre como funcionam a recuperação e a seleção de citações. Os links profundos levam ao trecho citado quando a página permite.
Google — mecanismo de fundamentação e recuperação
- “The model analyzes the prompt and determines if a Google Search can improve the answer.” (tradução) «O modelo analisa o prompt e decide se uma Busca do Google pode melhorar a resposta.» — primeira etapa do processo documentado em cinco etapas. Fonte
- “If needed, the model automatically generates one or multiple search queries and executes them.” (tradução) «Se necessário, o modelo gera e executa automaticamente uma ou mais consultas.» — essa expansão cria recuperação obscura para subconsultas ausentes da resposta visível. Fonte
- “Each
url_citationannotation links a text segment (defined bystart_indexandend_index) to a source URL.” (tradução) «Cada anotação url_citation vincula um trecho, definido por start_index e end_index, a uma URL de fonte.» — a lista completa de fontes recuperadas não é exposta aos usuários finais. Fonte - “There are no additional requirements to appear in AI Overviews or AI Mode, nor other special optimizations necessary.” (tradução) «Não há requisitos adicionais para aparecer nas Visões Gerais de IA ou no Modo IA, nem outras otimizações especiais necessárias.» — posição oficial do Google. Fonte
Bing / Microsoft — relatório AI Performance
- Citations: “Shows the total number of citations that are displayed as sources in AI-generated answers during the selected time frame.” (tradução) «Mostra o total de citações exibidas como fontes em respostas geradas por IA durante o período selecionado.» — o estado Citado. Fonte
- Grounding Queries: “Shows the key phrases the AI used when retrieving content that was referenced in AI-generated answers.” (tradução) «Mostra as principais expressões que a IA usou ao recuperar conteúdo referenciado em respostas geradas por IA.» — a visão oficial mais próxima do estado Recuperado. Fonte
- Average Cited Pages: “Shows the average number of unique pages from your site that are displayed as sources in AI-generated answers per day.” (tradução) «Mostra a média diária de páginas únicas do seu site exibidas como fontes em respostas geradas por IA.» Fonte
Como verificar cada camada
Uma sequência para confirmar em quais dos três estados você realmente está — cada camada exige sua própria verificação.
Recuperado? (logs do servidor)
- Obtenha os logs do servidor (ou da Cloudflare/CDN) e filtre os agentes de usuário de IA.
- Separe rastreadores de treinamento (
GPTBot,ClaudeBot), rastreadores de busca/indexação (OAI-SearchBot,Claude-SearchBot,PerplexityBot, Googlebot) e buscadores acionados pelo usuário (ChatGPT-User,Claude-User,Perplexity-User). - Confirme que os buscadores acionados pelo usuário recebem a resposta correta, em vez de 404/403/5xx ou desafio de CDN. Trate falhas como oportunidades de recuperação bloqueadas, não como citações perdidas garantidas.
- Verifique se os bots são legítimos (DNS reverso + direto / faixas de IP publicadas) — a string do agente de usuário pode ser falsificada.
Mencionado? (monitoramento de marca)
- Execute
Response contains {your brand}no Brand Radar em todas as plataformas. - Faça verificações manuais: pergunte sobre a marca em cada IA e procure seu nome aparecendo sem link.
- Execute o mesmo prompt várias vezes — as respostas variam entre execuções; uma captura isolada não é um conjunto de dados.
Citado? (rastreamento de citações)
- Verifique páginas citadas (suas URLs) e domínios citados (sites de terceiros citados quando falam de você) no Brand Radar.
- Consulte o relatório de desempenho de IA do Bing Webmaster Tools para contagens oficiais de citações e consultas de fundamentação do Copilot.
- Consulte o relatório de IA generativa do GSC para impressões em propriedades participantes; não deduza cliques ou consultas que ele não expõe.
- Execute o filtro para encontrado, mas não citado: “
Response contains {your brand} AND citation does not contain {your domain}” (tradução) «A resposta contém sua marca E a citação não contém seu domínio» — essa é a lacuna de influência sem crédito.
Verificações cruzadas
- Procure citações fantasma — URLs citadas sem o nome da marca no texto. O monitoramento de menções e citações precisa funcionar em paralelo.
- Confirme que você não bloqueou bots de IA no
robots.txt— o bloqueio elimina sua presença nos três estados de uma vez.
Recuperado vs. mencionado vs. citado — guia rápido
Os três estados lado a lado
| Recuperado | Mencionado | Citado | |
|---|---|---|---|
| O que significa | Uma IA buscou sua página como fonte (recuperação/fundamentação RAG) | Sua marca ou nome aparece no texto da resposta, sem link | Sua URL é uma fonte atribuída e clicável |
| Como detectar | Análise dos logs do servidor | Correspondência de texto no corpus de respostas da IA | Relatórios de citações + inspeção das URLs vinculadas |
| Ferramentas | Screaming Frog Log File Analyser, Botify, Ahrefs Bot Analytics, Cloudflare | Ahrefs Brand Radar (Response contains {brand}), prompts manuais | Brand Radar Cited Pages/Domains, Bing WMT AI Performance, GSC |
| Por que importa | Necessário para uma citação; o acesso de um bot -User é o primeiro sinal real | Reconhecimento da marca dentro da resposta, mesmo sem clique | Sinal mais forte — autoridade + cliques raros |
| A ressalva | Uma busca ≠ uma citação; invisível para o GA | Muitas vezes vem do treinamento, sem recuperação; varia entre execuções | Cerca de 82,9% das citações vêm de terceiros; taxa de clique de cerca de 1% |
Bots nos logs — o significado de cada um
| Bot | Responsável | Tipo | Sinal |
|---|---|---|---|
GPTBot | OpenAI | Rastreamento de treinamento | Consideração para treinamento/indexação — não é sinal de citação |
OAI-SearchBot | OpenAI | Indexação de busca | Indexado para recuperação na busca do ChatGPT |
ChatGPT-User | OpenAI | Inferência em tempo real | Buscado durante uma conversa — sinal mais próximo de uma possível citação |
ClaudeBot | Anthropic | Rastreamento de treinamento | Rastreado para treinamento do Claude |
Claude-User | Anthropic | Inferência em tempo real | Buscado durante uma conversa no Claude |
PerplexityBot | Perplexity | Indexação de busca | Indexado para o corpus da Perplexity |
Perplexity-User | Perplexity | Inferência em tempo real | Buscado durante uma consulta na Perplexity |
Googlebot | Rastreamento/renderização de busca | Alimenta o índice da Busca do Google usado nas Visões Gerais de IA e no Modo IA | |
Google-Extended | Token de controle, não um agente de solicitação | Controla certos usos de treinamento/fundamentação do Gemini; não controla inclusão nem classificação na Busca do Google |
Dados rápidos
- 99,6% da influência da IA é invisível (OtterlyAI / dados de fundamentação do Bing).
- O ChatGPT cita cerca de 15% das páginas recuperadas; taxa geral de citação de aproximadamente 0,59%.
- A Perplexity tem média de 21,87 citações por resposta; o Bing Copilot, 6,89.
- Aproximadamente 82,9% das citações B2B vêm de terceiros; o site da própria marca representa 5–10% das referências (McKinsey).
- 1% das visitas ao Google com resumo de IA incluiu clique em fonte citada (Pew); 92–94% das sessões no Modo IA do Google não levaram a um domínio externo na amostra independente de cliques da Semrush.
- A regra: rastreamento de treinamento/indexação ≠ sinal de citação; uma busca documentada acionada pelo usuário comprova uma solicitação, não uso pelo modelo, menção ou citação.
Erros ao medir os estados do funil
Chamar um acesso de rastreador de citação
Uma busca mostra atividade de recuperação, não que a resposta nomeou ou vinculou a fonte. Use capturas das respostas para menções e citações, em vez de promover evidências dos logs a um estado posterior do funil.
Deduzir recuperação a partir de uma menção
O modelo pode produzir o nome de uma marca a partir de conhecimento paramétrico ou de outras fontes. Marque recuperação apenas quando o log relevante ou outra evidência do produto der suporte a ela.
Tratar todo tráfego de bots como recuperação acionada pelo usuário
Agentes de treinamento, indexação, monitoramento e acionados pelo usuário executam funções diferentes. Segmente identidades documentadas e evite rotular toda solicitação de rastreador de IA como uso durante a resposta.
A Escada de Evidências
| Estado | Evidência mínima | O que não comprova |
|---|---|---|
| Recuperado | Uma solicitação relevante acionada pelo usuário nos logs ou evidência equivalente do produto | Que a marca apareceu na resposta |
| Mencionado | O texto capturado da resposta nomeia a marca ou entidade | Que uma URL recebeu link ou clique |
| Citado | A resposta capturada contém um link para a URL do site | Que o usuário clicou ou converteu |
| Visitado | Um evento analítico ou do servidor registra a sessão de destino | Que a visita recebeu um referenciador completo |
| Convertido | Um evento primário registra o resultado definido | Que o ponto de contato com a IA merece todo o crédito |
Suba a escada apenas quando houver evidência para aquele estado. Registre lacunas como lacunas, em vez de preenchê-las com suposições de atribuição.
Teste seus conhecimentos: recuperado, mencionado e citado
Recursos que valem seu tempo
Meus textos e palestras relacionados
- GEO? AEO? LLMO? O que é toda essa história de IA? (Ahrefs Evolve 2025) — minha palestra que apresenta o modelo recuperado/mencionado/citado, a correlação das menções de marca e a história da URL alucinada. Slides · Versão em webinar.
- Estratégias avançadas de AEO com Patrick Stox (Marketing Speak, ep. 539).
- Guia completo de visibilidade em IA — o contexto mais amplo em que este artigo se insere.
- Como acompanhar Visões Gerais de IA — aplicação prática do rastreamento de citações.
- Auditoria de visibilidade em IA — auditoria das três camadas.
- Metodologia do Brand Radar e 10 formas de usar o Brand Radar — inclusive o caso “encontrado, mas não citado”.
- Conheça os novos rastreadores da web: bots de IA se aproximam dos mecanismos de busca — o cenário de bots por trás da camada de recuperação.
De outros autores
- Screaming Frog — monitore bots de IA no Log File Analyser — tutorial prático sobre
-Uservs. bots de treinamento. - Botify — acompanhamento de bots de IA com análise de logs.
- Peec AI — guia para iniciantes sobre análise de lacunas de fontes — fontes recuperadas vs. citações usadas, como lacuna mensurável.
- Discovered Labs — como cada plataforma cita fontes de maneira diferente.
- OtterlyAI — relatório de citações de IA 2026 — mais de 1 milhão de pontos de dados de fundamentação do Bing; fonte principal para a estatística de 99,6% de influência invisível e a constatação de 73% de problemas de rastreabilidade.
- SparkToro — IAs são muito inconsistentes ao recomendar marcas — pesquisa que sustenta a probabilidade inferior a 1 em 100 de obter listas idênticas em 100 execuções.
- Superlines — estatísticas de busca com IA em 2026 — taxas de citação por plataforma e o fenômeno das citações fantasma.
- BrightEdge — visibilidade de marca no ChatGPT e na IA do Google — comparação das respostas a prompts orientados a ação em quatro setores.
- AiBoost — análise de logs para tráfego de bots de IA — proporções entre rastreamento e indicação: GPTBot, cerca de 1 276 rastreamentos por clique; ClaudeBot, cerca de 23 951.
Estatísticas que vale citar
- 99,6% da influência da IA é invisível. Na análise da OtterlyAI sobre dados de fundamentação do Bing Webmaster Tools, o conteúdo é muito usado nos bastidores, mas raramente aparece como citação visível. É o principal número sobre a lacuna entre recuperação e citação. Fonte
- Apenas 51,5% das frases geradas por IA são totalmente sustentadas por citações (e apenas 74,5% das citações realmente sustentam a frase) — Stanford, Avaliação da verificabilidade em mecanismos de busca generativa, EMNLP 2023. Fonte
- O ChatGPT cita apenas cerca de 15% das páginas que recupera — Leapd / Discovered Labs. Fonte
- Usuários clicaram em uma fonte citada em 1% das visitas ao Google com resumo de IA no estudo do Pew de março de 2025 nos EUA; 92–94% das sessões no Modo IA do Google na amostra independente da Semrush não levaram a um domínio externo. Ainda assim, o tráfego de IA medido pela Ahrefs converteu a uma taxa 23 vezes maior do que o tráfego orgânico tradicional em junho de 2025 — poucos cliques, mas excepcionais.
- A Perplexity tem média de 21,87 citações por resposta (a maior e mais transparente); Bing Copilot, cerca de 6,89; ChatGPT, taxa de aproximadamente 0,59%. Fonte
- Aproximadamente 82,9% das citações B2B vêm de fontes de terceiros (Discovered Labs); o site da própria marca representa apenas 5–10% das fontes que a IA usa sobre ela (McKinsey). O que a internet diz sobre você pesa mais do que suas páginas.
- Menções de marca na web são o principal preditor de presença nas Visões Gerais de IA (correlação de 0,664 — acima do Domain Rating, 0,326, e de backlinks, 0,218), no estudo da Ahrefs com 75 000 marcas, de Louise Linehan e Xibeijia Guan. Fonte
- Citações fantasma: o Gemini citou um domínio 182 vezes em 30 dias sem nomear a marca; 73% da presença daquela marca na IA eram citações sem menções (Superlines). Fonte
- Respostas de IA mudam: cerca de 40–60% das fontes citadas variam de um mês para outro, aproximadamente 70% do conteúdo das Visões Gerais de IA muda para a mesma consulta e há menos de 1 chance em 100 de duas execuções do mesmo prompt retornarem listas de marcas idênticas (SparkToro). Acompanhe tendências, não capturas isoladas. Fonte
Registro de alterações
Atualizado em 22 de ago. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.
Atualizado em 28 de jul. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.
Atualizado em 22 de jul. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.
Atualizado em 20 de jul. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.
Atualizado em 19 de jul. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.