URL marcada como 'noindex' (status do GSC)
O que significa o status "URL marcada como 'noindex'" no Google Search Console — e a variante "URL enviada marcada como 'noindex'" e o nome legado "Excluída pela tag 'noindex'". Quando é intencional vs. um erro, onde o noindex reside (meta tag vs. cabeçalho X-Robots-Tag), o conflito com robots.txt, noindex fantasma/CDN, e como corrigir e validar.
Idiomas
1 sinal de evidência nesta página
- Ferramenta relacionada ativaGoogle Index Checker
"URL marcada como 'noindex'" é o status de Indexação de Página do Google Search Console para uma página que o Google rastreou e encontrou uma diretiva noindex (uma meta tag robots ou um cabeçalho X-Robots-Tag), então a manteve fora do índice. Mesma condição, vários nomes: o atual "URL marcada como 'noindex'", a redação mais específica para sitemap "URL enviada marcada como 'noindex'" que relatórios e ferramentas usam comumente, e o legado "Excluída pela tag 'noindex'". Geralmente é intencional e tudo bem — valide a lista de URLs antes de "corrigir" qualquer coisa. O verdadeiro sinal de alerta é uma página com noindex ainda presente no seu sitemap — o envio de sitemap é uma dica para o Google, não uma garantia, e as duas diretivas se contradizem. Como o noindex depende do rastreamento, não o combine com uma desautorização no robots.txt — o Google não pode ver um noindex que não pode rastrear. Verifique dois lugares (a meta tag e o cabeçalho X-Robots-Tag), depure noindex fantasma/CDN com uma busca ao vivo do Googlebot, depois remova a diretiva, valide a correção e espere que o reprocessamento leve mais de um ou dois dias.
Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing reportTL;DR — “URL marcada como ‘noindex’” no Google Search Console significa que o Google olhou para a sua página, viu uma instrução
noindexnela e a manteve fora da pesquisa de propósito. Na maioria das vezes, isso é intencional — muitas páginas devem ser noindexadas. A situação que realmente deve preocupar é uma página que você colocou no seu sitemap (pedindo ao Google para indexá-la) que também diz para não indexar — alguns relatórios chamam isso de “Submitted URL marked ‘noindex’” (tradução) «URL enviada marcada como ‘noindex’». Veja a lista de páginas afetadas: se todas forem aquelas que você queria ocultar, está pronto.
O que este status está lhe dizendo
Este rótulo significa que o Google encontrou uma diretiva noindex ao processar a página. Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report O Google suporta noindex em um elemento meta robots ou no cabeçalho de resposta X-Robots-Tag. Evidence for this claim Google supports noindex through a robots meta tag or X-Robots-Tag header and must crawl the page to observe it. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Block indexing with noindex
Quando você abre o relatório Page Indexing no Search Console e vê uma linha chamada
“URL marcada como ‘noindex’”, aqui está o que aconteceu: o Google visitou (rastreou) a
página, encontrou uma instrução noindex nela e decidiu não colocá-la nos resultados de
pesquisa. É isso. A página não está quebrada — o Google fez exatamente o que a página
mandou.
Um noindex é uma pequena instrução que diz “não mostre esta página na pesquisa.” Ela
fica em um de dois lugares:
- Uma linha no código da página (uma tag meta robots), ou
- Uma configuração na resposta do servidor da página (um cabeçalho X-Robots-Tag) — esta você não consegue ver apenas olhando para a página.
Isso é ruim? Geralmente não
A palavra que assusta as pessoas é “Não indexada” (a seção onde este status fica). Parece um erro. Geralmente não é. Muitas páginas devem ser mantidas fora da pesquisa:
- Páginas de agradecimento / confirmação de pedido
- Resultados de pesquisa interna
- Páginas de login, conta e administração
- Versões filtradas ou ordenadas de uma listagem
Se as páginas nesta lista são aquelas que você queria ocultar, deixe-as em paz. Não há nada para corrigir.
Quando você precisa agir
Duas situações:
- Uma página que você quer no Google está nesta lista. Algo colocou um
noindexem uma página que deveria ranquear. Isso é um erro para rastrear. - Você vê “Submitted URL marked ‘noindex’” (tradução) «URL enviada marcada como ‘noindex’» (uma redação um pouco diferente e mais
direta que alguns relatórios e ferramentas usam). De qualquer forma, a substância é a mesma:
você enviou a página no seu sitemap — que serve para listar páginas que você
quer na Pesquisa — mas a página também diz “não indexe.” Essas duas coisas
se contradizem. Ou remova o
noindex(se você quer que ela seja indexada) ou tire a URL do seu sitemap (se não quer).
A confusão de nomes
Você também pode se lembrar disso como “Excluded by ‘noindex’ tag” (tradução) «Excluída pela tag ‘noindex’». Esse é apenas o nome mais antigo para a mesma coisa do relatório anterior do Google. Então, três rótulos — “URL marked ‘noindex’,” (tradução) «URL marcada como ‘noindex’», “Submitted URL marked ‘noindex’,” (tradução) «URL enviada marcada como ‘noindex’», e “Excluded by ‘noindex’ tag” (tradução) «Excluída pela tag ‘noindex’» — todos descrevem uma situação: o Google encontrou um noindex.
Uma armadilha para conhecer
Um instinto comum é também bloquear a página no robots.txt para “realmente” mantê-la
fora. Não faça isso. Bloquear o rastreamento impede o Google de ler a página completamente — o que
significa que ele também não consegue ver o seu noindex. Contra intuitivamente, a página pode permanecer
na pesquisa. Para remover uma página, deixe o Google rastreá-la e mantenha o noindex nela.
Quer a versão diagnóstica completa — detecção de meta tag vs. cabeçalho, noindex fantasma/CDN e o fluxo de correção e validação — mude para a aba Avançado.
TL;DR — “URL marcada como ‘noindex’” é o status de Indexação de Página do GSC para uma página que o Google rastreou e encontrou um
noindex— tag meta robots ou cabeçalho X-Robots-Tag, e o Google também honra uma tag meta robots colocada no corpo da página, não apenas no<head>. Vários nomes, um estado: o atual “URL marcada como ‘noindex’”, a redação mais precisa de submissão de sitemap “URL enviada marcada como ‘noindex’” que relatórios e ferramentas comumente usam, e o legado “Excluída por tag ‘noindex’.” É distinto de bloqueio por robots.txt (nunca rastreada) e de “Rastreada — atualmente não indexada” (sem diretiva). Geralmente intencional — valide a lista de URLs primeiro. Uma URL com noindex ainda presente no seu sitemap é o verdadeiro sinal (a submissão de sitemap é uma dica, não uma garantia).noindexé dependente de rastreamento: combine-o com uma desautorização de robots.txt e o Google não consegue vê-lo, então a página pode permanecer indexada. Quando as regras conflitam, o Google aplica a mais restritiva. Verifique duas fontes (o HTML renderizado e o cabeçalho HTTP), depure noindex fantasma/CDN com uma busca ao vivo do Googlebot (Inspeção de URL / Teste de Resultados Avançados), depois remova a diretiva, Valide a correção e espere que o reprocessamento leve mais de um dia ou dois — o Google diz que pode levar meses para páginas de prioridade mais baixa.
O que o status realmente significa
O relatório descreve a diretiva observada pelo Google, não o motivo pelo qual um CMS, modelo ou CDN adicionou-a. Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report O Google deve ser capaz de rastrear a página para observar e aplicar o noindex. Evidence for this claim Google supports noindex through a robots meta tag or X-Robots-Tag header and must crawl the page to observe it. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Block indexing with noindex
A definição do próprio Google é precisa: quando o Google tentou indexar a página, ele
encontrou uma diretiva noindex e, portanto, não a indexou. A palavra-chave é
encontrou — o Google teve que rastrear a página para ver a diretiva. Portanto, este
status carrega dois fatos ao mesmo tempo: o Google alcançou a página, e a página disse a ele
para não ser indexada.
Essa é toda a espinha dorsal de precisão aqui, e é o que separa este status de seus vizinhos:
- Bloqueada por robots.txt → o Google nunca foi autorizado a rastrear, então não leu nenhum conteúdo ou diretiva.
- “Rastreada — atualmente não indexada” → o Google rastreou, encontrou nenhuma diretiva, e escolheu não indexar mesmo assim.
- “URL marcada como ‘noindex’” → o Google rastreou, encontrou um
noindexe o obedeceu.
Os três nomes são uma condição
Isso confunde as pessoas porque o rótulo mudou ao longo do tempo e varia conforme como a URL foi encontrada:
- “URL marcada como ‘noindex’” — o rótulo atual e geral no relatório de Indexação de Página. Fica sob “Não indexada” (anteriormente “Excluída”). Esta é a redação que a documentação atual do relatório de Indexação de Página do próprio Google usa e define.
- “Submitted URL marked ‘noindex’” (tradução) «URL enviada marcada como ‘noindex’» — a mesma condição subjacente, mas para uma URL que também está em um sitemap que você enviou. Esta é a redação mais precisa que profissionais e ferramentas de SEO de terceiros comumente relatam para essa combinação. A documentação de ajuda atual do Google não a detalha como um status definido separadamente distinto de “URL marked ‘noindex’” (tradução) «URL marcada como ‘noindex’», então trate o rótulo exato como dependente do relatório — mas a substância permanece independentemente do que uma determinada ferramenta chama: um sitemap deve listar as URLs que você quer na Pesquisa (e enviar um é uma dica para o Google, não uma garantia de indexação), então uma URL com noindex nele é uma contradição que vale a pena resolver.
- “Excluded by ‘noindex’ tag” (tradução) «Excluída pela tag ‘noindex’» — o nome legado do relatório “Cobertura de Índice” anterior a 2021. Ainda é a versão coloquial mais pesquisada. A mesma coisa subjacente.
Se você chegou aqui por qualquer um desses três, você está no mesmo lugar.
É um problema? A decisão intencional vs. acidental
Não “corrija” isso reflexivamente. A árvore de decisão:
- Puxe a lista de URLs afetadas (clique no status).
- Estas são páginas que você pretendia excluir? Páginas de agradecimento, busca interna, URLs de facetas/filtros, conta/admin, staging que não deveria estar no ar. → Nenhuma ação. “Não indexado” não é o mesmo que “quebrado”, e o Google diz exatamente isso: estas URLs não foram indexadas, mas não necessariamente por causa de um erro.
- Há uma página que você quer indexada nesta lista? → Um noindex vazou para ela. Encontre e remova.
- A URL com noindex também está no seu sitemap enviado (muitas vezes
exibida como “URL enviada marcada como ‘noindex’”)? → Resolva a contradição
diretamente: remova o
noindex(para indexá-la) ou remova a URL do seu sitemap (para deixá-la com noindex). Não deixe uma URL com noindex em um sitemap — o envio do sitemap é uma dica para o Google sobre o que você quer indexar, não uma solicitação que substitui a diretiva da própria página.
A razão pela qual os concorrentes tratam isso como um puro “erro para corrigir” é que eles pulam a etapa 2. Na maioria das vezes, este status é o sistema funcionando corretamente.
Onde o noindex vive: meta tag vs. cabeçalho X-Robots-Tag
Existem exatamente dois métodos de entrega, e você precisa verificar ambos porque eles parecem completamente diferentes:
- Meta tag robots —
<meta name="robots" content="noindex">no<head>da página. Direciona todos os rastreadores;<meta name="googlebot" content="noindex">direciona apenas o Google. Esta é a que você pode ver no HTML. - Cabeçalho HTTP X-Robots-Tag —
X-Robots-Tag: noindexnos cabeçalhos de resposta do servidor. Esta é a sorrateira. Ela é definida na configuração do servidor, CMS ou CDN, não no código-fonte da página, então “Ver código-fonte” não a mostrará. O método de cabeçalho também é a única maneira de aplicar noindex em arquivos não-HTML — um cabeçalho de resposta pode ser usado para recursos não-HTML, como PDFs, arquivos de vídeo e arquivos de imagem, que não têm<head>para conter uma meta tag.
Quando o GSC diz noindex e você jura que a página não tem um, o cabeçalho é o primeiro lugar para olhar (a aba de folha de dicas coloca os dois lado a lado).
Como encontrar a diretiva em uma página
- Ver código-fonte / DOM renderizado — procure por
noindex. Verifique o<head>renderizado, não apenas o código-fonte bruto, já que uma tag pode ser injetada por JavaScript ou um gerenciador de tags. Também não pare no<head>: o Google disse que não impõe a posição do meta-robots e respeita uma meta tag robots encontrada no<body>da página também, então uma diretiva injetada mais abaixo no documento ainda conta. - Cabeçalhos de resposta —
curl -I https://example.com/page/(ou DevTools do navegador → Rede → a solicitação do documento → Cabeçalhos de resposta) e procure por uma linhaX-Robots-Tag. - Inspeção de URL (GSC) → Testar URL ao vivo — isso busca a página como o Googlebot e relata o veredito de indexação e a resposta. Esta é a que captura diretivas servidas apenas para o Google.
- Teste de resultados avançados — outra busca real do Googlebot que retorna a resposta HTTP e um instantâneo renderizado de exatamente o que o servidor mostra ao Google.
- Verifique se há regras de robots conflitantes, não apenas uma única tag. Se mais de
uma diretiva de robots se aplica à página (digamos, um modelo define
index, mas um plugin ou cabeçalho adicionanoindex), o Google aplica a regra mais restritiva — então umnoindexperdido em qualquer lugar vence, mesmo que outra regra digaindex. Não pare de procurar depois de encontrar uma diretiva que pareça permissiva.
O conflito do robots.txt (por que disallow + noindex sai pela culatra)
Este é o ponto mais confuso em todos os outros guias, então quero ser exato.
noindex é dependente de rastreamento: o Google precisa conseguir buscar a página para ler
a diretiva. O Google afirma a regra claramente — para que a regra noindex seja
eficaz, a página não deve ser bloqueada por um arquivo robots.txt e precisa estar
acessível ao rastreador; se estiver bloqueada ou o rastreador não conseguir acessá-la,
o rastreador nunca verá o noindex, e a página ainda pode aparecer na
pesquisa (por exemplo, se outras páginas linkarem para ela).
Escrevo sobre o lado oposto disso há anos. No meu artigo da Ahrefs sobre «Indexada, embora bloqueada por robots.txt», o ponto central é: “crawling and indexing are two different things” (tradução) «rastreamento e indexação são coisas diferentes» — “if you block a page from being crawled, Google may still index it.” (tradução) «se você impedir o rastreamento de uma página, o Google ainda poderá indexá-la». E, especificamente sobre esse conflito: “Unless Google can crawl a page, they won’t see the noindex meta tag and may still index it because it has links.” (tradução) «A menos que o Google possa rastrear uma página, ele não verá a metatag noindex e ainda poderá indexá-la porque ela tem links». Então a combinação autossabotadora é noindex + bloqueio no robots.txt: o disallow esconde o noindex, e a página pode permanecer indexada por meio de links externos.
A sequência correta para realmente remover uma página:
- Permita o rastreamento e mantenha o
noindexno lugar. - Aguarde o Google recrawlar, ver a diretiva e remover a página.
- Somente então, se você quiser economizar orçamento de rastreamento, você pode bloqueá-lo no robots.txt — após a desindexação, não antes.
Minha recomendação permanente, de aquele mesmo artigo: “Just add a noindex meta robots tag and make sure to allow crawling — assuming it’s canonical.” (tradução) «Basta adicionar uma metatag robots noindex e garantir que o rastreamento seja permitido, desde que essa seja a versão preferencial.»
noindex fantasma: cache de CDN e diretivas específicas para Googlebot
A versão mais difícil disso é o noindex “fantasma”: você olha a página, não vê noindex em lugar nenhum, e o GSC ainda relata um. John Mueller já abordou exatamente isso — nos casos que ele viu, havia um noindex real, às vezes mostrado apenas para o Google, o que pode ser muito difícil de depurar. (Ele observou esse cenário quando isso surgiu; estou parafraseando o ponto dele em vez de citá-lo como uma declaração formal.)
Os suspeitos usuais — trate-os como hipóteses a verificar, não como causas confirmadas, até que a resposta ao vivo realmente mostre um deles:
- Um CDN ou cache servindo um cabeçalho
X-Robots-Tag: noindexobsoleto que não está mais na sua configuração de origem. - Uma diretiva condicional ao user-agent — o servidor retorna uma página limpa para o seu navegador e uma com noindex para o Googlebot.
- Um vazamento de staging/template — um noindex destinado a um ambiente de staging indo para produção por meio de um template compartilhado.
O diagnóstico é o mesmo nos três: não confie em “View Source” no seu próprio navegador. Faça uma busca real do Googlebot — Test live URL do URL Inspection ou o Rich Results Test — que mostra a resposta HTTP e a página renderizada exatamente como o Google a recebe. É assim que você pega um servidor/CDN servindo uma coisa para você e outra para o rastreador.
Como corrigir e validar
Depois de confirmar que o noindex é um erro:
- Remova a diretiva na sua fonte real — a meta tag no template, ou o
cabeçalho
X-Robots-Tagna configuração do servidor/CMS/CDN. Limpe qualquer cache de CDN/página para que a correção seja realmente servida. - Confirme com uma busca ao vivo do Googlebot (Inspeção de URL → Testar URL ao vivo) que a página agora retorna sem noindex e mostra “URL disponível para o Google.”
- Solicite a indexação para URLs de alta prioridade e/ou use o botão Validar correção do relatório para pedir ao Google que reverifique todo o conjunto afetado.
- Aguarde. A desindexação e a reindexação não são instantâneas — o Google precisa rastrear novamente para ver a mudança primeiro, e a própria orientação do Google é que o tempo de revisita depende da importância da página e pode levar consideravelmente mais de um dia ou dois (sua documentação dá “meses” como possibilidade para páginas de menor prioridade). Solicitar a indexação em uma URL prioritária é como você pede ao Google para tentar mais cedo, não uma forma de forçar um cronograma específico. Não entre em pânico se o status persistir durante o reprocessamento.
Para o inverso — uma página que você quer com noindex, mas que está presa no índice
porque também estava bloqueada por robots.txt — desbloqueie o rastreamento primeiro para que o Google possa
finalmente ver o noindex.
Onde isso se encaixa
Este status é um nó no relatório Page Indexing do Google. A diretiva de robots
por trás dele — noindex — pode ser entregue como uma meta tag robots ou um
cabeçalho X-Robots-Tag, e a ferramenta certa depende de você estar trabalhando com
arquivos HTML ou não HTML. Os status vizinhos (“Indexado, embora bloqueado por
robots.txt” e “Rastreado — atualmente não indexado”) descrevem estados diferentes e
precisam de correções diferentes; mantê-los claros é a maior parte da batalha.
Resumo de IA
Uma visão condensada da versão Avançada:
- O que significa: “URL marcada como ‘noindex’” é o status de Indexação de Páginas do GSC para uma página que o Google rastreou e encontrou um
noindex— então ele a manteve fora do índice de propósito. O Google teve que rastrear a página para ver a diretiva, e ele honra essa diretiva esteja ela no<head>ou no corpo da página. - Vários nomes, um estado: o atual “URL marcada como ‘noindex’”, o mais específico “URL enviada marcada como ‘noindex’” que relatórios e ferramentas comumente usam, e o legado “Excluída pela tag ‘noindex’”.
- Distinto dos vizinhos: bloqueado por robots.txt = nunca rastreado; “Rastreada — atualmente não indexada” = rastreada, sem diretiva; este status = rastreada, encontrou um noindex, obedeceu.
- Esse estado costuma ser intencional. Valide a lista de URLs primeiro. Páginas de agradecimento, busca interna, facetas e área administrativa não exigem ação. Só aja se uma página que você quer indexada estiver na lista — ou se a URL estiver com noindex mas ainda estiver no seu sitemap (uma contradição, já que o envio ao sitemap é uma dica do que você quer indexado, não uma garantia): remova o noindex ou remova-a do sitemap.
- Dois métodos de entrega: uma meta tag robots em qualquer lugar do HTML renderizado (não apenas no
<head>), ou um cabeçalho HTTP X-Robots-Tag (a única forma para arquivos não-HTML como PDFs, e o sorrateiro — não está no código-fonte da página). Verifique ambos, e lembre-se de que quando várias regras de robots conflitam, o Google aplica a mais restritiva. - O conflito com robots.txt:
noindexé dependente de rastreamento. Combinar noindex com um bloqueio no robots.txt sai pela culatra — o Google não consegue ver uma diretiva em uma página que não pode rastrear, então ela pode permanecer indexada por meio de links. Para remover uma página: permita o rastreamento, mantenha o noindex e, opcionalmente, aplique o bloqueio depois da desindexação. - Noindex fantasma: o proprietário não vê a diretiva, mas o Google vê — geralmente por causa de um cache da CDN servindo um cabeçalho obsoleto, uma regra exclusiva para o Googlebot ou um vazamento do ambiente de homologação ou do template (trate essas possibilidades como hipóteses a confirmar, não como causas presumidas). Depure com uma busca real do Googlebot, usando o teste ao vivo da Inspeção de URL ou o Teste de pesquisa aprimorada, não apenas o código-fonte.
- Correção → validação: remova a diretiva na origem, limpe os caches, confirme com uma busca ao vivo do Googlebot, solicite a indexação ou valide a correção e espere — a própria orientação do Google diz que o reprocessamento depende da importância da página e pode levar muito mais que um ou dois dias, chegando a meses para páginas de menor prioridade.
Documentação oficial
Documentação de fonte primária dos mecanismos de busca.
- Relatório de indexação de páginas — o relatório em que este status aparece; define “URL marked ‘noindex’” (tradução) «URL marcada como ‘noindex’» e o status relacionado “Indexed, though blocked by robots.txt” (tradução) «Indexada, embora bloqueada por robots.txt» (o texto atual não detalha separadamente “Submitted URL marked ‘noindex’” (tradução) «URL enviada marcada como ‘noindex’» como um nome distinto, embora a contradição subjacente do sitemap seja real).
- Bloquear a indexação no mecanismo de pesquisa com noindex — o que
noindexfaz, os métodos de meta tag vs. cabeçalho X-Robots-Tag, a regra dependente de rastreamento (uma página bloqueada nunca vê o noindex) e a própria nota do Google de que revisitar uma página após uma alteração pode levar meses, dependendo da importância dela. - Especificações da meta tag robots, data-nosnippet e X-Robots-Tag — como regras de robots conflitantes são resolvidas (a regra mais restritiva vence) e a confirmação de que o Google também respeita uma meta tag robots colocada no corpo da página, não apenas no
<head>. - Introdução ao robots.txt — por que o robots.txt controla o rastreamento, não a indexação, e por que não é uma ferramenta de desindexação.
- Ferramenta de inspeção de URL — “Testar URL ao vivo” busca a página como o Googlebot, a maneira de detectar diretivas servidas apenas ao Google.
- Criar e enviar um sitemap — os sitemaps devem listar as URLs que você quer no Search, e enviar um é uma dica para o Google, não uma garantia de rastreamento ou indexação.
Bing / Microsoft
- Bing Webmaster Tools — Ajuda e instruções — o Bing honra a tag
<meta name="robots" content="noindex">e o cabeçalhoX-Robots-Tagda mesma forma; seus relatórios de índice exibem páginas com noindex de maneira semelhante. (Prioridade menor para este status específico do Google.)
Citações da fonte
Declarações oficiais do Google, além de meus próprios escritos sobre o conflito do robots.txt. Cada link é um link profundo que salta para a passagem citada na página de origem.
Google — o que o status significa
- “When Google tried to index the page it encountered a ‘noindex’ directive and therefore did not index it.” (tradução) «Quando o Google tentou indexar a página, encontrou uma diretiva ‘noindex’ e, portanto, não a indexou.» — Ajuda do Google Search Console (Relatório de indexação de páginas). Ir para a citação
Google — noindex depende do rastreamento
- “For the noindex rule to be effective, the page or resource must not be blocked by a robots.txt file, and it has to be otherwise accessible to the crawler. If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see the noindex rule, and the page can still appear in search results, for example if other pages link to it.” (tradução) «Para que a regra noindex seja eficaz, a página ou o recurso não deve ser bloqueado por um arquivo robots.txt e deve estar acessível ao rastreador de outra forma. Se a página for bloqueada por um arquivo robots.txt ou o rastreador não puder acessá-la, o rastreador nunca verá a regra noindex, e a página ainda pode aparecer nos resultados de pesquisa, por exemplo, se outras páginas tiverem links para ela.» — Documentação do Google Search Central (Bloquear a indexação no mecanismo de pesquisa com noindex). Ir para a citação
- “Depending on the importance of the page on the internet, it may take months for Googlebot to revisit a page.” (tradução) «Dependendo da importância da página na internet, pode levar meses para o Googlebot revisitar uma página.» — Documentação do Google Search Central (Bloquear a indexação no mecanismo de pesquisa com noindex), sobre quanto tempo o reprocessamento após uma alteração de noindex pode levar. Ler o artigo
Google — regras conflitantes e onde uma diretiva pode estar
- “Google Search doesn’t enforce placement of meta robots in the HTML head and will respect robots meta tags in the body section of an HTML document as well.” (tradução) «O Google Search não exige a colocação de meta robots no head do HTML e também respeitará as meta tags robots na seção body de um documento HTML.» — Documentação do Google Search Central (Robots meta tag, data-nosnippet e especificações de X-Robots-Tag). Leia o artigo
- “In the case of conflicting robots rules, the more restrictive rule applies.” (tradução) «No caso de regras de robots conflitantes, a regra mais restritiva se aplica.» — Documentação do Google Search Central (mesma especificação). Leia o artigo
Patrick Stox (Ahrefs) — o conflito de robots.txt
- “If you block a page from being crawled, Google may still index it because crawling and indexing are two different things.” (tradução) «Se você bloquear uma página de ser rastreada, o Google ainda pode indexá-la porque rastreamento e indexação são duas coisas diferentes.» — eu, «“Indexada, embora bloqueada por robots.txt” pode ser mais do que um bloqueio no robots.txt» (Ahrefs). Ver a citação
- “Unless Google can crawl a page, they won’t see the noindex meta tag and may still index it because it has links.” (tradução) «A menos que o Google possa rastrear uma página, ele não verá a meta tag noindex e ainda pode indexá-la porque ela tem links.» — eu (mesmo artigo). Leia o artigo
- ““Just add a noindex meta robots tag and make sure to allow crawling—assuming it’s canonical.”” (tradução) «Basta adicionar uma metatag robots noindex e garantir que o rastreamento seja permitido — desde que essa seja a versão preferencial.» — eu (mesmo artigo). Leia o artigo
Lista de verificação de triagem para “URL marcada como ‘noindex’”
Trabalhe de cima para baixo — a maioria termina na etapa 2 com “nenhuma ação necessária.”
- Abra a lista de URLs afetadas no relatório de Indexação de Páginas (clique na linha de status).
- Decida entre intencional vs. acidental: estas são páginas que você pretendia excluir (agradecimento, busca interna, facets, admin, staging)? Se sim → concluído.
- A URL também está no seu sitemap enviado (frequentemente exibida como
“URL enviada marcada como ‘noindex’”)? Resolva a contradição: remova o
noindex(para indexar) ou remova a URL do sitemap (para mantê-la fora). - Para páginas que devem ser indexadas, encontre a diretiva em ambos os lugares:
-
<head>renderizado para<meta name="robots" ... noindex>(verifique o DOM renderizado, não apenas o View Source). - Cabeçalhos de resposta para
X-Robots-Tag: noindex(curl -Iou DevTools → Network).
-
- Confirme o que o Googlebot vê com URL Inspection → Test live URL (ou o Rich Results Test) — detecta diretivas somente Googlebot / servidas por CDN.
- Verifique o conflito de robots.txt: a URL não está também desautorizada (uma desautorização esconde o noindex e pode deixar a página indexada).
- Remova a diretiva na sua fonte real (template / servidor / CMS / CDN), depois limpe qualquer cache de CDN ou de página.
- Re-teste ao vivo que a página agora não retorna noindex.
- Solicite a Indexação e/ou clique em Validate Fix; depois espere — o tempo de recrawl não é fixo. O Google diz que depende da importância da página e pode levar muito mais do que um ou dois dias, até meses para páginas de menor prioridade.
Folhas de referência
Os três nomes — mesma condição
| Rótulo que você viu | Quando aparece | Gravidade |
|---|---|---|
| URL marcada como ‘noindex’ | O Google rastreou a página e encontrou um noindex | Info (em “Não indexadas”) — geralmente intencional |
| URL enviada marcada como ‘noindex’ | O mesmo, mas a URL estava em um sitemap enviado | Frequentemente exibida como uma linha de nível de erro — independentemente do rótulo, uma contradição a resolver |
| Excluída pela tag ‘noindex’ | Nome legado (relatório de Cobertura do Índice pré-2021) | O mesmo que “URL marcada como ‘noindex’” |
Onde o noindex vive: meta tag vs. cabeçalho X-Robots-Tag
| Meta tag robots | Cabeçalho X-Robots-Tag | |
|---|---|---|
| Forma | <meta name="robots" content="noindex"> | X-Robots-Tag: noindex |
| Onde fica | No <head> da página (HTML) | Nos cabeçalhos de resposta HTTP |
| Visível em Ver código-fonte? | Sim (se não for injetado por JS) | Não — verifique com curl -I / DevTools |
| Definido por | Template / CMS / editor de página | Configuração do servidor / CMS / CDN |
| Funciona para não-HTML (PDF, imagem, vídeo)? | Não (sem <head>) | Sim |
| Segmentar um mecanismo? | name="googlebot" etc. | X-Robots-Tag: googlebot: noindex |
Como este status difere de seus vizinhos
| Status | Rastreada? | Diretiva encontrada? | Significado |
|---|---|---|---|
| URL marcada como ‘noindex’ | Sim | noindex | O Google obedeceu ao seu noindex |
| Indexada, embora bloqueada por robots.txt | Não | n/d (não é possível ler) | Bloqueada de rastreamento, mas indexada por meio de links |
| Rastreada — atualmente não indexada | Sim | Nenhuma | Sem diretiva; o Google simplesmente optou por não indexar |
Árvore de decisão intencional vs. acidental
| Pergunta | Se sim | Se não |
|---|---|---|
| Estas são páginas que você pretendia excluir? | Nenhuma ação | desça ↓ |
| É a variante de erro “Enviada”? | Remova o noindex ou remova do sitemap | desça ↓ |
| Você quer que esta página seja indexada? | Encontre e remova o noindex, depois Valide a correção | Deixe como está (e remova do sitemap, se presente) |
Os modelos mentais
1. Rastreada e viu. Este status só existe porque o Google rastreou a página e leu uma diretiva. Esse único fato o distingue de bloqueado por robots.txt (nunca rastreada) e de “Rastreada — atualmente não indexada” (rastreada, sem diretiva). Localize em qual dos três você está antes de tocar em qualquer coisa.
2. “Não indexada” ≠ quebrada. A suposição padrão deve ser intencional, não erro. Valide a lista de URLs primeiro; na maioria das vezes, a ação certa é não fazer nada. A única combinação que vale a pena tratar como urgente é uma URL com noindex que também está no seu sitemap enviado — porque um sitemap serve para listar o que você quer indexar (o envio é apenas uma dica para o Google, não uma garantia), e uma URL de sitemap com noindex contradiz isso.
3. Duas fontes, verifique sempre ambas.
Um noindex é ou uma meta tag (no <head> renderizado) ou um cabeçalho X-Robots-Tag
(na resposta HTTP). O cabeçalho é invisível em Ver código-fonte, então “eu
não tenho um noindex” geralmente significa “eu não verifiquei o cabeçalho.” Verifique ambos, todas as
vezes.
4. Dependente de rastreamento — nunca combine noindex com um disallow. O Google precisa rastrear uma página para ver seu noindex. Bloquear o rastreamento em robots.txt torna o noindex invisível, deixando a página indexável por meio de links. Para remover uma página: permita o rastreamento + mantenha o noindex, aguarde a desindexação, então opcionalmente aplique o disallow.
5. Confie na visão do Googlebot, não na do seu navegador. Para noindex fantasma (você não vê nenhum, o GSC vê um), o Ver código-fonte do seu navegador é o instrumento errado. Um CDN, cache ou regra de user-agent pode mostrar ao Googlebot algo diferente. Diagnostique com uma busca real do Googlebot — o teste ao vivo da Inspeção de URL ou o Teste de resultados avançados — que mostra a resposta exata que o Google recebe.
Playbook: você acabou de ver um status “marcada como ‘noindex’”
Leia isto de cima a baixo na primeira vez que encontrar um desses status. Ramifique em cada “se você vir” — a maioria das execuções termina cedo.
1. Abra o relatório Page Indexing e clique na linha do status. Observe qual dos três rótulos é: “URL marcada como ‘noindex’”, “URL enviada marcada como ‘noindex’” ou o legado “Excluída pela tag ‘noindex’”. Obtenha a lista completa das URLs afetadas — não julgue apenas pela contagem.
2. Examine a lista de URLs para ver o padrão. Se você vir principalmente páginas de agradecimento, busca interna, URLs de filtro/facetas ou páginas de admin/conta — essas são páginas que você normalmente não quer no índice. → Pare aqui. Nenhuma ação necessária; isso é o sistema funcionando como esperado.
3. Se você vir uma URL que realmente quer que seja ranqueada, isole-a.
Alguém ou algo colocou um noindex em uma página que deveria ser indexável. Vá para a
etapa 4 para descobrir de onde isso está vindo.
4. Se o rótulo for “URL enviada marcada como ‘noindex’” — ou se você apenas notar que a
URL está tanto com noindex quanto no seu sitemap — trate como urgente.
O envio do sitemap serve para sinalizar as URLs que você quer no Search (o Google
trata isso como uma dica, não uma garantia), então um noindex na mesma URL é uma
contradição direta, e muitos relatórios e ferramentas exibem isso como uma linha de erro
exatamente por esse motivo. Decida qual lado está correto — você quer que ela seja
indexada (remova o noindex) ou não (retire-a do sitemap) — e
resolva a contradição no mesmo dia em que a encontrar.
5. Localize a diretiva.
Verifique o <head> renderizado para uma tag <meta name="robots" content="noindex">,
depois verifique os cabeçalhos de resposta (curl -I ou DevTools → Network) para um
X-Robots-Tag: noindex. Se nenhum mostrar nada e o GSC ainda relatar um,
provavelmente você tem um noindex fantasma — vá para a etapa 6.
6. Se o View Source estiver limpo, mas o GSC ainda disser noindex, não confie no seu navegador. Execute uma busca ao vivo do Googlebot (URL Inspection → Test live URL, ou o Rich Results Test). Procure por um CDN/cache servindo um cabeçalho antigo, uma diretiva condicional ao user-agent ou um template de staging vazando para produção.
7. Se a URL também estiver bloqueada no robots.txt, corrija isso primeiro.
Um disallow esconde o noindex do Google completamente, então nada que você fizer com o
noindex terá efeito até que o rastreamento seja permitido novamente. Remova o disallow
(ou aguarde ele ser removido) antes de continuar.
8. Remova a diretiva na sua fonte real — template, configuração do servidor, campo do CMS ou regra de borda do CDN — e limpe qualquer cache que esteja na frente dela.
9. Re-verifique com uma busca ao vivo do Googlebot que a página agora não retorna noindex, depois use Request Indexing para URLs prioritárias e/ou Validate Fix para todo o conjunto afetado.
10. Aguarde e verifique novamente. Recrawl e reindexação não são instantâneos, e não há um prazo fixo — a própria orientação do Google é que o tempo de revisita depende da importância da página e pode levar meses para páginas de menor prioridade, não apenas dias. O Request Indexing pede ao Google para tentar mais cedo; não garante um cronograma. E se você bloqueou a página na etapa 7 apenas para economizar orçamento de rastreamento após a remoção, esse é o único caso em que disallow-após-noindex está correto.
Scripts e trechos de código
Verifique os cabeçalhos de resposta (macOS/Linux, shell) — a única maneira de ver um
X-Robots-Tag, já que ele nunca aparece no View Source:
curl -sI -A "Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)" "https://example.com/page/" | grep -i "x-robots-tag\|^HTTP"Verifique os cabeçalhos de resposta (Windows, PowerShell) — mesma verificação, sem
curl necessário:
$r = Invoke-WebRequest -Uri "https://example.com/page/" -UserAgent "Mozilla/5.0 (compatible; Googlebot/2.1; +http://www.google.com/bot.html)" -UseBasicParsing
$r.Headers["X-Robots-Tag"]
$r.StatusCodeEncontre uma tag meta robots no DOM renderizado (Console do DevTools) — cole no painel Console na página ao vivo; captura tags injetadas por um gerenciador de tags que o View Source bruto não veria:
[...document.querySelectorAll('meta[name="robots"], meta[name="googlebot"]')].map(m => m.outerHTML)Bookmarklet — verifique a tag meta robots da página atual em um clique. Salve como um marcador com este URL e clique nele em qualquer página que estiver auditando:
javascript:(function(){var m=[...document.querySelectorAll('meta[name="robots"],meta[name="googlebot"]')].map(function(x){return x.outerHTML}).join('\n')||'No meta robots tag found in DOM';alert(m);})();Regex — extraia noindex de uma exportação HTML em massa. Se você estiver pesquisando em um lote
de arquivos de código-fonte salvos ou uma exportação de rastreamento por valores content="...noindex...",
isso captura o atributo content completo para que você possa ver se noindex está
combinado com qualquer outra coisa (como nofollow ou noarchive):
<meta\s+name=["'](?:robots|googlebot)["']\s+content=["']([^"']*)["']O grupo de captura (([^"']*)) é a lista completa de diretivas — verifique-o
para noindex especificamente, em vez de assumir que uma correspondência significa noindex, já que a mesma
tag pode conter noarchive ou outras diretivas sem ele.
Ferramentas para esta tarefa
Ferramentas deste site
- Google Index Checker — busca uma URL como
Googlebot e relata sinais observáveis de indexabilidade: status, redirecionamentos,
diretivas noindex (meta tag e cabeçalho) e dicas de canonical, tudo em uma
única passada. É explícito que não consegue ver o estado real do índice do Google — apenas
o Search Console consegue — mas é a forma mais rápida de verificar a combinação noindex + canonical
- status antes de chegar perto do GSC.
- HTTP Header Checker — cabeçalhos de resposta brutos para uma
URL, incluindo
X-Robots-Tag. Use isto quando precisar especificamente confirmar um noindex baseado em cabeçalho (ou confirmar que ele sumiu após uma correção), separado de qualquer coisa no HTML da página. - Robots.txt Tester — verifica se uma determinada URL está desautorizada para um determinado user-agent. Execute isto sempre que estiver diagnosticando um noindex que parece não estar tendo efeito — uma desautorização na mesma URL é a causa clássica.
Ferramentas de terceiros
- Google Search Console — o relatório Page Indexing (onde este status vive), o relatório de sitemap (para a variante “Submitted”) e URL Inspection → Test live URL, a única ferramenta que mostra uma busca e veredito do Googlebot em tempo real.
- Rich Results Test — outra busca ao vivo do Googlebot; útil como uma segunda leitura da resposta HTTP e do snapshot renderizado quando você está atrás de um noindex fantasma ou servido por CDN.
Testes de validação
Execute estes após remover um noindex que você não queria, ou após resolver uma
contradição “Submitted URL marked ‘noindex’”.
Teste 1: O cabeçalho não envia mais X-Robots-Tag: noindex
- Teste a executar:
curl -Ina URL (ou o HTTP Header Checker) e inspecione os cabeçalhos de resposta. - Resultado esperado: Nenhum cabeçalho
X-Robots-Tag, ou um semnoindexnele. - Interpretação de falha: A diretiva ainda está sendo servida — verifique a configuração do servidor/CMS novamente e limpe qualquer cache de CDN ou edge que possa estar servindo uma resposta obsoleta.
- Janela de monitoramento: Imediata — isto é uma busca ao vivo, não um sinal dependente de rastreamento.
- Gatilho de reversão: N/A (este teste não muda nada); re-execute após cada mudança de configuração ou cache até passar.
Teste 2: A página renderizada não tem meta robots noindex
- Teste a executar: Google Index Checker ou uma
verificação de DevTools/View Source do
<head>renderizado. - Resultado esperado: Nenhum
<meta name="robots" content="noindex">(ou variantegooglebot) no DOM renderizado. - Interpretação de falha: Um template, tag manager ou injeção de JS ainda está adicionando a tag — verifique o DOM renderizado, não apenas o código-fonte bruto.
- Janela de monitoramento: Imediata.
- Gatilho de reversão: N/A; re-execute após cada mudança de template/configuração.
Teste 3: A busca ao vivo do Googlebot confirma que a página é indexável
- Teste a executar: GSC URL Inspection → Test live URL.
- Resultado esperado: “URL is available to Google” sem noindex sinalizado no resultado do teste ao vivo.
- Interpretação de falha: O Googlebot está vendo algo que seu navegador não vê — verifique se há uma diretiva condicional por user-agent ou regra de CDN servindo ao Google uma resposta diferente da que você recebe.
- Janela de monitoramento: Imediata para o próprio resultado do teste ao vivo.
- Gatilho de reversão: Se o teste ao vivo ainda mostrar noindex após uma mudança de configuração mais uma purga de cache, trate a correção como ainda não ativa e continue depurando antes de solicitar a indexação.
Teste 4: A URL também não está bloqueada por robots.txt
- Teste a executar: Robots.txt Tester na mesma URL.
- Resultado esperado: Permitido para o Googlebot.
- Interpretação de falha: Uma regra de bloqueio está ocultando qualquer estado de noindex existente — o Google não pode rastrear novamente para ver sua correção. Remova o bloqueio primeiro.
- Janela de monitoramento: Imediata.
- Gatilho de reversão: Não se aplica; isso deve passar antes que os outros testes signifiquem algo para uma página que você deseja indexar.
Teste 5: Relatório de indexação de páginas limpa o status
- Teste a executar: Relatório de indexação de páginas do GSC, após clicar em Validar correção no grupo afetado (ou Solicitar indexação para uma única URL prioritária).
- Resultado esperado: A URL sai de “URL marcada como ‘noindex’” / “URL enviada marcada como ‘noindex’” e entra em “Indexada” (ou seu status pretendido) no relatório.
- Interpretação de falha: Ainda aguardando novo rastreamento, ou a diretiva ainda está presente em algum lugar que você não verificou (reexecute os Testes 1–3).
- Janela de monitoramento: Variável, não fixa — a validação é executada em segundo plano no cronograma de rastreamento do próprio Google. A documentação do Google diz que o tempo para revisitar depende da importância da página e pode levar consideravelmente mais do que alguns dias, até meses para páginas de menor prioridade; não trate uma atualização lenta como uma falha por si só.
- Gatilho de reversão: Se a validação ainda não mudou após uma espera genuinamente longa (e os Testes 1–4 passarem), reexecute os Testes 1–4 em ordem, em vez de reenviar a mesma correção.
Quiz
Cinco perguntas para verificar o que realmente ficou deste artigo.
Registro de alterações
Atualizado em 11 de ago. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.
Atualizado em 11 de ago. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.
Atualizado em 18 de jul. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.