URL marcada como 'noindex' (status do GSC)

O que significa o status "URL marcada como 'noindex'" no Google Search Console — e a variante "URL enviada marcada como 'noindex'" e o nome legado "Excluída pela tag 'noindex'". Quando é intencional vs. um erro, onde o noindex reside (meta tag vs. cabeçalho X-Robots-Tag), o conflito com robots.txt, noindex fantasma/CDN, e como corrigir e validar.

Publicado pela primeira vez: 23 de jun. de 2026 · Última atualização: 11 de ago. de 2026 · Avançado
Idiomas
1 sinal de evidência nesta página

"URL marcada como 'noindex'" é o status de Indexação de Página do Google Search Console para uma página que o Google rastreou e encontrou uma diretiva noindex (uma meta tag robots ou um cabeçalho X-Robots-Tag), então a manteve fora do índice. Mesma condição, vários nomes: o atual "URL marcada como 'noindex'", a redação mais específica para sitemap "URL enviada marcada como 'noindex'" que relatórios e ferramentas usam comumente, e o legado "Excluída pela tag 'noindex'". Geralmente é intencional e tudo bem — valide a lista de URLs antes de "corrigir" qualquer coisa. O verdadeiro sinal de alerta é uma página com noindex ainda presente no seu sitemap — o envio de sitemap é uma dica para o Google, não uma garantia, e as duas diretivas se contradizem. Como o noindex depende do rastreamento, não o combine com uma desautorização no robots.txt — o Google não pode ver um noindex que não pode rastrear. Verifique dois lugares (a meta tag e o cabeçalho X-Robots-Tag), depure noindex fantasma/CDN com uma busca ao vivo do Googlebot, depois remova a diretiva, valide a correção e espere que o reprocessamento leve mais de um ou dois dias.

TL;DR — “URL marcada como ‘noindex’” é o status de Indexação de Página do GSC para uma página que o Google rastreou e encontrou um noindex — tag meta robots ou cabeçalho X-Robots-Tag, e o Google também honra uma tag meta robots colocada no corpo da página, não apenas no <head>. Vários nomes, um estado: o atual “URL marcada como ‘noindex’”, a redação mais precisa de submissão de sitemap “URL enviada marcada como ‘noindex’” que relatórios e ferramentas comumente usam, e o legado “Excluída por tag ‘noindex’.” É distinto de bloqueio por robots.txt (nunca rastreada) e de “Rastreada — atualmente não indexada” (sem diretiva). Geralmente intencional — valide a lista de URLs primeiro. Uma URL com noindex ainda presente no seu sitemap é o verdadeiro sinal (a submissão de sitemap é uma dica, não uma garantia). noindex é dependente de rastreamento: combine-o com uma desautorização de robots.txt e o Google não consegue vê-lo, então a página pode permanecer indexada. Quando as regras conflitam, o Google aplica a mais restritiva. Verifique duas fontes (o HTML renderizado e o cabeçalho HTTP), depure noindex fantasma/CDN com uma busca ao vivo do Googlebot (Inspeção de URL / Teste de Resultados Avançados), depois remova a diretiva, Valide a correção e espere que o reprocessamento leve mais de um dia ou dois — o Google diz que pode levar meses para páginas de prioridade mais baixa.

O que o status realmente significa

O relatório descreve a diretiva observada pelo Google, não o motivo pelo qual um CMS, modelo ou CDN adicionou-a. Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report O Google deve ser capaz de rastrear a página para observar e aplicar o noindex. Evidence for this claim Google supports noindex through a robots meta tag or X-Robots-Tag header and must crawl the page to observe it. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Block indexing with noindex

A definição do próprio Google é precisa: quando o Google tentou indexar a página, ele encontrou uma diretiva noindex e, portanto, não a indexou. A palavra-chave é encontrou — o Google teve que rastrear a página para ver a diretiva. Portanto, este status carrega dois fatos ao mesmo tempo: o Google alcançou a página, e a página disse a ele para não ser indexada.

Evidence for this claim Google reports URL marked noindex when it encountered a noindex directive while trying to index the URL and therefore did not index it. Scope: verified Search Console properties Confidence: high · Verified: Page indexing report

Essa é toda a espinha dorsal de precisão aqui, e é o que separa este status de seus vizinhos:

  • Bloqueada por robots.txt → o Google nunca foi autorizado a rastrear, então não leu nenhum conteúdo ou diretiva.
  • “Rastreada — atualmente não indexada” → o Google rastreou, encontrou nenhuma diretiva, e escolheu não indexar mesmo assim.
  • “URL marcada como ‘noindex’” → o Google rastreou, encontrou um noindex e o obedeceu.
Evidence for this claim Google reports URL marked noindex when it encounters a noindex directive and does not index the page. Scope: Google Search Console report terminology and documented Search behavior; the label alone may not prove the underlying root cause. Confidence: high · Verified: Google: Page indexing report

Os três nomes são uma condição

Isso confunde as pessoas porque o rótulo mudou ao longo do tempo e varia conforme como a URL foi encontrada:

  • “URL marcada como ‘noindex’” — o rótulo atual e geral no relatório de Indexação de Página. Fica sob “Não indexada” (anteriormente “Excluída”). Esta é a redação que a documentação atual do relatório de Indexação de Página do próprio Google usa e define.
  • “Submitted URL marked ‘noindex’” (tradução) «URL enviada marcada como ‘noindex’» — a mesma condição subjacente, mas para uma URL que também está em um sitemap que você enviou. Esta é a redação mais precisa que profissionais e ferramentas de SEO de terceiros comumente relatam para essa combinação. A documentação de ajuda atual do Google não a detalha como um status definido separadamente distinto de “URL marked ‘noindex’” (tradução) «URL marcada como ‘noindex’», então trate o rótulo exato como dependente do relatório — mas a substância permanece independentemente do que uma determinada ferramenta chama: um sitemap deve listar as URLs que você quer na Pesquisa (e enviar um é uma dica para o Google, não uma garantia de indexação), então uma URL com noindex nele é uma contradição que vale a pena resolver.
  • “Excluded by ‘noindex’ tag” (tradução) «Excluída pela tag ‘noindex’» — o nome legado do relatório “Cobertura de Índice” anterior a 2021. Ainda é a versão coloquial mais pesquisada. A mesma coisa subjacente.

Se você chegou aqui por qualquer um desses três, você está no mesmo lugar.

É um problema? A decisão intencional vs. acidental

Não “corrija” isso reflexivamente. A árvore de decisão:

  1. Puxe a lista de URLs afetadas (clique no status).
  2. Estas são páginas que você pretendia excluir? Páginas de agradecimento, busca interna, URLs de facetas/filtros, conta/admin, staging que não deveria estar no ar. → Nenhuma ação. “Não indexado” não é o mesmo que “quebrado”, e o Google diz exatamente isso: estas URLs não foram indexadas, mas não necessariamente por causa de um erro.
  3. Há uma página que você quer indexada nesta lista? → Um noindex vazou para ela. Encontre e remova.
  4. A URL com noindex também está no seu sitemap enviado (muitas vezes exibida como “URL enviada marcada como ‘noindex’”)? → Resolva a contradição diretamente: remova o noindex (para indexá-la) ou remova a URL do seu sitemap (para deixá-la com noindex). Não deixe uma URL com noindex em um sitemap — o envio do sitemap é uma dica para o Google sobre o que você quer indexar, não uma solicitação que substitui a diretiva da própria página.

A razão pela qual os concorrentes tratam isso como um puro “erro para corrigir” é que eles pulam a etapa 2. Na maioria das vezes, este status é o sistema funcionando corretamente.

Onde o noindex vive: meta tag vs. cabeçalho X-Robots-Tag

Existem exatamente dois métodos de entrega, e você precisa verificar ambos porque eles parecem completamente diferentes:

  • Meta tag robots<meta name="robots" content="noindex"> no <head> da página. Direciona todos os rastreadores; <meta name="googlebot" content="noindex"> direciona apenas o Google. Esta é a que você pode ver no HTML.
  • Cabeçalho HTTP X-Robots-TagX-Robots-Tag: noindex nos cabeçalhos de resposta do servidor. Esta é a sorrateira. Ela é definida na configuração do servidor, CMS ou CDN, não no código-fonte da página, então “Ver código-fonte” não a mostrará. O método de cabeçalho também é a única maneira de aplicar noindex em arquivos não-HTML — um cabeçalho de resposta pode ser usado para recursos não-HTML, como PDFs, arquivos de vídeo e arquivos de imagem, que não têm <head> para conter uma meta tag.
Evidence for this claim Google supports noindex through a robots meta tag or an X-Robots-Tag HTTP response header; both have the same effect, and the response header supports non-HTML resources. Scope: HTML and non-HTML web resources Confidence: high · Verified: Block Search indexing with noindex

Quando o GSC diz noindex e você jura que a página não tem um, o cabeçalho é o primeiro lugar para olhar (a aba de folha de dicas coloca os dois lado a lado).

Como encontrar a diretiva em uma página

  1. Ver código-fonte / DOM renderizado — procure por noindex. Verifique o <head> renderizado, não apenas o código-fonte bruto, já que uma tag pode ser injetada por JavaScript ou um gerenciador de tags. Também não pare no <head>: o Google disse que não impõe a posição do meta-robots e respeita uma meta tag robots encontrada no <body> da página também, então uma diretiva injetada mais abaixo no documento ainda conta.
  2. Cabeçalhos de respostacurl -I https://example.com/page/ (ou DevTools do navegador → Rede → a solicitação do documento → Cabeçalhos de resposta) e procure por uma linha X-Robots-Tag.
  3. Inspeção de URL (GSC)Testar URL ao vivo — isso busca a página como o Googlebot e relata o veredito de indexação e a resposta. Esta é a que captura diretivas servidas apenas para o Google.
  4. Teste de resultados avançados — outra busca real do Googlebot que retorna a resposta HTTP e um instantâneo renderizado de exatamente o que o servidor mostra ao Google.
  5. Verifique se há regras de robots conflitantes, não apenas uma única tag. Se mais de uma diretiva de robots se aplica à página (digamos, um modelo define index, mas um plugin ou cabeçalho adiciona noindex), o Google aplica a regra mais restritiva — então um noindex perdido em qualquer lugar vence, mesmo que outra regra diga index. Não pare de procurar depois de encontrar uma diretiva que pareça permissiva.

O conflito do robots.txt (por que disallow + noindex sai pela culatra)

Este é o ponto mais confuso em todos os outros guias, então quero ser exato. noindex é dependente de rastreamento: o Google precisa conseguir buscar a página para ler a diretiva. O Google afirma a regra claramente — para que a regra noindex seja eficaz, a página não deve ser bloqueada por um arquivo robots.txt e precisa estar acessível ao rastreador; se estiver bloqueada ou o rastreador não conseguir acessá-la, o rastreador nunca verá o noindex, e a página ainda pode aparecer na pesquisa (por exemplo, se outras páginas linkarem para ela).

Evidence for this claim Google must be allowed to crawl and otherwise access a URL to see and apply its noindex rule; a robots.txt block can hide the directive while the URL remains eligible to appear from other information. Scope: HTML and non-HTML web resources Confidence: high · Verified: Block Search indexing with noindex

Escrevo sobre o lado oposto disso há anos. No meu artigo da Ahrefs sobre «Indexada, embora bloqueada por robots.txt», o ponto central é: “crawling and indexing are two different things” (tradução) «rastreamento e indexação são coisas diferentes» — “if you block a page from being crawled, Google may still index it.” (tradução) «se você impedir o rastreamento de uma página, o Google ainda poderá indexá-la». E, especificamente sobre esse conflito: “Unless Google can crawl a page, they won’t see the noindex meta tag and may still index it because it has links.” (tradução) «A menos que o Google possa rastrear uma página, ele não verá a metatag noindex e ainda poderá indexá-la porque ela tem links». Então a combinação autossabotadora é noindex + bloqueio no robots.txt: o disallow esconde o noindex, e a página pode permanecer indexada por meio de links externos.

A sequência correta para realmente remover uma página:

  1. Permita o rastreamento e mantenha o noindex no lugar.
  2. Aguarde o Google recrawlar, ver a diretiva e remover a página.
  3. Somente então, se você quiser economizar orçamento de rastreamento, você pode bloqueá-lo no robots.txt — após a desindexação, não antes.

Minha recomendação permanente, de aquele mesmo artigo: “Just add a noindex meta robots tag and make sure to allow crawling — assuming it’s canonical.” (tradução) «Basta adicionar uma metatag robots noindex e garantir que o rastreamento seja permitido, desde que essa seja a versão preferencial.»

noindex fantasma: cache de CDN e diretivas específicas para Googlebot

A versão mais difícil disso é o noindex “fantasma”: você olha a página, não vê noindex em lugar nenhum, e o GSC ainda relata um. John Mueller já abordou exatamente isso — nos casos que ele viu, havia um noindex real, às vezes mostrado apenas para o Google, o que pode ser muito difícil de depurar. (Ele observou esse cenário quando isso surgiu; estou parafraseando o ponto dele em vez de citá-lo como uma declaração formal.)

Os suspeitos usuais — trate-os como hipóteses a verificar, não como causas confirmadas, até que a resposta ao vivo realmente mostre um deles:

  • Um CDN ou cache servindo um cabeçalho X-Robots-Tag: noindex obsoleto que não está mais na sua configuração de origem.
  • Uma diretiva condicional ao user-agent — o servidor retorna uma página limpa para o seu navegador e uma com noindex para o Googlebot.
  • Um vazamento de staging/template — um noindex destinado a um ambiente de staging indo para produção por meio de um template compartilhado.

O diagnóstico é o mesmo nos três: não confie em “View Source” no seu próprio navegador. Faça uma busca real do GooglebotTest live URL do URL Inspection ou o Rich Results Test — que mostra a resposta HTTP e a página renderizada exatamente como o Google a recebe. É assim que você pega um servidor/CDN servindo uma coisa para você e outra para o rastreador.

Como corrigir e validar

Depois de confirmar que o noindex é um erro:

  1. Remova a diretiva na sua fonte real — a meta tag no template, ou o cabeçalho X-Robots-Tag na configuração do servidor/CMS/CDN. Limpe qualquer cache de CDN/página para que a correção seja realmente servida.
  2. Confirme com uma busca ao vivo do Googlebot (Inspeção de URL → Testar URL ao vivo) que a página agora retorna sem noindex e mostra “URL disponível para o Google.”
  3. Solicite a indexação para URLs de alta prioridade e/ou use o botão Validar correção do relatório para pedir ao Google que reverifique todo o conjunto afetado.
  4. Aguarde. A desindexação e a reindexação não são instantâneas — o Google precisa rastrear novamente para ver a mudança primeiro, e a própria orientação do Google é que o tempo de revisita depende da importância da página e pode levar consideravelmente mais de um dia ou dois (sua documentação dá “meses” como possibilidade para páginas de menor prioridade). Solicitar a indexação em uma URL prioritária é como você pede ao Google para tentar mais cedo, não uma forma de forçar um cronograma específico. Não entre em pânico se o status persistir durante o reprocessamento.

Para o inverso — uma página que você quer com noindex, mas que está presa no índice porque também estava bloqueada por robots.txt — desbloqueie o rastreamento primeiro para que o Google possa finalmente ver o noindex.

Onde isso se encaixa

Este status é um nó no relatório Page Indexing do Google. A diretiva de robots por trás dele — noindex — pode ser entregue como uma meta tag robots ou um cabeçalho X-Robots-Tag, e a ferramenta certa depende de você estar trabalhando com arquivos HTML ou não HTML. Os status vizinhos (“Indexado, embora bloqueado por robots.txt” e “Rastreado — atualmente não indexado”) descrevem estados diferentes e precisam de correções diferentes; mantê-los claros é a maior parte da batalha.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.