Tag Meta Robots

A tag meta robots controla como uma página é indexada e exibida — todas as diretivas, a regra de rastrear antes de obedecer, a resolução de conflitos e a comparação com o X-Robots-Tag.

Publicado pela primeira vez: 23 de jun. de 2026 · Última atualização: 13 de ago. de 2026 · Avançado
Idiomas
1 sinal de evidência nesta página

A tag meta robots — <meta name="robots" content="noindex"> no <head> — informa aos mecanismos de busca como indexar e exibir uma única página. A regra decisiva é rastrear antes de obedecer: uma página bloqueada no robots.txt não é buscada, portanto seu noindex não é visto. Sem a tag, o padrão é index, follow. Em conflitos, prevalece a regra mais restritiva; ao combinar uma tag googlebot com a tag robots genérica, o Googlebot recebe a soma das regras negativas. A tag funciona apenas em HTML — use o cabeçalho X-Robots-Tag para PDFs, imagens e outros recursos não HTML.

TL;DR — A tag <meta name="robots" content="…"> no <head> controla como uma página é indexada e exibida; sem a tag, o padrão é index, follow. A lógica é rastrear antes de obedecer: “these settings can be read and followed only if crawlers are allowed to access the pages” (tradução) pt-BR: essas configurações só podem ser lidas e seguidas se os rastreadores tiverem permissão para acessar as páginas. Portanto, uma URL bloqueada no robots.txt não é buscada, e seu noindex não é visto — tenho dados próprios que demonstram o outro lado desse mecanismo. Em caso de conflito, prevalece a regra mais restritiva; ao combinar uma tag googlebot com a tag genérica robots, o Googlebot recebe a soma das regras negativas. A tag funciona somente em HTML; use o cabeçalho X-Robots-Tag para conteúdo não HTML e regras em escala. O Google reconhece somente dois tokens de rastreador, googlebot e googlebot-news, e ignora todos os demais valores, inclusive tokens de outros mecanismos, como bingbot.

Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications

O que é, onde fica e qual é o padrão

Nas palavras do Google, a tag meta robots permite “use a granular, page-specific approach to controlling how an individual HTML page should be indexed and served to users in Google Search results.” (tradução) pt-BR: usar uma abordagem granular, específica por página, para controlar como uma página HTML deve ser indexada e exibida aos usuários nos resultados da Pesquisa Google. O local convencional e compatível entre mecanismos é o <head>:

<meta name="robots" content="noindex, nofollow">

Todos os mecanismos esperam a tag no <head>, mas o Google deixa claro que essa posição não é uma exigência rígida da Pesquisa Google: “Google Search doesn’t enforce placement of meta robots in the HTML head and will respect robots meta tags in the body section of an HTML document as well.” (tradução) pt-BR: a Pesquisa Google não exige que a meta robots esteja no head do HTML e também respeita tags meta robots colocadas no body de um documento HTML. Trate isso como uma tolerância específica do Google, não como orientação portável. Continue inserindo a tag no <head> para que todo rastreador e validador que espera o posicionamento padrão consiga lê-la.

O atributo name define o público da regra, e é aqui que muitos guias exageram o suporte do Google. name="robots" se dirige a todos os rastreadores que reconhecem a tag. Além disso, o Google aceita exatamente dois tokens de rastreador e ignora qualquer outro valor: “Google supports two user agent tokens in the robots meta tag; other values are ignored: googlebot for all text results, and googlebot-news for news results.” (tradução) pt-BR: o Google aceita dois tokens de agente do usuário na tag meta robots; os demais valores são ignorados: googlebot para todos os resultados de texto e googlebot-news para resultados de notícias. Uma tag com name="bingbot" não é um controle documentado do Google: o Bing interpreta seu token conforme suas próprias regras, mas o Google ignora qualquer valor de name que não reconheça. Para o Google, os atributos name e content não diferenciam maiúsculas de minúsculas; o mesmo vale para nomes e valores do cabeçalho X-Robots-Tag.

Quando não há tag meta robots, o padrão é index, follow — a regra all, que, segundo o Google, “has no effect if explicitly listed.” (tradução) pt-BR: não produz efeito quando declarada explicitamente.

Evidence for this claim For Google, the default robots meta behavior is index, follow when no restrictive rule is present. Scope: Google-supported robots meta rules; other crawlers publish their own support and defaults. Confidence: high · Verified: Google Search Central: Robots meta tag specifications

A tag só é necessária para alterar o padrão.

É possível combinar regras de duas formas: separadas por vírgula na mesma tag (noindex, nofollow) ou distribuídas em várias tags <meta>. Segundo o Google, você pode “create a multi-rule instruction by combining robots meta tag rules with commas or by using multiple meta tags.” (tradução) pt-BR: criar uma instrução com várias regras combinando as regras da tag meta robots com vírgulas ou usando várias tags meta.

A regra que muda tudo: o Google precisa rastrear a página para ver a tag

Este é o ponto central do artigo. A tag meta robots segue a lógica rastrear antes de obedecer. O Google precisa buscar a página para ler a tag; qualquer barreira à busca impede a aplicação da regra. Nas palavras da especificação:

“Keep in mind that these settings can be read and followed only if crawlers are allowed to access the pages that include these settings.” (tradução) pt-BR: lembre-se de que essas configurações só podem ser lidas e seguidas se os rastreadores tiverem permissão para acessar as páginas que as contêm.

Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications

A consequência também está explícita:

“If a page is disallowed from crawling through the robots.txt file, then any information about indexing or serving rules will not be found and will therefore be ignored.” (tradução) pt-BR: se o rastreamento de uma página for impedido pelo arquivo robots.txt, as informações sobre regras de indexação ou exibição não serão encontradas e, por isso, serão ignoradas.

Assim, o erro clássico — usar Disallow no robots.txt e noindex na mesma URL — impede silenciosamente o funcionamento do noindex. O Google não rastreia a página, não vê a tag, e a URL pode permanecer no índice, muitas vezes como resultado sem snippet se receber links. A documentação complementar do Google afirma que a página “must not be blocked by a robots.txt file… If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see the noindex rule, and the page can still appear in search results.” (tradução) pt-BR: não pode estar bloqueada por um arquivo robots.txt; se a página estiver bloqueada ou o rastreador não conseguir acessá-la, ele nunca verá a regra noindex, e a página ainda poderá aparecer nos resultados.

Observei o outro lado desse mecanismo em dados reais. No experimento A história do bloqueio de 2 páginas bem posicionadas com robots.txt, bloqueei deliberadamente duas de nossas páginas bem posicionadas no robots.txt. Como o Google não podia mais rastreá-las, não conseguia atualizar as informações sobre elas, e as páginas conservaram a maior parte de suas posições: “We lost a position here or there and all of the featured snippets for the pages.” (tradução) pt-BR: perdemos uma posição aqui ou ali e todos os featured snippets dessas páginas. Minha conclusão foi: “Accidentally blocking pages (that Google already ranks) from being crawled using robots.txt probably isn’t going to have much impact on your rankings, and they will likely still show in the search results.” (tradução) pt-BR: bloquear por engano, via robots.txt, o rastreamento de páginas que o Google já posiciona provavelmente não terá grande impacto nas posições, e elas provavelmente continuarão aparecendo nos resultados. É o outro lado do problema de noindex: uma URL bloqueada fica congelada. Bloquear não é remover. Para retirar de fato uma página, use um noindex rastreável.

Essa é também a divisão que defendo publicamente entre os controles. Quando me perguntaram se o Google deveria aceitar noindex no robots.txt, respondi: “Google was clear they want robots.txt for crawl control only.” (tradução) pt-BR: o Google deixou claro que quer o robots.txt apenas para controle de rastreamento. Rastreamento é responsabilidade do robots.txt; indexação, da meta tag ou do cabeçalho. As funções não se sobrepõem. A diretiva noindex em robots.txt nunca teve suporte oficial, e o Google deixou de processá-la em 1º de setembro de 2019.

Todas as diretivas meta robots

Valores aceitos pelo Google, acompanhados pelas descrições exatas da especificação e por glossas naturais em pt-BR.

Indexação

  • all“There are no restrictions for indexing or serving. This rule is the default value and has no effect if explicitly listed.” (tradução) pt-BR: não há restrições de indexação ou exibição; essa é a regra padrão e não produz efeito quando declarada explicitamente.
  • noindex“Do not show this page, media, or resource in search results.” (tradução) pt-BR: não mostre esta página, mídia ou recurso nos resultados.
  • none“Equivalent to noindex, nofollow.” (tradução) pt-BR: equivale a noindex, nofollow.
  • indexifembedded“Google is allowed to index the content of a page if it’s embedded in another page through iframes or similar HTML tags, in spite of a noindex rule.” (tradução) pt-BR: o Google pode indexar o conteúdo de uma página quando ele está incorporado a outra página por iframe ou tag HTML semelhante, apesar de uma regra noindex. É a diretiva que pode prevalecer sobre noindex para conteúdo incorporado.

Links

  • nofollow“Do not follow the links on this page.” (tradução) pt-BR: não siga os links desta página. A regra vale para a página inteira, diferentemente de rel="nofollow" em um link específico.

Exibição e snippets

  • nosnippet“Do not show a text snippet or video preview in the search results for this page.” (tradução) pt-BR: não mostre snippet de texto nem prévia de vídeo nos resultados para esta página. O alcance é mais amplo que o snippet clássico. Segundo o Google, a regra “applies to all forms of search results (at Google: web search, Google Images, Discover, AI Overviews, AI Mode) and will also prevent the content from being used as a direct input for AI Overviews and AI Mode.” (tradução) pt-BR: aplica-se a todas as formas de resultados do Google e também impede o uso direto do conteúdo como entrada para AI Overviews e AI Mode.
  • max-snippet:[number]“Use a maximum of [number] characters as a textual snippet for this search result.” (tradução) pt-BR: use no máximo [number] caracteres no snippet de texto deste resultado. A regra tem o mesmo alcance ampliado de nosnippet: ela “applies to all forms of search results (such as Google web search, Google Images, Discover, Assistant, AI Overviews, AI Mode) and will also limit how much of the content may be used as a direct input for AI Overviews and AI Mode.” (tradução) pt-BR: aplica-se a todas essas formas de resultado e limita quanto conteúdo pode ser usado diretamente como entrada para AI Overviews e AI Mode. Isso controla a elegibilidade de entrada direta nos recursos de busca com IA do Google; não é uma exclusão geral de treinamento. Google-Extended e o controle separado de IA generativa da Pesquisa no Search Console têm escopos próprios. Não trate nosnippet nem max-snippet como se abrangessem esses dois sistemas.
  • max-image-preview:[setting]“Set the maximum size of an image preview for this page in search results.” (tradução) pt-BR: defina o tamanho máximo da prévia de imagem desta página nos resultados. Valores: none, standard e large; para este último, “A larger image preview, up to the width of the viewport, may be shown.” (tradução) pt-BR: pode ser exibida uma prévia maior, até a largura da viewport.
  • max-video-preview:[number]“Use a maximum of [number] seconds as a video snippet for videos on this page in search results.” (tradução) pt-BR: use no máximo [number] segundos como snippet de vídeo para os vídeos desta página nos resultados.
  • notranslate“Don’t offer translation of this page in search results.” (tradução) pt-BR: não ofereça a tradução desta página nos resultados.
  • noimageindex“Do not index images on this page.” (tradução) pt-BR: não indexe as imagens desta página.
  • unavailable_after:[date/time]“Do not show this page in search results after the specified date/time.” (tradução) pt-BR: não mostre esta página nos resultados depois da data e hora especificadas.

Históricas — não são mais controles ativos do Google

Algumas diretivas ainda citadas em guias antigos deixaram de ser usadas pelo Google. Não as adicione esperando algum efeito:

  • noarchive“The noarchive rule is no longer used by Google Search to control whether a cached link is shown in search results, as the cached link feature no longer exists.” (tradução) pt-BR: a Pesquisa Google não usa mais a regra noarchive para controlar a exibição de links em cache, pois esse recurso não existe mais.
  • nocache — sinônimo de noarchive em alguns mecanismos: “The nocache rule isn’t used by Google Search.” (tradução) pt-BR: a regra nocache não é usada pela Pesquisa Google.
  • nositelinkssearchbox“The nositelinkssearchbox rule is no longer used by Google Search to control whether the sitelink search box is shown for a given page, as the feature no longer exists.” (tradução) pt-BR: a Pesquisa Google não usa mais essa regra para controlar a caixa de pesquisa de sitelinks, pois o recurso não existe mais.

No nível do trecho, fora da meta tag

O atributo data-nosnippet permite controlar partes da página. Segundo o Google, é possível “designate textual parts of an HTML page not to be used as a snippet… on span, div, and section elements.” (tradução) pt-BR: indicar partes textuais de uma página HTML que não devem ser usadas como snippet em elementos span, div e section. As regras na meta tag abrangem a página inteira; data-nosnippet retira apenas um trecho do snippet.

Como combinar diretivas e resolver conflitos

Duas regras determinam o resultado quando as diretivas entram em conflito.

1. Prevalece a regra mais restritiva. “In the case of conflicting robots rules, the more restrictive rule applies. For example, if a page has both max-snippet:50 and nosnippet rules, the nosnippet rule will apply.” (tradução) pt-BR: quando regras de robots entram em conflito, aplica-se a mais restritiva; se a página tiver um limite de cinquenta caracteres e nosnippet, valerá nosnippet. Como nosnippet restringe mais que um limite de 50 caracteres, ele prevalece.

2. googlebot versus robots: soma das regras negativas. Uma tag com googlebot não substitui simplesmente a tag genérica robots; para o Googlebot, vale a união das restrições. O Google diz: “For situations where multiple crawlers are specified along with different rules, the search engine will use the sum of the negative rules.” (tradução) pt-BR: quando vários rastreadores são especificados com regras diferentes, o mecanismo usa a soma das regras negativas. O exemplo oficial é:

<meta name="robots" content="nofollow">
<meta name="googlebot" content="noindex">

“The page containing these meta tags will be interpreted as having a noindex, nofollow rule when crawled by Googlebot.” (tradução) pt-BR: quando rastreada pelo Googlebot, a página que contém essas tags será interpretada como tendo a regra noindex, nofollow. O nofollow de robots somado ao noindex de googlebot resulta em noindex, nofollow. Quando as tags definem de modo diferente a mesma diretiva, prevalece para aquele rastreador a tag que o nomeia.

Tag meta robots versus X-Robots-Tag — o cabeçalho HTTP

A tag meta robots funciona somente em HTML, pois precisa de um <head>. Para conteúdo não HTML, use X-Robots-Tag, que entrega o mesmo vocabulário de regras no cabeçalho HTTP. O Google afirma: “The X-Robots-Tag can be used as an element of the HTTP header response for a given URL. Any rule that can be used in a robots meta tag can also be specified as an X-Robots-Tag.” (tradução) pt-BR: a X-Robots-Tag pode fazer parte do cabeçalho de resposta HTTP de uma URL, e qualquer regra aceita na tag meta robots também pode ser especificada nela. A justificativa é direta: “You can use the X-Robots-Tag for non-HTML files like image files where the usage of robots meta tags in HTML is not possible.” (tradução) pt-BR: use X-Robots-Tag em arquivos não HTML, como imagens, nos quais não é possível usar tags meta robots no HTML.

Portanto:

  • PDF, imagem ou outro recurso não HTML? Não é possível adicionar uma tag <meta>; use o cabeçalho, por exemplo X-Robots-Tag: noindex.
  • Diretórios ou padrões inteiros? Configure o cabeçalho no servidor ou CDN para abranger caminhos inteiros com uma única regra.
  • Um mecanismo específico? O cabeçalho também pode nomear um rastreador: X-Robots-Tag: googlebot: noindex, nofollow; vários cabeçalhos X-Robots-Tag podem coexistir na mesma resposta.

São as mesmas regras em dois meios de entrega: meta tag para páginas HTML e cabeçalho para todo o restante ou para aplicação em escala.

Quais diretivas o Bing e outros mecanismos aceitam

Não presuma que o conjunto de diretivas seja universal. O Bing aceita as regras centrais de indexação e exibição: noindex, nofollow, noarchive (nocache como sinônimo) e nosnippet; também respeita X-Robots-Tag em recursos não HTML. O Bing não aceita a forma abreviada none. Para compatibilidade entre mecanismos, escreva noindex, nofollow por extenso. A família de controles de snippet e prévia — max-snippet, max-image-preview, max-video-preview — junto com noimageindex, notranslate, indexifembedded e unavailable_after, é na prática específica do Google. Na dúvida, escreva cada diretiva explicitamente e trate os controles max-* como recursos do Google.

Erros comuns e como corrigi-los

  • Disallow e noindex na mesma URL. O noindex não é visto. Mantenha a página rastreável e apenas o noindex.
  • noindex com rel=canonical apontando para outra URL. Os sinais conflitam: você pede ao Google que remova a página e, ao mesmo tempo, consolide seus sinais em outra. Escolha um objetivo. Veja mais em canonicalização.
  • Um noindex de todo o ambiente de homologação enviado para produção. Isso pode desindexar o site inteiro. Verifique antes do lançamento.
  • noindex injetado somente por JavaScript no cliente. O Google precisa renderizar a página para vê-lo; se o HTML renderizado diferir do esperado, o comportamento também será diferente. Prefira a tag no HTML bruto ou no cabeçalho.
  • Esperar que o Bing respeite diretivas específicas do Google, como none e a família max-*.
  • Esperar que uma diretiva de robots execute uma tarefa que não lhe pertence. noindex ou nosnippet, isoladamente, não garante economia de rastreamento, sigilo, mudança de posição, comportamento igual entre mecanismos, prazo fixo de remoção nem exclusão de toda superfície de IA ou busca. Use autenticação para sigilo, robots.txt para rastreamento e os controles próprios de cada mecanismo para os demais objetivos. O Google não dá prazo fixo para uma página com noindex sair dos resultados; conforme a prioridade de rastreamento, isso “may take months”. (tradução) pt-BR: pode levar meses.

No quadro geral, robots.txt e rastreamento cuidam do acesso do robô; noindex e indexação, da presença no índice; nosnippet, data-nosnippet, max-snippet e max-image-preview, de como uma página indexada aparece. X-Robots-Tag é o equivalente em cabeçalho HTTP da tag meta robots para conteúdo não HTML.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.