Como a pesquisa funciona

Como a pesquisa funciona — Português (Brasil)

Português (Brasil) › Conteúdo

Canonicalização

Como os mecanismos de busca escolhem uma URL canônica entre duplicatas e consolidam nela os sinais de ranqueamento — por que rel=canonical é uma sugestão, não uma regra, e como alinhar todos os sinais.

Ler artigo →
Português (Brasil) › Conteúdo

Rastreamento

Como os mecanismos de busca descobrem e baixam a web — Googlebot e Bingbot, descoberta de URLs, o agendador de rastreamento, renderização e como crawling difere de indexação e ranking. O hub para tudo relacionado a rastreamento.

Ler artigo →
Português (Brasil) › Conteúdo

Tag canonical para SEO

Como implementar rel=canonical corretamente — o elemento de link HTML, o cabeçalho HTTP Link para PDFs, URLs absolutas, um por página — e onde as pessoas erram.

Ler artigo →
Português (Brasil) › Conteúdo

Página alternativa com tag canonical adequada

“Página alternativa com tag canonical adequada” no relatório de indexação de páginas do Google Search Console não é um erro — é o sistema de canonicalização funcionando como esperado. Veja o que significa, por que contagens altas normalmente são aceitáveis, como difere dos dois status de duplicata e quais poucos casos merecem investigação.

Ler artigo →
Português (Brasil) › Conteúdo

Velocidade de rastreamento

Quão rápido os mecanismos de busca buscam suas páginas — o que é crawl rate, por que o Google aposentou o slider de rate do Search Console, como desacelerar o Googlebot com segurança hoje, por que você não pode forçar um aumento e como o Crawl Control manual do Bing é diferente.

Ler artigo →
Português (Brasil) › Conteúdo

Sitemap XML

O que é um sitemap XML, seu anatomía, as etiquetas ignoradas (priority/changefreq), lastmod preciso, os límites de 50 000/50MB, hreflang em sitemaps e como enviar uno.

Ler artigo →
Português (Brasil) › Conteúdo

Feeds RSS

Como os mecanismos de busca usam feeds RSS 2,0 e Atom 1,0 como um canal de descoberta para conteúdo novo — Feedfetcher, robots.txt, WebSub e por que um feed complementa, mas nunca substitui um sitemap XML.

Ler artigo →
Português (Brasil) › Conteúdo

Renderização

Como o Web Rendering Service do Google executa JavaScript para montar a página indexada, além das opções de renderização — CSR, SSR, SSG, hidratação, ISR, edge e dinâmica — e suas contrapartidas de SEO.

Ler artigo →
Português (Brasil) › Conteúdo

Robots.txt

O que o robots.txt realmente faz — ele controla o rastreamento, não a indexação — além da sintaxe exata, de como o Google o trata internamente e dos erros que quebram sites.

Ler artigo →
Português (Brasil) › Conteúdo

Crawled – atualmente não indexada

O que significa “Crawled — atualmente não indexada” no Google Search Console — o Google buscou a página, mas decidiu não indexá-la, geralmente por uma decisão ligada ao conteúdo ou à qualidade do site. Como ela difere de "Discovered – currently not indexed," _(tradução)_ «Descoberta — atualmente não indexada», quando investigar e como corrigi-la.

Ler artigo →
Português (Brasil) › Conteúdo

URL marcada como 'noindex' (status do GSC)

O que significa o status "URL marcada como 'noindex'" no Google Search Console — e a variante "URL enviada marcada como 'noindex'" e o nome legado "Excluída pela tag 'noindex'". Quando é intencional vs. um erro, onde o noindex reside (meta tag vs. cabeçalho X-Robots-Tag), o conflito com robots.txt, noindex fantasma/CDN, e como corrigir e validar.

Ler artigo →
Português (Brasil) › Conteúdo

Análise de Arquivos de Log

Como ler os logs de acesso brutos do seu servidor para ver exatamente o que o Googlebot, Bingbot e rastreadores de IA realmente buscaram — verificando bots reais, encontrando desperdício de rastreamento e páginas órfãs, e por que os logs são a fonte da verdade que as ferramentas de rastreamento e o Search Console apenas aproximam.

Ler artigo →
Português (Brasil) › Conteúdo

Crawler Baiduspider

O que é o Baiduspider — variantes e user-agents do crawler do Baidu, conformidade com robots.txt (e a exceção cpro/ads), verificação por DNS reverso, renderização fraca de JS e controle de rastreamento no Ziyuan.

Ler artigo →
Português (Brasil) › Conteúdo

Crawlers de IA: tipos, bots e controle

Os três tipos de crawler de IA — bots de treinamento, indexadores de pesquisa com IA e buscadores acionados pelo usuário —, os principais nomes e como controlar cada um sem prejudicar o SEO.

Ler artigo →
Português (Brasil) › Conteúdo

Bloqueada devido a uma solicitação não autorizada (401)

O que significa o status “Bloqueada devido a uma solicitação não autorizada (401)” do relatório de indexação de páginas do Google Search Console, como ele difere de 403 na RFC 9110, as causas comuns, como diagnosticá-lo como um bot e a correção certa conforme o tipo de página — pública, privada, falso positivo de WAF ou paywall.

Ler artigo →
Português (Brasil) › Conteúdo

Bloqueado devido a acesso proibido (403)

O que significa o status “Bloqueado devido a acesso proibido (403)” no relatório de indexação de páginas do Google Search Console, por que o Googlebot recebe 403 quando o navegador não recebe, como isso difere de 401 e como diagnosticar, corrigir e validar o problema.

Ler artigo →
Português (Brasil) › Conteúdo

Bloqueado devido a outro problema 4xx

O que significa “Bloqueado devido a outro problema 4xx” no relatório de indexação de páginas do Google Search Console, quais códigos aparecem com frequência (400, 405, 408, 410, 411, 413, 414, 421, 422, 451 e a nuance de 429), como o Google os trata e como diagnosticar, corrigir e validar a resposta real.

Ler artigo →
Português (Brasil) › Conteúdo

Bloqueado pelo robots.txt (status do GSC)

O que significa o status “Bloqueado pelo robots.txt” no relatório de indexação de páginas do Google Search Console: uma URL excluída da indexação porque o robots.txt proibiu o rastreamento. Normalmente é intencional. Veja a diferença para “Indexada, embora bloqueada”, o conflito entre noindex e Disallow e como corrigir um bloqueio acidental.

Ler artigo →
Português (Brasil) › Conteúdo

Rastreador Bingbot

O que é o Bingbot, o que ele alimenta além do Bing, como verificá-lo com DNS reverso e como controlar seu rastreamento com robots.txt, Crawl Control e IndexNow.

Ler artigo →
Português (Brasil) › Conteúdo

API de indexação do Google

O que a Google Indexing API realmente faz — oficialmente suportada apenas para páginas com JobPosting e BroadcastEvent (transmissão ao vivo), não para conteúdo geral. Os mitos, o que o Google realmente diz e o que usar em vez disso para indexação mais rápida.

Ler artigo →
Português (Brasil) › Conteúdo

IndexNow para SEO

O IndexNow é o protocolo aberto de push que informa instantaneamente ao Bing, Yandex, Naver, Seznam e Yep quando suas URLs mudam — uma única submissão, compartilhada entre todos eles. Como funciona, como configurá-lo e por que ele não faz nada pelo Google.

Ler artigo →
Português (Brasil) › Conteúdo

Sitemaps

O que é um sitemap, se você precisa de um, os tipos (XML, HTML, imagem, vídeo, notícias), como encontrar, criar e enviar um, e por que sitemaps ajudam na descoberta, mas nunca garantem indexação.

Ler artigo →
Português (Brasil) › Conteúdo

Índice de Sitemap

Um índice de sitemap é um sitemap de sitemaps — como grandes sites dividem o limite de 50 000 URLs, quantas URLs você pode cobrir e a estratégia de divisão que realmente compensa.

Ler artigo →
Português (Brasil) › Conteúdo

Prioridade de Sitemap

O que é a tag de prioridade de sitemap, por que o Google e o Bing ignoram completamente a prioridade e a frequência de alteração, e o que realmente sinaliza a importância de uma página para os mecanismos de busca.

Ler artigo →
Português (Brasil) › Conteúdo

Protocolo WebSub

WebSub (antigo PubSubHubbub) é um protocolo push que transmite alterações em feeds RSS/Atom para mecanismos de busca como o Google em tempo real — o que é, como funciona e seus limites.

Ler artigo →
Português (Brasil) › Conteúdo

Indexação

Como os mecanismos de busca armazenam e organizam páginas para que possam ranquear — análise de conteúdo, canonicalização, por que rastreado não é indexado e leitura do relatório de indexação de páginas do GSC.

Ler artigo →
Português (Brasil) › Conteúdo

Conteúdo duplicado

Não existe penalidade por conteúdo duplicado. O que o conteúdo duplicado realmente custa, como o Google agrupa duplicatas e escolhe uma canonical e como corrigir o problema.

Ler artigo →
Português (Brasil) › Conteúdo

Indexação mobile-first

O que é a indexação mobile-first — o Google usando seu HTML móvel para indexação e ranqueamento — e por que a paridade de conteúdo é a regra

Ler artigo →
Português (Brasil) › Conteúdo

Agente de usuário

O que é um user agent — o cabeçalho HTTP que rastreadores e navegadores usam para se identificar, o token do robots.txt versus a string completa, e como verificar se um bot é real.

Ler artigo →
Português (Brasil) › Conteúdo

Orçamento de rastreamento

O que o crawl budget realmente é — capacidade de rastreamento mais demanda de rastreamento — o que o desperdiça e o teste honesto para saber se seu site é grande o bastante para precisar se importar.

Ler artigo →
Português (Brasil) › Conteúdo

Demanda de rastreamento

O lado do "querer" do crawl budget — o que faz o Google querer rastrear suas páginas (popularidade, desatualização e inventário percebido), como a demanda encontra a capacidade do host e por que você não pode forçá-la.

Ler artigo →
Português (Brasil) › Conteúdo

PageRank e SEO

O PageRank é o algoritmo original de análise de links do Google — o que é, o modelo do navegador aleatório e a fórmula, a atualização do Navegador Razoável, sua história desde a Barra de Ferramentas até o vazamento da API de 2024, por que ainda é um sistema de ranqueamento central, e o que isso significa para seus links e arquitetura interna.

Ler artigo →
Português (Brasil) › Conteúdo

Rastreador Googlebot

O que o Googlebot realmente é — Smartphone vs Desktop, renderização evergreen do Chromium, strings de user-agent, verificação de faixas de IP, limites de bytes e a distinção entre rastreamento e ranqueamento.

Ler artigo →
Português (Brasil) › Conteúdo

Redirecionamentos JavaScript

O que é um redirecionamento JavaScript, como o pipeline de renderização do Google o trata de forma diferente de um 301 no servidor, quando é um último recurso aceitável e como implementar e detectar um — além de onde o meta refresh e a History API se encaixam.

Ler artigo →
Português (Brasil) › Conteúdo

SEO e Acessibilidade

Onde a acessibilidade web e o SEO realmente se sobrepõem (texto alternativo, cabeçalhos, texto do link, velocidade) e onde divergem — além de por que o Google diz que acessibilidade não é um fator de ranqueamento.

Ler artigo →
Português (Brasil) › Conteúdo

Sitelinks e SEO

O que são os sitelinks do Google, por que eles são 100% algorítmicos e como influenciá-los (não controlá-los) — além da ferramenta de rebaixamento que não existe mais, a descontinuação da caixa de pesquisa de sitelinks, os Deep Links do Bing e como os sitelinks pagos diferem dos orgânicos.

Ler artigo →
Português (Brasil) › Conteúdo

Relatório de indexação de páginas (GSC)

Como funciona o relatório de indexação de páginas do Google Search Console (antigo relatório de cobertura do índice) — indexadas versus não indexadas, coluna Origem, todos os status, Validar correção e atraso do relatório.

Ler artigo →