Como a pesquisa funciona
Como a pesquisa funciona — Português (Brasil)
Canonicalização
Como os mecanismos de busca escolhem uma URL canônica entre duplicatas e consolidam nela os sinais de ranqueamento — por que rel=canonical é uma sugestão, não uma regra, e como alinhar todos os sinais.
Português (Brasil) › ConteúdoRastreamento
Como os mecanismos de busca descobrem e baixam a web — Googlebot e Bingbot, descoberta de URLs, o agendador de rastreamento, renderização e como crawling difere de indexação e ranking. O hub para tudo relacionado a rastreamento.
Português (Brasil) › ConteúdoTag canonical para SEO
Como implementar rel=canonical corretamente — o elemento de link HTML, o cabeçalho HTTP Link para PDFs, URLs absolutas, um por página — e onde as pessoas erram.
Português (Brasil) › ConteúdoPágina alternativa com tag canonical adequada
“Página alternativa com tag canonical adequada” no relatório de indexação de páginas do Google Search Console não é um erro — é o sistema de canonicalização funcionando como esperado. Veja o que significa, por que contagens altas normalmente são aceitáveis, como difere dos dois status de duplicata e quais poucos casos merecem investigação.
Português (Brasil) › ConteúdoVelocidade de rastreamento
Quão rápido os mecanismos de busca buscam suas páginas — o que é crawl rate, por que o Google aposentou o slider de rate do Search Console, como desacelerar o Googlebot com segurança hoje, por que você não pode forçar um aumento e como o Crawl Control manual do Bing é diferente.
Português (Brasil) › ConteúdoSitemap XML
O que é um sitemap XML, seu anatomía, as etiquetas ignoradas (priority/changefreq), lastmod preciso, os límites de 50 000/50MB, hreflang em sitemaps e como enviar uno.
Português (Brasil) › ConteúdoFeeds RSS
Como os mecanismos de busca usam feeds RSS 2,0 e Atom 1,0 como um canal de descoberta para conteúdo novo — Feedfetcher, robots.txt, WebSub e por que um feed complementa, mas nunca substitui um sitemap XML.
Português (Brasil) › ConteúdoRenderização
Como o Web Rendering Service do Google executa JavaScript para montar a página indexada, além das opções de renderização — CSR, SSR, SSG, hidratação, ISR, edge e dinâmica — e suas contrapartidas de SEO.
Português (Brasil) › ConteúdoRobots.txt
O que o robots.txt realmente faz — ele controla o rastreamento, não a indexação — além da sintaxe exata, de como o Google o trata internamente e dos erros que quebram sites.
Português (Brasil) › ConteúdoCrawled – atualmente não indexada
O que significa “Crawled — atualmente não indexada” no Google Search Console — o Google buscou a página, mas decidiu não indexá-la, geralmente por uma decisão ligada ao conteúdo ou à qualidade do site. Como ela difere de "Discovered – currently not indexed," _(tradução)_ «Descoberta — atualmente não indexada», quando investigar e como corrigi-la.
Português (Brasil) › ConteúdoURL marcada como 'noindex' (status do GSC)
O que significa o status "URL marcada como 'noindex'" no Google Search Console — e a variante "URL enviada marcada como 'noindex'" e o nome legado "Excluída pela tag 'noindex'". Quando é intencional vs. um erro, onde o noindex reside (meta tag vs. cabeçalho X-Robots-Tag), o conflito com robots.txt, noindex fantasma/CDN, e como corrigir e validar.
Português (Brasil) › ConteúdoAnálise de Arquivos de Log
Como ler os logs de acesso brutos do seu servidor para ver exatamente o que o Googlebot, Bingbot e rastreadores de IA realmente buscaram — verificando bots reais, encontrando desperdício de rastreamento e páginas órfãs, e por que os logs são a fonte da verdade que as ferramentas de rastreamento e o Search Console apenas aproximam.
Português (Brasil) › ConteúdoCrawler Baiduspider
O que é o Baiduspider — variantes e user-agents do crawler do Baidu, conformidade com robots.txt (e a exceção cpro/ads), verificação por DNS reverso, renderização fraca de JS e controle de rastreamento no Ziyuan.
Português (Brasil) › ConteúdoCrawlers de IA: tipos, bots e controle
Os três tipos de crawler de IA — bots de treinamento, indexadores de pesquisa com IA e buscadores acionados pelo usuário —, os principais nomes e como controlar cada um sem prejudicar o SEO.
Português (Brasil) › ConteúdoBloqueada devido a uma solicitação não autorizada (401)
O que significa o status “Bloqueada devido a uma solicitação não autorizada (401)” do relatório de indexação de páginas do Google Search Console, como ele difere de 403 na RFC 9110, as causas comuns, como diagnosticá-lo como um bot e a correção certa conforme o tipo de página — pública, privada, falso positivo de WAF ou paywall.
Português (Brasil) › ConteúdoBloqueado devido a acesso proibido (403)
O que significa o status “Bloqueado devido a acesso proibido (403)” no relatório de indexação de páginas do Google Search Console, por que o Googlebot recebe 403 quando o navegador não recebe, como isso difere de 401 e como diagnosticar, corrigir e validar o problema.
Português (Brasil) › ConteúdoBloqueado devido a outro problema 4xx
O que significa “Bloqueado devido a outro problema 4xx” no relatório de indexação de páginas do Google Search Console, quais códigos aparecem com frequência (400, 405, 408, 410, 411, 413, 414, 421, 422, 451 e a nuance de 429), como o Google os trata e como diagnosticar, corrigir e validar a resposta real.
Português (Brasil) › ConteúdoBloqueado pelo robots.txt (status do GSC)
O que significa o status “Bloqueado pelo robots.txt” no relatório de indexação de páginas do Google Search Console: uma URL excluída da indexação porque o robots.txt proibiu o rastreamento. Normalmente é intencional. Veja a diferença para “Indexada, embora bloqueada”, o conflito entre noindex e Disallow e como corrigir um bloqueio acidental.
Português (Brasil) › ConteúdoRastreador Bingbot
O que é o Bingbot, o que ele alimenta além do Bing, como verificá-lo com DNS reverso e como controlar seu rastreamento com robots.txt, Crawl Control e IndexNow.
Português (Brasil) › ConteúdoAPI de indexação do Google
O que a Google Indexing API realmente faz — oficialmente suportada apenas para páginas com JobPosting e BroadcastEvent (transmissão ao vivo), não para conteúdo geral. Os mitos, o que o Google realmente diz e o que usar em vez disso para indexação mais rápida.
Português (Brasil) › ConteúdoIndexNow para SEO
O IndexNow é o protocolo aberto de push que informa instantaneamente ao Bing, Yandex, Naver, Seznam e Yep quando suas URLs mudam — uma única submissão, compartilhada entre todos eles. Como funciona, como configurá-lo e por que ele não faz nada pelo Google.
Português (Brasil) › ConteúdoSitemaps
O que é um sitemap, se você precisa de um, os tipos (XML, HTML, imagem, vídeo, notícias), como encontrar, criar e enviar um, e por que sitemaps ajudam na descoberta, mas nunca garantem indexação.
Português (Brasil) › ConteúdoÍndice de Sitemap
Um índice de sitemap é um sitemap de sitemaps — como grandes sites dividem o limite de 50 000 URLs, quantas URLs você pode cobrir e a estratégia de divisão que realmente compensa.
Português (Brasil) › ConteúdoPrioridade de Sitemap
O que é a tag de prioridade de sitemap, por que o Google e o Bing ignoram completamente a prioridade e a frequência de alteração, e o que realmente sinaliza a importância de uma página para os mecanismos de busca.
Português (Brasil) › ConteúdoProtocolo WebSub
WebSub (antigo PubSubHubbub) é um protocolo push que transmite alterações em feeds RSS/Atom para mecanismos de busca como o Google em tempo real — o que é, como funciona e seus limites.
Português (Brasil) › ConteúdoIndexação
Como os mecanismos de busca armazenam e organizam páginas para que possam ranquear — análise de conteúdo, canonicalização, por que rastreado não é indexado e leitura do relatório de indexação de páginas do GSC.
Português (Brasil) › ConteúdoConteúdo duplicado
Não existe penalidade por conteúdo duplicado. O que o conteúdo duplicado realmente custa, como o Google agrupa duplicatas e escolhe uma canonical e como corrigir o problema.
Português (Brasil) › ConteúdoIndexação mobile-first
O que é a indexação mobile-first — o Google usando seu HTML móvel para indexação e ranqueamento — e por que a paridade de conteúdo é a regra
Português (Brasil) › ConteúdoAgente de usuário
O que é um user agent — o cabeçalho HTTP que rastreadores e navegadores usam para se identificar, o token do robots.txt versus a string completa, e como verificar se um bot é real.
Português (Brasil) › ConteúdoOrçamento de rastreamento
O que o crawl budget realmente é — capacidade de rastreamento mais demanda de rastreamento — o que o desperdiça e o teste honesto para saber se seu site é grande o bastante para precisar se importar.
Português (Brasil) › ConteúdoDemanda de rastreamento
O lado do "querer" do crawl budget — o que faz o Google querer rastrear suas páginas (popularidade, desatualização e inventário percebido), como a demanda encontra a capacidade do host e por que você não pode forçá-la.
Português (Brasil) › ConteúdoPageRank e SEO
O PageRank é o algoritmo original de análise de links do Google — o que é, o modelo do navegador aleatório e a fórmula, a atualização do Navegador Razoável, sua história desde a Barra de Ferramentas até o vazamento da API de 2024, por que ainda é um sistema de ranqueamento central, e o que isso significa para seus links e arquitetura interna.
Português (Brasil) › ConteúdoRastreador Googlebot
O que o Googlebot realmente é — Smartphone vs Desktop, renderização evergreen do Chromium, strings de user-agent, verificação de faixas de IP, limites de bytes e a distinção entre rastreamento e ranqueamento.
Português (Brasil) › ConteúdoRedirecionamentos JavaScript
O que é um redirecionamento JavaScript, como o pipeline de renderização do Google o trata de forma diferente de um 301 no servidor, quando é um último recurso aceitável e como implementar e detectar um — além de onde o meta refresh e a History API se encaixam.
Português (Brasil) › ConteúdoSEO e Acessibilidade
Onde a acessibilidade web e o SEO realmente se sobrepõem (texto alternativo, cabeçalhos, texto do link, velocidade) e onde divergem — além de por que o Google diz que acessibilidade não é um fator de ranqueamento.
Português (Brasil) › ConteúdoSitelinks e SEO
O que são os sitelinks do Google, por que eles são 100% algorítmicos e como influenciá-los (não controlá-los) — além da ferramenta de rebaixamento que não existe mais, a descontinuação da caixa de pesquisa de sitelinks, os Deep Links do Bing e como os sitelinks pagos diferem dos orgânicos.
Português (Brasil) › ConteúdoRelatório de indexação de páginas (GSC)
Como funciona o relatório de indexação de páginas do Google Search Console (antigo relatório de cobertura do índice) — indexadas versus não indexadas, coluna Origem, todos os status, Validar correção e atraso do relatório.