Códigos de erro HTTP

Como os códigos de erro HTTP 4xx e 5xx afetam o SEO — como o Google trata erros, quais causam desindexação, desperdício de rastreamento e quedas de classificação, e como monitorá-los e corrigi-los.

Publicado pela primeira vez: 27 de jun. de 2026 · Última atualização: 3 de ago. de 2026 · Avançado
Idiomas
1 sinal de evidência nesta página

Códigos de erro HTTP são as respostas 4xx (erro do cliente) e 5xx (erro do servidor) que um servidor retorna em vez de um 2xx bem-sucedido. O Google trata as duas classes de forma muito diferente: 4xx (exceto 429) significa "o conteúdo não existe" — a página sai do índice, sem efeito na taxa de rastreamento; 5xx (e 429) significa "o servidor está falhando" — o Google limita primeiro o rastreamento em todo o site e só remove as páginas se os erros persistirem. Numericamente, 429 é um 4xx, mas o Google o trata explicitamente como erro do servidor. Soft 404 é o caso-armadilha — um 200 que parece dizer "não encontrado", que o Google identifica como desperdício de orçamento de rastreamento (principalmente uma preocupação de sites grandes), em vez de remover a página de forma limpa. 404 não é um sinal de qualidade ou classificação (Mueller), portanto não entre em pânico por causa de uma contagem de erros — o impacto real de um erro isolado ainda depende da URL (um recurso especial como robots.txt tem tratamento próprio, diferente de uma página comum); priorize as URLs com erro que têm links ou tráfego. Para indisponibilidade planejada, use 503 + Retry-After (nunca 403/404/410) e nunca use 503 no robots.txt. Monitore toda a família pelo relatório Page Indexing do Search Console. Este hub mapeia e liga para cada código individual: 401, 403, 404, 404 versus 410, 410, 429, 451, 500, 502, 503, 504 e soft 404.

TL;DR — Códigos de erro HTTP são as classes de status 4xx (cliente) e 5xx (servidor). O Google traça uma linha comportamental rígida entre elas: 4xx (exceto 429) significa “o conteúdo não existe” — a URL é removida do índice, com “no effect on crawl rate”; 5xx (e 429) significa “o servidor está falhando” — o Google limita o rastreamento proporcionalmente, preserva as URLs indexadas no início e só desindexa se os erros persistirem, aumentando depois a taxa de rastreamento gradualmente após a recuperação. Numericamente, 429 é um 4xx, mas o Google o chama de “a server error”. O conteúdo de qualquer resposta de erro é ignorado. 404 não é um sinal de qualidade (Mueller) — faça a triagem por links e tráfego, não corrija tudo e lembre que o impacto real de um erro isolado depende da URL (robots.txt tem tratamento especial de erros que uma página comum não tem). Soft 404 (um 200 que parece “not found”) é sinalizado pelo Google como desperdício de orçamento de rastreamento — principalmente uma preocupação de sites grandes, não um efeito garantido em todo site. Para uma indisponibilidade planejada, use 503 + Retry-After por “no máximo alguns dias” e nunca devolva 503 para robots.txt. Monitore a família no relatório Page Indexing do GSC. Este hub mapeia e encaminha para cada código individual.

A distinção que sustenta todo o tema

O código do protocolo descreve o resultado HTTP; um rótulo do Search Console descreve como o Google classificou uma busca observada. Evidence for this claim Primary standard or official documentation supporting the adjacent article claim. Scope: Protocol semantics and Search behavior are kept separate; no indexing, ranking, or migration-timing guarantee is inferred. Confidence: high · Verified: RFC 9110: Status codes Não deduza uma única causa-raiz nem um momento exato de remoção apenas a partir da família. Evidence for this claim Primary standard or official documentation supporting the adjacent article claim. Scope: Protocol semantics and Search behavior are kept separate; no indexing, ranking, or migration-timing guarantee is inferred. Confidence: high · Verified: Google: HTTP and network errors

Quatro camadas acabam reduzidas a “é um 404” quando as pessoas falam de erros, e mantê-las separadas é o que torna o restante desta página compreensível:

  1. Semântica do protocolo — o significado do código de status segundo a especificação HTTP (um 404 significa “not found”, ponto final).
  2. A busca observada — o que o Googlebot realmente recebeu em uma solicitação específica, em um horário específico, o que pode ser diferente do que um navegador vê.
  3. Processamento da pesquisa — como o pipeline de indexação do Google classifica e trata essa busca observada (remove a URL, limita o rastreamento ou ignora o corpo).
  4. Causa-raiz — o motivo real no seu servidor (um deploy incorreto, um banco sobrecarregado ou uma regra de WAF), que o código de status sozinho nunca informa.

Saber a família (4xx ou 5xx) informa qual das três primeiras camadas você está observando. Isso nunca substitui a camada 4 — você ainda precisa descobrir o motivo.

A documentação do próprio Google apresenta a divisão de forma clara, e vale internalizá-la antes de qualquer outra coisa: erros 4xx dizem “o conteúdo não existe”; erros 5xx dizem “o próprio servidor está falhando”. São problemas completamente diferentes, e o pipeline de indexação do Google responde a eles de maneiras completamente diferentes.

Um ponto de ancoragem útil: até um código de sucesso não é uma promessa. O Google diz claramente: “for Google Search, an HTTP 2xx (success) status code doesn’t guarantee indexing.” Tradução: “para a Pesquisa Google, um código de status HTTP 2xx (sucesso) não garante a indexação.” Na verdade, os códigos de erro são a metade mais determinística do quadro — dizem ao Google, sem ambiguidade, “sumiu” ou “está quebrado”.

Como o Google trata erros 4xx

Para erros do cliente, o comportamento do Google é uniforme e direto: “Google doesn’t use the content from URLs that return 4xx status codes,” e “Google crawlers inform the next processing system that the content doesn’t exist.” Tradução: “o Google não usa o conteúdo de URLs que retornam códigos de status 4xx” e “os rastreadores do Google informam ao próximo sistema de processamento que o conteúdo não existe”. Mesmo que sua página 403 ou 404 mostre uma parede de texto real, nada disso é indexado — o corpo da resposta de erro é ignorado.

Duas consequências decorrem daí:

  • URLs antes indexadas são removidas. Quando uma página retorna 4xx de forma confiável, o Google a remove do índice com o tempo.
  • Não há penalidade de taxa de rastreamento. Este é o desmistificador: “The 4xx status codes, except 429, have no effect on crawl rate.” Tradução: “os códigos de status 4xx, exceto 429, não afetam a taxa de rastreamento”. Uma montanha de 404 não torna mais lento o rastreamento do restante do site.

Esse último ponto elimina um mau instinto: não tente limitar o Googlebot com 401 ou 403. O Google adverte explicitamente: “don’t use 401 and 403 status codes for limiting the crawl rate.” Tradução: “não use códigos de status 401 e 403 para limitar a taxa de rastreamento”. Uma barreira de autenticação não desacelera o rastreamento — apenas torna o conteúdo invisível.

Como o Google trata erros 5xx (e 429)

Erros do servidor ativam o ramo de “the server is struggling” (“o servidor está com dificuldades”) e, aqui, o Google protege deliberadamente seu site:

  • A taxa de rastreamento é limitada primeiro, proporcionalmente ao volume. “5xx and 429 server errors prompt Google’s crawlers to temporarily slow down with crawling,” e “the decrease in crawl rate is proportionate to the number of individual URLs that are returning a server error.” Tradução: “erros de servidor 5xx e 429 fazem os rastreadores do Google reduzir temporariamente o ritmo do rastreamento” e “a redução da taxa de rastreamento é proporcional ao número de URLs individuais que retornam um erro de servidor”. Alguns 500 quase não aparecem; uma interrupção no site inteiro reduz muito o rastreamento.
  • URLs indexadas são preservadas… até os erros persistirem. “Already indexed URLs are preserved in the index, but eventually dropped,” e “removes from the index URLs that persistently return a server error.” Tradução: “URLs já indexadas são preservadas no índice, mas acabam sendo removidas” e “remove do índice URLs que retornam persistentemente um erro de servidor”. Uma oscilação breve não desindexa você; uma falha prolongada, sim.
  • O conteúdo de 5xx também é ignorado. “Any content Google receives from URLs that return a 5xx status code is ignored.” Tradução: “qualquer conteúdo que o Google receba de URLs que retornam um código de status 5xx é ignorado”.
  • A recuperação é automática, mas gradual. “Once the server starts responding with a 2xx status code, Google gradually increases the crawl rate for the site.” Tradução: “quando o servidor começa a responder com um código de status 2xx, o Google aumenta gradualmente a taxa de rastreamento do site”. O Google recua rapidamente e retoma com cautela — não existe um desbloqueio manual; corrija a causa-raiz e espere.

Por que 429 fica na categoria de erro do servidor

Esta é a nuance que mais passa despercebida na maioria dos guias.  429 Too Many Requests  é numericamente um 4xx, mas o Google o trata como um sinal do servidor: “Google’s crawlers treat the 429 status code as a signal that the server is overloaded, and it’s considered a server error.” Tradução: “os rastreadores do Google tratam o código de status 429 como um sinal de que o servidor está sobrecarregado, e ele é considerado um erro do servidor”. Assim, um WAF ou limitador de taxa que começa a disparar 429 para o Googlebot limita seu rastreamento da mesma maneira que uma onda de 500 — não remove páginas individuais como um 404. Quando detalho os códigos no meu guia de códigos de status HTTP na Ahrefs, coloco 429 junto aos erros do servidor exatamente por esse motivo: é “a form of rate-limiting to protect the server,” ou seja, “uma forma de limitação de taxa para proteger o servidor”, e faz o Google desacelerar.

Mapa da família de códigos de erro

Esta é a visão rápida de triagem de toda a família. Cada código abaixo tem seu próprio aprofundamento dentro deste hub (eles também estão na barra lateral):

Erros de bloqueio / acesso

  • 401 Unauthorized — o cliente não se identificou nem se verificou quando necessário. Fica bloqueado para o Googlebot atrás de uma solicitação de autenticação.
  • 403 Forbidden — o cliente é conhecido, mas não tem direitos de acesso.

Erros de não encontrado

  • 404 Not Found — o recurso solicitado não foi encontrado.
  • 404 vs 410 — a diferença prática entre “não encontrado” e “removido” (é menor do que as pessoas imaginam).
  • 410 Gone — como um 404, mas também diz que o recurso não voltará. Remove páginas um pouco mais rápido.

O código de dupla identidade

  • 429 Too Many Requests — limitação de taxa; numericamente é 4xx, mas o Google o trata como erro do servidor para fins de taxa de rastreamento.

Legal

  • 451 Unavailable For Legal Reasons — bloqueado por motivo legal: bloqueios por país e remoções por DMCA.

Erros do servidor (5xx)

  • 500 Internal Server Error — o servidor encontrou um problema que não consegue tratar.
  • 502 Bad Gateway — uma resposta inválida de um servidor upstream.
  • 503 Service Unavailable — o servidor está sobrecarregado ou em manutenção (o código correto para uma indisponibilidade planejada).
  • 504 Gateway Timeout — nenhuma resposta oportuna de um servidor upstream.

O caso-armadilha

  • Soft 404 — uma página que retorna  200 OK , mas parece dizer “não encontrado”. O pior dos dois mundos — mais detalhes abaixo.

Redirecionamentos quebrados são próximos de erros, mas são categorizados separadamente (o Google os exibe como “Redirect error” no Search Console, distinto de uma “follow up to 10 redirect hops” normal e funcional). Por padrão, os rastreadores do Google “follow up to 10 redirect hops” antes de desistir. Uma cadeia longa demais, um loop ou uma URL inválida transforma o caso nesse status de erro de redirecionamento.

Um erro HTTP prejudica seu SEO?

Comece pelo veredito: um erro isolado em uma página comum quase nunca é um problema, e 404s especificamente não são um sinal de ranking ou qualidade. Mueller foi explícito e repetiu isso. O reflexo — “I have 50,000 404s, my site must be penalized” — é o principal mito a desarmar. Erros são parte normal da web; fazer páginas retornarem 404 ou 410 é a maneira tecnicamente correta de lidar com URLs que não existem.

“Isolado” não significa “sempre inofensivo”, porém — o impacto real depende do que está retornando o erro. Uma página comum em 404 não é um acontecimento; um recurso especial é diferente. O Google dá ao robots.txt regras próprias de tratamento de erros, distintas das URLs regulares, portanto um erro de servidor no robots.txt pode afetar o rastreamento de um modo que o 404 de uma página comum nunca afetaria. Avalie o erro pela URL em que ele ocorre e pelo que depende dela, não apenas pelo código de status.

O padrão com um mecanismo real e documentado é o 5xx persistente e em massa: limitação da taxa de rastreamento → eventual desindexação. Mesmo isso é proporcional ao número de URLs com erro e geralmente reversível quando o servidor se recupera — o Google descreve a retomada como gradual, não instantânea. Portanto, trate o tempo exato, a cadência de novas tentativas e a velocidade de recuperação como dependentes das evidências (o que a documentação do Google descreve), não como uma garantia fixa. A distinção de Mueller é a que você deve lembrar: a taxa de rastreamento reage a erros do servidor (429/500/503/tempos limite), não a 404.

Desperdício de rastreamento versus desindexação — dois danos diferentes

É útil separar as duas maneiras pelas quais erros podem custar caro:

  • Desindexação — 4xx persistente (página removida como “sumida”) ou 5xx persistente (páginas removidas após uma falha prolongada do servidor). Trata-se de páginas saindo do índice.
  • Desperdício do orçamento de rastreamento — principalmente uma preocupação de sites grandes. O guia de orçamento de rastreamento do Google observa “if the site slows down or responds with server errors, the limit goes down and Google crawls less.” Tradução: “se o site ficar lento ou responder com erros do servidor, o limite diminui e o Google rastreia menos”. Mas o verdadeiro desperdício de orçamento é o soft 404: “soft 404 pages will continue to be crawled, and waste your budget.” Tradução: “páginas soft 404 continuarão sendo rastreadas e desperdiçarão seu orçamento”. Como um soft 404 parece vivo (retorna  200 ), o Google continua verificando uma página que na verdade não está ali. Por isso o soft 404 é o caso do “pior dos dois mundos” — não sai de forma limpa como um 404 verdadeiro, permanece e queima buscas.

A armadilha do soft 404 tem duas causas comuns, ambas dignas de menção: um template personalizado de “página não encontrada” que retorna  200  em vez de um 404 real, e um redirecionamento indiscriminado de toda URL morta para a página inicial — o Google também reconhece esse padrão como soft 404. Uma página 404 amigável é boa para a experiência e totalmente recomendada — desde que ainda retorne o código HTTP 404 verdadeiro.

Como fazer uma indisponibilidade planejada corretamente

Quando você coloca intencionalmente um site (ou uma seção) offline, o código correto é **503 Service Unavailable com um cabeçalho  Retry-After ** — nunca um 4xx. A orientação do Google para “pausar seu negócio on-line” é específica:

  • “If you need to urgently disable the site for 1-2 days, then return an informational error page with a 503 HTTP response status code.” Tradução: “se você precisar desativar o site com urgência por 1–2 dias, retorne uma página de erro informativa com um código de status de resposta HTTP 503”.
  • “This is an extreme measure that should only be taken for a very short period of time (a few days at most),” porque “completely closing a site even for just a few weeks can have negative consequences on Google’s indexing of your site.” Tradução: “esta é uma medida extrema, que só deve ser tomada por um período muito curto (no máximo alguns dias)” e “fechar completamente um site por apenas algumas semanas pode ter consequências negativas para a indexação do seu site pelo Google”.
  • “Don’t block the website by returning 403, 404, 410 HTTP status codes” durante a indisponibilidade — um 4xx diz “sumiu permanentemente”, exatamente o sinal errado para uma interrupção temporária.
  • A armadilha que quase todos deixam passar: “Don’t return a 503 HTTP response status code for the robots.txt file because this blocks all crawling.” Tradução: “não retorne um código de status de resposta HTTP 503 para o arquivo robots.txt, pois isso bloqueia todo o rastreamento”. Use 503 nas páginas, não no robots.txt.

Como monitorar toda a família no Search Console

No dia a dia, você encontrará esses erros no relatório Page Indexing do Search Console, onde cada um corresponde a um status distinto:

  • Not found (404)“this page returned a 404 error when requested.” Tradução: “esta página retornou um erro 404 quando solicitada”.
  • Server error (5xx)“your server returned a 500-level error when the page was requested.” Tradução: “seu servidor retornou um erro de nível 500 quando a página foi solicitada”.
  • Blocked due to unauthorized request (401)“the page was blocked to Googlebot by a request for authorization.” Tradução: “a página foi bloqueada para o Googlebot por uma solicitação de autorização”.
  • Blocked due to access forbidden (403) — um 403 em que foram fornecidas credenciais, mas o acesso não foi concedido.
  • Blocked due to other 4xx issue — um 4xx não coberto por outro status; use a Inspeção de URL para depurar.
  • Soft 404 — uma “user-friendly ‘not found’ message but not a 404 HTTP response code.” Tradução: “mensagem amigável de ‘não encontrado’, mas não um código de resposta HTTP 404”.
  • Redirect error — cadeia longa demais, loop, URL longa demais ou URL inválida na cadeia.

Cada status aponta para uma causa-raiz e um caminho de correção diferentes. Depois de resolver um deles, use Validate Fix para solicitar um novo rastreamento — mas mantenha expectativas realistas sobre o tempo; o novo rastreamento não é instantâneo. E lembre-se da formulação do próprio Google: “it’s fine for a URL not to be indexed for the right reasons — for example… a 404 for a page that you’ve removed and have no replacement for.” Tradução: “tudo bem uma URL não ser indexada pelos motivos corretos — por exemplo, um 404 para uma página que você removeu e para a qual não tem substituta”. Nem todo erro é uma tarefa.

O Search Console sozinho não basta para agir — é um ponto de vista, com amostragem e atraso. Ao registrar um erro para triagem, anote no mínimo: a URL, quando você a observou, o ponto de observação (Search Console, verificação ao vivo ou logs do servidor/CDN), o user agent da solicitação, o método HTTP, o código de status final e o caminho da resposta (incluindo qualquer cadeia de redirecionamento), se é isolado ou recorrente e uma etapa de verificação pós-correção depois do novo deploy. Triangular o GSC com uma verificação de status ao vivo e seus próprios logs é o que transforma uma linha antiga do relatório em um problema confirmado e corrigível.

Como corrigir e priorizar erros

  • Faça a triagem dos 404 por valor. Corrija os que têm links de entrada, links internos, presença no sitemap ou tráfego persistente — redirecione-os com 301 para uma página relevante para recuperar a autoridade dos links. Deixe URLs realmente mortas em 404 ou 410. Como escrevi no meu guia da Ahrefs, a correção prática para a maioria é “you just need to 301 redirect each of these pages to a relevant page” — mas somente quando existe um destino relevante. Não redirecione tudo indiscriminadamente para a página inicial (isso é um soft 404).
  • 410 versus 404 é uma diferença marginal. Um 410 remove uma página um pouco mais rápido que um 404; a diferença prática de SEO é pequena. Use 410 quando quiser deixar explícito que algo desapareceu de vez, mas não espere que seja dramaticamente melhor.
  • Encontre a causa-raiz dos 5xx. As correções ficam no servidor: capacidade e tempos limite para 500, saúde do upstream/CDN para 502/504 e regras de WAF ou limitação de taxa que estejam bloqueando o Googlebot por engano em 403/429. Confirme o bot real com uma verificação de DNS reverso/direto antes de aplicar limitação de taxa.
  • Causas-raiz comuns que vale nomear: erros da aplicação e do banco de dados e hosts sobrecarregados (5xx), falhas de upstream/CDN (502/504), limitação de taxa ou WAF bloqueando bots (403/429), migrações quebradas e links internos obsoletos (404) e páginas de erro amigáveis mal configuradas (soft 404).

Bing: um padrão semelhante, não um código verificado independentemente

As declarações públicas do Bing apontam na mesma direção da abordagem do Google — códigos na faixa dos 400 são tratados como ausentes ou proibidos, e códigos na faixa dos 500 sinalizam problemas do servidor que prejudicam a eficiência do rastreamento — mas não verifiquei de forma independente a paridade completa, atual e código a código na documentação do próprio Bing; portanto, trate isto como uma direção, não como uma correspondência confirmada. Fabrice Canel descreve o objetivo do Bing como “crawl efficiency north star … to crawl a URL only when the content has been added … updated,”, e erros persistentes trabalham diretamente contra isso — o Bing gasta espaço de rastreamento em URLs que não produzem conteúdo novo e indexável. O Bing também recomenda 503 com Retry-After para indisponibilidades planejadas, em vez de servir páginas de erro como 200. Você encontra as superfícies de erros de rastreamento do Bing no Bing Webmaster Tools (URL Inspection, Crawl Control, Site Scan).

Para onde ir agora

Esta página é o hub conceitual da família de códigos de erro. Ela está dentro do cluster mais amplo HTTP Status Codes (o panorama completo de 1xx–5xx, além de redirecionamentos e códigos de sucesso); este sub-hub é o mapa da metade dos erros. Cada código abaixo tem seu próprio aprofundamento:

Bloqueio / acesso

  • 401 Unauthorized — o que dispara o status “Blocked due to unauthorized request” e por que barreiras de autenticação não limitam o Googlebot.
  • 403 Forbidden — credenciais fornecidas, mas acesso negado, e os padrões de WAF/bloqueio de bots que causam falsos 403 para o Googlebot.

Não encontrado

  • 404 Not Found — como o Google trata páginas ausentes, por que isso não é uma penalidade e quais 404 você realmente deve corrigir.
  • 404 vs 410 — a diferença real e pequena e quando recorrer a cada um.
  • 410 Gone — o sinal de “removido permanentemente” e sua remoção um pouco mais rápida.

Limitação de taxa

  • 429 Too Many Requests — o 4xx que se comporta como 5xx e como evitar que limites de taxa reduzam seu rastreamento.

Legal

  • 451 Unavailable For Legal Reasons — remoções, bloqueios por país e como as remoções legais aparecem.

Erros do servidor

  • 500 Internal Server Error — a falha genérica do servidor e como encontrar sua causa-raiz.
  • 502 Bad Gateway — falhas do upstream/proxy.
  • 503 Service Unavailable — o código correto para manutenção e indisponibilidade planejada (com a armadilha do robots.txt).
  • 504 Gateway Timeout — tempos limite do upstream.

O caso-armadilha

  • Soft 404 — o 200 que parece removido, por que desperdiça o orçamento de rastreamento e como transformá-lo em um 404 verdadeiro.

Redirecionamentos quebrados são tratados separadamente como o status Redirect error — relacionados, mas categorizados à parte no Search Console.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.