Códigos de erro HTTP
Como os códigos de erro HTTP 4xx e 5xx afetam o SEO — como o Google trata erros, quais causam desindexação, desperdício de rastreamento e quedas de classificação, e como monitorá-los e corrigi-los.
Idiomas
1 sinal de evidência nesta página
- Ferramenta relacionada ativaHTTP Status & Redirect Checker
Códigos de erro HTTP são as respostas 4xx (erro do cliente) e 5xx (erro do servidor) que um servidor retorna em vez de um 2xx bem-sucedido. O Google trata as duas classes de forma muito diferente: 4xx (exceto 429) significa "o conteúdo não existe" — a página sai do índice, sem efeito na taxa de rastreamento; 5xx (e 429) significa "o servidor está falhando" — o Google limita primeiro o rastreamento em todo o site e só remove as páginas se os erros persistirem. Numericamente, 429 é um 4xx, mas o Google o trata explicitamente como erro do servidor. Soft 404 é o caso-armadilha — um 200 que parece dizer "não encontrado", que o Google identifica como desperdício de orçamento de rastreamento (principalmente uma preocupação de sites grandes), em vez de remover a página de forma limpa. 404 não é um sinal de qualidade ou classificação (Mueller), portanto não entre em pânico por causa de uma contagem de erros — o impacto real de um erro isolado ainda depende da URL (um recurso especial como robots.txt tem tratamento próprio, diferente de uma página comum); priorize as URLs com erro que têm links ou tráfego. Para indisponibilidade planejada, use 503 + Retry-After (nunca 403/404/410) e nunca use 503 no robots.txt. Monitore toda a família pelo relatório Page Indexing do Search Console. Este hub mapeia e liga para cada código individual: 401, 403, 404, 404 versus 410, 410, 429, 451, 500, 502, 503, 504 e soft 404.
TL;DR — Códigos de erro HTTP são as respostas de “algo deu errado” que seu servidor envia em vez de um “200 OK” normal. Eles vêm em duas famílias: 4xx (a página está ausente ou bloqueada — um problema do cliente) e 5xx (o próprio servidor está com problemas). O Google trata as duas de maneiras muito diferentes: um 4xx apenas remove a página da pesquisa; um 5xx faz o Google reduzir o ritmo de rastreamento de todo o site até o servidor se recuperar. E, apesar do pânico que causam, erros 404 não são uma penalidade — você só precisa corrigir os que importam.
O que são códigos de erro HTTP
Códigos de status HTTP são metadados padronizados de resposta, agrupados nas classes 4xx de erro do cliente e 5xx de erro do servidor. Evidence for this claim Primary standard or official documentation supporting the adjacent article claim. Scope: Protocol semantics and Search behavior are kept separate; no indexing, ranking, or migration-timing guarantee is inferred. Confidence: high · Verified: RFC 9110: Status codes O Google documenta tratamentos distintos de rastreamento e indexação para essas famílias de respostas. Evidence for this claim Primary standard or official documentation supporting the adjacent article claim. Scope: Protocol semantics and Search behavior are kept separate; no indexing, ranking, or migration-timing guarantee is inferred. Confidence: high · Verified: Google: HTTP and network errors
Sempre que um navegador ou bot de mecanismo de busca solicita uma página, seu servidor responde com um código de status de três dígitos. 200 significa “aqui está a página, tudo certo”. Os códigos de erro são os que estão nos 400 e 500 — eles significam que a solicitação não foi concluída.
Há duas famílias, e a diferença entre elas é a coisa mais importante desta página:
- 4xx — erros do cliente. O problema está na solicitação: a página sumiu
(
404), foi removida permanentemente (410) ou você não tem permissão de acesso (401,403). Para um mecanismo de busca, um 4xx basicamente diz “there’s no content here.”. - 5xx — erros do servidor. O problema está do seu lado: o servidor caiu
(
500), um sistema de que ele depende falhou (502,504) ou ele está sobrecarregado ou em manutenção (503). Para um mecanismo de busca, um 5xx diz “the server itself is broken right now.”.
Como o Google reage a cada família
É aqui que as duas famílias se separam:
- Uma página 4xx apenas é removida da pesquisa. O Google decide que o conteúdo não existe e remove a URL do índice com o tempo. É importante notar que muitos 404 não tornam mais lento o rastreamento do restante do site.
- Um 5xx faz o Google rastrear todo o site mais lentamente. Quando o servidor apresenta erros, o Google reduz o ritmo para não piorar a situação. Suas páginas já indexadas permanecem no índice no início — o Google só começa a removê-las se os erros continuarem. Quando o servidor volta a funcionar, o rastreamento acelera novamente por conta própria.
O que a maioria das pessoas entende errado
Uma pilha de erros 404 não é uma penalidade. John Mueller, do Google, disse claramente que 404 são “not a quality signal, it’s not a SEO signal.” Tradução: “não são um sinal de qualidade nem um sinal de SEO.” Páginas quebradas e ausentes são uma parte normal da web. Portanto, quando você abre o Search Console e vê milhares de erros “Not found”, não entre em pânico — só precisa corrigir os que realmente importam: páginas para as quais ainda apontam links, páginas no seu sitemap e páginas que recebiam tráfego. As que realmente morreram podem continuar em 404.
O único padrão que tem uma desvantagem real e documentada é um servidor que continua emitindo erros 5xx — esse é o caso em que o Google reduz o rastreamento e acaba removendo páginas. Mesmo assim, é reversível: corrija o servidor e ele se recupera.
Um passeio rápido pelos códigos
Cada um deles tem sua própria página aprofundada — aqui está a versão em uma linha:
- 401 / 403 — a página está bloqueada (é preciso fazer login ou o acesso foi proibido).
- 404 — página não encontrada. 410 — página removida definitivamente.
- 429 — “too many requests” (limitação de taxa). Parece um erro do cliente, mas o Google o trata como um erro do servidor.
- 451 — bloqueado por motivos legais (uma remoção ou um bloqueio por país).
- 500 / 502 / 503 / 504 — a família de erros do servidor (falha, gateway inválido, indisponibilidade e tempo limite do gateway).
- Soft 404 — o caso sorrateiro: uma página que diz “not found”, mas retorna
o código
200, então o Google continua verificando-a.
Quer entender a mecânica — exatamente como a taxa de rastreamento do Google reage, quando páginas são desindexadas, como tirar um site do ar do jeito certo e como monitorar tudo isso no Search Console? Mude para a aba Avançado.
TL;DR — Códigos de erro HTTP são as classes de status 4xx (cliente) e 5xx (servidor). O Google traça uma linha comportamental rígida entre elas: 4xx (exceto 429) significa “o conteúdo não existe” — a URL é removida do índice, com “no effect on crawl rate”; 5xx (e 429) significa “o servidor está falhando” — o Google limita o rastreamento proporcionalmente, preserva as URLs indexadas no início e só desindexa se os erros persistirem, aumentando depois a taxa de rastreamento gradualmente após a recuperação. Numericamente, 429 é um 4xx, mas o Google o chama de “a server error”. O conteúdo de qualquer resposta de erro é ignorado. 404 não é um sinal de qualidade (Mueller) — faça a triagem por links e tráfego, não corrija tudo e lembre que o impacto real de um erro isolado depende da URL (robots.txt tem tratamento especial de erros que uma página comum não tem). Soft 404 (um 200 que parece “not found”) é sinalizado pelo Google como desperdício de orçamento de rastreamento — principalmente uma preocupação de sites grandes, não um efeito garantido em todo site. Para uma indisponibilidade planejada, use 503 + Retry-After por “no máximo alguns dias” e nunca devolva 503 para robots.txt. Monitore a família no relatório Page Indexing do GSC. Este hub mapeia e encaminha para cada código individual.
A distinção que sustenta todo o tema
O código do protocolo descreve o resultado HTTP; um rótulo do Search Console descreve como o Google classificou uma busca observada. Evidence for this claim Primary standard or official documentation supporting the adjacent article claim. Scope: Protocol semantics and Search behavior are kept separate; no indexing, ranking, or migration-timing guarantee is inferred. Confidence: high · Verified: RFC 9110: Status codes Não deduza uma única causa-raiz nem um momento exato de remoção apenas a partir da família. Evidence for this claim Primary standard or official documentation supporting the adjacent article claim. Scope: Protocol semantics and Search behavior are kept separate; no indexing, ranking, or migration-timing guarantee is inferred. Confidence: high · Verified: Google: HTTP and network errors
Quatro camadas acabam reduzidas a “é um 404” quando as pessoas falam de erros, e mantê-las separadas é o que torna o restante desta página compreensível:
- Semântica do protocolo — o significado do código de status segundo a especificação HTTP (um 404 significa “not found”, ponto final).
- A busca observada — o que o Googlebot realmente recebeu em uma solicitação específica, em um horário específico, o que pode ser diferente do que um navegador vê.
- Processamento da pesquisa — como o pipeline de indexação do Google classifica e trata essa busca observada (remove a URL, limita o rastreamento ou ignora o corpo).
- Causa-raiz — o motivo real no seu servidor (um deploy incorreto, um banco sobrecarregado ou uma regra de WAF), que o código de status sozinho nunca informa.
Saber a família (4xx ou 5xx) informa qual das três primeiras camadas você está observando. Isso nunca substitui a camada 4 — você ainda precisa descobrir o motivo.
A documentação do próprio Google apresenta a divisão de forma clara, e vale internalizá-la antes de qualquer outra coisa: erros 4xx dizem “o conteúdo não existe”; erros 5xx dizem “o próprio servidor está falhando”. São problemas completamente diferentes, e o pipeline de indexação do Google responde a eles de maneiras completamente diferentes.
Um ponto de ancoragem útil: até um código de sucesso não é uma promessa. O Google diz claramente: “for Google Search, an HTTP 2xx (success) status code doesn’t
guarantee indexing.” Tradução: “para a Pesquisa Google, um código de status HTTP 2xx (sucesso) não garante a indexação.” Na verdade, os códigos de erro são a metade mais determinística do quadro — dizem ao Google, sem ambiguidade, “sumiu” ou “está quebrado”.
Como o Google trata erros 4xx
Para erros do cliente, o comportamento do Google é uniforme e direto: “Google doesn’t use
the content from URLs that return 4xx status codes,” e “Google crawlers
inform the next processing system that the content doesn’t exist.” Tradução: “o Google não usa o conteúdo de URLs que retornam códigos de status 4xx” e “os rastreadores do Google informam ao próximo sistema de processamento que o conteúdo não existe”. Mesmo que sua página 403 ou 404 mostre uma parede de texto real, nada disso é indexado — o corpo da resposta de erro é ignorado.
Duas consequências decorrem daí:
- URLs antes indexadas são removidas. Quando uma página retorna 4xx de forma confiável, o Google a remove do índice com o tempo.
- Não há penalidade de taxa de rastreamento. Este é o desmistificador: “The
4xxstatus codes, except429, have no effect on crawl rate.” Tradução: “os códigos de status 4xx, exceto 429, não afetam a taxa de rastreamento”. Uma montanha de 404 não torna mais lento o rastreamento do restante do site.
Esse último ponto elimina um mau instinto: não tente limitar o Googlebot com 401 ou 403. O Google adverte explicitamente: “don’t use 401 and 403 status codes for limiting the crawl rate.” Tradução: “não use códigos de status 401 e 403 para limitar a taxa de rastreamento”. Uma barreira de autenticação não desacelera o rastreamento — apenas torna o conteúdo invisível.
Como o Google trata erros 5xx (e 429)
Erros do servidor ativam o ramo de “the server is struggling” (“o servidor está com dificuldades”) e, aqui, o Google protege deliberadamente seu site:
- A taxa de rastreamento é limitada primeiro, proporcionalmente ao volume. “5xx and
429server errors prompt Google’s crawlers to temporarily slow down with crawling,” e “the decrease in crawl rate is proportionate to the number of individual URLs that are returning a server error.” Tradução: “erros de servidor 5xx e 429 fazem os rastreadores do Google reduzir temporariamente o ritmo do rastreamento” e “a redução da taxa de rastreamento é proporcional ao número de URLs individuais que retornam um erro de servidor”. Alguns 500 quase não aparecem; uma interrupção no site inteiro reduz muito o rastreamento. - URLs indexadas são preservadas… até os erros persistirem. “Already indexed URLs are preserved in the index, but eventually dropped,” e “removes from the index URLs that persistently return a server error.” Tradução: “URLs já indexadas são preservadas no índice, mas acabam sendo removidas” e “remove do índice URLs que retornam persistentemente um erro de servidor”. Uma oscilação breve não desindexa você; uma falha prolongada, sim.
- O conteúdo de 5xx também é ignorado. “Any content Google receives from URLs that return a 5xx status code is ignored.” Tradução: “qualquer conteúdo que o Google receba de URLs que retornam um código de status 5xx é ignorado”.
- A recuperação é automática, mas gradual. “Once the server starts responding with a 2xx status code, Google gradually increases the crawl rate for the site.” Tradução: “quando o servidor começa a responder com um código de status 2xx, o Google aumenta gradualmente a taxa de rastreamento do site”. O Google recua rapidamente e retoma com cautela — não existe um desbloqueio manual; corrija a causa-raiz e espere.
Por que 429 fica na categoria de erro do servidor
Esta é a nuance que mais passa despercebida na maioria dos guias. 429 Too Many Requests é numericamente um 4xx, mas o Google o trata como um sinal do servidor: “Google’s crawlers
treat the 429 status code as a signal that the server is overloaded, and it’s
considered a server error.” Tradução: “os rastreadores do Google tratam o código de status 429 como um sinal de que o servidor está sobrecarregado, e ele é considerado um erro do servidor”. Assim, um WAF ou limitador de taxa que começa a disparar 429 para o Googlebot limita seu rastreamento da mesma maneira que uma onda de 500 — não remove páginas individuais como um 404. Quando detalho os códigos no meu guia de códigos de status HTTP na Ahrefs, coloco 429 junto aos erros do servidor exatamente por esse motivo: é “a form of
rate-limiting to protect the server,” ou seja, “uma forma de limitação de taxa para proteger o servidor”, e faz o Google desacelerar.
Mapa da família de códigos de erro
Esta é a visão rápida de triagem de toda a família. Cada código abaixo tem seu próprio aprofundamento dentro deste hub (eles também estão na barra lateral):
Erros de bloqueio / acesso
- 401 Unauthorized — o cliente não se identificou nem se verificou quando necessário. Fica bloqueado para o Googlebot atrás de uma solicitação de autenticação.
- 403 Forbidden — o cliente é conhecido, mas não tem direitos de acesso.
Erros de não encontrado
- 404 Not Found — o recurso solicitado não foi encontrado.
- 404 vs 410 — a diferença prática entre “não encontrado” e “removido” (é menor do que as pessoas imaginam).
- 410 Gone — como um 404, mas também diz que o recurso não voltará. Remove páginas um pouco mais rápido.
O código de dupla identidade
- 429 Too Many Requests — limitação de taxa; numericamente é 4xx, mas o Google o trata como erro do servidor para fins de taxa de rastreamento.
Legal
- 451 Unavailable For Legal Reasons — bloqueado por motivo legal: bloqueios por país e remoções por DMCA.
Erros do servidor (5xx)
- 500 Internal Server Error — o servidor encontrou um problema que não consegue tratar.
- 502 Bad Gateway — uma resposta inválida de um servidor upstream.
- 503 Service Unavailable — o servidor está sobrecarregado ou em manutenção (o código correto para uma indisponibilidade planejada).
- 504 Gateway Timeout — nenhuma resposta oportuna de um servidor upstream.
O caso-armadilha
- Soft 404 — uma página que retorna
200 OK, mas parece dizer “não encontrado”. O pior dos dois mundos — mais detalhes abaixo.
Redirecionamentos quebrados são próximos de erros, mas são categorizados separadamente (o Google os exibe como “Redirect error” no Search Console, distinto de uma “follow up to 10 redirect hops” normal e funcional). Por padrão, os rastreadores do Google “follow up to 10 redirect hops” antes de desistir. Uma cadeia longa demais, um loop ou uma URL inválida transforma o caso nesse status de erro de redirecionamento.
Um erro HTTP prejudica seu SEO?
Comece pelo veredito: um erro isolado em uma página comum quase nunca é um problema, e 404s especificamente não são um sinal de ranking ou qualidade. Mueller foi explícito e repetiu isso. O reflexo — “I have 50,000 404s, my site must be penalized” — é o principal mito a desarmar. Erros são parte normal da web; fazer páginas retornarem 404 ou 410 é a maneira tecnicamente correta de lidar com URLs que não existem.
“Isolado” não significa “sempre inofensivo”, porém — o impacto real depende do que está retornando o erro. Uma página comum em 404 não é um acontecimento; um recurso especial é diferente. O Google dá ao robots.txt regras próprias de tratamento de erros, distintas das URLs regulares, portanto um erro de servidor no robots.txt pode afetar o rastreamento de um modo que o 404 de uma página comum nunca afetaria. Avalie o erro pela URL em que ele ocorre e pelo que depende dela, não apenas pelo código de status.
O padrão com um mecanismo real e documentado é o 5xx persistente e em massa: limitação da taxa de rastreamento → eventual desindexação. Mesmo isso é proporcional ao número de URLs com erro e geralmente reversível quando o servidor se recupera — o Google descreve a retomada como gradual, não instantânea. Portanto, trate o tempo exato, a cadência de novas tentativas e a velocidade de recuperação como dependentes das evidências (o que a documentação do Google descreve), não como uma garantia fixa. A distinção de Mueller é a que você deve lembrar: a taxa de rastreamento reage a erros do servidor (429/500/503/tempos limite), não a 404.
Desperdício de rastreamento versus desindexação — dois danos diferentes
É útil separar as duas maneiras pelas quais erros podem custar caro:
- Desindexação — 4xx persistente (página removida como “sumida”) ou 5xx persistente (páginas removidas após uma falha prolongada do servidor). Trata-se de páginas saindo do índice.
- Desperdício do orçamento de rastreamento — principalmente uma preocupação de sites grandes. O guia de orçamento de rastreamento do Google observa “if the site slows down or responds with server errors, the limit
goes down and Google crawls less.” Tradução: “se o site ficar lento ou responder com erros do servidor, o limite diminui e o Google rastreia menos”. Mas o verdadeiro desperdício de orçamento é o soft 404: “soft 404 pages will continue to be crawled, and waste your budget.” Tradução: “páginas soft 404 continuarão sendo rastreadas e desperdiçarão seu orçamento”. Como um soft 404 parece vivo (retorna
200), o Google continua verificando uma página que na verdade não está ali. Por isso o soft 404 é o caso do “pior dos dois mundos” — não sai de forma limpa como um 404 verdadeiro, permanece e queima buscas.
A armadilha do soft 404 tem duas causas comuns, ambas dignas de menção: um template personalizado de “página não encontrada” que retorna 200 em vez de um 404 real, e um redirecionamento indiscriminado de toda URL morta para a página inicial — o Google também reconhece esse padrão como soft 404. Uma página 404 amigável é boa para a experiência e totalmente recomendada — desde que ainda retorne o código HTTP 404 verdadeiro.
Como fazer uma indisponibilidade planejada corretamente
Quando você coloca intencionalmente um site (ou uma seção) offline, o código correto é **503 Service Unavailable com um cabeçalho Retry-After ** — nunca um 4xx. A orientação do Google para “pausar seu negócio on-line” é específica:
- “If you need to urgently disable the site for 1-2 days, then return an informational error page with a 503 HTTP response status code.” Tradução: “se você precisar desativar o site com urgência por 1–2 dias, retorne uma página de erro informativa com um código de status de resposta HTTP 503”.
- “This is an extreme measure that should only be taken for a very short period of time (a few days at most),” porque “completely closing a site even for just a few weeks can have negative consequences on Google’s indexing of your site.” Tradução: “esta é uma medida extrema, que só deve ser tomada por um período muito curto (no máximo alguns dias)” e “fechar completamente um site por apenas algumas semanas pode ter consequências negativas para a indexação do seu site pelo Google”.
- “Don’t block the website by returning 403, 404, 410 HTTP status codes” durante a indisponibilidade — um 4xx diz “sumiu permanentemente”, exatamente o sinal errado para uma interrupção temporária.
- A armadilha que quase todos deixam passar: “Don’t return a 503 HTTP response status code for the robots.txt file because this blocks all crawling.” Tradução: “não retorne um código de status de resposta HTTP 503 para o arquivo robots.txt, pois isso bloqueia todo o rastreamento”. Use 503 nas páginas, não no robots.txt.
Como monitorar toda a família no Search Console
No dia a dia, você encontrará esses erros no relatório Page Indexing do Search Console, onde cada um corresponde a um status distinto:
- Not found (404) — “this page returned a 404 error when requested.” Tradução: “esta página retornou um erro 404 quando solicitada”.
- Server error (5xx) — “your server returned a 500-level error when the page was requested.” Tradução: “seu servidor retornou um erro de nível 500 quando a página foi solicitada”.
- Blocked due to unauthorized request (401) — “the page was blocked to Googlebot by a request for authorization.” Tradução: “a página foi bloqueada para o Googlebot por uma solicitação de autorização”.
- Blocked due to access forbidden (403) — um 403 em que foram fornecidas credenciais, mas o acesso não foi concedido.
- Blocked due to other 4xx issue — um 4xx não coberto por outro status; use a Inspeção de URL para depurar.
- Soft 404 — uma “user-friendly ‘not found’ message but not a 404 HTTP response code.” Tradução: “mensagem amigável de ‘não encontrado’, mas não um código de resposta HTTP 404”.
- Redirect error — cadeia longa demais, loop, URL longa demais ou URL inválida na cadeia.
Cada status aponta para uma causa-raiz e um caminho de correção diferentes. Depois de resolver um deles, use Validate Fix para solicitar um novo rastreamento — mas mantenha expectativas realistas sobre o tempo; o novo rastreamento não é instantâneo. E lembre-se da formulação do próprio Google: “it’s fine for a URL not to be indexed for the right reasons — for example… a 404 for a page that you’ve removed and have no replacement for.” Tradução: “tudo bem uma URL não ser indexada pelos motivos corretos — por exemplo, um 404 para uma página que você removeu e para a qual não tem substituta”. Nem todo erro é uma tarefa.
O Search Console sozinho não basta para agir — é um ponto de vista, com amostragem e atraso. Ao registrar um erro para triagem, anote no mínimo: a URL, quando você a observou, o ponto de observação (Search Console, verificação ao vivo ou logs do servidor/CDN), o user agent da solicitação, o método HTTP, o código de status final e o caminho da resposta (incluindo qualquer cadeia de redirecionamento), se é isolado ou recorrente e uma etapa de verificação pós-correção depois do novo deploy. Triangular o GSC com uma verificação de status ao vivo e seus próprios logs é o que transforma uma linha antiga do relatório em um problema confirmado e corrigível.
Como corrigir e priorizar erros
- Faça a triagem dos 404 por valor. Corrija os que têm links de entrada, links internos, presença no sitemap ou tráfego persistente — redirecione-os com 301 para uma página relevante para recuperar a autoridade dos links. Deixe URLs realmente mortas em 404 ou 410. Como escrevi no meu guia da Ahrefs, a correção prática para a maioria é “you just need to 301 redirect each of these pages to a relevant page” — mas somente quando existe um destino relevante. Não redirecione tudo indiscriminadamente para a página inicial (isso é um soft 404).
- 410 versus 404 é uma diferença marginal. Um 410 remove uma página um pouco mais rápido que um 404; a diferença prática de SEO é pequena. Use 410 quando quiser deixar explícito que algo desapareceu de vez, mas não espere que seja dramaticamente melhor.
- Encontre a causa-raiz dos 5xx. As correções ficam no servidor: capacidade e tempos limite para 500, saúde do upstream/CDN para 502/504 e regras de WAF ou limitação de taxa que estejam bloqueando o Googlebot por engano em 403/429. Confirme o bot real com uma verificação de DNS reverso/direto antes de aplicar limitação de taxa.
- Causas-raiz comuns que vale nomear: erros da aplicação e do banco de dados e hosts sobrecarregados (5xx), falhas de upstream/CDN (502/504), limitação de taxa ou WAF bloqueando bots (403/429), migrações quebradas e links internos obsoletos (404) e páginas de erro amigáveis mal configuradas (soft 404).
Bing: um padrão semelhante, não um código verificado independentemente
As declarações públicas do Bing apontam na mesma direção da abordagem do Google — códigos na faixa dos 400 são tratados como ausentes ou proibidos, e códigos na faixa dos 500 sinalizam problemas do servidor que prejudicam a eficiência do rastreamento — mas não verifiquei de forma independente a paridade completa, atual e código a código na documentação do próprio Bing; portanto, trate isto como uma direção, não como uma correspondência confirmada. Fabrice Canel descreve o objetivo do Bing como “crawl efficiency north star … to crawl a URL only when
the content has been added … updated,”, e erros persistentes trabalham diretamente contra isso — o Bing gasta espaço de rastreamento em URLs que não produzem conteúdo novo e indexável. O Bing também recomenda 503 com Retry-After para indisponibilidades planejadas, em vez de servir páginas de erro como 200. Você encontra as superfícies de erros de rastreamento do Bing no Bing Webmaster Tools (URL Inspection, Crawl Control, Site Scan).
Para onde ir agora
Esta página é o hub conceitual da família de códigos de erro. Ela está dentro do cluster mais amplo HTTP Status Codes (o panorama completo de 1xx–5xx, além de redirecionamentos e códigos de sucesso); este sub-hub é o mapa da metade dos erros. Cada código abaixo tem seu próprio aprofundamento:
Bloqueio / acesso
- 401 Unauthorized — o que dispara o status “Blocked due to unauthorized request” e por que barreiras de autenticação não limitam o Googlebot.
- 403 Forbidden — credenciais fornecidas, mas acesso negado, e os padrões de WAF/bloqueio de bots que causam falsos 403 para o Googlebot.
Não encontrado
- 404 Not Found — como o Google trata páginas ausentes, por que isso não é uma penalidade e quais 404 você realmente deve corrigir.
- 404 vs 410 — a diferença real e pequena e quando recorrer a cada um.
- 410 Gone — o sinal de “removido permanentemente” e sua remoção um pouco mais rápida.
Limitação de taxa
- 429 Too Many Requests — o 4xx que se comporta como 5xx e como evitar que limites de taxa reduzam seu rastreamento.
Legal
- 451 Unavailable For Legal Reasons — remoções, bloqueios por país e como as remoções legais aparecem.
Erros do servidor
- 500 Internal Server Error — a falha genérica do servidor e como encontrar sua causa-raiz.
- 502 Bad Gateway — falhas do upstream/proxy.
- 503 Service Unavailable — o código correto para manutenção e indisponibilidade planejada (com a armadilha do robots.txt).
- 504 Gateway Timeout — tempos limite do upstream.
O caso-armadilha
- Soft 404 — o 200 que parece removido, por que desperdiça o orçamento de rastreamento e como transformá-lo em um 404 verdadeiro.
Redirecionamentos quebrados são tratados separadamente como o status Redirect error — relacionados, mas categorizados à parte no Search Console.
Resumo de IA
Uma síntese da versão Avançada:
- Duas famílias, dois comportamentos. 4xx = “o conteúdo não existe”; 5xx = “o servidor está falhando”. O pipeline de indexação do Google responde de forma muito diferente a cada um.
- 4xx (exceto 429): o conteúdo é ignorado, a URL sai do índice e há “no effect on crawl rate.”. Não use 401/403 para limitar o Googlebot — o Google diz explicitamente para não fazer isso.
- 5xx (e 429): o Google limita o rastreamento primeiro (proporcionalmente ao número de URLs com erro), preserva as URLs indexadas no início e só desindexa se os erros persistirem. A recuperação é automática, mas a taxa de rastreamento volta gradualmente.
- 429 é a exceção: numericamente 4xx, mas o Google o trata como “a server error” para fins de taxa de rastreamento — ele se comporta como um 5xx.
- 404 não é sinal de qualidade/classificação (Mueller). Não entre em pânico por causa da quantidade de erros; faça a triagem por links, presença no sitemap e tráfego — use 301 nos que importam e deixe páginas mortas retornarem 404/410.
- O impacto de um erro isolado depende da URL, não apenas do código de status — uma página comum em 404 não é um acontecimento, mas recursos especiais como robots.txt têm seu próprio tratamento de erros e podem afetar o rastreamento de outra forma.
- Soft 404 é a armadilha: um
200que parece dizer “not found”, que o Google identifica como desperdício de orçamento porque continua verificando uma página que parece viva — principalmente uma preocupação de sites grandes, não um efeito garantido em todos. - 410 versus 404 é marginal — 410 é removido um pouco mais rápido; a diferença prática é pequena.
- Indisponibilidade planejada: use 503 + Retry-After, “no máximo alguns dias”, nunca 403/404/410 e nunca use 503 no robots.txt (isso bloqueia todo o rastreamento).
- Monitore pelo relatório Page Indexing do GSC — sete status (404, 5xx, 401, 403, outro 4xx, soft 404 e erro de redirecionamento) — além de suas próprias verificações ao vivo e logs do servidor, usando Validate Fix.
- As declarações públicas do Bing apontam na mesma direção das do Google — mas a paridade completa código a código não foi verificada de forma independente; o Bing também recomenda 503 + Retry-After durante indisponibilidade.
Documentação oficial
Documentação de fonte primária dos mecanismos de busca.
- HTTP status codes, network errors, and DNS errors — a documentação definitiva sobre como o Google trata 4xx, 5xx, 429, redirecionamentos e erros de rede/DNS.
- Page Indexing report (Ajuda do Search Console) — todos os status de erro que você verá no dia a dia (404, 5xx, 401, 403, outro 4xx, soft 404, erro de redirecionamento) e o Validate Fix.
- Optimize your crawl budget — como erros do servidor reduzem o limite de rastreamento e por que soft 404 desperdiça orçamento.
- Pause your online business in Google Search — o procedimento 503 + Retry-After para indisponibilidade planejada e o que não fazer.
- Soft 404 errors — o que é um soft 404 e como corrigi-lo.
- Make your 404 pages more useful — orientação antiga, mas ainda válida: uma página 404 amigável é aceitável desde que retorne um código 404 verdadeiro.
Bing / Microsoft
- Crawl error alerts (Ajuda do Bing Webmaster Tools) — onde o Bing exibe erros de rastreamento.
- bingbot Series: Maximizing Crawl Efficiency — a “estrela-guia de eficiência de rastreamento” do Bing, contra a qual erros persistentes trabalham.
Citações da fonte
Declarações registradas do Google e do Bing. Cada link é um deep link que salta até a passagem citada na fonte.
Google — a divisão entre 4xx e 5xx
- “For Google Search, an HTTP
2xx (success)status code doesn’t guarantee indexing.” — documentação do Google Search Central. Ir para a citação - “Google doesn’t use the content from URLs that return
4xxstatus codes.” Ir para a citação - “The
4xxstatus codes, except429, have no effect on crawl rate.” Ir para a citação
Google — 5xx e 429
- “5xx and
429server errors prompt Google’s crawlers to temporarily slow down with crawling.” Ir para a citação - “already indexed URLs are preserved in the index, but eventually dropped.” Ir para a citação
- “Any content Google receives from URLs that return a 5xx status code is ignored.” Ir para a citação
- “Google’s crawlers treat the
429status code as a signal that the server is overloaded, and it’s considered a server error.” Ir para a citação
Google — orçamento de rastreamento e soft 404
- “If the site slows down or responds with server errors, the limit goes down and Google crawls less.” Ir para a citação
- “Soft 404 pages will continue to be crawled, and waste your budget.” Ir para a citação
Google — indisponibilidade planejada
- “If you need to urgently disable the site for 1-2 days, then return an informational error page with a 503 HTTP response status code.” Ir para a citação
- “Don’t return a 503 HTTP response status code for the robots.txt file because this blocks all crawling.” Ir para a citação
Google — tudo bem não estar no índice
- “It’s fine for a URL not to be indexed for the right reasons — for example, an expected robots.txt rule on your site, a noindex tag on the page, a duplicate URL, or a 404 for a page that you’ve removed and have no replacement for.” — Ajuda do Search Console. Ir para a citação
John Mueller, Google — 404s não são um sinal de qualidade
- “404s are not a quality signal, it’s not a SEO signal.” Leia a cobertura
- Sobre a reação da taxa de rastreamento: “I’d only expect the crawl rate to react that quickly if they were returning 429 / 500 / 503 / timeouts… (404s are generally fine & once discovered, Googlebot will retry them anyway)… Once things settle down on the server, the crawl rate will return to normal automatically.” Leia a cobertura
Fabrice Canel, da Microsoft Bing
- “Our crawl efficiency north star is to crawl a URL only when the content has been added (URL not crawled before), updated (fresh on-page context or useful outbound links).” Ir para a citação
Qual erro devo tratar primeiro?
Quando surge um lote de erros, faça a triagem nesta ordem — saúde do servidor antes de páginas ausentes, porque é aí que está o dano real em todo o site.
1. Você está vendo 5xx ou 429 (erro do servidor ou um pico de timeouts)?
- Sim → Trate como urgente. Este é o ramo que reduz o rastreamento em todo o site e pode remover páginas do índice se persistir. Encontre a causa raiz agora: capacidade/timeouts do servidor (500), saúde do upstream/CDN (502/504) ou um WAF/limitador de taxa bloqueando o Googlebot por engano (403/429). A recuperação é automática assim que você volta a retornar
2xx, mas a taxa de rastreamento sobe novamente de forma gradual. - Não → Siga adiante; 4xx não afeta a taxa de rastreamento.
2. É um soft 404 (um 200 que parece dizer “not found”)?
- Sim → Corrija o código da resposta. Retorne um 404/410 real ou, se a página mudou, redirecione-a com 301 para uma página relevante. Pare de redirecionar URLs mortas indiscriminadamente para a página inicial. Soft 404s desperdiçam orçamento de rastreamento porque o Google continua verificando-os.
- Não → Continue.
3. É um 404 / 410 (Not found / Gone)?
- A URL tem links recebidos, links internos, presença no sitemap ou tráfego persistente?
- Sim → Redirecione-a com 301 para uma página relevante, recuperando a equidade.
- Não → Deixe-a como está. Uma página realmente morta deve simplesmente retornar 404/410 — não é uma penalidade, e você não precisa corrigi-la.
4. É um 401 / 403 (Blocked)?
- Esta página deveria ser pública? Sim → Corrija a configuração de autenticação/permissão ou a regra de WAF que está bloqueando o Googlebot. Não → É aceitável que esteja bloqueada — mas não espere que 401/403 limitem o Googlebot; eles apenas tornam o conteúdo invisível.
5. É um 451 (Legal)?
- É uma remoção legal ou um bloqueio geográfico, não um bug técnico — trate pelo processo jurídico/de compliance, não pelo de SEO.
6. É um Redirect error?
- Encurte a cadeia (o Google segue aproximadamente 10 saltos), desfaça o loop ou corrija a URL inválida/longa demais na cadeia para que ela resolva para um único
200final.
Remoção do índice ou desperdício de rastreamento — qual dano estou enfrentando?
- Páginas saindo do índice? → Procure 4xx persistentes (removidas como “desaparecidas”) ou 5xx persistentes (removidas depois de uma falha sustentada). Erros isolados não fazem isso.
- Orçamento de rastreamento sendo consumido (sites grandes)? → Procure soft 404s e erros em massa — as páginas que continuam sendo rastreadas novamente porque parecem vivas.
Tabela de consulta: código de erro → comportamento → correção
Como o Google trata cada código
| Código | Classe | O que significa | Reação do Google à taxa de rastreamento | Correção |
|---|---|---|---|---|
| 401 | 4xx | Não autenticado | Nenhuma (não use para limitar) | Corrija a autenticação se deveria ser público |
| 403 | 4xx | Autenticado, mas proibido | Nenhuma | Corrija permissões / regra de WAF |
| 404 | 4xx | Não encontrado | Nenhuma | 301 se tiver links/tráfego; caso contrário, deixe como está |
| 410 | 4xx | Removido definitivamente | Nenhuma | Use quando realmente tiver desaparecido (remove um pouco mais rápido) |
| 429 | 4xx* | Muitas solicitações | Limita (tratado como erro do servidor) | Aumente/afrouxe os limites de taxa para o Googlebot |
| 451 | 4xx | Bloqueado por razões legais | Nenhuma | Trate pelo jurídico, não pelo SEO |
| 500 | 5xx | Erro interno do servidor | Limita; remove do índice se persistir | Corrija o erro do app/DB e a capacidade |
| 502 | 5xx | Gateway inválido (upstream) | Limita | Corrija o upstream / CDN |
| 503 | 5xx | Indisponível / manutenção | Limita (destinado a indisponibilidade) | Adicione Retry-After; mantenha curto |
| 504 | 5xx | Timeout do gateway (upstream) | Limita | Corrija o timeout do upstream |
| Soft 404 | 200 | Parece “not found” | Continua rastreando → desperdiça orçamento | Retorne 404/410 real ou faça 301 para uma página relevante |
Fatos rápidos
- 4xx (exceto 429): conteúdo ignorado, URL removida, zero efeito na taxa de rastreamento.
- 5xx + 429: limite primeiro, remoção do índice apenas se persistir, recuperação gradual.
- 404s não são um sinal de qualidade/ranking — faça a triagem por links/tráfego.
- Soft 404 é a armadilha:
200que parece removido → desperdiça orçamento de rastreamento. - Indisponibilidade planejada = 503 + Retry-After, “no máximo alguns dias”, nunca 403/404/410 — e nunca 503 no robots.txt (bloqueia todo o rastreamento).
- Redirecionamentos: o Google segue até aproximadamente 10 saltos; cadeias longas demais ou em loop = “Redirect error” no GSC.
Status do Page Indexing do GSC para acompanhar Not found (404) · Server error (5xx) · Blocked due to unauthorized request (401) · Blocked due to access forbidden (403) · Blocked due to other 4xx issue · Soft 404 · Redirect error — depois use Validate Fix quando estiver resolvido.
Recursos que valem seu tempo
Textos relacionados meus
- HTTP Status Codes & Their SEO Impact — minha análise completa, código a código: 4xx, 5xx, 429 e as correções práticas em toda a faixa de códigos de status.
- 11 Types Of Redirects & Their SEO Impact — o lado dos redirecionamentos, uma causa importante tanto de erros de redirecionamento quanto de soft 404s.
- The Beginner’s Guide to Technical SEO — onde os códigos de status se encaixam no quadro maior.
Minhas palestras
- How Search Works (SlideShare) — minha explicação de rastreamento, renderização, indexação e veiculação, incluindo como os códigos de status controlam o pipeline. (Meu aviso permanente se aplica: “This is my understanding of systems… not going to be 100% complete or accurate.”)
Ao redor do setor
- Googlebot Crawl Slump? Mueller Points To Server Errors (Search Engine Journal) — a matéria que sustenta a distinção “a taxa de rastreamento reage a 429/500/503/timeouts, não a 404s”, nas palavras do próprio Mueller.
- The ultimate guide to HTTP status codes for SEO (Search Engine Land) — uma referência ampla para todas as classes de status.
- HTTP Status Codes Explained (Semrush) — visão geral dos grupos de códigos com foco na implementação.
- An SEO Guide to HTTP Status Codes (Search Engine Journal) — referência código a código com contexto de SEO.
- r/TechSEO — a comunidade para depurar erros de rastreamento e indexação.
O modelo dos dois danos: desaparecimento versus limitação de rastreamento
Não priorize um erro HTTP apenas pelo primeiro dígito. Pergunte qual dos dois danos ele cria.
Dano 1: a URL diz que o conteúdo não existe
A maioria das respostas 4xx informa ao Google que o conteúdo solicitado está indisponível. O Google não indexa o corpo retornado, e uma URL afetada de forma persistente pode sair do índice. Em geral, o escopo é a própria URL; respostas 4xx comuns não informam ao Google que o servidor inteiro está insalubre. A exceção é 429, que o Google trata como um problema de disponibilidade do servidor.
Pergunta de decisão: Esta URL deveria existir, receber tráfego ou preservar links? Se sim, corrija o status incorreto ou envie os usuários para um destino genuinamente equivalente. Se não, um 404 ou 410 pode ser o resultado correto, e não um problema de SEO.
Dano 2: o servidor diz que não consegue responder de forma confiável
Respostas 5xx e 429 sinalizam problemas de disponibilidade ou capacidade. O Google pode reduzir o rastreamento para não aumentar a carga; apenas falhas sustentadas ameaçam URLs indexadas. Portanto, o dano pode se espalhar além de uma URL com falha, causando descoberta e atualização mais lentas em todo o site.
Pergunta de decisão: A falha é persistente ou ampla o bastante para mudar o comportamento do crawler? Se sim, trate-a como um incidente de infraestrutura e restaure respostas confiáveis. Não tente “corrigi-la” dentro do Search Console.
Camada de prioridade: valor e intenção
Depois de escolher o dano, ordene as URLs afetadas conforme deveriam estar ativas, tenham links internos ou externos, apareçam em um sitemap, recebam tráfego de busca ou representem um template crítico. Uma contagem de erros sem esse contexto não é uma lista de prioridades.
Matriz de evidência/ação: o que registrar por erro
O modelo dos dois danos informa qual problema você está enfrentando. Esta matriz é o que você deve registrar de fato para cada URL afetada antes de decidir o que fazer — ignorar qualquer uma dessas colunas é como uma lista de triagem vira um palpite:
| Dimensão | O que registrar | Por que importa |
|---|---|---|
| Intencionalidade | Esta URL deveria existir e estar ativa agora? | Separa um defeito real de uma remoção esperada |
| Importância da URL | Links, presença no sitemap, tráfego, criticidade do template | Define a prioridade da correção — o erro sozinho não define |
| Família / código | Status exato observado (404, 410, 429, 500…) | Determina em qual categoria de dano ele entra |
| Escopo | Uma URL, um template ou todo o site | Um padrão é um incidente; uma única URL normalmente não é |
| Duração | Primeiro registro, ainda recorrente ou resolvido | Isolado ≠ persistente — só a persistência causa remoção do índice/limitação |
| Ponto de descoberta | Search Console, verificação de status ao vivo ou logs do servidor/CDN | Cada ponto enxerga algo diferente; triangule, não confie em apenas um |
| Impacto para o usuário | Um visitante real também encontra o erro ou apenas crawlers? | Um problema exclusivo de crawler e uma indisponibilidade para usuários têm prioridades diferentes |
| Responsável | Quem corrige — equipe de app, infraestrutura, conteúdo ou jurídico | A causa raiz define o caminho da correção, não o código de status |
| Verificação | Como você confirmará a correção (nova verificação, Validate Fix, nova leitura dos logs) | Uma “correção” não verificada não é uma correção |
Prompt: transforme uma exportação de erros do GSC em uma fila de triagem
Exporte a lista de URLs afetadas do Search Console e, quando possível, enriqueça-a com código de status, presença no sitemap, cliques/impressões orgânicos, links internos, links externos e estado pretendido da URL. Cole apenas dados não sensíveis.
You are triaging an HTTP-error URL export for technical SEO. Use only the supplied
columns. Do not assume that every 404 is a problem or that every 5xx is permanent.
For each URL:
1. Classify the response as 4xx disappearance risk, 5xx/429 crawl-throttling risk,
soft-404 mismatch, or insufficient evidence.
2. Decide whether the URL appears intended to exist, based only on sitemap presence,
links, traffic, template, and the supplied intended-state field.
3. Assign priority: incident-now, high, medium, low, or expected/no fix.
4. Explain the priority using the exact supplied signals.
5. Recommend the next verification, not a guessed root cause.
Prioritize broad or persistent 5xx/429 incidents first, then intended URLs with
traffic or links, then sitemap/internal-link hygiene. Keep intentional 404/410 URLs
out of the fix queue. Return a table plus a short list of missing data that would
change the ranking.
DATA:
[PASTE SANITIZED EXPORT HERE]Verifique o resultado com checagens de status ao vivo e com o mapa de URLs pretendido do site antes de atribuir o trabalho.
Ferramentas para triagem de erros
- Bulk HTTP Status Code Checker — cole as URLs exportadas para coletar códigos de status ao vivo, cadeias de redirecionamento, destinos e latência; depois filtre e exporte o resultado. Isso transforma uma linha antiga do relatório em evidência HTTP atual.
- Website Down Checker — verifique se um incidente 5xx suspeito pode ser reproduzido externamente antes de mudar configurações do aplicativo ou do crawler.
- Relatório Page Indexing do Google Search Console — identifique os grupos de motivos do Google e exemplos afetados; use a inspeção de URL para uma verificação ao vivo representativa.
- Logs de acesso do servidor ou CDN — meça as taxas de erro voltadas aos crawlers e diferencie um problema de uma única URL de um padrão de disponibilidade em todo o site.
O Search Console relata o que o Google observou; ele não substitui uma solicitação ao vivo nem as evidências do servidor necessárias para descobrir a causa.
URLs pretendidas retornando erros
Métrica: Contagem e proporção de URLs que deveriam estar ativas, mas retornam 4xx, 5xx ou 429, segmentadas por família de resposta e template.
O que informa: Separa defeitos reais de disponibilidade/indexação da limpeza intencional de 404/410.
Como obter: Combine um rastreamento atual ou uma exportação do Bulk HTTP Status Code Checker com seu sitemap, grafo de links internos e inventário de URLs pretendidas.
Referência / faixa realista: A meta é zero erros não intencionais nas URLs que precisam estar ativas. URLs aposentadas esperadas devem ser acompanhadas separadamente, não forçadas a uma meta inventada de taxa de erro para todo o site.
Periodicidade: Diariamente para templates críticos e durante releases; semanalmente para o inventário mais amplo.
Taxa de erro das solicitações de crawlers
Métrica: Solicitações de mecanismos de busca que retornam 4xx, 429 ou 5xx como proporção das solicitações verificadas de crawlers, separadas por status, hostname e grupo de caminhos.
O que informa: Mostra se o desperdício do crawler está concentrado em URLs aposentadas ou se falhas do servidor podem estar suprimindo a demanda de rastreamento.
Como obter: Agregue solicitações verificadas de crawlers a partir dos logs de acesso do CDN ou servidor; não confie apenas na string de user-agent quando a verificação estiver disponível.
Referência / faixa realista: Estabeleça a combinação normal do seu site. 404s intencionais podem ser legítimos; respostas 5xx/429 sem explicação em URLs pretendidas não devem ser tratadas como ruído normal da linha de base.
Periodicidade: Monitore continuamente alertas de 5xx/429; revise as tendências segmentadas semanalmente.
Tendência do inventário de erros do Search Console
Métrica: Contagens de URLs afetadas por motivo do Page Indexing, associadas ao estado de uma URL representativa e à data de atualização do relatório.
O que informa: Se o inventário observado pelo Google está diminuindo após as correções ou se está se expandindo para templates adicionais.
Como obter: Exporte as tabelas de motivos do Page Indexing e mantenha snapshots datados; verifique exemplos pontuais com a inspeção de URL e solicitações ao vivo.
Referência / faixa realista: Compare com o estado pretendido do site e com seus próprios snapshots anteriores. O Search Console usa amostragem e atraso, portanto não invente um limite de aprovação em tempo real.
Periodicidade: Semanalmente e depois que o Google tiver tempo para rastrear novamente uma correção publicada; use logs e verificações ao vivo para monitoramento imediato de incidentes.
Teste seus conhecimentos: códigos de erro HTTP
Cinco perguntas rápidas sobre como o Google trata erros 4xx e 5xx. Escolha uma resposta para cada uma e depois confira.
Registro de alterações
Atualizado em 18 de jul. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.