Páginas órfãs
Páginas órfãs não têm links internos, então os mecanismos de busca têm dificuldade para encontrá-las e elas recebem zero PageRank interno. Como identificá-las e corrigi-las.
Idiomas
1 sinal de evidência nesta página
- Ferramenta relacionada ativaGoogle Index Checker
Uma página órfã é aquela para a qual nada no seu site aponta internamente. Como o Google descobre páginas principalmente seguindo links, uma órfã sem entrada no sitemap e sem backlinks é efetivamente invisível — e mesmo quando é encontrada via sitemap, ela recebe zero PageRank interno e muitas vezes cai em 'Descoberta — atualmente não indexada'. Um rastreador sozinho não consegue encontrar órfãs (ele só segue links que consegue alcançar); você precisa comparar o rastreamento com seu sitemap, analytics e dados de backlinks. Corrija as que você quer ranquear adicionando links internos contextuais; coloque noindex nas intencionais (PPC e páginas de agradecimento); redirecione ou exclua as demais.
Evidence for this claim Google discovers pages through links and recommends that every page you care about have a link from at least one other page on the site. Scope: Current Google link and discovery guidance. Confidence: high · Verified: Google Search Central: Link best practices Evidence for this claim Sitemaps can help search engines discover URLs but do not guarantee crawling or indexing and do not replace navigational links. Scope: Current Google sitemap behavior. Confidence: high · Verified: Google Search Central: Learn about sitemapsTL;DR — Uma página órfã é uma página do seu site para a qual nenhuma outra página tem link. Os mecanismos de busca encontram páginas seguindo links, então uma órfã é fácil de passar despercebida — muitas vezes ela não é rastreada, indexada ou recebe tráfego. A solução geralmente é simples: coloque links para ela a partir de algumas páginas relevantes do seu site.
O que é uma página órfã
Imagine seu site como uma rede de salas conectadas por portas. As portas são seus links internos. Uma página órfã é uma sala sem portas de entrada — você só consegue chegar até ela se já souber o endereço exato.
Isso é um problema porque os mecanismos de busca não sabem o endereço com antecedência. Eles encontram páginas principalmente seguindo links: um bot chega a uma página, pega os links nela e visita esses em seguida. Se nenhuma página tem link para uma página, o bot não tem um caminho para seguir, então a página pode passar despercebida — e uma página que nunca é encontrada não pode aparecer na busca.
Por que páginas órfãs são um problema
- Elas são difíceis de descobrir. Sem links internos, não há um caminho de links para o Google seguir.
- Elas perdem o “suco de links”. Links distribuem autoridade pelo seu site. Uma órfã não recebe nada disso, então até conteúdo bom tem dificuldade para ranquear.
- Elas frequentemente ficam sem indexação. Um status comum no Search Console, “Descoberta — atualmente não indexada”, aparece com frequência para páginas órfãs: o Google sabe que a URL existe, mas não acha que vale a pena indexá-la.
Como uma página acaba órfã
Raramente é de propósito. Os culpados mais comuns:
- Você reformulou o site ou mudou o menu e uma página foi removida da navegação.
- Um post de blog nunca foi atribuído a uma categoria ou tag.
- Um produto foi descontinuado, mas a página foi mantida no ar.
- Uma página só existiu como algo pontual (uma página de campanha ou de anúncio).
Como encontrar e corrigir
Você não consegue encontrar órfãs apenas rastreando seu site — um rastreador só vê páginas que ele consegue alcançar seguindo links, o que por definição exclui órfãs. Em vez disso, você compara duas listas: as páginas que um rastreador encontrou e todas as páginas que você sabe que existem (seu sitemap, suas análises, o Search Console). Qualquer coisa na segunda lista que não esteja na primeira é uma órfã.
Para corrigir uma que você realmente quer ranquear: adicione alguns links internos para ela a partir de
páginas relacionadas, usando texto âncora claro que descreva a página. Se for uma página que você
não quer na busca (como uma página de agradecimento após uma compra), a resposta
não são links — é uma tag noindex. E se for antiga e inútil, redirecione para algo
relevante ou remova-a.
Quer os dados, as citações do Google e o fluxo de auditoria exato? Mude para a aba Avançado.
Evidence for this claim Google discovers pages through links and recommends that every page you care about have a link from at least one other page on the site. Scope: Current Google link and discovery guidance. Confidence: high · Verified: Google Search Central: Link best practices Evidence for this claim Sitemaps can help search engines discover URLs but do not guarantee crawling or indexing and do not replace navigational links. Scope: Current Google sitemap behavior. Confidence: high · Verified: Google Search Central: Learn about sitemapsTL;DR — O Google descobre URLs de três maneiras — seguindo links (principal), sitemaps (complementar) e rastreando novamente páginas que já conhece. Uma página órfã (sem links internos) sem entrada no sitemap e sem backlinks não tem nenhum caminho de descoberta. Mesmo quando um sitemap faz com que ela seja rastreada, ela recebe zero PageRank interno, e é por isso que órfãs se concentram em “Descoberta — atualmente não indexada.” Um rastreamento sozinho não consegue encontrar órfãs — você compara o rastreamento com um superconjunto de URLs conhecidas (sitemap, análises, GSC, índice de backlinks). Corrija as que você quer ranquear com links internos contextuais; use
noindexnas intencionais; redirecione ou exclua o restante. Em nosso estudo com 1 milhão de domínios, 66,2% dos sites tinham páginas com apenas um link interno dofollow — órfãs são o extremo de um problema muito comum de pobreza de links internos.
O que torna uma página órfã
Uma página órfã é uma página para a qual nenhuma outra página do seu site tem link internamente. Essa é a definição completa — trata-se de links internos de entrada, nada mais. Uma página pode ter um monte de backlinks externos e ainda assim ser órfã internamente. Uma página pode estar no seu sitemap XML e ainda assim ser órfã. O status de órfã é medido apenas com base no grafo de links internos do seu site.
Ajuda pensar em links internos como um espectro, em vez de algo binário. Páginas verdadeiramente órfãs (zero links internos) são o pior caso; um único link interno é apenas um pouco melhor; uma página bem linkada está no extremo saudável. Quando estudamos mais de um milhão de domínios para o estudo do Site Audit da Ahrefs, 66,2 % dos sites tinham páginas com apenas um único link interno dofollow de entrada. Como eu disse na época: “At least it’s not a completely orphaned page. But if it’s a page that you want to rank, you may want to add some more internal links.” (tradução) «Pelo menos não é uma página completamente órfã. Mas, se é uma página que você quer ranquear, talvez você queira adicionar mais alguns links internos.» Órfãs são apenas o extremo do mesmo problema de sub-linkagem.
Por que páginas órfãs são um problema de SEO
Os mecanismos de busca não conseguem descobri-las de forma confiável
O Google é explícito sobre como encontra URLs. “There isn’t a central registry of all web pages, so Google must constantly look for new and updated pages.” (tradução) «Não existe um registro central de todas as páginas da web, então o Google precisa procurar constantemente por páginas novas e atualizadas.» Ele faz isso de três maneiras: páginas que já conhece de rastreamentos anteriores, “when Google extracts a link from a known page to a new page,” (tradução) «quando o Google extrai um link de uma página conhecida para uma página nova», e “when you submit a list of pages (a sitemap) for Google to crawl.” (tradução) «quando você envia uma lista de páginas (um sitemap) para o Google rastrear.»
Seguir links é o mecanismo principal; sitemaps são complementares, não um substituto. A própria orientação de práticas recomendadas de links do Google é direta: “Every page you care about should have a link from at least one other page on your site.” (tradução) «Toda página que você considera importante deve ter um link de pelo menos uma outra página do seu site.» Uma página órfã sem entrada no sitemap e sem backlinks externos não tem nenhum dos três caminhos de descoberta — ela é genuinamente invisível para o Googlebot.
Evidence for this claim Google discovers pages through links and recommends that every page you care about have a link from at least one other page on the site. Scope: Current Google link and discovery guidance. Confidence: high · Verified: Google Search Central: Link best practicesJohn Mueller chamou os links internos de “super critical for SEO… one of the biggest things that you can do on a website to kind of guide Google and guide visitors to the pages that you think are important.” (tradução) «supercríticos para SEO… uma das maiores coisas que você pode fazer em um site para meio que guiar o Google e guiar os visitantes para as páginas que você considera importantes.» A abordagem dele é sobre a distância de links das suas páginas de hub importantes, não apenas a contagem bruta de links — uma página órfã tem distância de link infinita, porque não é alcançável pelo seu grafo de links de forma alguma.
Elas não recebem PageRank interno
O PageRank ainda sustenta a autoridade baseada em links do Google, e links internos são a tubulação que o move pelo seu site. Uma página órfã está desconectada dessa tubulação, então recebe zero PageRank interno, não importa quão bom seja seu conteúdo.
Este é o ângulo que a maioria das pessoas ignora, e ele funciona nos dois sentidos. Uma página com backlinks externos fortes, mas sem links internos, não é apenas subutilizada — é um vazamento de PageRank. A autoridade flui para essa página de fora e depois não tem para onde ir, porque nenhum link interno a leva adiante para o resto do seu site. Adicione links internos e você tanto fortalece a página órfã quanto permite que sua equidade de entrada circule.
Elas se concentram em “Descoberta — atualmente não indexada”
Quando o Google sabe que uma URL existe (por um sitemap ou um link externo), mas decide não indexá-la, o GSC reporta “Discovered — currently not indexed.” (tradução) «Descoberta — atualmente não indexada.» Páginas órfãs são uma causa clássica: o Google encontrou a URL, mas, sem links internos apontando para ela, não há sinal de que a página importa, então ela é despriorizada. Adicionar links internos de páginas relevantes é uma das maneiras mais confiáveis de tirar essas URLs desse grupo. (Não é a única causa — conteúdo raso e orçamento de rastreamento também entram — mas é uma das primeiras coisas que eu verifico.)
Elas podem desperdiçar orçamento de rastreamento — mas principalmente em sites grandes
Para o site médio, isso mal se registra. Em sites muito grandes (pense em 100 mil+ páginas, ou grandes quantidades de URLs que mudam rapidamente), grandes conjuntos de URLs órfãs e quase órfãs consomem orçamento de rastreamento sem retribuir. A maioria dos sites genuinamente não precisa pensar nisso; se você está abaixo dessa escala, trate órfãs como um problema de descoberta e PageRank, não de orçamento de rastreamento.
Causas comuns
- Migrações e reformulações — as URLs sobrevivem à mudança, mas os links que apontavam para elas não são reconstruídos.
- Mudanças de navegação — uma página é removida do menu e nada substitui o link.
- Lacunas no fluxo de trabalho do CMS — uma postagem é publicada sem ser atribuída a uma categoria ou tag, então o único caminho de link (o arquivo de categoria) nunca é criado. WordPress e CMSs semelhantes geram muitas URLs de paginação e arquivo que podem deixar conteúdo órfão dessa forma.
- Produtos descontinuados — a página do produto permanece ativa após ser removida das listagens.
- Landing pages de campanha e PPC — criadas para serem acessadas por um anúncio, nunca vinculadas ao site (muitas vezes intencional).
- Conteúdo de staging, teste e microsites isolados — deixado publicamente acessível e nunca integrado ao grafo de links principal.
Como encontrar páginas órfãs
O método principal é uma comparação de duas listas, porque nenhum rastreamento pode encontrar órfãs por conta própria:
- Lista 1 — páginas alcançáveis. Execute um rastreador de site que começa na sua página inicial e segue links internos. Isso é tudo que o Google poderia descobrir seguindo links.
- Lista 2 — todas as páginas conhecidas. Reúna todas as URLs que você sabe que existem: seu sitemap XML, Google Analytics (páginas com sessões), páginas do GSC, seu índice de backlinks e logs do servidor.
- Órfãs = na Lista 2, mas não na Lista 1.
No Ahrefs Site Audit, isso é integrado — ele inicia o rastreamento a partir dos seus sitemaps, do índice de backlinks do Ahrefs e dos dados conectados do GA/GSC, e então sinaliza qualquer URL que ele conhece, mas não conseguiu alcançar por links internos, como “Página órfã”. No Screaming Frog, você envia seu sitemap, GA e dados do GSC como fontes de URL, executa o rastreamento no modo lista/rastreamento e usa a análise do rastreamento para revelar URLs que aparecem nessas fontes, mas não foram encontradas seguindo links. Com apenas o GSC, você não consegue ver a estrutura do site, mas URLs em “Descobertas — atualmente não indexadas” que não aparecem no seu rastreamento são fortes suspeitas de órfãs.
Como corrigi-las
Faça a triagem pelo valor primeiro — nem toda órfã merece um link.
Antes de fazer a triagem, confirme se o candidato em si vale a pena receber links: verifique seu status de resposta, seu alvo canônico e se está definido como noindex. Vincular a uma URL que redireciona, retorna 404, canonicaliza para outro lugar ou é deliberadamente excluída do índice não é uma correção — apenas adiciona um link quebrado ou desperdiçado. Somente páginas que resolvem corretamente e são destinadas à indexação pertencem ao grupo “adicionar links” abaixo.
- Páginas valiosas que você quer ranquear → adicione links internos. Encontre páginas topicamente relevantes e vincule a partir delas com texto âncora descritivo. Priorize vincular a partir de páginas que já têm autoridade interna (páginas hub e cluster) e certifique-se de que a página também esteja no seu sitemap XML.
- Órfãs intencionais (PPC, agradecimento, algumas páginas legais) →
noindex. Elas não precisam de links internos; precisam ser mantidas fora do índice de forma limpa. Adicionar links seria a correção errada. Dê a cada categoria de órfã intencional um proprietário nomeado e um motivo documentado para sua exclusão, para que a próxima auditoria não a sinalize novamente como acidental. - Páginas de baixo valor → redirecione ou exclua. Faça um 301 para a alternativa mais relevante, ou remova-a completamente se não houver nada relevante e nenhum backlink que valha a pena preservar.
Evite recorrência: incorpore uma etapa de links internos ao seu fluxo de publicação, atribua categorias/tags antes de publicar e re-audite após cada migração, reformulação ou mudança de navegação. Essa é a mesma disciplina de links internos que governa a profundidade de rastreamento e como o PageRank flui pela sua arquitetura — a prevenção de órfãs é apenas o piso de um bom link interno.
Uma nota sobre o termo relacionado, mas diferente: uma página órfã não tem links internos de entrada; uma página sem saída não tem links internos de saída. São problemas separados, e uma página pode ser ambos.
Resumo de IA
Uma visão condensada da versão Avançada:
- Definição: uma página órfã não tem links internos de entrada. Ela é medida apenas em relação ao seu grafo de links internos — uma página pode ter backlinks externos ou estar no seu sitemap e ainda assim ser órfã.
- Por que isso prejudica: o Google descobre URLs de três maneiras — seguindo links (principal), sitemaps (complementar), rastreamentos anteriores. Uma órfã sem entrada no sitemap e sem backlinks não tem caminho de descoberta. Mesmo quando rastreada via sitemap, ela recebe zero PageRank interno, então as órfãs se concentram em “Descoberta — atualmente não indexada.”
- Vazamento de PageRank: uma órfã com backlinks externos atrai autoridade que então não consegue fluir para o resto do site.
- Escala do problema: no estudo de Site Audit da Ahrefs com 1M de domínios, 66,2% dos sites tinham páginas com apenas um link interno dofollow — as órfãs são o extremo da pobreza generalizada de links internos.
- Como encontrá-las: um rastreamento sozinho não consegue encontrar órfãs. Compare o rastreamento (páginas alcançáveis por links) com um superconjunto de URLs conhecidas (sitemap, analytics, GSC, backlinks). Órfãs = conhecidas, mas inalcançáveis.
- Como corrigi-las: páginas valiosas → adicione links internos contextuais; órfãs
intencionais (PPC, agradecimento) →
noindex; baixo valor → redirecione ou exclua. - Orçamento de rastreamento é uma preocupação real, mas secundária, principalmente para sites muito grandes.
Documentação oficial
Orientações de fontes primárias relevantes para páginas órfãs e descoberta.
- Guia detalhado de como o Google Search funciona — os três mecanismos de descoberta de URLs (rastreamentos anteriores, extração de links, envio de sitemap).
- Torne seus links rastreáveis — “Toda página que você considera importante deve ter um link de pelo menos uma outra página do seu site”, e como os links são usados para encontrar e ranquear páginas.
- Guia de primeiros passos de SEO — como o Google encontra páginas via rastreamentos conhecidos e seguimento de links.
- Relatório de indexação de páginas — “Descoberta — atualmente não indexada” — a definição do Google do status em que as páginas órfãs normalmente se encontram.
- Visão geral de sitemaps — o que um sitemap garante (e o que não garante); um auxílio à descoberta, não um substituto para links.
Bing / Microsoft
- Bing Webmaster Tools — a ferramenta Site Scan revela problemas de rastreabilidade; o Bing não tem documentação que aborde páginas órfãs pelo nome, mas o princípio de descoberta por seguimento de links se aplica ao Bingbot também.
Ahrefs (documentação da ferramenta)
- Erro de página órfã no Site Audit — como a Ahrefs define e inicia a verificação de páginas órfãs.
Citações da fonte
Declarações registradas do Google. Cada link é um link profundo que salta para a passagem citada na página de origem.
Google — como as URLs são descobertas
- “There isn’t a central registry of all web pages, so Google must constantly look for new and updated pages.” (tradução) «Não existe um registro central de todas as páginas da web, então o Google precisa procurar constantemente por páginas novas e atualizadas.» — Documentação do Google Search Central. Ir para a citação
- “Some pages are known because Google has already visited them. Other pages are discovered when Google extracts a link from a known page to a new page… Still other pages are discovered when you submit a list of pages (a sitemap) for Google to crawl.” (tradução) «Algumas páginas são conhecidas porque o Google já as visitou. Outras páginas são descobertas quando o Google extrai um link de uma página conhecida para uma nova página… Ainda outras páginas são descobertas quando você envia uma lista de páginas (um sitemap) para o Google rastrear.» Ir para a citação
Google — links são essenciais
- “Google uses links as a signal when determining the relevancy of pages, and to find new pages to crawl.” (tradução) «O Google usa links como um sinal ao determinar a relevância das páginas e para encontrar novas páginas para rastrear.» — Torne seus links rastreáveis. Ir para a citação
- “Every page you care about should have a link from at least one other page on your site.” (tradução) «Toda página que você considera importante deve ter um link de pelo menos uma outra página do seu site.» Ir para a citação
John Mueller, Google Search Advocate
- “Internal linking is super critical for SEO. I think it’s one of the biggest things that you can do on a website to kind of guide Google and guide visitors to the pages that you think are important.” (tradução) «O link interno é supercrítico para SEO. Acho que é uma das maiores coisas que você pode fazer em um site para guiar o Google e guiar os visitantes para as páginas que você considera importantes.» — Google Search Central SEO Office Hours, março de 2022. Leia a cobertura
- Sobre a distância de links em vez da profundidade de URL: “It’s really, from the homepage, or from the primary page, how quickly can we reach that specific page?” — (tradução) «Na verdade, a partir da página inicial ou da página principal, com que rapidez podemos chegar a essa página específica?» — uma órfã tem distância de link infinita. Leia a cobertura
Lista de verificação de auditoria de páginas órfãs
Um processo repetível para encontrar e resolver órfãs:
- Execute um rastreamento completo de links internos a partir da página inicial (Lista 1 — páginas alcançáveis).
- Reúna todas as URLs conhecidas: sitemap XML, Google Analytics, páginas do GSC, índice de backlinks, logs do servidor (Lista 2).
- Calcule a lacuna: URLs na Lista 2, mas não na Lista 1 — estes são seus candidatos a órfãs.
- No Ahrefs Site Audit, conecte GA + GSC e verifique o problema Orphan page.
- No Screaming Frog, envie sitemap/GA/GSC como fontes de URL e execute a análise de rastreamento para revelar URLs sem links.
- Verifique “Discovered — currently not indexed” no GSC em relação ao seu rastreamento — as inalcançáveis são fortes suspeitas de órfãs.
- Descarte primeiro os falsos positivos: páginas protegidas por autenticação, links somente JS, hosts/protocolos alternativos, caminhos bloqueados e variantes de normalização de URL podem parecer uma órfã sem links de entrada sem ser uma.
- Faça a triagem de cada órfã por valor: tráfego orgânico? backlinks? conteúdo útil?
- Antes de linkar, confirme se o candidato resolve corretamente (status 200, canônica
correta, não
noindex) — não linke para um redirecionamento, duplicado ou URL excluída. - Quer ranqueá-la → adicione links internos contextuais com texto âncora descritivo a partir de páginas relevantes e autoritativas; confirme se ela está no sitemap.
- Intencional (PPC / página de agradecimento / algumas legais) → aplique
noindex, não adicione links; atribua um responsável para cada categoria de órfã intencional. - Baixo valor → redirecione com 301 para a melhor alternativa ou exclua.
- Adicione uma etapa de links internos ao seu fluxo de publicação e reaudite após cada migração ou reformulação.
Os modelos mentais
1. O espectro de links internos. Órfã (0 links) → link único → bem linkada. Não trate isso como binário. Os dados de Patrick: 66,2% dos sites têm páginas com apenas um link interno dofollow — a maior parte do trabalho com órfãs é, na verdade, um trabalho de “sub-linkagem” um passo adiante.
2. Três caminhos de descoberta — e as órfãs bloqueiam todos eles. O Google encontra URLs por meio de rastreamentos anteriores, seguimento de links (principal) e sitemaps (complementar). Uma órfã sem entrada no sitemap e sem backlinks tem zero caminhos abertos. Pergunte: qual dos três está realmente carregando esta página?
3. Órfãs = conhecidas menos alcançáveis. Um rastreador não consegue encontrar órfãs — ele só segue links que consegue alcançar. Órfãs são a diferença de conjunto entre toda URL que você sabe que existe e toda URL que um rastreamento alcançou. Você sempre precisa de uma segunda lista.
4. PageRank é encanamento; órfãs são canos desconectados. Links internos circulam autoridade. Uma órfã não recebe nenhuma — e uma órfã com backlinks externos vaza a autoridade que flui para ela, porque nada a leva adiante.
5. A regra de decisão de triagem.
Quer que ele ranqueie? Adicione links internos. Oculto intencionalmente (PPC, página de agradecimento)?
noindex. Baixo valor? Redirecione ou exclua. Nunca use como padrão “adicionar links” para
todo órfão.
Ferramentas para encontrar páginas órfãs
Lembre-se da regra: um crawler sozinho não consegue encontrar órfãos, então toda ferramenta abaixo funciona combinando um rastreamento com uma lista externa de URLs conhecidas.
- Ahrefs Site Audit — sinaliza um problema de Página órfã ao semear o rastreamento a partir dos seus sitemaps, do índice de backlinks da Ahrefs e dos dados conectados do Google Analytics / Search Console, comparando isso com o que ele conseguiu alcançar por meio de links internos.
- Screaming Frog SEO Spider — carregue seu sitemap XML, dados do GA e do GSC como fontes de URL, execute a análise de rastreamento e exporte URLs que existem nessas fontes, mas que não foram encontradas pelo rastreamento de links.
- Google Search Console — sem visualização de estrutura, mas o relatório de Indexação de páginas (“Descoberta — atualmente não indexada”) mostra URLs que o Google conhece; cruze- referência com seu rastreamento para identificar órfãos.
- Google Analytics — páginas que recebem sessões e que não aparecem no seu rastreamento de links internos são candidatas a órfãs.
- Análise de logs do servidor — URLs que bots acessam (ou usuários acessam) que não são alcançáveis internamente apontam para órfãos, especialmente em sites grandes.
- Ahrefs Webmaster Tools — acesso gratuito ao Site Audit para sites que você verifica, com a mesma verificação de páginas órfãs.
Correções de páginas órfãs que criam novos problemas
Tratar o sitemap XML como uma estratégia de links internos
Um sitemap pode ajudar na descoberta, mas não dá à página contexto de navegação ou equidade de links internos. Mantenha a URL no sitemap e vincule-a a partir de um hub, categoria ou artigo relevante quando a página for destinada a ranquear.
Adicionar todo órfão à navegação global
Links em todo o site não são a resposta para toda página desconectada. Coloque cada página valiosa onde um leitor naturalmente precisaria dela; consolide, redirecione ou remova páginas que não têm mais propósito.
Chamar todo resultado de rastreamento com zero links internos de órfão
Um crawler vê apenas as fontes e URLs iniciais que você forneceu. Compare os dados de rastreamento com sitemaps, analytics, Search Console e dados de backlinks antes de decidir que a página existe e realmente não tem links internos. Um resultado de “zero links internos” também pode ser um falso positivo de configuração de rastreamento em vez de um órfão verdadeiro — verifique: links atrás de login ou outra autenticação, links adicionados apenas por JavaScript que o crawler não renderizou, links apontando para um host ou protocolo diferente (http vs. https, www vs. não-www) do que você rastreou, variantes móveis ou de template que o rastreamento tratou como URLs separadas, caminhos bloqueados por robots.txt ou configurações do crawler e diferenças de normalização de URL (barras finais, parâmetros de rastreamento, maiúsculas/minúsculas) que fazem a mesma página parecer duas. Elimine essas possibilidades e confirme o alvo canônico antes de tratar a URL como genuinamente órfã.
Problemas comuns de investigação de páginas órfãs
O crawler não relata órfãos
Sintoma: O rastreamento parece limpo mesmo que o analytics contenha URLs que os usuários podem visitar. Causa provável: Um crawler de links não consegue descobrir uma URL sem links, e nenhuma fonte secundária de URL foi conectada. Correção: Importe listas de URLs do sitemap, analytics, Search Console, backlinks e CMS e compare-as com as URLs rastreadas.
Uma página corrigida ainda mostra zero links internos
Sintoma: Você adicionou um link, mas o próximo relatório ainda classifica o destino como um
órfão. Causa provável: A página de origem não foi rastreada, o link é injetado apenas após a
interação ou o destino difere após a normalização. Correção: Inspecione
o HTML da origem para ver um href real, rastreie a origem diretamente e compare o destino final exato
após redirecionamentos.
Um órfão está indexado, mas nunca melhora
Sintoma: A URL é indexada após ser adicionada a um sitemap, mas as impressões permanecem estáveis. Causa provável: A descoberta foi resolvida sem adicionar contexto interno útil, ou a página se sobrepõe a outra URL. Correção: Adicione links contextuais relevantes, verifique a canônica e decida se a consolidação é melhor do que preservar a página.
Classificar uma exportação de páginas órfãs
Cole um CSV contendo URL, status, canônica, sessões orgânicas, impressões, backlinks e tipo de página neste prompt:
Act as a technical SEO reviewer. Classify each supplied URL as: link and retain,
consolidate, redirect, intentionally isolated, or investigate. Use only the columns
I provide. For every decision, name the evidence, the most relevant page or section
that should link to it when applicable, and any missing data that prevents a safe
decision. Do not infer traffic, backlinks, or index state. Return a review table and
a separate list of ambiguous cases.Propor posicionamentos de links contextuais
Cole o título da página órfã, um resumo curto e uma lista de páginas de origem candidatas:
Find the candidate source pages where a link to this target would genuinely help a
reader. For each fit, propose one natural sentence and descriptive anchor text.
Reject weak placements instead of forcing a link. Do not invent claims or add the
link to global navigation unless the target belongs there for users. Comparar um rastreamento com um inventário de URLs conhecidas
Salve URLs absolutas normalizadas do seu rastreador como crawled.txt e o inventário combinado
de sitemap, analytics, Search Console, backlinks e CMS como known.txt.
Execute isto no macOS ou Linux:
comm -23 <(sort -u known.txt) <(sort -u crawled.txt)Equivalente em PowerShell:
Compare-Object (Get-Content crawled.txt | Sort-Object -Unique) (Get-Content known.txt | Sort-Object -Unique) -PassThru | Where-Object SideIndicator -eq '=>'A saída é uma lista de candidatos, não um veredito. Redirecionamentos, canônicas, parâmetros de rastreamento e páginas intencionalmente isoladas ainda precisam de classificação.
Provar que uma página retida não é mais órfã
Teste a executar: Rastreie a partir do ponto de entrada normal do site e inspecione os links de entrada do alvo. Resultado esperado: Pelo menos um link interno relevante e rastreável alcança a URL final do alvo. Interpretação de falha: A origem não estava acessível, o link não é um link real ou aponta para uma URL diferente. Janela de monitoramento: Imediata após a implantação e a conclusão do rastreamento. Gatilho de reversão: O novo link interrompe a navegação ou aponta os usuários para a página errada; remova-o ou corrija-o.
Provar que os sinais de indexabilidade concordam
Teste a executar: Verifique o status final, as diretivas de robots e a canônica com o
Google Index Checker, depois use a Inspeção de URL do Search Console
para o estado registrado pelo Google. Resultado esperado: Uma página retida retorna
200, permite a indexação e aponta a canônica para si mesma ou para o equivalente pretendido.
Interpretação de falha: A página foi vinculada antes de seus sinais técnicos serem
corrigidos. Janela de monitoramento: Os sinais de HTTP e HTML são imediatos; o estado registrado pelo Google
é atualizado após o recrawl. Gatilho de reversão: O link expõe uma URL privada,
duplicada ou intencionalmente excluída.
Contagem de páginas órfãs por disposição de negócio
Métrica: Órfãos candidatos divididos em reter, consolidar, redirecionar, intencionalmente isolados e investigar. O que isso indica: Se o backlog é um problema de descoberta ou principalmente de higiene de URL. Como obter: Junte fontes de URLs conhecidas com um rastreamento de links recente e registre a disposição revisada. Benchmark / faixa realista: Estabeleça uma linha de base específica do site; a meta para páginas valiosas e indexáveis marcadas como reter é zero órfãos verdadeiros. Cadência: Mensal e após migrações, redesenho ou mudanças na navegação.
Páginas valiosas restauradas no grafo de links
Métrica: Candidatos retidos que ganham pelo menos um link de entrada relevante e rastreável. O que isso indica: Se as correções mudaram o grafo em vez de apenas uma planilha. Como obter: Compare as contagens de links de entrada do alvo entre dois snapshots de rastreamento. Benchmark / faixa realista: Meça em relação à lista de remediação aprovada; páginas intencionalmente isoladas não pertencem ao denominador. Cadência: Após cada lançamento de remediação, depois mensalmente até que o backlog seja encerrado.
Teste-se: Páginas órfãs
Cinco perguntas rápidas sobre o que são páginas órfãs, por que elas prejudicam e como corrigi-las. Escolha uma resposta para cada uma e depois verifique.
Recursos que valem seu tempo
Meus escritos relacionados
- Estudo de Site Audit da Ahrefs: 1M de domínios — a fonte da estatística de 66,2% de link interno único e uma visão ampla de problemas técnicos comuns.
- Links Internos para SEO: Um Guia Prático — como construir a estrutura de links internos que evita páginas órfãs.
- Como Encontrar e Corrigir Páginas Órfãs — o passo a passo do Blog da Ahrefs com etapas específicas de ferramentas.
- O Guia do Iniciante para SEO Técnico — onde as páginas órfãs se encaixam no panorama maior de rastreamento e indexação.
Minhas palestras
- Como o Search Funciona (SlideShare) — minha explicação sobre descoberta, rastreamento, indexação e ranqueamento, incluindo como o seguimento de links impulsiona a descoberta. (Aviso permanente: “Esta é a minha compreensão dos sistemas… não será 100% completa ou precisa.”)
Da indústria em geral
- Erro de página órfã no Site Audit (Ajuda da Ahrefs) — a definição precisa que o Site Audit usa e como ele inicia o rastreamento.
- Como Encontrar Páginas Órfãs (Screaming Frog) — os três métodos de fonte de URL para revelar páginas órfãs em um rastreamento.
- O Que São Páginas Órfãs e Como Encontrá-las e Corrigi-las (Semrush) — uma lista detalhada de causas com capturas de tela.
- Como Encontrar Páginas Órfãs (Search Engine Journal) — o método de comparação baseado em planilhas.
- O Que São Páginas Órfãs e Como Encontrá-las e Corrigi-las (Conductor) — uma estrutura clara de triagem/fluxo de decisão.
- Página Órfã (Glossário de SEO da Ahrefs) — a definição de referência curta.
Registro de alterações
Atualizado em 18 de jul. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.