Tradução Automática e SEO

A tradução automática é segura para SEO? A política de abuso de conteúdo em escala do Google visa a publicação em massa de traduções automáticas não revisadas para manipulação de ranqueamento — não a tradução em si. Aqui está a política atual, o caso do Reddit, o fluxo de trabalho MTPE e a camada de hreflang que o conteúdo traduzido automaticamente ainda precisa.

Publicado pela primeira vez: 2 de jul. de 2026 · Última atualização: 11 de ago. de 2026 · Avançado
Idiomas

A tradução automática não é proibida para SEO. O que a política de abuso de conteúdo em escala do Google visa é publicar páginas traduzidas automaticamente, cruas, não revisadas e em massa para manipular ranqueamentos — o gatilho é baixo valor em escala, não o método de tradução. O Google disse isso em 2025 (conteúdo traduzido por IA não é 'estritamente definido... como spam'), removeu sua orientação antiga de bloquear páginas traduzidas automaticamente com robots.txt e não tomou nenhuma ação contra os dezenas de milhões de URLs traduzidos por IA do Reddit. O fluxo de trabalho padrão em escala é MTPE — tradução automática mais pós-edição humana — porque a tradução 100 % humana de cada página geralmente não é prática. Despejos de tradução automática crua e não revisada são o risco real. E a qualidade da tradução é apenas metade do trabalho: meu estudo de 374 756 domínios que usam hreflang encontrou mais de 67 % com algum problema de hreflang, então o conteúdo traduzido automaticamente frequentemente erra o público-alvo, independentemente de quão boa seja a tradução.

TL;DR — A tradução automática não é proibida. A política de abuso de conteúdo em escala do Google tem como alvo MT em massa, não revisado, publicado em escala para manipular o ranqueamento — o gatilho é “little value… to users,” (tradução) «pouco valor… para os usuários», não o método. O Google declarou em 2025 que conteúdo traduzido por IA é not “strictly defined… as spam,” (tradução) «não é “estritamente definido… como spam”», removeu seu antigo conselho de bloqueio de robots.txt e não tomou nenhuma ação sobre as dezenas de milhões de URLs traduzidas por IA do Reddit. O fluxo de trabalho em escala é MTPE (MT + pós-edição humana), porque tradução 100 % humana de cada página geralmente não é prática. Dois modos de falha separados: qualidade da tradução e o invólucro técnico — meu estudo de 374 756 domínios que usam hreflang encontrou 67 %+ com algum problema de hreflang, então o conteúdo MT frequentemente erra o alvo do público mesmo quando a tradução está boa. E se você não traduzir nada, o Google pode traduzir automaticamente suas páginas para seu próprio subdomínio translate.goog e ficar com o tráfego.

Evidence for this claim Google's scaled content abuse policy focuses on large amounts of low-value content created primarily to manipulate rankings and includes low-value automated translation as one possible technique. Scope: Google Search spam policy; machine translation is not categorically prohibited by this policy. Confidence: high · Verified: Google: Scaled content abuse Evidence for this claim Google recommends making a page's language obvious in visible content and warns that translating only boilerplate while leaving the main content unchanged can create a poor experience. Scope: Google Search guidance for multilingual page content. Confidence: high · Verified: Google: Make page language obvious

O Google penaliza conteúdo traduzido por máquina?

Não — não por ser traduzido por máquina. Esta é a alegação mais desatualizada no conteúdo dos concorrentes, a maior parte escrita antes da renomeação da política do Google em março de 2024 e dos esclarecimentos de 2025, então ainda repete uma linha genérica de “o Google penaliza conteúdo traduzido automaticamente”.

Aqui está a política em vigor. As políticas de spam do Google definem abuso de conteúdo em escala (a seção renomeada de “conteúdo gerado automaticamente” em março de 2024) como: “Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users.” (tradução) «Abuso de conteúdo em escala ocorre quando muitas páginas são geradas com o objetivo principal de manipular o ranqueamento nas buscas e não ajudar os usuários.» A tradução aparece uma vez, em uma lista de exemplos, agrupada com raspagem e sinonímia: “Scraping feeds, search results, or other content to generate many pages (including through automated transformations like synonymizing, translating, or other obfuscation techniques), where little value is provided to users.” (tradução) «Raspagem de feeds, resultados de busca ou outro conteúdo para gerar muitas páginas (inclusive por meio de transformações automatizadas como sinonímia, tradução ou outras técnicas de ofuscação), quando pouco valor é oferecido aos usuários.»

Leia isso com atenção. Não diz que “conteúdo traduzido” ou “conteúdo traduzido por máquina” é uma violação. As palavras que sustentam o peso são “to generate many pages” (tradução) «para gerar muitas páginas» e “where little value is provided to users.” (tradução) «onde pouco valor é fornecido aos usuários». O padrão é volume + baixo valor + intenção de manipulação de ranqueamento. A tradução é citada como uma forma de cometer esse padrão, no mesmo contexto que a raspagem — não como uma categoria de conteúdo proibido.

Declaração de 2025 do Google — a linha atual mais clara

A confirmação mais citável e mais atual veio em junho de 2025. Depois que o Reddit expandiu traduções por IA em seu site, Glenn Gabe perguntou diretamente ao Google se isso era sancionado, e um porta-voz do Google respondeu (relatado pelo Search Engine Land): “While we don’t comment on the status of specific sites or pages, nor do we provide individualized support for any site, our policies do not strictly define content that has been translated by AI as spam. Our scaled content abuse policy mentions automated transformations, including translations, as part of the overall warning against creating large amounts of unoriginal content that provides little to no value to users.” (tradução) «Embora não comentemos o status de sites ou páginas específicos, nem ofereçamos suporte individualizado a nenhum site, nossas políticas não definem estritamente como spam o conteúdo traduzido por IA. Nossa política de abuso de conteúdo em escala menciona transformações automatizadas, incluindo traduções, como parte do alerta geral contra a criação de grandes quantidades de conteúdo não original que oferece pouco ou nenhum valor aos usuários.»

Isso é o Google confirmando, em linguagem clara, exatamente a distinção acima: tradução por IA/máquina não é “strictly defined… as spam” (tradução) «“estritamente definido… como spam”»; a política é sobre saída em escala e de baixo valor, não sobre o método de tradução em si.

O que mudou em 2024–2025

Três movimentos concretos contextualizam a política atual:

  • A renomeação de março de 2024. “Conteúdo gerado automaticamente” tornou-se abuso de conteúdo em escala, reformulando toda a área em torno de valor em escala em vez de como o conteúdo foi criado. A antiga linguagem de ajuda sobre “conteúdo gerado automaticamente” (que literalmente listava “texto traduzido por uma ferramenta automatizada sem revisão ou curadoria humana antes da publicação” como exemplo) foi incorporada a essa estrutura baseada em valor.
  • A remoção da orientação sobre robots.txt em 2025. O Google removeu sua orientação de longa data que dizia aos proprietários de sites para usar robots.txt para bloquear páginas traduzidas automaticamente, caracterizando-a no changelog como “This is a docs-only change, no change in behavior.” (tradução) «Esta é uma mudança apenas de documentação, sem mudança de comportamento.» Quando a política avalia o conteúdo pelo valor para o usuário em vez do método de criação, uma regra genérica de “bloquear todas as páginas traduzidas por máquina” deixou de ser correta. A ferramenta correta para uma página traduzida específica de baixa qualidade agora é noindex no nível da página, não um bloqueio de robots.txt em todo o site.
  • Consistência ao longo de 15 anos. Nada disso é realmente novo. As pessoas do Google (Mueller em 2010, Cutts em 2011) traçavam a mesma linha — tradução automatizada não revisada vs. tradução revisada — muito antes de “tradução por IA” ser o termo. Nunca foi sobre tradução como técnica; sempre foi sobre automação não revisada em escala.

MT seguida de revisão humana vs. despejos brutos de MT em massa

Esta é a distinção que realmente importa operacionalmente. Duas coisas são chamadas de “tradução por máquina para SEO”, e elas vivem em lados opostos da política:

  • Despejo bruto de MT em massa — milhares de páginas processadas pelo Google Translate ou DeepL e publicadas sem revisão humana, principalmente para aparecer em mais idiomas. Este é o risco de abuso de conteúdo em escala.
  • MTPE — pós-edição de tradução por máquina — a MT produz o primeiro rascunho; um linguista humano ou editor fluente revisa e corrige antes da publicação. MTPE leve corrige legibilidade e erros óbvios; MTPE completo eleva a saída à qualidade de tradução humana.

MTPE é o fluxo de trabalho padrão de fato da indústria em qualquer escala real. Vale a pena ser preciso sobre o que é: uma prática de controle de risco, não uma etapa oficial de conformidade do Google. O Google não concede às páginas traduzidas uma isenção de “revisão” ou qualquer outra aprovação formal — a revisão humana apenas mantém a saída no lado certo da barra de valor que a política de abuso de conteúdo em escala realmente mede. A razão pela qual o MTPE domina é pragmática: tradução 100 % humana de cada página geralmente não é prática ou acessível quando você mantém milhares ou milhões de URLs localizadas em uma dúzia de mercados. MT bruto é o piso barato e arriscado; tradução humana completa é o teto caro e lento; MTPE é onde o SEO internacional empresarial realmente vive. E fazer tudo certo — saída fluente, revisão humana, hreflang tecnicamente válido — ainda não garante indexação, ranqueamento ou como uma página é exibida; remove o risco de abuso de conteúdo em escala, não compra um resultado de ranqueamento. (Vou mais fundo na camada estratégica — quando você deve traduzir versus localizar completamente — no artigo irmão sobre tradução versus localização.)

Mais uma coisa antes de enviar qualquer coisa por uma ferramenta de tradução: enviar conteúdo de página para uma API de MT ou um LLM significa que esse texto sai do seu sistema e vai parar com um terceiro. O que acontece com ele — retenção, se é usado para treinamento de modelo, onde é armazenado, quem mais pode acessá-lo — depende inteiramente do provedor específico, do plano em que você está e das regras de proteção de dados da sua jurisdição. Isso importa mais para páginas que carregam dados pessoais, conteúdo regulamentado (saúde/financeiro/jurídico) ou qualquer coisa sob NDA ou restrição de licenciamento do que para cópia de marketing genérica. Isso não é conselho de SEO — verifique os termos atuais de processamento de dados do provedor para o seu plano real e envolva quem cuida de proteção de dados/jurídico na sua empresa, antes de enviar qualquer coisa sensível por ele. Nenhum artigo de SEO, incluindo este, pode resolver isso por você.

O caso Reddit: prova de que é aplicado por valor, não por método

Reddit é o teste de estresse do mundo real. De acordo com o relato de Glenn Gabe, Reddit escalou traduções de IA em mais de 20 idiomas e publicou dezenas de milhões de URLs traduzidos por IA — Gabe cita, por exemplo, 2,3 milhões de URLs ranqueando na França e 2,4 milhões na Espanha. Isso é o mais “em escala” que conteúdo em escala pode ser. A resposta do Google, nas palavras de Gabe: “Well, nothing happened. Nothing at all.” (tradução) «Bem, nada aconteceu. Absolutamente nada.» Nenhuma ação manual, nenhuma despromoção algorítmica.

A lição não é “MT bruto em escala é sempre seguro” — é que o Google aplicou a política com base em se o conteúdo subjacente era útil, não no método de tradução ou volume. (Tenha cuidado ao atribuir o enquadramento: o Reddit caracterizando a abordagem como “sancionada” é o enquadramento do Reddit, não uma citação do Google. O que o Google realmente disse é a declaração “not strictly defined as spam” (tradução) «“não estritamente definido como spam”» acima.)

A camada técnica que o conteúdo MT ainda precisa

Aqui está o ponto diferenciado que a maioria das coberturas perde: qualidade de tradução e implementação técnica são dois modos de falha separados, e você tem que acertar ambos.

URLs dedicadas e indexáveis — não sobreposições de JS. Um widget do Google Tradutor ou uma sobreposição de tradução JS no lado do cliente não dá aos mecanismos de busca páginas traduzidas reais para ranquear. A própria orientação do Google sobre versões localizadas e documentos multirregionais assumem URLs distintas e rastreáveis por idioma. Tradução em tempo real sem URLs dedicadas, indexáveis e com tags hreflang é um problema mais claro do que qualidade de MT — simplesmente não há nada traduzido para o mecanismo indexar.

Hreflang — e por que a maior parte dele está quebrado. O hreflang informa aos mecanismos de busca qual versão de idioma/região servir para quem. No meu estudo de hreflang com 374 756 domínios (Brighton SEO 2023), mais de 67 % dos domínios que usam hreflang tinham pelo menos um problema — anotações x-default ausentes, tags de autorreferência ausentes, referências a páginas redirecionadas ou quebradas, tags de retorno recíproco ausentes, ponteiros para URLs não canônicas e valores de idioma inconsistentes. O hreflang é um dos aspectos mais complexos do SEO e só funciona como um cluster recíproco: se duas páginas não apontarem uma para a outra, o Google ignora o par inteiro.

Juntando tudo isso, a implicação prática é desconfortável: a maioria das configurações de páginas traduzidas está direcionando mal seu público, independentemente da qualidade da tradução. Uma página perfeitamente traduzida por humanos com hreflang quebrado tem desempenho tão ruim quanto um despejo bruto de MT com hreflang perfeito. A qualidade da tradução é necessária, mas não suficiente. (A mecânica — os três métodos de implementação, a regra de reciprocidade, x-default, códigos válidos — está nos mergulhos profundos de hreflang e x-default.)

Um esclarecimento útil da documentação do Google: páginas traduzidas não são automaticamente conteúdo duplicado. O Google trata explicitamente uma página como duplicada apenas “if the main content of the page remains untranslated” (tradução) «se o conteúdo principal da página permanecer sem tradução» — ou seja, o mesmo corpo no idioma de origem em uma URL /de/. Uma página genuinamente traduzida, independentemente de como foi produzida, não é uma duplicata.

O requisito mínimo, antes de qualquer outra coisa: uma URL indexável dedicada por idioma, conteúdo principal real visível sem JavaScript, um cluster hreflang recíproco (autorreferência + todos os alternates + x-default) e um canônico que aponte para si mesmo em vez da página no idioma de origem. A qualidade da tradução não vale nada se algum desses quatro estiver ausente — o Google não tem nada indexável para julgar. (O passo a passo completo está na lente Decision Trees.)

O que acontece se você não traduzir nada

Há um incentivo real em 2025 para publicar pelo menos uma tradução de linha de base revisada em vez de nada: o Google pode traduzir automaticamente seu conteúdo para o próprio subdomínio translate.goog e ficar com o tráfego. De acordo com a análise da Ahrefs (que revisei), estima-se que 377M de visitas orgânicas mensais fluam pelas páginas de proxy de tradução do Google, com Índia, Indonésia e Brasil entre os mercados mais afetados — tráfego que poderia ter ido para as próprias páginas localizadas do editor original.

Minha opinião, e vou sustentá-la: o Google fala em melhorar o sistema de hreflang há anos; em vez de continuar ajudando os criadores a localizar, ele efetivamente decidiu reivindicar uma parte desse tráfego como seu. O Google enquadra o proxy como um fallback para quando “there is no high-quality, local-language content available” (tradução) «não há conteúdo local de alta qualidade disponível no idioma local» (como o Search Engine Land relatou) — o que inverte o argumento usual. A ausência de uma página traduzida real e revisada é o que convida o Google a traduzi-la para você e ficar com o clique. Publicar até mesmo uma página enxuta no idioma nativo, revisada por MTPE, com hreflang adequado, é como você faz sua URL ser a que é indexada. Este é um forte argumento comercial a favor da MT revisada, não contra a tradução.

A abordagem do Bing

A Bing/Microsoft não publica uma política dedicada sobre tradução automática como a política de spam do Google. Suas Diretrizes para webmasters estruturam o ranqueamento em torno da qualidade e credibilidade do conteúdo de forma ampla, sem uma exceção específica para tradução. A leitura honesta: o Bing não tem uma regra específica para MT, mas suas diretrizes gerais sobre conteúdo raso/de baixa qualidade se aplicariam da mesma forma — despejos de MT em massa sem revisão são um subconjunto de conteúdo raso, não uma política exclusiva do Bing. Observe também que o Bing depende mais do sinal content-language do que do hreflang, o que vale considerar no wrapper técnico.

A conclusão

A tradução automática é uma ferramenta de SEO legítima e comum. Use-a como um primeiro rascunho, coloque um humano no controle de qualidade (MTPE), dê a cada idioma uma URL indexável dedicada, configure o hreflang corretamente e avalie o resultado pelo fato de ser realmente útil para aquele mercado. Se fizer isso, você não está enganando ninguém — está fazendo o que todo grande site multilíngue já faz. Pule a revisão e despeje MT bruto em escala para perseguir ranqueamento, e isso é o padrão que a política de abuso de conteúdo em escala existe para capturar.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.