Traducción automática y SEO

¿La traducción automática es segura para el SEO? La política de abuso de contenido a gran escala de Google apunta a la MT masiva y sin revisión para manipular el posicionamiento, no a la traducción en sí. Aquí están la política actual, el caso de Reddit, el flujo de trabajo MTPE y la capa hreflang que todavía necesita el contenido traducido automáticamente.

Publicado por primera vez: 2 jul 2026 · Última actualización: 22 ago 2026 · Avanzado
Idiomas

La traducción automática no está prohibida para el SEO. La política de abuso de contenido a gran escala de Google apunta a publicar páginas traducidas automáticamente, sin revisar y en masa para manipular el posicionamiento: el desencadenante es el bajo valor a gran escala, no el método de traducción. Google lo dijo en 2025 (el contenido traducido por IA no está 'estrictamente definido... como spam'), retiró su antigua recomendación de bloquear las páginas traducidas automáticamente con robots.txt y no tomó ninguna medida contra las decenas de millones de URL traducidas por IA de Reddit. El flujo de trabajo estándar a escala es MTPE —traducción automática más posedición humana— porque normalmente no es práctico traducir a mano el 100 % de cada página. Los volcados de MT sin revisar son el riesgo real. Y la calidad de la traducción es solo la mitad del trabajo: mi estudio de 374 756 dominios con hreflang encontró que más del 67 % tenía algún problema de hreflang, por lo que el contenido traducido automáticamente suele dirigirse al público equivocado, por buena que sea la traducción.

TL;DR — La traducción automática no está prohibida. La política de Google sobre abuso de contenido a gran escala apunta a publicar MT masiva y sin revisar para manipular el posicionamiento: el desencadenante es «little value… to users» —«poco valor… a los usuarios»—, no el método. En 2025 Google declaró que el contenido traducido por IA no está «strictly defined… as spam» —«estrictamente definido… como spam»—, retiró su antiguo consejo de bloquearlo con robots.txt y no tomó ninguna medida contra las decenas de millones de URL traducidas por IA de Reddit. El flujo escalable es MTPE (MT + posedición humana), porque traducir manualmente el 100 % de cada página rara vez es práctico. Hay dos fallos distintos: la calidad de la traducción y la envoltura técnica. Mi estudio de 374 756 dominios con hreflang encontró que más del 67 % tenía algún problema, por lo que el contenido MT suele dirigirse al público equivocado aunque la traducción sea buena. Y si no traduces, Google puede traducir automáticamente tus páginas en su propio translate.goog subdominio y mantener el tráfico.

Evidence for this claim Google's scaled content abuse policy focuses on large amounts of low-value content created primarily to manipulate rankings and includes low-value automated translation as one possible technique. Scope: Google Search spam policy; machine translation is not categorically prohibited by this policy. Confidence: high · Verified: Google: Scaled content abuse Evidence for this claim Google recommends making a page's language obvious in visible content and warns that translating only boilerplate while leaving the main content unchanged can create a poor experience. Scope: Google Search guidance for multilingual page content. Confidence: high · Verified: Google: Make page language obvious

¿Google penaliza el contenido traducido automáticamente?

No, no por estar traducido automáticamente. Es una de las afirmaciones más desactualizadas del contenido de la competencia: la mayoría se escribió antes del cambio de nombre de la política de Google en marzo de 2024 y de sus aclaraciones de 2025, así que todavía repite la frase general «Google penaliza el contenido traducido automáticamente».

Esta es la política operativa. Las políticas de spam de Google definen el abuso de contenido a gran escala (la sección que cambió de «contenido generado automáticamente» en marzo de 2024) así: «Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users.» (traducción) «El abuso de contenido a gran escala ocurre cuando se generan muchas páginas con el propósito principal de manipular el posicionamiento y no ayudar a los usuarios». La traducción aparece una vez, en una lista de ejemplos, junto al scraping y la sinonimización: «Scraping feeds, search results, or other content to generate many pages (including through automated transformations like synonymizing, translating, or other obfuscation techniques), where little value is provided to users.» (traducción) «Extraer feeds, resultados de búsqueda u otro contenido para generar muchas páginas (incluso mediante transformaciones automatizadas como sinonimizar, traducir u otras técnicas de ofuscación) cuando se ofrece poco valor a los usuarios».

Léelo con precisión. No dice que el «contenido traducido» o el «contenido traducido automáticamente» sea una infracción. Las palabras decisivas son «to generate many pages» (traducción) «generar muchas páginas» y «where little value is provided to users» (traducción) «cuando se ofrece poco valor a los usuarios». El patrón es volumen + poco valor + intención de manipular el posicionamiento. La traducción se menciona como una forma de cometerlo, en la misma frase que el scraping; no como una categoría de contenido prohibido.

La declaración de Google de 2025: la línea más clara

La confirmación más citable y reciente llegó en junio de 2025. Después de que Reddit ampliara las traducciones de IA en su sitio, Glenn Gabe preguntó directamente a Google si se sancionaría, y un portavoz de Google respondió (lo recogió Search Engine Land): «While we don’t comment on the status of specific sites or pages, nor do we provide individualized support for any site, our policies do not strictly define content that has been translated by AI as spam. Our scaled content abuse policy mentions automated transformations, including translations, as part of the overall warning against creating large amounts of unoriginal content that provides little to no value to users.» (traducción) «Aunque no comentamos el estado de sitios o páginas concretos ni ofrecemos asistencia individualizada, nuestras políticas no definen estrictamente como spam el contenido traducido por IA. La política de abuso de contenido a gran escala menciona las transformaciones automatizadas, incluidas las traducciones, como parte de la advertencia general contra crear grandes cantidades de contenido no original que ofrece poco o ningún valor a los usuarios».

Eso confirma, en lenguaje llano, exactamente la distinción anterior: la traducción por IA o automática no está «strictly defined… as spam» (traducción) «estrictamente definida… como spam»; la política trata de resultados masivos y de poco valor, no del método de traducción.

Qué cambió en 2024–2025

Tres movimientos concretos ponen la política actual en contexto:

  • El cambio de nombre de marzo de 2024. “Auto-generated content” (traducción) «Contenido generado automáticamente» pasó a ser abuso de contenido a gran escala y el foco se desplazó al valor a escala, no a cómo se creó el contenido. El antiguo texto de ayuda (que literalmente enumeraba como ejemplo el “auto-generated content” (traducción) «contenido generado automáticamente» y el “text translated by an automated tool without human review or curation before publishing” (traducción) «texto traducido por una herramienta automatizada sin revisión ni selección humana antes de publicarlo» quedó integrado en este marco basado en el valor.
  • La retirada de la guía de robots.txt en 2025. Google eliminó su consejo de siempre de usar robots.txt para bloquear páginas traducidas automáticamente y lo describió en el registro de cambios como “This is a docs-only change, no change in behavior.” (traducción) «Este cambio solo afecta a la documentación; no cambia el comportamiento». Una vez que la política evalúa el valor para el usuario y no el método de creación, dejó de tener sentido una regla general de “block all machine-translated pages” (traducción) «bloquear todas las páginas traducidas automáticamente». La herramienta correcta para una página traducida concreta y de baja calidad es ahora noindex a nivel de página, no bloquear todo el sitio con robots.txt.
  • Coherencia durante más de 15 años. Nada de esto es realmente nuevo. Las personas de Google (Mueller en 2010 y Cutts en 2011) ya distinguían entre traducción automática sin revisar y traducción revisada mucho antes de que se hablara de «traducción por IA». Nunca se trató de la técnica de traducción, sino de la automatización sin revisar a escala.

MT seguida de revisión humana frente a volcados masivos de MT sin revisar

Esta es la distinción que importa en la práctica. Hay dos cosas que reciben el nombre de «traducción automática para SEO» y están en lados opuestos de la política:

  • Volcado masivo de MT sin revisar: miles de páginas pasan por Google Translate o DeepL y se publican sin revisión humana, principalmente para aparecer en más idiomas. Ese es el riesgo de abuso de contenido a gran escala.
  • MTPE —posedición de traducción automática—: la MT produce el primer borrador y un lingüista o editor fluido lo revisa y corrige antes de publicarlo. La MTPE ligera corrige legibilidad y errores evidentes; la MTPE completa lleva el resultado a calidad de traducción humana.

La MTPE es el flujo de trabajo estándar de facto del sector a cualquier escala real. Conviene precisar qué es: una práctica de control de riesgos, no un paso oficial de cumplimiento de Google. Google no concede a las páginas traducidas una exención por estar «revisadas» ni ningún otro aprobado formal; la revisión humana simplemente mantiene el resultado en el lado correcto del umbral de valor que mide la política de abuso de contenido a gran escala. La MTPE domina por una razón práctica: traducir a mano el 100 % de cada página no suele ser práctico ni asequible cuando mantienes miles o millones de URL localizadas en una docena de mercados. La MT sin revisar es el suelo barato y arriesgado; la traducción humana completa, el techo caro y lento; la MTPE es donde vive realmente el SEO internacional empresarial. Y hacerlo todo bien —resultado fluido, revisión humana y hreflang técnicamente válido— todavía no garantiza la indexación, el posicionamiento ni cómo se mostrará una página: elimina el riesgo de abuso de contenido a gran escala, pero no compra un resultado de ranking. (Profundizo en la capa estratégica —cuándo traducir y cuándo localizar por completo— en el artículo hermano sobre traducción frente a localización.)

Una cosa más antes de pasar nada por una herramienta de traducción: enviar contenido a una API de MT o a un LLM significa que el texto sale de tu sistema y llega a un tercero. Qué ocurre con él —retención, uso para entrenar modelos, lugar de almacenamiento y quién puede acceder— depende del proveedor concreto, del plan contratado y de las normas de protección de datos de tu jurisdicción. Esto importa más para páginas con datos personales, contenido regulado (sanitario, financiero o jurídico) o material sujeto a un NDA o a restricciones de licencia que para un texto de marketing genérico. Esto no es asesoramiento SEO: comprueba las condiciones actuales de tratamiento de datos del proveedor para tu plan e involucra al equipo de privacidad o jurídico de tu empresa antes de enviar información sensible. Ningún artículo de SEO, incluido este, puede resolverlo por ti.

El caso de Reddit: prueba de que se aplica por valor, no por método

Reddit es la prueba de estrés del mundo real. Según el informe de Glenn Gabe, Reddit amplió las traducciones de IA a más de 20 idiomas y publicó decenas de millones de URL traducidas por IA; Gabe cita, por ejemplo, 2,3 millones de URL posicionadas en Francia y 2,4 millones en España. Es difícil encontrar contenido a mayor escala. La respuesta de Google, en palabras de Gabe, fue: «Well, nothing happened. Nothing at all.» (traducción) «Bueno, no pasó nada. Absolutamente nada». No hubo acción manual ni degradación algorítmica.

La lección no es que «la MT sin revisar a escala siempre sea segura», sino que Google aplicó la política según si el contenido subyacente era útil, no según el método de traducción o el volumen. (Atribuye con cuidado el encuadre: que Reddit describa el enfoque como «sancionado» es la interpretación de Reddit, no una cita de Google. Lo que Google dijo realmente es la declaración anterior de que no está «estrictamente definido como spam».)

La capa técnica que todavía necesita el contenido de MT

Este es el punto diferencial que la mayoría de la cobertura pasa por alto: la calidad de la traducción y la implementación técnica son dos modos de fallo distintos, y hay que acertar en ambos.

URL dedicadas e indexables, no superposiciones de JS. Un widget de Google Translate o una superposición de traducción en JavaScript del lado del cliente no proporciona a los motores de búsqueda páginas traducidas reales que puedan posicionar. La guía de Google sobre versiones localizadas y su documentación multirregional dan por sentadas URL distintas y rastreables para cada idioma. La traducción al vuelo sin URL dedicadas, indexables y etiquetadas con hreflang es un problema mucho más claro que la calidad de la MT: no hay nada traducido que el motor pueda indexar.

Hreflang y por qué la mayoría está roto. hreflang indica a los motores de búsqueda qué versión de idioma o región deben servir a cada persona. En mi estudio de hreflang de 374 756 dominios (Brighton SEO 2023), más del 67 % de los dominios que usaban hreflang tenía al menos un problema: anotaciones x-default ausentes, etiquetas autorreferentes ausentes, referencias a páginas redirigidas o rotas, etiquetas de retorno recíproco ausentes, punteros a URL no canónicas y valores de idioma incoherentes. hreflang es uno de los aspectos más complejos del SEO y solo funciona como clúster recíproco: si dos páginas no apuntan ambas a la otra, Google ignora por completo la pareja.

Juntarlo todo lleva a una conclusión incómoda: la mayoría de las configuraciones de páginas traducidas dirige mal a su público independientemente de la calidad de la traducción. Una página perfectamente traducida por una persona con un hreflang roto rinde tan mal como un volcado de MT sin revisar con un hreflang perfecto. La calidad de la traducción es necesaria, pero no suficiente. (La mecánica —los tres métodos de implementación, la regla de reciprocidad, x-default y los códigos válidos— está en las guías detalladas de hreflang y x-default.)

Una aclaración útil de la documentación de Google: las páginas traducidas no son contenido duplicado automáticamente. Google considera que una página es duplicada solo «if the main content of the page remains untranslated» (traducción) «si el contenido principal de la página permanece sin traducir», es decir, el mismo cuerpo en el idioma de origen colocado en una URL /de/. Una página realmente traducida, independientemente de cómo se produzca, no es un duplicado.

La barrera mínima, antes que nada: una URL indexable dedicada por idioma, contenido principal real visible sin JavaScript, un clúster hreflang recíproco (autorreferencia + todas las alternativas + x-default) y un canónico que apunte a sí mismo, no a la página en el idioma de origen. La calidad de la traducción no sirve de nada si falta cualquiera de esos cuatro elementos: Google no tiene nada indexable que juzgar. (La guía completa está en la lente Árboles de decisión.)

Qué ocurre si no traduces nada

Hay un incentivo real en 2025 para publicar al menos una traducción de referencia revisada en lugar de no publicar nada: Google puede traducir automáticamente tu contenido en su propio subdominio translate.goog y quedarse con el tráfico. Según el análisis de Ahrefs (que revisé), se estima que 377M de visitas orgánicas mensuales pasan por las páginas proxy de traducción de Google; India, Indonesia y Brasil están entre los mercados más afectados. Es tráfico que podría haber llegado a las páginas localizadas del propio editor.

Mi opinión, y la mantengo: Google lleva años hablando de mejorar el sistema hreflang; en vez de seguir ayudando a los creadores a localizar, en la práctica ha decidido reclamar parte de ese tráfico como propio. Google presenta el proxy como un recurso alternativo cuando «there is no high-quality, local-language content available» (traducción) «no hay contenido local de alta calidad disponible» (según informó Search Engine Land). Eso da la vuelta al argumento habitual: la ausencia de una página traducida real y revisada es lo que invita a Google a traducirla por ti y quedarse con el clic. Publicar aunque sea una página en el idioma local, revisada con MTPE y con un hreflang correcto, es la forma de que tu URL sea la que se indexe. Es un argumento comercial sólido a favor de revisar la MT, no en contra de traducir.

El enfoque de Bing

Microsoft no publica una política específica sobre traducción automática como la política de spam de Google. Sus Directrices para webmasters enmarcan el posicionamiento alrededor de la calidad y la credibilidad del contenido en general, sin una excepción específica para la traducción. La lectura honesta es que Bing no tiene una regla exclusiva para MT, pero su orientación general sobre contenido superficial o de baja calidad se aplicaría igual: los volcados masivos de MT sin revisar son un subconjunto del contenido superficial, no una política única de Bing. Ten en cuenta también que Bing se apoya en la señal content-language más que en hreflang; hay que contemplarlo en la envoltura técnica.

La conclusión

La traducción automática es una herramienta de SEO legítima y generalizada. Úsala como primer borrador, pon a una persona a cargo del control de calidad (MTPE), da a cada idioma una URL indexable propia, configura bien hreflang y juzga el resultado por si realmente ayuda a ese mercado. Hazlo así y no estarás manipulando nada: estarás haciendo lo que ya hacen los grandes sitios multilingües. Si omites la revisión y publicas MT masiva sin revisar para perseguir el posicionamiento, ese es el patrón que la política de abuso de contenido a gran escala pretende detectar.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.