Contenido duplicado entre idiomas
El contenido traducido no es contenido duplicado para Google — ese mito está al revés. El riesgo real son páginas casi idénticas en el mismo idioma entre variantes de país. De Patrick Stox.
Idiomas
Google no trata las traducciones como contenido duplicado: una página alemana y su original en inglés son contenido diferente para los sistemas de Google, y esa es la premisa de hreflang. La documentación de Google es explícita: las versiones localizadas solo son duplicados si el contenido principal sigue sin traducir. El riesgo real es la imagen inversa: páginas casi idénticas en el mismo idioma entre variantes de país (en-US, en-GB, en-AU), sin localización real de moneda, ortografía o normativa. Google puede agruparlas y elegir una versión canonical, lo que puede debilitar la segmentación geográfica incluso con hreflang correcto. hreflang no detiene la agrupación: puede ayudar a mostrar la URL adecuada dentro de un grupo, pero es una sugerencia, no una directiva. En mi estudio de 374 756 dominios que usaban hreflang, el 67 % tenía al menos un problema. La solución para la duplicación real en el mismo idioma es localizar de verdad o consolidar, no añadir más etiquetas. Vigila la trampa de Search Console: una página regional puede desaparecer del informe de URL canonical aunque se siga sirviendo correctamente.
TL;DR — Traducir una página a otro idioma no crea contenido duplicado para Google: una página alemana y su versión en inglés son contenido diferente, punto. Lo que la gente llama «contenido duplicado entre idiomas» es, en gran medida, un mito. El riesgo real es el contrario: páginas en el mismo idioma para países distintos (una versión de Estados Unidos, Reino Unido y Australia) que son casi idénticas, sin diferencias reales. Google puede tratarlas como duplicados.
El mito en una línea
Oirás que, si traduces tu contenido al español, francés y alemán, Google marcará como contenido duplicado todas esas versiones. No es cierto, y nunca lo ha sido. La documentación de Google dice que las páginas traducidas solo se consideran duplicados si el contenido principal sigue sin traducir. Cuando traduces las palabras de verdad, son contenido diferente.
Evidence for this claim Google says localized pages are considered duplicates only when their main content remains untranslated. Scope: Google Search treatment of localized page variants; canonical selection can still apply to substantially similar same-language pages. Confidence: high · Verified: Google: Localized versionsGoogle determina el idioma a partir del contenido visible, no de hreflang, del
atributo lang de HTML ni de la URL.
Tiene sentido: un buscador que tratara las traducciones como duplicados estaría castigando a todos los sitios multilingües de la web, y hreflang —el sistema que Google creó para los sitios multilingües— no tendría sentido.
Qué está realmente en riesgo
El problema real es la imagen inversa del mito. Imagina una tienda en inglés que crea tres copias de una página:
example.com/us/para Estados Unidosexample.com/uk/para Reino Unidoexample.com/au/para Australia
Si esas tres páginas son básicamente idénticas —mismas palabras, mismos precios, sin localización real—, eso sí es contenido duplicado genuino. Están en el mismo idioma y no hay nada que las diferencie de forma significativa. Google puede decidir que son duplicados, agruparlas y elegir solo una para mostrarla. Tu cuidadosa configuración por país puede acabar convertida silenciosamente en una sola página.
Entonces, ¿qué lo soluciona?
No más etiquetas. La solución son diferencias reales:
- Moneda y precios distintos (USD frente a GBP y AUD).
- Ortografía y redacción distintas (color/colour y expresiones locales).
- Textos distintos sobre envíos, devoluciones, impuestos y aspectos legales.
- Ejemplos o productos realmente diferentes cuando corresponda.
Si tus páginas por país son realmente distintas, no son duplicados. Si son clones con una bandera cambiada en una esquina, ninguna cantidad de hreflang obligará a Google a mantenerlas separadas.
Dónde encaja hreflang
hreflang no corrige el contenido duplicado. Es una forma de decirle a Google: «estas páginas son versiones unas de otras; muestra la correcta a la persona correcta». Puede ayudar a Google a intercambiar tu página del Reino Unido para una persona que busca desde el Reino Unido incluso dentro de un grupo de duplicados, pero es una sugerencia, no una orden, y no impide que se forme el grupo. La forma de mantener separadas las páginas por país es hacerlas realmente distintas.
¿Quieres la versión profunda —cómo funciona realmente la agrupación de Google, por qué una página puede «desaparecer» de Search Console mientras sigue posicionándose y los datos reales sobre la frecuencia con la que falla hreflang—? Cambia a la pestaña Avanzado.
Diagnóstico de síntomas de contenido duplicado entre locales
Una página traducida aparece como duplicada
Síntoma: una auditoría agrupa dos URL en idiomas distintos. Causa probable: el contenido principal nunca se tradujo, solo cambiaron la navegación y el texto de plantilla, o la herramienta compara el marcado en vez del idioma. Solución: inspecciona el contenido principal renderizado; completa la traducción donde aún sea igual y mantén las traducciones legítimas en URL independientes con canonical autorreferente.
Una página regional desaparece del informe de URL canónica
Síntoma: Search Console informa de que una página de un país es la canónica de otra página del mismo idioma. Causa probable: las páginas regionales son casi idénticas y Google las agrupó. Solución: confirma si la URL prevista aún se intercambia para la audiencia correcta; si el mercado necesita realmente una página separada, localiza moneda, disponibilidad, detalles legales e intención de búsqueda en vez de añadir más etiquetas.
Hreflang es correcto, pero aparece la URL regional equivocada
Síntoma: en la búsqueda aparece otra versión del mismo idioma para un país. Causa probable: hreflang es solo una sugerencia y una diferenciación débil o conflictos de canonical pesan más. Solución: alinea los canonicals autorreferentes, repara las anotaciones recíprocas y haz sustantiva la distinción regional; consolida las variantes que no necesitan diferir.
Las URL localizadas apuntan con canonical a la página del idioma original
Síntoma: las páginas traducidas declaran la URL original como canonical y no consiguen indexarse de forma independiente. Causa probable: una plantilla compartida aplica un canonical entre idiomas. Solución: usa canonicals autorreferentes para las alternativas traducidas legítimas y conéctalas con hreflang recíproco.
TL;DR — «Contenido duplicado entre idiomas» es, en gran medida, un mito: la documentación de Google dice que las versiones localizadas solo son duplicados si el contenido principal sigue sin traducir, así que las traducciones reales son contenido diferente. El riesgo genuino son las páginas casi duplicadas en el mismo idioma para países distintos (en-US/en-GB/en-AU sin localización), que se agrupan y reciben una única canonical, deshaciendo la segmentación geográfica. hreflang no evita la agrupación; es una señal para intercambiar la URL dentro del grupo, y solo una sugerencia. En mi estudio de 374 756 dominios que usaban hreflang, el 67 % tenía al menos un problema. Vigila la trampa de Search Console: una página regional consolidada puede desaparecer del informe de canonicals y seguir sirviéndose correctamente. La solución es localizar de verdad o consolidar, no añadir más etiquetas.
El mito y por qué está al revés
El término principal «contenido duplicado entre idiomas» lleva incorporado un mito: la idea de que traducir una página a otro idioma crea contenido duplicado. No lo hace, y Google es especialmente directo al respecto. En su guía sobre versiones localizadas, Google afirma que “Localized versions of a page are only considered duplicates if the main content of the page remains untranslated.” (traducción) «Las versiones localizadas de una página solo se consideran duplicados si el contenido principal de la página sigue sin traducir.» Ir a la cita Traduce el contenido principal y las páginas son contenido diferente, punto.
Evidence for this claim Google says localized pages are considered duplicates only when their main content remains untranslated. Scope: Google Search treatment of localized page variants; canonical selection can still apply to substantially similar same-language pages. Confidence: high · Verified: Google: Localized versionsEsa es la premisa completa de hreflang. Google dice que se debe “Use hreflang to tell Google about the variations of your content, so that we can understand that these pages are localized variations of the same content.” (traducción) «usar hreflang para informar a Google de las variaciones de tu contenido, de modo que pueda entender que esas páginas son variantes localizadas del mismo contenido.» Ir a la cita Es una herramienta de mapeo para alternativas legítimamente distintas, no un parche para un problema de duplicación que no existe en las traducciones reales. Y no confundas hreflang con la detección del idioma: Google “doesn’t use hreflang or the HTML lang attribute to detect the language of a page; instead, we use algorithms to determine the language.” (traducción) «no usa hreflang ni el atributo lang de HTML para detectar el idioma de una página; usa algoritmos para determinarlo.» Ir a la cita
Evidence for this claim Google says it determines page language from visible content rather than hreflang, the HTML lang attribute, or the URL. Scope: Google Search language detection, not browser or accessibility behavior. Confidence: high · Verified: Google: Make page language obviousMatt Cutts dijo lo mismo sobre el inglés sin traducir en ccTLD distintos en 2011:
según Search Engine Roundtable,
usar el mismo contenido en inglés en .com, .fr y .de no es un problema para
Google; y, si puedes, contrata a un traductor e implementa hreflang, pero no hay
motivo para entrar en pánico. Esta ha sido la posición de Google durante más de
una década.
El matiz: traducir solo la plantilla
La prueba de que «el contenido principal sigue sin traducir» tiene una trampa. Si solo traduces la plantilla —menú, navegación, pie, barra lateral y texto repetido— pero dejas el cuerpo principal en el idioma original, no has traducido la página. La prueba de Google se refiere al contenido principal, no al armazón que lo rodea. En mi guía sobre canonicalización señalo esto como un patrón de duplicación distinto: menús y texto repetido traducidos, pero el cuerpo principal sin traducir. Traducir la mitad no te saca del grupo de duplicados; lo que importa es que cambie el contenido principal, no que cambie algo de la página.
Cuando audites este caso, comprueba la página renderizada y visible, no solo
el marcado fuente. Google determina el idioma a partir de lo que realmente ven
los usuarios, no de hreflang, del atributo lang de HTML ni de la URL.
Evidence for this claim Google says it determines page language from visible content rather than hreflang, the HTML lang attribute, or the URL. Scope: Google Search language detection, not browser or accessibility behavior. Confidence: high · Verified: Google: Make page language obvious Una plantilla que cambia lang="fr"
en la etiqueta <html> mientras el bloque de contenido principal sigue
renderizándose en inglés no ha traducido nada que importe a la detección del
idioma ni a la comprobación de contenido duplicado de Google. Abre la página real
y lee el bloque de contenido principal.
El riesgo real: páginas casi duplicadas en el mismo idioma para países distintos
Este es el escenario que el mito oculta. Tienes varias páginas en el mismo
idioma dirigidas a países distintos —en-US, en-GB, en-AU o
de-DE/de-CH— y son casi idénticas, sin localización real de moneda, ortografía,
normativa, envíos o ejemplos. Eso sí es contenido duplicado genuino.
Los mismos productos en países distintos
Un catálogo de comercio electrónico no necesita reescribir cada descripción del fabricante solo para justificar una URL regional de producto. Dos páginas pueden describir el mismo producto físico en el mismo idioma y representar ofertas significativamente distintas. Comprueba el estado comercial, no solo la similitud de párrafos:
- precio en la moneda y el mercado correspondientes;
- impuestos, aranceles, promociones, garantías y condiciones de devolución;
- destinos, velocidades, costes y restricciones de códigos postales de entrega;
- disponibilidad en línea, en tienda, para recogida y por variante;
- inventario de la tienda local o identidad del vendedor;
- información legal, de tallas, medidas o normativa;
- URL canonical, conjunto de hreflang recíproco y datos estructurados de la oferta.
Cuando esas diferencias son reales, cada página regional prevista debería exponer normalmente su propia URL estable, canonical autorreferente y anotación hreflang correspondiente. La oferta visible, el marcado Product/Offer, el feed de comercio y el checkout deben describir el mismo mercado. Un selector de moneda que solo cambia un símbolo, o una plantilla que cambia el nombre del país mientras el catálogo y el cumplimiento del pedido siguen idénticos, es una evidencia débil para mantener otra página indexable. La guía de datos estructurados de productos de Google y las políticas de Merchant Center tratan la oferta de la página de destino y los datos comerciales enviados como representaciones conectadas que deben contener información exacta del producto.
Incluye el país en el título cuando aclare la oferta o coincida con una intención real cualificada por país —por ejemplo, entrega, disponibilidad en tienda, normativa o una gama de productos específica del mercado—. No añadas nombres de país mecánicamente a todos los títulos que, por lo demás, son idénticos. Eso crea variación en los metadatos sin convertir la página en un mejor resultado regional. La decisión anterior —si el negocio necesita segmentación por idioma, por país o por ambos— pertenece a Segmentación por idioma frente a segmentación por país.
La guía de sitios multirregionales de Google lo aborda directamente: «if you have multiple pages in the same language as part of a multi-regional site (for instance, if both example.de/ and example.com/de/ show similar German language content), pick a preferred version and use the rel=“canonical” element and hreflang tags to make sure that the correct language or regional URL is served to searchers.» (traducción) «si tienes varias páginas en el mismo idioma como parte de un sitio multirregional (por ejemplo, si example.de/ y example.com/de/ muestran contenido similar en alemán), elige una versión preferida y usa el elemento rel=“canonical” y las etiquetas hreflang para asegurarte de que se sirva a los buscadores la URL lingüística o regional correcta.» Ir a la cita Fíjate en el encuadre: Google no dice que las páginas no sean duplicados; dice que gestiones la duplicación con canonical y hreflang.
Cómo funciona realmente la agrupación
En el pódcast Search Off the Record de Google (episodio 16), el equipo de Search Relations explicó este mecanismo usando un ejemplo alemán/suizo-alemán. John Mueller dijo: “we have, at the same time, systems that try to understand when content is duplicated, and we try to put them into one cluster of pages, and then sometimes, the German and the Swiss page will get into the same cluster. But with hreflang, we can show the proper URL, at least.” (traducción) «al mismo tiempo tenemos sistemas que intentan entender cuándo se duplica el contenido y procuramos ponerlo en un grupo de páginas; a veces la página alemana y la suiza entran en el mismo grupo. Pero con hreflang podemos mostrar la URL correcta, al menos.» Martin Splitt añadió que, en general, no es un problema: “it makes sense that these are put together in the same dup cluster… because it’s the same content, essentially.” (traducción) «tiene sentido que se agrupen en el mismo grupo de duplicados… porque, en esencia, es el mismo contenido.»
Léelo con atención, porque es el centro de todo el tema: hreflang funciona dentro de la agrupación, no contra ella. Google decide que las páginas son duplicados, las agrupa y elige una canonical; el trabajo de hreflang es ayudar a intercambiar la URL servida por la adecuada para quien busca. Gary Illyes describió ese intercambio como un componente de posicionamiento: si buscas en un idioma y aparecería una página en el idioma equivocado, Google cambia al resultado correcto. Pero la agrupación ya ocurrió. hreflang no la evitó; solo dirigió el intercambio dentro del grupo.
Por eso he sido tajante en mi guía sobre canonicalización: hreflang no resuelve la duplicación en los sitios internacionales. Google intentará normalmente cambiar a la versión correcta, pero no está garantizado y esta configuración falla a menudo. En mi ponencia de SEO internacional de Pubcon 2017 lo expresé con claridad: ¿cómo puedes tener hreflang recíproco A→B y B→A si Google ya piensa que A=C y A ni siquiera está indexada? Cuando Google ha deduplicado las páginas, el grupo de hreflang que construiste ya no tiene una base sólida.
Hay una salvedad sobre el mecanismo anterior: la explicación de agrupación e intercambio procede del equipo de Search Relations de Google explicándolo en un pódcast, no de una especificación escrita, y Google no documenta paso a paso la conexión interna exacta. Trátala como la explicación oficial más clara del comportamiento, no como un detalle de implementación garantizado e inmutable. Para la regla duradera y actual, apóyate en la guía de sitios multirregionales de Google y en la guía de URL canónicas: elige una versión preferida y alinea canonical con hreflang. Usa el pódcast para entender por qué existe esa guía, no como un mecanismo separado y verificable.
La trampa del informe de Search Console
Esta es la parte que alarma a los profesionales y una observación que suele estar desatendida. Como Search Console informa sobre la URL canonical, una página regional consolidada en el mismo idioma puede parecer que desapareció aunque se siga sirviendo correctamente. En SOTR, episodio 16, Martin Splitt describió exactamente esto: en el informe puede parecer que «¿qué pasó con la página suiza? Ha desaparecido», porque ahora es un duplicado de la página alemana; pero eso no significa que Google haya dejado de mostrar la página suiza a la gente de Suiza.
Así que, si una página regional desaparece de tus informes de canonical o indexación, no supongas que se desindexó. En el caso de un grupo del mismo idioma, la página puede haberse incorporado al grupo de otro local a efectos del informe y seguir posicionándose para su audiencia prevista. El diagnóstico práctico: si una página local pierde de forma repetida frente a la versión de otro local en el informe de canonical, o la URL del país equivocado aparece en la SERP de un mercado, es un síntoma de agrupación por mismo idioma, no un error de sintaxis de hreflang ni algo que necesariamente vayan a arreglar más etiquetas de hreflang. Confirma qué se está sirviendo realmente —obtén la URL desde el mercado objetivo o comprueba las posiciones allí directamente— en vez de depender solo del informe de canonical. El comportamiento exacto de este informe no está detallado en la documentación escrita de Google, así que verifica lo que está activo antes de sacar conclusiones.
¿Hay una penalización? No
No existe una penalización por contenido duplicado en este caso, y nunca la hubo. John Mueller, en un tuit de 2021 recogido por Search Engine Roundtable, dijo: “There’s no duplicate content penalty for something like that, but concentrating your site’s value on fewer pages generally makes it easier for those pages to be more visible.” (traducción) «No hay una penalización por contenido duplicado para algo así, pero concentrar el valor de tu sitio en menos páginas suele facilitar que esas páginas tengan más visibilidad.» Ese segundo inciso es el coste real: no una penalización, sino dilución. Repartir la autoridad entre clones casi idénticos debilita cada uno.
Conviene precisar qué cubre «no hay penalización»: se refiere a la
canonicalización ordinaria —Google consolida páginas locales casi idénticas y
elige una para posicionarla de buena fe—. Es una cuestión distinta de las
políticas de spam independientes de Google sobre contenido escalado de poco valor
o páginas doorway creadas para manipular los resultados entre variantes de país o
idioma. Ese es un problema de intención manipuladora, no de agrupación en el
mismo idioma, y se evalúa por separado. Un sitio con páginas en-US/en-GB
honestamente casi duplicadas y sin intención de engañar no está en territorio de
penalización; un sitio que produce masivamente variantes locales delgadas solo
para capturar más espacio de búsqueda es otro caso.
Bing cubre algo parecido, pero conviene señalarlo por separado porque es su propia guía, no un comportamiento confirmado de Google. En su publicación de diciembre de 2025 sobre contenido duplicado, Bing dice que la localización crea contenido duplicado cuando las páginas regionales o lingüísticas son casi idénticas y no ofrecen diferencias significativas a los usuarios de cada mercado. Su solución va en la misma dirección que la de Google: diferenciar de forma significativa (terminología, ejemplos, normativa y detalles del producto), usar hreflang cuando corresponda y usar canonical para las variantes que no representan una intención de búsqueda distinta. Bing también dice que los sistemas de IA agrupan las URL casi duplicadas en una página representativa; conviene señalarlo como observación propia de Bing sobre su búsqueda con IA, no como un comportamiento confirmado de Google. (Bing apenas usa hreflang; se apoya en la señal del idioma del contenido, así que en Bing la diferenciación importa todavía más que las etiquetas.)
Lo que dicen los datos: hreflang falla mucho
Si dependes de hreflang para mantener ordenadas tus variantes regionales, ten en cuenta lo frágil que es en la práctica. En mi estudio de Brighton SEO 2023 sobre 374 756 dominios, el 67 % de los dominios que usaban hreflang tenía al menos un problema: faltaba x-default, faltaban etiquetas autorreferentes, se apuntaba a páginas redirigidas o rotas, faltaban etiquetas recíprocas, se señalaban URL que no eran canonical y más. hreflang es una de unas 20 señales de canonicalización, y un grupo roto solo significa que Google ignora la asociación y vuelve al tratamiento normal de duplicados. Si tu defensa contra la consolidación en el mismo idioma es un grupo de hreflang y dos tercios de los grupos del mundo real están rotos, esa defensa es más débil de lo que suele suponerse. Incluso Mueller ha dicho que a menudo le sorprende que la gente consiga hreflang bien, dada toda la complejidad.
Cómo solucionarlo de verdad
- Decide si las variantes son realmente diferentes. Si
en-USyen-GBtienen moneda, precios, envíos, texto legal y ortografía distintos, bien: no son duplicados. Si son clones, ese es tu problema, no tus etiquetas. - Localiza de verdad o consolida. La solución es una localización genuina (moneda, ortografía, normativa y ejemplos) o menos páginas. A veces la respuesta técnica correcta es una página bien diferenciada, no tres clones y hreflang. El consejo de Mueller de «concentrar el valor en menos páginas» se aplica directamente.
- Alinea canonical + hreflang + x-default para que no se contradigan. Cada
local debe autorreferenciar su canonical; el grupo hreflang debe referenciar
todos los locales, incluido el propio; y x-default debe apuntar a una alternativa
razonable. La herida clásica que uno mismo se inflige — mi «Error n.º 5» de mi
guía de hreflang — es que hreflang
apunte a una página cuyo
rel=canonicaldice que no es la autoridad. Las señales contradictorias se ignoran. Esto también funciona al revés: no apuntes con canonical una traducción genuina de vuelta a la página del idioma original solo para acallar una preocupación por contenido duplicado que no corresponde. La guía de URL canónicas de Google es específica: el canonical de una página debe estar en el mismo idioma que la propia página, o ser el mejor sustituto disponible si no existe un canonical en el mismo idioma. Canonicalizar una página traducida a un original en otro idioma no arregla nada; solo le dice a Google que la URL localizada no es la que debe mostrar, lo que puede sacarla por completo de los resultados de ese mercado. - Diagnostica en Search Console, pero léelo bien. Que falte una página regional del informe de canonical puede significar consolidación, no desindexación. Confirma qué se está sirviendo realmente en el mercado objetivo antes de «arreglar» un problema que quizá no existe.
Cómo se conecta con el resto del clúster
Esta pieza se ocupa del ángulo del contenido duplicado; sus hermanas cubren las decisiones adyacentes. La cuestión de si necesitas siquiera una variante por país pertenece a la decisión de segmentación por idioma frente a país. La mecánica de las etiquetas —grupos recíprocos, códigos ISO válidos y los tres métodos de implementación— pertenece a hreflang, y el valor de fallback tiene su propio tratamiento en x-default. La diferencia entre traducir palabras y adaptar de verdad una página a un mercado es la distinción entre traducción y localización: justo lo que convierte un clon de país casi duplicado en contenido realmente distinto. La calidad de la traducción automática es otro riesgo; no confundas una traducción automática delgada con el mito del contenido duplicado entre idiomas.
Resumen de IA
Una síntesis de la versión Avanzada:
- El mito está al revés. Google no trata las traducciones como contenido duplicado. Según la documentación de Google, las versiones localizadas solo son duplicados «si el contenido principal de la página sigue sin traducir». Traduce el contenido principal y las páginas son contenido diferente.
- La premisa completa de hreflang es mapear alternativas legítimamente distintas por idioma o local; no es una solución para el contenido duplicado.
- El riesgo real es la imagen inversa: páginas casi duplicadas en el mismo idioma para países distintos (en-US/en-GB/en-AU, de-DE/de-CH), sin localización real de moneda, ortografía, normativa o contenido. Esos sí son duplicados genuinos.
- Traducir solo la plantilla sigue fallando la prueba. Lo que importa es que cambie el contenido principal, no que se traduzcan el menú y la navegación.
- Google agrupa los casi duplicados y elige un canonical. hreflang funciona dentro del grupo como señal de intercambio, no contra él: no detiene la agrupación y es una sugerencia, no una directiva.
- Trampa de Search Console: una página regional consolidada puede «desaparecer» del informe de canonical y seguir sirviéndose correctamente en su mercado. No confundas consolidación con desindexación; confirma lo que está activo, porque la explicación exacta del intercambio y el informe procede de un pódcast de Google, no de una especificación escrita.
- No hay penalización (Mueller, 2021) por la consolidación ordinaria, pero concentrar el valor en menos páginas las hace más visibles. Eso es distinto de las políticas de spam de Google sobre contenido escalado o doorway manipulador, que son otra cuestión basada en la intención. Bing describe una realidad parecida en su propia guía y añade que los sistemas de IA agrupan los casi duplicados.
- Datos: en mi estudio de 374 756 dominios, el 67 % de los dominios que usaban hreflang tenía al menos un problema; por eso es frágil confiar en hreflang para preservar variantes.
- La solución es localizar de verdad o consolidar, no añadir más etiquetas; además, alinea canonical + hreflang + x-default y nunca canonicalices una traducción real de vuelta a un original en otro idioma.
Documentación oficial
Documentación de fuentes primarias de los buscadores.
- Informar a Google de las versiones localizadas de una página — la fuente del desmentido principal: el contenido principal traducido no es duplicado y muestra para qué sirve hreflang.
- Gestionar sitios multirregionales y multilingües — el caso del mismo idioma en regiones distintas (example.de/ frente a example.com/de/) y la solución con canonical + hreflang; también las señales de localización que observa Google (idioma y moneda locales, direcciones y teléfonos).
- Search Off the Record, episodio 16 — «Cómo funciona la publicación, hreflang y más» — la explicación oficial más clara de la agrupación en el mismo idioma, el mecanismo de intercambio y la trampa del informe de Search Console.
Bing / Microsoft
- ¿El contenido duplicado perjudica el SEO y la visibilidad en la búsqueda con IA? (diciembre de 2025) — Bing explica cuándo la localización crea contenido duplicado, cómo diferenciarlo y cómo los sistemas de IA agrupan URL casi duplicadas.
Citas de las fuentes
Declaraciones registradas de Google y Bing. Cada enlace profundo salta al pasaje citado de la fuente (las líneas del pódcast llevan marca de tiempo, porque la transcripción es un PDF sin ancla de página).
Google — el contenido traducido no es contenido duplicado (el desmentido)
- “Localized versions of a page are only considered duplicates if the main content of the page remains untranslated.” (traducción) «Las versiones localizadas de una página solo se consideran duplicados si el contenido principal de la página sigue sin traducir.» — documentación de Google Search Central. Ir a la cita
- “Use hreflang to tell Google about the variations of your content, so that we can understand that these pages are localized variations of the same content.” (traducción) «Usa hreflang para informar a Google de las variaciones de tu contenido, de modo que pueda entender que estas páginas son variantes localizadas del mismo contenido.» Ir a la cita
- “Google doesn’t use hreflang or the HTML lang attribute to detect the language of a page; instead, we use algorithms to determine the language.” (traducción) «Google no usa hreflang ni el atributo lang de HTML para detectar el idioma de una página; usa algoritmos para determinarlo.» Ir a la cita
Google — el caso genuino de mismo idioma y región distinta, y la solución
- «…if you have multiple pages in the same language as part of a multi-regional site (for instance, if both example.de/ and example.com/de/ show similar German language content), pick a preferred version and use the rel=“canonical” element and hreflang tags to make sure that the correct language or regional URL is served to searchers.» (traducción) «si tienes varias páginas en el mismo idioma como parte de un sitio multirregional (por ejemplo, si example.de/ y example.com/de/ muestran contenido similar en alemán), elige una versión preferida y usa el elemento rel=“canonical” y las etiquetas hreflang para asegurarte de que se sirva a los buscadores la URL lingüística o regional correcta.» — documentación de Google Search Central. Ir a la cita
- “Other signals to identify the intended audience of your site can include local addresses and phone numbers on the pages, the use of local language and currency, links from other local sites, or signals from your Business Profile (where available).” (traducción) «Otras señales para identificar la audiencia prevista de tu sitio pueden incluir direcciones y teléfonos locales en las páginas, el uso del idioma y la moneda locales, enlaces de otros sitios locales o señales de tu Perfil de Empresa, cuando estén disponibles.» Ir a la cita
Google — cómo funcionan la agrupación y el intercambio (Search Off the Record, episodio 16)
- John Mueller: “we have, at the same time, systems that try to understand when content is duplicated, and we try to put them into one cluster of pages, and then sometimes, the German and the Swiss page will get into the same cluster. But with hreflang, we can show the proper URL, at least.” (traducción) «al mismo tiempo tenemos sistemas que intentan entender cuándo se duplica el contenido y procuramos ponerlo en un grupo de páginas; a veces la página alemana y la suiza entran en el mismo grupo. Pero con hreflang podemos mostrar la URL correcta, al menos.» — SOTR, episodio 16, aproximadamente 00:26:59.
- Martin Splitt: “it makes sense that these are put together in the same dup cluster, or duplication cluster, because it’s the same content, essentially.” (traducción) «tiene sentido que se agrupen en el mismo grupo de duplicados, o grupo de duplicación, porque, en esencia, es el mismo contenido.» — SOTR, episodio 16, aproximadamente 00:27:23.
- Martin Splitt, sobre la trampa del informe: la página suiza puede parecer que “has disappeared because it’s now a duplicate of the German page, but that doesn’t mean that we are not showing the Swiss page to people in Switzerland.” (traducción) «ha desaparecido porque ahora es un duplicado de la página alemana, pero eso no significa que no mostremos la página suiza a la gente de Suiza.» — SOTR, episodio 16, aproximadamente 00:27:35.
- John Mueller, sobre la dificultad de hreflang: “I’m often surprised when people get things right with regards to hreflang because of all of the complexity.” (traducción) «a menudo me sorprende que la gente consiga hacer bien hreflang, dada toda la complejidad.» — SOTR, episodio 16, aproximadamente 00:17:50.
Google — no hay penalización (a través del tuit incrustado de Search Engine Roundtable)
- John Mueller (mayo de 2021): “There’s no duplicate content penalty for something like that, but concentrating your site’s value on fewer pages generally makes it easier for those pages to be more visible.” (traducción) «No hay una penalización por contenido duplicado para algo así, pero concentrar el valor de tu sitio en menos páginas suele facilitar que esas páginas tengan más visibilidad.» Leer la cobertura
¿Es realmente un problema de contenido duplicado o una traducción legítima?
Trabaja de arriba abajo. La mayoría de las preocupaciones sobre «contenido duplicado entre idiomas» se disuelven en el paso 1.
Paso 1 — ¿Las páginas están en idiomas distintos o en el mismo idioma?
- Idiomas distintos (inglés frente a alemán frente a español, con el contenido principal realmente traducido) → no es un problema de contenido duplicado. Para Google son contenido diferente. Usa hreflang para mapear las alternativas y sigue adelante. Detente aquí.
- Mismo idioma, país o región distinta (en-US frente a en-GB frente a en-AU) → puede existir contenido duplicado real. Ve al paso 2.
Paso 2 — ¿Está traducido el contenido principal o solo la plantilla? (para la ruta de idiomas distintos, comprueba esto por seguridad)
- Solo se tradujeron el menú, la navegación y el pie, pero el cuerpo principal no cambió → sigue siendo efectivamente duplicado. La prueba de Google se refiere al contenido principal. Traduce el cuerpo o no has salido del grupo.
- El contenido principal está realmente traducido → contenido diferente, no un duplicado.
Paso 3 — ¿Las páginas del mismo idioma para cada país difieren de verdad? Comprueba la sustancia: moneda, precios, convenciones ortográficas, envíos y devoluciones, impuestos, texto legal o normativo, disponibilidad de productos y ejemplos.
- Sí — diferencias reales y mantenidas → no son duplicados. Mantenlas separadas; alinea canonical + hreflang + x-default para que las señales no se contradigan.
- No — clones casi idénticos → contenido duplicado genuino. Ve al paso 4.
Paso 4 — ¿Localizar o consolidar?
- El mercado justifica contenido localizado real → localiza de verdad (moneda, ortografía, aspectos legales y ejemplos). Entonces las páginas no son duplicados.
- El mercado no justifica contenido único → consolida. Menos páginas fuertes son mejores que una proliferación de clones; concentrar el valor las hace más visibles.
Comprobación de realidad sobre hreflang: en ningún paso añadir hreflang convierte duplicados en páginas no duplicadas. hreflang ayuda a Google a servir la URL correcta desde un grupo; nunca detiene la agrupación. Si tu única «solución» es añadir más etiquetas, no has arreglado la duplicación.
Mitos y errores habituales
Las formas recurrentes en que este tema se tuerce y qué hacer en su lugar.
1. «Google penaliza el contenido traducido como contenido duplicado.» Por qué es incorrecto: la documentación de Google dice que el contenido principal traducido no es duplicado y, para empezar, no existe un mecanismo de penalización por contenido duplicado (Mueller, 2021). Haz esto: traduce libremente, mapea las alternativas con hreflang y deja de preocuparte por una penalización que no existe.
2. «hreflang evita el contenido duplicado.» Por qué es incorrecto: hreflang funciona dentro de la agrupación de Google, no contra ella: «intentamos ponerlas en un grupo… pero con hreflang podemos mostrar la URL correcta, al menos». Es una señal de intercambio y una sugerencia, no una directiva. Haz esto: trata hreflang como un mecanismo para intercambiar versiones, no para eliminar duplicados. Evita la duplicación con diferencias reales de contenido o con menos páginas.
3. «Si mi hreflang es correcto, Google siempre mostrará la URL exacta que indiqué.» Por qué es incorrecto: hreflang es una sugerencia. Google puede ignorarlo y lo hace cuando otras señales (similitud del contenido, canonical o estructura del sitio) entran en conflicto; además, en mi estudio el 67 % de los dominios que usaban hreflang tenía al menos un problema. Haz esto: alinea todas las señales (canonical, enlaces internos, hreflang y x-default) y comprueba qué sirve realmente Google.
4. «Las páginas regionales del mismo idioma necesitan una traducción intensa para evitar duplicados.» Por qué es incorrecto: en-US y en-GB ya están en el mismo idioma; no hay nada que traducir. Necesitan localización, no traducción. Haz esto: diferéncialas mediante moneda, ortografía, envíos, contenido legal o normativo y ejemplos: diferencias reales, no lingüísticas.
5. «Traducir solo el menú y la navegación es suficiente.» Por qué es incorrecto: la prueba de duplicación de Google se refiere al contenido principal. Traducir solo la plantilla deja el contenido principal sin traducir, así que la página sigue pudiendo activar la prueba. Haz esto: traduce el contenido principal, no solo la plantilla que lo rodea.
6. «Está bien usar hreflang hacia una página que no es canonical.»
Por qué es incorrecto: si rel=canonical dice que una página no es la autoridad
mientras hreflang la señala como un destino distinto, has enviado señales
contradictorias: mi «Error n.º 5». Las contradicciones se ignoran.
Haz esto: cada local debe autorreferenciar su canonical; el grupo hreflang debe
referenciar todos los locales, incluido el propio.
7. «Mi página del Reino Unido desapareció de Search Console, así que se desindexó.» Por qué es incorrecto: en el caso de un grupo del mismo idioma, una página regional puede desaparecer del informe canonical porque se integró en el grupo de otro local, aunque se siga sirviendo al mercado correcto, según el propio pódcast de Google. Haz esto: confirma qué se sirve realmente al mercado objetivo antes de tratar la consolidación como desindexación.
8. «El contenido traducido automáticamente es contenido duplicado por defecto.» Por qué es incorrecto: la calidad de la traducción automática y el contenido delgado son riesgos distintos, no el mito del contenido duplicado entre idiomas. Google juzga el contenido traducido por el valor para el usuario, no por si lo produjo una máquina. Haz esto: mantén separados los dos problemas: preocúpate por la calidad de la traducción automática, no por la traducción automática como duplicación.
Ejemplos prácticos
Cuatro escenarios que separan el mito del riesgo real.
1. Traducción completa — inglés, alemán y español (no es duplicado) Un sitio de marketing SaaS cuyo contenido principal está realmente traducido al alemán y al español. Palabras distintas, mismo significado.
- Veredicto: no es contenido duplicado. Para Google es contenido diferente.
- Qué hacer: conecta los tres con hreflang recíproco; no hace falta nada más para la duplicación. El mito termina aquí.
2. «Traducción» solo de la plantilla (sigue siendo efectivamente duplicado) Una página cuyo menú, pie y barra lateral están traducidos al francés, pero cuyo cuerpo principal sigue en inglés.
- Veredicto: el contenido principal no está traducido, así que todavía puede tratarse como efectivamente duplicado; esa es la trampa de la prueba de Google de que «el contenido principal sigue sin traducir».
- Qué hacer: traduce el cuerpo principal o no publiques la página «francesa».
3. Clones en-US frente a en-GB frente a en-AU (contenido duplicado genuino) Una tienda en inglés crea tres carpetas por país idénticas byte por byte: mismos precios en USD, mismo texto, todo igual, solo cambia el icono de la bandera.
- Veredicto: contenido duplicado genuino. Mismo idioma, sin diferencias reales. Google puede agruparlas y elegir un canonical, deshaciendo silenciosamente la configuración.
- Qué hacer: localiza de verdad (precios en GBP/AUD, ortografía, envíos y aspectos legales) o consolida en menos páginas. hreflang no salvará los clones.
4. de-DE frente a de-CH, bien localizadas (no es duplicado) Un sitio en alemán con una versión para Alemania y otra para Suiza: precios distintos en EUR frente a CHF, envíos y texto legal específicos de Suiza y convenciones ortográficas del alemán suizo (por ejemplo, sin ß).
- Veredicto: páginas del mismo idioma realmente diferenciadas, no clones. Mantenlas separadas.
- Qué hacer: canonical autorreferente por local, un grupo hreflang recíproco
(
de-DE,de-CH) y un x-default sensato. Señales alineadas, sin contradicciones.
La idea central: un idioma distinto casi nunca es el problema; el mismo idioma sin diferencias reales casi siempre lo es.
Ponte a prueba: contenido duplicado entre idiomas
Cinco preguntas rápidas sobre el mito, el riesgo real y el encaje de hreflang. Elige una respuesta para cada una y comprueba después.
Recursos que merecen tu tiempo
Mis artículos relacionados
- Google utiliza unas 40 señales de canonicalización — mi guía sobre canonicalización, incluido por qué hreflang no resuelve la duplicación internacional y el patrón de duplicación por traducir solo la plantilla.
- Hreflang: la guía sencilla para principiantes — implementación, reglas recíprocas y autorreferentes y el error de usar hreflang hacia una página que no es canonical.
- Duplicado: Google eligió un canonical distinto al del usuario — el estado exacto de GSC que aparece cuando se consolida una página local y cómo alinear las señales.
- Guía de SEO técnico para principiantes — dónde encajan el contenido duplicado y las configuraciones internacionales en el panorama general.
Mis ponencias
- Los problemas de hreflang más comunes en 374 756 dominios — Brighton SEO 2023 (diapositivas · vídeo) — el estudio detrás de la cifra del 67 % de dominios con problemas y el encuadre de hreflang como una de unas 20 señales de canonicalización.
- Vas a estropear el SEO internacional — Pubcon Vegas 2017 (SlideShare) — por qué hreflang falla después de que Google ya haya deduplicado las páginas y el caos de su implementación.
Oficial
- Google — Informar a Google de las versiones localizadas de una página — el desmentido del mito directamente desde la fuente.
- Google — Gestionar sitios multirregionales y multilingües — el caso de mismo idioma y región distinta y la solución canonical + hreflang.
- Bing — ¿El contenido duplicado perjudica el SEO y la visibilidad en la búsqueda con IA? (diciembre de 2025).
De otras fuentes del sector
- Search Off the Record, episodio 16 — Cómo funciona la publicación, hreflang y más (Google Search Relations) — la agrupación, el mecanismo de intercambio y la trampa del informe de Search Console, en palabras de Google.
- Los sitios internacionalizados con el mismo contenido en inglés no siempre son tratados como duplicados por Google (Search Engine Roundtable, Barry Schwartz) — Matt Cutts (2011), el tuit de John Mueller sobre la «no penalización» (2021) y la cautela de Gianluca Fiorelli.
- Hreflang, SEO internacional y contenido duplicado: cómo solucionarlo (thegray.company) — uno de los mejores artículos comparables; separa correctamente el contenido multilingüe (sin riesgo) del mismo idioma en regiones distintas (riesgo real).
- El mito de la penalización por contenido duplicado (Search Engine Land) — la realidad más amplia de la «no penalización» en la que encaja este tema.
- 6 errores comunes de las etiquetas hreflang que sabotean tu SEO internacional (Search Engine Journal) — errores recurrentes de implementación, incluido hreflang hacia una página que no es canonical.
- r/TechSEO — comunidad para depurar hreflang y contenido duplicado.
Registro de cambios
Actualizado el 22 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 22 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 8 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 29 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 18 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.