Contenido duplicado entre idiomas

El contenido traducido no es contenido duplicado para Google — ese mito está al revés. El riesgo real son páginas casi idénticas en el mismo idioma entre variantes de país. De Patrick Stox.

Publicado por primera vez: 2 jul 2026 · Última actualización: 22 ago 2026 · Avanzado
Idiomas

Google no trata las traducciones como contenido duplicado: una página alemana y su original en inglés son contenido diferente para los sistemas de Google, y esa es la premisa de hreflang. La documentación de Google es explícita: las versiones localizadas solo son duplicados si el contenido principal sigue sin traducir. El riesgo real es la imagen inversa: páginas casi idénticas en el mismo idioma entre variantes de país (en-US, en-GB, en-AU), sin localización real de moneda, ortografía o normativa. Google puede agruparlas y elegir una versión canonical, lo que puede debilitar la segmentación geográfica incluso con hreflang correcto. hreflang no detiene la agrupación: puede ayudar a mostrar la URL adecuada dentro de un grupo, pero es una sugerencia, no una directiva. En mi estudio de 374 756 dominios que usaban hreflang, el 67 % tenía al menos un problema. La solución para la duplicación real en el mismo idioma es localizar de verdad o consolidar, no añadir más etiquetas. Vigila la trampa de Search Console: una página regional puede desaparecer del informe de URL canonical aunque se siga sirviendo correctamente.

TL;DR — «Contenido duplicado entre idiomas» es, en gran medida, un mito: la documentación de Google dice que las versiones localizadas solo son duplicados si el contenido principal sigue sin traducir, así que las traducciones reales son contenido diferente. El riesgo genuino son las páginas casi duplicadas en el mismo idioma para países distintos (en-US/en-GB/en-AU sin localización), que se agrupan y reciben una única canonical, deshaciendo la segmentación geográfica. hreflang no evita la agrupación; es una señal para intercambiar la URL dentro del grupo, y solo una sugerencia. En mi estudio de 374 756 dominios que usaban hreflang, el 67 % tenía al menos un problema. Vigila la trampa de Search Console: una página regional consolidada puede desaparecer del informe de canonicals y seguir sirviéndose correctamente. La solución es localizar de verdad o consolidar, no añadir más etiquetas.

El mito y por qué está al revés

El término principal «contenido duplicado entre idiomas» lleva incorporado un mito: la idea de que traducir una página a otro idioma crea contenido duplicado. No lo hace, y Google es especialmente directo al respecto. En su guía sobre versiones localizadas, Google afirma que “Localized versions of a page are only considered duplicates if the main content of the page remains untranslated.” (traducción) «Las versiones localizadas de una página solo se consideran duplicados si el contenido principal de la página sigue sin traducir.» Ir a la cita Traduce el contenido principal y las páginas son contenido diferente, punto.

Evidence for this claim Google says localized pages are considered duplicates only when their main content remains untranslated. Scope: Google Search treatment of localized page variants; canonical selection can still apply to substantially similar same-language pages. Confidence: high · Verified: Google: Localized versions

Esa es la premisa completa de hreflang. Google dice que se debe “Use hreflang to tell Google about the variations of your content, so that we can understand that these pages are localized variations of the same content.” (traducción) «usar hreflang para informar a Google de las variaciones de tu contenido, de modo que pueda entender que esas páginas son variantes localizadas del mismo contenido.» Ir a la cita Es una herramienta de mapeo para alternativas legítimamente distintas, no un parche para un problema de duplicación que no existe en las traducciones reales. Y no confundas hreflang con la detección del idioma: Google “doesn’t use hreflang or the HTML lang attribute to detect the language of a page; instead, we use algorithms to determine the language.” (traducción) «no usa hreflang ni el atributo lang de HTML para detectar el idioma de una página; usa algoritmos para determinarlo.» Ir a la cita

Evidence for this claim Google says it determines page language from visible content rather than hreflang, the HTML lang attribute, or the URL. Scope: Google Search language detection, not browser or accessibility behavior. Confidence: high · Verified: Google: Make page language obvious

Matt Cutts dijo lo mismo sobre el inglés sin traducir en ccTLD distintos en 2011: según Search Engine Roundtable, usar el mismo contenido en inglés en .com, .fr y .de no es un problema para Google; y, si puedes, contrata a un traductor e implementa hreflang, pero no hay motivo para entrar en pánico. Esta ha sido la posición de Google durante más de una década.

El matiz: traducir solo la plantilla

La prueba de que «el contenido principal sigue sin traducir» tiene una trampa. Si solo traduces la plantilla —menú, navegación, pie, barra lateral y texto repetido— pero dejas el cuerpo principal en el idioma original, no has traducido la página. La prueba de Google se refiere al contenido principal, no al armazón que lo rodea. En mi guía sobre canonicalización señalo esto como un patrón de duplicación distinto: menús y texto repetido traducidos, pero el cuerpo principal sin traducir. Traducir la mitad no te saca del grupo de duplicados; lo que importa es que cambie el contenido principal, no que cambie algo de la página.

Cuando audites este caso, comprueba la página renderizada y visible, no solo el marcado fuente. Google determina el idioma a partir de lo que realmente ven los usuarios, no de hreflang, del atributo lang de HTML ni de la URL. Evidence for this claim Google says it determines page language from visible content rather than hreflang, the HTML lang attribute, or the URL. Scope: Google Search language detection, not browser or accessibility behavior. Confidence: high · Verified: Google: Make page language obvious Una plantilla que cambia lang="fr" en la etiqueta <html> mientras el bloque de contenido principal sigue renderizándose en inglés no ha traducido nada que importe a la detección del idioma ni a la comprobación de contenido duplicado de Google. Abre la página real y lee el bloque de contenido principal.

El riesgo real: páginas casi duplicadas en el mismo idioma para países distintos

Este es el escenario que el mito oculta. Tienes varias páginas en el mismo idioma dirigidas a países distintos —en-US, en-GB, en-AU o de-DE/de-CH— y son casi idénticas, sin localización real de moneda, ortografía, normativa, envíos o ejemplos. Eso sí es contenido duplicado genuino.

Los mismos productos en países distintos

Un catálogo de comercio electrónico no necesita reescribir cada descripción del fabricante solo para justificar una URL regional de producto. Dos páginas pueden describir el mismo producto físico en el mismo idioma y representar ofertas significativamente distintas. Comprueba el estado comercial, no solo la similitud de párrafos:

  • precio en la moneda y el mercado correspondientes;
  • impuestos, aranceles, promociones, garantías y condiciones de devolución;
  • destinos, velocidades, costes y restricciones de códigos postales de entrega;
  • disponibilidad en línea, en tienda, para recogida y por variante;
  • inventario de la tienda local o identidad del vendedor;
  • información legal, de tallas, medidas o normativa;
  • URL canonical, conjunto de hreflang recíproco y datos estructurados de la oferta.

Cuando esas diferencias son reales, cada página regional prevista debería exponer normalmente su propia URL estable, canonical autorreferente y anotación hreflang correspondiente. La oferta visible, el marcado Product/Offer, el feed de comercio y el checkout deben describir el mismo mercado. Un selector de moneda que solo cambia un símbolo, o una plantilla que cambia el nombre del país mientras el catálogo y el cumplimiento del pedido siguen idénticos, es una evidencia débil para mantener otra página indexable. La guía de datos estructurados de productos de Google y las políticas de Merchant Center tratan la oferta de la página de destino y los datos comerciales enviados como representaciones conectadas que deben contener información exacta del producto.

Incluye el país en el título cuando aclare la oferta o coincida con una intención real cualificada por país —por ejemplo, entrega, disponibilidad en tienda, normativa o una gama de productos específica del mercado—. No añadas nombres de país mecánicamente a todos los títulos que, por lo demás, son idénticos. Eso crea variación en los metadatos sin convertir la página en un mejor resultado regional. La decisión anterior —si el negocio necesita segmentación por idioma, por país o por ambos— pertenece a Segmentación por idioma frente a segmentación por país.

La guía de sitios multirregionales de Google lo aborda directamente: «if you have multiple pages in the same language as part of a multi-regional site (for instance, if both example.de/ and example.com/de/ show similar German language content), pick a preferred version and use the rel=“canonical” element and hreflang tags to make sure that the correct language or regional URL is served to searchers.» (traducción) «si tienes varias páginas en el mismo idioma como parte de un sitio multirregional (por ejemplo, si example.de/ y example.com/de/ muestran contenido similar en alemán), elige una versión preferida y usa el elemento rel=“canonical” y las etiquetas hreflang para asegurarte de que se sirva a los buscadores la URL lingüística o regional correcta.» Ir a la cita Fíjate en el encuadre: Google no dice que las páginas no sean duplicados; dice que gestiones la duplicación con canonical y hreflang.

Cómo funciona realmente la agrupación

En el pódcast Search Off the Record de Google (episodio 16), el equipo de Search Relations explicó este mecanismo usando un ejemplo alemán/suizo-alemán. John Mueller dijo: “we have, at the same time, systems that try to understand when content is duplicated, and we try to put them into one cluster of pages, and then sometimes, the German and the Swiss page will get into the same cluster. But with hreflang, we can show the proper URL, at least.” (traducción) «al mismo tiempo tenemos sistemas que intentan entender cuándo se duplica el contenido y procuramos ponerlo en un grupo de páginas; a veces la página alemana y la suiza entran en el mismo grupo. Pero con hreflang podemos mostrar la URL correcta, al menos.» Martin Splitt añadió que, en general, no es un problema: “it makes sense that these are put together in the same dup cluster… because it’s the same content, essentially.” (traducción) «tiene sentido que se agrupen en el mismo grupo de duplicados… porque, en esencia, es el mismo contenido.»

Léelo con atención, porque es el centro de todo el tema: hreflang funciona dentro de la agrupación, no contra ella. Google decide que las páginas son duplicados, las agrupa y elige una canonical; el trabajo de hreflang es ayudar a intercambiar la URL servida por la adecuada para quien busca. Gary Illyes describió ese intercambio como un componente de posicionamiento: si buscas en un idioma y aparecería una página en el idioma equivocado, Google cambia al resultado correcto. Pero la agrupación ya ocurrió. hreflang no la evitó; solo dirigió el intercambio dentro del grupo.

Por eso he sido tajante en mi guía sobre canonicalización: hreflang no resuelve la duplicación en los sitios internacionales. Google intentará normalmente cambiar a la versión correcta, pero no está garantizado y esta configuración falla a menudo. En mi ponencia de SEO internacional de Pubcon 2017 lo expresé con claridad: ¿cómo puedes tener hreflang recíproco A→B y B→A si Google ya piensa que A=C y A ni siquiera está indexada? Cuando Google ha deduplicado las páginas, el grupo de hreflang que construiste ya no tiene una base sólida.

Hay una salvedad sobre el mecanismo anterior: la explicación de agrupación e intercambio procede del equipo de Search Relations de Google explicándolo en un pódcast, no de una especificación escrita, y Google no documenta paso a paso la conexión interna exacta. Trátala como la explicación oficial más clara del comportamiento, no como un detalle de implementación garantizado e inmutable. Para la regla duradera y actual, apóyate en la guía de sitios multirregionales de Google y en la guía de URL canónicas: elige una versión preferida y alinea canonical con hreflang. Usa el pódcast para entender por qué existe esa guía, no como un mecanismo separado y verificable.

La trampa del informe de Search Console

Esta es la parte que alarma a los profesionales y una observación que suele estar desatendida. Como Search Console informa sobre la URL canonical, una página regional consolidada en el mismo idioma puede parecer que desapareció aunque se siga sirviendo correctamente. En SOTR, episodio 16, Martin Splitt describió exactamente esto: en el informe puede parecer que «¿qué pasó con la página suiza? Ha desaparecido», porque ahora es un duplicado de la página alemana; pero eso no significa que Google haya dejado de mostrar la página suiza a la gente de Suiza.

Así que, si una página regional desaparece de tus informes de canonical o indexación, no supongas que se desindexó. En el caso de un grupo del mismo idioma, la página puede haberse incorporado al grupo de otro local a efectos del informe y seguir posicionándose para su audiencia prevista. El diagnóstico práctico: si una página local pierde de forma repetida frente a la versión de otro local en el informe de canonical, o la URL del país equivocado aparece en la SERP de un mercado, es un síntoma de agrupación por mismo idioma, no un error de sintaxis de hreflang ni algo que necesariamente vayan a arreglar más etiquetas de hreflang. Confirma qué se está sirviendo realmente —obtén la URL desde el mercado objetivo o comprueba las posiciones allí directamente— en vez de depender solo del informe de canonical. El comportamiento exacto de este informe no está detallado en la documentación escrita de Google, así que verifica lo que está activo antes de sacar conclusiones.

¿Hay una penalización? No

No existe una penalización por contenido duplicado en este caso, y nunca la hubo. John Mueller, en un tuit de 2021 recogido por Search Engine Roundtable, dijo: “There’s no duplicate content penalty for something like that, but concentrating your site’s value on fewer pages generally makes it easier for those pages to be more visible.” (traducción) «No hay una penalización por contenido duplicado para algo así, pero concentrar el valor de tu sitio en menos páginas suele facilitar que esas páginas tengan más visibilidad.» Ese segundo inciso es el coste real: no una penalización, sino dilución. Repartir la autoridad entre clones casi idénticos debilita cada uno.

Conviene precisar qué cubre «no hay penalización»: se refiere a la canonicalización ordinaria —Google consolida páginas locales casi idénticas y elige una para posicionarla de buena fe—. Es una cuestión distinta de las políticas de spam independientes de Google sobre contenido escalado de poco valor o páginas doorway creadas para manipular los resultados entre variantes de país o idioma. Ese es un problema de intención manipuladora, no de agrupación en el mismo idioma, y se evalúa por separado. Un sitio con páginas en-US/en-GB honestamente casi duplicadas y sin intención de engañar no está en territorio de penalización; un sitio que produce masivamente variantes locales delgadas solo para capturar más espacio de búsqueda es otro caso.

Bing cubre algo parecido, pero conviene señalarlo por separado porque es su propia guía, no un comportamiento confirmado de Google. En su publicación de diciembre de 2025 sobre contenido duplicado, Bing dice que la localización crea contenido duplicado cuando las páginas regionales o lingüísticas son casi idénticas y no ofrecen diferencias significativas a los usuarios de cada mercado. Su solución va en la misma dirección que la de Google: diferenciar de forma significativa (terminología, ejemplos, normativa y detalles del producto), usar hreflang cuando corresponda y usar canonical para las variantes que no representan una intención de búsqueda distinta. Bing también dice que los sistemas de IA agrupan las URL casi duplicadas en una página representativa; conviene señalarlo como observación propia de Bing sobre su búsqueda con IA, no como un comportamiento confirmado de Google. (Bing apenas usa hreflang; se apoya en la señal del idioma del contenido, así que en Bing la diferenciación importa todavía más que las etiquetas.)

Lo que dicen los datos: hreflang falla mucho

Si dependes de hreflang para mantener ordenadas tus variantes regionales, ten en cuenta lo frágil que es en la práctica. En mi estudio de Brighton SEO 2023 sobre 374 756 dominios, el 67 % de los dominios que usaban hreflang tenía al menos un problema: faltaba x-default, faltaban etiquetas autorreferentes, se apuntaba a páginas redirigidas o rotas, faltaban etiquetas recíprocas, se señalaban URL que no eran canonical y más. hreflang es una de unas 20 señales de canonicalización, y un grupo roto solo significa que Google ignora la asociación y vuelve al tratamiento normal de duplicados. Si tu defensa contra la consolidación en el mismo idioma es un grupo de hreflang y dos tercios de los grupos del mundo real están rotos, esa defensa es más débil de lo que suele suponerse. Incluso Mueller ha dicho que a menudo le sorprende que la gente consiga hreflang bien, dada toda la complejidad.

Cómo solucionarlo de verdad

  1. Decide si las variantes son realmente diferentes. Si en-US y en-GB tienen moneda, precios, envíos, texto legal y ortografía distintos, bien: no son duplicados. Si son clones, ese es tu problema, no tus etiquetas.
  2. Localiza de verdad o consolida. La solución es una localización genuina (moneda, ortografía, normativa y ejemplos) o menos páginas. A veces la respuesta técnica correcta es una página bien diferenciada, no tres clones y hreflang. El consejo de Mueller de «concentrar el valor en menos páginas» se aplica directamente.
  3. Alinea canonical + hreflang + x-default para que no se contradigan. Cada local debe autorreferenciar su canonical; el grupo hreflang debe referenciar todos los locales, incluido el propio; y x-default debe apuntar a una alternativa razonable. La herida clásica que uno mismo se inflige — mi «Error n.º 5» de mi guía de hreflang — es que hreflang apunte a una página cuyo rel=canonical dice que no es la autoridad. Las señales contradictorias se ignoran. Esto también funciona al revés: no apuntes con canonical una traducción genuina de vuelta a la página del idioma original solo para acallar una preocupación por contenido duplicado que no corresponde. La guía de URL canónicas de Google es específica: el canonical de una página debe estar en el mismo idioma que la propia página, o ser el mejor sustituto disponible si no existe un canonical en el mismo idioma. Canonicalizar una página traducida a un original en otro idioma no arregla nada; solo le dice a Google que la URL localizada no es la que debe mostrar, lo que puede sacarla por completo de los resultados de ese mercado.
  4. Diagnostica en Search Console, pero léelo bien. Que falte una página regional del informe de canonical puede significar consolidación, no desindexación. Confirma qué se está sirviendo realmente en el mercado objetivo antes de «arreglar» un problema que quizá no existe.

Cómo se conecta con el resto del clúster

Esta pieza se ocupa del ángulo del contenido duplicado; sus hermanas cubren las decisiones adyacentes. La cuestión de si necesitas siquiera una variante por país pertenece a la decisión de segmentación por idioma frente a país. La mecánica de las etiquetas —grupos recíprocos, códigos ISO válidos y los tres métodos de implementación— pertenece a hreflang, y el valor de fallback tiene su propio tratamiento en x-default. La diferencia entre traducir palabras y adaptar de verdad una página a un mercado es la distinción entre traducción y localización: justo lo que convierte un clon de país casi duplicado en contenido realmente distinto. La calidad de la traducción automática es otro riesgo; no confundas una traducción automática delgada con el mito del contenido duplicado entre idiomas.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.