Contenido duplicado
No existe una penalización por contenido duplicado. Qué costes reales puede tener la duplicación, cómo agrupan los motores las URL y eligen una canónica, y cómo corregirla.
Idiomas
1 señal de evidencia en esta página
- Herramienta activa relacionadaHTTP Status & Redirect Checker
No existe una penalización general por contenido duplicado: Google y Bing lo dicen; la duplicación normal se gestiona mediante deduplicación y selección de la URL representativa, no mediante una acción de política. Los costes reales son indirectos y posibles, no garantizados: dilución de señales, elección de la URL equivocada (aunque otro miembro del grupo puede servirse en un contexto concreto), rastreo menos eficiente y medición más confusa. Los motores agrupan las URL coincidentes y eligen una URL representativa a partir de señales para representar el conjunto. La mayoría de la duplicación es técnica, no editorial (http/https, www, parámetros, navegación facetada, URL de impresión y móvil); filtros, ordenaciones, paginación, variantes y traducciones completas requieren revisar cada caso. Corrige según la intención: causa raíz/301 → rel=canonical → parámetros → noindex solo cuando quieras eliminar → hreflang → sindicación, donde la guía actual favorece que el socio aplique noindex a su copia. Las penalizaciones solo afectan al abuso engañoso y a escala.
Evidence for this claim Ordinary duplicate content is generally handled through canonicalization rather than a general duplicate-content penalty. Scope: Google duplicate URL handling. Confidence: high · Verified: Google Search Central: Duplicate URLs Evidence for this claim Redirects and rel=canonical are strong signals for specifying a preferred canonical URL, but Google may select another canonical. Scope: Google canonicalization signals. Confidence: high · Verified: Google Search Central: Canonical URLsTL;DR — El contenido duplicado es el mismo contenido, o casi el mismo, que aparece en más de una dirección web. No existe una «penalización por contenido duplicado»: Google lo ha dicho durante años; los duplicados normales se agrupan y se elige una versión para mostrar. Lo que puede ocurrir es que las señales se dividan y que a veces aparezca la página «equivocada». La solución es dirigir todo a una URL preferida según el resultado que realmente quieres, sin entrar en pánico; además, no todo lo que parece duplicado (filtros, paginación o traducciones) lo es.
Qué es el contenido duplicado
Hay contenido duplicado cuando el mismo contenido, o uno muy parecido, se puede alcanzar desde más de una URL. Puede ocurrir dentro de un solo sitio o entre sitios distintos.
La mayoría de las veces no es alguien copiando tus textos: es un accidente técnico. La misma página acaba viviendo en varias direcciones, por ejemplo:
http://example.comyhttps://example.comexample.comywww.example.comexample.com/pageyexample.com/page?utm_source=newsletter
Para una persona, todas parecen «la página». Para un motor de búsqueda, cada URL distinta es una página distinta que casualmente tiene el mismo contenido.
Lo importante: no existe una penalización por contenido duplicado
Este es el miedo que trae a la mayoría hasta aquí, así que lo aclaro de entrada: Google no te penaliza por tener contenido duplicado. El equipo de Google escribió en 2008 que no existe una penalización por contenido duplicado, al menos no en el sentido habitual. Bing volvió a decirlo en 2025: el contenido duplicado no activa penalizaciones por sí solo.
En 2016 escribí un artículo titulado El mito de la penalización por contenido duplicado. El mito ha sido sorprendentemente difícil de eliminar, pero sigue siendo un mito.
La única excepción es la duplicación engañosa: raspar sitios ajenos y republicarlos, o generar automáticamente montones de páginas para manipular las posiciones. Eso es spam y el spam recibe acciones. La duplicación normal, accidental y técnica no infringe ninguna política; Google la incorpora a un grupo, elige una versión y la muestra como parte de su mantenimiento rutinario, no como castigo.
Entonces, ¿cuál es el problema real?
Si no hay penalización, ¿por qué corregirlo? Hay tres razones reales:
- Tus señales se dividen. Enlaces, clics y compartidos pueden apuntar a tres versiones distintas en vez de acumularse en una sola. Cada versión queda más débil que la página combinada.
- Google puede elegir la URL «equivocada». Cuando hay duplicados, Google escoge una para representar al grupo. Puede no ser la que tú habrías elegido; a veces otro miembro del grupo se sirve para una búsqueda concreta que encaja mejor, así que tampoco siempre hay una elección única y fija.
- El rastreo es menos eficiente. Google rastrea con más frecuencia la versión elegida y menos las copias para ahorrar esfuerzo. Normalmente está bien, pero en un sitio con mucha duplicación las páginas nuevas o actualizadas pueden descubrirse más despacio.
Nada de esto es un castigo. Son ineficiencias y todas se pueden corregir.
Cómo corregirlo (versión sencilla)
El objetivo siempre es el mismo: hacer que todo apunte a una URL preferida.
- Redirige las versiones que no quieres (como
httpo la que no usawww) a la que sí quieres mediante una redirección 301. - Cuando necesites que un duplicado siga siendo accesible, añade una etiqueta canónica (
rel="canonical") que indique qué versión es la real. - Enlaza de forma coherente a la versión preferida en todo tu sitio.
Esto cubre el 90 %. ¿Quieres la lista completa de causas, la jerarquía de soluciones en orden de preferencia, la configuración de sindicación y los mitos desmontados uno por uno? Cambia a la pestaña Avanzado.
Evidence for this claim Ordinary duplicate content is generally handled through canonicalization rather than a general duplicate-content penalty. Scope: Google duplicate URL handling. Confidence: high · Verified: Google Search Central: Duplicate URLs Evidence for this claim Redirects and rel=canonical are strong signals for specifying a preferred canonical URL, but Google may select another canonical. Scope: Google canonicalization signals. Confidence: high · Verified: Google Search Central: Canonical URLsTL;DR — No existe una penalización general por contenido duplicado: Google y Bing lo dicen explícitamente. La duplicación normal se resuelve mediante deduplicación y selección de la URL representativa, no mediante una acción de política. Los costes reales son indirectos y posibles, no garantizados: dilución de señales, elección de la URL equivocada (aunque otro miembro del grupo puede servirse en un contexto concreto), rastreo menos eficiente y medición más confusa. Los motores detectan duplicados → los agrupan → eligen una URL representativa a partir de señales; la URL declarada es una pista, no una regla. La mayoría de los duplicados son técnicos, no editoriales, pero filtros, ordenaciones, paginación, variantes y traducciones necesitan una revisión caso por caso. Corrige según la intención, aproximadamente en este orden: causa raíz / 301 →
rel="canonical"→ gestión de parámetros →noindexsolo para eliminar → hreflang → sindicación (la guía actual de Google favorece que el socio apliquenoindexa su copia en vez de depender solo de esa señal). Las penalizaciones solo afectan al abuso engañoso y a escala, como raspar y republicar masivamente sin aportar valor.
Qué es realmente el contenido duplicado
Como lo expresé en mi guía de Ahrefs: “Duplicate content is the same or similar content that appears on the web in more than one place. It can exist on one website or across multiple websites.” (traducción) «El contenido duplicado es el mismo contenido o uno similar que aparece en la web en más de un lugar. Puede existir en un solo sitio o en varios». La definición antigua de Google (de una publicación de Search Central de 2006) hablaba de bloques sustanciales dentro de un dominio o entre dominios que coinciden por completo o son apreciablemente similares.
La idea clave es reformularlo: la mayoría del contenido duplicado es un artefacto técnico, no plagio. Una página se sirve en varias direcciones y cada dirección es una URL distinta para un rastreador. La duplicación editorial también existe, pero es minoritaria y ni siquiera se penaliza salvo que sea engañosa.
La documentación actual de Google es más precisa: se refiere al contenido principal que es igual o muy parecido, no a una coincidencia palabra por palabra, y puede ocurrir dentro de un sitio o en toda la web. Conviene distinguirlo de: contenido pobre (una página demasiado escasa para ser útil, sea duplicada o no), plagio (una cuestión legal/ética, no técnica), canibalización de palabras clave (varias páginas distintas de tu sitio compiten por la misma consulta) y la puntuación de «casi duplicado» de un rastreador (un umbral configurable de una herramienta, no algo que Google publique o use directamente).
¿Existe una penalización por contenido duplicado? No.
Este es el eje de todo el tema, así que no puedo ser más claro: no existe una penalización general por contenido duplicado. Los dos grandes motores lo dicen.
La publicación de Google de 2008, Desmitificar la «penalización por contenido duplicado», empieza con la frase que todo el mundo debería conocer: “There’s no such thing as a ‘duplicate content penalty.’ At least, not in the way most people mean when they say that.” (traducción) «No existe una “penalización por contenido duplicado”, al menos no en el sentido que la mayoría da a esa frase». John Mueller lo ha reafirmado durante años; en mi guía de Ahrefs lo cito directamente: “We don’t have a duplicate content penalty. It’s not that we would demote a site for having a lot of duplicate content.” (traducción) «La penalización por contenido duplicado no existe: tener muchas copias no hace que rebajemos la posición de un sitio».
Bing volvió a decirlo recientemente. En su publicación de diciembre de 2025 escribió: “Duplicate content doesn’t trigger search penalties on its own, but it does reduce visibility by diluting authority.” (traducción) «El contenido duplicado no activa penalizaciones de búsqueda por sí solo, pero reduce la visibilidad al diluir la autoridad».
Llevo una década defendiendo esta idea. Mi artículo de 2016 en Search Engine Land, *El mito de la penalización por contenido duplicado *, lo expresó así: “Duplicate content is not grounds for action unless its intent is to manipulate search results.” (traducción) «El contenido duplicado no es motivo de acción salvo que su intención sea manipular los resultados de búsqueda». Esa frase sigue siendo toda la historia.
La única excepción real: abuso engañoso y a escala
Las penalizaciones solo entran en escena cuando la duplicación es manipuladora. Eso vive en las políticas de spam de Google, no en una regla de «contenido duplicado». La línea clara es el abuso de contenido a escala: “Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users.” (traducción) «El abuso de contenido a escala ocurre cuando se generan muchas páginas principalmente para manipular las posiciones y no para ayudar a los usuarios». También se menciona el scraping: “Republishing content from other sites without adding any original content or value, or even citing the original source” (traducción) «republicar contenido de otros sitios sin añadir contenido o valor original, ni siquiera citar la fuente original». La consecuencia es que “Sites that violate our policies may rank lower in results or not appear in results at all.” (traducción) «los sitios que infringen nuestras políticas pueden posicionarse más abajo o no aparecer en los resultados».
La distinción importante es esta: la duplicación benigna (la misma página en www y sin www) no es eso; Google normalmente gestiona el contenido duplicado mediante deduplicación y selección de la URL representativa, no mediante una acción de política. La duplicación engañosa y a escala es otro asunto de las políticas de spam. No confundas ambas cosas ni adoptes el absoluto contrario: «no hay penalización» no significa que la duplicación nunca pueda llevar a una acción; significa que la duplicación normal por sí sola no es el detonante.
Los costes reales del contenido duplicado
Si no hay penalización, ¿para qué molestarse? Hay algunos costes indirectos y posibles —no garantizados y no equivalentes a perder posiciones—:
- Señales diluidas o divididas. Cuando varias URL contienen el mismo contenido, las señales de posicionamiento se dispersan. Bing dice que “When several URLs contain the same content, signals such as clicks, links, impressions, and engagement are often diluted.” (traducción) «Cuando varias URL contienen el mismo contenido, las señales como clics, enlaces, impresiones y participación suelen diluirse». La documentación de Google lo formula de manera condicional: consolidar señales es una razón para especificar una URL preferida, lo que implica que la dilución es posible, no automática; una redirección o señal fuerte es lo que apila las señales en una URL.
- Se elige la URL equivocada, o aparece otra en un caso concreto. Google agrupa el conjunto y selecciona una URL representativa. Si tus señales están mezcladas puede elegir una versión no deseada; eso es lo que indica el estado de Search Console «Duplicate, Google chose different canonical than user» (traducción) «Google eligió una URL representativa distinta de la declarada». No siempre hay una única elección fija: la guía de Google sobre cómo funciona Search señala que otro miembro puede servirse si encaja mejor en un contexto concreto, como un dispositivo o una consulta específica.
- El rastreo es menos eficiente, no necesariamente «desperdiciado». Google rastrea la URL representativa elegida con más frecuencia y los demás miembros del grupo con menos frecuencia para reducir carga. Es un cambio relativo de cadencia, no una prueba de que cada duplicado consuma una cantidad material de crawl budget; pero en sitios grandes sí se acumula y se solapa con el crawl budget, la navegación facetada y las trampas de araña.
- La medición se vuelve más confusa. Tráfico, clics y conversiones divididos entre URL dificultan ver el rendimiento real de una pieza de contenido; Google enumera «simplificar las métricas de seguimiento» como una razón para consolidar.
Cómo gestionan los duplicados Google y Bing
El mecanismo es el mismo en ambos motores: detectar → agrupar → elegir una URL representativa.
La publicación de Google de 2008 describe el proceso en primera persona: cuando detecta contenido duplicado, por ejemplo por variaciones de parámetros de URL, agrupa las URL duplicadas en un conjunto y selecciona la que considera mejor para representarlo en los resultados. El motivo es ofrecer variedad: quiere mostrar diez resultados distintos, no diez URL con el mismo contenido. Google intenta filtrar documentos duplicados para reducir la redundancia y también señala el coste de rastreo: cuanto más tiempo y recursos dedica Googlebot a duplicados en varias URL, menos tiempo tiene para el resto del contenido.
Mueller también ha descrito la fase de publicación: si Google encuentra exactamente la misma información en varias páginas, cuando alguien la busca intenta encontrar la que mejor encaja y no muestra todas.
El giro de la búsqueda con IA en 2025. Bing aplica el mismo modelo al descubrimiento mediante LLM: “LLMs group near-duplicate URLs into a single cluster and then choose one page to represent the set. If the differences between pages are minimal, the model may select a version that is outdated.” (traducción) «Los LLM agrupan las URL casi duplicadas en un solo conjunto y eligen una página para representarlo. Si las diferencias son mínimas, el modelo puede seleccionar una versión desactualizada». Por eso la consolidación protege también tu visibilidad en búsqueda con IA, no solo los enlaces azules.
Esta es la relación con la canonicalización: agrupar y elegir una URL representativa es canonicalización. El contenido duplicado es el problema; la canonicalización es el proceso que lo resuelve. Tu URL declarada es una pista fuerte, no una instrucción: Google pondera las señales reunidas —redirecciones, rel="canonical", enlaces internos y sitemaps— para elegir la representante. Ninguna garantiza por sí sola el resultado.
Qué causa el contenido duplicado
Casi todo es técnico. Esta es la taxonomía completa de mi guía de Ahrefs, agrupada:
Variantes de protocolo y host
- HTTP frente a HTTPS
- sin www frente a www
Variantes de URL y parámetros
- Parámetros de seguimiento (UTM, etc.)
- ID de sesión en las URL
- URL sensibles a mayúsculas
- Barra final frente a ausencia de barra final
Páginas creadas por funciones del sitio
- URL para imprimir
- URL específicas de móvil (subdominios
m.) - URL AMP
- Navegación facetada o filtrada
- Páginas de etiquetas y categorías (archivo)
- URL de adjuntos o imágenes (texto repetitivo)
- Comentarios paginados
- Páginas de resultados de búsqueda interna
- Localización (variantes regionales en el mismo idioma)
Entre sitios
- Entornos de staging o desarrollo que se indexaron
- Sindicación y contenido raspado
La pregunta es: «¿cuántas URL distintas pueden llevar al mismo contenido?» Cada respuesta adicional es un duplicado. Los parámetros de URL son la fuente más prolífica, por eso reciben un tratamiento propio.
No todo lo que parece duplicación lo es
Algunos casos se llaman «contenido duplicado» por error cuando la respuesta correcta es «depende». Haz una revisión separada antes de tocar nada:
- Filtros, ordenaciones y paginación. Un parámetro no es automáticamente un duplicado. Los parámetros de seguimiento y sesión (
?utm_source=,?sessionid=) crean contenido equivalente y deberían apuntar mediante canonicalización a la URL limpia. Pero un filtro u ordenación puede cambiar la página; la guía de URL para comercio electrónico de Google pide revisarlos caso por caso. La paginación es otro caso: la guía de paginación dice que cada página debe tener su propia URL y una canónica autorreferente; no se recomienda llevar todas a la página uno. - Variantes de producto. Tampoco son siempre duplicados. URL separadas para un color, tamaño o configuración realmente distintos pueden ayudar a descubrir esa variante; lo que duplica es tener rutas equivalentes y parámetros redundantes para el mismo inventario. Evalúa la intención, no el hecho de que sea «solo una variante».
- Traducciones completas. Una página traducida a otro idioma no es un duplicado solo porque coincidan la plantilla y el diseño; la guía de versiones localizadas sitúa el límite en el idioma, no en el diseño. Las variantes regionales en el mismo idioma (
en-usfrente aen-gb) sí pueden agruparse como casi duplicados; por eso se relacionan con hreflang, no con consolidación. - Porcentaje de «casi duplicado» de un rastreador. Herramientas como Ahrefs y Screaming Frog marcan páginas que superan un umbral, a menudo ~90 %. Es una configuración diagnóstica de la herramienta, no un número que Google publique o aplique. Compara el contenido principal renderizado; no lo trates como un veredicto.
Cómo encontrar contenido duplicado
- Search Console — «Duplicate, Google chose different canonical than user» (traducción) «Google eligió una URL representativa distinta de la declarada». Es la señal más fuerte que tienes: Google sustituyó la URL declarada. Las causas habituales son contenido duplicado o similar, cadenas o bucles de canonical, errores en la etiqueta preferida, contenido internacional sin traducir y renderizado de una app shell de JavaScript. Escribí una guía completa sobre este estado.
- Un rastreador del sitio (Ahrefs Site Audit o Screaming Frog) detecta páginas duplicadas o casi duplicadas, títulos duplicados y variantes de protocolo, host y barra.
- Búsquedas
site:para localizar casos obvios: HTTP y HTTPS activos, URL con parámetros indexadas o subdominios de staging que escaparon. - Comprobación de accesibilidad. Prueba manualmente las variantes de una página importante (
http/https,www/sinwww, barra final y mayúsculas) y observa cuál resuelve con200en vez de redirigir. - Compara el contenido renderizado, no solo el HTML original. Google indexa lo que se renderiza, incluido JavaScript. Dos URL con fuentes distintas pero la misma salida renderizada pueden agruparse; dos HTML parecidos con contenido renderizado distinto tampoco. Cuando haya dudas, comprueba qué carga realmente en un navegador.
Cómo corregir contenido duplicado (orden de preferencia)
El orden siguiente es un buen valor predeterminado, pero la primera pregunta real es qué quieres que ocurra con esta URL: la solución correcta depende de la intención, no de una clasificación universal.
- ¿Quieres eliminar por completo el duplicado y redirigir el tráfico? → 301.
- ¿Necesitas mantenerlo accesible, pero quieres que otra URL lo represente en los resultados? →
rel="canonical". - ¿Es una página distinta que se agrupó por error? → hazla realmente diferente; eso no es una solución de canonicalización.
- ¿Quieres sacarla deliberadamente del índice de Google? →
noindex.
Con ese marco, este es el orden, empezando por las soluciones más fuertes y de causa raíz y dejando la eliminación para el final:
1. Corrige la causa raíz o consolida con redirecciones 301. Para variantes de protocolo, host, barra y mayúsculas, haz que solo resuelva una versión y redirige las demás hacia ella con 301. Una redirección es la señal de consolidación más fuerte de Google: “A strong signal that the target of the redirect should become canonical.” (traducción) «Una señal fuerte de que el destino de la redirección debe convertirse en canónico». Bing coincide: “Use 301 redirects to consolidate variants into a single preferred URL.” (traducción) «Usa redirecciones 301 para consolidar las variantes en una única URL preferida». Es la solución preferida porque elimina el duplicado y transmite las señales.
2. rel="canonical" cuando debes mantener accesible el duplicado. Si la copia debe seguir activa (una versión para imprimir o una URL con parámetros que el usuario necesita), añade una referencia a la URL preferida. Google dice: “A strong signal that the specified URL should become canonical.” (traducción) «Una señal fuerte de que la URL especificada debe convertirse en representativa». La palabra importante es señal: es una pista, no una instrucción. Google puede elegir otra si las demás señales entran en conflicto.
3. Gestión de parámetros y enlaces internos coherentes. Gestiona los parámetros de forma consistente: canonicaliza a la URL limpia y enlaza siempre internamente con la única versión preferida. La antigua herramienta de parámetros de URL de GSC se retiró en 2022; ahora se gestionan mediante canonical, robots y enlaces internos, no desde un panel. Incluir una URL en el sitemap es una señal débil que ayuda a que se convierta en representativa; deja los sitemaps solo con URL preferidas.
4. noindex, solo cuando realmente quieres eliminar la página. noindex elimina una página; no consolida señales en la URL preferida como sí hacen un 301 o una referencia preferida. Úsalo solo cuando quieres sacar la página del índice (por ejemplo, resultados de búsqueda interna pobres), no como solución predeterminada para duplicados. Si aplicas noindex cuando querías consolidar, tiras las señales en vez de fusionarlas.
Conviene distinguirlo con claridad: robots.txt y la herramienta de eliminación de URL de Search Console tampoco son métodos de canonicalización. Bloquear una URL en robots.txt impide que Googlebot vea la página, de modo que no puede evaluarla ni incorporarla a un grupo; no asigna un duplicado a una URL preferida. La eliminación oculta una URL temporalmente de los resultados; no consolida nada. Usa noindex, una redirección o una canónica cuando el objetivo sea consolidar.
5. hreflang para variantes localizadas. En variantes regionales del mismo idioma (en-us frente a en-gb), hreflang relaciona las versiones para mostrar la correcta a cada audiencia. No aumenta las posiciones ni es una herramienta de consolidación: solo muestra la variante regional adecuada.
6. Sindicación, y esta parte ha cambiado. Republicar no es arriesgado si la relación está bien configurada. Las políticas de spam de Google excluyen explícitamente la sindicación: “News publications that have syndicated news content from other news publications” (traducción) «publicaciones de noticias que han sindicado contenido de otras publicaciones de noticias» no se considera abuso. El riesgo nunca fue la sindicación en sí.
Pero el mecanismo recomendado ha dejado atrás el consejo de poner la URL preferida primero que yo y gran parte de la industria dábamos antes. La guía actual de solución de problemas de canonicalización ya no trata rel="canonical" como la vía principal para impedir que la copia del socio compita con el original: las páginas sindicadas suelen diferir lo suficiente (plantilla, introducción, anuncios o enlaces relacionados) para que Google no siempre respete la referencia hacia tu URL. Lo que Google describe ahora como más eficaz es que el socio de sindicación bloquee su copia para que no se indexe (su propio noindex o dejarla fuera del sitemap), en vez de depender de una referencia que apunte a tu página.
En la práctica, sigue pidiendo al socio que ponga una referencia hacia ti si está dispuesto: no perjudica y ayuda cuando las páginas son casi idénticas. Pero si controlas el riesgo de que la copia del socio supere a la original, la petición más fiable es mantener su copia fuera del índice por completo. Es una actualización real del consejo antiguo de «URL preferida o noindex, cualquiera sirve»; si configuraste una sindicación basándote solo en canonical hace tiempo, conviene revisarla con los socios relevantes.
Mitos del contenido duplicado, desmontados
- «Existe una penalización por contenido duplicado». No. Google: “There’s no such thing as a ‘duplicate content penalty.’” (traducción) «No existe una “penalización por contenido duplicado”». Bing dice que “doesn’t trigger search penalties on its own” (traducción) «no activa penalizaciones por sí solo». Las penalizaciones solo corresponden al abuso engañoso y a escala.
- «Si dos páginas son más de un X % similares, te penalizan». No. No hay un umbral porcentual que active una penalización. Los motores agrupan y eligen una URL representativa; no restan puntos por un porcentaje. Matt Cutts dijo una vez que entre el 25 % y el 30 % del contenido web era duplicado: es normal y esperado.
- «Citar fuentes o repetir texto fijo te perjudica». No. Los pies, avisos, especificaciones y citas son repeticiones normales que los motores esperan.
- «Tener http:// y https:// (o www y sin www) activos provoca una penalización». No hay penalización, pero sí un problema real de división de señales. Corrígelo con un 301 por eficiencia, no por miedo.
- «Una referencia rel=canonical garantiza el resultado». No.
rel="canonical"es una señal/pista, no una instrucción; un 301 es más fuerte y las señales contradictorias pueden hacer que Google elija otra. - «
noindexes la solución predeterminada para duplicados». Normalmente es incorrecto. Elimina una página, no consolida. Prefiere 301 o canonical y usanoindexsolo para eliminar de verdad.
En resumen
No hay penalización. Hay dilución, una URL equivocada en los resultados y rastreo menos eficiente; la solución para las tres cosas es consolidarlo todo en una URL representativa usando la señal más fuerte razonable. Si prefieres no ordenar los duplicados tú mismo, Google puede agruparlos y elegir una representante. Yo prefiero tomar esa decisión por adelantado.
Resumen de IA
Una versión condensada de la versión Advanced:
- No existe una penalización general por contenido duplicado. Google («no existe tal penalización») y Bing («no activa penalizaciones por sí solo») lo dicen. Google gestiona normalmente la duplicación mediante deduplicación y selección de la URL representativa, no mediante una acción de política. Las penalizaciones solo afectan al abuso engañoso y a escala, como scraping y republicación masiva sin valor.
- Los costes reales son indirectos y posibles: (1) dilución de señales; (2) elección de la URL equivocada, aunque otro miembro no representativo pueda servirse en un contexto concreto; (3) rastreo menos eficiente; (4) medición más confusa.
- Los motores lo gestionan: detectar → agrupar → elegir una URL representativa. Google agrupa las URL y selecciona una representante a partir de las señales; la URL declarada es una pista, no una regla. Bing aplica ahora el mismo modelo a la búsqueda con LLM/IA y puede mostrar una representante desactualizada, por lo que la consolidación también protege la visibilidad en IA.
- La mayoría de la duplicación es técnica: HTTP/HTTPS, www/sin www, parámetros, ID de sesión, mayúsculas, barra final, páginas de impresión/móvil/AMP, navegación facetada, archivos, búsqueda interna, staging y sindicación.
- No todo lo que parece duplicación lo es: filtros, ordenaciones y paginación requieren revisar el contenido; las páginas paginadas mantienen sus propias referencias; las variantes de producto pueden merecer URL propias; las traducciones completas a otro idioma no son duplicados; las variantes regionales del mismo idioma sí pueden agruparse; el porcentaje de «casi duplicado» es un ajuste de la herramienta.
- Encuéntralo con el estado de GSC «Duplicate, Google chose different canonical than user», un rastreador, búsquedas
site:, comprobaciones de accesibilidad y comparación del contenido renderizado. - Corrige según la intención: causa raíz / 301 →
rel="canonical"(pista, no instrucción) → gestión de parámetros y enlaces internos →noindexsolo para eliminar (tampoco consolidanrobots.txtni la herramienta de eliminación) → hreflang para variantes localizadas → sindicación, donde la guía actual favorece pedir al socionoindexen su copia. - Mitos desmontados: no existe un porcentaje de similitud penalizable; citar o repetir texto fijo está bien; HTTP y HTTPS activos no constituyen una penalización; una canónica no garantiza el resultado;
noindexno es la solución predeterminada.
Documentación oficial
Políticas de fuentes primarias de los motores de búsqueda.
- Qué es la canonicalización — mecánica actual: similitud del contenido principal, agrupación, frecuencia de rastreo y excepción de publicación según el contexto.
- Consolidar URL duplicadas / especificar una URL preferida — por qué especificar una URL preferida, cómo elige Google si no la declaras y el orden de fuerza de las señales (redirecciones > rel=canonical > sitemap).
- Solucionar problemas de canonicalización — guía actual para sindicación (noindex del socio frente a solo canonical), soluciones para copias y tiempos de reevaluación.
- Guía detallada de cómo funciona Google Search — renderizado antes de indexar, agrupación y publicación contextual de un miembro no representativo.
- Diseñar una estructura de URL para sitios de comercio electrónico — parámetros y variantes de producto.
- Paginación, carga incremental y su impacto en Google Search — cada página paginada debe tener su propia URL y una referencia autorreferente.
- Indicar a Google las versiones localizadas de tu página — el límite está en el idioma, no en el diseño; hreflang recíproco para variantes regionales.
- Políticas de spam — dónde viven las penalizaciones: abuso de contenido a escala, scraping y excepción de sindicación.
- Desmitificar la «penalización por contenido duplicado» (2008) — publicación original de «no hay penalización».
- Gestión legítima de duplicación de contenido entre dominios (2009) — referencia antigua para sindicación.
- Tratar con eficacia el contenido duplicado (2006) — definición histórica.
Bing / Microsoft
- ¿El contenido duplicado perjudica el SEO y la visibilidad en la búsqueda con IA? (diciembre de 2025) — modelo de Bing de «sin penalización → señales diluidas → agrupar → elegir una», extendido a búsqueda con LLM/IA.
Citas de las fuentes
Declaraciones públicas de Google y Bing. Cada enlace es un enlace profundo que salta al pasaje citado.
Google — no hay penalización
- “There’s no such thing as a ‘duplicate content penalty.’ At least, not in the way most people mean when they say that.” (traducción) «No existe una “penalización por contenido duplicado”, al menos no en el sentido que la mayoría da a esa frase». — Google Search Central, Desmitificar la «penalización por contenido duplicado» (2008). Leer la publicación
- “We don’t have a duplicate content penalty. It’s not that we would demote a site for having a lot of duplicate content.” (traducción) «No existe una penalización por contenido duplicado: un sitio no baja por acumular muchas copias». — John Mueller, Google. Ir a la cita
Google — dónde viven realmente las penalizaciones (políticas de spam)
- “Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users.” (traducción) «El abuso de contenido a escala ocurre cuando se generan muchas páginas principalmente para manipular las posiciones y no para ayudar a los usuarios». — Google Search Essentials, políticas de spam. Ir a la cita
- “Republishing content from other sites without adding any original content or value, or even citing the original source.” (traducción) «Republicar contenido de otros sitios sin añadir contenido o valor original, ni siquiera citar la fuente original». — políticas de spam de Google, scraping abusivo. Ir a la cita
- “Sites that violate our policies may rank lower in results or not appear in results at all.” (traducción) «Los sitios que infringen nuestras políticas pueden posicionarse más abajo o no aparecer en los resultados». Ir a la cita
- Excepción de sindicación: “News publications that have syndicated news content from other news publications.” (traducción) «Publicaciones de noticias que han sindicado contenido de otras publicaciones de noticias». Ir a la cita
Google — agrupación y jerarquía de soluciones
- “If you don’t specify a canonical URL, Google will identify which version of the URL is objectively the best version to show to users in Search.” (traducción) «Si no especificas una URL preferida, Google identificará qué versión es objetivamente la mejor para mostrar a los usuarios en la búsqueda». Ir a la cita
- Redirecciones: “A strong signal that the target of the redirect should become canonical.” (traducción) «Una señal fuerte de que el destino de la redirección debe convertirse en representativo». Ir a la cita
rel="canonical": “A strong signal that the specified URL should become canonical.” (traducción) «Una señal fuerte de que la URL especificada debe convertirse en representativa». Ir a la cita- Inclusión en sitemap: “A weak signal that helps the URLs that are included in a sitemap become canonical.” (traducción) «Una señal débil que ayuda a que las URL incluidas en un sitemap se conviertan en representativas». Ir a la cita
Bing — el mismo modelo, más el ángulo de IA
- “Duplicate content doesn’t trigger search penalties on its own, but it does reduce visibility by diluting authority.” (traducción) «El contenido duplicado no activa penalizaciones de búsqueda por sí solo, pero reduce la visibilidad al diluir la autoridad». — Bing Webmaster Blog (diciembre de 2025). Ir a la cita
- “When several URLs contain the same content, signals such as clicks, links, impressions, and engagement are often diluted.” (traducción) «Cuando varias URL contienen el mismo contenido, las señales como clics, enlaces, impresiones y participación suelen diluirse». Ir a la cita
- “LLMs group near-duplicate URLs into a single cluster and then choose one page to represent the set. If the differences between pages are minimal, the model may select a version that is outdated.” (traducción) «Los LLM agrupan las URL casi duplicadas en un solo grupo y eligen una página para representarlo. Cuando las páginas casi no se distinguen, el modelo puede acabar mostrando una versión antigua». Ir a la cita
Lista de comprobación de contenido duplicado
Repasa esto para encontrar y resolver la duplicación del sitio:
- Comprueba en Search Console los estados «Duplicate, Google chose different canonical than user» (traducción) «Google eligió una URL representativa distinta de la declarada» y «Duplicate without user-selected canonical» (traducción) «Duplicada sin URL preferida seleccionada por el usuario».
- Confirma que solo resuelve un protocolo:
httpredirige con 301 ahttps. - Confirma que solo resuelve un host: www y sin www no devuelven ambos
200; uno redirige al otro. - Confirma una convención única de barra final y un uso coherente de mayúsculas: las variantes redirigen en vez de resolver ambas.
- Los parámetros de seguimiento y sesión (UTM, sort, ID de sesión) apuntan mediante canonical a la URL limpia.
- Las variantes de impresión, móvil (
m.) y AMP apuntan con una referencia a la URL principal. - La navegación facetada o filtrada no genera URL duplicadas rastreables (canonical, robots o
#en vez de?). - Las páginas de etiquetas/categorías/archivo y los resultados de búsqueda interna no se indexan como duplicados pobres.
- Los subdominios de staging/desarrollo no están indexados (bloqueados o
noindex+ autenticación). - Cada página importante tiene una referencia autorreferente.
- Los enlaces internos apuntan a una única versión preferida.
- Los sitemaps solo enumeran URL preferidas e indexables.
- Las variantes localizadas se relacionan con hreflang, no se consolidan.
- Para copias sindicadas, pide al socio que aplique
noindex; una referencia hacia el original es una señal secundaria, no la solución principal. - Filtros, ordenaciones y paginación se evalúan por intención; las páginas paginadas mantienen su propia referencia.
Jerarquía de soluciones (en orden de preferencia)
Cuando encuentres duplicación, baja por esta lista: primero las soluciones de causa raíz y más fuertes; la eliminación queda al final. Elige la opción más alta que corresponda.
1. Corrige la causa raíz / redirección 301. Lo mejor es que el duplicado deje de existir. Para variantes de protocolo, host, barra y mayúsculas, haz que resuelva una versión y redirige las demás con 301. Una redirección es la señal más fuerte de Google: «una señal fuerte de que el destino debe convertirse en canónico». Es la opción predeterminada.
2. rel="canonical" cuando la copia debe seguir accesible. Si no puedes eliminarla (vista de impresión o parámetro necesario), apunta la canónica a la URL preferida. Es una pista fuerte, no una instrucción: Google puede elegir otra; respáldala con enlaces internos coherentes y un sitemap limpio.
3. Gestión de parámetros y enlaces internos coherentes. Trata los parámetros de forma consistente, canonicaliza a la URL limpia y enlaza internamente siempre con esa versión. La herramienta de parámetros de URL de GSC desapareció en 2022; esta es ahora la palanca de parámetros.
4. noindex, solo cuando realmente quieres eliminarlo. noindex elimina; no consolida. Úsalo cuando la página de verdad no deba estar en el índice (por ejemplo, búsqueda interna pobre), nunca como solución predeterminada para duplicados, porque descarta las señales en vez de unirlas.
5. hreflang para variantes localizadas. Las variantes regionales del mismo idioma no son necesariamente duplicados que haya que consolidar: relaciónalas con hreflang para mostrar la región correcta. No aumenta las posiciones; dirige la versión correcta.
6. Sindicación: pide al socio que bloquee la indexación, no solo una canonical. Una canonical hacia tu original ayuda y vale la pena pedirla, pero la guía actual de Google dice que bloquear la copia del socio (noindex) es más eficaz, porque las páginas sindicadas suelen diferir lo suficiente para que una canonical sola no las excluya de la competencia.
Regla de decisión en una línea: ¿puedes eliminar el duplicado? → 301. ¿No? → canonical. ¿Contenido distinto por región? → hreflang. ¿Quieres quitarlo por completo? → noindex. Usa la eliminación solo cuando la consolidación no sea lo que quieres. robots.txt y la eliminación de URL no están en esta lista: bloquean u ocultan, pero no consolidan.
Causa → solución recomendada
| Causa de duplicación | Solución recomendada |
|---|---|
| HTTP frente a HTTPS | Redirección 301 a HTTPS |
| sin www frente a www | 301 al host preferido |
| Barra final frente a ausencia | Elige una; redirige la otra con 301 |
| URL en mayúsculas frente a minúsculas | 301 a minúsculas o impón el uso de mayúsculas |
| Parámetros de seguimiento (UTM, etc.) | rel="canonical" a la URL limpia |
| ID de sesión | Eliminar de la URL; canonical a la limpia |
| URL para imprimir | rel="canonical" a la página principal |
URL móvil (m.) / AMP | rel="canonical" a la página canónica |
| Navegación facetada/filtrada | Canonical, bloqueo de robots o # en vez de ? |
| Etiquetas/categorías/archivos | Canonical o noindex si son pobres |
| Resultados de búsqueda interna | noindex (normalmente quieres quitarlos) |
| Variantes regionales localizadas | hreflang (relacionar, no consolidar) |
| Staging/desarrollo indexado | Bloqueo + noindex + autenticación |
| Sindicación | Pedir noindex en la copia del socio; la canonical hacia ti ayuda, pero ya no es la solución principal |
| Filtros, ordenaciones y paginación | Caso por caso; cada página paginada conserva su propia canonical |
| Traducciones completas (otro idioma) | No son duplicados; usa hreflang recíproco |
Fuerza de las señales (orden de Google): redirección 301 (fuerte) > rel="canonical" (fuerte) > inclusión en sitemap (débil). Una redirección gana a una canonical cuando entran en conflicto.
Qué hace cada herramienta
| Herramienta | ¿Consolida señales? | ¿Elimina del índice? | Úsala para |
|---|---|---|---|
| Redirección 301 | Sí | Sí (URL antigua) | Corregir variantes de causa raíz |
rel="canonical" | Sí (como pista) | No | Mantener accesible un duplicado |
noindex | No | Sí | Eliminar realmente una página |
| hreflang | No | No | Dirigir variantes localizadas |
Recuerda: no existe una penalización; corrige la duplicación para consolidar señales y mejorar la eficiencia del rastreo, no por miedo.
Cómo encontrar variantes duplicadas
No necesitas una herramienta sofisticada para detectar los duplicados técnicos habituales: unas pocas comprobaciones encuentran la mayoría.
Búsquedas site: (cualquier navegador). Detecta duplicados que ya están en el índice:
site:example.com inurl:http:// # is the http version indexed?
site:example.com inurl:? # parameterized URLs indexed?
site:staging.example.com # did a staging subdomain escape?
site:example.com intitle:"Your Page Title" # same title on multiple URLs?Comprueba qué variantes de URL resuelven con 200 (macOS/Linux). Si más de una devuelve 200 en vez de redirigir, tienes un problema de consolidación:
for url in \
"http://example.com/page" \
"https://example.com/page" \
"https://www.example.com/page" \
"https://example.com/page/" \
"https://example.com/Page"; do
code=$(curl -s -o /dev/null -w "%{http_code}" -I "$url")
echo "$code $url"
done
# Want: one 200 (the canonical) and the rest 301 to it.Equivalente en Windows (PowerShell):
$urls = "http://example.com/page","https://example.com/page",
"https://www.example.com/page","https://example.com/page/"
foreach ($u in $urls) {
$r = Invoke-WebRequest -Uri $u -Method Head -MaximumRedirection 0 `
-SkipHttpErrorCheck -ErrorAction SilentlyContinue
"{0} {1}" -f $r.StatusCode, $u
}Lee la canonical declarada de una página para confirmar que apunta donde esperas:
curl -s "https://example.com/page" | grep -i 'rel="canonical"'Para deduplicar todo el sitio, deja que lo haga un rastreador; consulta la pestaña Herramientas.
Herramientas para encontrar y corregir duplicados
- Google Search Console — informe de páginas. Los estados «Duplicate, Google chose different canonical than user» (traducción) «Google eligió una URL representativa distinta de la declarada», «Duplicate without user-selected canonical» (traducción) «Duplicada sin URL preferida seleccionada por el usuario» y «Alternate page with proper canonical tag» (traducción) «Página alternativa con una etiqueta preferida correcta» indican exactamente cómo trata Google tus duplicados. Empieza aquí.
- Inspección de URL (GSC) — muestra lado a lado la canonical declarada por el usuario y la seleccionada por Google.
- Ahrefs Site Audit — detecta páginas duplicadas o casi duplicadas, títulos/meta duplicados y variantes de protocolo, host, barra y mayúsculas.
- Screaming Frog SEO Spider — rastrea para descubrir contenido duplicado, cadenas/bucles de canonical y problemas de redirección.
- Ahrefs Webmaster Tools — rastreo y auditoría gratuitos para sitios verificados.
- Búsquedas
site:— forma rápida de ver duplicados ya indexados; consulta la pestaña Scripts. - Bing Webmaster Tools — muestra patrones de duplicación y admite IndexNow para impulsar URL modificadas o eliminadas y actualizar antes el grupo.
Antes y después: tres configuraciones duplicadas habituales
Un ejemplo simplificado de las tres duplicaciones técnicas más comunes de esta página, con el problema y la solución.
**1. Variantes de protocolo y host que resuelven con 200
# Bad — four addresses all serve the same page, all return 200
http://example.com/guide → 200
https://example.com/guide → 200
http://www.example.com/guide → 200
https://www.example.com/guide → 200Qué está mal: cada rastreo de cualquiera de esas cuatro URL es, desde el punto de vista de Google, un rastreo de «la misma página». Un enlace construido hacia la versión «equivocada» no consolida las demás. Las señales se dividen en cuatro direcciones en vez de acumularse en una.
# Clean — one canonical host/protocol, everything else 301s to it
http://example.com/guide → 301 → https://www.example.com/guide
https://example.com/guide → 301 → https://www.example.com/guide
http://www.example.com/guide → 301 → https://www.example.com/guide
https://www.example.com/guide → 200 (canonical, self-referencing <link rel="canonical">)Solución: es el paso de «corregir la causa raíz / 301» de la jerarquía anterior; es la señal más fuerte porque elimina el duplicado.
**2. Una URL con parámetro de seguimiento y canonical incorrecta
<!-- Bad — the parameterized URL canonicalizes to itself,
so Google treats /product?utm_source=newsletter as its own page
instead of folding it into the clean URL -->
<!-- served at https://example.com/product?utm_source=newsletter -->
<link rel="canonical" href="https://example.com/product?utm_source=newsletter" />Qué está mal: una canonical autorreferente en una URL con parámetros le dice a Google «esta es la página real», lo que derrota el objetivo. La URL limpia y cada variante (?utm_source=, ?sort=, ?ref=) parecen candidatas canónicas separadas.
<!-- Clean — every parameter variant canonicalizes to the clean URL -->
<!-- served at https://example.com/product?utm_source=newsletter -->
<link rel="canonical" href="https://example.com/product" />Solución: es el paso 3, gestión de parámetros: canonicaliza cada variante con parámetros a la URL limpia y enlaza internamente solo a la URL limpia.
**3. Una copia sindicada sin relación con el original
<!-- Bad — the syndicating site has no canonical or noindex pointing
back to your original, so the copy competes with it in results -->
<!-- your article, republished on partner-site.com/your-article -->
<link rel="canonical" href="https://partner-site.com/your-article" /><!-- Better, but not the most effective option on its own — the syndicated
copy canonicals back to your original -->
<!-- your article, republished on partner-site.com/your-article -->
<link rel="canonical" href="https://example.com/your-article" /><!-- Most effective per Google's current guidance — the partner keeps
their copy out of the index entirely, so there's nothing to compete
with your original at all -->
<!-- your article, republished on partner-site.com/your-article -->
<meta name="robots" content="noindex, follow" />Solución: es el paso 6 de la jerarquía. La sindicación no es arriesgada por sí sola (las políticas de spam de Google excluyen explícitamente la sindicación legítima). Lo que cambió es el consejo: una canonical hacia ti ayuda, pero no impide de forma fiable que la copia del socio compita, porque las páginas sindicadas pueden diferir lo suficiente para que Google no la respete. Pedir al socio que aplique noindex a su copia es más fiable.
Prompts para trabajar con contenido duplicado
Prompts listos para copiar para las tareas de esta página. Pega tus propias URL o HTML donde se indique, verifica el resultado antes de actuar y recuerda que los modelos pueden interpretar mal la semántica de los parámetros.
Agrupa una lista de URL en conjuntos duplicados
Pega una lista de URL (de una exportación de rastreo, una búsqueda site: o registros del servidor). Espera recibir las URL agrupadas en conjuntos, una URL preferida sugerida para cada uno y el razonamiento.
Here is a list of URLs from my site. Group them into clusters of URLs
that likely serve the same or near-duplicate content (protocol/host
variants, trailing slash, case, tracking parameters, print/mobile/AMP
versions). For each cluster, suggest which URL should be the canonical
and explain why, using the fix hierarchy: 301 redirect for pure
technical variants, rel=canonical for URLs that must stay reachable.
URLs:
[paste URL list here]Audita referencias rel=canonical en conflicto
Pega el HTML <head> sin procesar (o solo las líneas de canonical/hreflang/redirección) de varias páginas. Espera una lista de conflictos: referencias autorreferentes que no deberían existir, referencias que apuntan a URL con redirección o cadenas de canonical.
Here is the <head> markup for several pages on my site. Check the
rel="canonical" tags for problems: a canonical pointing at a URL that
itself redirects or 404s, a canonical chain (A canonicals to B, B
canonicals to C), a parameterized URL with a self-referencing
canonical instead of pointing at the clean URL, or a canonical
pointing cross-domain unintentionally. List each issue found with the
URL and a one-line explanation.
[paste head markup per URL here]Decide la solución para una lista de parámetros
Pega una lista de parámetros vistos en Search Console o en los registros del servidor (por ejemplo, ?sort=, ?utm_source=, ?sessionid= y ?color=). Espera una recomendación por parámetro: canonicalizar, aplicar noindex o bloquear, según cambie o no el contenido.
Here are the URL parameters my site generates, with a short note on
what each one does. For each parameter, tell me whether the resulting
URL should (a) canonicalize to the clean URL because it doesn't change
the content meaningfully, (b) stay indexable as its own page because
it does change the content (e.g. a real filter a user would search
for), or (c) be blocked/noindexed because it's low-value (session IDs,
sort order, tracking tags). Explain the reasoning for each.
Parameters:
[paste parameter list and notes here] Pruebas de validación: ¿la consolidación surtió efecto?
Ejecuta estas pruebas después de aplicar una corrección de contenido duplicado —un 301, un cambio de canonical o una limpieza de parámetros— para confirmar que llegó y saber cuándo revertirla.
1. La redirección resuelve correctamente
Prueba: ejecuta curl -I en cada variante antigua (o usa el HTTP Status Checker) de las URL consolidadas. Resultado esperado: una única 200 en la URL preferida y todas las demás devuelven un 301 directo con una cabecera Location que apunta a ella, sin cadena. Interpretación del fallo: una variante sigue devolviendo 200 o Location apunta a otra URL que redirige. Ventana: inmediata. Disparador de reversión: cualquier variante con 200 o una cadena de más de un salto.
2. La etiqueta canonical apunta donde quieres
Prueba: usa el Canonical Checker (o curl -s <url> | grep 'rel="canonical"') en la URL duplicada o con parámetros. Resultado esperado: la canonical declarada coincide exactamente con la URL limpia/preferida (protocolo, host y ruta, sin parámetros sobrantes). Interpretación del fallo: una canonical autorreferente en una variante indica que la solución no se aplicó; una canonical que apunta a una URL con redirección o que no resuelve correctamente debe apuntar al destino final. Ventana: inmediata. Disparador de reversión: canonical autorreferente o destino que no devuelve 200.
3. La canonical elegida por Google coincide con la tuya
Prueba: en Google Search Console → Inspección de URL, compara la «canonical declarada por el usuario» con la «canonical seleccionada por Google». Resultado esperado: coinciden. Interpretación del fallo: una diferencia indica que Google sigue tratando otra URL como autoridad, normalmente porque la redirección/canonical es reciente o quedan señales en enlaces internos o sitemap. Ventana: 2–4 semanas después de la corrección, cuando se vuelva a rastrear la página. Disparador de reversión: la diferencia persiste más de 4–6 semanas sin acercarse.
4. El recuento de estados duplicados de GSC baja
Prueba: sigue en Search Console → informe de páginas el recuento de «Duplicate, Google chose different canonical than user» (traducción) «Google eligió una URL representativa distinta de la declarada» (o usa el Google Search Console CSV Analyzer si extraes los datos). Resultado esperado: las URL afectadas salen de ese estado al volver a rastrearse. Interpretación del fallo: un recuento estable o creciente indica que la corrección aún no se propagó o que una señal contradictoria sigue apuntando a la URL no preferida. Ventana: 2–4 semanas, según la cadencia de rastreo. Disparador de reversión: el recuento no cambia tras un ciclo completo sin explicación; revisa enlaces internos y sitemap antes de asumir que la corrección es errónea.
Recursos que merecen tu tiempo
Mis artículos: fuentes principales de esta página
- Contenido duplicado: por qué ocurre y cómo corregirlo — guía completa de Ahrefs: taxonomía de causas y jerarquía de soluciones.
- El mito de la penalización por contenido duplicado — mi artículo de 2016 en Search Engine Land y predecesor moderno de esta página.
- Duplicada: Google eligió una URL representativa distinta de la del usuario — significado, causas y corrección del estado de GSC.
- Etiquetas rel=canonical explicadas — análisis profundo de rel=canonical.
- Google utiliza unas 40 señales de canonicalización — cómo elige Google la URL representativa.
- Parámetros de URL: guía completa para profesionales de SEO — fuente más prolífica de URL duplicadas.
Oficial
- Google: What is canonicalization · Consolidate duplicate URLs · Fix canonicalization issues (guía actual de sindicación) · Spam policies · Handling legitimate cross-domain duplication (referencia antigua de sindicación).
- Bing: ¿El contenido duplicado perjudica el SEO y la visibilidad en la búsqueda con IA? (diciembre de 2025).
De la industria
- r/TechSEO — comunidad para depurar canonical y duplicados.
- ¿Qué es el contenido duplicado? (Semrush) — visión general de causas y detección.
- Contenido duplicado: causas y soluciones (Yoast) — lista de causas con orientación CMS, especialmente WordPress.
- Guía definitiva de SEO para contenido duplicado (Sitebulb) — guía técnica sobre casi duplicados e impacto en búsqueda con IA.
- ¿Existe una penalización por contenido duplicado? (SISTRIX) — respuesta directa al mito.
- Horas de oficina de Google SEO, 31 de enero de 2021: John Mueller sobre contenido duplicado — transcripción de la aclaración de Mueller.
Frases citables que conviene conservar
Las frases a las que recurro cuando alguien insiste en que existe una penalización:
- John Mueller, Google — “We don’t have a duplicate content penalty. It’s not that we would demote a site for having a lot of duplicate content.” (traducción) «No tenemos una penalización por contenido duplicado. No es que bajemos de posición a un sitio por tener mucho contenido duplicado». Fuente (mi guía de Ahrefs)
- Google (2008) — “There’s no such thing as a ‘duplicate content penalty.’ At least, not in the way most people mean when they say that.” (traducción) «No existe una “penalización por contenido duplicado”, al menos no en el sentido que la mayoría da a esa frase». Fuente
- Yo, en Search Engine Land (2016) — “Duplicate content is not grounds for action unless its intent is to manipulate search results.” (traducción) «El contenido duplicado no es motivo de acción salvo que su intención sea manipular los resultados». Y sobre dejar que Google lo ordene: “If you don’t want to worry about sorting through duplication on your site, you can let us worry about it instead.” (traducción) «Si no quieres preocuparte por ordenar la duplicación de tu sitio, puedes dejar que nos preocupemos nosotros». Fuente
- Bing (2025) — “Duplicate content doesn’t trigger search penalties on its own, but it does reduce visibility by diluting authority.” (traducción) «El contenido duplicado no activa penalizaciones por sí solo, pero reduce la visibilidad al diluir la autoridad». Fuente
- Matt Cutts, Google — entre el 25 % y el 30 % del contenido web es duplicado. La duplicación es normal y esperada, no sancionable. Cobertura (Search Engine Land)
Ponte a prueba: contenido duplicado
Cinco preguntas rápidas sobre contenido duplicado y sus mitos. Elige una respuesta para cada una y después comprueba el resultado.
Registro de cambios
Actualizado el 8 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 17 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.