SEO multilingüe

Cómo optimizar un sitio que ofrece varios idiomas: SEO multilingüe frente a multirregional, cómo detecta realmente Google el idioma, hreflang, estructura de URL y Bing.

Publicado por primera vez: 25 jun 2026 · Última actualización: 22 ago 2026 · Avanzado
Idiomas

El SEO multilingüe consiste en optimizar un sitio que ofrece más de un idioma para que cada versión llegue a la persona que busca en ese idioma. Lo que casi todo el mundo entiende mal: Google ignora el atributo <html lang> y las cabeceras Content-Language; lee el texto visible para detectar el idioma. hreflang tampoco indica a Google el idioma de una página; asigna qué URL son alternativas entre sí. Bing es lo contrario: se apoya en la etiqueta meta content-language. Primero configura bien el idioma, después conecta las alternativas con hreflang y luego elige una estructura de URL (subdirectorios para la mayoría de sitios). El 67 % de las configuraciones de hreflang tiene errores, pero Google corrige muchas automáticamente.

TL;DR — Con el modelo mental correcto, la mayor parte del SEO multilingüe encaja en su sitio. Google no lee el atributo <html lang> ni la cabecera HTTP Content-Language para detectar el idioma; utiliza principalmente el texto visible. Otros motores pueden usar señales diferentes, así que verifica sus indicaciones actuales. hreflang no declara el idioma de una página; indica qué URL son alternativas para que Google pueda intercambiar la adecuada, y es una sugerencia, no una directiva. También es endiabladamente propenso a errores: mi estudio de 374 756 dominios descubrió que el 67 % tenía problemas de hreflang. Usa subdirectorios en la mayoría de sitios, no redirijas automáticamente a Googlebot y traduce solo las páginas con un caso de negocio real.

Evidence for this claim Google recommends distinct URLs for each language version and cautions against relying on cookies or browser settings to swap content at one URL. Scope: Current Google multilingual site guidance. Confidence: high · Verified: Google Search Central: Managing multilingual sites Evidence for this claim hreflang can connect equivalent language or regional URLs, while page language is determined from visible content rather than the annotation alone. Scope: Current Google localized-version guidance. Confidence: high · Verified: Google Search Central: Localized versions

Multilingüe ≠ multirregional

La distinción fundamental. Multilingüe se refiere al idioma; multirregional, al país. Un sitio suizo en alemán, francés e italiano es multilingüe, pero de una sola región. Un sitio en inglés para EE. UU. y el Reino Unido es multirregional, pero de un solo idioma. Se solapan continuamente, pero utilizan señales distintas y generan problemas diferentes, por lo que yo los mantengo separados mentalmente y tú también deberías hacerlo. La formulación de Google es: “A multilingual website is any website that offers content in more than one language,” (traducción) «un sitio web multilingüe es cualquier sitio que ofrece contenido en más de un idioma», frente a “A multi-regional website is one that explicitly targets users in different countries.” (traducción) «un sitio web multirregional es aquel que se dirige explícitamente a usuarios de distintos países».

Cómo detecta Google realmente el idioma de una página (esta es la clave)

Este es el aspecto que más se malinterpreta de todo el tema, y vale la pena insistir porque mucha gente se equivoca:

Google ignora tu atributo <html lang>. Google ignora tu cabecera HTTP Content-Language. Lee el texto visible.

Directamente de la documentación: “Google uses the visible content of your page to determine its language. We don’t use any code-level language information such as lang attributes, or the URL.” (traducción) «Google determina el idioma a partir del contenido visible de la página y no emplea datos lingüísticos del código, como los atributos lang, ni la URL». Y en la página de hreflang: “Google doesn’t use hreflang or the HTML lang attribute to detect the language of a page; instead, we use algorithms to determine the language.” (traducción) «Google no utiliza hreflang ni el atributo HTML lang para detectar el idioma de una página; en su lugar, usamos algoritmos para determinarlo».

En Search Off the Record (julio de 2024), Gary Illyes le dio un nombre: LDCP — Language Demotion, Country Promotion. Su explicación: “if someone is searching in German and your page is in English, then you would get a demotion.” (traducción) «si alguien busca en alemán y tu página está en inglés, sufrirías una pérdida de posición». Es un mecanismo de posicionamiento y más fundamental que hreflang: si tu página no está realmente en el idioma de quien busca, LDCP la degrada independientemente de lo que indiquen tus etiquetas. (Illyes también señaló que este tipo de señalización manual está desapareciendo, al indicar que Google ya tenía sistemas que «aprenden automáticamente» a emparejar versiones en idiomas alternativos; la autodetección es la dirección que está tomando.)

¿Por qué desconfía tanto Google de <html lang>? Porque se equivoca constantemente. Gary contó la historia de Joomla: el CMS “came with the Lang attribute set to English” (traducción) «venía con el atributo Lang establecido en inglés», aunque la página era 100 % alemana; por eso concluyó “you can’t trust that” (traducción) «no puedes fiarte de eso». John Mueller ha dicho lo mismo: el atributo HTML lang es “something we don’t use at all” (traducción) «algo que no usamos en absoluto» y “almost always wrong” (traducción) «casi siempre incorrecto», motivo por el que Google tiende a ignorarlo.

La conclusión: la detección del idioma es un problema de contenido, no de marcado. Escribe contenido real en el idioma de destino. El atributo lang sigue siendo importante para la accesibilidad (lectores de pantalla) y para Bing, pero no para la detección lingüística de Google.

Bing lo hace al revés

Bing no admite hreflang. Y mientras Google ignora las señales lingüísticas a nivel de código, Bing depende de ellas. Su orden de prioridad es:

  1. <meta http-equiv="content-language" content="en-us"> — la señal principal.
  2. Atributo <html lang=""> — señal secundaria.
  3. Contenido de texto de la página.

El formato de Bing es un código de idioma ISO 639 de dos letras, un guion y un código geográfico ISO 3166 (en-us, es-mx). Por tanto, un sitio correctamente internacionalizado que funcione en ambos motores necesita contenido en URL independientes más hreflang (para Google/Yandex) más la etiqueta meta content-language (para Bing). No son redundantes: alimentan a motores diferentes.

Qué hace realmente hreflang (y qué no hace)

hreflang es un mapa de relaciones, no un detector de idiomas. No le indica a Google el idioma de una página; Google ya lo obtiene del contenido. Le indica qué URL son alternativas entre sí y para qué audiencia de idioma-región, de modo que Google pueda mostrar la adecuada a cada persona. Google dice: “Use hreflang to tell Google about the variations of your content, so that we can understand that these pages are localized variations of the same content.” (traducción) «Usa hreflang para informar a Google de las variaciones de tu contenido, de modo que podamos entender que estas páginas son versiones localizadas del mismo contenido».

Tres cosas tienen que estar bien o el clúster se ignora:

  • Bidireccionalidad. “If two pages don’t both point to each other, the tags will be ignored.” (traducción) «si dos páginas no se enlazan mutuamente, las etiquetas se ignorarán». La versión inglesa apunta a la italiana y la italiana debe apuntar de vuelta.
  • Autorreferencia. Cada página se incluye a sí misma junto con todas las demás.
  • x-default como alternativa para idiomas no coincidentes (recomendado, pero no estrictamente obligatorio).

Hay tres métodos de entrega: etiquetas <link> HTML en el <head>, la cabecera HTTP Link (útil para archivos no HTML como los PDF) o un sitemap XML con el espacio de nombres xhtml:link. Las URL deben estar completamente cualificadas e incluir https://.

Y, lo que es fundamental: hreflang es una sugerencia, no una directiva. La frase de Google es que “hreflang annotations are a hint to Google, not a directive.” (traducción) «las anotaciones hreflang son una sugerencia para Google, no una directiva». Puede ignorarlas y lo hará cuando las etiquetas canónicas, las señales de contenido o el estado de indexación no coincidan.

El ángulo valioso y poco cubierto: hreflang acelera la indexación de idiomas nuevos

Este es un beneficio del que casi nadie habla. En el mismo episodio de SOTR, Gary Illyes dijo que descubrir hreflang activa un rastreo de verificación de las alternativas: “There is a dependency crawl triggering when we discover Hreflang, like we want to verify that.” (traducción) «cuando descubrimos Hreflang se activa un rastreo de dependencias, porque queremos verificarlo». En términos sencillos: cuando Google encuentra hreflang en una página, rastrea las versiones en idiomas alternativos para verificar la relación, lo que acelera la indexación de tus páginas en idiomas nuevos. Por tanto, hreflang no solo sirve para mostrar la versión correcta; también acelera el descubrimiento de idiomas recién lanzados.

Por qué tus datos de hreflang en GSC parecen escasos (y es normal)

Otro punto de Illyes que conviene interiorizar: Search Console solo informa de la URL principal que Google elige como representativa de cada grupo; además, explicó que la gran mayoría de los clústeres de hreflang corresponden a alternativas. Por eso esas URL alternativas no aparecen individualmente en los informes de cobertura de GSC. Si tus paneles hacen parecer que tus páginas lingüísticas «no están indexadas», a menudo solo refleja la forma en que GSC informa de la versión principal, no un problema real. Verifica con la herramienta de Inspección de URL y las SERP activas en lugar de confiar en el recuento agregado.

Contenido duplicado: es-MX frente a es-ES

Un temor común es que dos variantes del español se marquen como duplicadas. La regla real de Google es: “Localized versions of a page are only considered duplicates if the main content of the page remains untranslated.” (traducción) «las versiones localizadas de una página solo se consideran duplicadas si el contenido principal de la página permanece sin traducir». Dos páginas realmente en español con diferencias regionales reales (moneda, vocabulario y referencias locales) son distintas. Pero dos URL es-ES y es-MX con texto idéntico y sin diferenciación regional se tratarán como duplicadas; hreflang por sí solo no las separa: lo hace el contenido regional diferenciado. Dentro de un clúster hreflang válido, las señales también pueden consolidarse entre las alternativas, lo que suele ser útil.

Estructura de URL, enlaces internos y detección del idioma

Estructura. Subdirectorios (/es/, /fr/) para la mayoría de sitios: heredan la autoridad del dominio raíz y requieren poco mantenimiento. Los subdominios se tratan más como sitios independientes. Los ccTLD son la señal más fuerte de orientación por país, pero implican propiedades y construcción de enlaces independientes. Los parámetros de URL están explícitamente «no recomendados».

Enlaces internos entre versiones. Enlaza entre sí las versiones lingüísticas de forma sensata (el selector de idioma forma parte de ello), pero no trates cada alternativa como un enlace principal de navegación. Deja que hreflang comunique la relación formal y que el selector sirva a los usuarios.

Experiencia de usuario de la detección de idioma y trampa de rastreabilidad. Aquí es donde los sitios se rompen silenciosamente. Googlebot “sends HTTP requests without setting Accept-Language in the request header” (traducción) «envía solicitudes HTTP sin establecer Accept-Language en la cabecera de la solicitud» y rastrea principalmente desde IP de EE. UU. (aunque también utiliza algunas IP de fuera de EE. UU.). Si rediriges automáticamente a los usuarios a una versión lingüística según su IP o Accept-Language, Googlebot quizá solo vea la versión inglesa y nunca descubra las demás. La instrucción directa de Google es: “Avoid automatically redirecting users from one language version of a site to a different language version.” (traducción) «evita redirigir automáticamente a los usuarios de una versión lingüística de un sitio a otra versión lingüística».

Haz esto en su lugar: sirve URL independientes, anótalas con hreflang y, si quieres ayudar a los usuarios, muestra un banner de sugerencia no intrusivo («Esta página está disponible en inglés; ¿quieres cambiar?») que los mantenga en su URL actual y recuerde su elección mediante una cookie o localStorage. Usa Accept-Language como sugerencia, nunca como activador de una redirección. Y no uses banderas como identificadores de idioma: las banderas representan países, no idiomas.

Calidad de la traducción y traducción automática

La traducción automática no está prohibida por sí misma. La definición de Google dice: “Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users.” (traducción) «el abuso de contenido a escala ocurre cuando se generan muchas páginas con el propósito principal de manipular las posiciones de búsqueda y no de ayudar a los usuarios». Ir a la cita La traducción aparece como un ejemplo de transformación automatizada cubierta por esa política: “including through automated transformations like synonymizing, translating, or other obfuscation techniques,” (traducción) «incluidas transformaciones automatizadas como la sinonimización, la traducción u otras técnicas de ofuscación», específicamente “where little value is provided to users.” (traducción) «cuando se aporta poco valor a los usuarios». Ir a la cita El criterio es el valor, no el método de producción. El riesgo real es volcar traducción automática a escala sin supervisión editorial; la traducción automática con revisión y selección humana (un flujo que a menudo se denomina MTPE) es una forma estándar y escalable de evitarlo. Evalúa una página traducida como evaluarías cualquier página: ¿responde a una intención de búsqueda real de ese mercado? Y no traduzcas simplemente tus palabras clave en inglés: haz una investigación de palabras clave real para cada idioma, porque la intención y la formulación varían entre mercados. (Más información: traducción automática y SEO.)

Esquema para sitios multilingües

Usa la propiedad inLanguage en el esquema de Article/Product/FAQPage para indicar el idioma del contenido y proporciona a cada versión lingüística su propio bloque de esquema en ese idioma. El esquema y hreflang hacen trabajos distintos: hreflang asigna URL alternativas; el esquema aclara el significado y el idioma del contenido. Son capas complementarias.

La tasa de errores: mi estudio de 374 756 dominios

Realicé un estudio sobre 374 756 dominios usando hreflang. El titular: más del 67 % tenía problemas. El desglose, empezando por los más comunes: ausencia de x-default (56,3 %), ausencia de etiquetas autorreferentes (18 %), referencias rotas o redirigidas (16,9 %), ausencia de etiquetas recíprocas (15,3 %), referencias no canónicas (8 %), códigos ISO incorrectos (4,6 %), incoherencia entre HTML lang y hreflang (3,2 %), entradas de idioma duplicadas (2,5 %) y la misma página declarada para varios idiomas (2,5 %).

Dos salvedades impiden que esto sea una catástrofe. Primero, las dos primeras —x-default y las referencias autorreferentes— son recomendadas, no estrictamente obligatorias, así que la gravedad real es menor de lo que sugiere el 67 %. Segundo, Google corrige muchas de estas cosas por ti. Gary Illyes ha dicho que los errores de hreflang «no causaron problemas» durante su etapa de implementación, y mi postura de siempre (desde mi charla Enterprise SEO Chaos en SMX) es que quizá no merezca la pena perseguir cada error de hreflang, porque probablemente Google corrige muchos automáticamente. Pero los errores estructurales —enlaces recíprocos ausentes y URL rotas— sí rompen el clúster y deben corregirse. Prioridad: corrige lo estructural y monitoriza lo conductual.

La amenaza de 2025: el proxy translate.goog de Google

Hay un matiz más reciente que conviene conocer (el artículo de Motoko Hunt en Search Engine Land de junio de 2025): cuando Google determina que no hay contenido local de alta calidad disponible, traduce automáticamente el contenido mediante un proxy translate.goog. El navegador importa: los usuarios de Chrome se dirigen a la URL original del editor (se conserva el tráfico), pero los de Safari/Firefox pasan por translate.goog (se pierde tráfico). Los datos de Ahrefs lo situaron en 6,2 millones de apariciones en AI Overviews con URL traducidas y cientos de millones de clics de exposición. La lectura estratégica es: publicar contenido nativo en el idioma local es tanto la defensa (Google no traducirá mediante proxy lo que ya ofreces) como el ataque (te posicionas tú mismo en esos mercados). Trata las SERP traducidas automáticamente como una señal de demanda no satisfecha.

La advertencia de Mueller: no lo traduzcas todo

Por último, moderación. John Mueller advierte contra el impulso de estar en todos los idiomas: “Let’s create all languages! Let’s make pages for all countries! What if someone in Japan wants to read it in Swahili?” (traducción) «¡Creemos todos los idiomas! ¡Hagamos páginas para todos los países! ¿Y si alguien en Japón quiere leerlo en suajili?»; y señala que “it’s easy to dig into endless pits of complexity with hreflang.” (traducción) «es fácil caer en pozos interminables de complejidad con hreflang». Su consejo, que comparto, es: “first… limit the number of pages you create to those that are absolutely critical & valuable.” (traducción) «primero… limita el número de páginas que creas a las que sean absolutamente críticas y valiosas». Prioriza las páginas con mucho tráfico y conversión en mercados con demanda demostrada (usa GSC para encontrar consultas que ya generan impresiones en un idioma de destino). Cada versión lingüística que creas implica costes continuos de rastreo, indexación, canonicalización y mantenimiento: inviértelos solo donde haya un retorno real.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.