Etiqueta Meta Robots

La etiqueta meta robots controla cómo se indexa y se sirve una página: cada directiva, la regla de rastrear y luego obedecer, la resolución de conflictos y la etiqueta meta frente a X-Robots-Tag.

Publicado por primera vez: 23 jun 2026 · Última actualización: 11 ago 2026 · Avanzado
Idiomas
1 señal de evidencia en esta página

La etiqueta meta robots — <meta name="robots" content="noindex"> en el <head> — indica a los motores de búsqueda cómo indexar y servir una sola página. La regla que rompe todo: es rastrear y luego obedecer, por lo que una página bloqueada en robots.txt nunca se obtiene y su noindex nunca se ve. Sin etiqueta, el valor predeterminado es index, follow. Las reglas conflictivas se resuelven a la más restrictiva; para una etiqueta nombrada googlebot frente a la etiqueta genérica robots, Googlebot toma la suma de las reglas negativas. La etiqueta es solo HTML: use el encabezado X-Robots-Tag para PDF, imágenes y otros no HTML.

TL;DR — <meta name="robots" content="…"> en el <head> controla cómo se indexa y sirve una sola página; sin etiqueta, el valor predeterminado es index, follow. Es rastrear y luego obedecer: “estos ajustes solo se pueden leer y seguir si se permite a los rastreadores acceder a las páginas” — por lo que una URL bloqueada por robots.txt nunca se obtiene y su noindex nunca se ve (tengo datos de primera mano sobre el lado opuesto de esto). Las reglas en conflicto se resuelven a la más restrictiva; entre una etiqueta googlebot y la etiqueta genérica robots, Googlebot toma la suma de las reglas negativas. La etiqueta es solo HTML — usa el encabezado X-Robots-Tag para contenido no HTML y a escala. Google solo lee dos tokens con nombre de rastreador — googlebot y googlebot-news — e ignora cualquier otro valor, incluidos los tokens de otros motores como bingbot.

Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications

Qué es, dónde va y el valor predeterminado

La metaetiqueta robots te permite, en palabras de Google, “usar un enfoque granular y específico por página para controlar cómo se debe indexar y servir una página HTML individual a los usuarios en los resultados de búsqueda de Google.” El lugar convencional y portátil para ella es el <head>:

<meta name="robots" content="noindex, nofollow">

La colocación en el <head> es la convención de autoría que todos los motores esperan, pero Google es claro en que no es un requisito estricto específicamente para Google Search: “Google Search no exige la colocación de meta robots en el head HTML y respetará las metaetiquetas robots en la sección del cuerpo de un documento HTML también.” Trata eso como tolerancia para Google, no como consejo portátil — aún así, escríbela en el <head> para que cada rastreador y validador que espera una colocación estándar la lea correctamente.

El atributo name es la audiencia, y aquí es donde la mayoría de las guías exageran el soporte de Google. name="robots" se dirige a todos los rastreadores que leen la etiqueta. Más allá de eso, Google admite exactamente dos tokens con nombre de rastreador e ignora cualquier otro valor: “Google admite dos tokens de agente de usuario en la etiqueta meta de robots; otros valores se ignoran: googlebot para todos los resultados de texto y googlebot-news para resultados de noticias.” Una etiqueta con name="bingbot" no es un control documentado de Google — Bing lee su propio token en sus propios términos, pero Google omite cualquier valor de name que no reconoce. Tanto los atributos name como content son insensibles a mayúsculas para Google, y también lo son los nombres y valores del encabezado X-Robots-Tag.

Cuando no hay ninguna metaetiqueta robots presente, el valor predeterminado es index, follow (la regla all, que Google señala “has no effect if explicitly listed” (traducción) «no tiene efecto si se lista explícitamente»). Evidence for this claim For Google, the default robots meta behavior is index, follow when no restrictive rule is present. Scope: Google-supported robots meta rules; other crawlers publish their own support and defaults. Confidence: high · Verified: Google Search Central: Robots meta tag specifications Solo necesitas la etiqueta para cambiar ese valor predeterminado.

Puedes combinar reglas de dos maneras: separadas por comas en una sola etiqueta (noindex, nofollow) o como múltiples etiquetas <meta>. Google: puedes “crear una instrucción de múltiples reglas combinando las reglas de la etiqueta meta de robots con comas o usando múltiples etiquetas meta.”

La regla que lo rompe todo: Google debe rastrear la página para ver la etiqueta

Este es el artículo completo. La etiqueta meta de robots es rastrear y luego obedecer. Google tiene que obtener la página para leer la etiqueta, por lo que cualquier cosa que detenga la obtención detiene la aplicación de la etiqueta. Directamente de la especificación:

“Ten en cuenta que estos ajustes solo se pueden leer y seguir si los rastreadores pueden acceder a las páginas que incluyen estos ajustes.”

Evidence for this claim Google can read and follow page-level robots rules only when it is allowed to access the page. Scope: Google-supported robots meta and X-Robots-Tag rules; robots.txt blocking can prevent rule discovery. Confidence: high · Verified: Google Search Central: Robots meta tag specifications

Y la consecuencia, explicada:

“Si una página está deshabilitada para el rastreo mediante el archivo robots.txt, cualquier información sobre reglas de indexación o servicio no se encontrará y, por lo tanto, se ignorará.”

Así que el error clásico — Disallow en robots.txt más noindex en la misma URL — anula silenciosamente el noindex. Google nunca rastrea la página, nunca ve la etiqueta, y la URL puede permanecer en el índice (a menudo como un resultado desnudo, sin fragmento, si algo enlaza a ella). El documento complementario de Google sobre bloquear la indexación dice lo mismo en un lenguaje más simple: “must not be blocked by a robots.txt file… If the page is blocked by a robots.txt file or the crawler can’t access the page, the crawler will never see the noindex rule, and the page can still appear in search results.” (traducción) «No debe estar bloqueada por un archivo robots.txt… Si la página está bloqueada por un archivo robots.txt o el rastreador no puede acceder a ella, nunca verá la regla noindex y la página aún puede aparecer en los resultados».

He observado el lado opuesto de este mecanismo con datos reales. En mi experimento La historia de bloquear 2 páginas de alto ranking con Robots.txt, bloqueé deliberadamente dos de nuestras páginas con ranking en robots.txt. Debido a que Google ya no podía rastrearlas, no podía actualizar nada sobre ellas — y las páginas en su mayoría mantuvieron su ranking: “Perdimos una posición aquí o allá y todos los fragmentos destacados de las páginas.” Mi conclusión: “Bloquear accidentalmente páginas (que Google ya clasifica) para que no sean rastreadas usando robots.txt probablemente no tendrá mucho impacto en tus rankings, y es probable que sigan apareciendo en los resultados de búsqueda.” Esa es la misma moneda que el problema de noindex — una URL bloqueada está congelada. Bloquear ≠ eliminar. Si realmente quieres que una página desaparezca, necesitas un noindex rastreable, que es el punto principal de esta etiqueta.

Esta es la línea que he trazado públicamente sobre dónde pertenece cada herramienta. Preguntado si Google debería agregar soporte para noindex en robots.txt, dije: “Google fue claro en que quieren robots.txt solo para el control del rastreo.” Rastrear es el trabajo de robots.txt; indexar es el trabajo de la etiqueta meta (o del encabezado). No se superponen, y la directiva noindex en robots.txt nunca fue oficialmente compatible — Google dejó de analizarla el 1 de septiembre de 2019.

Cada directiva meta de robots (la referencia)

Los valores compatibles de Google, con las descripciones textuales de la especificación:

Indexación

  • all“No hay restricciones para indexar o servir. Esta regla es el valor predeterminado y no tiene efecto si se lista explícitamente.”
  • noindex“No mostrar esta página, medio o recurso en los resultados de búsqueda.”
  • none“Equivalente a noindex, nofollow.”
  • indexifembedded“Google puede indexar el contenido de una página si está incrustado en otra página mediante iframes o etiquetas HTML similares, a pesar de una regla noindex.” (La única directiva que anula un noindex, para contenido incrustado.)

Enlaces

  • nofollow“No seguir los enlaces en esta página.” Esto es a nivel de página — un alcance diferente de un rel="nofollow" por enlace, que se aplica a un solo enlace.

Servicio y fragmentos

  • nosnippet“Do not show a text snippet or video preview in the search results for this page.” (traducción) «No muestres un fragmento de texto ni una vista previa de video en los resultados de búsqueda de esta página». Este ámbito es más amplio que el fragmento de texto clásico: Google dice que “applies to all forms of search results (at Google: web search, Google Images, Discover, AI Overviews, AI Mode) and will also prevent the content from being used as a direct input for AI Overviews and AI Mode.” (traducción) «se aplica a todas las formas de resultados de búsqueda (en Google: búsqueda web, Google Images, Discover, AI Overviews, AI Mode) y también evitará que el contenido se utilice como entrada directa para AI Overviews y AI Mode».
  • max-snippet:[number]“Use a maximum of [number] characters as a textual snippet for this search result.” (traducción) «Usa un máximo de [número] caracteres como fragmento de texto para este resultado de búsqueda». Tiene el mismo ámbito ampliado que nosnippet: “applies to all forms of search results (such as Google web search, Google Images, Discover, Assistant, AI Overviews, AI Mode) and will also limit how much of the content may be used as a direct input for AI Overviews and AI Mode.” (traducción) «se aplica a todas las formas de resultados de búsqueda (como la búsqueda web de Google, Google Images, Discover, Assistant, AI Overviews, AI Mode) y también limitará cuánto del contenido puede utilizarse como entrada directa para AI Overviews y AI Mode». Eso es un control de elegibilidad de entrada directa para las funciones de búsqueda de IA propias de Google — no es una exclusión general del entrenamiento de IA. Mantener tu contenido fuera del entrenamiento de modelos (p. ej., Google-Extended) o fuera del control separado a nivel de propiedad de IA generativa en Search Console son sistemas diferentes con ámbitos diferentes; no trates nosnippet/max-snippet como si cubrieran cualquiera de ellos.
  • max-image-preview:[setting]“Set the maximum size of an image preview for this page in search results.” (traducción) «Establece el tamaño máximo de la vista previa de imagen para esta página en los resultados de búsqueda». Configuraciones: none, standard o large (“A larger image preview, up to the width of the viewport, may be shown.” (traducción) «Se puede mostrar una vista previa de imagen más grande, hasta el ancho de la ventana gráfica»).
  • max-video-preview:[number]“Use a maximum of [number] seconds as a video snippet for videos on this page in search results.” (traducción) «Usa un máximo de [número] segundos como fragmento de video para los videos de esta página en los resultados de búsqueda».
  • notranslate“Don’t offer translation of this page in search results.” (traducción) «No ofrezcas traducción de esta página en los resultados de búsqueda».
  • noimageindex“Do not index images on this page.” (traducción) «No indexes imágenes en esta página».
  • unavailable_after:[date/time]“Do not show this page in search results after the specified date/time.” (traducción) «No muestres esta página en los resultados de búsqueda después de la fecha/hora especificada».

Históricos — controles de Google que ya no están activos

Algunas directivas que aún circulan en guías antiguas son aquellas que Google dice que ya no utiliza. No las añadas esperando que hagan algo:

  • noarchive“The noarchive rule is no longer used by Google Search to control whether a cached link is shown in search results, as the cached link feature no longer exists.” (traducción) «La regla noarchive ya no la utiliza Google Search para controlar si se muestra un enlace en caché en los resultados de búsqueda, ya que la función de enlace en caché ya no existe».
  • nocache (un sinónimo que algunos motores usaban para noarchive) — “The nocache rule isn’t used by Google Search.” (traducción) «La regla nocache no la utiliza Google Search».
  • nositelinkssearchbox“The nositelinkssearchbox rule is no longer used by Google Search to control whether the sitelink search box is shown for a given page, as the feature no longer exists.” (traducción) «La regla nositelinkssearchbox ya no la utiliza Google Search para controlar si se muestra el cuadro de búsqueda de enlaces de sitio para una página determinada, ya que la función ya no existe».

A nivel de párrafo (no en la metaetiqueta)

Hay un control a nivel de subpágina: el atributo data-nosnippet. Google: puedes “designate textual parts of an HTML page not to be used as a snippet… on span, div, and section elements.” (traducción) «designar partes textuales de una página HTML para que no se utilicen como fragmento… en elementos span, div y section». Todo lo que está en la metaetiqueta es para toda la página; nosnippet / data-nosnippet es cómo mantienes un pasaje fuera del fragmento sin tocar el resto.

Combinar directivas y resolver conflictos

Dos reglas rigen lo que sucede cuando las directivas chocan.

1. La regla más restrictiva gana. “In the case of conflicting robots rules, the more restrictive rule applies. For example, if a page has both max-snippet:50 and nosnippet rules, the nosnippet rule will apply.” (traducción) «En el caso de reglas de robots en conflicto, se aplica la regla más restrictiva. Por ejemplo, si una página tiene tanto reglas max-snippet:50 como nosnippet, se aplicará la regla nosnippet». nosnippet es más estricto que un límite de 50 caracteres, así que nosnippet es lo que obtienes.

2. googlebot vs robots — la suma de las reglas negativas. Esta es la que la mayoría de las guías se equivocan. Una etiqueta con nombre googlebot no simplemente reemplaza la etiqueta genérica robots — para la superposición, Googlebot toma la unión de las restricciones. Google: “For situations where multiple crawlers are specified along with different rules, the search engine will use the sum of the negative rules.” (traducción) «Para situaciones donde se especifican múltiples rastreadores junto con reglas diferentes, el motor de búsqueda usará la suma de las reglas negativas». Su ejemplo trabajado:

<meta name="robots" content="nofollow">
<meta name="googlebot" content="noindex">

“The page containing these meta tags will be interpreted as having a noindex, nofollow rule when crawled by Googlebot.” (traducción) «La página que contiene estas metaetiquetas se interpretará como si tuviera una regla noindex, nofollow cuando Googlebot la rastree.» El nofollow de robots más el noindex de googlebot suman noindex, nofollow para Googlebot. (Cuando una etiqueta googlebot y una etiqueta robots establecen la misma directiva de manera diferente, la que lleva el nombre del rastreador es la que se aplica a ese rastreador).

Etiqueta meta robots vs. X-Robots-Tag (la cabecera HTTP)

La metaetiqueta robots es solo HTML: necesita un <head>. Para cualquier cosa que no sea HTML, se usa la X-Robots-Tag, que entrega el mismo vocabulario de reglas en la cabecera de respuesta HTTP. Google: “The X-Robots-Tag can be used as an element of the HTTP header response for a given URL. Any rule that can be used in a robots meta tag can also be specified as an X-Robots-Tag.” (traducción) «La X-Robots-Tag se puede usar como elemento de la respuesta de cabecera HTTP para una URL determinada. Cualquier regla que se pueda usar en una metaetiqueta robots también se puede especificar como X-Robots-Tag.» Y la razón de su existencia: “You can use the X-Robots-Tag for non-HTML files like image files where the usage of robots meta tags in HTML is not possible.” (traducción) «Puedes usar la X-Robots-Tag para archivos que no son HTML, como archivos de imagen, donde no es posible usar metaetiquetas robots en HTML.»

Entonces:

  • ¿PDF, imagen u otro formato que no sea HTML? No puedes añadir una etiqueta <meta>: usa la cabecera, p. ej., X-Robots-Tag: noindex.
  • ¿Directorios completos o patrones? La cabecera se configura a nivel de servidor/CDN, por lo que escala a rutas completas en una sola regla de configuración.
  • ¿Un solo motor? La cabecera también puede dirigirse a un rastreador: X-Robots-Tag: googlebot: noindex, nofollow, y se pueden combinar varias cabeceras X-Robots-Tag en una sola respuesta.

Mismas reglas, dos mecanismos de entrega: la metaetiqueta para páginas HTML, la cabecera para todo lo demás y para escalar.

Qué directivas admiten Bing y otros motores

No asumas que el conjunto de directivas es universal: no lo es. Bing admite las reglas básicas de indexación y servicio: noindex, nofollow, noarchive (con nocache como sinónimo) y nosnippet, y respeta la X-Robots-Tag para recursos que no son HTML. Pero Bing no admite la abreviatura none, así que para seguridad entre motores, escribe noindex, nofollow explícitamente en lugar de confiar en none. La familia de control de fragmentos y vistas previas (max-snippet, max-image-preview, max-video-preview), junto con noimageindex, notranslate, indexifembedded y unavailable_after, es efectivamente solo de Google. En caso de duda, escribe las directivas explícitamente y trata los controles max-* como funciones de Google.

Errores comunes (y las soluciones)

  • Disallow + noindex en la misma URL. El noindex nunca se ve. Solución: deja la página rastreable; mantén solo el noindex.
  • noindex más un rel=canonical que apunte a otro lugar. Señales contradictorias: le estás diciendo a Google tanto “descarta esta página” como “consolídala en otra”. Elige una. (Más en canonicalización).
  • Un noindex en todo el entorno de staging enviado a producción. Desindexación catastrófica en todo el sitio. Verifica antes del lanzamiento.
  • Un noindex inyectado solo mediante JavaScript del lado del cliente. Google tiene que renderizar la página para verlo, y si el HTML renderizado difiere de lo que esperas, el comportamiento también difiere. Prefiere la etiqueta en el HTML sin procesar o la cabecera. (Ver renderizado).
  • Esperar que Bing respete directivas solo de Google (none, la familia max-*).
  • Esperar que una directiva de robots haga un trabajo que no le corresponde. Una regla noindex o nosnippet no garantiza por sí sola ahorros en el presupuesto de rastreo, confidencialidad, un cambio en el ranking, un comportamiento idéntico entre motores de búsqueda, un plazo de eliminación específico o la exclusión de todas las superficies de IA/búsqueda: cada uno de esos resultados pertenece a un control diferente (autenticación para confidencialidad, robots.txt para rastreo, la documentación de cada motor para paridad, Search Console o Google-Extended para ámbitos específicos de IA). Google no da un plazo fijo para cuándo una página con noindex desaparece realmente: depende de la prioridad de recrawleo y “puede llevar meses” para una página de menor importancia.

Para ver dónde encaja esto en el panorama general: robots.txt y crawling son el lado del control de rastreo; noindex e indexing son el lado del control de indexación; y nosnippet / data-nosnippet, max-snippet y max-image-preview son los controles de publicación a los que recurres cuando quieres que una página se indexe pero quieres dar forma a cómo aparece. La X-Robots-Tag es el equivalente en cabecera HTTP de esta misma etiqueta para contenido no HTML.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.