SEO técnico
Una guía completa de SEO técnico: una guía para principiantes en lenguaje sencillo y una guía avanzada a nivel de sistemas sobre rastreo, renderizado, indexación y posicionamiento.
Idiomas
Dos guías en una. La guía para principiantes explica el SEO técnico desde cero: el flujo de rastreo → indexación → posicionamiento, los pocos fundamentos que todo sitio necesita, cómo revisar un sitio y qué mitos ignorar. La guía avanzada profundiza en sistemas: presupuesto de rastreo, la decisión de renderizado, las ~40 señales de canonicalización, enlaces internos, Core Web Vitals como tres problemas separados, monitoreo continuo, migraciones y búsqueda con IA. El hilo conductor es el que siempre menciono: el SEO técnico es la parte más importante del SEO hasta que deja de serlo. Es la base que permite que el contenido y los enlaces posicionen, no un truco de posicionamiento en sí mismo. Una página que Google no indexa no puede posicionarse, por lo que el trabajo de mayor valor suele ser el más aburrido.
TL;DR — El SEO técnico es el trabajo entre bastidores que permite a los motores de búsqueda encontrar, leer y entender las páginas. No es un truco que eleve el sitio en los rankings — es la base que permite que el contenido y los enlaces hagan eso. Si el lado técnico está roto, incluso las grandes páginas no pueden aparecer. Todo se reduce a una frase: una página que Google no indexa no puede posicionarse. Esta guía explica qué importa, cómo revisar un sitio y qué ignorar con seguridad.
Qué es realmente el SEO técnico
Cuando la gente aprende SEO por primera vez, piensa en dos cosas: contenido (escribir buenas páginas) y enlaces (conseguir que otros sitios apunten al tuyo). El SEO técnico es la tercera pata, y viene antes de que las otras dos puedan importar. Es todo lo que decide si un motor de búsqueda puede llegar a la página, leerla correctamente y archivarla en su índice.
En mi guía para principiantes sobre SEO técnico lo he descrito durante años como la práctica de ayudar a los motores de búsqueda a encontrar, rastrear, entender e indexar las páginas. Ese es todo el trabajo en cuatro verbos. Conviene observar lo que no está ahí: escribir buen texto, elegir palabras clave, conseguir enlaces. Esas cosas son reales e importantes — simplemente no son SEO técnico.
La analogía a la que siempre vuelvo es una casa. El contenido son los muebles y la pintura. Los enlaces son los vecinos que recomiendan el lugar. El SEO técnico es la fontanería y el cableado — invisible, poco glamuroso, y lo que lo arruina todo cuando se rompe. Nadie felicita las tuberías de una casa, pero todo el mundo nota cuando dejan de funcionar.
El proceso sobre el que todo funciona
Google Search describe el proceso en tres etapas. Su documentación es directa al respecto: “Google Search works in three stages, and not all pages make it through each stage.” (traducción) «Google Search funciona en tres etapas, y no todas las páginas superan cada etapa.» Evidence for this claim Google Search describes crawling, indexing, and serving as three stages; discovery is part of the crawling stage, and not every page advances through each stage. Scope: Google Search documentation; conceptual explanation, not a promise of ranking outcomes. Confidence: high · Verified: Google: How Search Works
- Rastreo — un bot (Googlebot para Google, Bingbot para Bing) descubre la URL y descarga la página.
- Indexación — el motor determina de qué trata la página y la almacena en una base de datos gigante de todo lo que podría mostrar.
- Servir (posicionar) — cuando alguien busca, el motor extrae las mejores coincidencias de esa base de datos y las ordena.
A three-stage pipeline. Crawl discovers and downloads a URL. Index processes the page and stores eligible information. Serve ranks the best indexed matches for a query. Not every page advances through every stage.
Esa cláusula — no todas las páginas superan cada etapa — es la razón completa por la que existe el SEO técnico. Una página puede ser rastreada pero no indexada, o indexada pero nunca mostrada para una consulta. La mayor parte del SEO técnico consiste simplemente en eliminar lo que impide que las páginas pasen por esas puertas.
Por qué es una base, no un truco
Aquí está la parte que sorprende a la gente: el SEO técnico normalmente no hace que una página se posicione más alto. No hay un “algoritmo de SEO técnico” que puedas engañar. Lo que hace es despejar los obstáculos para que el buen contenido y los enlaces puedan contar de verdad. Corregir una etiqueta canónica rota o un servidor lento no suma puntos: evita perderlos.
A veces lo digo así: el SEO técnico es la parte más importante del SEO hasta que deja de serlo. En el momento en que las páginas pueden ser rastreadas e indexadas, el apalancamiento se desplaza hacia el contenido y los enlaces, que mueven los rankings mucho más de lo que la mayoría de los proyectos técnicos jamás lo harán. Así que el objetivo no es la perfección técnica — es despejar las puertas y luego apartarte de el propio camino.
Los fundamentos que todo sitio necesita
Puedes ignorar una cantidad sorprendente de SEO técnico. Pero hay una lista corta que todo sitio debería tener bien:
- Acceso de rastreo. Se debe comprobar que no se bloqueen accidentalmente páginas que deben encontrarse.
El archivo
robots.txtcontrola qué URLs pueden solicitar los bots. El error clásico de principiante es usarlo para intentar ocultar una página — no es para eso (más sobre eso en la sección de mitos). Evidence for this claim A robots.txt rule controls crawling rather than guaranteeing removal from Google Search; a URL can still appear when Google cannot crawl it. Scope: Google Search crawler behavior. Other crawlers can interpret robots.txt differently. Confidence: high · Verified: Google: Introduction to robots.txt - Un sitemap. Un sitemap XML es una lista de las URLs importantes entregada directamente a los motores de búsqueda. Envíalo en Google Search Console y Bing Webmaster Tools. Importa sobre todo para sitios grandes o completamente nuevos.
- Una versión clara de cada página. Si el mismo contenido vive en varias URLs
(con y sin
www,httpvshttps, parámetros de seguimiento), dile a los motores de búsqueda cuál es la canónica — la real — con una etiquetarel="canonical". Esto es canonicalización, y es la mayor parte de lo que los principiantes necesitan saber sobre contenido duplicado. - HTTPS. El sitio debe servirse a través de una conexión segura. Es una señal de ranking pequeña y un requisito básico de confianza.
- Velocidad razonable y un diseño compatible con móviles. Google indexa la versión móvil de el sitio, así que tiene que funcionar en un teléfono. No hay que obsesionarse con las puntuaciones de velocidad (ver los mitos); basta con evitar una lentitud extrema.
Eso es genuinamente la mayor parte para un sitio normal. Rastreable, tiene un sitemap, una versión canónica por página, HTTPS, funciona en móviles, no es insoportablemente lento.
Cómo comprobar el SEO técnico de un sitio
No se necesitan herramientas caras para empezar. Las gratuitas que proporcionan los motores de búsqueda son la verdad de referencia:
- Google Search Console → Informe de indexación de páginas. Esto indica qué páginas están indexadas y por qué las demás no lo están. Es la pantalla más útil en el SEO técnico. Si una página importante no está indexada, aquí es donde se detecta.
- La herramienta URL Inspection (también en Search Console). Se introduce cualquier URL y Google indica exactamente cómo rastreó, renderizó e indexó esa página — y permite solicitar la indexación.
- Bing Webmaster Tools. El equivalente de Bing, y vale la pena configurarlo — su índice ahora alimenta muchas respuestas de IA, así que importa más de lo que sugiere su cuota de mercado de búsqueda.
Conviene empezar ahí. Si las páginas importantes están indexadas y el informe de indexación de páginas no está lleno de sorpresas, el SEO técnico probablemente está bien.
Lo que el SEO técnico no es
Gran parte de la confusión viene de que la gente lo archiva todo bajo “SEO técnico”. No es:
- Calidad del contenido o investigación de palabras clave — eso es SEO on-page y estrategia de contenido.
- Construcción de enlaces — eso es SEO off-page.
- Escribir etiquetas de título y meta descripciones — eso es on-page, aunque vive justo en el límite.
Los límites realmente se difuminan en algunos puntos — el marcado de esquema, los enlaces internos y la velocidad de página están a caballo entre lo técnico y lo on-page. No hay que preocuparse por en qué categoría están. La etiqueta importa menos que hacer el trabajo.
Mitos comunes que ignorar
La mitad de ser bueno en SEO técnico es no perder tiempo en cosas que no importan. Las grandes:
- «Bloquear una página en
robots.txtla elimina de Google». No es así. Google dice claramente que robots.txt “is not a mechanism for keeping a web page out of Google.” (traducción: «no es un mecanismo para mantener una página web fuera de Google»). Una página bloqueada aún puede aparecer si otros sitios enlazan a ella — Google simplemente no puede ver su contenido. Para eliminar realmente una página, se permite el rastreo y se añade una etiquetanoindex. - “Necesito preocuparme por el presupuesto de rastreo.” Casi seguro que no. La mayoría de los sitios nunca necesitan pensar en ello; solo importa para sitios muy grandes o que cambian rápidamente. Evidence for this claim Google says crawl-budget guidance is mainly relevant to very large sites, including sites with over one million unique pages or over ten thousand rapidly changing pages. Scope: Google Search guidance; the page-count examples are diagnostic starting points, not hard eligibility thresholds. Confidence: high · Verified: Google: Large site crawl budget guide
- “Core Web Vitals son un factor de ranking enorme.” Son una señal real pero menor. Generalmente no los priorizo para rankings a menos que un sitio sea extremadamente lento. Deben mejorarse para los usuarios, no para un supuesto impulso en el ranking. Evidence for this claim Google says Core Web Vitals are used by ranking systems, while page experience does not override more relevant content. Scope: Google Search ranking guidance; no fixed weight or ranking-position effect is promised. Confidence: high · Verified: Google: Core Web Vitals and Search Google: Page experience
- “Necesitas una puntuación perfecta de 100 en PageSpeed.” No. Esas puntuaciones de laboratorio no son en lo que Google se basa para el ranking — utiliza datos de campo del mundo real. Perseguir el 100 es una pérdida de tiempo.
- “El contenido duplicado es una penalización.” No lo es. Google llama a cierta duplicación “normal.” Es un problema de canonicalización, no un peligro.
- “IndexNow tells Google about my pages.” (traducción: «IndexNow informa a Google sobre mis páginas»). No es así: Google no usa IndexNow. Es un protocolo de Bing y otros buscadores.
SEO técnico en la era de la búsqueda con IA
La búsqueda con IA — los AI Overviews de Google, ChatGPT, Perplexity — funciona con la misma infraestructura. Estos sistemas aún tienen que rastrear, leer y entender las páginas antes de poder citarlas, y hay una nueva ola de rastreadores de IA (GPTBot, ClaudeBot, PerplexityBot) que recorren la web. Así que los fundamentos de esta guía no van a desaparecer en la era de la IA — si acaso, una base técnica limpia es ahora lo que determina la elegibilidad para que una página aparezca citada en una respuesta de IA en absoluto.
Dónde ir a continuación
Cuando estés listo para la versión para profesionales — el pipeline en detalle real, umbrales de presupuesto de rastreo, la decisión de renderizado, las muchas señales de canonicalización, y cómo ejecutar el SEO técnico como un sistema continuo, se cambia a la pestaña Guía Avanzada.
Y esta página es el centro de todo el pilar de SEO técnico. Las inmersiones profundas están organizadas en Cómo funciona la búsqueda (rastreo, descubrimiento, indexación, renderizado), Migraciones de sitios, metaetiquetas On-Page, Herramientas de motores de búsqueda (Search Console y Bing Webmaster Tools), y SEO con JavaScript — todo en la barra lateral.
TL;DR — El SEO técnico es el mismo pipeline de rastreo → renderizado → indexación → entrega en todos los sitios — no existe un “algoritmo de SEO técnico” separado — y es una base, no un factor de ranking por sí mismo. El pipeline se trata como una serie de puertas y diagnostica en cuál está atascada una página antes de cambiar nada. El apalancamiento es mayormente negativo (no perder lo que has ganado), así que el trabajo estructural aburrido — canonicalización, redirecciones, enlaces internos — es el que mejor paga, y se acumula a escala. La mayoría de los sitios no necesitan gestionar el presupuesto de rastreo; el renderizado es un paso separado que puede retrasarse; Core Web Vitals son tres problemas distintos y una palanca de ranking menor; la canonicalización es una decisión ponderada entre ~40 señales; y desde 2025, la búsqueda con IA condiciona la elegibilidad a señales técnicas limpias antes de posicionar o citar una página. La habilidad más alta aquí es la priorización — saber qué ignorar.
El SEO técnico decide la elegibilidad, no la posición
El SEO técnico es la única parte del SEO cuyo beneficio es casi enteramente negativo: su trabajo es evitar perder posicionamiento, no ganarlo. Google no otorga posiciones por tener una infraestructura limpia. Los mismos sistemas de rastreo, indexación y ranking funcionan ya sea que el sitio esté impecable o sea un desastre — no hay un “algoritmo de SEO técnico” separado detrás de ellos. Lo que el SEO técnico realmente decide es si las páginas pueden entrar en esos sistemas en absoluto, y si el motor las entiende correctamente una vez que están dentro.
Así que el modelo mental correcto no es “hacer SEO técnico para posicionar”. Es “hacer SEO técnico para que el contenido y los enlaces puedan posicionarse”. Esa inversión es toda la razón por la que el trabajo poco glamoroso —canonicalización, redirecciones, enlaces internos— es el trabajo de mayor valor, y por la que la habilidad más útil en esta disciplina es la priorización: saber qué arreglar y, con la misma frecuencia, qué dejar en paz.
El embudo, como compuertas
Todo cuelga de un solo embudo, y la cláusula operativa de Google es “no todas las páginas pasan por cada etapa”. Evidence for this claim Google Search describes crawling, indexing, and serving as three stages; discovery is part of the crawling stage, and not every page advances through each stage. Scope: Google Search documentation; conceptual explanation, not a promise of ranking outcomes. Confidence: high · Verified: Google: How Search Works No imagines una cinta transportadora que lleva cada página hasta el final. Imagina una serie de compuertas, cada una con su propio aprobado/reprobado:
- Rastreo — descubrimiento (enlaces + sitemaps + protocolos de envío) más la descarga. Una página a la que nada enlaza, o una deshabilitada en
robots.txt, puede que nunca llegue. - Renderizado — Google ejecuta el JavaScript en un Chrome headless reciente (el Web Rendering Service) antes de poder entender completamente la página. Este es un paso separado de la descarga, es sin estado y puede ir con retraso.
- Indexación — el motor procesa la página, elige una canónica entre duplicados y decide si almacenarla. “La indexación no está garantizada” incluso cuando el rastreo y el renderizado tienen éxito.
- Servicio — comprensión de la consulta, luego posicionamiento mediante muchos sistemas automatizados y, por último, funciones de búsqueda superpuestas.
Se deben mantener rastreo ≠ renderizado ≠ indexación ≠ posicionamiento como conceptos separados; así, la mayor parte del SEO técnico deja de ser misterioso. Cuando una página rinde por debajo de lo esperado, no se debe adivinar ni cambiar diez cosas: se identifica qué compuerta falló y se corrige esa etapa.
Una advertencia honesta antes de que trates cualquier descripción del embudo como evangelio, incluida la mía: es un modelo, no el código fuente. How Search Works es una charla que doy en conferencias y que recorre todo este embudo (diapositivas en SlideShare), y la abro con una advertencia que repetiré aquí: “this is my understanding of systems… not going to be 100% complete or accurate.” (traducción) «esta es mi comprensión de los sistemas… no va a ser 100 % completa o precisa». Tómala con flexibilidad y úsala para razonar sobre problemas.
Quién hace realmente el rastreo
“Googlebot” suena como un solo programa. Es una familia —de escritorio, móvil (el que importa, ya que la indexación es mobile-first), imagen, noticias, video y anuncios— todos extrayendo del mismo fondo de presupuesto de rastreo, por lo que un rastreo descontrolado de imágenes o parámetros puede privar del rastreo a el contenido real.
Y ya no son solo los motores de búsqueda. Cuando analicé los datos de rastreo de Cloudflare Radar (un artículo de Ahrefs que escribí sobre la nueva ola de bots), los rastreadores de motores de búsqueda seguían rastreando más, pero los bots de IA estaban firmemente en segundo lugar y en camino de superarlos. Al revisar los registros, el elenco de personajes ha cambiado; gestionar qué rastreadores de IA se permiten y confirmar que son quienes dicen ser ahora forma parte del trabajo.
Presupuesto de rastreo: cuándo importa y cuándo no
Google define el presupuesto de rastreo como “the set of URLs that Google can and wants to crawl,” (traducción) «el conjunto de URLs que Google puede y quiere rastrear», establecido por la capacidad de rastreo (la salud del servidor) y la demanda de rastreo (popularidad y desactualización). El presupuesto efectivo aumenta de dos maneras: se proporciona más capacidad a los bots o —mucho más a menudo— se evita desperdiciarlo. Se consolidan duplicados, se bloquean espacios de bajo valor, se devuelven 404/410 para páginas desaparecidas permanentemente, se corrigen los 404 blandos, se mantienen los sitemaps actualizados con un lastmod preciso y se evitan cadenas de redirección largas.
La parte tranquilizadora, y lo seguiré diciendo: la mayoría de los sitios no necesitan preocuparse por el presupuesto de rastreo. Google mismo indica que si las páginas generalmente se rastrean el mismo día en que se publican, “you don’t need to read this guide.” (traducción) «no hace falta leer esta guía». Empieza a afectar alrededor de 1M+ páginas, o 10k+ páginas que cambian rápidamente. Por debajo de eso, conviene dedicar el esfuerzo a otra cosa. Evidence for this claim Google says crawl-budget guidance is mainly relevant to very large sites, including sites with over one million unique pages or over ten thousand rapidly changing pages. Scope: Google Search guidance; the page-count examples are diagnostic starting points, not hard eligibility thresholds. Confidence: high · Verified: Google: Large site crawl budget guide Fabrice Canel de Bing plantea la misma idea de forma más directa: menos es más — menos URLs para rastrear es mejor para el SEO.
robots.txt: control de rastreo, no control de indexación
La distinción más importante en todo este archivo: robots.txt controla el rastreo, no la indexación. Deshabilitar una URL impide que los bots la obtengan — no la mantiene fuera del índice. Una página deshabilitada aún puede indexarse (solo URL, sin contenido) si otras páginas enlazan a ella y, peor aún, al deshabilitar una página también se impide que Google vea una etiqueta noindex en ella.
Entonces las reglas son:
- ¿Se busca retirar una página de la búsqueda? Se permite el rastreo y se añade
noindex. Nunca se debe usarrobots.txtpara desindexar. - ¿Se busca que los bots omitan un espacio de URL de bajo valor (búsqueda interna, combinaciones infinitas de facetas) y no importa la indexación? La deshabilitación en
robots.txtes correcta. - ¿Se gestionan rastreadores de IA? Aquí también se permiten o bloquean GPTBot, ClaudeBot, PerplexityBot, CCBot y similares: una decisión estratégica, no un valor predeterminado.
Canonicalización: una decisión ponderada, no un comando
La canonicalización es donde vive gran parte del SEO técnico avanzado, y está ampliamente malentendida. rel="canonical" es una señal, no una directiva. Google la pondera frente a muchas otras señales — redirecciones, enlaces internos, inclusión en el sitemap, HTTPS, estructura de URL — cuando elige la URL representativa. Mi análisis profundo sobre
canonicalización sitúa el recuento en alrededor de 40 señales que alimentan la selección canónica, por eso a veces aparece “Duplicate, Google chose different canonical than user” en Search Console: la etiqueta fue superada en votos.
Las implicaciones prácticas:
- No envíes señales contradictorias. Pasé años en sitios empresariales (dirigí SEO técnico interno en IBM), y en una charla que doy llamada Enterprise SEO Chaos muestro páginas reales que “redirected to one version, canonicaled to a second, and internally linked to a third.” (traducción) «redirigían a una versión, canonicaban a una segunda y enlazaban internamente a una tercera». Se elige una URL y se alinean todas las señales.
- La fuerza de la señal se clasifica aproximadamente redirección >
rel="canonical"> enlaces internos > sitemap. Un 301 es una declaración mucho más fuerte que una etiqueta canónica. - El contenido duplicado no es una penalización. Gary Illyes de Google ha dicho que aproximadamente el 60 % de la web es contenido duplicado, y Google trata parte de él como normal — no una violación de spam. El costo son señales divididas y rastreo desperdiciado, no un castigo. La solución es la consolidación, no el pánico.
Y una nota sobre JavaScript: una vez ejecuté una prueba — inyectar un rel="canonical" mediante JavaScript en una página que no lo tenía en el HTML — y Google lo honró, aunque había dicho públicamente que no lo haría. Después de que eso saliera a la luz, Google actualizó su documentación de SEO para JavaScript
. La lección no es “se deben usar canónicas JS”; es que esto es comprobable, y los documentos no siempre tienen la última palabra.
La decisión de renderizado
El renderizado es el paso que la mayoría de las descripciones generales omiten, y es donde los sitios con JavaScript se meten en problemas. “During the crawl, Google renders the page and runs any JavaScript it finds using a recent version of Chrome.” (traducción) «Durante el rastreo, Google renderiza la página y ejecuta cualquier JavaScript que encuentre usando una versión reciente de Chrome». Evidence for this claim Google processes JavaScript pages in crawling, rendering, and indexing phases and uses a recent version of Chrome for rendering. Scope: Google Search JavaScript processing; rendering and indexing remain subject to technical and quality constraints. Confidence: high · Verified: Google: JavaScript SEO basics Es un servicio separado y sin estado, puede almacenar en caché recursos durante semanas y puede retrasarse respecto a la obtención inicial — por lo que un cambio dependiente de JS puede tardar un tiempo en reflejarse.
JavaScript no es el enemigo aquí. Como lo expresé en mi guía de JavaScript SEO, JavaScript no es malo para el SEO, y no es malvado — solo es diferente de lo que muchos especialistas en SEO están acostumbrados. La decisión real es cómo renderizas:
- Renderizado del lado del servidor (SSR) — el más seguro para el SEO; el HTML llega completo.
- Generación estática (SSG/pre-renderizado) — lo mejor de ambos mundos para contenido que no cambia por solicitud.
- Renderizado del lado del cliente (CSR) — el mayor riesgo; el contenido solo existe después de que JS se ejecuta, por lo que se depende del paso de renderizado.
- Renderizado dinámico — Google lo llama un workaround, no una recomendación; Bing es más favorable. Trátalo como un puente, no como un destino.
Conviene conocer bien dos trampas. Primero, lazy-loading: Googlebot no se desplaza ni hace clic,
así que el contenido que solo se carga con la interacción puede permanecer invisible — asegúrate de que se cargue cuando
esté en el viewport. Segundo, enlaces: Google solo puede seguir un enlace que sea un elemento
real <a href>. Un routerLink o un controlador de clic sin href no es un
enlace rastreable. Verifica la salida renderizada contra el HTML sin procesar con la herramienta
URL Inspection (Inspección de URLs) siempre que se sospeche una discrepancia.
Arquitectura del sitio y enlaces internos
Los enlaces internos hacen tres trabajos a la vez: ayudan a los bots a descubrir páginas, distribuyen PageRank y transmiten contexto temático a través del texto de anclaje. John Mueller ha llamado a los enlaces internos “super critical for SEO” (traducción) «supercríticos para el SEO» y uno de los mayores recursos del propio sitio — y estoy de acuerdo. Es una de las acciones bajo control directo con mayor retorno de inversión.
Algunos puntos a nivel de sistemas:
- Páginas huérfanas — páginas a las que nada enlaza — son lo primero que se debe buscar. Si no está enlazada, apenas es descubrible y recibe casi nada de equidad.
- La arquitectura es gestión del embudo de rastreo. Las páginas importantes deben estar cerca de la página de inicio; las páginas profundas y con muchos clics de distancia se rastrean menos y se posicionan peor.
- La escultura de PageRank con
nofollowestá muerta (desde 2009). Poner nofollow a los enlaces internos hace que esa equidad se evapore en lugar de redistribuirse. Gestiona el flujo con arquitectura real, no con trucos de nofollow.
Core Web Vitals: tres problemas, no uno
El mayor error de los profesionales con la experiencia de página es tratarla como un único problema de “hacer el sitio más rápido”. Core Web Vitals son tres problemas distintos con causas raíz diferentes y soluciones diferentes:
- LCP (Largest Contentful Paint) — carga. Impulsado por el tiempo de respuesta del servidor, recursos que bloquean el renderizado y la velocidad con la que se carga el activo de contenido principal. Objetivo: menos de 2,5 segundos.
- INP (Interaction to Next Paint) — interactividad. Impulsado por la ejecución de JavaScript que bloquea el hilo principal. Objetivo: menos de 200 milisegundos. (INP reemplazó a FID en 2024 — si todavía ves FID en algún lugar, el consejo está desactualizado.)
- CLS (Cumulative Layout Shift) — estabilidad visual. Impulsado por imágenes sin dimensiones, fuentes que cargan tarde y contenido inyectado. Objetivo: menos de 0,1.
Dos cosas importan más allá de las definiciones. Datos de campo, no datos de laboratorio: Google posiciona según los datos de CrUX de usuarios reales, no según la puntuación de Lighthouse, así que un Lighthouse 65 con buenos datos de campo supera a un Lighthouse 100 con malos datos de campo. Y proporción: seré honesto — no creo que Core Web Vitals tengan mucho impacto en el SEO, y a menos que un sitio sea extremadamente lento, generalmente no priorizaré arreglarlos para el posicionamiento. Haz el trabajo por los usuarios y las conversiones; solo no lo vendas de más como una palanca de posicionamiento.
Datos estructurados: señales para la búsqueda y la IA
Los datos estructurados (se usa JSON-LD) no mejoran el posicionamiento, pero hacen que las páginas sean elegibles para resultados enriquecidos y, cada vez más, ayudan a los sistemas de IA a analizar el contenido para citarlo. Son genuinamente útiles — y genuinamente sobrevalorados como señal de posicionamiento. Mi enfoque honesto: la mayor parte del SEO consiste en hacer bien lo básico, y el contenido y los enlaces mueven la aguja más que el esquema. Debe implementarse donde desbloquee un resultado enriquecido o aclare una entidad; no debe esperarse que eleve el posicionamiento por sí solo. (Y nota: las URLs del marcado de esquema no son enlaces internos rastreables — Mueller lo ha confirmado).
Internacional, brevemente
Si el sitio atiende a varios idiomas o regiones, se usan URLs distintas por versión y anotaciones hreflang para mapearlas, y se prefieren ccTLDs o subdirectorios sobre parámetros de URL. No se debe redirigir automáticamente por IP — Google advierte explícitamente contra ello y rompe el rastreo. El SEO internacional es lo bastante profundo como para ser un pilar propio; esto es solo el apretón de manos técnico.
El SEO técnico es un sistema continuo, no una auditoría puntual
El enfoque que todas las guías de la competencia entienden mal: el SEO técnico no es una lista de verificación que se completa una vez. Los sitios cambian constantemente — los despliegues rompen las etiquetas canónicas, un lanzamiento introduce un noindex en una plantilla, un nuevo script de anuncios hunde el INP, las cadenas de redirecciones se acumulan. La práctica madura es monitoreo y detección de regresiones:
- Observa la Indexación de páginas de GSC para detectar cambios repentinos en los recuentos indexados y los estados excluidos.
- Se observan las Estadísticas de rastreo y los registros para detectar picos en los códigos de respuesta y cambios en los patrones de rastreo.
- Revalida el rastreo, el renderizado y las redirecciones después de cada despliegue significativo.
Sobre los archivos de registro específicamente: solía tratarlos como una herramienta de solución de problemas una vez cada pocos años. Eso ha cambiado. Los registros son ahora el lugar más claro para ver qué rastreadores de IA visitan realmente y con qué frecuencia — algo que ninguna otra herramienta muestra tan directamente — así que para quien se preocupe por la búsqueda con IA, se han vuelto mucho más útiles de lo que eran.
Migraciones de sitio: el evento de mayor riesgo
Una migración — nuevo dominio, HTTP a HTTPS, una replataforma, una reestructuración de URLs — es el evento técnico de mayor riesgo, porque afecta a cada URL a la vez. Se mapea lo antiguo a lo nuevo 1:1, se usan redirecciones permanentes 301/308, se mantienen activas indefinidamente (no me apresuraría a eliminarlas — un par de saltos de redirección no son nada de qué preocuparse), y se usa la herramienta Cambio de dirección de GSC donde corresponda. Las migraciones pueden ser complejas e involucrar a mucha gente, pero no hay que entrar en pánico — se puede corregir casi cualquier cosa que salga mal. Hay un clúster completo de Migraciones de sitio bajo este pilar.
SEO técnico para la búsqueda con IA
El cambio moderno, y va en contra de la perezosa afirmación de que “el SEO técnico está muerto”: a partir de 2025, los sistemas de búsqueda con IA deciden la elegibilidad antes de posicionar o citar. Para que una página sea citada en una respuesta de IA, la página generalmente tiene que estar limpiamente canonicalizada, ser lo bastante rápida, renderizable sin heroicidades y estar estructurada lo suficiente para ser analizada con confianza. Las señales desordenadas ya no solo bajan un posicionamiento — pueden eliminarla por completo de la respuesta. Debido a que el índice de Bing alimenta muchas respuestas de LLM, Bing Webmaster Tools e IndexNow importan más de lo que sugiere la cuota de búsqueda de Bing. La higiene técnica importa más en la era de la IA, no menos.
Dónde está realmente el apalancamiento
Si se retiene una cosa de esta guía, que sea la priorización. Conviene dedicar el tiempo a indexación, canonicalización, enlaces internos y migraciones limpias — el trabajo que decide si las páginas existen en la búsqueda y consolidan su equidad. No hay que perder el sueño por el presupuesto de rastreo, Core Web Vitals, contenido duplicado o cadenas de redirecciones cortas salvo que exista un problema específico y diagnosticado. Y no se debe perseguir la perfección — dudo que haya un sitio web importante que sea técnicamente perfecto, y si lo hubiera, me preocuparía que estuvieran desperdiciando recursos en cosas que no importan en lugar de en las que sí.
Este centro de recursos mapea el resto del pilar: Cómo funciona la Búsqueda, Migraciones de sitios, On-Page, Herramientas de motores de búsqueda y SEO para JavaScript. Se empieza donde el sitio esté fallando: el pipeline indica qué puerta revisar primero.
Resumen de IA
Una versión condensada de la Guía avanzada:
- No hay algoritmo separado. El mismo pipeline de rastreo → renderizado → indexación → servicio se aplica en todos los sitios. El SEO técnico decide si las páginas pueden entrar al sistema y ser comprendidas: es una base, no un truco de ranking. El apalancamiento es mayormente negativo: no perder lo que el contenido y los enlaces ganaron.
- El pipeline se trata como puertas. “No todas las páginas pasan por cada etapa.” Se diagnostica cuál puerta (rastreo, renderizado, indexación, servicio) falló una página antes de cambiar nada.
- La frase clave: una página que Google no indexa no puede posicionarse, así que el trabajo estructural aburrido (canonicalización, redirecciones, enlaces internos) paga mejor y se acumula a escala.
- Presupuesto de rastreo: capacidad + demanda. La mayoría de los sitios nunca necesitan gestionarlo (importa en ~1M+ páginas, o 10k+ que cambian rápidamente). Bing: menos es más.
- robots.txt controla el rastreo, no la indexación. Para eliminar una página: se permite el rastreo +
noindex. También es donde se permiten o bloquean los rastreadores de IA. - La canonicalización es una decisión ponderada entre ~40 señales;
rel=canonicales una señal, no una orden. No se deben enviar señales contradictorias; el contenido duplicado no es una penalización. - El renderizado es separado y puede retrasarse. JS no es malo, solo diferente. Elige SSR / estático / CSR / dinámico deliberadamente; vigila las trampas de lazy-loading y
<a href>. - El enlazado interno es “súper crítico” (Mueller). Busca huérfanos; la arquitectura es gestión del embudo de rastreo; el esculpido con
nofollowestá muerto. - Core Web Vitals = tres problemas (LCP/INP/CLS), juzgados con datos de campo, no Lighthouse — y una palanca de ranking menor (Patrick no los prioriza para rankings).
- Monitoreo, no una auditoría única. Observa Page Indexing, Crawl Stats y logs; revalida después de despliegues. Los logs son útiles recientemente para detectar rastreadores de IA.
- Las migraciones son el evento de mayor riesgo: se mapea 1:1, se usa
301y se mantienen las redirecciones. - La búsqueda con IA condiciona la elegibilidad a señales técnicas limpias antes de posicionar/citar; el índice de Bing alimenta a los LLM, así que Bing Webmaster Tools + IndexNow importan más que su cuota.
Documentación oficial
Los documentos de fuente primaria que anclan todo el pilar de SEO técnico.
- Guía en profundidad sobre cómo funciona la Búsqueda de Google — el pipeline de rastreo → indexación → servicio, descubrimiento de URLs, renderizado, indexación y servicio. La página más importante en SEO técnico.
- Guía de inicio de SEO — la orientación para principiantes de Google y la base de Search Essentials.
- Rastreo e indexación — el centro para
robots.txt, sitemaps, canonicalización y controles de rastreo. - Optimiza tu presupuesto de rastreo — capacidad de rastreo + demanda, y quién realmente necesita preocuparse.
- Conceptos básicos de SEO para JavaScript — el renderizado como parte de la indexación y cómo mantener el contenido JS indexable.
- Core Web Vitals y experiencia de página — qué son las señales de experiencia de página y cómo se usan.
- Movimientos de sitio con cambios de URL — el manual de migración de Google: redirecciones, Change of Address y qué monitorear.
- Dentro de Googlebot (marzo de 2026) — economía de rastreo actual y límites de bytes.
Bing / Microsoft
- Cómo entrega Bing los resultados de búsqueda — El flujo de rastreo → indexación → posicionamiento de Bing y los factores de posicionamiento que menciona.
- Serie bingbot: Maximizando la eficiencia del rastreo — La definición de rastreo de Bing y su “estrella del norte de eficiencia de rastreo.”
- IndexNow / indexnow.org — El protocolo push para señalar instantáneamente URLs cambiadas; se combina con sitemaps.
Citas de la fuente
Declaraciones oficiales de Google y Bing que anclan el pilar de SEO técnico. Cada enlace es un enlace profundo que salta al pasaje citado en la página de origen.
Google — el pipeline
- “Google Search works in three stages, and not all pages make it through each stage.” (traducción) «Google Search funciona en tres etapas, y no todas las páginas pasan por cada etapa.» Ir a la cita
- “Googlebot uses an algorithmic process to determine which sites to crawl, how often, and how many pages to fetch from each site.” (traducción) «Googlebot utiliza un proceso algorítmico para determinar qué sitios rastrear, con qué frecuencia y cuántas páginas obtener de cada sitio.» Ir a la cita
- “During the crawl, Google renders the page and runs any JavaScript it finds using a recent version of Chrome.” (traducción) «Durante el rastreo, Google renderiza la página y ejecuta cualquier JavaScript que encuentre usando una versión reciente de Chrome.» Ir a la cita
- “Indexing isn’t guaranteed; not every page that Google processes will be indexed.” (traducción) «La indexación no está garantizada; no todas las páginas que Google procesa serán indexadas.» Ir a la cita
Google — presupuesto de rastreo y robots.txt
- “Taking crawl capacity and crawl demand together, Google defines a site’s crawl budget as the set of URLs that Google can and wants to crawl.” (traducción) «Tomando juntos la capacidad de rastreo y la demanda de rastreo, Google define el presupuesto de rastreo de un sitio como el conjunto de URLs que Google puede y quiere rastrear.» Ir a la cita
- “If your site doesn’t have a large number of pages that change rapidly, or if your pages seem to be crawled the same day that they are published, you don’t need to read this guide.” (traducción) «Si el sitio no tiene un gran número de páginas que cambian rápidamente, o si las páginas parecen rastrearse el mismo día en que se publican, no hace falta leer esta guía». Ir a la cita
- “A robots.txt file tells search engine crawlers which URLs the crawler can access on your site.” (traducción) «Un archivo robots.txt indica a los rastreadores de motores de búsqueda a qué URLs puede acceder el rastreador en el sitio». Ir a la cita
Bing — Fabrice Canel, Microsoft
- “Crawling is the process by which bingbot discovers new and updated documents or content to be added to Bing’s searchable index.” (traducción) «El rastreo es el proceso mediante el cual bingbot descubre documentos o contenido nuevos y actualizados para agregar al índice de búsqueda de Bing.» Ir a la cita
- “Less is more for SEO. Never forget that. Less URLs to crawl, better for SEO.” (traducción) «Menos es más para el SEO. Nunca debe olvidarse. Menos URLs para rastrear, mejor para el SEO». Leer la entrevista
Representantes de Google, oficialmente (reproducido a través de cobertura de la industria)
- John Mueller: “Technical SEO is not going away, it continues to be the foundation of everything built on the open web.” (traducción) «El SEO técnico no va a desaparecer; sigue siendo la base de todo lo construido sobre la web abierta». Cobertura (Search Engine Journal)
- Gary Illyes, sobre el presupuesto de rastreo: “the vast majority of the people don’t have to care about it.” (traducción) «la gran mayoría de las personas no tienen que preocuparse por ello». Cobertura (Search Engine Journal)
- John Mueller, sobre los enlaces internos: “internal linking is super critical for SEO… one of the biggest things that you can do on a website.” (traducción) «el enlazado interno es fundamental para el SEO… una de las acciones más importantes que se pueden realizar en un sitio web». Cobertura (Search Engine Journal)
- John Mueller, sobre Core Web Vitals: “it’s more than a tie-breaker, but it also doesn’t replace relevance.” (traducción) «es más que un desempate, pero tampoco reemplaza la relevancia». Cobertura (Search Engine Journal)
- Gary Illyes, sobre la prioridad de Core Web Vitals: “If you don’t have anything better to do on your site, go do Core Web Vitals.” (Pubcon AMA) (traducción) «Si no hay nada mejor que hacer en el sitio, conviene trabajar en Core Web Vitals». Cobertura (Search Engine Land)
- Martin Splitt, sobre el renderizado: “two-wave indexing… plays less and less of a role.” (traducción) «la indexación en dos oleadas… juega un papel cada vez menor». Cobertura (Onely)
Patrick Stox (trabajo propio)
- “This is my understanding of systems and is based on a lot of public statements from Google and my own knowledge. Warning: It’s not going to be 100% complete or accurate.” — diapositiva 3 de mi presentación How Search Works. (traducción) «Esta es mi comprensión de los sistemas y se basa en muchas declaraciones públicas de Google y en mi propio conocimiento. Advertencia: no va a ser 100 % completo ni preciso». Ver la diapositiva
Los modelos mentales
1. No existe un algoritmo de SEO técnico. El mismo proceso de rastreo → indexación → entrega, los mismos sistemas de posicionamiento, en cada sitio. El SEO técnico decide si las páginas pueden entrar en el sistema y ser comprendidas; no otorga puntos de posicionamiento. Antes de buscar un “truco técnico”, se pregunta qué etapa ordinaria está fallando.
2. Fundamento, no factor. El apalancamiento del SEO técnico es mayormente negativo: evita perder lo que el contenido y los enlaces han ganado. Una página que Google no indexa no puede posicionarse, así que la mayor parte del trabajo consiste en eliminar obstáculos, no en añadir señales.
3. Cuatro puertas, no una cinta transportadora. Rastreo → renderizado → indexación → entrega. Cada una es un filtro, y “no todas las páginas pasan por cada etapa”. Cuando una página tiene un rendimiento inferior, localiza cuál puerta falló antes de cambiar nada.
4. Los cuatro “no es igual”.
- Rastreo ≠ indexación (una página bloqueada aún puede ser indexada; la indexación no está garantizada incluso cuando el rastreo tiene éxito).
- Rastreo ≠ posicionamiento (la tasa de rastreo no es una señal de posicionamiento).
- Rastreo ≠ renderizado (JavaScript se ejecuta en un paso separado que puede retrasarse).
- Indexación ≠ posicionamiento (estar en el índice no garantiza ganar consultas).
5. La regla del apalancamiento a escala. En sitios grandes todo es a nivel de plantilla, por lo que el impacto se multiplica. Un error puede mantener millones de páginas fuera del índice; una corrección canónica puede recuperar una fortuna. El trabajo estructural aburrido supera a las cosas llamativas.
6. La priorización es la habilidad real. Lo más difícil y valioso en el SEO técnico es saber qué ignorar. Se corrigen la indexación, la canonicalización, los enlaces internos y las migraciones; no hay que preocuparse por el presupuesto de rastreo, Core Web Vitals o el contenido duplicado sin un problema diagnosticado.
7. La IA eleva el listón, no lo baja. La búsqueda con IA decide la elegibilidad (canonicalización limpia, schema, páginas renderizables rápidas) antes de clasificar o citar. Las señales técnicas desordenadas pueden eliminarla por completo de la respuesta.
Lista de verificación de fundamentos de SEO técnico
Una primera pasada para confirmar que los motores de búsqueda pueden encontrar, leer y comprender el sitio:
- Rastreable. Las páginas importantes están enlazadas desde algún lugar rastreable (sin
huérfanas);
robots.txtno bloquea nada que deba indexarse. - Descubrible. Se envía un sitemap XML en Google Search Console y en
Bing Webmaster Tools, que enumera solo URL canónicas e indexables con
lastmodpreciso. - Renderizable. El contenido dependiente de JS es accesible mediante enlaces
<a href>reales, no solo navegación por clic; el contenido crítico no depende de una renderización lenta. - Indexable. Sin
noindexdisperso en páginas que deban encontrarse; se consulta el informe de Indexación de páginas de GSC para ver los estados excluidos. - Canónico. Una URL canónica por contenido; los duplicados apuntan a ella; sin cadenas canónicas ni canónicas que apunten a la página de inicio; las señales coinciden (redirección, canónica, enlaces internos, sitemap apuntan de la misma manera).
- Servidor saludable. Respuestas rápidas y estables: mínimos
5xx/tiempos de espera (los bots se ralentizan cuando el servidor tiene problemas). - Redirecciones limpias. Sin cadenas de redirección largas ni bucles; los movimientos permanentes usan
301/308; las páginas desaparecidas devuelven404/410. - Sin desperdicio de URL. Los parámetros, la navegación facetada y los ID de sesión no generan espacios de URL infinitos o duplicados (trampas para arañas).
- Meta en la página. Etiquetas de título y meta descripciones únicas y precisas; directivas meta robots correctas.
- Seguro para migraciones. Si se cambia algo (dominio, HTTPS, plataforma, URL), se mapean redirecciones 1:1 de antiguo→nuevo y se usa la herramienta Cambio de dirección de GSC donde corresponda.
- Elegible para IA. Schema válido, señales de entidad consistentes, acceso de rastreadores de IA decidido deliberadamente y páginas renderizables rápidas para que la búsqueda con IA pueda analizarlas y citarlas.
¿Cuánto debe preocupar realmente?
Lo más útil para un profesional del SEO técnico no es una lista de verificación, sino un sentido de proporción. Muchas “mejores prácticas” reciben mucha más atención de la que merecen. Aquí está mi ranking honesto de dónde está el apalancamiento y dónde no.
| Elemento técnico | Cuánto importa | Mi opinión |
|---|---|---|
| Indexación y canonicalización | Alta | Aquí está el apalancamiento. Una página que Google no indexa no puede posicionarse, así que lograr que las páginas se rastreen, se indexen y se consoliden en una única canónica es el trabajo de mayor valor que existe. |
| Enlaces internos | Alta | Mueller lo llama “super critical for SEO,” (traducción) «fundamental para el SEO», y estoy de acuerdo: es una de las acciones más importantes para guiar a Google y a los usuarios hacia las páginas que importan. |
| Redirecciones en una migración | Alta | El evento técnico de mayor riesgo. Se mapea lo antiguo→nuevo 1:1 para conservar la autoridad; una implementación incorrecta pierde tráfico. |
| Marcado de esquema | Media | Excelente para resultados enriquecidos y para ayudar a la IA a analizar el contenido, pero está sobrevalorado como señal de posicionamiento. La mayor parte del SEO consiste en hacer bien lo básico; el contenido y los enlaces mueven la aguja más que el esquema. |
| Core Web Vitals | Baja (para el posicionamiento) | No creo que Core Web Vitals tengan mucho impacto en el SEO y, salvo que el sitio sea extremadamente lento, por lo general no los priorizaré. Deben mejorarse por los usuarios y las conversiones, no por una mejora en el posicionamiento. |
| Presupuesto de rastreo | Baja (la mayoría de los sitios) | La mayoría de los sitios no necesitan preocuparse por el presupuesto de rastreo. Empieza a afectar alrededor de 1M+ de páginas, o 10k+ que cambian rápidamente, no el sitio promedio. |
| Análisis de archivos de registro | En aumento | Los registros son la verdad absoluta sobre lo que los bots realmente hacen en el sitio. Solía tratarlos como una herramienta de solución de problemas una vez cada dos años, pero últimamente se han vuelto mucho más útiles porque son el lugar más claro para ver a los rastreadores de IA (GPTBot, ClaudeBot, PerplexityBot y demás) golpeando el sitio. Si importa la búsqueda con IA, los registros son donde esa actividad aparece primero. |
| Contenido duplicado | Baja (no hay que entrar en pánico) | No hay penalización por contenido duplicado. Es un problema de canonicalización, no un peligro; alrededor del 60 % de la web es contenido duplicado de todos modos. |
| Cadenas de redirección cortas | Muy baja | ¿Un par de saltos? No me preocuparía en absoluto. |
| HTTPS | Muy baja | Una señal de posicionamiento pequeña, básicamente un desempate, pero debe implementarse de todos modos; es un requisito básico para la confianza. |
El patrón: conviene dedicar el tiempo a la indexación, la consolidación y las migraciones limpias; no hay que perder el sueño por el presupuesto de rastreo, Core Web Vitals o el contenido duplicado salvo que exista un problema específico y diagnosticado. Y no se debe perseguir la perfección técnica; dudo que exista un sitio web importante que sea técnicamente perfecto, y si lo hubiera, me preocuparía que estuvieran desperdiciando recursos en cosas que no importan en lugar de en cosas que sí importan.
Qué control hace qué
La otra cosa que la gente confunde constantemente: estas son cuatro herramientas separadas para cuatro trabajos separados:
| Control | ¿Detiene el rastreo? | ¿Detiene la indexación? | Uso recomendado |
|---|---|---|---|
robots.txt deshabilitar | Sí | No | Mantener a los bots fuera de espacios de URL de bajo valor |
noindex (meta/cabecera) | No (debe permanecer rastreable) | Sí | Eliminar una página del índice |
rel=canonical | No | Consolida, no fuerza | Señalar el duplicado preferido |
Redirección 301/308 | Envía a los bots hacia adelante | Consolida en el destino | Movimientos permanentes y consolidación |
El error clásico es usar robots.txt para desindexar: si se bloquea el rastreo,
Google no puede ver la etiqueta noindex y puede mantener la página en los resultados a través de enlaces de
otros sitios. ¿Se busca que una página desaparezca? Se permite el rastreo y se añade noindex.
Herramientas para el SEO técnico
- Google Search Console — la fuente de verdad sobre cómo trata Google el sitio: el informe de Indexación de páginas, Estadísticas de rastreo, la herramienta Inspección de URLs (estado de rastreo/renderizado/indexación para una URL individual) y la herramienta Cambio de dirección para migraciones.
- Bing Webmaster Tools — información de rastreo, Control de rastreo, Site Scan e IndexNow — y es más importante de lo que sugiere su cuota porque el índice de Bing alimenta muchas respuestas de LLM.
- Rastreadores de sitios / auditorías — Ahrefs Site Audit y Screaming Frog SEO Spider simulan un rastreo y detectan cadenas de redirecciones, URLs duplicadas, páginas bloqueadas, canónicas rotas y patrones tipo trampa a escala.
- Análisis de archivos de registro del servidor — el único lugar donde se observa exactamente qué rastrearon los bots y dónde desperdiciaron presupuesto — y cada vez más la forma más clara de ver qué rastreadores de IA (GPTBot, ClaudeBot, PerplexityBot) visitan. Screaming Frog Log File Analyser, o canaliza los registros a BigQuery / una plataforma de registros.
- Ahrefs Webmaster Tools — rastreo y auditoría gratuitos para sitios que verifiques.
- PageSpeed Insights / Lighthouse — comprobaciones de experiencia de página y renderizado; combínalos con datos de campo (CrUX) para saber cómo experimentan la página los usuarios reales y el renderizador.
- IndexNow — envía URLs modificadas a Bing (y otros) en tiempo real en lugar de esperar a ser rastreado de nuevo.
Métricas técnicas de SEO duraderas
Tendencia de cobertura de indexación prevista
- Qué mide: Si las URLs canónicas e indexables que se pretende que los motores de búsqueda sirvan están realmente representadas en el índice a lo largo del tiempo.
- Cómo obtenerlo: Se compara el mapa del sitio XML o el inventario de URLs indexables aprobadas con los datos de Indexación de páginas de Search Console y luego inspecciona los motivos de exclusión por plantilla.
- Cadencia: Se revisa después de lanzamientos importantes y con una frecuencia programada adecuada al ritmo de publicación y rastreo del sitio.
- Dirección saludable: Las URLs indexables previstas se mantienen estables o crecen con contenido aprobado, mientras que las exclusiones inexplicadas y los conflictos de canónica duplicada disminuyen.
- Decisión que se activa: Se investigan problemas de rastreo, canónica, renderizado,
duplicación o
noindexa nivel de plantilla antes de invertir en más contenido para la misma área afectada.
Tasa de aprobación de campo de Core Web Vitals por plantilla
- Qué mide: La proporción de grupos de páginas de usuarios reales que aprueban Core Web Vitals de campo, separados por plantilla y dispositivo en lugar de promediarse en todo el sitio.
- Cómo obtenerlo: Se usan Core Web Vitals de Search Console y datos de campo de CrUX/PageSpeed Insights; se asignan los grupos de URLs afectados a la plantilla o componente responsable.
- Cadencia: Se hace seguimiento a través de la ventana de datos de campo y se compara antes y después de los lanzamientos de rendimiento importantes.
- Dirección saludable: Las plantillas más importantes pasan a grupos aprobados sin que las regresiones se desplacen a otro dispositivo, región o tipo de página.
- Decisión que se activa: Se prioriza una corrección de plantilla o componente compartido cuando un grupo deficiente afecte a tráfico significativo o a la experiencia del usuario; no se persiguen cambios pequeños solo de laboratorio como truco de posicionamiento.
Fiabilidad del rastreo y mezcla de respuestas
- Qué mide: Si el rastreo de los motores de búsqueda llega de forma fiable a URLs útiles en lugar de gastar capacidad en errores, cadenas, trampas o espacios de URLs de bajo valor.
- Cómo obtenerlo: Se combinan Estadísticas de rastreo de Search Console con registros del servidor e informes de rastreadores, segmentados por estado, host, directorio/plantilla y bot.
- Cadencia: Se monitorea continuamente para detectar incidentes y se revisan tendencias después de cambios en la plataforma, CDN, redirecciones, facetas o migraciones.
- Dirección saludable: Respuestas exitosas estables para URLs importantes, menos fallos 5xx y cadenas de redirecciones, y menos rastreo repetido de espacios trampa conocidos en relación con la propia línea base del sitio.
- Decisión que se activa: Se corrigen primero la disponibilidad o el enrutamiento; luego se ajustan el descubrimiento interno, el manejo de parámetros o los controles de rastreo para el desperdicio persistente.
Recursos que valen el tiempo
Mi redacción técnica SEO (Ahrefs)
- La guía del principiante para el SEO técnico — el marco completo: encontrar, rastrear, comprender e indexar.
- SEO técnico empresarial — cómo se ve el SEO técnico a escala (y por qué la perfección es el objetivo equivocado).
- Presupuesto de rastreo: todo lo que necesitas saber — cuándo importa y los (muchos) casos en los que no.
- SEO de JavaScript: problemas y mejores prácticas — “JavaScript no es malo para el SEO… solo es diferente.”
- Canonicalización: una guía para principiantes — las ~40 señales que Google pondera y por qué la mayoría de los duplicados no son malintencionados.
- Redirecciones para SEO — los 11 tipos y cuánto tiempo mantenerlas (más de lo que crees).
- Migración de sitios web: una guía completa — “se puede corregir casi cualquier cosa que salga mal.”
- Core Web Vitals y PageSpeed — por qué no priorizo CWV para los rankings.
Mis ponencias
- Cómo funciona la búsqueda (SlideShare) — mi recorrido completo por el rastreo, el renderizado, la indexación y el posicionamiento.
- Caos del SEO empresarial (SMX) — las historias a escala de IBM: 24 variaciones de URL, cadenas de redirección de 14 saltos y señales que apuntan en direcciones diferentes.
De la industria
- web.dev — Core Web Vitals — la documentación de la plataforma web de Google sobre LCP, INP y CLS: qué mide cada uno y cómo solucionarlo, aparte de la búsqueda.
- Blog de Onely — una agencia de SEO técnico conocida por su investigación profunda sobre renderizado e indexación (su artículo sobre las dos olas de indexación es un buen ejemplo).
- Search Engine Roundtable — el registro casi diario de Barry Schwartz de lo que realmente indican los representantes de Google y Bing; la forma más rápida de seguir los cambios en las declaraciones.
- Search Engine Journal — SEO técnico — cobertura continua y explicaciones, y la fuente de varias declaraciones de representantes citadas arriba.
- Search Engine Land — SEO — noticias de la industria y cobertura de conferencias (AMAs de Pubcon/SMX con el equipo de Google).
- La serie Crawling December de Google — el mejor conjunto concentrado de explicaciones oficiales sobre el rastreo.
- r/TechSEO — la comunidad para depurar rastreo, indexación y renderizado.
Podcasts
- Search Off the Record (Google Search Relations) — Gary Illyes y Martin Splitt sobre cómo Googlebot rastrea, renderiza e indexa. Lo más parecido a un comentario oficial sobre el proceso. Escuchar
- Voices of Search — Prioritizing SEO Efforts, mi conversación sobre por qué la priorización es la parte más difícil del trabajo y cómo clasifico el trabajo de alto impacto / bajo esfuerzo. Escuchar
- TheeDigital — Debunking SEO Myths — yo sobre los mitos técnicos que no mueren (penalizaciones por contenido duplicado, densidad de palabras clave, subdominios vs. subcarpetas). Escuchar
Vídeos
- Google Search Central (YouTube) — la serie How Google Search Works y las explicaciones de Martin Splitt sobre rastreo, renderizado y SEO de JavaScript. Canal
Estadísticas que vale la pena citar
Una mezcla de mi propia investigación y cifras de terceros (Google, Microsoft y Cloudflare):
- Los resultados enriquecidos pueden aumentar el CTR. Los estudios de caso publicados por Google reportan un 25% más de CTR en las páginas marcadas de Rotten Tomatoes, un 35% de aumento en visitas para Food Network y un 82% más de CTR en las páginas de resultados enriquecidos de Nestlé en comparación con las que no lo son. Google — introducción a los datos estructurados
- El renderizado cuesta aproximadamente 20 veces más que el rastreo. De mis charlas sobre SEO en JavaScript: Ahrefs rastreó alrededor de 7 mil millones de páginas al día, pero renderizó alrededor de 80 millones de páginas JavaScript usando unos 600 servidores, una idea útil de por qué el renderizado se raciona y puede retrasarse. Deck
- Aproximadamente el 60% de la web es contenido duplicado — Gary Illyes (Google) — que es exactamente por lo que algo de duplicación es “normal” y la canonicalización, no el pánico, es la respuesta correcta. Google — consolidar URLs duplicadas
- Bing descubre decenas de miles de millones de URLs nuevas cada día — Fabrice Canel (Microsoft) — la escala del problema de descubrimiento y filtrado detrás de “menos es más.” Cobertura (Search Engine Roundtable)
- Los bots de IA son un claro #2 y se acercan a los bots de motores de búsqueda — de los datos de rastreo de Cloudflare Radar (mi análisis de ellos): los bots de búsqueda aún rastrean más, pero los rastreadores de IA están en camino de superarlos en un par de años. Fuente
- El 95,2% de los sitios tienen redirecciones
3XX; el 72,9% carece de meta descripciones (mi estudio) — en más de 1 millón de dominios en Ahrefs Site Audit. Pero no conviene reaccionar en exceso al número de meta descripciones: Google las reescribe aproximadamente el 62,78% de las veces, y no son un factor de ranking. Fuente
Pon a prueba: SEO técnico
Cinco preguntas rápidas sobre qué es el SEO técnico y el flujo de rastreo → indexación → entrega. Se elige una respuesta para cada una y después se comprueba.
Technical SEO is infrastructure for the organic channel: it makes the content and product work you already funded available to search engines, then protects that access as the site changes.
- The operating model needs both periodic deep audits and standing monitoring and release guardrails.
- Recommendations should be ranked by traffic or revenue at risk, implementation cost, and the consequence of doing nothing—not by best-practice labels.
- Executive attention belongs on migrations, JavaScript rendering, crawl and index controls, and faceted navigation because template-level failures can spread across large sections of a site.
The return often appears as existing content and product work finally performing. Engineering capacity to implement the highest-impact fixes is usually more valuable than repeatedly buying new findings.
Riesgo si se ignora: A migration, rendering assumption, or index-control mistake can quietly remove important pages from search, while crawl waste and technical debt accumulate between periodic reviews.
Pregunta a tu equipo: If organic traffic dropped sharply tomorrow, what alerts would fire, who would diagnose it, and which upcoming releases have already received an SEO review?
Registro de cambios
Actualizado el 14 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 14 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 3 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 18 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
- Avanzado
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 7 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
- Para responsables de decisiones
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.