SEO de la búsqueda interna en ecommerce
Cómo aprovechar las consultas del buscador de una tienda para conversión y contenidos sin permitir que sus páginas de resultados agoten el rastreo, y cuándo convertir una demanda recurrente en una página de destino indexable.
Idiomas
1 señal de evidencia en esta página
- Herramienta activa relacionadarobots.txt Tester
La búsqueda interna de una tienda tiene dos caras. El cuadro de búsqueda concentra intención de compra y sus registros revelan oportunidades de contenido; las URL de resultados, como /search?q=..., pueden formar un espacio casi infinito de páginas escasas, duplicadas o vacías. Para evitar que consuman rastreo, bloquea el patrón adecuado en robots.txt en lugar de confiar únicamente en noindex, y no combines disallow con una directiva noindex que el robot ya no podrá leer. Los resultados vacíos deben devolver errores HTTP 404s reales, no soft 404s. Si una consulta demuestra demanda genuina y repetida, crea una categoría o página de destino estable: no indexes directamente la URL interna de búsqueda.
TL;DR — Su tienda tiene un cuadro de búsqueda y, en realidad, son dos temas de SEO distintos. La caja en sí es excelente: quienes la usan suelen estar cerca de comprar, y lo que escriben es una lista gratuita de lo que sus clientes realmente quieren. Las páginas que crea esa caja (las direcciones web del tipo
/search?q=running-shoes) son el problema: tienen poco contenido, se repiten entre sí y puede haber un número interminable de ellas. La tarea principal es mantener esas direcciones web de resultados de búsqueda fuera de Google y, al mismo tiempo, seguir aprovechando el cuadro de búsqueda —y todo lo que los compradores escriben en él— a su favor.
Qué significa aquí «búsqueda interna del sitio»
Hay dos tipos de «búsqueda» que suelen enredarse, así que conviene separarlos:
- Búsqueda en Google (o Bing): el motor de búsqueda que está en la web y que envía gente hacia su tienda.
- Búsqueda interna del sitio: el pequeño cuadro de búsqueda que está en su tienda y que permite a un comprador explorar sus propios productos.
Esta página trata del segundo caso. Cuando un comprador escribe «botas impermeables»
en el cuadro de búsqueda de su tienda, la mayoría de los sitios crean una nueva
dirección web para esa página de resultados, algo como
yourstore.com/search?q=waterproof-boots. Esa es la parte que importa para el SEO.
Por qué el cuadro de búsqueda es bueno
Quienes usan su cuadro de búsqueda suelen ir más en serio que quienes solo navegan: le han dicho exactamente qué quieren. Dos ventajas:
- Convierte. Un cuadro de búsqueda rápido y preciso que tolera erratas y sinónimos («trainers» = «sneakers») ayuda a la gente a encontrar y comprar cosas.
- Es una lista gratuita de palabras clave. Cada frase que la gente escribe es un cliente real diciéndole, con sus propias palabras, qué está buscando. Eso es oro para decidir qué productos tener en stock, sobre qué escribir y qué categorías crear.
Por qué las páginas de resultados de búsqueda son un problema
Aquí está el inconveniente. Esas páginas /search?q=... pueden causar, sin hacer
ruido, tres dolores de cabeza:
- Hay variaciones interminables. La gente escribe millones de cosas distintas —incluidas erratas y texto sin sentido— y cada una puede crear su propia dirección web.
- Tienen poco contenido y son repetitivas. Una búsqueda de «zapatos rojos» y una página de categoría de zapatos rojos pueden mostrar casi los mismos productos, así que Google ve casi duplicados.
- Algunas están vacías. Una búsqueda de algo que usted no vende devuelve una página que dice «sin resultados». Esa es una página de poco valor que no quiere tener en Google.
Google tiene un tiempo limitado para rastrear su sitio y prefiere dedicarlo a sus páginas reales de producto y de categoría antes que a un pantano de URL de resultados de búsqueda. Por eso el consejo estándar es: mantenga las páginas de resultados de búsqueda interna fuera de Google.
Evidence for this claim Low-value, dynamically generated URL spaces can waste crawl resources better spent on useful pages. Scope: Crawl-budget impact is most material on large or rapidly changing sites. Confidence: high · Verified: Google: Large-site crawl budgetLa solución sencilla
- Indique a los motores de búsqueda que no rastreen sus páginas de resultados de
búsqueda mediante su archivo
robots.txt(suele ser una sola línea; su desarrollador o su plataforma pueden configurarla). - Asegúrese de que una búsqueda que no encuentra nada devuelva una respuesta correcta de «no encontrado», y no una página que parece vacía pero finge ser normal. Evidence for this claim A page for a resource that does not exist should return an appropriate 404 or 410 status rather than a misleading 200. Scope: A useful search interface may remain available to users while nonexistent result resources use correct status handling. Confidence: high · Verified: Google: Soft 404 errors
- No intente resolver esto añadiendo una etiqueta «noindex» y bloqueando la página al mismo tiempo: si la bloquea, Google no puede leer la etiqueta, así que gana el bloqueo y la etiqueta no hace nada. Elija una (para esta tarea, la correcta es el bloqueo).
La única excepción que conviene conocer
A veces mucha gente busca en su sitio —y en Google— exactamente lo mismo, como
«barras de proteína sin gluten». Si esa frase tiene demanda real y repetida, no
intente posicionar su página /search?q= en bruto. En su lugar, cree para ella una
página de categoría o de aterrizaje real, con una dirección limpia, un título
adecuado y algo de texto útil. Esa sí es una página que merece posicionarse; la URL
de búsqueda en bruto, no.
¿Quiere la versión técnica: el razonamiento exacto de robots.txt frente a noindex, por qué los resultados vacíos necesitan un 404 real y cómo convertir los registros de búsqueda en páginas indexables? Cambie a la pestaña Avanzado.
TL;DR — La búsqueda interna en ecommerce son dos temas con un mismo nombre, y todo el juego consiste en no confundirlos. La funcionalidad es una superficie de conversión de alta intención cuyos registros de consultas son uno de los mejores insumos de investigación de palabras clave que usted posee. Las páginas de resultados (
/search?q=...) son un espacio casi infinito de URL escasas, casi duplicadas y a menudo vacías: Google las clasifica justo al lado de la navegación por facetas y los identificadores de sesión como una categoría principal de URL de poco valor añadido que «drenan la actividad de rastreo de páginas que sí tienen valor». La columna vertebral de precisión: para mantenerlas fuera del índice, robots.txt gana a noindex; Google es explícito: «no uses noindex, ya que Google seguirá solicitando la página, pero después la descartará… desperdiciando tiempo de rastreo», así que aplique disallow a la ruta de búsqueda para que los bots nunca gasten presupuesto en ella. Nunca combine un disallow de robots.txt con noindex en la misma URL: una página bloqueada no se puede leer, así que el noindex nunca se ve y la URL puede quedarse en el índice si está enlazada. Devuelva 404 reales para los conjuntos de resultados vacíos, no errores soft 404 («las páginas soft 404 se seguirán rastreando y desperdiciarán tu presupuesto»). Y cuando una consulta tenga demanda genuina y repetida, no indexe la URL de búsqueda en bruto: cree para ella una página de categoría o de aterrizaje adecuada.
Dos tareas que no se solapan
La razón por la que la búsqueda interna confunde a la gente es que el «SEO de la búsqueda interna en ecommerce» agrupa dos tareas que casi no tienen nada que ver entre sí:
- Hacer buena la experiencia de búsqueda. Relevancia, velocidad, tolerancia a erratas, sinónimos, merchandising, gestión de los casos sin resultados y —algo crítico— la explotación de los registros de consultas en busca de señales de demanda. Esto es trabajo de UX y CRO con un dividendo de SEO.
- Evitar que las URL de resultados de búsqueda le perjudiquen en la búsqueda orgánica. Impedir que desperdicien presupuesto de rastreo, inflen el índice y creen casi duplicados.
Optimice la tarea 1 de forma agresiva. Para la tarea 2, la postura por defecto es la contención, con una excepción deliberada (que se cubre más abajo). Casi toda la confusión en este tema viene de aplicar el entusiasmo de la tarea 1 («¡vamos a posicionar nuestras páginas de búsqueda!») a un espacio de URL que casi nunca lo merece.
Por qué las páginas de resultados de búsqueda son un pasivo de rastreo
Las URL de búsqueda interna son el ejemplo de manual del espacio de URL de poco valor añadido sobre el que advierte Google. En la publicación canónica de Google sobre presupuesto de rastreo, Gary Illyes enumera las categorías de URL que desperdician presupuesto de rastreo «en orden de importancia», y «Navegación por facetas e identificadores de sesión» encabeza la lista, seguida de «Contenido duplicado en el sitio» y «Páginas de error soft». Las páginas de resultados de búsqueda interna incurren en las tres a la vez:
- Espacio infinito y generado dinámicamente. Cada consulta distinta —incluidas erratas, bots y basura en la cadena de consulta— puede acuñar una URL nueva. Es la misma dinámica de explosión de parámetros que hace peligrosa la navegación por facetas.
- Contenido escaso y casi duplicado. Una búsqueda
?q=running-shoesy su categoría/shoes/running/pueden mostrar casi los mismos productos, de modo que la página de búsqueda compite con (y duplica) una página que sí quiere posicionar. - Páginas vacías o de error soft. Las páginas de «sin resultados» son de poco
valor por definición y, si devuelven
200 OK, son errores soft 404, algo que Google señala específicamente como desperdicio de rastreo.
El costo es exactamente el que describe Illyes: «Desperdiciar recursos del servidor en páginas como estas drenará la actividad de rastreo de páginas que sí tienen valor, lo que puede causar un retraso significativo en el descubrimiento de buen contenido en un sitio». En una tienda grande, las URL de búsqueda sin control pueden convertirse sin hacer ruido en uno de los mayores sumideros de rastreo que tiene.
Una advertencia sobre la escala, porque es fácil preocuparse de más: Google deja claro que el presupuesto de rastreo es sobre todo una preocupación de sitios grandes: «si tus páginas parecen rastrearse el mismo día en que se publican, no necesitas leer esta guía». A una tienda de Shopify con 500 productos no le van a limitar el rastreo por unas cuantas URL de búsqueda. Pero incluso en sitios pequeños, dejar que las páginas de búsqueda entren en el índice crea problemas de contenido duplicado o escaso y de inflado del índice que conviene prevenir con independencia del presupuesto de rastreo. La solución de contención es barata en cualquier caso.
robots.txt frente a noindex: hay que acertar en esto
Esta es la columna vertebral de precisión de todo el tema, y es lo que la mayoría de las tiendas entiende al revés. Tiene dos herramientas y hacen cosas distintas:
- El disallow de
robots.txtdetiene el rastreo. Los bots nunca solicitan la URL, así que nunca gastan presupuesto en ella. Esta es la herramienta correcta para los resultados de búsqueda interna, porque la cuestión es precisamente que esas URL no merecen ser solicitadas de entrada. noindexdetiene la indexación, pero solo después de que la página se haya rastreado: Googlebot tiene que solicitar la página para ver la etiqueta. Así quenoindexno hace nada por ahorrar presupuesto de rastreo. La guía de presupuesto de rastreo de Google es tajante: «No uses noindex, ya que Google seguirá solicitando la página, pero después la descartará cuando vea una metaetiqueta noindex o una cabecera en la respuesta HTTP, desperdiciando tiempo de rastreo».
Así que, para el objetivo estándar de «mantener las páginas de búsqueda fuera de Google
y fuera del calendario de rastreo», aplique disallow a la ruta de búsqueda en
robots.txt:
User-agent: *
Disallow: /search
Disallow: /*?q=
Disallow: /*?s=(Ajuste la ruta a la que use su plataforma: /search, ?q=, ?s=,
/catalogsearch/ en Magento, etc.)
El error crítico: nunca aplique disallow y noindex a la misma URL. Si una URL
está bloqueada en robots.txt, Googlebot no puede solicitarla, lo que significa que no
puede ver la etiqueta noindex que usted le puso. Evidence for this claim Google must crawl a page to see noindex, so a robots.txt block prevents Google from processing that page's noindex rule. Scope: Robots.txt controls crawling, while noindex controls indexing after retrieval. Confidence: high · Verified: Google: Block indexing with noindex Gana el bloqueo; la etiqueta es invisible. Y una
URL bloqueada por robots puede acabar igualmente indexada (como URL sin descripción)
si algo enlaza a ella, porque robots.txt controla el rastreo, no la indexación. Así
que:
- Objetivo: no desperdiciar rastreo en ellas ni posicionarlas → disallow en
robots.txt(el caso normal para las páginas de búsqueda). - Objetivo: ya están indexadas y necesita eliminarlas → permita temporalmente
el rastreo y sirva
noindexhasta que desaparezcan, y entonces puede aplicar disallow. No haga las dos cosas a la vez.
Resultados vacíos: 404 reales, no errores soft 404
Cuando una búsqueda no devuelve nada, lo incorrecto es servir una página 200 OK de
«sin resultados»: eso es un error soft 404, y Google advierte que «las páginas
soft 404 se seguirán rastreando y desperdiciarán tu presupuesto». Evidence for this claim Soft-404 pages can continue to consume crawl resources because they return a success response for missing content. Scope: Google may classify pages algorithmically based on content and response behavior. Confidence: high · Verified: Google: Large-site crawl budget Mejores opciones para una página sin resultados:
- Devolver un estado
404auténtico (o410) para que Google reciba «una señal potente de no volver a rastrear esa URL». - O servir una experiencia útil de «sin resultados» detrás de una URL que ya esté
bloqueada en
robots.txt: si los bots nunca rastrean/search, el código de estado de la página vacía es irrelevante para el presupuesto de rastreo, y puede centrar la página en recuperar al comprador (categorías sugeridas, productos populares, sugerencias ortográficas).
La UX y la solución de rastreo no están en tensión: bloquee la ruta de búsqueda para los bots y diseñe la página de cero resultados orientada a personas pensando únicamente en recuperar la conversión.
La única vez que sí quiere una página indexable
La contención es lo predeterminado, pero hay una oportunidad real de cola larga
escondida en sus registros de búsqueda, y el error es intentar capturarla indexando
URL /search?q= en bruto. No lo haga. En su lugar:
- Explote los registros de consultas. Sus consultas de búsqueda interna son una lista propia (first-party) de demanda expresada con las palabras de sus clientes, incluidos los huecos de catálogo («¿buscan cosas que yo no tengo?») y expresiones que quizá falten en los nombres de sus categorías.
- Valide la demanda externa. Contraste las consultas internas de mayor volumen con la demanda real de los motores de búsqueda usando una herramienta de palabras clave. Una frase que arrasa en su sitio y tiene volumen de búsqueda orgánica es una candidata.
- Cree una página adecuada para ella, no la URL de búsqueda. Cree una página de
categoría o colección real (o una página de aterrizaje curada) en una URL
estática y limpia (
/collections/gluten-free-protein-bars/), con un título descriptivo, un H1,BreadcrumbList, una o dos frases de texto realmente útil y enlaces internos. Esa es una página que merece indexarse y posicionarse; la URL de resultados de búsqueda en bruto, no.
Es la misma lógica de «bloquear el ruido, indexar la señal» de la navegación por facetas, salvo que con la búsqueda interna la señal casi nunca justifica indexar la propia URL de búsqueda. En su lugar, promueva la demanda a una página creada a propósito.
Dónde encaja esto
La búsqueda interna en ecommerce se solapa mucho con algunos temas vecinos. La
navegación por facetas es el pariente más cercano: los filtros y la búsqueda son
dos variantes del mismo problema de explosión de parámetros, y las directrices de
Google sobre navegación por facetas (robots.txt para bloquear, 404 para las
combinaciones vacías, la canónica como herramienta más débil a largo plazo) se
trasladan casi directamente a las URL de búsqueda. El SEO de páginas de categoría
es donde debería aterrizar la demanda de cola larga que encuentre en los registros de
búsqueda. Y el enfoque de eficiencia de rastreo —capacidad más demanda, URL de poco
valor añadido drenando presupuesto de las páginas reales— es el tema del presupuesto
de rastreo. La búsqueda interna es la pieza que convierte el cuadro de búsqueda de
su propia tienda de un pasivo de rastreo oculto en un activo de investigación de
palabras clave.
Resumen con IA
Una versión condensada de la variante Advanced:
- La búsqueda interna en ecommerce son dos temas en uno. La funcionalidad (el
cuadro de búsqueda del sitio) es una herramienta de conversión de alta intención y
una mina de oro propia para la investigación de palabras clave. Las páginas de
resultados (
/search?q=...) son un pasivo de SEO. No los confunda. - Las páginas de resultados son desperdicio de rastreo de manual. Google enumera «Navegación por facetas e identificadores de sesión» en primer lugar entre las categorías de URL de poco valor añadido; las URL de búsqueda interna son el mismo patrón infinito, escaso, casi duplicado y a menudo vacío, y «drenan la actividad de rastreo de páginas que sí tienen valor».
- robots.txt gana a noindex para esta tarea.
noindexsigue obligando a un rastreo antes de descartar la página («no uses noindex, ya que Google seguirá solicitando la página… desperdiciando tiempo de rastreo»), así que aplique disallow a la ruta de búsqueda en robots.txt para que los bots nunca la soliciten. - Nunca aplique disallow y noindex a la misma URL: una página bloqueada no se puede leer, así que el noindex nunca se ve, y una URL bloqueada a la que se enlaza puede indexarse igualmente como URL sin descripción.
- Resultados vacíos → 404 real, no error soft 404 («las páginas soft 404 se
seguirán rastreando y desperdiciarán tu presupuesto»); o sirva la experiencia de
cero resultados detrás de una ruta
/searchya bloqueada. - La excepción de cola larga: no indexe URL de búsqueda en bruto. Explote los registros de búsqueda para detectar demanda, valídela con volumen de búsqueda real y cree para las ganadoras una página de categoría o de aterrizaje adecuada en una URL estática limpia.
- Vecinos: navegación por facetas (el mismo problema de explosión de parámetros), SEO de páginas de categoría (donde debería aterrizar la demanda), presupuesto de rastreo (el marco de eficiencia).
Documentación oficial
Documentación de fuentes primarias. No existe un único documento de Google titulado «búsqueda interna del sitio»: las directrices están repartidas entre los documentos de presupuesto de rastreo, navegación por facetas y URL duplicadas, porque las páginas de resultados de búsqueda son una instancia del mismo problema de URL de poco valor.
Google — rastreo y presupuesto de rastreo
- Optimiza tu presupuesto de rastreo — la regla de robots.txt por encima de noindex, el desperdicio por errores soft 404,
404/410para las páginas eliminadas y quién tiene que preocuparse realmente por el presupuesto de rastreo. - Qué significa el presupuesto de rastreo para Googlebot — la lista de categorías de URL de poco valor añadido (navegación por facetas e identificadores de sesión en primer lugar) y por qué drenan rastreo de las páginas valiosas.
- Cómo gestionar el rastreo de las URL de navegación por facetas — el análogo más cercano a la búsqueda interna: robots.txt para bloquear, fragmentos de URL para evitar el impacto, la URL canónica como herramienta más débil a largo plazo y
404para las combinaciones vacías. (versión de infraestructura de rastreo.)
Google — indexación y duplicados
- Introducción a robots.txt — qué hace un
Disallow(bloquear el rastreo) y, sobre todo, qué no hace (retirar del índice). - Bloquear la indexación de búsqueda con noindex — la herramienta para retirar páginas del índice y el requisito de que la página sea rastreable para que la etiqueta se vea.
- Consolidar URL duplicadas — contexto de canonicalización para la vertiente de casi duplicados de los resultados de búsqueda.
Google — especialidad de ecommerce
- Diseñar una estructura de URL para sitios de ecommerce — minimizar las URL duplicadas y mantener los parámetros de sesión y de seguimiento fuera de los enlaces internos.
- Ayudar a Google a entender la estructura de tu sitio de ecommerce — el argumento a favor de páginas de categoría creadas a propósito (donde debería aterrizar la demanda de los registros de búsqueda) frente a las URL dinámicas.
Citas de la fuente
Declaraciones oficiales de Google. Cada enlace es un enlace profundo que salta al pasaje citado en la página de origen. No hay ninguna cita de Google que mencione específicamente la «búsqueda interna del sitio», así que el material siguiente son las directrices sobre la categoría de URL a la que pertenecen las páginas de resultados de búsqueda —desperdicio de presupuesto de rastreo, robots frente a noindex y errores soft 404—, que es exactamente lo que las gobierna.
Google — qué desperdicia presupuesto de rastreo
- “Faceted navigation and session identifiers / On-site duplicate content / Soft error pages / Hacked pages / Infinite spaces and proxies / Low quality and spam content” (traducción) «Navegación por facetas e identificadores de sesión / Contenido duplicado en el sitio / Páginas de error soft / Páginas hackeadas / Espacios infinitos y proxies / Contenido de baja calidad y spam»: Gary Illyes, sobre las categorías de URL de poco valor añadido «en orden de importancia». Las páginas de resultados de búsqueda interna son una instancia de las tres primeras. Ir a la cita
- “Wasting server resources on pages like these will drain crawl activity from pages that do actually have value, which may cause a significant delay in discovering great content on a site.” (traducción) «Desperdiciar recursos del servidor en páginas como estas drenará la actividad de rastreo de páginas que sí tienen valor, lo que puede causar un retraso significativo en el descubrimiento de buen contenido en un sitio»: Gary Illyes, Google. Ir a la cita
- “An increased crawl rate will not necessarily lead to better positions in Search results… while crawling is necessary for being in the results, it’s not a ranking signal.” (traducción) «Una mayor frecuencia de rastreo no llevará necesariamente a mejores posiciones en los resultados de búsqueda… aunque el rastreo es necesario para estar en los resultados, no es un factor de posicionamiento»: Gary Illyes, Google (es decir, que sus páginas de búsqueda se rastreen más no va a ayudar en nada). Ir a la cita
Google — robots.txt frente a noindex frente a error soft 404
- “Don’t use noindex, as Google will still request, but then drop the page when it sees a noindex meta tag or header in the HTTP response, wasting crawling time.” (traducción) «No uses noindex, ya que Google seguirá solicitando la página, pero después la descartará cuando vea una metaetiqueta noindex o una cabecera en la respuesta HTTP, desperdiciando tiempo de rastreo»: Google Search Central, sobre por qué robots.txt (y no noindex) es la herramienta para el presupuesto de rastreo. Ir a la cita
- “soft 404 pages will continue to be crawled, and waste your budget.” (traducción)
«Las páginas soft 404 se seguirán rastreando y desperdiciarán tu presupuesto»: Google Search
Central, sobre las páginas vacías o sin resultados que devuelven
200 OK. Ir a la cita - “Return a 404 or 410 status code for permanently removed pages… a 404 status code is a strong signal not to crawl that URL again.” (traducción) «Devuelve un código de estado 404 o 410 para las páginas eliminadas de forma permanente… un código de estado 404 es una señal potente de no volver a rastrear esa URL»: Google Search Central. Ir a la cita
Google — el presupuesto de rastreo importa sobre todo a gran escala
- “If your site doesn’t have a large number of pages that change rapidly, or if your pages seem to be crawled the same day that they are published, you don’t need to read this guide.” (traducción) «Si tu sitio no tiene un gran número de páginas que cambien rápidamente, o si tus páginas parecen rastrearse el mismo día en que se publican, no necesitas leer esta guía» Ir a la cita
¿Qué control aplicar a una URL de resultados de búsqueda?
Recorra la lista de arriba abajo y deténgase en la primera coincidencia.
1. ¿Es el caso estándar, resultados de búsqueda que nunca quiere que se rastreen ni se posicionen?
→ Aplique disallow en robots.txt a la ruta de búsqueda (/search, ?q=, ?s=, /catalogsearch/).
Los bots nunca la solicitan, así que nunca cuesta presupuesto de rastreo. No añada además noindex.
2. ¿Estas URL de búsqueda ya están indexadas y necesita sacarlas del índice?
→ No basta con aplicar disallow: una URL bloqueada por robots puede seguir indexada. En su lugar: permita
el rastreo temporalmente y sirva noindex (o use la Removals tool de GSC en los casos
urgentes) hasta que desaparezcan, y entonces aplique disallow para ahorrar rastreo futuro. Nunca haga ambas cosas a la vez.
3. ¿Una consulta concreta tiene demanda genuina y repetida (interna y externa)?
→ No indexe la URL de búsqueda. Cree una página de categoría, colección o aterrizaje
real en una URL estática limpia, con título, H1, BreadcrumbList y texto útil.
Promueva la demanda a una página creada a propósito; siga bloqueando la ruta de búsqueda en bruto.
4. ¿Qué debería devolver una búsqueda vacía o sin resultados?
→ Un 404 real (o sirva una página de «sin resultados» orientada a la conversión detrás de la
ruta /search ya bloqueada). Nunca una página 200 OK de «sin resultados» que sea rastreable:
eso es un error soft 404 y desperdicia presupuesto.
5. ¿Su tienda es pequeña (se rastrea el mismo día, muy por debajo de las seis cifras de URL)? → El presupuesto de rastreo probablemente no sea su problema, pero bloquee igualmente las URL de búsqueda para evitar contenido duplicado o escaso e inflado del índice. La solución es única y barata en cualquier caso.
Lista de comprobación de SEO para la búsqueda interna en ecommerce
Contener las páginas de resultados
- La ruta de resultados de búsqueda (
/search,?q=,?s=, el equivalente de su plataforma) está bloqueada enrobots.txt. - Las URL de resultados de búsqueda no llevan además una etiqueta
noindex(bloqueo + noindex en la misma URL anula el noindex). - Ningún enlace interno transmite autoridad hacia las URL de búsqueda (no deberían estar en su navegación, su sitemap ni sus etiquetas canónicas).
- Las URL de búsqueda no están en su sitemap XML.
- Cualquier URL de búsqueda que ya esté en el índice se está limpiando de la forma correcta (permitir el rastreo + noindex hasta que desaparezca, o la Removals tool de GSC en los casos urgentes), antes de aplicarle disallow.
Gestionar los resultados vacíos
- Las páginas sin resultados devuelven un
404real (no un error soft 404 con200 OK), o viven detrás de una ruta de búsqueda ya bloqueada. - La experiencia de cero resultados orientada a personas recupera al comprador (categorías sugeridas, productos populares, sugerencias ortográficas y de sinónimos).
Explotar la demanda
- Los registros de consultas de búsqueda interna se revisan con regularidad para detectar huecos de catálogo y las expresiones de los clientes.
- Las consultas internas de mayor volumen se contrastan con la demanda de búsqueda externa real.
- Las consultas ganadoras se convierten en páginas de categoría o de aterrizaje
creadas a propósito (URL estática limpia, título, H1,
BreadcrumbList, texto útil), no en URL de búsqueda indexadas.
Hacer buena la funcionalidad (UX/CRO)
- La búsqueda tolera erratas y sinónimos.
- La búsqueda es rápida y devuelve resultados relevantes.
- El merchandising o el boosting está configurado para las consultas clave en las que importa.
Los modelos mentales
1. Dos tareas, un solo nombre. El «SEO de la búsqueda interna en ecommerce» agrupa dos tareas sin relación entre sí: hacer buena la funcionalidad (UX, CRO, explotación de los registros de consultas) y evitar que las URL de resultados perjudiquen la búsqueda orgánica (contención). Optimice la primera de forma agresiva; contenga la segunda por defecto. Casi todos los errores en este tema consisten en aplicar el entusiasmo de la tarea 1 a un espacio de URL de la tarea 2.
2. Los resultados de búsqueda son un problema de navegación por facetas disfrazado.
Una URL ?q= es el mismo patrón infinito, escaso, casi duplicado y a veces vacío que
una faceta ?color=&size=. Se aplica el mismo instrumental: bloquear el ruido
(robots.txt), devolver 404 en las vacías, la canónica es el recurso más débil
y promover la demanda real a una página creada a propósito.
3. robots.txt y noindex no son intercambiables.
robots.txt = detener el rastreo (ahorra presupuesto, pero no puede retirar una URL
ya indexada). noindex = detener la indexación (retira la página, pero solo después
de un rastreo, así que no ahorra presupuesto, y es invisible si la URL está además
bloqueada). Elija la que se ajuste a su objetivo y nunca las apile en la misma URL.
4. La señal está en la caja, no en la URL. Lo valioso de la búsqueda interna no es la página de resultados: es la consulta. Trate el registro de búsqueda como un conjunto de datos propio de palabras clave. La URL se bloquea; la demanda que revela recibe una página real.
5. La escala fija lo que está en juego, no la solución. El presupuesto de rastreo es una preocupación de sitios grandes; el contenido duplicado o escaso y el inflado del índice, no. La solución de contención (bloquear las URL de búsqueda, devolver 404 en las vacías) es barata y correcta a cualquier tamaño, así que aplíquela sin importar lo grande que sea su tienda.
Formas de equivocarse con el SEO de la búsqueda interna
Aplicar disallow y noindex a la misma URL de búsqueda.
El error más común de todos. Si robots.txt bloquea la URL, Googlebot no puede
solicitarla, así que nunca ve la etiqueta noindex, y una URL bloqueada a la que se
enlaza puede seguir indexada como URL sin descripción. Use una herramienta por
objetivo, nunca las dos en la misma URL.
Recurrir a noindex para «ahorrar presupuesto de rastreo».
noindex no detiene el rastreo: Google sigue solicitando la página para ver la
etiqueta y luego la descarta, «desperdiciando tiempo de rastreo». Para el
presupuesto, la herramienta es robots.txt.
Servir páginas 200 OK de «sin resultados».
Una página de cero resultados rastreable que devuelve 200 es un error soft 404, que
Google sigue rastreando y contabiliza como desperdicio. Devuelva un 404 real o
coloque la experiencia sin resultados detrás de una ruta ya bloqueada.
Intentar posicionar URL /search?q= en bruto.
Incluso cuando una consulta tiene demanda real, la URL de búsqueda en bruto es escasa
y casi duplicada. La solución es una página de categoría o de aterrizaje creada a
propósito, no indexar la página de resultados de búsqueda.
Enlazar a URL de búsqueda desde su navegación, su sitemap o los widgets de «búsquedas populares».
Los chips de «búsquedas populares», los enlaces de autocompletado y las entradas de
sitemap que apuntan a /search?q= conducen a los rastreadores directamente al espacio
que intenta contener. Mantenga los enlaces internos apuntando a páginas reales de
categoría y de producto.
Dejar que los identificadores de sesión y los parámetros de seguimiento viajen en las URL de búsqueda.
/search?q=shoes&sessionid=…&utm_… multiplica la misma página escasa en muchas.
Mantenga los parámetros de sesión y de seguimiento fuera de los enlaces internos:
Google agrupa los identificadores de sesión con la navegación por facetas como el
principal desperdicio de rastreo.
Suponer que una tienda pequeña está exenta. Quizá no tenga un problema de presupuesto de rastreo, pero igualmente puede sufrir contenido duplicado o escaso e inflado del índice. Bloquee las URL de búsqueda sin importar el tamaño.
Búsqueda interna en ecommerce: hoja de referencia rápida
Qué hace cada control
| Control | ¿Detiene el rastreo? | ¿Detiene la indexación? | Úselo en páginas de búsqueda cuando… |
|---|---|---|---|
disallow de robots.txt | Sí | No (las URL enlazadas pueden persistir) | El caso normal: nunca quiere que se rastreen ni se posicionen |
noindex (rastreable) | No | Sí | Está limpiando del índice URL de búsqueda ya indexadas |
robots.txt + noindex juntos | — | Roto | Nunca: el bloqueo oculta la etiqueta noindex |
404 / 410 real | Señala «no volver a rastrear» | Retira del índice | Páginas vacías o sin resultados |
rel=canonical | No | Consolida (solo una indicación) | Recurso débil; no es la herramienta principal aquí |
Consulta → acción
| Situación | Acción |
|---|---|
| URL estándar de resultados de búsqueda | Bloquear en robots.txt |
| URL de búsqueda ya indexada que hay que eliminar | Permitir el rastreo + noindex hasta que desaparezca, y entonces bloquear |
| Consulta con demanda real y repetida | Crear una página de categoría o de aterrizaje en una URL limpia; no indexar ?q= |
| Búsqueda vacía o sin resultados | 404 real (o experiencia sin resultados detrás de una ruta bloqueada) |
| Parámetros de sesión o de seguimiento en las URL de búsqueda | Mantenerlos fuera de los enlaces internos; bloquear el patrón |
Datos rápidos
- Categoría n.º 1 de desperdicio de rastreo según Google: navegación por facetas e identificadores de sesión; las páginas de resultados de búsqueda son el mismo patrón.
noindexno ahorra presupuesto de rastreo: Google solicita la página primero.- Los errores soft 404 (
200 OKcon «sin resultados») se siguen rastreando y desperdician presupuesto. - El presupuesto de rastreo es sobre todo una preocupación de sitios grandes; el inflado del índice y la duplicación, no.
- El resultado valioso de la búsqueda interna es el registro de consultas, no la URL de resultados.
Herramientas para el SEO de la búsqueda interna en ecommerce
- Google Analytics 4 — búsqueda en el sitio: el informe de términos de búsqueda de GA4 captura lo que los compradores escriben en la búsqueda interna de su sitio (configure el parámetro de consulta de búsqueda en el flujo de datos). Esta es su fuente principal de datos de demanda interna para la fase de explotación de consultas.
- La analítica de búsqueda interna de su plataforma: la analítica de búsqueda de Shopify, los paneles de Algolia / Klevu / Searchspring o el informe de términos de búsqueda de Magento, para las consultas sin resultados, las consultas principales y los clics, que le dicen tanto qué construir como dónde falla la UX de búsqueda.
- Google Search Console — Page Indexing report: vigile los grupos de excluidas por si se acumulan URL de búsqueda o con parámetros; eso indica que su contención tiene fugas.
- GSC — Crawl Stats: compruebe si Googlebot está dedicando tiempo a URL
/searcho?q=. - GSC — URL Inspection / Removals: confirme cómo se trata una URL de búsqueda y use Removals para limpiar con urgencia páginas de búsqueda ya indexadas.
- Screaming Frog SEO Spider / Ahrefs Site Audit: rastree la tienda para encontrar
URL de búsqueda enlazadas internamente, incluidas en el sitemap o que devuelven
200con resultados vacíos, además de los patrones de error soft 404 y de casi duplicados. - Una herramienta de investigación de palabras clave (por ejemplo, Ahrefs Keywords Explorer): para validar que una consulta interna de alto volumen también tiene demanda de búsqueda externa real antes de crear una página para ella.
Problemas habituales de SEO en la búsqueda interna
Las URL de búsqueda siguen indexadas tras un bloqueo en robots.txt
Causa probable: robots.txt impide el rastreo, pero no garantiza la desindexación, así que Google
no puede ver un noindex en la página bloqueada. Solución: permita temporalmente el rastreo y sirva
noindex hasta que las URL desaparezcan, y después aplique disallow al patrón para evitar futuro desperdicio de rastreo.
Confírmelo con URL Inspection en lugar de solo con una consulta site:.
Las búsquedas sin resultados aparecen como errores soft 404
Causa probable: la plantilla devuelve 200 OK incluso cuando no existe ningún producto. Solución: devuelva
un 404 real o mantenga la experiencia de recuperación orientada a personas detrás de una ruta de búsqueda ya
bloqueada al rastreo. Confirme el estado HTTP por separado del mensaje visible.
Googlebot sigue rastreando nuevas combinaciones de consultas
Causa probable: formularios, enlaces internos, parámetros o variantes de ruta inconsistentes exponen un espacio de URL mayor que el que cubre la regla de robots. Solución: inventaríe los patrones reales de URL de búsqueda a partir de los registros, elimine los enlaces rastreables que apuntan a ellos y actualice las reglas de disallow con pruebas acotadas. Confirme que las URL valiosas de producto y de categoría siguen permitidas.
Una página de aterrizaje promovida compite con su antigua URL de búsqueda
Causa probable: el resultado de búsqueda en bruto sigue siendo rastreable o enlazado internamente después de lanzar la página curada. Solución: apunte la navegación y los enlaces contextuales a la página de aterrizaje limpia, mantenga controlado el espacio de búsqueda en bruto y verifique que la página de aterrizaje es autocanónica.
Ejemplos simplificados de búsqueda interna
Contención del rastreo sin una directiva en conflicto
User-facing search: /search?q=waterproof-boots
robots.txt: Disallow: /search
page-level noindex: not relied on while the path is blocked
XML sitemap: search URL omittedEl bloqueo aborda el rastreo futuro. Si la URL ya está indexada, permita primero que la página
se rastree con noindex; aplíquele disallow solo después de su retirada.
Promover la demanda a una página real
Before: /search?q=gluten-free-protein-bars
After: /collections/gluten-free-protein-bars/La colección limpia recibe un título estable, un H1, texto útil, breadcrumbs, productos curados y enlaces internos. La URL de búsqueda en bruto sigue formando parte del espacio de búsqueda no indexable.
Prompts para el análisis de la búsqueda interna
Clasificar las consultas internas en acciones
Pegue un CSV con la consulta, el número de búsquedas, el número de resultados y las conversiones. Elimine los datos personales antes de compartirlo con cualquier modelo.
You are reviewing ecommerce internal-search demand. For each supplied query, classify it
as: synonym/merchandising fix, zero-result inventory gap, possible curated landing page,
navigation problem, or noise. Explain the evidence from the supplied columns only. Do not
invent external search volume. Return a table and a separate list of items that require
external keyword validation before an indexable page is created.Auditar los controles de las URL de búsqueda
Pegue URL de búsqueda representativas, el robots.txt, las cabeceras de respuesta y la sección head del HTML correspondiente.
Audit these internal-search URLs for crawl and index-control conflicts. For each URL,
report: robots.txt access, HTTP status, meta or X-Robots-Tag directive, canonical target,
internal-link source, and sitemap presence. Flag robots.txt + noindex conflicts and
200-status zero-result pages. Do not infer any value that is absent from the input. Scripts para encontrar URL de búsqueda expuestas
Comprobar la respuesta de una URL representativa y el archivo robots
curl -I 'https://www.example.com/search?q=test'
curl -sS 'https://www.example.com/robots.txt'El primer comando confirma el estado HTTP real; el segundo le permite comparar la ruta exacta con las reglas desplegadas. Sustitúyalo por un sitio que usted controle.
Encontrar enlaces de búsqueda en la página renderizada actual
Ejecute esto en la consola de DevTools en una página representativa de categoría o de navegación:
[...document.querySelectorAll('a[href]')]
.map(a => a.href)
.filter(href => /(?:\/search(?:\/|\?|$)|[?&](?:q|query|s)=)/i.test(href));Cualquier resultado merece revisión, porque unos enlaces rastreables corrientes pueden exponer el espacio de URL de búsqueda incluso cuando la funcionalidad empieza siendo un formulario.
Contar las solicitudes a la ruta de búsqueda en un extracto del log de acceso
awk '$7 ~ /^\/search([/?]|$)/ {print $7}' access.log | sort | uniq -c | sort -nrAjuste el campo de la ruta de la solicitud a su formato de log. Esto revela las variantes realmente rastreadas; no distingue bots salvo que la entrada ya se haya filtrado adecuadamente.
Demuestre que los controles de búsqueda funcionan
Prueba de control de rastreo
Prueba a ejecutar: pruebe URL de búsqueda representativas y URL de categoría valiosas en el robots.txt Tester. Resultado esperado: los patrones de búsqueda quedan bloqueados mientras las rutas de producto y de categoría siguen permitidas. Interpretación del fallo: la regla es demasiado estrecha, demasiado amplia o no coincide con los patrones de URL desplegados. Ventana de seguimiento: inmediata tras el despliegue del robots.txt. Disparador de reversión: URL legítimas del catálogo quedan bloqueadas.
Prueba del estado en búsquedas sin resultados
Prueba a ejecutar: solicite una consulta con cero resultados conocida usando curl -I. Resultado esperado: un
404 real cuando la URL es rastreable, o la confirmación de que toda la ruta de búsqueda ya está
bloqueada. Interpretación del fallo: una plantilla de cero resultados rastreable con 200 supone un riesgo de
error soft. Ventana de seguimiento: inmediata tras la publicación de la plantilla. Disparador de reversión: búsquedas
válidas o páginas de producto empiezan a devolver estados de error.
Prueba de la página de aterrizaje promovida
Prueba a ejecutar: inspeccione la nueva URL curada, su canónica, sus enlaces internos y el equivalente de
búsqueda en bruto. Resultado esperado: la página curada devuelve 200, es autocanónica
y recibe enlaces rastreables mientras el espacio de búsqueda en bruto sigue controlado. Interpretación
del fallo: los dos tipos de URL están compitiendo o la nueva página está huérfana. Ventana de
seguimiento: comprobaciones técnicas inmediatas seguidas de seguimiento en Search Console tras el nuevo rastreo.
Disparador de reversión: la publicación expone un espacio de URL de consulta sin controlar.
Métricas permanentes de búsqueda interna
Cuota de rastreo de las URL de búsqueda
Métrica: proporción de solicitudes verificadas de motores de búsqueda que van a URL de búsqueda interna. Qué le dice: si el espacio de URL controlado sigue consumiendo actividad de rastreo. Cómo obtenerla: logs del servidor con bots verificados, agrupados por ruta y patrón de parámetros. Referencia / rango realista: establezca una línea base previa al cambio y reduzca las solicitudes evitables a URL de búsqueda sin suprimir el rastreo valioso del catálogo. Cadencia: semanal tras los cambios, y después mensual.
Tasa de consultas sin resultados
Métrica: búsquedas internas que no devuelven ningún producto como proporción de todas las búsquedas internas. Qué le dice: dónde los sinónimos, el merchandising, la navegación o el inventario fallan a los compradores. Cómo obtenerla: analítica de búsqueda interna segmentada por consulta normalizada. Referencia / rango realista: compare categorías y observe la tendencia frente a la línea base de la propia tienda; la mezcla de catálogo hace engañoso cualquier objetivo universal. Cadencia: semanal para merchandising y mensual para la planificación de SEO y contenidos.
Conversión asistida por la búsqueda
Métrica: tasa de conversión e ingresos de las sesiones que usan la búsqueda interna, manteniendo visibles los grupos de consultas. Qué le dice: si la funcionalidad ayuda a los compradores a encontrar productos en lugar de limitarse a generar URL. Cómo obtenerla: eventos de analítica cruzados con las transacciones. Referencia / rango realista: use las sesiones sin búsqueda y los periodos anteriores como contexto, no como prueba de causalidad. Cadencia: mensual y tras los cambios de relevancia.
Demanda promovida a páginas duraderas
Métrica: temas de consultas internas validados que se han convertido en páginas curadas, más las impresiones orgánicas y las conversiones de esas páginas. Qué le dice: si la demanda propia se está convirtiendo en inventario indexable útil. Cómo obtenerla: mantenga una lista de lanzamientos y crúcela con Search Console y la analítica. Referencia / rango realista: evalúe cada página frente a su caso de demanda documentado. Cadencia: trimestral.
Recursos que merecen su tiempo
Mis artículos relacionados
- Guía para principiantes de SEO técnico — dónde encajan el presupuesto de rastreo, la indexación y el control de las URL duplicadas en el panorama general.
- Navegación por facetas: guía para expertos en SEO — el tema hermano más cercano; la misma lógica de bloquear el ruido que gobierna las URL de búsqueda interna.
- Presupuesto de rastreo: todo lo que necesitas saber sobre SEO — por qué los espacios de URL de poco valor, como los resultados de búsqueda, drenan rastreo de las páginas reales, y a quién le tiene que importar realmente.
- Robots.txt y SEO: todo lo que necesitas saber — la herramienta que usará para contener las páginas de resultados de búsqueda, y la distinción entre rastreo e indexación que la hace funcionar.
Mis ponencias
- Cómo funciona la búsqueda (SlideShare) — mi recorrido por el rastreo, el renderizado, la indexación y el posicionamiento, que es el modelo mental que hay detrás de tratar las URL de búsqueda como desperdicio de rastreo. (Se aplica mi advertencia habitual: «Esta es mi comprensión de los sistemas… no va a ser 100 % completa ni exacta»).
Del sector
- Qué significa el presupuesto de rastreo para Googlebot (Google Search Central) — la lista de referencia de Gary Illyes de categorías de URL de poco valor añadido a la que pertenecen las páginas de resultados de búsqueda.
- Optimiza tu presupuesto de rastreo (Google Search Central) — la regla de robots.txt por encima de noindex y la advertencia sobre el desperdicio de rastreo por errores soft 404.
- Cómo gestionar el rastreo de las URL de navegación por facetas (Google Search Central) — el manual de navegación por facetas que se traslada directamente a las URL de búsqueda interna (robots.txt para bloquear,
404para los resultados vacíos, la URL canónica como herramienta más débil). - Los mayores problemas de rastreo de Google (Search Engine Land) — el desglose de Gary Illyes sobre qué causa realmente el exceso de rastreo, con la navegación por facetas en aproximadamente la mitad de todos los problemas reportados.
- Gary Illyes de Google sigue advirtiendo sobre los problemas de parámetros de URL (Search Engine Journal) — la advertencia de la explosión del espacio de URL, de «1000 URL a un abrasador 1 millón», que se aplica igual a los parámetros de búsqueda.
Ponga a prueba sus conocimientos: Ecommerce Site Search SEO
Cinco preguntas rápidas sobre cómo interactúan las páginas de resultados de búsqueda interna con el SEO. Elija una respuesta para cada una y compruébelas.
Registro de cambios
Actualizado el 8 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.