SEO de um pesquisa interna em comércio eletrônico
Como aprovechar as consultas do buscador de uma loja para conversão e conteúdos sem permitir que seus páginas de resultados agoten o rastreo, e quando convertir uma demanda recurrente em uma página de destino indexable.
Idiomas
1 sinal de evidência nesta página
- Ferramenta relacionada ativarobots.txt Tester
UM pesquisa interna de uma loja tem dos caras. O cuadro de pesquisa concentra intenção de compra e seus registros revelan oportunidades de conteúdo; as URL de resultados, como /pesquisa?q=..., podem formar um espacio casi infinito de páginas escasas, duplicadas ou vacías. para evitar que consuman rastreo, bloquea o patrón adecuado em robots.txt em vez de confiar somente em noindex, e não combines disallow com uma directiva noindex que o robot já não podrá leer. Os resultados vacíos devem retornar errores HTTP 404s reais, não soft 404s. Se uma consulta demuestra demanda genuina e repetida, cria uma categoria ou página de destino estable: não indexes diretamente um URL interna de pesquisa.
TL;DR — Seu loja tem um cuadro de pesquisa e, em realidade, são dos temas de SEO distintos. UM caja em sí é excelente: quienes um usam suelen estar cerca de comprar, e o que escriben é uma lista gratuita de o que seus clientes realmente quieren. As páginas que cria essa caja (as direcções web do tipo
/search?q=running-shoes) são problema: têm poco conteúdo, se repiten entre sí e pode haber um número interminable de elas. UM tarea principal é manter essas direcções web de resultados de pesquisa fuera de Google e, ao mesmo tempo, seguir aprovechando o cuadro de pesquisa —e todo o que os compradores escriben em él— um seu favor.
O que significa aqui «pesquisa interna do site»
Há dos tipos de «pesquisa» que suelen enredarse, assim que conviene separarlos:
- Pesquisa em Google (ou Bing): o mecanismo de busca que está em um web e que envia gente para seu loja.
- Pesquisa interna do site: o pequeño cuadro de pesquisa que está em seu loja e que permite um comprador explorar seus propios produtos.
esta página trata do segundo caso. Quando um comprador escribe «botas impermeables»
em o cuadro de pesquisa de seu loja, um mayoría de os sites criam uma nova
direcção web para essa página de resultados, algo como
yourstore.com/search?q=waterproof-boots. Essa é um parte que importa para o SEO.
por o que o cuadro de pesquisa é bueno
Quienes usam seu cuadro de pesquisa suelen ir mas em serio que quienes somente navegan: lhe han dicho exactamente o que quieren. Dos ventajas:
- Convierte. Um cuadro de pesquisa rápido e preciso que tolera erratas e sinónimos («trainers» = «sneakers») ajuda um gente um encontrar e comprar cosas.
- É uma lista gratuita de palavras-chave. cada frase que um gente escribe é um cliente real diciéndole, com seus propias palabras, o que está buscando. Eso é oro para decidir o que produtos ter em stock, sobre o que escribir e o que categorias criar.
por o que as páginas de resultados de pesquisa são um problema
Aqui está o inconveniente. Essas páginas /search?q=... podem causar, sem fazer
ruido, tres dolores de cabeza:
- Há variações interminables. UM gente escribe millones de cosas distintas —incluidas erratas e texto sem sentido— e cada uma pode criar seu própria direcção web.
- Têm poco conteúdo e são repetitivas. Uma pesquisa de «zapatos rojos» e uma página de categoria de zapatos rojos podem mostrar casi os mismos produtos, assim que Google ve casi duplicados.
- Algumas estão vacías. Uma pesquisa de algo que você não vende retorna uma página que dice «sem resultados». Essa é uma página de poco valor que não quiere ter em Google.
Google tem limited tempo para rastrear seu site, e isso iria rather spend que tempo em seu real produto e categoria páginas than em um swamp de search-result URLs. So o standard advice é: mantenha internal resultados de pesquisa páginas out de Google.
Evidence for this claim Low-value, dynamically generated URL spaces can waste crawl resources better spent on useful pages. Scope: Crawl-budget impact is most material on large or rapidly changing sites. Confidence: high · Verified: Google: Large-site crawl budgetUM solução sencilla
- Tell mecanismos de busca não para rastrear seu resultados de pesquisa páginas usando seu
robots.txtarquivo (geralmente um line — seu developer ou plataforma pode set este). - Faça sure um pesquisa que encontra nothing returns um proper “não encontrado” resposta, não um página que looks empty mas pretends para ser normal. Evidence for this claim A page for a resource that does not exist should return an appropriate 404 or 410 status rather than a misleading 200. Scope: A useful search interface may remain available to users while nonexistent result resources use correct status handling. Confidence: high · Verified: Google: Soft 404 errors
- Do não try para solve este por adding um “noíndice” tag e blocking o página em o mesmo tempo — se você block isso, Google não pode read o tag, so o block wins e o tag faz nothing. Pick um (para este job, o block é o right um).
UM única excepção que conviene conocer
UM veces muita gente busca em seu site —e em Google— exactamente o mesmo, como
«barras de proteína sem gluten». Se essa frase tem demanda real e repetida, não
intente posicionar seu página /search?q= em bruto. Em seu lugar, cree para ella uma
página de categoria ou de aterrizagem real, com uma direcção limpia, um título
adecuado e algo de texto útil. Essa sí é uma página que merece posicionarse; um URL
de pesquisa em bruto, não.
¿Quiere um versión técnica: o razonamiento exacto de robots.txt frente um noindex, por o que os resultados vacíos precisam um 404 real e como convertir os registros de pesquisa em páginas indexables? Cambie um pestaña Avanzado.
TL;DR — UM pesquisa interna em comércio eletrônico são dos temas com um mesmo nome, e todo o juego consiste em não confundirlos. UM funcionalidade é uma superficie de conversão de alta intenção cuyos registros de consultas são uno de os mejores insumos de investigação de palavras-chave que você posee. As páginas de resultados (
/search?q=...) são um espacio casi infinito de URL escasas, casi duplicadas e um menudo vacías: Google as clasifica justo ao lado de um navegação por facetas e os identificadores de sesión como uma categoria principal de URL de poco valor añadido que «drenan um actividade de rastreo de páginas que sí têm valor». UM columna vertebral de precisión: para mantenerlas fuera do índice, robots.txt gana um noindex; Google é explícito: «não usa noindex, porque Google seguirá solicitando um página, mas depois um descartará… desperdiciando tempo de rastreo», assim que aplique disallow um ruta de pesquisa para que os bots nunca gasten presupuesto em ella. nunca combine um disallow de robots.txt com noindex em um mesma URL: uma página bloqueada não é possível leer, assim que o noindex nunca se ve e um URL pode quedarse em o índice se está enlazada. Devuelva 404 reais para os conjuntos de resultados vacíos, não errores soft 404 («as páginas soft 404 se seguirán rastreando e desperdiciarán seu presupuesto»). E quando uma consulta tenha demanda genuina e repetida, não indexe um URL de pesquisa em bruto: cree para ella uma página de categoria ou de aterrizagem adecuada.
Dos tareas que não se solapan
UM razón por um que um pesquisa interna confunde um gente é que o «SEO de um pesquisa interna em comércio eletrônico» agrupa dos tareas que casi não têm nada que ver entre sí:
- Fazer buena um experiencia de pesquisa. Relevancia, velocidade, tolerancia um erratas, sinónimos, merchandising, gestión de os casos sem resultados e —algo crítico— um explotação de os registros de consultas em busca de sinais de demanda. Esto é trabajo de UX e CRO com um dividendo de SEO.
- Evitar que as URL de resultados de pesquisa lhe perjudiquen em um pesquisa orgánica. Impedir que desperdicien presupuesto de rastreo, inflen o índice e creen casi duplicados.
Optimice um tarea 1 de forma agresiva. para um tarea 2, um postura por defecto é um contenção, com uma excepção deliberada (que se cubre mas abajo). Casi toda um confusión em este tema viene de aplicar o entusiasmo de um tarea 1 («¡vamos um posicionar nuestras páginas de pesquisa!») um espacio de URL que casi nunca o merece.
por o que as páginas de resultados de pesquisa são um pasivo de rastreo
As URL de pesquisa interna são exemplo de manual do espacio de URL de poco valor añadido sobre o que advierte Google. Em um publicação canónica de Google sobre presupuesto de rastreo, Gary Illyes enumera as categorias de URL que desperdician presupuesto de rastreo «em orden de importancia», e «Navegação por facetas e identificadores de sesión» encabeza um lista, seguida de «Conteúdo duplicado em o site» e «páginas de error soft». As páginas de resultados de pesquisa interna incurren em as tres um vez:
- Infinite, dynamically gerado space. cada distinct query — including typos, bots, e query-string junk — pode mint um novo URL. isto é o mesmo parameter-explosion dynamic que faz faceted navegação dangerous.
- Thin, near-duplicate conteúdo. um
?q=running-shoespesquisa e seu/shoes/running/categoria pode surface ala maioria o mesmo produtos, so o pesquisa página competes com (e duplicates) um página você na prática quer para ranquear. - Empty / soft-error páginas. “não resultados” páginas são low-value por definition, e
se eles return
200 OKthey’re soft 404s — qual Google especificamente flags as rastrear waste.
O costo é exactamente o que describe Illyes: «Desperdiciar recursos do servidor em páginas como estas drenará um actividade de rastreo de páginas que sí têm valor, o que pode causar um retraso significativo em o descoberta de buen conteúdo em um site». Em uma loja grande, as URL de pesquisa sem control podem convertirse sem fazer ruido em uno de os mayores sumideros de rastreo que tem.
Uma advertencia sobre um escala, porque é fácil preocuparse de mas: Google deja claro que o presupuesto de rastreo é sobre todo uma preocupação de sites grandes: «se seus páginas parecen rastrearse o mesmo dia em que se publican, você não precisa leer esta guía». UM uma loja de Shopify com 500 produtos não lhe van um limitar o rastreo por algumas cuantas URL de pesquisa. Mas incluso em sites pequeños, dejar que as páginas de pesquisa entren em o índice cria problemas de conteúdo duplicado ou escaso e de inflado do índice que conviene prevenir com independencia do presupuesto de rastreo. UM solução de contenção é barata em qualquer caso.
robots.txt frente um noindex: há que acertar em esto
esta é um columna vertebral de precisión de todo o tema, e é o que um mayoría de as lojas entiende ao revés. Tem dos ferramentas e fazem cosas distintas:
- O disallow de
robots.txtdetiene o rastreo. Os bots nunca solicitan um URL, assim que nunca gastan presupuesto em ella. esta é um ferramenta correcta para os resultados de pesquisa interna, porque um cuestión é precisamente que essas URL não merecen ser solicitadas de entrada. noindexdetiene um indexação, mas somente depois de que um página se haya rastreado: Googlebot tem que solicitar um página para ver um etiqueta. Assim quenoindexnão faz nada por ahorrar presupuesto de rastreo. UM guía de presupuesto de rastreo de Google é tajante: «Não usa noindex, porque Google seguirá solicitando um página, mas depois um descartará quando vea uma metaetiqueta noindex ou uma cabecera em um resposta HTTP, desperdiciando tempo de “Don’t use noindex, as Google will still request)”*
(tradução) «não use noindex, pois o Google ainda solicitará a página»
rastreo».
Assim que, para o objetivo estándar de «manter as páginas de pesquisa fuera de Google
e fuera do calendario de rastreo», aplique disallow um ruta de pesquisa em
robots.txt:
User-agent: *
Disallow: /search
Disallow: /*?q=
Disallow: /*?s=(Ajuste um ruta um que use seu plataforma: /search, ?q=, ?s=,
/catalogsearch/ em Magento, etc.)
o critical mistake: nunca disallow e noíndice o mesmo URL. se um URL é
blocked em robots.txt, Googlebot não pode fetch isso, qual significa isso não pode see o
noindex tag você put em isso. Evidence for this claim Google must crawl a page to see noindex, so a robots.txt block prevents Google from processing that page's noindex rule. Scope: Robots.txt controls crawling, while noindex controls indexing after retrieval. Confidence: high · Verified: Google: Block indexing with noindex o block wins; o tag é invisible. e um
robots-blocked URL pode ainda end up indexado (as um simples URL, não snippet) se algo
links para isso — porque robots.txt controls rastreamento, não indexação. So:
- objetivo: não desperdiciar rastreo em elas nem posicionarlas → disallow em
robots.txt(o caso normal para as páginas de pesquisa). - objetivo: já estão indexadas e precisa eliminarlas → permita temporalmente
o rastreo e sirva
noindexaté que desaparezcan, e então pode aplicar disallow. Não haga as dos cosas um vez.
Empty resultados: real 404s, não soft 404s
Quando um pesquisa returns nothing, o wrong move é para serve um 200 OK “não resultados”
página — isso é um soft 404, e Google warns “soft 404 páginas vai continue para ser
rastreado, e waste seu budget.” Evidence for this claim Soft-404 pages can continue to consume crawl resources because they return a success response for missing content. Scope: Google may classify pages algorithmically based on content and response behavior. Confidence: high · Verified: Google: Large-site crawl budget Better opções para um zero-results página:
- Retornar um estado
404auténtico (ou410) para que Google reciba «uma sinal potente de não volver um rastrear essa URL». - OU servir uma experiencia útil de «sem resultados» detrás de uma URL que já esté
bloqueada em
robots.txt: se os bots nunca rastrean/search, o código de estado de um página vacía é irrelevante para o presupuesto de rastreo, e pode centrar um página em recuperar ao comprador (categorias sugeridas, produtos populares, sugerencias ortográficas).
UM UX e um solução de rastreo não estão em tensión: bloquee um ruta de pesquisa para os bots e diseñe um página de cero resultados orientada um personas pensando somente em recuperar um conversão.
UM única vez que sí quiere uma página indexable
UM contenção é o predeterminado, mas há uma oportunidade real de cola larga
escondida em seus registros de pesquisa, e o error é intentar capturarla indexando
URL /search?q= em bruto. Não haga. Em seu lugar:
- Explote os registros de consultas. Seus consultas de pesquisa interna são uma lista própria (first-party) de demanda expresada com as palabras de seus clientes, incluidos os huecos de catálogo («¿buscan cosas que eu não tengo?») e expresiones que talvez falten em os nomes de seus categorias.
- Valide um demanda externa. Contraste as consultas internas de mayor volumen com um demanda real de os mecanismos de busca usando uma ferramenta de palabras clave. Uma frase que arrasa em seu site e tem volumen de pesquisa orgánica é uma candidata.
- Cree uma página adecuada para ella, não um URL de pesquisa. Cree uma página de
categoria ou colecção real (ou uma página de aterrizagem curada) em uma URL
estática e limpia (
/collections/gluten-free-protein-bars/), com um título descriptivo, um H1,BreadcrumbList, uma ou dos frases de texto realmente útil e links internos. Essa é uma página que merece indexarse e posicionarse; um URL de resultados de pesquisa em bruto, não.
É um mesma lógica de «bloquear o ruido, indexar um sinal» de um navegação por facetas, salvo que com um pesquisa interna um sinal casi nunca justifica indexar um própria URL de pesquisa. Em seu lugar, promueva um demanda um uma página creada um propósito.
Onde encaja esto
UM pesquisa interna em comércio eletrônico se solapa muito com alguns temas vecinos. UM
navegação por facetas é o pariente mas cercano: os filtros e um pesquisa são
dos variantes do mesmo problema de explosión de parámetros, e as directrices de
Google sobre navegação por facetas (robots.txt para bloquear, 404 para as
combinações vacías, um canónica como ferramenta mas débil um largo plazo) se
trasladan casi diretamente um as URL de pesquisa. O SEO de páginas de categoria
é onde deveria aterrizar um demanda de cola larga que encuentre em os registros de
pesquisa. E o enfoque de eficiencia de rastreo —capacidade mas demanda, URL de poco
valor añadido drenando presupuesto de as páginas reais— é o tema do presupuesto
de rastreo. UM pesquisa interna é um pieza que convierte o cuadro de pesquisa de
seu própria loja de um pasivo de rastreo oculto em um activo de investigação de
palavras-chave.
Resumen com IA
Uma versión condensada de um variante Advanced:
- UM pesquisa interna em comércio eletrônico são dos temas em uno. UM funcionalidade (o
cuadro de pesquisa do site) é uma ferramenta de conversão de alta intenção e
uma mina de oro própria para um investigação de palavras-chave. As páginas de
resultados (
/search?q=...) são um pasivo de SEO. Não os confunda. - As páginas de resultados são desperdicio de rastreo de manual. Google enumera «Navegação por facetas e identificadores de sesión» em primer lugar entre as categorias de URL de poco valor añadido; as URL de pesquisa interna são mesmo patrón infinito, escaso, casi duplicado e um menudo vacío, e «drenan um actividade de rastreo de páginas que sí têm valor».
- robots.txt gana um noindex para esta tarea.
noindexsigue obligando um rastreo antes de descartar um página («não usa noindex, porque Google seguirá solicitando um página… desperdiciando tempo de rastreo»), assim que aplique disallow um ruta de pesquisa em robots.txt para que os bots nunca um soliciten. - nunca aplique disallow e noindex um mesma URL: uma página bloqueada não se pode leer, assim que o noindex nunca se ve, e uma URL bloqueada um que se enlaza pode indexarse igualmente como URL sem descrição.
- Resultados vacíos → 404 real, não error soft 404 («as páginas soft 404 se
seguirán rastreando e desperdiciarán seu presupuesto»); ou sirva um experiencia de
cero resultados detrás de uma ruta
/searchjá bloqueada. - UM excepção de cola larga: não indexe URL de pesquisa em bruto. Explote os registros de pesquisa para detectar demanda, valídela com volumen de pesquisa real e cree para as ganadoras uma página de categoria ou de aterrizagem adecuada em uma URL estática limpia.
- Vecinos: navegação por facetas (o mesmo problema de explosión de parámetros), SEO de páginas de categoria (onde deveria aterrizar um demanda), presupuesto de rastreo (o marco de eficiencia).
Documentação oficial
Documentação de fuentes primarias. Não existe um único documento de Google titulado «pesquisa interna do site»: as directrices estão repartidas entre os documentos de presupuesto de rastreo, navegação por facetas e URL duplicadas, porque as páginas de resultados de pesquisa são uma instancia do mesmo problema de URL de poco valor.
Google — rastreo e presupuesto de rastreo
- Optimiza seu presupuesto de rastreo — um regra de robots.txt por encima de noindex, o desperdicio por errores soft 404,
404/410para as páginas eliminadas e quem tem que preocuparse realmente por o presupuesto de rastreo. - O que significa o presupuesto de rastreo para Googlebot — um lista de categorias de URL de poco valor añadido (navegação por facetas e identificadores de sesión em primer lugar) e por o que drenan rastreo de as páginas valiosas.
- Como gerenciar o rastreo de as URL de navegação por facetas — o análogo mas cercano um pesquisa interna: robots.txt para bloquear, fragmentos de URL para evitar o impacto, um URL canónica como ferramenta mas débil um largo plazo e
404para as combinações vacías. (versión de infraestructura de rastreo.)
Google — indexação e duplicados
- Introducção um robots.txt — o que faz um
Disallow(bloquear o rastreo) e, sobre todo, o que não faz (retirar do índice). - Bloquear um indexação de pesquisa com noindex — um ferramenta para retirar páginas do índice e o requisito de que um página seja rastreable para que um etiqueta se vea.
- Consolidar URL duplicadas — contexto de canonicalização para um vertiente de casi duplicados de os resultados de pesquisa.
Google — especialidade de comércio eletrônico
- Diseñar uma estructura de URL para sites de comércio eletrônico — minimizar as URL duplicadas e manter os parámetros de sesión e de monitoramento fuera de os links internos.
- Ajudar um Google um entender um estructura de seu site de comércio eletrônico — o argumento um favor de páginas de categoria creadas um propósito (onde deveria aterrizar um demanda de os registros de pesquisa) frente um as URL dinámicas.
Citas de um fuente
On-the-record statements de Google. cada link é um deep link que jumps para o quoted passage em o fonte página. ali não é um Google quote que nomes “internal site pesquisa” especificamente, so o material below é o guidance em o categoria de URL que search-results páginas belong para — rastrear-budget waste, robots-vs-noíndice, e soft 404s — qual é exactly o que governs eles.
Google — o que desperdicia presupuesto de rastreo
- “Faceted navegação e session identifiers / On-site duplicate conteúdo / Soft error páginas / Hacked páginas / Infinite spaces e proxies / Low qualidade e spam conteúdo” (traducção) «Navegação por facetas e identificadores de sesión / Conteúdo duplicado em o site / páginas de error soft / páginas hackeadas / Espacios infinitos e proxies / Conteúdo de baja qualidade e spam»: Gary Illyes, sobre as categorias de URL de poco valor añadido «em orden de importancia». As páginas de resultados de pesquisa interna são uma instancia de as tres primeras. Ir um cita
- “Wasting servidor resources em páginas like estes vai drain crawl activity de páginas
que do na realidade têm valor, qual pode cause um significant delay em discovering
great conteúdo em um site.” (traducção) «Desperdiciar recursos do servidor em páginas como
estas drenará um actividade de rastreo de páginas que sí têm valor, o que pode causar um
retraso significativo em o descoberta de buen conteúdo em um site»: Gary Illyes, Google.
“will drain crawl activity from pages that do actually have value”
(tradução) «drenará a atividade de rastreamento de páginas que realmente têm valor»
Ir um cita - “Um increased crawl rate vai não necessarily lead para better positions em Pesquisa
resultados… enquanto crawling é necessary para being em o resultados, isso é não um classificação
sinal.” (traducção) «Uma mayor frecuencia de rastreo não llevará necesariamente um mejores
posições em os resultados de pesquisa… embora o rastreo é necesario para estar em os
resultados, não é um fator de posicionamiento»: Gary Illyes, Google (ou seja, que seus
páginas de pesquisa se rastreen mas não va um ajudar em nada).
“An increased crawl rate will not necessarily lead to better positions”
(tradução) «uma taxa de rastreamento maior não levará necessariamente a posições melhores»
Ir um cita
Google — robots.txt frente um noindex frente um error soft 404
- “Não use noindex, as Google vai ainda solicitação, mas então drop o página quando isso sees um noindex meta tag ou header em o HTTP resposta, wasting crawling tempo.” (traducção) «Não usa noindex, porque Google seguirá solicitando um página, mas depois um descartará quando vea uma metaetiqueta noindex ou uma cabecera em um resposta HTTP, desperdiciando tempo de rastreo»: Google pesquisa Central, sobre por o que robots.txt (e não noindex) é um ferramenta para o presupuesto de rastreo. Ir um cita
- “soft 404 páginas vai continue para ser crawled, e waste seu budget.” (traducção)
«As páginas soft 404 se seguirán rastreando e desperdiciarán seu presupuesto»: Google pesquisa
Central, sobre as páginas vacías ou sem resultados que devuelven
200 OK. “soft 404 pages will continue to be crawled, and waste your budget”
(tradução) «páginas soft 404 continuarão sendo rastreadas e desperdiçarão seu orçamento»
Ir um cita - “Return um 404 ou 410 status código para permanently removed páginas… um 404 status código
é um strong sinal não para crawl que URL again.” (traducção) «Retorna um código de estado
404 ou 410 para as páginas eliminadas de forma permanente… um código de estado 404 é uma
sinal potente de não volver um rastrear essa URL»: Google pesquisa Central.
“a 404 status code is a strong signal not to crawl that URL again”
(tradução) «um 404 status código é um strong sinal não para crawl que URL again»
Ir um cita
Google — o presupuesto de rastreo importa sobre todo um gran escala
- “Se seu site não têm um large number de páginas que altere rapidly, ou se seu
páginas seem para ser crawled o mesmo dia que eles são published, você não precisa para
read este guide.” (traducção) «Se seu site não tem um gran número de páginas que cambien
rápidamente, ou se seus páginas parecen rastrearse o mesmo dia em que se publican, você não precisa
leer esta guía»
“you don’t need to read this guide”
(tradução) «você não precisa ler este guia»
Ir um cita
¿O que control aplicar um uma URL de resultados de pesquisa?
Recorra um lista de arriba abajo e deténgase em um primera coincidencia.
1. ¿É o caso estándar, resultados de pesquisa que nunca quiere que se rastreen nem se posicionen?
→ Aplique disallow em robots.txt um ruta de pesquisa (/search, ?q=, ?s=, /catalogsearch/).
Os bots nunca um solicitan, assim que nunca cuesta presupuesto de rastreo. Não añada además noindex.
2. ¿estas URL de pesquisa já estão indexadas e precisa sacarlas do índice?
→ Não basta com aplicar disallow: uma URL bloqueada por robots pode seguir indexada. Em seu lugar: permita
o rastreo temporalmente e sirva noindex (ou use um Removals ferramenta de GSC em os casos
urgentes) até que desaparezcan, e então aplique disallow para ahorrar rastreo futuro. nunca haga ambas cosas um vez.
3. ¿Uma consulta concreta tem demanda genuina e repetida (interna e externa)?
→ Não indexe um URL de pesquisa. Cree uma página de categoria, colecção ou aterrizagem
real em uma URL estática limpia, com título, H1, BreadcrumbList e texto útil.
Promueva um demanda um uma página creada um propósito; siga bloqueando um ruta de pesquisa em bruto.
4. ¿O que deveria retornar uma pesquisa vacía ou sem resultados?
→ Um 404 real (ou sirva uma página de «sem resultados» orientada um conversão detrás de um
ruta /search já bloqueada). nunca uma página 200 OK de «sem resultados» que seja rastreable:
eso é um error soft 404 e desperdicia presupuesto.
5. ¿Seu loja é pequeña (se rastreia o mesmo dia, muito por debajo de as seis cifras de URL)? → O presupuesto de rastreo provavelmente não seja seu problema, mas bloquee igualmente as URL de pesquisa para evitar conteúdo duplicado ou escaso e inflado do índice. UM solução é única e barata em qualquer caso.
Lista de comprobação de SEO para um pesquisa interna em comércio eletrônico
Contener as páginas de resultados
- UM ruta de resultados de pesquisa (
/search,?q=,?s=, o equivalente de seu plataforma) está bloqueada emrobots.txt. - As URL de resultados de pesquisa não llevan además uma etiqueta
noindex(bloqueo + noindex em um mesma URL anula o noindex). - Nenhum link interno transmite autoridade para as URL de pesquisa (não deveriam estar em seu navegação, seu sitemap nem seus etiquetas canónicas).
- As URL de pesquisa não estão em seu sitemap XML.
- Qualquer URL de pesquisa que já esté em o índice se está limpiando de um forma correcta (permitir o rastreo + noindex até que desaparezca, ou um Removals ferramenta de GSC em os casos urgentes), antes de aplicarle disallow.
Gerenciar os resultados vacíos
- As páginas sem resultados devuelven um
404real (não um error soft 404 com200 OK), ou viven detrás de uma ruta de pesquisa já bloqueada. - UM experiencia de cero resultados orientada um personas recupera ao comprador (categorias sugeridas, produtos populares, sugerencias ortográficas e de sinónimos).
Explotar um demanda
- Os registros de consultas de pesquisa interna se revisan com regularidade para detectar huecos de catálogo e as expresiones de os clientes.
- As consultas internas de mayor volumen se contrastan com um demanda de pesquisa externa real.
- As consultas ganadoras se convierten em páginas de categoria ou de aterrizagem
creadas um propósito (URL estática limpia, título, H1,
BreadcrumbList, texto útil), não em URL de pesquisa indexadas.
Fazer buena um funcionalidade (UX/CRO)
- UM pesquisa tolera erratas e sinónimos.
- UM pesquisa é rápida e retorna resultados relevantes.
- O merchandising ou o boosting está configurado para as consultas clave em as que importa.
Os modelos mentales
1. Dos tareas, um somente nome. O «SEO de um pesquisa interna em comércio eletrônico» agrupa dos tareas sem relação entre sí: fazer buena um funcionalidade (UX, CRO, explotação de os registros de consultas) e evitar que as URL de resultados perjudiquen um pesquisa orgánica (contenção). Optimice um primera de forma agresiva; contenga um segunda por defecto. Casi todos os errores em este tema consisten em aplicar o entusiasmo de um tarea 1 um espacio de URL de um tarea 2.
2. Os resultados de pesquisa são um problema de navegação por facetas disfrazado.
Uma URL ?q= é o mesmo patrón infinito, escaso, casi duplicado e um veces vacío que
uma faceta ?color=&size=. Se aplica o mesmo instrumental: bloquear o ruido
(robots.txt), retornar 404 em as vacías, um canónica é o recurso mas débil
e promover um demanda real um uma página creada um propósito.
3. robots.txt e noindex não são intercambiables.
robots.txt = detener o rastreo (ahorra presupuesto, mas não pode retirar uma URL
já indexada). noindex = detener um indexação (retira um página, mas somente depois
de um rastreo, assim que não ahorra presupuesto, e é invisible se um URL está además
bloqueada). Elija um que se ajuste um seu objetivo e nunca as apile em um mesma URL.
4. UM sinal está em um caja, não em um URL. O valioso de um pesquisa interna não é um página de resultados: é um consulta. Trate o registro de pesquisa como um conjunto de dados próprio de palavras-chave. UM URL se bloquea; um demanda que revela recebe uma página real.
5. UM escala fija o que está em juego, não um solução. O presupuesto de rastreo é uma preocupação de sites grandes; o conteúdo duplicado ou escaso e o inflado do índice, não. UM solução de contenção (bloquear as URL de pesquisa, retornar 404 em as vacías) é barata e correcta um qualquer tamaño, assim que aplíquela sem importar o grande que seja seu loja.
Formas de equivocarse com o SEO de um pesquisa interna
Aplicar disallow e noindex um mesma URL de pesquisa.
O error mas común de todos. Se robots.txt bloquea um URL, Googlebot não pode
solicitarla, assim que nunca ve um etiqueta noindex, e uma URL bloqueada um que se
enlaza pode seguir indexada como URL sem descrição. use uma ferramenta por
objetivo, nunca as dos em um mesma URL.
Recurrir um noindex para «ahorrar presupuesto de rastreo».
noindex não detiene o rastreo: Google sigue solicitando um página para ver um
etiqueta e depois um descarta, «desperdiciando tempo de rastreo». para o
presupuesto, um ferramenta é robots.txt.
Servir páginas 200 OK de «sem resultados».
Uma página de cero resultados rastreable que retorna 200 é um error soft 404, que
Google sigue rastreando e contabiliza como desperdicio. Devuelva um 404 real ou
coloque um experiencia sem resultados detrás de uma ruta já bloqueada.
Intentar posicionar URL /search?q= em bruto.
Incluso quando uma consulta tem demanda real, um URL de pesquisa em bruto é escasa
e casi duplicada. UM solução é uma página de categoria ou de aterrizagem creada um
propósito, não indexar um página de resultados de pesquisa.
Enlazar um URL de pesquisa desde seu navegação, seu sitemap ou os widgets de «pesquisas populares».
Os chips de «pesquisas populares», os links de autocompletado e as entradas de
sitemap que apuntan um /search?q= conducen um os rastreadores diretamente ao espacio
que intenta contener. Mantenga os links internos apuntando um páginas reais de
categoria e de produto.
Dejar que os identificadores de sesión e os parámetros de monitoramento viajen em as URL de pesquisa.
/search?q=shoes&sessionid=…&utm_… multiplica um mesma página escasa em muitas.
Mantenga os parámetros de sesión e de monitoramento fuera de os links internos:
Google agrupa os identificadores de sesión com um navegação por facetas como o
principal desperdicio de rastreo.
Suponer que uma loja pequeña está exenta. Talvez não tenha um problema de presupuesto de rastreo, mas igualmente pode sufrir conteúdo duplicado ou escaso e inflado do índice. Bloquee as URL de pesquisa sem importar o tamaño.
Pesquisa interna em comércio eletrônico: hoja de referencia rápida
O que faz cada control
| Control | ¿Detiene o rastreo? | ¿Detiene um indexação? | Úselo em páginas de pesquisa quando… |
|---|---|---|---|
disallow de robots.txt | Sí | Não (as URL enlazadas podem persistir) | O caso normal: nunca quiere que se rastreen nem se posicionen |
noindex (rastreable) | Não | Sí | está limpiando do índice URL de pesquisa já indexadas |
robots.txt + noindex juntos | — | Roto | nunca: o bloqueo oculta um etiqueta noindex |
404 / 410 real | Señala «não volver um rastrear» | Retira do índice | páginas vacías ou sem resultados |
rel=canonical | Não | Consolida (somente uma indicação) | Recurso débil; não é um ferramenta principal aqui |
Consulta → acção
| Situação | Acção |
|---|---|
| URL estándar de resultados de pesquisa | Bloquear em robots.txt |
| URL de pesquisa já indexada que há que eliminar | Permitir o rastreo + noindex até que desaparezca, e então bloquear |
| Consulta com demanda real e repetida | Criar uma página de categoria ou de aterrizagem em uma URL limpia; não indexar ?q= |
| Pesquisa vacía ou sem resultados | 404 real (ou experiencia sem resultados detrás de uma ruta bloqueada) |
| Parámetros de sesión ou de monitoramento em as URL de pesquisa | Mantenerlos fuera de os links internos; bloquear o patrón |
Fast facts
- Google’s #1 rastrear-waste categoria: faceted navegação e session identifiers — resultados de pesquisa páginas são mesmo pattern.
noindexnão save rastrear budget — Google solicitações o página primeiro.- Soft 404s (
200 OK“não resultados”) mantenha getting rastreado e waste budget. - Crawl budget é mostly um large-site concern; índice bloat/duplication não é.
- o valuable output de site pesquisa é o query log, não resultados URL.
Ferramentas para o SEO de um pesquisa interna em comércio eletrônico
- Google Analytics 4 — pesquisa em o site: o relatório de términos de pesquisa de GA4 captura o que os compradores escriben em um pesquisa interna de seu site (configure o parámetro de consulta de pesquisa em o flujo de dados). esta é seu fuente principal de dados de demanda interna para um fase de explotação de consultas.
- UM analítica de pesquisa interna de seu plataforma: um analítica de pesquisa de Shopify, os paneles de Algolia / Klevu / Searchspring ou o relatório de términos de pesquisa de Magento, para as consultas sem resultados, as consultas principais e os clics, que lhe dicen tanto o que construir como onde falla um UX de pesquisa.
- Google pesquisa Console — página Indexação relatório: vigile os grupos de excluidas por se se acumulan URL de pesquisa ou com parámetros; eso indica que seu contenção tem fugas.
- GSC — Crawl Stats: compruebe se Googlebot está dedicando tempo um URL
/searchou?q=. - GSC — URL Inspection / Removals: confirme como se trata uma URL de pesquisa e use Removals para limpiar com urgencia páginas de pesquisa já indexadas.
- Screaming Frog SEO Spider / Ahrefs site Auditoria: rastree um loja para encontrar
URL de pesquisa enlazadas internamente, incluidas em o sitemap ou que devuelven
200com resultados vacíos, además de os patrones de error soft 404 e de casi duplicados. - Uma ferramenta de investigação de palavras-chave (por exemplo, Ahrefs Keywords Explorer): para validar que uma consulta interna de alto volumen também tem demanda de pesquisa externa real antes de criar uma página para ella.
Problemas habituales de SEO em um pesquisa interna
As URL de pesquisa siguen indexadas após um bloqueo em robots.txt
Causa probable: robots.txt impide o rastreo, mas não garantiza um desindexação, assim que Google
não pode ver um noindex em um página bloqueada. Solução: permita temporalmente o rastreo e sirva
noindex até que as URL desaparezcan, e depois aplique disallow ao patrón para evitar futuro desperdicio de rastreo.
Confírmelo com URL Inspection em vez de somente com uma consulta site:.
Zero-result searches appear as soft 404s
Causa probable: um plantilla retorna 200 OK incluso quando não existe nenhum produto. Solução: devuelva
um 404 real ou mantenga um experiencia de recuperação orientada um personas detrás de uma ruta de pesquisa já
bloqueada ao rastreo. Confirme o estado HTTP por separado do mensagem visible.
Googlebot sigue rastreando novas combinações de consultas
Causa probable: formularios, links internos, parámetros ou variantes de ruta inconsistentes exponen um espacio de URL mayor que o que cubre um regra de robots. Solução: inventaríe os patrones reais de URL de pesquisa um partir de os registros, elimine os links rastreables que apuntan um eles e actualice as regras de disallow com testes acotadas. Confirme que as URL valiosas de produto e de categoria siguen permitidas.
Uma página de aterrizagem promovida compite com seu antiga URL de pesquisa
Causa probable: o resultado de pesquisa em bruto sigue siendo rastreable ou enlazado internamente depois de lanzar um página curada. Solução: apunte um navegação e os links contextuales um página de aterrizagem limpia, mantenga controlado o espacio de pesquisa em bruto e verifique que um página de aterrizagem é autocanónica.
Exemplos simplificados de pesquisa interna
Contenção do rastreo sem uma directiva em conflicto
User-facing search: /search?q=waterproof-boots
robots.txt: Disallow: /search
page-level noindex: not relied on while the path is blocked
XML sitemap: search URL omittedO bloqueo aborda o rastreo futuro. Se um URL já está indexada, permita primeiro que um página
se rastree com noindex; aplíquele disallow somente depois de seu retirada.
Promover um demanda um uma página real
Before: /search?q=gluten-free-protein-bars
After: /collections/gluten-free-protein-bars/UM colecção limpia recebe um título estable, um H1, texto útil, breadcrumbs, produtos curados e links internos. UM URL de pesquisa em bruto sigue formando parte do espacio de pesquisa não indexable.
Prompts para o análisis de um pesquisa interna
Clasificar as consultas internas em acções
Pegue um CSV com um consulta, o número de pesquisas, o número de resultados e as conversiones. Elimine os dados personales antes de compartirlo com qualquer modelo.
You are reviewing ecommerce internal-search demand. For each supplied query, classify it
as: synonym/merchandising fix, zero-result inventory gap, possible curated landing page,
navigation problem, or noise. Explain the evidence from the supplied columns only. Do not
invent external search volume. Return a table and a separate list of items that require
external keyword validation before an indexable page is created.Auditar os controles de as URL de pesquisa
Pegue URL de pesquisa representativas, o robots.txt, as cabeceras de resposta e um secção head do HTML correspondiente.
Audit these internal-search URLs for crawl and index-control conflicts. For each URL,
report: robots.txt access, HTTP status, meta or X-Robots-Tag directive, canonical target,
internal-link source, and sitemap presence. Flag robots.txt + noindex conflicts and
200-status zero-result pages. Do not infer any value that is absent from the input. Scripts para encontrar URL de pesquisa expuestas
Verificar um resposta de uma URL representativa e o arquivo robots
curl -I 'https://www.example.com/search?q=test'
curl -sS 'https://www.example.com/robots.txt'O primer comando confirma o estado HTTP real; o segundo lhe permite comparar um ruta exacta com as regras desplegadas. Sustitúyalo por um site que você controle.
encontrar links de pesquisa em um página renderizada real
Ejecute esto em um consola de DevTools em uma página representativa de categoria ou de navegação:
[...document.querySelectorAll('a[href]')]
.map(a => a.href)
.filter(href => /(?:\/search(?:\/|\?|$)|[?&](?:q|query|s)=)/i.test(href));Qualquer resultado merece revisión, porque alguns links rastreables corrientes podem exponer o espacio de URL de pesquisa incluso quando um funcionalidade empieza siendo um formulario.
Contar as solicitações um ruta de pesquisa em um extracto do log de acceso
awk '$7 ~ /^\/search([/?]|$)/ {print $7}' access.log | sort | uniq -c | sort -nrAjuste o campo de um ruta de um solicitação um seu formato de log. Esto revela as variantes realmente rastreadas; não distingue bots salvo que um entrada já se haya filtrado adecuadamente.
Demuestre que os controles de pesquisa funcionam
Teste de control de rastreo
Teste um ejecutar: pruebe URL de pesquisa representativas e URL de categoria valiosas em o robots.txt Tester. resultado esperado: os patrones de pesquisa quedan bloqueados enquanto as rutas de produto e de categoria siguen permitidas. Interpretação do fallo: um regra é demasiado estrecha, demasiado amplia ou não coincide com os patrones de URL desplegados. Ventana de monitoramento: inmediata após o despliegue do robots.txt. Disparador de reversión: URL legítimas do catálogo quedan bloqueadas.
Teste do estado em pesquisas sem resultados
Teste um ejecutar: solicite uma consulta com cero resultados conocida usando curl -I. resultado esperado: um
404 real quando um URL é rastreable, ou um confirmação de que toda um ruta de pesquisa já está
bloqueada. Interpretação do fallo: uma plantilla de cero resultados rastreable com 200 supone um riesgo de
error soft. Ventana de monitoramento: inmediata após um publicação de um plantilla. Disparador de reversión: pesquisas
válidas ou páginas de produto empiezan um retornar estados de error.
Teste de um página de aterrizagem promovida
Teste um ejecutar: inspeccione um nova URL curada, seu canónica, seus links internos e o equivalente de
pesquisa em bruto. resultado esperado: um página curada retorna 200, é autocanónica
e recebe links rastreables enquanto o espacio de pesquisa em bruto sigue controlado. Interpretação
do fallo: os dos tipos de URL estão compitiendo ou um nova página está huérfana. Ventana de
monitoramento: comprobações técnicas inmediatas seguidas de monitoramento em Pesquisa Console após o novo rastreo.
Disparador de reversión: um publicação expone um espacio de URL de consulta sem controlar.
Métricas permanentes de pesquisa interna
Cuota de rastreo de as URL de pesquisa
Métrica: proporção de solicitações verificadas de mecanismos de busca que van um URL de pesquisa interna. O que lhe dice: se o espacio de URL controlado sigue consumiendo actividade de rastreo. Como obtenerla: logs do servidor com bots verificados, agrupados por ruta e patrón de parámetros. Referencia / rango realista: establezca uma línea base previa ao alteração e reduzca as solicitações evitables um URL de pesquisa sem suprimir o rastreo valioso do catálogo. Cadencia: semanal após os alterações, e depois mensual.
Tasa de consultas sem resultados
Métrica: pesquisas internas que não devuelven nenhum produto como proporção de todas as pesquisas internas. O que lhe dice: onde os sinónimos, o merchandising, um navegação ou o inventario fallan um os compradores. Como obtenerla: analítica de pesquisa interna segmentada por consulta normalizada. Referencia / rango realista: compare categorias e observe um tendencia frente um línea base de um própria loja; um mezcla de catálogo faz engañoso qualquer objetivo universal. Cadencia: semanal para merchandising e mensual para um planificação de SEO e conteúdos.
Conversão asistida por um pesquisa
Métrica: taxa de conversão e ingresos de as sesiones que usam um pesquisa interna, manteniendo visibles os grupos de consultas. O que lhe dice: se um funcionalidade ajuda um os compradores um encontrar produtos em lugar de limitarse um generar URL. Como obtenerla: eventos de analítica cruzados com as transacções. Referencia / rango realista: use as sesiones sem pesquisa e os periodos anteriores como contexto, não como teste de causalidade. Cadencia: mensual e após os alterações de relevancia.
Demanda promovida um páginas duraderas
Métrica: temas de consultas internas validados que se han convertido em páginas curadas, mas as impresiones orgánicas e as conversiones de essas páginas. O que lhe dice: se um demanda própria se está convirtiendo em inventario indexable útil. Como obtenerla: mantenga uma lista de lanzamientos e crúcela com Pesquisa Console e um analítica. Referencia / rango realista: evalúe cada página frente um seu caso de demanda documentado. Cadencia: trimestral.
Recursos que merecen seu tempo
Mis artículos relacionados
- Guía para principiantes de SEO técnico — onde encajan o presupuesto de rastreo, um indexação e o control de as URL duplicadas em o panorama general.
- Navegação por facetas: guía para expertos em SEO — o tema hermano mas cercano; um mesma lógica de bloquear o ruido que gobierna as URL de pesquisa interna.
- Presupuesto de rastreo: todo o que necesitas saber sobre SEO — por o que os espacios de URL de poco valor, como os resultados de pesquisa, drenan rastreo de as páginas reais, e um quem lhe tem que importar realmente.
- Robots.txt e SEO: todo o que necesitas saber — um ferramenta que usará para contener as páginas de resultados de pesquisa, e um distinção entre rastreo e indexação que um faz funcionar.
Mis ponencias
- Como funciona um pesquisa (SlideShare) — mi recorrido por o rastreo, o renderizado, um indexação e o posicionamiento, que é o modelo mental que há detrás de tratar as URL de pesquisa como desperdicio de rastreo. (Se aplica mi advertencia habitual: «esta é mi comprensión de os sistemas… não va um ser 100 % completa nem exacta»).
Do sector
- O que significa o presupuesto de rastreo para Googlebot (Google pesquisa Central) — um lista de referencia de Gary Illyes de categorias de URL de poco valor añadido um que pertenecen as páginas de resultados de pesquisa.
- Optimiza seu presupuesto de rastreo (Google pesquisa Central) — um regra de robots.txt por encima de noindex e um advertencia sobre o desperdicio de rastreo por errores soft 404.
- Como gerenciar o rastreo de as URL de navegação por facetas (Google pesquisa Central) — o manual de navegação por facetas que se traslada diretamente um as URL de pesquisa interna (robots.txt para bloquear,
404para os resultados vacíos, um URL canónica como ferramenta mas débil). - Os mayores problemas de rastreo de Google (Mecanismo de busca Land) — o desglose de Gary Illyes sobre o que causa realmente o exceso de rastreo, com um navegação por facetas em aproximadamente um mitad de todos os problemas reportados.
- Gary Illyes de Google sigue advirtiendo sobre os problemas de parámetros de URL (Mecanismo de busca Journal) — um advertencia de um explosión do espacio de URL, de «1000 URL um abrasador 1 millón», que se aplica igual um os parámetros de pesquisa.
Ponga um teste seus conocimientos: Comércio eletrônico site Pesquisa SEO
Cinco perguntas rápidas sobre como interactúan as páginas de resultados de pesquisa interna com o SEO. Elija uma resposta para cada uma e compruébelas.
Registro de alterações
Atualizado em 22 de ago. de 2026.
Resumo editorial e detalhes registrados da alteração.Detalhes da alteração
-
As notas detalhadas sobre as alterações estão disponíveis atualmente em inglês.
Não é possível fazer a comparação completa — nenhum instantâneo anterior foi arquivado para esta revisão.