Frecuencia de rastreo

Con qué frecuencia los motores de búsqueda vuelven a rastrear una página que ya conocen: qué la impulsa (popularidad, falta de actualización, un lastmod honesto), qué no (changefreq, priority, publicar a diario) y por qué no se puede forzar.

Publicado por primera vez: 22 jun 2026 · Última actualización: 8 ago 2026 · Avanzado
Idiomas

La frecuencia de rastreo es la frecuencia con la que un motor de búsqueda vuelve a obtener una página que ya conoce. Está impulsada principalmente por la importancia de la página (popularidad, PageRank, enlaces) y por la frecuencia con la que cambia realmente (falta de actualización), aunque Google también menciona otras señales de demanda: Google aprende el patrón de actualización de cada página y se ajusta. Puedes influir en ella indirectamente mediante la importancia, los cambios reales, un lastmod preciso y un servidor saludable, pero no puedes configurarla. changefreq y priority se ignoran; modificar lastmod de forma cosmética es contraproducente; y rastrear con más frecuencia no mejora el posicionamiento.

TL;DR — La frecuencia de rastreo es la cadencia de rerastreo de una URL conocida, establecida por el programador principalmente a partir de dos señales: importancia (popularidad / PageRank / enlaces) y obsolescencia (con qué frecuencia cambia realmente la página) — la documentación de Google también menciona otras señales de demanda, como el inventario percibido y los eventos en todo el sitio. Google aprende el patrón de actualización de cada página y se adapta — incluso reduce el rastreo en páginas estables (3 → 10 → 30 → 100 días). changefreq y priority se ignoran; solo se respeta un lastmod verificable vinculado a un cambio significativo. No puedes establecer la frecuencia directamente — mejoras las señales (importancia, cambio real, lastmod preciso, salud del servidor) y, para una única URL, solicitas un rerastreo. Un mayor rastreo no mejora las clasificaciones. Es distinta de la frecuencia de rastreo (velocidad) y del presupuesto de rastreo (demanda + capacidad).

Qué es realmente la frecuencia de rastreo

La frecuencia de rastreo es la frecuencia con la que un motor de búsqueda vuelve a obtener una URL que ya conoce, para comprobar si cambió. Es la cadencia de rerastreo, decidida para cada URL por el programador de rastreo. Los dos grandes factores son la importancia de la página y la frecuencia con la que realmente cambia — la documentación de Google llama a estos factores popularidad y obsolescencia. Evidence for this claim Google's crawl-demand guidance says popular URLs tend to be crawled more often and systems seek to recrawl often enough to detect changes. Scope: Adaptive Google recrawling; no fixed per-page cadence is promised. Confidence: high · Verified: Google: Large site crawl budget guide

Esta es la parte de la historia del rastreo que más fácilmente se confunde con sus conceptos hermanos, así que permíteme trazar los límites con claridad.

Frecuencia de rastreo vs. presupuesto de rastreo vs. frecuencia de rastreo

Estos tres términos se usan indistintamente y no deberían:

TérminoQué mideEstablecido por
Frecuencia de rastreoCon qué frecuencia se vuelve a obtener una URL conocida (cadencia)El programador — popularidad + obsolescencia
Frecuencia de rastreo (capacidad)Qué tan rápido / cuántas conexiones paralelasEl estado de tu servidor (rápido = más, errores = menos)
Presupuesto de rastreoDemanda + capacidad — “the set of URLs that Google can and wants to crawl” (traducción) «el conjunto de URL que Google puede y quiere rastrear»Ambos anteriores, combinados

La propia definición de Google lo une: “Google defines a site’s crawl budget as the set of URLs that Google can and wants to crawl.” (traducción) «Google define el presupuesto de rastreo de un sitio como el conjunto de URLs que Google puede y quiere rastrear.» La frecuencia es una cadencia por URL que está dentro de ese presupuesto. La frecuencia de rastreo es el acelerador en la tubería. Como lo expreso en mi guía de presupuesto de rastreo: “Crawl budget is the amount of time and resources a search engine allows for crawling a website. It is made up [of] crawl demand which is how many pages a search engine wants to crawl on your site and crawl rate which is how fast they can crawl.” (traducción) «El presupuesto de rastreo es la cantidad de tiempo y recursos que un motor de búsqueda permite para el rastreo de un sitio web. Está compuesto [de] la demanda de rastreo, que es cuántas páginas quiere rastrear un motor de búsqueda en tu sitio, y la frecuencia de rastreo, que es qué tan rápido pueden rastrear.»

Rastreos de descubrimiento vs. rastreos de actualización

La frecuencia trata realmente sobre el rastreo de actualización. John Mueller explicó la división claramente: “One is a discovery crawl where we try to discover new pages on your website. And the other is a refresh crawl where we update existing pages that we know about.” (traducción) «Uno es un rastreo de descubrimiento, en el que intentamos descubrir nuevas páginas en tu sitio web. Y el otro es un rastreo de actualización, en el que actualizamos las páginas existentes que conocemos.»

La cadencia de actualización varía enormemente según la página. Mueller de nuevo: “We would refresh crawl the homepage, I don’t know, once a day, or every couple of hours, or something like that.” (traducción) «Rastrearíamos la página principal para actualizarla, no sé, una vez al día, o cada par de horas, o algo así.» Y en el otro extremo: “If we recognize that individual pages change very rarely, then we realize we don’t have to crawl them all the time.” (traducción) «Si reconocemos que las páginas individuales cambian muy rara vez, entonces nos damos cuenta de que no tenemos que rastrearlas todo el tiempo.»

La clave es que Google aprende tu patrón por página: “If you have a news website and you update it hourly, then we should learn that we need to crawl it hourly. Whereas if it’s a news website that updates once a month, then we should learn that we don’t need to crawl every hour.” (traducción) «Si tienes un sitio web de noticias y lo actualizas cada hora, entonces deberíamos aprender que necesitamos rastrearlo cada hora. Mientras que si es un sitio web de noticias que se actualiza una vez al mes, entonces deberíamos aprender que no necesitamos rastrear cada hora.»

Qué determina con qué frecuencia Google vuelve a rastrear una página

En mi presentación How Search Works enumero los factores de demanda de rastreo que impulsan el rerastreo: PageRank, la frecuencia con la que cambia la página, el tiempo desde el último rastreo y los cambios importantes del sitio. Ese es el mismo modelo de popularidad + obsolescencia que Google documenta, solo que desde mi propio enfoque, y tampoco es una lista exhaustiva. La documentación de Google también menciona el inventario percibido (cuántas URL cree que tiene tu sitio) y los eventos en todo el sitio, como una migración de dominio o de estructura de URL, como factores que pueden aumentar o reducir la demanda de rastreo. La popularidad y la obsolescencia son los dos que puedes influir más directamente, así que son los que merecen más atención. Desglosándolos:

Popularidad, PageRank y enlaces

“URLs that are more popular on the Internet tend to be crawled more often to keep them fresher in our systems.” (traducción) «Las URL que son más populares en Internet tienden a rastrearse con más frecuencia para mantenerlas más actualizadas en nuestros sistemas.» Más enlaces internos y externos a una página → mayor importancia percibida → rerastreos más frecuentes. En mi publicación sobre presupuesto de rastreo lo digo de la misma manera: “Popular pages, or those with more links and PageRank, will generally receive priority over other pages.” (traducción) «Las páginas populares, o aquellas con más enlaces y PageRank, generalmente recibirán prioridad sobre otras páginas.»

Obsolescencia — y el retroceso

Los sistemas de Google “want to recrawl documents frequently enough to pick up any changes.” (traducción) «quieren volver a rastrear documentos con la frecuencia suficiente para detectar cualquier cambio.» La otra cara es que las páginas que no cambian se rastrean cada vez menos. De mi guía de presupuesto de rastreo: “If Google sees that a page isn’t changing, they will crawl the page less frequently.” (traducción) «Si Google ve que una página no cambia, rastreará la página con menor frecuencia.» No hay un intervalo fijo — es un retroceso: “if they crawl a page and see no changes after a day, they may wait three days before crawling again, ten days the next time, 30 days, 100 days, etc.” (traducción) «si rastrean una página y no ven cambios después de un día, pueden esperar tres días antes de volver a rastrear, diez días la próxima vez, 30 días, 100 días, etc.»

Calidad y demanda de búsqueda

Gary Illyes presenta el programador como algo a lo que tienes que convencer: “If you want to increase how much we crawl, then you somehow have to convince search that your stuff is worth fetching, which is basically what the scheduler is listening to.” (traducción) «Si quieres aumentar cuánto rastreamos, entonces de alguna manera tienes que convencer a la búsqueda de que tu contenido vale la pena recuperarse, que es básicamente lo que el programador está escuchando.» Es dinámico: “Scheduling is very dynamic. As soon as we get the signals back from search indexing that the quality of the content has increased across this many URLs, we would just start turning up demand.” (traducción) «La programación es muy dinámica. En cuanto recibimos de vuelta las señales de la indexación de búsqueda de que la calidad del contenido ha aumentado en esta cantidad de URL, simplemente empezaríamos a aumentar la demanda.» Funciona en ambos sentidos — “If search demand goes down, then that also correlates to the crawl limit going down.” (traducción) «Si la demanda de búsqueda baja, entonces eso también se correlaciona con que el límite de rastreo baje.»

Conviene saber: Google está intentando activamente rastrear menos las páginas estables por razones de eficiencia. Illyes ha descrito públicamente querer “crawl even less” (traducción) «rastrear aún menos» y reducir los bytes en la red. Así que no esperes que el programador se incline por rastrear en exceso tus páginas que no cambian.

Salud del servidor (la tasa permite la frecuencia)

La frecuencia solo puede llegar tan alto como lo permita tu frecuencia de rastreo. El límite de capacidad de rastreo es aproximadamente el número máximo de conexiones paralelas simultáneas que usará Google; un servidor rápido y sin errores eleva ese techo, mientras que un sitio lento o uno que devuelve 5xx/429 se rastrea menos. El estado del servidor no aumenta la frecuencia — simplemente deja de ser un cuello de botella.

El papel de los sitemaps y lastmod

Este es el mayor mito que hay que desmentir. La gente piensa que los ajustes de los sitemaps controlan la cadencia. En su mayor parte, no lo hacen.

changefreq y priority se ignoran

Directamente de la documentación de sitemaps de Google: “Google ignores <priority> and <changefreq> values.” (traducción) «Google ignora los valores <priority> y <changefreq>.» Establecer <changefreq>hourly</changefreq> no hace nada. Evidence for this claim Google ignores sitemap priority and changefreq values and may use accurate lastmod values. Scope: Google sitemap processing. Confidence: high · Verified: Google: Build and submit a sitemap Deja de optimizar esos campos.

lastmod es la única señal — si es honesta

La única señal de frescura que Google respeta de un sitemap es lastmod, y solo de forma condicional: “Google uses the <lastmod> value if it’s consistently and verifiably (for example by comparing to the last modification of the page) accurate.” (traducción) «Google usa el valor <lastmod> si es preciso de manera constante y verificable (por ejemplo, al compararlo con la última modificación de la página).» Si mientes al respecto, Google lo nota y deja de confiar en él.

Y tiene que reflejar un cambio real:

  • “The <lastmod> value should reflect the date and time of the last significant update to the page. For example, an update to the main content, the structured data, or links on the page is generally considered significant, however an update to the copyright date is not.” (traducción) «El valor de <lastmod> debería reflejar la fecha y hora de la última actualización significativa de la página. Por ejemplo, una actualización del contenido principal, de los datos estructurados o de los enlaces de la página generalmente se considera significativa, pero una actualización de la fecha de copyright no lo es.» Actualizar lastmod porque cambiaste el año del pie de página no ayudará, y erosiona la confianza que hace que lastmod funcione en absoluto.

¿Puedes forzar o acelerar el rastreo?

La respuesta honesta: no hay un dial para la frecuencia. Lo que realmente tienes:

  • Mejorar las entradas — importancia (enlaces, enlazado interno), cambios genuinos de contenido, un lastmod preciso y un servidor rápido y saludable.
  • Solicitar una única URL — La herramienta de inspección de URL de Google Search Console tiene una acción “Request indexing” para una página a la vez. Es una solicitud, no una garantía, y no cambia la cadencia continua. Google es explícito en que presionar el botón sin parar tampoco ayuda: solicitar la misma URL repetidamente no hará que se rastree más rápido.
  • Enviar un cambio (en Bing y otros) — consulta más abajo.
Evidence for this claim Requesting a recrawl repeatedly for the same URL does not make Google crawl it faster. Scope: owned URLs Confidence: high · Verified: Ask Google to recrawl your URLs

Lo que no puedes hacer: establecer una frecuencia, forzar rastreos diarios publicando diariamente, o usar el antiguo control deslizante de frecuencia de rastreo de GSC (se retiró). Bing tiene una cuadrícula de Crawl Control, pero esta controla el ritmo, no la frecuencia.

Bing: rastreo adaptativo e IndexNow

Bing piensa en la frecuencia de rastreo como un problema de costo. Según su publicación sobre frecuencia de rastreo, la cadencia “depends on the frequency of which the content is edited and updated,” (traducción) «depende de la frecuencia con la que el contenido se edita y actualiza», y “Defining when to fetch the web page next is the hard problem we are looking to optimize.” (traducción) «Definir cuándo obtener la página web a continuación es el problema difícil que buscamos optimizar». Su respuesta adaptativa: “What we learned was that we could optimize our system to avoid fetching the same content over and over, and instead check periodically for major changes” (traducción) «Lo que aprendimos fue que podíamos optimizar nuestro sistema para evitar obtener el mismo contenido una y otra vez, y en su lugar comprobar periódicamente si hay cambios importantes» — lo que en un caso produjo “about 40% crawl saving on this site!” (traducción) «¡aproximadamente un 40 % de ahorro de rastreo en este sitio!»

El mecanismo de Bing de “you can nudge it” (traducción) «puedes darle un pequeño impulso» es IndexNow: en lugar de esperar al planificador, señalas un cambio. “Whether you’re adding, updating, or deleting content, IndexNow notifies multiple search engines of your content changes as soon as they happen,” (traducción) «Ya sea que añadas, actualices o elimines contenido, IndexNow notifica a varios motores de búsqueda los cambios de tu contenido tan pronto como ocurren», lo cual trata de “limiting the need for costly exploratory crawls.” (traducción) «limitar la necesidad de costosos rastreos exploratorios». Ten en cuenta la asimetría: Google no usa IndexNow para el rastreo general.

Cómo comprobar tu frecuencia de rastreo

  • GSC → Crawl Stats — solicitudes totales a lo largo del tiempo, desglosadas por código de respuesta, tipo de archivo y tipo de Googlebot. Así es como observas la cadencia a nivel del sitio; no es un informe de último rastreo por URL.
  • GSC → URL Inspection — la fecha “last crawl” para una URL individual. Esto, no Crawl Stats, es donde compruebas cuándo se obtuvo por última vez una página específica.
  • Bing Webmaster Tools — Crawl Control (frecuencia de rastreo) e IndexNow Insights.
  • Análisis de registros del servidor — la verdad objetiva: exactamente a qué URLs acceden los bots y con qué frecuencia.

Mitos comunes sobre la frecuencia de rastreo

  • “Publicar a diario fuerza un rastreo más rápido.” No — Google aprende tu patrón y rastrea más por importancia y cambio genuino, no por el volumen de publicación.
  • changefreq/priority controlan la frecuencia.” No — ambos se ignoran.
  • “Solo actualiza lastmod para que se vuelva a rastrear.” Solo funciona si es verificable y está ligado a un cambio significativo; manipularlo hace que Google desconfíe de él.
  • “Más rastreo significa mejor posicionamiento.” No. Como he escrito en mi guía de presupuesto de rastreo, _“The rate of crawling isn’t going to impact your rankings.” (traducción) «La frecuencia de rastreo no va a afectar tu posicionamiento.» El rastreo es un requisito previo, no un impulso — _“More crawling doesn’t mean you’ll rank better, but if your pages aren’t crawled and indexed they aren’t going to rank at all.” (traducción) «Más rastreo no significa que posicionarás mejor, pero si tus páginas no se rastrean e indexan, no posicionarán en absoluto.»
  • “Existe una programación fija.” No — es dinámica, por URL y adaptativa.
  • “Puedo configurar la frecuencia de rastreo en Search Console.” No — el control deslizante de frecuencia ha desaparecido, y no hay ningún control de frecuencia.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.