Descubrimiento

Cómo descubren URL los buscadores mediante enlaces internos, backlinks, sitemaps, RSS/Atom y protocolos push como IndexNow y la API de indexación. El centro de todo lo relacionado con el descubrimiento.

Publicado por primera vez: 22 jun 2026 · Última actualización: 2 sept 2026 · Avanzado
1 señal de evidencia en esta página

El descubrimiento es el paso de encontrar una página antes de que el buscador la solicite: el motor debe saber que una URL existe para poder rastrearla, indexarla o posicionarla. Es el nombre didáctico que usa este centro para la primera acción de lo que el modelo oficial de Google denomina fase de rastreo. Las URL se descubren por extracción —enlaces internos, backlinks, sitemaps y RSS/Atom— y por notificación —IndexNow, API de indexación, lastmod, WebSub e Inspección de URLs—. Google lo llama «descubrimiento de URL», y es distinto del rastreo y la indexación. Por eso «Descubierta: actualmente sin indexar» significa encontrada, pero todavía no rastreada, y puede tener varias causas.

En resumen: Descubrimiento es el nombre que este centro da al primer movimiento de la búsqueda —descubrir → rastrear → indexar → servir—: el motor debe saber que una URL existe antes de solicitarla. El modelo oficial de Google lo incluye dentro de su etapa de rastreo y no lo presenta como una cuarta fase. Las URL se descubren por pull o extracción —enlaces internos, backlinks, sitemaps y RSS/Atom— y por push o notificación —IndexNow, API de indexación, lastmod, WebSub e Inspección de URLs—. Google llama al paso «descubrimiento de URL». «Descubierta: actualmente sin indexar» significa encontrada, pero aún no rastreada, con varias causas posibles. Las páginas huérfanas son el fallo canónico; IndexNow sirve para Bing y otros, no para Google; la API de indexación solo admite JobPosting/BroadcastEvent; enviar una URL nunca garantiza su indexación.

Evidencia de esta afirmación Google discovers URLs through links, sitemaps, and other previously known signals before crawling and possible indexing. Alcance: Current Google crawling and indexing overview. Confianza: alta · Verificado: Google Search Central: How Search works Evidencia de esta afirmación Sitemaps and indexing requests can aid discovery but do not guarantee crawling, indexing, or serving in results. Alcance: Current Google sitemap and indexing-request behavior. Confianza: alta · Verificado: Google Search Central: Learn about sitemaps

Qué es el descubrimiento de URL

Es el paso de encontrar. Antes de rastrear, indexar o servir una página, el motor debe saber que existe y añadirla a su lista de páginas conocidas. Google lo nombra de forma explícita: “This process is called ‘URL discovery’.” (traducción: «Este proceso se denomina descubrimiento de URL»). También explica: “Some pages are known because Google has already visited them. Other pages are discovered when Google extracts a link from a known page to a new page… Still other pages are discovered when you submit a list of pages (a sitemap) for Google to crawl.” (traducción: «Algunas páginas se conocen porque Google ya las ha visitado. Otras se descubren cuando extrae un enlace desde una página conocida hacia otra nueva… Y otras cuando envías una lista de páginas, un sitemap, para que Google las rastree»).

Evidencia de esta afirmación Google does not guarantee that a discovered or submitted URL will be crawled, indexed, or served. Alcance: web search Confianza: alta · Verificado: In-depth guide to how Google Search works

Ese pasaje resume todo el centro: las páginas se encuentran mediante enlaces internos y externos y mediante sitemaps. Todo lo demás es una variación de esas ideas o una forma de notificar el cambio en vez de esperar a que el motor lo extraiga.

Sobre el modelo de etapas. Aquí tratamos descubrir → rastrear → indexar → servir como cuatro pasos con nombre porque separar «encontrada», «solicitada» y «almacenada» aclara el diagnóstico. Google nombra tres etapas —rastreo, indexación y publicación— y coloca el descubrimiento al principio del rastreo. La secuencia es idéntica; este centro le da nombre propio porque se comporta de forma distinta y suele diagnosticarse mal.

Evidencia de esta afirmación Google's official three-stage model is crawling, indexing, and serving; it places URL discovery at the beginning of the crawling stage rather than defining discovery as a separate official fourth stage. Alcance: web search Confianza: alta · Verificado: In-depth guide to how Google Search works

Descubrimiento frente a rastreo e indexación

Separa estos conceptos y desaparece gran parte de la confusión:

  • Descubrimiento — el motor sabe que una URL existe. Todavía no ha solicitado nada.
  • Rastreo — el motor descarga la URL descubierta y la renderiza. Es el tema del centro Rastreo.
  • Indexación — analiza y almacena la página rastreada para poder servirla.

Google describe la parte posterior con tres etapas: “Google Search works in three stages, and not all pages make it through each stage” (traducción: «La Búsqueda de Google funciona en tres etapas y no todas las páginas superan cada una»): rastreo, indexación y publicación. El descubrimiento es la puerta de entrada a la primera. Ningún paso es por sí mismo un factor de posicionamiento; son requisitos para poder competir. Una URL que no se descubre nunca se rastrea, indexa ni sirve.

Cómo descubren URL los buscadores: extracción frente a notificación

El modelo más claro es pull frente a push. En pull, el motor encuentra URL por sí solo; en push, tú se las notificas.

Pull: el motor la encuentra

Enlaces internos y backlinks. Google explica: “Other pages are discovered when Google extracts a link from a known page to a new page: for example, a hub page, such as a category page, links to a new blog post.” (traducción: «Otras páginas se descubren cuando Google extrae un enlace de una página conocida hacia otra nueva; por ejemplo, una página central o de categoría enlaza a un artículo nuevo»). Un sitio bien enlazado suele permitir descubrir casi todas sus páginas; los sitios nuevos con pocos enlaces externos y los sitios grandes con páginas sin enlazar corren más riesgo. Los enlaces no son la única vía, pero Google los menciona primero y escalan con cada publicación. Por eso el enlazado interno es una de las palancas de mayor impacto y las páginas huérfanas sufren. Un backlink funciona igual: una página externa ya conocida revela tu nueva URL.

Evidencia de esta afirmación Google says it can usually discover most pages on a properly linked site, while new sites with few external links and large sites with unlinked pages have a greater risk of pages not being discovered. Alcance: sitemaps and internal links Confianza: alta · Verificado: What is a sitemap?

Sitemaps. Google: “A sitemap helps search engines discover URLs on your site, but it doesn’t guarantee that all the items in your sitemap will be crawled and indexed.” (traducción: «Un sitemap ayuda a los buscadores a descubrir URL de tu sitio, pero no garantiza que todos sus elementos se rastreen e indexen»). Es una ayuda de descubrimiento, no una garantía. Las guías anidadas explican XML, índices, imágenes y vídeo.

Feeds RSS / Atom. Google acepta feeds como formato de sitemap: “Google accepts RSS 2.0 and Atom 1.0 feeds.” (traducción: «Google acepta feeds RSS 2.0 y Atom 1.0»). Solo muestran URL modificadas recientemente, así que complementan un sitemap completo.

Push: notificas que algo cambió

WebSub (PubSubHubbub). Para RSS/Atom, Google admite WebSub: “If you use Atom or RSS, you can use WebSub to broadcast your changes to search engines, including Google.” (traducción: «Si usas Atom o RSS, puedes usar WebSub para difundir los cambios a los buscadores, incluido Google»). En vez de esperar a una nueva lectura, el feed difunde el cambio.

lastmod del sitemap. Es una señal de frescura que indica que una URL cambió y puede merecer otro rastreo. Bing le concede más peso y afirma que sigue siendo una señal importante para priorizar nuevas solicitudes e indexaciones.

API de indexación de Google: alcance limitado. Solo puede usarse con páginas que contengan JobPosting o BroadcastEvent dentro de VideoObject. No es un endpoint general para enviar cualquier URL, aunque se comercialice así. Para cualquier otro tipo de página, no es la herramienta adecuada.

IndexNow: Bing y otros, no Google. Es un protocolo push que avisa de inmediato cuando una URL se añade, actualiza o elimina. Su FAQ dice: “Search engines adopting the IndexNow protocol agree that submitted URLs will be automatically shared with all other participating search engines.” (traducción: «Los buscadores que adoptan IndexNow acuerdan compartir automáticamente las URL enviadas con los demás motores participantes»). Según la documentación consultada en julio de 2026, participan Microsoft Bing, Yandex, Naver, Seznam.cz y Yep; comprueba la documentación vigente, porque la lista puede cambiar. Google no figura. No existe una página de ayuda de Google que declare «no admitimos IndexNow»: la conclusión se basa en su ausencia de la lista y en comentarios de Googlers sobre pruebas, no en una confirmación oficial. Aun así, notificar solo indica que la URL cambió; cada motor decide si la rastrea o indexa. Para Google, usa enlaces, sitemaps e Inspección de URLs.

Envío manual: Inspección de URLs. Para una sola URL, Google indica: “To request a crawl of individual URLs, use the URL Inspection tool.” (traducción: «Para solicitar el rastreo de URL individuales, usa la herramienta Inspección de URLs»). Repetir no fuerza velocidad: “there’s a quota for submitting individual URLs and requesting a recrawl multiple times for the same URL won’t get it crawled any faster.” (traducción: «existe una cuota y solicitar varias veces otro rastreo de la misma URL no hará que se rastree más rápido»). Bing tiene un canal propio de hasta 10 000 URL al día, separado de IndexNow.

Tanto la extracción como la notificación pueden dar a conocer una URL, pero ninguna evita la cola de rastreo ni garantiza la indexación. Fuente: /technical-seo/how-search-works/discovery/

Dos vías de descubrimiento alimentan una cola de rastreo. La extracción incluye seguir enlaces y leer sitemaps. La notificación incluye IndexNow para los motores participantes, la API de indexación de Google con alcance limitado y señales de frescura como lastmod, RSS o WebSub. Google no usa IndexNow para páginas generales y su API solo admite JobPosting y páginas de emisiones en directo válidas.

© Patrick Stox LLC · CC BY 4.0 ·

Cómo describen el descubrimiento Google y Bing

Ambos motores lo sitúan al principio del proceso. Bing lo incluye directamente en su definición de rastreo. Fabrice Canel: “Crawling is the process by which bingbot discovers new and updated documents or content to be added to Bing’s searchable index.” (traducción: «El rastreo es el proceso mediante el cual bingbot descubre documentos o contenido nuevos y actualizados para añadirlos al índice consultable de Bing»).

La escala importa aunque la cifra exacta cambie. Canel describió a Bing descubriendo decenas de miles de millones de URL normalizadas que nunca había visto, cada día; en agosto de 2022 escribió «12s of billions … never seen before». No he vuelto a verificarlo frente a una fuente primaria vigente, así que debe tomarse como orden de magnitud, no como recuento diario actual. El descubrimiento es una avalancha y los motores reducen prioridades de forma agresiva: ese es el contexto de «Descubierta: actualmente sin indexar».

Páginas huérfanas: cuando falla el descubrimiento

Una página huérfana no recibe enlaces internos. Como los enlaces son una de las dos vías que Google menciona directamente, junto con los sitemaps, solo podrá encontrarse mediante un sitemap, un enlace externo, una redirección o una referencia canónica o hreflang. Si tampoco existe ninguna, quizá no se descubra nunca.

La solución es enlazado interno, no trucos push. Enlaza desde un centro o categoría relevante, exactamente como el ejemplo de Google. Incluir la huérfana en el sitemap ayuda a descubrirla, pero no sustituye la señal de importancia de un enlace interno. Las huérfanas aparecen a menudo como «Descubierta: actualmente sin indexar» porque Google encuentra el registro del sitemap, pero no prioriza una página a la que nada enlaza.

«Descubierta: actualmente sin indexar» en Search Console

Lo seguro es el límite entre etapas. El diagnóstico completo está en la guía específica. Según Google, encontró la página, pero aún no la rastreó: quería solicitarla, esperaba que sobrecargase el sitio y reprogramó el rastreo; por eso no aparece fecha de último rastreo.

En cambio, «Rastreada: actualmente sin indexar» es un problema posterior: Google sí solicitó la página, pero no la indexó y podría hacerlo o no en el futuro.

  • Descubierta: actualmente sin indexar = Google conoce la URL, pero no la ha solicitado. Estado de descubrimiento o programación, con fecha de rastreo vacía.
  • Rastreada: actualmente sin indexar = Google la solicitó, pero decidió no indexarla. Estado de indexación o calidad.

Causas posibles de «Descubierta»: trabaja en este orden y no supongas una sola:

  1. Programación del rastreo o menor prioridad por la carga percibida del servidor, la explicación oficial del propio estado.
  2. Página huérfana o con enlaces internos débiles, que reduce el esfuerzo que Google quiere dedicarle.
  3. Señales generales de calidad o autoridad que reducen la demanda de rastreo del sitio, un patrón del conjunto, no prueba de un fallo en esa URL.
  4. Sitio nuevo o con poca autoridad y poca demanda de rastreo.

Ninguna es la causa universal. Google documenta la programación, pero no ofrece una razón determinista para cada URL. Trátalas como hipótesis. Tampoco implica siempre un fallo: John Mueller afirma “it’s completely normal that we don’t index everything off of the website” (traducción: «es completamente normal que no indexemos todo lo que hay en un sitio») y recomienda reconsiderar la calidad global. Gary Illyes señala que la gran mayoría no necesita pensar en presupuesto de rastreo.

Mi resumen práctico, basado en mi guía de indexación en Ahrefs, es que Descubierta significa conocida, pero no rastreada; Rastreada significa solicitada, pero no indexada y suele apuntar a calidad. Las soluciones se solapan: haz el contenido único, útil y acorde con la intención; elimina noindex, bloqueos de robots o canónicas accidentales; mantén estable el servidor; crea una jerarquía lógica con buenos enlaces internos; solicita otro rastreo una vez y monitoriza. La guía específica explica capacidad, demanda y correcciones paso a paso.

Cómo ayudar al descubrimiento

Por orden aproximado de impacto:

  1. Refuerza los enlaces internos y elimina la condición de huérfana. Los enlaces son una de las dos vías que Google nombra directamente.
  2. Incluye la URL en un sitemap XML limpio, con URL canónicas e indexables y un lastmod exacto. Envía el sitemap a Search Console y Bing Webmaster Tools.
  3. Mejora la calidad global del sitio para aumentar la demanda de rastreo y mover páginas que permanecen en «Descubierta».
  4. Usa Inspección de URLs → Solicitar indexación para una URL importante; existe una cuota y repetir no acelera.
  5. Usa IndexNow para Bing y motores participantes. Google no ofrece un equivalente general: depende de enlaces, sitemaps e Inspección de URLs.

Próximos pasos

Este centro explica cómo se conoce una URL. Las guías anidadas tratan los sitemaps:

Sitemaps

  • Sitemaps — qué son, formatos aceptados y cómo ayudan sin garantizar resultados.
    • Sitemap XML — formato, campos, límites y uso correcto de lastmod.
    • Índice de sitemaps — división y referencia de varios archivos.
    • Sitemap de imágenes — descubrimiento en búsqueda de imágenes.
    • Sitemap de vídeo — contenido de vídeo y metadatos.

Para lo que ocurre después —solicitud, programación, renderizado y presupuesto— consulta Rastreo. IndexNow y la API de indexación también están cerca de esa parte. Para el panorama completo, consulta Cómo funciona la búsqueda. Cada tema anidado es una guía propia y aparece también en el menú lateral.

Añadir una nota de experto

Fijar una cita de experto

¿Es una persona nueva? Crea su perfil sin reclamar en /admin/experts/ → Fijar una cita de experto primero.