Rastreador Bingbot

Qué es Bingbot, qué impulsa más allá de Bing, cómo verificarlo mediante DNS inverso y cómo controlar su rastreo con robots.txt, Crawl Control e IndexNow.

Publicado por primera vez: 24 jun 2026 · Última actualización: 11 ago 2026 · Avanzado
Idiomas
2 señales de evidencia en esta página

Bingbot es el rastreador web de Microsoft Bing: el bot que descubre, obtiene y renderiza páginas para el índice de Bing. Su token de robots.txt es bingbot y, desde que pasó al motor Edge basado en Chromium, es evergreen y renderiza JavaScript moderno. El punto que más profesionales de SEO pasan por alto es que ese mismo índice alimenta Yahoo, DuckDuckGo, Ecosia y Copilot, así que bloquear bingbot te cuesta mucho más que la pequeña cuota de mercado de Bing. Verifícalo mediante el DNS inverso en dos pasos (las cadenas de user-agent se pueden suplantar), no con la lista de IP publicada. Contrólalo con robots.txt, Crawl Control en Bing Webmaster Tools e IndexNow, el protocolo de Bing de enviar cambios en lugar de esperar.

TL;DR — Bingbot es el rastreador de Microsoft Bing (token de robots.txt: bingbot), activo desde el 1 de octubre de 2010, cuando sustituyó a MSNBot. Es evergreen y utiliza el motor Edge basado en Chromium, por lo que renderiza JavaScript moderno. Su alcance real es mayor que el tráfico atribuido directamente a bing.com porque Microsoft utiliza su infraestructura de búsqueda en productos y asociaciones. Verifícalo mediante el método de verificación documentado por Bing en lugar de confiar en la cadena de user-agent. Gestiona el rastreo con robots.txt, Crawl Control en Bing Webmaster Tools e IndexNow, el protocolo de envío de Bing creado junto con Yandex.

Evidence for this claim Bingbot is Microsoft's crawler for Bing search services and identifies itself with documented user-agent strings. Scope: Current Microsoft Bingbot documentation. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Bingbot Evidence for this claim Microsoft recommends verifying Bingbot through reverse and forward DNS rather than trusting the user-agent string alone. Scope: Current Bingbot verification method. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Verify Bingbot

De MSNBot a Bingbot

Bingbot es el rastreador web principal de Microsoft: el programa que descubre, obtiene y procesa páginas para construir y actualizar el índice de Bing. Entró en funcionamiento el 1 de octubre de 2010 y sustituyó al MSNBot heredado. La transición incluyó una regla de robots.txt que sigue importando si aún conservas directivas antiguas: el anuncio de Microsoft decía que “as of October 1st, if we detect separate sets of custom directives for both MSNBot and BingBot in your robots.txt file, the BingBot directives will take precedence.” (traducción) «a partir del 1 de octubre, si detectamos conjuntos separados de directivas personalizadas para MSNBot y BingBot en tu archivo robots.txt, prevalecerán las directivas de BingBot». Por tanto, las reglas de MSNBot no anulan silenciosamente las de Bingbot: ocurre al revés.

Bingbot impulsa más que Bing

Este es el replanteamiento más importante de esta página. La cuota directa de Bing en el mercado de búsquedas es pequeña, lo que hace que muchos profesionales de SEO lo pasen por alto. Pero el índice que construye Bingbot también alimenta Yahoo Search, DuckDuckGo, Ecosia, la búsqueda predeterminada de Edge y Microsoft Copilot, y en el pasado también impulsó ChatGPT Search. La dependencia de Yahoo se remonta al lanzamiento de 2010, cuando Microsoft advirtió a los propietarios de sitios: “To keep your content in the Bing index, please ensure that BingBot has the same access to your site as given to MSNBot.” (traducción) «Para mantener tu contenido en el índice de Bing, asegúrate de que BingBot tenga el mismo acceso a tu sitio que MSNBot».

La consecuencia práctica es que un Disallow contra bingbot no te cuesta «solo Bing». Se extiende por todo ese ecosistema de una vez. Te importe Bing específicamente o no, Bingbot es la puerta de entrada a una parte importante de la web consultable y, cada vez más, a las respuestas de IA.

La cadena de user-agent (y por qué es evergreen)

El user-agent de Bingbot contiene el token bingbot/2.0 y un número de versión de Chromium Chrome/W.X.Y.Z, donde W.X.Y.Z se sustituye por la compilación estable actual de Microsoft Edge (el ejemplo de Microsoft es 100.0.4896.127); esa sustitución es lo que hace que la cadena sea evergreen. Según el anuncio de Microsoft de abril de 2022 sobre las cadenas definitivas, el UA de escritorio es Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm) Chrome/W.X.Y.Z Safari/537.36 y el UA móvil es Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/W.X.Y.Z Mobile Safari/537.36 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm). La vista previa anterior de Microsoft, de diciembre de 2019, también había propuesto un fragmento final adicional Edg/W.X.Y.Z, pero ese fragmento no aparece en las cadenas definitivas que Microsoft publicó en 2022 y confirmó plenamente activas en febrero de 2023; si haces coincidir el UA de bingbot en código, no lo exijas. La cadena heredada más antigua era la simple Mozilla/5.0 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm).

«Evergreen» significa exactamente que el número de versión sigue automáticamente la última versión estable de Edge. En la práctica, esto eliminó la antigua diferencia entre dos niveles de rastreo y renderización: como Bingbot utiliza la misma familia de motores Chromium que Edge y Chrome modernos, renderiza JavaScript como un navegador actual. Bing también considera que la renderización dinámica de buena fe es una opción legítima para sitios con mucho JS: desde su perspectiva, no es cloaking.

Verificar Bingbot: el user-agent no basta

Las cadenas de user-agent se pueden suplantar trivialmente, así que una solicitud que afirma ser de Bingbot no demuestra nada por sí sola. La comprobación fiable es el DNS inverso en dos pasos:

  1. Búsqueda inversa (PTR) de la IP que rastrea en tus logs. Una IP auténtica de Bingbot resuelve a un nombre de host que termina en search.msn.com; el patrón es msnbot-<ip-with-dashes>.search.msn.com (por ejemplo, 157.55.39.1msnbot-157-55-39-1.search.msn.com).
  2. Búsqueda directa (A) de ese nombre de host. Debe volver a resolver a la IP original.

Si cualquiera de los dos pasos falla, no es Bingbot. Microsoft publica una lista de IP en bing.com/toolbox/bingbot.json (28 prefijos IPv4, generada por última vez en enero de 2024), pero la propia empresa recomienda preferir el DNS inverso a la lista de IP, porque las direcciones pueden cambiar en cualquier momento. Trata el JSON como una referencia aproximada, no como una lista de autorización para el cortafuegos. (La misma lógica de DNS inverso por encima de la lista de IP se aplica a Googlebot; consulta los scripts de verificación en la pestaña Scripts).

Cómo descubre y rastrea Bingbot

El descubrimiento se basa en los enlaces. Fabrice Canel, responsable de Bingbot durante mucho tiempo en Microsoft, describe el enfoque como seguir la importancia: “We are guided by key pages that are important on the internet and we follow links to understand what’s next.” (traducción) «Nos guiamos por las páginas clave que son importantes en internet y seguimos enlaces para entender qué viene después». La escala es enorme: en una entrevista de 2019, Canel dijo que “Every day, my team discovers more than 100 billion new URLs never seen before, while useless URLs parameters are ignored.” (traducción) «Cada día, mi equipo descubre más de 100 000 millones de URL nuevas que nunca se habían visto, mientras ignora los parámetros de URL inútiles». (Una cifra de 2020 situó el descubrimiento de URL nuevas en unos 70 000 millones al día; ambas cifras son reales y corresponden a fechas distintas, así que conviene mantener el año cuando cites cualquiera de ellas.)

Dos comportamientos distinguen a Bingbot de la forma en que Google describe su propio rastreador:

  • Prefiltrado antes de obtener la URL. Bingbot juzga el coste y el valor antes de descargarla. Como ha explicado Bing, “Pages that are deemed to have absolutely no potential for being useful in satisfying a user’s search query in Bing results are not retained.” (traducción) «Las páginas que se considera que no tienen absolutamente ningún potencial para ser útiles a la hora de satisfacer una consulta de búsqueda en los resultados de Bing no se conservan».
  • Memoria de URL. Bingbot recuerda las URL esencialmente para siempre: “Bingbot retains every URL in memory and comes back and recrawls intermittently, even if all links to it have been removed.” (traducción) «Bingbot conserva todas las URL en la memoria y vuelve a rastrearlas de forma intermitente, aunque se hayan eliminado todos sus enlaces». Por eso una página puede seguir recibiendo visitas de Bingbot mucho después de que hayas quitado todos los enlaces internos que apuntaban a ella.

Debajo de todo esto hay una postura que prioriza la cortesía. Canel: “Our default crawl policy is to be as polite as possible when crawling the web.” (traducción) «Nuestra política de rastreo predeterminada consiste en ser lo más respetuosos posible al rastrear la web». Y su opinión sincera sobre el problema en sí: “Crawling right is a fascinating engineering problem that hasn’t fully been solved yet.” (traducción) «Rastrear correctamente es un problema de ingeniería fascinante que todavía no se ha resuelto por completo».

Otros rastreadores de Microsoft

Bingbot no es el único bot de Microsoft que verás:

  • AdIdxBot (adidxbot): el rastreador de control de calidad de Bing Ads. El detalle importante es que comparte el presupuesto de rastreo con Bingbot, así que un rastreo publicitario intenso puede consumir el presupuesto de tus páginas orgánicas.
  • BingPreview: genera instantáneas y miniaturas de vista previa de las páginas.
  • MicrosoftPreview: vistas previas de enlaces en Teams y Office.
  • BingVideoPreview: vistas previas de vídeo que solo se muestran en Bing. Como los demás, tiene variantes de escritorio y móvil, y se identifica mediante +https://aka.ms/microsoftbots en lugar de la URL bingbot.htm que utilizan los rastreadores antiguos.
  • MSNBot / MSNBot-Media: el rastreador heredado, retirado el 1 de octubre de 2010.

Cómo controlar el rastreo de Bingbot

Tres palancas, de la más brusca a la más quirúrgica:

  • robots.txt: el token bingbot controla el rastreo. Úsalo para mantener al bot fuera de espacios de poco valor; no es una herramienta para desindexar.
  • Crawl Control (Bing Webmaster Tools): permite establecer la tasa de rastreo por hora de Bingbot, de modo que puedas ralentizarlo durante las horas punta y dejarlo correr más rápido fuera de ellas. Esta es una divergencia real entre Google y Bing: Google retiró el control deslizante de tasa de rastreo de Search Console, mientras que Bing todavía ofrece un control activo.
  • IndexNow: en lugar de esperar a que vuelva a rastrear, envías el cambio. Es un protocolo “created by Microsoft Bing and Yandex, allowing websites to easily notify search engines whenever their website content is created, updated, or deleted.” (traducción) «creado por Microsoft Bing y Yandex, que permite a los sitios web avisar fácilmente a los motores de búsqueda cada vez que se crea, actualiza o elimina contenido». Un ping llega a todos los motores participantes. No repetiré aquí el tratamiento completo: consulta la guía detallada de IndexNow para la configuración, el archivo de clave y el límite de 10 000 URL por solicitud.

El punto estratégico al que siempre vuelvo es que Bing corrigió su reputación de rastreo agresivo volviéndose eficiente, e IndexNow es la pieza central. Como escribí en mi análisis del rastreo de bots de IA y motores de búsqueda, “It’s estimated that 53% of crawler traffic is wasted effort, and IndexNow can help cut that number down to almost nothing.” (traducción) «Se estima que el 53 % del tráfico de rastreadores es esfuerzo desperdiciado, e IndexNow puede ayudar a reducir esa cifra casi a cero». Enviar cambios supera a intentar inducir más rastreo exploratorio.

Bingbot, Copilot y la brecha de exclusión voluntaria de la IA

Como el índice de Bing alimenta Microsoft Copilot, Bingbot es en la práctica también un rastreador de IA. Las indicaciones de Canel para aparecer bien allí son concretas: “schema markup helps Microsoft’s LLMs understand your content,” (traducción) «el marcado de schema ayuda a los LLM de Microsoft a entender tu contenido», y “Gen AIs value fresh content in particular, partly as a reference check of their LLM training data. Use the API at indexnow.org to push that information as it’s published or updated.” (traducción) «las IA generativas conceden especial valor al contenido reciente, en parte porque lo contrastan con los datos con los que se entrenaron sus LLM. Usa la API de indexnow.org para enviar esa información al publicarla o actualizarla».

Hay un matiz que los artículos de la competencia suelen omitir. Google ofrece un token Google-Extended que permite excluirse del entrenamiento de IA sin afectar a la indexación de búsqueda. Según la mayoría de las interpretaciones de terceros, no existe una exclusión separada equivalente para Bing, lo que significa que bloquear bingbot para mantenerte fuera del entrenamiento de Copilot también te sacaría de la búsqueda de Bing y de todo lo que dependa de ella. Lo trataría como una observación sobre cómo encajan actualmente los controles, no como una política cerrada de Microsoft, y comprobaría la documentación actual antes de actuar.

Para saber dónde encaja Bingbot en el panorama general —la familia de rastreadores, Googlebot, el concepto de user-agent, los rastreadores de IA, robots.txt e IndexNow—, el hub de rastreo lo conecta todo.

Add an expert note

Pin an expert quote

New person? Create their unclaimed profile at /admin/experts/ → Pin a quote first.