Rastreador Bingbot
Qué es Bingbot, qué impulsa más allá de Bing, cómo verificarlo mediante DNS inverso y cómo controlar su rastreo con robots.txt, Crawl Control e IndexNow.
Idiomas
2 señales de evidencia en esta página
- Datos de origen enlazadosBingbot IP list (bingbot.json)
- Herramienta activa relacionadaGooglebot Verifier
Bingbot es el rastreador web de Microsoft Bing: el bot que descubre, obtiene y renderiza páginas para el índice de Bing. Su token de robots.txt es bingbot y, desde que pasó al motor Edge basado en Chromium, es evergreen y renderiza JavaScript moderno. El punto que más profesionales de SEO pasan por alto es que ese mismo índice alimenta Yahoo, DuckDuckGo, Ecosia y Copilot, así que bloquear bingbot te cuesta mucho más que la pequeña cuota de mercado de Bing. Verifícalo mediante el DNS inverso en dos pasos (las cadenas de user-agent se pueden suplantar), no con la lista de IP publicada. Contrólalo con robots.txt, Crawl Control en Bing Webmaster Tools e IndexNow, el protocolo de Bing de enviar cambios en lugar de esperar.
Evidence for this claim Bingbot is Microsoft's crawler for Bing search services and identifies itself with documented user-agent strings. Scope: Current Microsoft Bingbot documentation. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Bingbot Evidence for this claim Microsoft recommends verifying Bingbot through reverse and forward DNS rather than trusting the user-agent string alone. Scope: Current Bingbot verification method. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Verify BingbotTL;DR — Bingbot es el rastreador de Microsoft Bing: el bot que visita tus páginas, las descarga y las añade al índice de búsqueda de Bing. Funciona de forma muy parecida a Googlebot. Bloquearlo impide que Bing rastree las URL afectadas y también puede afectar a productos o socios que utilizan la infraestructura de búsqueda de Bing, así que verifica el impacto con la documentación actual de Microsoft.
Qué es Bingbot
Cuando ves bingbot en los logs de tu servidor, es el rastreador de Microsoft visitando tu sitio. Igual que Googlebot trabaja para Google, Bingbot sigue enlaces, lee sitemaps, descarga tus páginas y las entrega para añadirlas al índice de Bing, la base de datos de la que Bing obtiene resultados cuando alguien busca.
Se lanzó el 1 de octubre de 2010 y sustituyó a un bot anterior llamado MSNBot. El nombre que verás en robots.txt y en tus logs es simplemente bingbot.
Por qué importa más de lo que parece
Esta es la parte que sorprende a la gente. La cuota de Bing en el mercado de búsquedas es pequeña, así que resulta tentador ignorar Bingbot por completo. Pero el índice de Bing que construye Bingbot no alimenta solo a Bing. También impulsa:
- Yahoo Search
- DuckDuckGo
- Ecosia
- La búsqueda predeterminada de Microsoft Edge
- Microsoft Copilot
Así que, si bloqueas Bingbot, no desapareces solo de Bing: te desconectas de todos esos servicios a la vez. Es un problema mucho mayor de lo que parece cuando se resume como «un 3 % de cuota de mercado».
¿Puede Bingbot leer JavaScript?
Sí. Antes preocupaba que Bing no pudiera gestionar sitios con mucho JavaScript, pero Bingbot ahora funciona con el mismo motor Chromium que impulsa Microsoft Edge, así que renderiza las páginas como un navegador moderno. Si tu contenido aparece en una versión actual de Edge o Chrome, por lo general Bingbot también puede verlo.
Cómo ayudar a Bingbot (o detenerlo)
- Para dejarlo entrar: asegúrate de que tus páginas importantes estén enlazadas, envía un sitemap en Bing Webmaster Tools y no las bloquees accidentalmente en
robots.txt. - Para ralentizarlo: Bing Webmaster Tools tiene una función llamada Crawl Control que permite establecer la velocidad a la que Bingbot rastrea hora a hora.
- Para acelerar las cosas: existe una opción de «envío» llamada IndexNow que permite avisar a Bing en cuanto cambia una página, en lugar de esperar al siguiente rastreo.
¿Quieres la versión técnica: las cadenas de user-agent, cómo verificar que una solicitud es realmente de Bingbot, los otros rastreadores de Microsoft y cómo Bingbot alimenta Copilot? Cambia a la pestaña Avanzado.
Evidence for this claim Bingbot is Microsoft's crawler for Bing search services and identifies itself with documented user-agent strings. Scope: Current Microsoft Bingbot documentation. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Bingbot Evidence for this claim Microsoft recommends verifying Bingbot through reverse and forward DNS rather than trusting the user-agent string alone. Scope: Current Bingbot verification method. Confidence: high · Verified: Microsoft Bing Webmaster Tools: Verify BingbotTL;DR — Bingbot es el rastreador de Microsoft Bing (token de
robots.txt:bingbot), activo desde el 1 de octubre de 2010, cuando sustituyó a MSNBot. Es evergreen y utiliza el motor Edge basado en Chromium, por lo que renderiza JavaScript moderno. Su alcance real es mayor que el tráfico atribuido directamente a bing.com porque Microsoft utiliza su infraestructura de búsqueda en productos y asociaciones. Verifícalo mediante el método de verificación documentado por Bing en lugar de confiar en la cadena de user-agent. Gestiona el rastreo conrobots.txt, Crawl Control en Bing Webmaster Tools e IndexNow, el protocolo de envío de Bing creado junto con Yandex.
De MSNBot a Bingbot
Bingbot es el rastreador web principal de Microsoft: el programa que descubre, obtiene y procesa páginas para construir y actualizar el índice de Bing. Entró en funcionamiento el 1 de octubre de 2010 y sustituyó al MSNBot heredado. La transición incluyó una regla de robots.txt que sigue importando si aún conservas directivas antiguas: el anuncio de Microsoft decía que “as of October 1st, if we detect separate sets
of custom directives for both MSNBot and BingBot in your robots.txt file, the
BingBot directives will take precedence.” (traducción) «a partir del 1 de octubre, si detectamos conjuntos separados de directivas personalizadas para MSNBot y BingBot en tu archivo robots.txt, prevalecerán las directivas de BingBot». Por tanto, las reglas de MSNBot no anulan silenciosamente las de Bingbot: ocurre al revés.
Bingbot impulsa más que Bing
Este es el replanteamiento más importante de esta página. La cuota directa de Bing en el mercado de búsquedas es pequeña, lo que hace que muchos profesionales de SEO lo pasen por alto. Pero el índice que construye Bingbot también alimenta Yahoo Search, DuckDuckGo, Ecosia, la búsqueda predeterminada de Edge y Microsoft Copilot, y en el pasado también impulsó ChatGPT Search. La dependencia de Yahoo se remonta al lanzamiento de 2010, cuando Microsoft advirtió a los propietarios de sitios: “To keep your content in the Bing index, please ensure that BingBot has the same access to your site as given to MSNBot.” (traducción) «Para mantener tu contenido en el índice de Bing, asegúrate de que BingBot tenga el mismo acceso a tu sitio que MSNBot».
La consecuencia práctica es que un Disallow contra bingbot no te cuesta «solo Bing». Se extiende por todo ese ecosistema de una vez. Te importe Bing específicamente o no, Bingbot es la puerta de entrada a una parte importante de la web consultable y, cada vez más, a las respuestas de IA.
La cadena de user-agent (y por qué es evergreen)
El user-agent de Bingbot contiene el token bingbot/2.0 y un número de versión de Chromium Chrome/W.X.Y.Z, donde W.X.Y.Z se sustituye por la compilación estable actual de Microsoft Edge (el ejemplo de Microsoft es 100.0.4896.127); esa sustitución es lo que hace que la cadena sea evergreen. Según el anuncio de Microsoft de abril de 2022 sobre las cadenas definitivas, el UA de escritorio es Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm) Chrome/W.X.Y.Z Safari/537.36 y el UA móvil es Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/W.X.Y.Z Mobile Safari/537.36 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm). La vista previa anterior de Microsoft, de diciembre de 2019, también había propuesto un fragmento final adicional Edg/W.X.Y.Z, pero ese fragmento no aparece en las cadenas definitivas que Microsoft publicó en 2022 y confirmó plenamente activas en febrero de 2023; si haces coincidir el UA de bingbot en código, no lo exijas. La cadena heredada más antigua era la simple Mozilla/5.0 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm).
«Evergreen» significa exactamente que el número de versión sigue automáticamente la última versión estable de Edge. En la práctica, esto eliminó la antigua diferencia entre dos niveles de rastreo y renderización: como Bingbot utiliza la misma familia de motores Chromium que Edge y Chrome modernos, renderiza JavaScript como un navegador actual. Bing también considera que la renderización dinámica de buena fe es una opción legítima para sitios con mucho JS: desde su perspectiva, no es cloaking.
Verificar Bingbot: el user-agent no basta
Las cadenas de user-agent se pueden suplantar trivialmente, así que una solicitud que afirma ser de Bingbot no demuestra nada por sí sola. La comprobación fiable es el DNS inverso en dos pasos:
- Búsqueda inversa (PTR) de la IP que rastrea en tus logs. Una IP auténtica de Bingbot resuelve a un nombre de host que termina en
search.msn.com; el patrón esmsnbot-<ip-with-dashes>.search.msn.com(por ejemplo,157.55.39.1→msnbot-157-55-39-1.search.msn.com). - Búsqueda directa (A) de ese nombre de host. Debe volver a resolver a la IP original.
Si cualquiera de los dos pasos falla, no es Bingbot. Microsoft publica una lista de IP en bing.com/toolbox/bingbot.json (28 prefijos IPv4, generada por última vez en enero de 2024), pero la propia empresa recomienda preferir el DNS inverso a la lista de IP, porque las direcciones pueden cambiar en cualquier momento. Trata el JSON como una referencia aproximada, no como una lista de autorización para el cortafuegos. (La misma lógica de DNS inverso por encima de la lista de IP se aplica a Googlebot; consulta los scripts de verificación en la pestaña Scripts).
Cómo descubre y rastrea Bingbot
El descubrimiento se basa en los enlaces. Fabrice Canel, responsable de Bingbot durante mucho tiempo en Microsoft, describe el enfoque como seguir la importancia: “We are guided by key pages that are important on the internet and we follow links to understand what’s next.” (traducción) «Nos guiamos por las páginas clave que son importantes en internet y seguimos enlaces para entender qué viene después». La escala es enorme: en una entrevista de 2019, Canel dijo que “Every day, my team discovers more than 100 billion new URLs never seen before, while useless URLs parameters are ignored.” (traducción) «Cada día, mi equipo descubre más de 100 000 millones de URL nuevas que nunca se habían visto, mientras ignora los parámetros de URL inútiles». (Una cifra de 2020 situó el descubrimiento de URL nuevas en unos 70 000 millones al día; ambas cifras son reales y corresponden a fechas distintas, así que conviene mantener el año cuando cites cualquiera de ellas.)
Dos comportamientos distinguen a Bingbot de la forma en que Google describe su propio rastreador:
- Prefiltrado antes de obtener la URL. Bingbot juzga el coste y el valor antes de descargarla. Como ha explicado Bing, “Pages that are deemed to have absolutely no potential for being useful in satisfying a user’s search query in Bing results are not retained.” (traducción) «Las páginas que se considera que no tienen absolutamente ningún potencial para ser útiles a la hora de satisfacer una consulta de búsqueda en los resultados de Bing no se conservan».
- Memoria de URL. Bingbot recuerda las URL esencialmente para siempre: “Bingbot retains every URL in memory and comes back and recrawls intermittently, even if all links to it have been removed.” (traducción) «Bingbot conserva todas las URL en la memoria y vuelve a rastrearlas de forma intermitente, aunque se hayan eliminado todos sus enlaces». Por eso una página puede seguir recibiendo visitas de Bingbot mucho después de que hayas quitado todos los enlaces internos que apuntaban a ella.
Debajo de todo esto hay una postura que prioriza la cortesía. Canel: “Our default crawl policy is to be as polite as possible when crawling the web.” (traducción) «Nuestra política de rastreo predeterminada consiste en ser lo más respetuosos posible al rastrear la web». Y su opinión sincera sobre el problema en sí: “Crawling right is a fascinating engineering problem that hasn’t fully been solved yet.” (traducción) «Rastrear correctamente es un problema de ingeniería fascinante que todavía no se ha resuelto por completo».
Otros rastreadores de Microsoft
Bingbot no es el único bot de Microsoft que verás:
- AdIdxBot (
adidxbot): el rastreador de control de calidad de Bing Ads. El detalle importante es que comparte el presupuesto de rastreo con Bingbot, así que un rastreo publicitario intenso puede consumir el presupuesto de tus páginas orgánicas. - BingPreview: genera instantáneas y miniaturas de vista previa de las páginas.
- MicrosoftPreview: vistas previas de enlaces en Teams y Office.
- BingVideoPreview: vistas previas de vídeo que solo se muestran en Bing. Como los demás, tiene variantes de escritorio y móvil, y se identifica mediante
+https://aka.ms/microsoftbotsen lugar de la URLbingbot.htmque utilizan los rastreadores antiguos. - MSNBot / MSNBot-Media: el rastreador heredado, retirado el 1 de octubre de 2010.
Cómo controlar el rastreo de Bingbot
Tres palancas, de la más brusca a la más quirúrgica:
robots.txt: el tokenbingbotcontrola el rastreo. Úsalo para mantener al bot fuera de espacios de poco valor; no es una herramienta para desindexar.- Crawl Control (Bing Webmaster Tools): permite establecer la tasa de rastreo por hora de Bingbot, de modo que puedas ralentizarlo durante las horas punta y dejarlo correr más rápido fuera de ellas. Esta es una divergencia real entre Google y Bing: Google retiró el control deslizante de tasa de rastreo de Search Console, mientras que Bing todavía ofrece un control activo.
- IndexNow: en lugar de esperar a que vuelva a rastrear, envías el cambio. Es un protocolo “created by Microsoft Bing and Yandex, allowing websites to easily notify search engines whenever their website content is created, updated, or deleted.” (traducción) «creado por Microsoft Bing y Yandex, que permite a los sitios web avisar fácilmente a los motores de búsqueda cada vez que se crea, actualiza o elimina contenido». Un ping llega a todos los motores participantes. No repetiré aquí el tratamiento completo: consulta la guía detallada de IndexNow para la configuración, el archivo de clave y el límite de 10 000 URL por solicitud.
El punto estratégico al que siempre vuelvo es que Bing corrigió su reputación de rastreo agresivo volviéndose eficiente, e IndexNow es la pieza central. Como escribí en mi análisis del rastreo de bots de IA y motores de búsqueda, “It’s estimated that 53% of crawler traffic is wasted effort, and IndexNow can help cut that number down to almost nothing.” (traducción) «Se estima que el 53 % del tráfico de rastreadores es esfuerzo desperdiciado, e IndexNow puede ayudar a reducir esa cifra casi a cero». Enviar cambios supera a intentar inducir más rastreo exploratorio.
Bingbot, Copilot y la brecha de exclusión voluntaria de la IA
Como el índice de Bing alimenta Microsoft Copilot, Bingbot es en la práctica también un rastreador de IA. Las indicaciones de Canel para aparecer bien allí son concretas: “schema markup helps Microsoft’s LLMs understand your content,” (traducción) «el marcado de schema ayuda a los LLM de Microsoft a entender tu contenido», y “Gen AIs value fresh content in particular, partly as a reference check of their LLM training data. Use the API at indexnow.org to push that information as it’s published or updated.” (traducción) «las IA generativas conceden especial valor al contenido reciente, en parte porque lo contrastan con los datos con los que se entrenaron sus LLM. Usa la API de indexnow.org para enviar esa información al publicarla o actualizarla».
Hay un matiz que los artículos de la competencia suelen omitir. Google ofrece un token Google-Extended que permite excluirse del entrenamiento de IA sin afectar a la indexación de búsqueda. Según la mayoría de las interpretaciones de terceros, no existe una exclusión separada equivalente para Bing, lo que significa que bloquear bingbot para mantenerte fuera del entrenamiento de Copilot también te sacaría de la búsqueda de Bing y de todo lo que dependa de ella. Lo trataría como una observación sobre cómo encajan actualmente los controles, no como una política cerrada de Microsoft, y comprobaría la documentación actual antes de actuar.
Para saber dónde encaja Bingbot en el panorama general —la familia de rastreadores, Googlebot, el concepto de user-agent, los rastreadores de IA, robots.txt e IndexNow—, el hub de rastreo lo conecta todo.
Resumen de IA
Una síntesis de la versión Avanzada:
- Bingbot = el rastreador de Microsoft Bing. Token de
robots.txt:bingbot; activo desde el 1 de octubre de 2010, cuando sustituyó a MSNBot (y las directivas de BingBot tienen prioridad sobre las de MSNBot que queden). - Alcance > cuota de mercado. El índice que construye Bingbot también impulsa Yahoo, DuckDuckGo, Ecosia, la búsqueda predeterminada de Edge y Copilot, así que bloquear
bingbotse extiende mucho más allá de Bing. - Renderización evergreen. Funciona con el motor Edge basado en Chromium; el UA lleva el token
bingbot/2.0y un número de versiónChrome/W.X.Y.Zsustituido por la compilación estable actual de Edge (no hay un fragmento independienteEdg/en las cadenas definitivas de 2022). Renderiza JavaScript moderno y la renderización dinámica de buena fe no es cloaking. - Verifica mediante DNS inverso en dos pasos: PTR hacia
msnbot-*.search.msn.comy después una búsqueda directa que coincida con la IP. Los user-agents se pueden suplantar; prefiere el DNS inverso a la lista de IP debingbot.json, que cambia. - Cómo rastrea: sigue «key pages» (traducción) «páginas clave» y enlaces, descubre aproximadamente 100 000 millones de URL nuevas al día (2019; aproximadamente 70 000 millones en una cifra de 2020), prefiltra las URL con «no potential» (traducción) «ningún potencial» antes de obtenerlas y conserva todas las URL en memoria, incluso cuando se han eliminado todos sus enlaces.
- Otros bots de Microsoft: AdIdxBot (comparte el presupuesto de rastreo de Bingbot), BingPreview, MicrosoftPreview y BingVideoPreview; MSNBot está retirado.
- Contrólalo con
robots.txt, Crawl Control (tasa por hora; Google retiró su equivalente) e IndexNow (envío creado junto con Yandex). El planteamiento de Patrick: aproximadamente el 53 % del tráfico de rastreadores es esfuerzo desperdiciado e IndexNow lo reduce casi a cero. - Ángulo de IA: Bingbot alimenta Copilot; el schema y el contenido reciente ayudan; no existe un equivalente claro de Bing a Google-Extended, así que bloquearlo para el entrenamiento de IA también te saca de la búsqueda (trátalo como una observación y verifica la documentación actual).
Documentación oficial
Documentación de fuentes primarias, principalmente de Microsoft/Bing, con un enlace de contraste de Google. Atención: muchas entradas de blogs.bing.com y páginas de bing.com/webmasters/help se renderizan mediante JavaScript o redirigen, así que confirma los detalles en un navegador si un enlace rebota.
Bing / Microsoft
- ¿Qué rastreadores utiliza Bing?: lista oficial de bots de Microsoft y sus tokens de user-agent (Bingbot, AdIdxBot y los rastreadores de vista previa).
- Anuncio del cambio de user-agent del rastreador Bingbot: cadenas UA definitivas de escritorio y móvil de Microsoft (confirmadas plenamente activas en febrero de 2023); es la fuente de las cadenas exactas citadas arriba.
- Bingbot IP list (bingbot.json): prefijos IPv4 publicados. Úsala solo como referencia; Microsoft recomienda el DNS inverso.
- Verify Bingbot tool: búsqueda en línea de Microsoft para confirmar que una IP que rastrea es realmente Bingbot.
- Bing Webmaster Tools — Crawl Control: configura la tasa de rastreo de Bingbot por hora.
- IndexNow / indexnow.org: protocolo de envío para avisar al instante de URL creadas, actualizadas o eliminadas.
- bingbot Series: Maximizing Crawl Efficiency: filosofía de Bing sobre la «eficiencia del rastreo».
Google (para contrastar)
- Overview of Google crawlers and fetchers: user-agents y rangos de IP de Googlebot, el paralelismo con la configuración de Bing. Observa las diferencias: Google retiró el control manual de tasa de rastreo, no utiliza IndexNow para páginas generales y ofrece
Google-Extendedpara excluirse del entrenamiento de IA por separado de la búsqueda.
Citas de la fuente
Declaraciones públicas sobre Bingbot, principalmente de Fabrice Canel, responsable de Bingbot en Microsoft. Cada enlace es un enlace profundo que salta al pasaje citado.
Fabrice Canel, Microsoft Bing: descubrimiento y escala
- “We are guided by key pages that are important on the internet and we follow links to understand what’s next.” (traducción) «Nos guiamos por las páginas clave que son importantes en internet y seguimos enlaces para entender qué viene después». Saltar a la cita
- “Every day, my team discovers more than 100 billion new URLs never seen before, while useless URLs parameters are ignored.” (traducción) «Cada día, mi equipo descubre más de 100 000 millones de URL nuevas que nunca se habían visto, mientras ignora los parámetros de URL inútiles». (Entrevista de Search Engine Journal, 2019). Saltar a la cita
- “Crawling right is a fascinating engineering problem that hasn’t fully been solved yet.” (traducción) «Rastrear correctamente es un problema de ingeniería fascinante que todavía no se ha resuelto por completo». (SEJ, 2019). Saltar a la cita
- “Our default crawl policy is to be as polite as possible when crawling the web.” (traducción) «Nuestra política de rastreo predeterminada consiste en ser lo más respetuosos posible al rastrear la web». (SEJ, 2019). Saltar a la cita
Microsoft Bing: cómo gestiona Bingbot las URL
- “Bingbot retains every URL in memory and comes back and recrawls intermittently, even if all links to it have been removed.” (traducción) «Bingbot conserva todas las URL en la memoria y vuelve a rastrearlas de forma intermitente, aunque se hayan eliminado todos sus enlaces». Saltar a la cita
- “Pages that are deemed to have absolutely no potential for being useful in satisfying a user’s search query in Bing results are not retained.” (traducción) «Las páginas que se considera que no tienen absolutamente ningún potencial para ser útiles a la hora de satisfacer una consulta de búsqueda en los resultados de Bing no se conservan». Saltar a la cita
Fabrice Canel, Microsoft Bing: eficiencia, schema e IA
- “Less is more for SEO. Never forget that. Less URLs to crawl, better for SEO.” (traducción) «Menos es más para el SEO. No lo olvides nunca. Menos URL que rastrear, mejor para el SEO». Saltar a la cita
- “schema markup helps Microsoft’s LLMs understand your content.” (traducción) «el marcado de schema ayuda a los LLM de Microsoft a entender tu contenido» (SMX Munich, 2025). Saltar a la cita
- “Gen AIs value fresh content in particular, partly as a reference check of their LLM training data. Use the API at indexnow.org to push that information as it’s published or updated.” (traducción) «Las IA generativas valoran especialmente el contenido reciente, en parte como comprobación de referencia de sus datos de entrenamiento. Utiliza la API de indexnow.org para enviar esa información cuando se publique o actualice». Saltar a la cita
Microsoft Bing: el lanzamiento de 2010 e IndexNow
- “as of October 1st, if we detect separate sets of custom directives for both MSNBot and BingBot in your robots.txt file, the BingBot directives will take precedence.” (traducción) «a partir del 1 de octubre, si detectamos conjuntos separados de directivas personalizadas para MSNBot y BingBot en tu archivo robots.txt, prevalecerán las directivas de BingBot» (blog de Bing Webmaster, 2010).
- “To keep your content in the Bing index, please ensure that BingBot has the same access to your site as given to MSNBot.” (traducción) «Para mantener tu contenido en el índice de Bing, asegúrate de que BingBot tenga el mismo acceso a tu sitio que MSNBot» (blog de Bing Webmaster, 2010).
- “IndexNow is a new protocol created by Microsoft Bing and Yandex, allowing websites to easily notify search engines whenever their website content is created, updated, or deleted.” (traducción) «IndexNow es un protocolo nuevo creado por Microsoft Bing y Yandex que permite a los sitios web avisar fácilmente a los motores de búsqueda cada vez que se crea, actualiza o elimina contenido» (blog de Bing Webmaster, 2021).
Patrick Stox (yo): el giro hacia la eficiencia de Bing
- “There was a lot of blowback on Bing in the past because of their aggressive crawling.” (traducción) «En el pasado hubo muchas críticas contra Bing por su rastreo agresivo». Saltar a la cita
- “It’s estimated that 53% of crawler traffic is wasted effort, and IndexNow can help cut that number down to almost nothing.” (traducción) «Se estima que el 53 % del tráfico de rastreadores es esfuerzo desperdiciado e IndexNow puede ayudar a reducir esa cifra casi a cero». Saltar a la cita
blogs.bing.com redirigen ahora a la página principal del blog o se renderizan mediante JavaScript, y algunas fuentes del sector bloquean la comprobación automatizada. Las líneas sobre el lanzamiento de 2010 y de IndexNow se validaron frente al texto original del blog, pero sus URL activas pueden redirigir; confírmalas en un navegador (o en Wayback Machine) antes de tratarlas como definitivas y apóyate en los enlaces profundos verificados de SEJ/SEL/Kalicube cuando necesites una fuente estable. ¿Qué debo hacer con Bingbot?
Las decisiones sobre Bingbot dependen de dos cosas: si una solicitud procede realmente de Bingbot y si quieres ralentizarlo, acelerarlo o bloquearlo por completo. Haz clic para continuar.
Deciding what to do about Bingbot
Bingbot y los rastreadores de Microsoft: hoja de referencia rápida
Cadenas de user-agent
| Variante | Cadena (actual) |
|---|---|
| Escritorio | Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko; compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm) Chrome/W.X.Y.Z Safari/537.36 |
| Móvil | Mozilla/5.0 (Linux; Android 6.0.1; Nexus 5X Build/MMB29P) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/W.X.Y.Z Mobile Safari/537.36 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm) |
| Heredada (anterior a Chromium) | Mozilla/5.0 (compatible; bingbot/2.0; +http://www.bing.com/bingbot.htm) |
W.X.Y.Z = la versión estable actual de Microsoft Edge, sustituida en el token Chrome/ (es evergreen: se actualiza sola). Estas son las cadenas definitivas que Microsoft publicó en abril de 2022 y confirmó plenamente activas en febrero de 2023; una vista previa anterior de diciembre de 2019 también había propuesto un fragmento final Edg/W.X.Y.Z, pero no forma parte del UA definitivo: no lo exijas en el código que identifica bots.
La familia de rastreadores de Microsoft
| Rastreador | Token de robots.txt | Qué hace |
|---|---|---|
| Bingbot | bingbot | Rastreador web principal del índice de Bing |
| AdIdxBot | adidxbot | Control de calidad de Bing Ads: comparte el presupuesto de rastreo de Bingbot |
| BingPreview | — | Instantáneas y miniaturas de vista previa de páginas |
| MicrosoftPreview | — | Vistas previas de enlaces de Teams y Office |
| BingVideoPreview | — | Vistas previas de vídeo solo en Bing (aka.ms/microsoftbots) |
| MSNBot, MSNBot-Media | msnbot | Heredado: retirado el 1 de octubre de 2010 |
Datos rápidos
- Se lanzó el 1 de octubre de 2010 y sustituyó a MSNBot.
- Si existen directivas de MSNBot y BingBot en
robots.txt, gana BingBot. - Verifica mediante DNS inverso hacia
*.search.msn.com, no mediante el user-agent ni la lista de IP (las IP cambian). - Lista de IP:
bing.com/toolbox/bingbot.json: 28 prefijos IPv4, generada en enero de 2024. - Crawl Control en Bing Webmaster Tools establece la tasa de rastreo por hora (Google retiró su equivalente).
- IndexNow = envío de URL modificadas; creado junto con Yandex.
Verifica que un bot sea realmente Bingbot
Una solicitud que diga ser Bingbot no demuestra nada: la cadena de user-agent se puede suplantar trivialmente. Como dice Microsoft, que un bot utilice el user-agent exacto de Bingbot no lo convierte en Bingbot. Confírmalo mediante una comprobación DNS inversa y directa en dos pasos. Una IP auténtica de Bingbot resuelve inversamente a un nombre de host que termina en search.msn.com (patrón msnbot-<ip-with-dashes>.search.msn.com), y ese nombre de host debe resolver directamente de nuevo a la misma IP.
macOS / Linux
# 1) Reverse DNS the IP from your logs — it should end in search.msn.com
host 157.55.39.1
# → 1.39.55.157.in-addr.arpa domain name pointer msnbot-157-55-39-1.search.msn.com
# 2) Forward DNS that hostname back — it must resolve to the same IP
host msnbot-157-55-39-1.search.msn.com
# → msnbot-157-55-39-1.search.msn.com has address 157.55.39.1Windows
nslookup 157.55.39.1
nslookup msnbot-157-55-39-1.search.msn.comSi la búsqueda inversa no termina en search.msn.com, o la directa no devuelve la IP original, no es Bingbot: descártalo o limita su velocidad. También puedes utilizar la herramienta Verify Bingbot en línea de Microsoft y la lista de IP publicada en bingbot.json como comprobación aproximada, pero Microsoft deja claro que las IP pueden cambiar, así que el DNS es la fuente de verdad y no una lista de autorización codificada. (Es el mismo enfoque que al verificar Googlebot; consulta la pestaña Scripts del hub de rastreo para ver la versión de Google).
Lista de comprobación de preparación para Bingbot
Una comprobación rápida para confirmar que trabajas con Bingbot y no contra él:
-
robots.txtno bloquea abingbotpara nada que quieras que aparezca en Bing (recuerda que eso también controla Yahoo, DuckDuckGo, Ecosia y Copilot). - No hay directivas antiguas de MSNBot que luchen contra tus reglas de Bingbot (gana BingBot, pero límpialas).
- Se ha enviado un sitemap XML en Bing Webmaster Tools, con solo URL canónicas e indexables y un
lastmodpreciso. - La verificación del bot utiliza DNS inverso y directo, no el user-agent ni una lista de IP codificada.
- Si usas un cortafuegos o una lista de autorización de bots, verificas mediante DNS, no fijando las IP de
bingbot.json(cambian). - Se ha revisado Crawl Control si el tráfico de Bingbot sobrecarga el servidor en las horas punta.
- Se ha conectado IndexNow para enviar las URL creadas, actualizadas o eliminadas, en lugar de esperar.
- El contenido que depende de JS es accesible y se renderiza (Bingbot es evergreen, pero los enlaces reales
<a href>siguen siendo mejores que la navegación basada solo en clics). - Sabes que AdIdxBot comparte el presupuesto de rastreo de Bingbot si utilizas Bing Ads.
- Antes de bloquear
bingbotpor motivos de IA, has confirmado que no existe una exclusión independiente para Copilot: bloquearlo actualmente también te saca de la búsqueda de Bing.
Modelos mentales
1. Alcance, no cuota de mercado. La cuota directa de Bing en las búsquedas es pequeña, así que resulta tentador juzgar Bingbot solo por esa cifra. El replanteamiento importante es que el índice que construye Bingbot es el backend de Yahoo Search, DuckDuckGo, Ecosia, la búsqueda predeterminada de Edge y Microsoft Copilot. Una regla Disallow: bingbot no te cuesta «un 3 % de las búsquedas»: te cuesta todas esas superficies a la vez. Juzga las decisiones sobre Bingbot por el alcance del ecosistema, no por la cifra independiente de Bing.
2. Verifica mediante DNS, no mediante user-agent. La cadena de user-agent de una solicitud es solo una cabecera que establece el cliente: cualquiera puede escribir bingbot/2.0 en un comando curl. La única afirmación que no se puede falsificar a bajo coste es un registro DNS que apunte al dominio propio de Microsoft search.msn.com, comprobado en ambas direcciones (inversa y después directa). Trata cualquier otra señal, como el user-agent o la lista de IP publicada, como una pista, no como una prueba.
3. Tres palancas, de brusca a quirúrgica. robots.txt es el instrumento contundente: mantiene a Bingbot fuera de una ruta por completo, pero controla el rastreo, no la desindexación. Crawl Control en Bing Webmaster Tools es el dial: determina cuándo Bingbot te visita con más intensidad, hora a hora, sin expulsarlo. IndexNow es el bisturí: no espera a que Bingbot vuelva, sino que envía una sola URL en el momento en que cambia. Utiliza la palanca menos brusca que resuelva el problema real.
4. Google retiró el dial; Bing lo conservó. Google eliminó de Search Console su limitador de tasa de rastreo. Crawl Control de Bing sigue ofreciendo un control activo de la tasa por hora. Si estás acostumbrado a tratar la gestión de la tasa de rastreo como «algo que ya no se puede hacer», eso es cierto para Googlebot, pero no para Bingbot: sigue siendo una palanca real y actual que merece la pena usar cuando el tráfico de Bingbot sobrecarga el servidor en horas punta.
El KPI permanente: tráfico de referencia total del ecosistema de Bing
La cifra de cuota de mercado de Bing se queda corta al medir lo que Bingbot vale para ti, porque el índice que construye también alimenta Yahoo Search, DuckDuckGo, Ecosia y Microsoft Copilot. El KPI honesto no es el «tráfico de Bing» aislado, sino el tráfico de referencia combinado de todo ese ecosistema, seguido a lo largo del tiempo.
Segmenta el tráfico de referencia de toda la familia del índice de Bing
- Métrica: sesiones o clics en tu herramienta de analítica cuyo referente sea
bing.com,search.yahoo.com,duckduckgo.com,ecosia.orgocopilot.microsoft.com, sumados y seguidos como un solo grupo junto a (no en lugar de) tu cifra de Google. - Qué te dice: si bloquear Bingbot o servirlo de forma insuficiente realmente te está costando tráfico más allá del propio Bing. Una caída que aparezca a la vez en los cinco referentes es un problema de acceso de Bingbot, no un problema de posicionamiento en un solo motor.
- Cómo obtenerlo: segmenta tu herramienta de analítica existente (GA4, logs del servidor o lo que ya utilices) por dominio de referencia para cada uno de los cinco anteriores y combínala con Bing Webmaster Tools — Search Performance, que informa directamente de los clics e impresiones propios de Bing (no puede ver las cifras posteriores de Yahoo/DuckDuckGo/Ecosia, así que los datos de referentes de la analítica son el único lugar donde existe esa visión combinada).
- Referencia / intervalo realista: no hay una cifra honesta de todo el sector que debas perseguir aquí: la distribución del ecosistema varía enormemente según la audiencia y la geografía. Establece tu propia línea base con datos de referentes de varios meses antes de juzgar el movimiento de un solo mes.
- Cadencia: una vez al mes basta para la tendencia; compruébalo semanalmente justo después de cambiar
robots.txt, desplegar IndexNow o hacer cualquier otra cosa que afecte al acceso de Bingbot.
Herramientas para verificar y controlar Bingbot
- Googlebot Verifier: herramienta propia. Pega una IP que afirme ser Bingbot y ejecutará por ti la comprobación de DNS inverso confirmado hacia delante, además de nombrar al propietario real de la red si se trata de un suplantador. Es la versión práctica de la comprobación DNS en dos pasos de la pestaña Scripts, sin tocar un terminal.
- robots.txt Tester: herramienta propia. Comprueba si una URL concreta está permitida o bloqueada específicamente para el token
bingbot(a diferencia de*o Googlebot), ve exactamente qué regla gana y detecta una directivamsnbotantigua que luche contra tu regla de Bingbot antes de publicarla. - Verify Bingbot tool: búsqueda de IP en línea de Microsoft, útil como comprobación cruzada frente a Googlebot Verifier.
- Bing Webmaster Tools — Crawl Control: establece directamente la tasa de rastreo por hora de Bingbot; es el control activo cuyo equivalente retiró Google.
- IndexNow (
indexnow.org): envía URL creadas, actualizadas o eliminadas en lugar de esperar a la siguiente pasada de Bingbot; un ping llega a todos los motores participantes.
Recursos que merecen tu tiempo
Mis textos relacionados
- Conoce los nuevos rastreadores web: los bots de IA se acercan a los bots de los motores de búsqueda: donde explico el pasado de rastreo agresivo de Bing, el giro de IndexNow y la estadística del 53 % de tráfico desperdiciado.
- ¿Cuándo debería preocuparte el presupuesto de rastreo?: incluye el planteamiento de Bing sobre la «eficiencia del rastreo» y la nota de que “Bing also has an Indexing API that’s available to everyone.” (traducción) «Bing también tiene una API de indexación disponible para todo el mundo».
- Bingbot (Ahrefs SEO glossary): la versión breve de referencia.
- Guía para principiantes de SEO técnico: donde encajan los rastreadores en el panorama general.
Mis charlas
- Cómo funciona la búsqueda (SlideShare): mi recorrido por el rastreo, la renderización, la indexación y el posicionamiento. (Se aplica el aviso habitual: “This is my understanding of systems… not going to be 100% complete or accurate.” (traducción) «Esta es mi comprensión de los sistemas… no va a ser 100 % completa ni precisa»).
De otros autores
- Cómo funciona Bingbot: descubrimiento, rastreo, extracción e indexación (SEJ): recorrido detallado de Fabrice Canel que sustenta los puntos anteriores sobre la memoria de URL y el prefiltrado.
- Por qué y cómo planea Bing mejorar su rastreador Bingbot (SEJ, 2019): entrevista con Canel que incluye la cifra de 100 000 millones de URL nuevas al día, la cita sobre el rastreo respetuoso y la frase del «problema de ingeniería fascinante».
- Microsoft Bing y Copilot: usa schema para sus LLM (Search Engine Land, 2025): intervención de Canel en SMX Munich sobre cómo el marcado de schema ayuda a los LLM de Microsoft y el contenido reciente como señal de posicionamiento de Copilot.
- Las cinco puertas de infraestructura tras el rastreo, la renderización y la indexación (Search Engine Land): marco de eficiencia de rastreo de Canel, «menos es más para el SEO», explicado puerta por puerta.
- Cómo eligen páginas Bingbot y Googlebot (Kalicube): cita de Canel sobre guiarse por páginas clave al descubrir URL, con comparación con Googlebot.
- r/TechSEO: comunidad para depurar problemas de rastreo e indexación.
Estadísticas que merece la pena citar
- Aproximadamente 100 000 millones de URL nuevas descubiertas al día: cifra de Fabrice Canel de 2019 sobre cuántas URL nunca vistas encuentra Bingbot cada día (“more than 100 billion new URLs never seen before” (traducción) «más de 100 000 millones de URL nunca vistas»). Otra cifra de 2020 situó el dato en unos 70 000 millones; conserva la fecha cuando cites cualquiera de las dos. Fuente
- Aproximadamente el 53 % del tráfico de rastreadores es esfuerzo desperdiciado: mi estimación y el argumento a favor de IndexNow: enviar cambios “can help cut that number down to almost nothing.” (traducción) «puede ayudar a reducir esa cifra casi a cero». Fuente
- 28 prefijos IPv4 publicados: el tamaño de la lista oficial de IP de Bingbot de Microsoft (
bingbot.json, generada en enero de 2024), un contexto útil, pero Microsoft advierte que las direcciones cambian, así que verifica mediante DNS inverso. Fuente
Ponte a prueba: Bingbot
Cinco preguntas rápidas sobre Bingbot, su verificación y su alcance. Elige una respuesta para cada una y después comprueba el resultado.
Registro de cambios
Actualizado el 11 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 9 ago 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.
Actualizado el 18 jul 2026.
Resumen editorial y detalles registrados del cambio.Detalles del cambio
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
-
Los detalles del cambio están disponibles actualmente en inglés.
La comparación completa no está disponible: no se archivó una instantánea anterior para esta revisión.