Tony Wang7 min de lecturaCómo hacer scraping de resultados de Bing en 2026 (API y Python)
Haz scraping de resultados de Bing en 2026 — Python DIY, no-code o una API estructurada para datos web, imagen, noticias y video.
La forma más rápida de hacer scraping de los resultados de búsqueda de Bing en 2026 es llamar a una API de búsqueda estructurada que devuelve JSON normalizado — resultados orgánicos con títulos, URLs y fragmentos, además de módulos de imágenes, noticias, videos y autosugerencias — en lugar de pilotar tú mismo un navegador headless a través de las defensas anti-bot de Bing. Todavía puedes construir un scraper DIY en Python, pero ya no tienes la API oficial de desarrolladores de Bing como respaldo: Microsoft la retiró en 2025.
Microsoft retiró la Bing Search API — qué significa esto en realidad
Si llegaste hasta aquí buscando, es muy probable que sea porque tú (o un sistema del que dependes) solía llamar a la API oficial de Web Search, News, Image o Autosuggest de Bing y dejó de funcionar. Eso no es un error. Microsoft retiró todas las Bing Search API el 11 de agosto de 2025, tras anunciar la decisión el 15 de mayo de 2025. Se dio de baja cada instancia — las claves existentes dejaron de funcionar y se cerraron los nuevos registros. Algunos desarrolladores reportaron que la creación de API se había desactivado silenciosamente ya en marzo de 2025, semanas antes del anuncio formal, lo que dejó aproximadamente tres meses entre el aviso público y el corte definitivo.
Todo el conjunto desapareció con ella: Web Search, Image Search, News Search, Video Search, Autosuggest, Spell Check, Entity Search, Visual Search, Custom Search y Local Business Search. El camino recomendado por Microsoft es Grounding with Bing Search dentro de Azure AI Foundry — pero eso es un cambio de naturaleza, no un simple cambio de nombre. Requiere aprovisionar un proyecto de Azure AI Agents, grupos de recursos y un despliegue de modelo; está construido para que un agente LLM fundamente sus propias respuestas en datos web en vivo, no para entregarle a tu aplicación un array JSON de resultados ordenados. Para un equipo que solo quiere resultados de búsqueda en una base de datos o en un panel de monitoreo, montar un proyecto de Azure AI Agents es demasiada plataforma para lo que antes era una sola llamada REST.
Por eso "Bing API alternative" y, en Japón específicamente, bing api 廃止 ("Bing API discontinuada") siguen siendo términos de búsqueda activos más de un año después del cierre — el costo de incorporación de Azure AI Foundry es lo bastante alto como para que los equipos sigan buscando un reemplazo directo más simple, y siguen apareciendo equipos nuevos que descubren el retiro por primera vez cuando su primera llamada a la API devuelve un 404. Una API estructurada de terceros — que siga devolviendo esa forma sencilla de "dame resultados ordenados como JSON" que ofrecía la antigua API de Bing — es la respuesta práctica para la mayoría de esos casos de uso, y de eso trata el resto de esta guía.
Por qué hacer scraping de los resultados de búsqueda de Bing
- SEO y monitoreo de SERP. Sigue cómo se posicionan tus páginas (o las de un competidor) en Bing a lo largo del tiempo — Bing todavía impulsa a Yahoo, DuckDuckGo (parcialmente) y otros motores secundarios, así que una mejora de ranking ahí se multiplica.
- Seguimiento de rankings entre motores. El índice y el algoritmo de ranking de Bing difieren de los de Google; ejecuta el mismo conjunto de palabras clave en ambos y podrás saber si un movimiento de ranking es de todo el sitio o específico del motor.
- AI grounding y RAG. Alimenta un pipeline de LLM con resultados web en vivo sin pagar el impuesto de plataforma de Azure AI Foundry ni construir tu propio crawler.
- Monitoreo de noticias y contenido. El módulo de noticias de Bing muestra cobertura reciente por palabra clave, útil para monitorear marca y competidores.
- Investigación de mercado y producto. Las autosugerencias y las búsquedas relacionadas revelan demanda real de consultas para investigación de palabras clave, sin necesidad de una cuenta de Google Ads.
¿Es legal hacer scraping de Bing?
El scraping de resultados de búsqueda públicos suele tratarse de forma distinta al acceso a datos privados o detrás de un paywall, pero "público" no es un permiso general. Las reglas prácticas a tener en cuenta:
- Recopila solo páginas de resultados públicas — sin inicios de sesión, sin cuentas personales.
- Respeta los límites de tasa y no degrades el servicio para otros usuarios.
- Revisa los términos de uso de Bing y tu legislación local antes de un uso comercial; tú eres responsable de cómo usas los datos.
- Almacena y procesa los resultados de forma lícita, especialmente cualquier dato que pueda ser personal.
Nada de esto es asesoría legal — consulta ¿Es legal el web scraping en 2026? para la versión extendida, incluido el contexto de hiQ v. LinkedIn y la CFAA.
Opción 1: DIY en Python (y por qué se rompe)
Un enfoque ingenuo consiste en descargar la página de resultados y parsear el HTML:
import requests
from bs4 import BeautifulSoup
resp = requests.get(
"https://www.bing.com/search",
params={"q": "ai agents"},
headers={
"User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36",
"Accept-Language": "en-US,en;q=0.9",
},
)
soup = BeautifulSoup(resp.text, "html.parser")
# Bing's organic results sit in <li class="b_algo"> blocks — but the class names
# and nesting shift often, so selectors need to key on stable attributes and be
# re-verified regularly. Normalize each block into {position, title, url,
# description} before you can do anything useful with it.
Esto funciona una vez y luego se rompe. Los costos recurrentes:
- Defensas anti-bot. Bing sirve una página de desafío (no tus resultados) a las peticiones que marca como automatizadas — IPs de centros de datos, huellas de navegador ausentes y una cadencia de peticiones inusual, todo lo dispara.
- Cambios de markup. Los contenedores de resultados y los nombres de clase cambian sin previo aviso, y tus selectores devuelven silenciosamente una lista vacía en lugar de fallar de forma ruidosa.
- Sin respaldo oficial. Antes de agosto de 2025, un scraper roto tenía una API oficial como red de seguridad. Esa red de seguridad ya no existe — ahora mantienes el camino DIY sin nada detrás.
- Sin estructura. Sigues teniendo que normalizar tú mismo los resultados orgánicos, las tarjetas de noticias, las tarjetas de video y las búsquedas relacionadas a un esquema estable, y cada módulo tiene su propio markup.
La mayor parte del costo no está en el primer scrape — está en mantenerlo vivo a través de los cambios anti-bot y de diseño de Bing sin ningún respaldo oficial si se rompe.
Opción 2: Herramientas no-code y listas para usar
Las extensiones de navegador y los scrapers de apuntar y hacer clic están bien para una exportación puntual, pero resultan incómodos dentro de un pipeline de datos: difíciles de programar, difíciles de versionar, y siguen rompiéndose cuando la página de Bing cambia. Para una recolección recurrente que alimenta un producto o un panel, una API encaja mejor — sobre todo ahora que no hay ninguna API oficial de Microsoft a la que recurrir.
Opción 3: Una API de búsqueda de Bing estructurada
La Bing API de Crawlora envuelve el manejo de peticiones, la evasión anti-bot y la normalización detrás de cinco endpoints documentados — web, imágenes, noticias, video y autosugerencias — todos bajo una sola clave compartida con cualquier otro motor y plataforma de la cuenta.
curl -G "https://api.crawlora.net/api/v1/bing/search" \
-H "x-api-key: $CRAWLORA_API_KEY" \
--data-urlencode "q=ai agents" \
--data-urlencode "country=us" \
--data-urlencode "lang=en-us" \
--data-urlencode "count=10"
import requests
resp = requests.get(
"https://api.crawlora.net/api/v1/bing/search",
headers={"x-api-key": "YOUR_API_KEY"},
params={"q": "ai agents", "country": "us", "lang": "en-us", "count": 10},
)
for row in resp.json()["data"]["results"]:
print(row["position"], row["title"], row["url"])
Una respuesta es JSON normalizado que puedes almacenar directamente (los campos que se muestran son ilustrativos — revisa la documentación para el esquema actual):
{
"code": 200,
"msg": "OK",
"data": {
"results": [
{
"position": 1,
"title": "Example result title",
"url": "https://example.com/",
"hostname": "example.com",
"display_url": "https://example.com › page",
"description": "Snippet text shown under the result.",
"favicon": "https://th.bing.com/th/id/..."
}
],
"pagination": { "page": 1, "count": 10, "next_page": 2 }
}
}
Pagina los resultados con page, y llama a los endpoints hermanos para otros tipos de resultado:
BASE = "https://api.crawlora.net/api/v1/bing"
headers = {"x-api-key": "YOUR_API_KEY"}
images = requests.get(f"{BASE}/images", headers=headers, params={"q": "ai agents", "count": 20}).json()["data"]
news = requests.get(f"{BASE}/news", headers=headers, params={"q": "ai agents"}).json()["data"]
videos = requests.get(f"{BASE}/videos", headers=headers, params={"q": "ai agents"}).json()["data"]
suggest = requests.get(f"{BASE}/suggest", headers=headers, params={"q": "ai age", "count": 8}).json()["data"]
Los resultados de noticias incluyen age, age_timestamp, source y thumbnail junto a los habituales title/url/description; las autosugerencias devuelven un array suggestions ordenado de pares `{position, query}` — útil para la misma investigación de demanda de palabras clave que cubría la antigua Bing Autosuggest API. Localiza cualquier endpoint con country (código de dos letras) y lang (formato ll-cc, por ejemplo ja-jp); todos los endpoints usan por defecto country=us, lang=en-us.
Una sola clave de Crawlora llama a los cinco endpoints de Bing, además de cualquier otro motor y plataforma de la misma cuenta — sin proyecto de Azure, sin grupo de recursos y sin lista de espera para entrar.
Qué puedes recopilar
- Resultados web orgánicos: posición, título, URL, hostname, URL de visualización, fragmento de descripción y favicon
- Resultados de imágenes: posición, URL de la imagen, miniatura, fuente, URL de la fuente y dimensiones
- Resultados de noticias: posición, título, fuente, descripción y antigüedad/marca de tiempo
- Resultados de video: posición, título, creador, plataforma y duración
- Sugerencias de autocompletado: sugerencias de consulta ordenadas para un prefijo
- Paginación mediante
page, y control de localización mediantecountryylang
Limitaciones y retos comunes
- Ya no hay una API oficial gratuita. Las Search API propias de Bing desaparecieron; Grounding with Bing Search es una función de Azure AI Agents, no un endpoint de búsqueda de propósito general, y requiere un proyecto de Azure completo para usarse.
- Anti-bot para el DIY. El scraping directo se enfrenta a páginas de desafío en IPs de centros de datos y huellas inusuales; una API estructurada gestiona la suplantación, los reintentos y la normalización detrás de una sola clave.
- Cambios en el markup y los módulos. Los bloques orgánicos, de imágenes, noticias, video y sugerencias tienen cada uno su propia forma y cambian de manera independiente — usa endpoints dedicados en lugar de un único parser gigante.
- Las búsquedas
site:no son compatibles. Bing sirve un desafío de verificación de bot específicamente para las consultas con el operadorsite:; usa la Google Search API para búsquedas restringidas a un dominio. - Sesgo de motor único. El ranking de Bing difiere de los de Google y Brave — trata los resultados de cada motor como su propia serie en lugar de asumir que coinciden.
Fuentes
Dónde encaja esto
Pruébalo primero, gratis: ejecuta cualquier URL pública a través del Free Web Scraper, o comprueba si un sitio bloquea bots con el Anti-Bot Checker — sin registro.
Bing resulta más útil como segundo motor junto a Google y Brave para el seguimiento de rankings entre motores — consulta cómo funcionan las API de monitoreo de SERP y el caso de uso de monitoreo de SERP. Combínalo con la Brave Search API y la Google Search API; las formas de respuesta son lo bastante consistentes como para que el mismo código de almacenamiento capture los tres. Para juzgar si vale la pena perseguir un movimiento de ranking, coloca los resultados del motor junto a la demanda de búsqueda — consulta cómo hacer scraping de Google Trends. Cuando la consulta es local en lugar de web-wide, cambia a resultados de lugares con cómo hacer scraping de Google Maps; cuando es académica en lugar de comercial, cómo hacer scraping de Google Scholar cubre el índice de artículos y citas en su lugar. Para una comparación de herramientas más amplia, consulta las mejores API de SERP en 2026.
Empieza probando los endpoints en el Playground, leyendo el esquema de petición y respuesta en la documentación de la API y revisando los costos en créditos en la página de precios.
Parte de nuestra serie de guías de cómo hacer scraping — cada plataforma que cubrimos, en un solo índice.
Preguntas frecuentes
¿Puedo hacer scraping de Bing sin que me bloqueen?
Crawlora gestiona la suplantación de Chrome, el enrutamiento de proxies y los reintentos detrás de la API, y devuelve errores documentados en lugar de páginas de desafío cuando Bing no está disponible. Solo tienes que llamar a un endpoint para obtener JSON normalizado.
¿De verdad se retiró la Bing Search API? (bing api 廃止)
Sí, ya está retirada. Microsoft lo anunció el 15 de mayo de 2025 y retiró todas las Bing Search API — Web, Image, News, Video y Autosuggest — el 11 de agosto de 2025. Las claves existentes dejaron de funcionar y se cerraron los nuevos registros. El reemplazo recomendado, Grounding with Bing Search dentro de Azure AI Foundry, requiere todo un proyecto de Azure AI Agents en lugar de un simple cambio de clave, así que una alternativa de terceros como los endpoints de Bing de Crawlora sigue siendo una opción práctica para los equipos que solo quieren resultados en JSON ordenado.
Ahora que la API de Microsoft desapareció, ¿qué uso como alternativa a la Bing API?
Una API estructurada de terceros que mantenga la forma sencilla de la antigua Bing API — enviar una consulta y recibir JSON ordenado — sin necesitar un proyecto de Azure. Los endpoints de Bing de Crawlora cubren resultados web, de imagen, noticias, video y autosugerencias con la misma clave que Google y Brave.
¿Bing todavía tiene una API de búsqueda oficial?
No una de propósito general. Grounding with Bing Search existe como función de Azure AI Agents (Azure AI Foundry) solo para fundamentar las respuestas de un LLM en datos web en vivo, no como un endpoint REST independiente que llamas para obtener un array JSON de resultados como hacía la antigua Bing Search API.
¿En qué se diferencia Bing de Google a efectos de scraping?
El índice y el ranking de Bing difieren de los de Google, así que los resultados también difieren — por eso muchos equipos recopilan ambos. Bing también rechaza las consultas con el operador site: con un desafío de verificación de bot, mientras que la Search API de Google sí admite directamente búsquedas restringidas a un dominio.
¿Qué datos devuelve la Bing Search API?
Resultados orgánicos con posición, título, URL, hostname y descripción, más endpoints dedicados para imágenes, noticias, video y autosugerencias. Pagina con page y localiza con country y lang.
¿Puedo usarla para el seguimiento de rankings?
Sí. Cada respuesta incluye posición y URL, así que registrarlas según un calendario te da un rastreador de rankings de Bing. Ejecuta las mismas palabras clave en Google y Brave para comparar entre motores.