Tony Wang4 min de lecturaCómo scrapear reviews de Trustpilot en 2026 (API y Python)
Tres formas de scrapear reviews de Trustpilot en 2026 — DIY Python, no-code o API estructurada: qué devuelve cada una y lo legal.
La forma más rápida de hacer scraping de reviews de Trustpilot en 2026 es llamar a una API de reviews estructurada que devuelve JSON normalizado — ratings, texto de reviews, fechas, etiquetas de quienes las escriben y datos del perfil de negocio — en lugar de paginar y parsear el HTML de Trustpilot tú mismo. Hacerlo por tu cuenta (DIY) en Python es posible, pero la paginación, los cambios de layout y las defensas anti-bot lo vuelven costoso de mantener, y el texto de las reviews son datos personales que debes manejar con cuidado.
Trustpilot sí tiene una API de Business oficial, pero requiere un plan de pago y acceso de partner. Una API de scraping estructurada es la ruta práctica cuando quieres datos de reviews públicas de negocios que no son tuyos.
¿Es legal hacer scraping de reviews de Trustpilot?
Las reviews son públicas, pero contienen datos personales (nombres y opiniones de quienes las escriben), así que trátalas con cuidado extra:
- Recopila solo páginas de reviews públicas — sin logins.
- Trata la información de quienes escriben reviews como datos personales bajo GDPR/CCPA: minimiza lo que almacenas y ten una base legal.
- Respeta los límites de tasa (rate limits) y los términos de Trustpilot; tú eres responsable del uso legal.
- No presentes reviews scrapeadas de una forma que engañe sobre su fuente o autenticidad.
Esto no es asesoría legal — consulta Is web scraping legal in 2026?, que cubre la línea entre datos públicos y personales con más profundidad.
Opción 1: DIY en Python (y por qué se rompe)
Un primer intento obtiene una página de negocio y parsea las tarjetas de reviews:
import json, requests
from bs4 import BeautifulSoup
resp = requests.get(
"https://www.trustpilot.com/review/openai.com",
headers={"User-Agent": "Mozilla/5.0", "Accept-Language": "en-US,en;q=0.9"},
)
soup = BeautifulSoup(resp.text, "html.parser")
# Trustpilot pre-loads reviews into a __NEXT_DATA__ script tag — faster than parsing cards
data = json.loads(soup.select_one("#__NEXT_DATA__").string)
reviews = data["props"]["pageProps"].get("reviews", []) # undocumented path; shifts between deploys
print(len(reviews), "reviews on page 1")
# ...then normalize each review to CSV, page every ?page= URL, and get past Cloudflare
Los costos recurrentes:
- Cloudflare y rate limits — Trustpilot está detrás de Cloudflare con detección de bots y rate limiting, así que las solicitudes repetidas necesitan proxies residenciales y fallbacks de renderizado JS.
- Estructura no documentada — la estructura del blob
__NEXT_DATA__cambia entre despliegues, así que tu ruta hacia ella se rompe silenciosamente. - Paginación — las reviews se distribuyen en muchas URLs
?page=que hay que recorrer y deduplicar. - Normalización — estrellas, fechas, flags de verificación y respuestas necesitan un parsing consistente.
Opción 2: Herramientas no-code y listas para usar
Los scrapers de apuntar y hacer clic pueden capturar una o dos páginas, pero el monitoreo de reputación implica revisar negocios de nuevo según un calendario y almacenar el historial. Eso es un trabajo de pipeline, y ahí una API encaja mejor que una herramienta manual.
Opción 3: Una API estructurada de Trustpilot
La Trustpilot API de Crawlora expone endpoints documentados para perfiles de negocio, reviews, búsqueda y categorías, devolviendo JSON normalizado. Las reviews se direccionan por el slug del negocio (su dominio en Trustpilot):
curl -G "https://api.crawlora.net/api/v1/trustpilot/business/openai.com/reviews" \
-H "x-api-key: $CRAWLORA_API_KEY" \
--data-urlencode "page=1" \
--data-urlencode "language=en"
import requests
resp = requests.get(
"https://api.crawlora.net/api/v1/trustpilot/business/openai.com/reviews",
headers={"x-api-key": "YOUR_API_KEY"},
params={"page": 1, "language": "en"},
)
for review in resp.json()["data"]["reviews"]:
print(review["stars"], review["title"], review["date"])
Una respuesta es JSON normalizado que puedes almacenar directamente (los campos son ilustrativos — confirma el esquema en los docs):
{
"code": 200,
"msg": "OK",
"data": {
"business": { "slug": "openai.com", "rating": 4.1, "review_count": 1234 },
"reviews": [
{
"stars": 5,
"title": "Great experience",
"text": "Review body text.",
"date": "2026-05-01",
"verified": true
}
]
}
}
Puedes filtrar reviews por stars, verified, language, un término de búsqueda q y un rango de fechas. ¿No conoces el slug? Encuéntralo, y luego obtén el perfil, competidores relacionados o una categoría completa:
h = {"x-api-key": "YOUR_API_KEY"}
base = "https://api.crawlora.net/api/v1/trustpilot"
found = requests.get(f"{base}/business-units/search", headers=h, params={"q": "openai"}).json()["data"]
profile = requests.get(f"{base}/business/openai.com", headers=h).json()["data"]
related = requests.get(f"{base}/business/openai.com/related", headers=h).json()["data"]
sector = requests.get(f"{base}/category/software_company", headers=h, params={"page": 1}).json()["data"]
El slug es el dominio de la empresa en Trustpilot (por ejemplo, openai.com); los endpoints de categoría (/categories, /category/{slug}) descubren negocios de un sector para benchmarking competitivo.
Qué puedes recopilar
- Perfil de negocio: rating general, cantidad de reviews y categoría
- Reviews individuales: estrellas, título, cuerpo, fecha, verificación y respuestas cuando existen
- Filtros por estrellas, estado de verificación, idioma, palabra clave y rango de fechas
- Endpoints de categoría y búsqueda para descubrir negocios
Limitaciones y desafíos comunes
- La API oficial es solo para tu propio perfil. Las APIs de Service Reviews y Business Units de Trustpilot requieren una cuenta de Business verificada y devuelven datos solo de tu propia Business Unit — para hacer benchmarking de competidores, recopilas reviews públicas.
- Cloudflare y rate limits. Las páginas públicas están detrás de Cloudflare con detección de bots y rate limiting, así que hacerlo tú mismo necesita proxies residenciales y renderizado JS; una API estructurada maneja eso detrás de una sola key.
- Las reviews son datos personales. Los nombres y opiniones de quienes escriben reviews caen bajo GDPR/CCPA — minimiza lo que almacenas, ten una base legal, y no tergiverses la fuente o autenticidad de las reviews.
- Paginación. Las reviews y los listados de categoría están paginados; recorre cada página y deduplica.
Fuentes
Dónde encaja esto
Pruébalo primero, gratis: ejecuta cualquier URL pública a través del Free Web Scraper, o comprueba si un sitio bloquea bots con el Anti-Bot Checker — sin registro.
Esto impulsa el monitoreo de reviews y reputación: sigue el rating de una marca a lo largo del tiempo, marca nuevas reviews negativas, y compara contra competidores. Combínalo con el sentiment del lado de las apps de los endpoints de reviews de App Store y Google Play — o nuestro dataset de sentiment de reviews de apps ya scrapeado — para una vista del feedback de clientes a través de canales. Para más fuentes estructuradas de reviews, consulta cómo hacer scraping de reviews de App Store, cómo hacer scraping de TripAdvisor y cómo hacer scraping de Google Reviews — la mayor superficie de reviews para la mayoría de negocios locales; el mismo patrón de rating/review aplica a películas y series en cómo hacer scraping de IMDb; para sentiment de otras fuentes públicas, cómo hacer scraping de Reddit; para el toolkit más amplio, cómo elegir una API de web scraping.
Empieza probando el endpoint en el Playground, leyendo el esquema de petición y respuesta en la documentación de la API, y revisando los costos en créditos en la página de precios. Para una comparación completa con otras API de datos de Trustpilot, consulta las mejores API de scraper de Trustpilot en 2026.
Parte de nuestra serie de guías de cómo hacer scraping — cada plataforma que cubrimos, en un solo índice.
Preguntas frecuentes
¿Puedo hacer scraping de Trustpilot sin que me bloqueen?
Crawlora se encarga del enrutamiento de proxies, el ritmo de las solicitudes y los reintentos detrás de la API, y devuelve errores documentados para páginas no disponibles, así que llamas a un endpoint y obtienes JSON de reviews normalizado. (Trustpilot está detrás de Cloudflare con detección de bots y rate limiting, así que hacerlo por tu cuenta necesita proxies residenciales y renderizado JS.)
¿Tiene Trustpilot una API oficial?
Sí, pero es solo para tu propio perfil: las APIs de Service Reviews y Business Units de Trustpilot requieren una cuenta de Business verificada y devuelven datos solo de tu propia Business Unit. Para hacer benchmarking de competidores, Crawlora recopila datos de reviews públicas de varios negocios como JSON normalizado.
¿Son los datos de reviews datos personales?
Las reviews contienen nombres y opiniones de quienes las escriben, que pueden ser datos personales bajo GDPR y CCPA. Minimiza lo que almacenas, ten una base legal, trátalos con responsabilidad y no tergiverses la fuente o autenticidad de las reviews.
¿Puedo hacer scraping de reviews de competidores o de un sector entero?
Sí. Usa la búsqueda de business-units para encontrar slugs, el endpoint related-businesses para competidores y los endpoints de categoría para descubrir y obtener cualquier negocio de un sector para benchmarking.
¿Qué filtros hay disponibles para las reviews?
Estrellas, estado de verificación, idioma, una palabra clave (q) y un rango de fechas, además de paginación, así que obtienes exactamente las reviews que necesitas.
¿Cómo encuentro el slug de un negocio?
Usa el endpoint de búsqueda de business-units. El slug es el dominio del negocio en Trustpilot (por ejemplo, openai.com), que se usa en la ruta de reviews.