Tony Wang4 Min. LesezeitTrustpilot-Reviews scrapen 2026 (API & Python)
Drei Wege, Trustpilot-Reviews und -Ratings 2026 zu scrapen — DIY-Python, No-Code-Tools oder strukturierte API: was jeder liefert, und die Rechtsgrundlagen.
Der schnellste Weg, um 2026 Trustpilot-Reviews zu scrapen, ist der Aufruf einer strukturierten Reviews-API, die normalisiertes JSON zurückgibt — Ratings, Review-Text, Datumsangaben, Labels der Bewertenden und Business-Profildaten — statt Trustpilots HTML selbst zu paginieren und zu parsen. DIY in Python ist möglich, aber Pagination, Layout-Änderungen und Anti-Bot-Abwehr machen es teuer in der Wartung, und Review-Text sind personenbezogene Daten, die du sorgfältig behandeln musst.
Trustpilot betreibt zwar eine offizielle Business-API, die aber einen kostenpflichtigen Plan und Partner-Zugang voraussetzt. Eine strukturierte Scraping-API ist der praktische Weg, wenn du öffentliche Review-Daten über Unternehmen willst, die dir nicht gehören.
Ist es legal, Trustpilot-Reviews zu scrapen?
Reviews sind öffentlich, enthalten aber personenbezogene Daten (Namen und Meinungen der Bewertenden), also behandle sie mit besonderer Sorgfalt:
- Erfasse nur öffentliche Review-Seiten — keine Logins.
- Behandle Informationen zu Bewertenden als personenbezogene Daten nach DSGVO/CCPA: speichere so wenig wie möglich und sorge für eine Rechtsgrundlage.
- Respektiere Rate-Limits und Trustpilots Bedingungen; für die rechtmäßige Nutzung bist du verantwortlich.
- Präsentiere gescrapte Reviews nicht so, dass sie über ihre Quelle oder Echtheit täuschen.
Das ist keine Rechtsberatung — siehe Is web scraping legal in 2026?, wo die Grenze zwischen öffentlichen und personenbezogenen Daten ausführlicher behandelt wird.
Option 1: DIY in Python (und warum es kaputtgeht)
Ein erster Versuch lädt eine Business-Seite und parst die Review-Karten:
import json, requests
from bs4 import BeautifulSoup
resp = requests.get(
"https://www.trustpilot.com/review/openai.com",
headers={"User-Agent": "Mozilla/5.0", "Accept-Language": "en-US,en;q=0.9"},
)
soup = BeautifulSoup(resp.text, "html.parser")
# Trustpilot pre-loads reviews into a __NEXT_DATA__ script tag — faster than parsing cards
data = json.loads(soup.select_one("#__NEXT_DATA__").string)
reviews = data["props"]["pageProps"].get("reviews", []) # undocumented path; shifts between deploys
print(len(reviews), "reviews on page 1")
# ...then normalize each review to CSV, page every ?page= URL, and get past Cloudflare
Die wiederkehrenden Kosten:
- Cloudflare & Rate-Limits — Trustpilot sitzt hinter Cloudflare mit Bot-Erkennung und Rate-Limiting, sodass wiederholte Requests residentielle Proxys und JS-Rendering-Fallbacks brauchen.
- Undokumentierte Struktur — der Aufbau des
__NEXT_DATA__-Blobs ändert sich zwischen Deploys, sodass dein Pfad hinein still und leise kaputtgeht. - Pagination — Reviews verteilen sich über viele
?page=-URLs, die du durchlaufen und deduplizieren musst. - Normalisierung — Sterne, Datumsangaben, Verifizierungs-Flags und Antworten brauchen alle ein konsistentes Parsing.
Option 2: No-Code- und fertige Tools
Point-and-Click-Scraper können ein, zwei Seiten abgreifen, aber Reputation-Monitoring bedeutet, Unternehmen nach Zeitplan erneut zu prüfen und die Historie zu speichern. Das ist eine Pipeline-Aufgabe, und da passt eine API besser als ein manuelles Tool.
Option 3: Eine strukturierte Trustpilot-API
Crawloras Trustpilot API stellt dokumentierte Endpoints für Business-Profile, Reviews, Suche und Kategorien bereit und gibt normalisiertes JSON zurück. Reviews werden über den Business-Slug adressiert (die Domain des Unternehmens auf Trustpilot):
curl -G "https://api.crawlora.net/api/v1/trustpilot/business/openai.com/reviews" \
-H "x-api-key: $CRAWLORA_API_KEY" \
--data-urlencode "page=1" \
--data-urlencode "language=en"
import requests
resp = requests.get(
"https://api.crawlora.net/api/v1/trustpilot/business/openai.com/reviews",
headers={"x-api-key": "YOUR_API_KEY"},
params={"page": 1, "language": "en"},
)
for review in resp.json()["data"]["reviews"]:
print(review["stars"], review["title"], review["date"])
Eine Antwort ist normalisiertes JSON, das du direkt speichern kannst (die Felder sind beispielhaft — bestätige das Schema in den Docs):
{
"code": 200,
"msg": "OK",
"data": {
"business": { "slug": "openai.com", "rating": 4.1, "review_count": 1234 },
"reviews": [
{
"stars": 5,
"title": "Great experience",
"text": "Review body text.",
"date": "2026-05-01",
"verified": true
}
]
}
}
Du kannst Reviews nach stars, verified, language, einem Suchbegriff q und einem Zeitraum filtern. Du kennst den Slug nicht? Finde ihn, und rufe dann das Profil, verwandte Wettbewerber oder eine ganze Kategorie ab:
h = {"x-api-key": "YOUR_API_KEY"}
base = "https://api.crawlora.net/api/v1/trustpilot"
found = requests.get(f"{base}/business-units/search", headers=h, params={"q": "openai"}).json()["data"]
profile = requests.get(f"{base}/business/openai.com", headers=h).json()["data"]
related = requests.get(f"{base}/business/openai.com/related", headers=h).json()["data"]
sector = requests.get(f"{base}/category/software_company", headers=h, params={"page": 1}).json()["data"]
Der Slug ist die Domain des Unternehmens auf Trustpilot (z. B. openai.com); die Kategorie-Endpoints (/categories, /category/{slug}) finden Unternehmen einer Branche für Wettbewerbs-Benchmarking.
Was du erfassen kannst
- Business-Profil: Gesamt-Rating, Anzahl der Reviews und Kategorie
- Einzelne Reviews: Sterne, Titel, Text, Datum, Verifizierung und Antworten, wo vorhanden
- Filter für Sterne, verifizierten Status, Sprache, Keyword und Zeitraum
- Kategorie- und Such-Endpoints, um Unternehmen zu finden
Grenzen und typische Herausforderungen
- Die offizielle API gilt nur für das eigene Profil. Trustpilots Service-Reviews- und Business-Units-APIs verlangen ein verifiziertes Business-Konto und geben nur Daten für deine eigene Business Unit zurück — um Wettbewerber zu benchmarken, erfasst du öffentliche Reviews.
- Cloudflare & Rate-Limits. Öffentliche Seiten sitzen hinter Cloudflare mit Bot-Erkennung und Rate-Limiting, sodass DIY residentielle Proxys und JS-Rendering braucht; eine strukturierte API erledigt das hinter einem einzigen Key.
- Reviews sind personenbezogene Daten. Namen und Meinungen der Bewertenden fallen unter DSGVO/CCPA — speichere so wenig wie möglich, sorge für eine Rechtsgrundlage und stelle Quelle oder Echtheit der Reviews nicht falsch dar.
- Pagination. Reviews und Kategorie-Listings paginieren; durchlaufe jede Seite und dedupliziere.
Sources
Wo das hineinpasst
Probier es zuerst kostenlos aus: schicke eine beliebige öffentliche URL durch den Free Web Scraper oder prüfe mit dem Anti-Bot Checker, ob eine Website Bots blockiert — ohne Anmeldung.
Das treibt Review- und Reputation-Monitoring an: verfolge das Rating einer Marke über die Zeit, markiere neue negative Reviews und benchmarke gegen Wettbewerber. Kombiniere es mit App-seitigem Sentiment aus den Review-Endpoints von App Store und Google Play — oder unserem vorgescrapten App-Review-Sentiment-Datensatz — für eine kanalübergreifende Sicht auf Kundenfeedback. Für Sentiment aus anderen öffentlichen Quellen siehe how to scrape Reddit; für das breitere Toolkit how to choose a web scraping API.
Leg los, indem du den Endpoint im Playground testest, das Request- und Response-Schema in den API docs liest und die Credit-Kosten auf der Pricing-Seite durchgehst.
Häufig gestellte Fragen
Kann ich Trustpilot scrapen, ohne blockiert zu werden?
Crawlora übernimmt Proxy-Routing, Request-Taktung und Retries hinter der API und gibt für unbrauchbare Seiten dokumentierte Fehler zurück, sodass du einen Endpoint aufrufst und normalisiertes Review-JSON bekommst. (Trustpilot sitzt hinter Cloudflare mit Bot-Erkennung und Rate-Limiting, sodass DIY residentielle Proxys und JS-Rendering braucht.)
Hat Trustpilot eine offizielle API?
Ja, aber sie gilt nur für das eigene Profil: Trustpilots Service-Reviews- und Business-Units-APIs verlangen ein verifiziertes Business-Konto und geben nur Daten für deine eigene Business Unit zurück. Um Wettbewerber zu benchmarken, erfasst Crawlora öffentliche Review-Daten über Unternehmen hinweg als normalisiertes JSON.
Sind Review-Daten personenbezogene Daten?
Reviews enthalten Namen und Meinungen der Bewertenden, die nach DSGVO und CCPA personenbezogene Daten sein können. Speichere so wenig wie möglich, sorge für eine Rechtsgrundlage, gehe verantwortungsvoll damit um und stelle Quelle oder Echtheit der Reviews nicht falsch dar.
Kann ich Reviews von Wettbewerbern oder eine ganze Branche scrapen?
Ja. Nutze die Business-Units-Suche, um Slugs zu finden, den Related-Businesses-Endpoint für Wettbewerber und die Kategorie-Endpoints, um jedes Unternehmen einer Branche zum Benchmarking zu finden und abzurufen.
Wonach kann ich Reviews filtern?
Sterne, verifizierter Status, Sprache, ein Keyword (q) und ein Zeitraum, plus Pagination, sodass du genau die Reviews abrufst, die du brauchst.
Wie finde ich den Slug eines Unternehmens?
Nutze den Business-Units-Such-Endpoint. Der Slug ist die Domain des Unternehmens auf Trustpilot (zum Beispiel openai.com), die im Reviews-Pfad verwendet wird.