Tony Wang7 Min. LesezeitRotten Tomatoes scrapen 2026 (API & Python)
Rotten Tomatoes 2026 scrapen — Tomatometer & Audience Score per DIY, No-Code oder strukturierter API, plus echte Rechtslage und Lizenzkosten.
Am schnellsten scrapst du Rotten Tomatoes 2026, indem du eine strukturierte API aufrufst, die normalisiertes JSON zurückgibt — Title-Detail, Tomatometer, Audience Score und Review-Snippets — für Movies, TV-Serien, Staffeln und Episoden in derselben Request-Form, statt Rotten Tomatoes' Seiten selbst zu parsen oder Fandangos eigenen Developer-Freigabeprozess abzuwarten. Rotten Tomatoes ist die Standard-Referenz für „soll ich mir das ansehen" im Großteil des englischsprachigen Webs, aber die offizielle API ist weder kostenlos noch schnell zu bekommen, und die Bedingungen des Eigentümers verbieten automatisierte Sammlung ausdrücklich. Dieser Guide behandelt alle drei Ansätze, was jeder liefert, wo jeder scheitert, und die rechtliche Realität vorab.
Warum Rotten-Tomatoes-Daten scrapen?
Rotten Tomatoes' Tomatometer und Audience Score verankern einen Großteil der nachgelagerten Rezeptions-Recherche und treiben an:
- Sentiment- und Review-Aggregation — Critic- und Audience-Konsens für einen Title abrufen, ohne ihn selbst aus Rohdaten-Reviews neu herzuleiten.
- Streaming-Katalog-Qualitätssignale — ein Vertrauenssignal (Tomatometer, „Certified Fresh“) an einen Title hängen, bevor du ihn empfiehlst oder lizenzierst.
- Critic-vs.-Audience-Divergenz-Recherche — Tomatometer gegen Audience Score vergleichen, um Titles zu finden, bei denen Presse- und Publikumsreaktion stark auseinandergehen.
- Markt- und Release-Recherche — verfolgen, wie neue Releases abschneiden, indem du „in theaters"- und „best TV"-Listen beobachtest, sobald Scores eintreffen.
- Cross-Referenzierung mit anderen Rating-Quellen — Rotten Tomatoes' Zwei-Score-System mit TMDB-Katalog-Metadaten oder Metacritics Metascore kombinieren, für ein vollständigeres Rezeptionsbild, als eine einzelne Quelle liefert.
Ist es legal, Rotten Tomatoes zu scrapen?
Option 1: DIY in Python (und warum es scheitert)
Rotten Tomatoes' Movie- und TV-Seiten sind React-gerendert, mit Score-Daten, die neben dem Markup in einem JSON-Payload eingebettet sind, deshalb muss ein DIY-Scraper in der Regel entweder einen Headless-Browser steuern oder diesen eingebetteten State ausgraben:
import requests
from bs4 import BeautifulSoup
resp = requests.get(
"https://www.rottentomatoes.com/m/inception",
headers={"User-Agent": "Mozilla/5.0 (compatible; research-bot/1.0)"},
)
soup = BeautifulSoup(resp.text, "html.parser")
# Tomatometer and Audience Score render client-side from a score-details
# JSON blob embedded in the page — there's no clean <script type="application/ld+json">
# AggregateRating block to lean on the way there is on some other review sites
Es demot und scheitert dann:
- Die ToS nennen Scraping direkt, und es ist das strengste Verbot in dieser Serie bisher. Fandangos Terms of Use nennen Robots, Spiders, Crawler und „data gathering or extraction software“ beim Namen, dazu eine explizite AI/ML-Trainings-Einschränkung — es gibt keine Grauzone, um die man argumentieren könnte.
- Kein sauberer strukturierte-Daten-Fallback. Anders als Seiten, die einen
AggregateRating-JSON-LD-Block exponieren, leben Rotten Tomatoes' Tomatometer und Audience Score im client-gerenderten Komponenten-State, was bedeutet, dass du entweder einen Headless-Browser laufen lassen oder eine interne Payload-Form reverse-engineeren musst, die nicht dokumentiert ist und sich unangekündigt ändert. - Vier verschiedene Content-Typen, vier verschiedene Seiten-Formen. Movies, TV-Serien, Staffeln und Episoden rendern jeweils anders — ein Parser, der auf Movie-Seiten abgestimmt ist, braucht in der Regel eine separate Behandlung für TV.
- Reviews paginieren hinter Cursor-basierten „load more"-Requests. Critic- und Audience-Review-Snippets sind nicht vollständig im initialen HTML vorhanden; mehr als die erste Seite zu holen bedeutet, einen internen Pagination-Call nachzubauen.
Option 2: No-Code / Ready-made Tools
Marketplace-Scraper-Actors existieren für einmalige Rotten-Tomatoes-Abzüge und sind für einen Spreadsheet-Export einer Handvoll Titles okay. Sie tragen aber dasselbe Terms-of-Use-Risiko wie DIY-Scraping, und keines von ihnen löst das Scheduling- oder Multi-Plattform-Schema-Problem für eine echte Pipeline. Die beiden lizenzierten Alternativen — Fandangos eigenes Developer Network und Fabric Origins B2B-API — erfordern beide ein kostenpflichtiges Abo und einen Freigabeprozess; keine bietet einen kostenlosen oder Same-Day-Signup-Weg.
Option 3: Eine strukturierte Rotten-Tomatoes-API
Für einen wiederholbaren Workflow ohne fünfstellige Jahreslizenz oder 60-Tage-Freigabewartezeit liefert eine Rotten-Tomatoes-Scraping-API normalisiertes JSON, ohne dass du Page-Parsing pflegen musst. Suche nach einem Title, um seinen Pfad zu bekommen:
curl "https://api.crawlora.net/api/v1/rottentomatoes/search?query=inception" \
-H "x-api-key: $CRAWLORA_API_KEY"
{
"code": 200,
"msg": "OK",
"data": {
"query": "inception",
"limit": 2,
"results": [
{
"title": "Inception",
"path": "/m/inception",
"url": "https://www.rottentomatoes.com/m/inception",
"release_year": "2010",
"tomatometer_score": 87,
"tomatometer_sentiment": "POSITIVE"
}
]
}
}
Hol dann Movie-, Series- oder Person-Detail per Pfad in Python:
import requests
h = {"x-api-key": "YOUR_API_KEY"}
base = "https://api.crawlora.net/api/v1/rottentomatoes"
hits = requests.get(f"{base}/search", headers=h, params={"query": "inception"}).json()["data"]["results"]
movie = requests.get(f"{base}/movie", headers=h, params={"path": hits[0]["path"]}).json()["data"]
reviews = requests.get(f"{base}/movie/reviews", headers=h, params={"path": hits[0]["path"], "type": "critics", "limit": 10}).json()["data"]
Movie-Detail liefert Tomatometer und Audience Score als separate Objekte (echte Felder — prüf die docs):
{
"code": 200,
"msg": "OK",
"data": {
"title": "Inception",
"path": "/m/inception",
"url": "https://www.rottentomatoes.com/m/inception",
"media_type": "Movie",
"critics_score": { "score_percent": "87%" },
"audience_score": { "score_percent": "91%" },
"public_page_derived": true
}
}
TV funktioniert nach demselben Prinzip, aber als Series-/Season-/Episode-Hierarchie — /rottentomatoes/series für die Show, /rottentomatoes/season für eine Staffel, /rottentomatoes/episode für eine einzelne Episode:
series = requests.get(f"{base}/series", headers=h, params={"path": "/tv/breaking_bad"}).json()["data"]
season = requests.get(f"{base}/season", headers=h, params={"path": "/tv/breaking_bad/s01"}).json()["data"]
episode = requests.get(f"{base}/episode", headers=h, params={"path": "/tv/breaking_bad/s01/e01"}).json()["data"]
{
"code": 200,
"msg": "OK",
"data": {
"title": "Breaking Bad",
"path": "/tv/breaking_bad",
"url": "https://www.rottentomatoes.com/tv/breaking_bad",
"media_type": "TvSeries",
"number_of_seasons": 5,
"critics_score": { "score_percent": "96%" },
"audience_score": { "score_percent": "97%" },
"public_page_derived": true
}
}
/rottentomatoes/person liefert die Filmografie eines Cast-/Crew-Mitglieds mit Critic-Scores pro Title; /rottentomatoes/browse/movies und /rottentomatoes/browse/tv liefern kuratierte Listen (Movies in Theaters, Best TV Shows und Ähnliches), filterbar über sort und limit. Speichere eine Zeile pro Title (oder pro Review) und lass Search- und Browse-Abrufe nach Zeitplan erneut laufen.
Was du sammeln kannst
Title-Suche (Title, Pfad, URL, Release-Jahr, Tomatometer-Score und -Sentiment); Movie-, Series-, Season- und Episode-Detail (Tomatometer und Audience Score als separate Prozent-Objekte, Media-Typ, Staffel-/Episoden-Anzahl, Parent-Series- und Parent-Season-Referenzen, Ausstrahlungsdaten); Critic- und Audience-Review-Snippets pro Title (Anzeigename und Review-Ausschnitt, Cursor-paginiert); Person-Detail (Name, Geburtsdatum, Geburtsort, höchstbewerteter Title und Filmografie mit Critic-Scores pro Title); und kuratierte Browse-Listen für Movies in Theaters und Top-TV-Shows. Nur öffentliche Aggregat- und Review-Daten.
Grenzen
- Die strengste ToS in dieser Serie bisher. Fandango nennt Robots, Spiders, Crawler und Daten-Extraktions-Software ausdrücklich beim Namen und verbietet separat AI/ML-Trainingsnutzung — begrenze jedes Projekt auf aggregierte Scores und eine begrenzte, attributierte Review-Stichprobe, und verfolge für alles im großen Maßstab lizenzierten Zugang.
- Keine kostenlose offizielle API, und beide lizenzierten Wege sind kostenpflichtig und freigabe-gebunden. Fandangos eigenes Developer Network startet Berichten zufolge bei rund 60.000 $/Jahr mit bis zu 60 Tagen Prüfung; Fabric Origins B2B-Alternative erfordert ebenfalls ein kostenpflichtiges Abo und eine Konto-Freigabe.
- Kein sauberer JSON-LD-Fallback. Scores rendern aus client-seitigem Komponenten-State statt aus einem strukturierten-Daten-Block, DIY-Parsing bedeutet also entweder einen Headless-Browser oder das Reverse-Engineering eines undokumentierten Payloads.
- Reviews paginieren hinter einem Cursor. Eine vollständige Review-Stichprobe für einen Title braucht wiederholte Calls, die
page_info.end_cursorfolgen, nicht einen einzelnen Seitenaufruf. - Reviewer-Identität ist zuordenbar. Critic- und Audience-Review-Snippets sind an einen namentlich genannten Reviewer geknüpft — behandle die Review-Sammlung unter derselben Personendaten-Perspektive wie jeden anderen namentlichen Review-Scrape, und vermeide Bulk-Republishing von vollständigem Review-Text.
Wo das eingesetzt wird
- Rezeptions-Recherche — Tomatometer gegen Audience Score vergleichen, um Critic-/Audience-Divergenz über Genres oder Release-Fenster hinweg zu untersuchen.
- Katalog-Qualitätssignale — einen Vertrauens-Score an einen Title hängen, bevor du ihn in einem Streaming- oder Discovery-Produkt featurest oder lizenzierst.
- Studio- und Release-Tracking — verfolgen, wie neue Releases abschneiden, sobald sie in Theaters oder im TV landen.
- Multi-Quellen-Anreicherung — Rotten Tomatoes' Zwei-Score-System mit TMDB-Katalog-Metadaten oder Metacritics Critic-/User-Scores in einer Pipeline kombinieren.
Sources
Leg los mit dem Sammeln
Probier es zuerst kostenlos aus: jage eine beliebige öffentliche URL durch den Free Web Scraper, oder prüfe mit dem Anti-Bot Checker, ob eine Seite Bots blockiert — ohne Anmeldung.
Teste die Search-, Movie-, Series- und Person-Endpoints im Playground, sieh dir das Schema in den API docs an und wirf einen Blick aufs pricing. Rotten Tomatoes sagt dir, wie Critics und Audience einen Title bewertet haben; TMDB ergänzt saubere Katalog-Metadaten und Artwork, und Metacritic fügt ein zweites Critic-/User-Scoring-System zum Vergleich hinzu — kombiniere zwei davon für ein vollständigeres Rezeptionsbild, als eine einzelne Quelle liefert. Siehe auch how to choose a web scraping API und is web scraping legal.
Häufig gestellte Fragen
Hat Rotten Tomatoes eine öffentliche API?
Rotten Tomatoes betreibt ein Fandango Developer Network, aber es ist nicht Self-Service oder kostenlos. Neue Bewerber reichen einen Vorschlag ein, der die geplante Nutzung beschreibt, die Prüfung kann bis zu 60 Tage dauern, und die Lizenzierung startet Berichten zufolge bei rund 60.000 $/Jahr für Score- und Review-Snippet-Zugriff.
Ist es legal, Rotten Tomatoes zu scrapen?
Fandangos Terms of Use verbieten ausdrücklich Robots, Spiders, Crawler und Daten-Extraktions-Software, und untersagen separat, Rotten-Tomatoes-Content für das Training eines KI-/ML-Modells zu nutzen. Automatisierte Sammlung außerhalb der lizenzierten API oder Fabric Origins B2B-API birgt echtes Terms-of-Use-Risiko — das ist eine der strengeren Plattformen in dieser Serie.
Welche Daten kannst du von Rotten Tomatoes bekommen?
Title-Suchergebnisse, Movie-/Series-/Season-/Episode-Detail mit Tomatometer und Audience Score, Critic- und Audience-Review-Snippets, Cast- und Crew-Filmografien mit Scores pro Title, und kuratierte Browse-Listen wie Movies in Theaters oder Top-TV-Shows.
Was ist der Unterschied zwischen dem Tomatometer und dem Audience Score?
Der Tomatometer ist der Prozentsatz professioneller Critic-Reviews, die positiv sind (ein Critic-Konsens-Score). Der Audience Score ist der Prozentsatz verifizierter Ticketkäufer oder registrierter Nutzer, die einen Title positiv bewertet haben. Die beiden gehen häufig auseinander, weshalb ihr Vergleich einer der häufigsten Anwendungsfälle für Rotten-Tomatoes-Daten ist.
Gibt es eine kostenlose Alternative zu Rotten Tomatoes' offizieller API?
Es gibt keine kostenlose offizielle Stufe. Fabric Origin lizenziert eine kostenpflichtige, freigabe-gebundene B2B-Rotten-Tomatoes-API, die Movies, Shows, Staffeln und Episoden abdeckt, als Alternative zur direkten Bewerbung über Fandango, erfordert aber weiterhin ein Abo und eine Konto-Freigabe.
Wie bekommst du Rotten-Tomatoes-Daten für eine TV-Show, nicht nur einen Film?
Rotten Tomatoes strukturiert TV als Series-/Season-/Episode-Hierarchie. Ein Series-Endpoint liefert Show-Level-Tomatometer und Audience Score plus Staffel-Anzahl; ein Season-Endpoint liefert die Scores dieser Staffel; ein Episode-Endpoint liefert Detail pro Episode inklusive Ausstrahlungsdatum und Parent-Series-/Parent-Season-Referenz.
Kannst du einzelne Critic- und Audience-Reviews bekommen, nicht nur den aggregierten Score?
Ja — Review-Snippets sind pro Title verfügbar, getrennt nach Critic- und Audience-Typ, und paginieren hinter einem Cursor. Da Review-Text einem namentlich genannten Reviewer zugeordnet ist, behandle die Sammlung als begrenzte, attributierte Stichprobe statt als Bulk-Republish.