Tony Wang6 min de lecturaCómo scrapear TMDB en 2026 (API y Python)
Consigue datos de movies y TV de TMDB en 2026 — la API oficial gratis, no-code o una API estructurada — con ejemplos JSON reales.
TMDB es una de las pocas plataformas de esta serie con una API oficial real, gratuita y self-serve — puedes registrarte y conseguir una key en minutos, y cubre casi todo lo que necesita un producto de movies/TV. Así que la pregunta honesta no es "¿TMDB tiene API?", sino "¿cuándo sigues queriendo una API de scraping en su lugar?". Esta guía cubre la API propia de TMDB, opciones no-code y una API estructurada multi-plataforma, con la realidad legal de cada una expuesta desde el principio.
¿Por qué usar datos de TMDB?
Los datos de movies, TV y personas de TMDB sostienen buena parte del tooling de cine/TV, que impulsa:
- Enriquecimiento de catálogo — añadir título canónico, cast, género y datos de estreno a una app de media, watchlist o dataset interno.
- Recomendación y descubrimiento — construir features de browsing y descubrimiento por género, época o estilo "en cartelera".
- Seguimiento de talento y filmografía — seguir la obra de un director o actor a lo largo de sus créditos de movie y TV.
- Investigación de rating cross-platform — combinar el rating propio de TMDB con los scores de IMDb o Metacritic para tener una imagen de recepción más completa que la que da una sola fuente.
- Pipelines de posters y metadata — el CDN de posters e imágenes de perfil de TMDB es un backing store habitual para el artwork de apps de media.
¿Es legal usar/scrapear TMDB?
Opción 1: la API gratuita propia de TMDB (y sus límites reales)
La API para developers de TMDB es real y funciona. Registra una cuenta, pide una key desde los ajustes de API de tu cuenta y llámala directamente — no necesitas scraping:
curl "https://api.themoviedb.org/3/movie/27205" \
-H "Authorization: Bearer YOUR_TMDB_V4_READ_ACCESS_TOKEN"
# or with the v3 query-param key:
curl "https://api.themoviedb.org/3/movie/27205?api_key=YOUR_TMDB_API_KEY"
Esa es una forma legítima y gratuita de conseguir el propio catálogo de movies y TV de TMDB — título, overview, cast, crew, géneros y el rating de TMDB. El CDN de TMDB limita las requests a unas 50 requests/segundo y 20 conexiones por IP, lo cual es generoso para una herramienta de lookup en una sola plataforma.
Dónde empieza a importar menos para un pipeline más grande:
- Es el catálogo de TMDB, no la página renderizada. La API devuelve los registros estructurados propios de TMDB — no te da el módulo de "títulos similares", los charts de popularidad ni los hilos de reviews de usuarios tal como se renderizan realmente a los visitantes en themoviedb.org; parte de eso solo existe como presentación a nivel de página.
- Una cuenta, key y schema separados por plataforma. Si tu producto también extrae IMDb, Letterboxd o Metacritic, la API de TMDB es un modelo de auth más, un rate limit más y una forma de respuesta más que mantener junto a las demás.
- Los términos comerciales necesitan una lectura real. El uso no comercial es gratis con atribución; cualquier cosa que cobre a usuarios, redistribuya contenido de TMDB o sea comercial de otra forma necesita primero el visto bueno escrito de TMDB — vale la pena contrastarlo con tu caso de uso real antes de construir sobre eso.
Opción 2: herramientas no-code
Existen actors de scraping de marketplace y conectores no-code para workflows relacionados con TMDB — la mayoría envuelven la propia API de TMDB en lugar del sitio, ya que el sitio mismo prohíbe el scraping. Están bien para una extracción puntual o una exportación a spreadsheet, pero para un pipeline programado añaden una capa de indirección sobre una API que de otro modo podrías llamar directamente, y tampoco resuelven el problema del schema multi-plataforma.
Opción 3: una API estructurada de TMDB (vía Crawlora)
Si quieres TMDB junto a otras plataformas en una sola forma normalizada — el mismo header de auth, JSON consistente —, una TMDB scraping API te lo da. Busca en movies, TV y personas:
curl "https://api.crawlora.net/api/v1/tmdb/search?query=inception" \
-H "x-api-key: $CRAWLORA_API_KEY"
{
"code": 200,
"msg": "OK",
"data": {
"query": "inception",
"page": 1,
"has_next_page": true,
"results": [
{ "type": "movie", "id": "27205", "title": "Inception", "release_date": "2010-07-15", "overview": "Cobb, a skilled thief...", "uri": "https://www.themoviedb.org/movie/27205-inception" }
]
}
}
Luego resuelve el id y consulta el detalle de movie, TV o person en Python:
import requests
h = {"x-api-key": "YOUR_API_KEY"}
base = "https://api.crawlora.net/api/v1/tmdb"
hits = requests.get(f"{base}/search", headers=h, params={"query": "inception"}).json()["data"]["results"]
movie_id = hits[0]["id"]
movie = requests.get(f"{base}/movie/{movie_id}", headers=h).json()["data"]
now_playing = requests.get(f"{base}/movie/list", headers=h, params={"category": "now_playing"}).json()["data"]
El detalle de movie es JSON normalizado con cast, crew y rating (campos reales — revisa los docs):
{
"code": 200,
"msg": "OK",
"data": {
"id": "27205",
"title": "Inception",
"tagline": "Your mind is the scene of the crime.",
"release_date": "2010-07-15",
"year": 2010,
"runtime_minutes": 148,
"genres": ["Action", "Science Fiction", "Adventure"],
"countries": ["United States", "United Kingdom"],
"status": "Released",
"budget": 160000000,
"revenue": 839030630,
"rating": { "average": 8.372, "count": 39524, "review_count": 8 },
"top_crew": [{ "name": "Christopher Nolan", "slug": "525", "jobs": ["Director", "Writer"] }],
"cast": [{ "name": "Leonardo DiCaprio", "slug": "6193", "character": "Dom Cobb" }],
"uri": "https://www.themoviedb.org/movie/27205-inception"
}
}
TV funciona con la misma forma, con first_air_year, last_air_year y number_of_episodes en lugar de runtime y budget. /tmdb/movie/list y /tmdb/tv/list devuelven listas curadas y filtrables (category, sort_by, with_genres, min_rating, date_from/date_to, y más) para browsing y descubrimiento, y /tmdb/person devuelve bio, fecha de nacimiento, foto y filmografía por id — con /tmdb/person/list para explorar personas. Guarda una fila por título (o por persona) y vuelve a correrlo con un schedule.
Qué puedes recolectar
Datos públicos del catálogo de TMDB: búsqueda multi-tipo (movie, TV o person, con id y url); detalle de movie y TV (título, tagline, overview, fecha de estreno, runtime o número de episodios, géneros, países, status, budget/revenue en el caso de movies, poster, promedio/conteo de rating, top crew y cast con nombres de personaje); listas curadas y filtrables de movie/TV (now playing, popular, top rated, upcoming, airing today, y filtros por género/rating/fecha); y detalle de person (bio, fecha de nacimiento, foto y filmografía a lo largo de créditos de movie y TV).
Limitaciones y desafíos comunes
- Sabe qué puerta estás usando. La API propia de TMDB es gratuita y legítima para trabajo no comercial en una sola plataforma; scrapear el sitio themoviedb.org en sí va explícitamente en contra de los términos de TMDB de cualquier forma.
- El uso comercial necesita una conversación real con TMDB. La atribución sola cubre solo el uso no comercial; cualquier cosa comercial — incluyendo un producto construido sobre una API normalizada que incluya datos de TMDB — debería revisarse contra los API Terms of Use de TMDB y, donde se requiera, licenciarse directamente con TMDB.
- La API es el catálogo de TMDB, no todo lo de la página. Parte del contenido renderizado en la página (hilos de reviews, "títulos similares" tal como se muestran a los usuarios, charts de popularidad en vivo) no es un campo directo de la API.
- Fan-out por registro. Un registro completo (título más cast, crew y rating) es una llamada por id; construir un catálogo implica iterar ids desde los endpoints de search o list.
- Solo datos públicos. Esto recolecta lo que TMDB ya expone a través de su API — nunca una forma de saltarte las restricciones del sitio de TMDB ni sus términos de licencia comercial.
Dónde se usa esto
- Enriquecimiento de catálogo — añadir título canónico, cast y datos de rating a un producto de media.
- Superficies de descubrimiento — impulsar "en cartelera", browsing por género y features de recomendación.
- Investigación de recepción cross-platform — combinar el rating de TMDB con los scores de IMDb y Metacritic en un solo schema normalizado.
- Seguimiento de talento — seguir la filmografía de un director o actor a lo largo de su trabajo en movie y TV.
Fuentes
Empieza a recolectar
Pruébalo primero, gratis: pasa cualquier URL pública por el Free Web Scraper, o revisa si un sitio bloquea bots con el Anti-Bot Checker — sin registro.
Prueba los endpoints de search, movie y person en el Playground, revisa el schema en los API docs y consulta los pricing. TMDB te dice qué es un título, quién lo hizo y cómo lo calificó la propia comunidad de TMDB; IMDb añade el rating y la baseline de reviews por defecto de la web, y Metacritic añade el scoring de crítica versus usuarios — combínalos para tener una imagen completa de la recepción en lugar de confiar en una sola fuente. Letterboxd añade el ángulo de comunidad cinéfila que el catálogo de TMDB no cubre, y si el anime es parte de tu catálogo, how to scrape anime data cubre las bases de datos de comunidad (AniList, MyAnimeList) que TMDB no rastrea. Consulta también how to choose a web scraping API e is web scraping legal.
Parte de nuestra serie de guías how-to-scrape — todas las plataformas que cubrimos, en un solo índice.
Preguntas frecuentes
¿TMDB tiene una API gratuita? ¿Por qué no usar solo eso?
Sí — la API oficial de TMDB (developer.themoviedb.org) es realmente gratuita y self-serve para uso no comercial, y es una primera opción legítima para una herramienta de lookup de TMDB en una sola plataforma. Una API de scraping estructurada tiene sentido cuando normalizas TMDB junto a otras plataformas como IMDb o Metacritic en un mismo schema, o cuando quieres evitarte gestionar un key y un modelo de rate-limit de TMDB solo para una fuente.
¿Es legal hacer scraping de TMDB?
Los Terms of Use de TMDB prohíben scrapear directamente el sitio themoviedb.org. La API propia de TMDB es el camino sancionado — gratis para uso no comercial con atribución; el uso comercial necesita un acuerdo escrito aparte con TMDB. Esto no es asesoría legal.
¿Qué datos de TMDB puedo recolectar?
Resultados de búsqueda, detalle de movie y TV (overview, géneros, cast, crew, rating, fechas de estreno/emisión, runtime o número de episodios), listas curadas y filtrables (now playing, popular, top rated, por género o rating) y detalle de person con filmografía.
¿Necesito un API key de TMDB para usar los endpoints de TMDB de Crawlora?
No — los endpoints de TMDB de Crawlora solo usan tu API key de Crawlora; no necesitas una cuenta ni un key aparte de TMDB.
¿Puedo obtener movies, TV shows y people de una sola search?
Sí — /tmdb/search devuelve resultados mixtos entre tipos movie, TV y person, cada uno con un id y una uri que puedes resolver hasta el detalle completo.
¿La API de TMDB cubre reviews y "títulos similares"?
Devuelve el rating agregado propio de TMDB, pero no todos los módulos renderizados en la página (como el widget en vivo de "títulos similares" o los hilos de reviews), tal como se muestran en themoviedb.org, tienen un campo directo en la API.
¿Puedo usar datos de TMDB comercialmente?
La API propia de TMDB necesita un acuerdo escrito aparte con TMDB para el uso comercial más allá de la simple atribución no comercial. Revisa los API Terms of Use de TMDB para tu caso de uso concreto antes de construir un producto comercial.