Tony Wang6 min de lecturaCómo scrapear Mercari en 2026 (API y Python)
Scrapea Mercari en 2026: búsqueda, detalle de artículo y taxonomía vía Python DIY, no-code o una API estructurada, y qué permiten sus ToS.
Mercari no tiene un portal público para desarrolladores que permita leer su catálogo, así que en 2026 el camino fiable más rápido es una API de scraping estructurada que devuelva JSON normalizado para resultados de búsqueda, detalle de artículo y taxonomía — en vez de parsear tú mismo las páginas de listing de Mercari. Mercari está en el mismo género de resale que StockX y Poshmark, pero con un matiz que esos dos no tienen: Mercari US y Mercari Japan son dos marketplaces distintos bajo una misma marca, con apps separadas, catálogos de artículos separados y monedas separadas — esta guía cubre el sitio de US.
¿Por qué scrapear datos de Mercari?
- Investigación de precios de reventa — rastrea lo que realmente se vende un artículo, marca o categoría en un marketplace peer-to-peer grande, como comparación frente al retail u otros sitios de resale.
- Investigación de arbitraje entre mercados — compara los precios de listing de US contra los precios de otro marketplace para la misma marca o tipo de artículo (nota: Mercari Japan es un catálogo separado, no el mismo inventario).
- Seguimiento de tendencias por marca y categoría — obtén el número de listings y precios de una marca o categoría para ver qué está circulando y en qué rango de precio.
- Investigación de mercado — usa la taxonomía de categoría/marca/talla para dimensionar cuántos listings activos existen en un nicho concreto sin tener que adivinar ortografías.
- Pipelines y agentes de IA — alimenta datos normalizados de listings y artículos a un agente de pricing o sourcing en vez de hacer screen-scraping de HTML.
¿Es legal scrapear Mercari?
Opción 1: Hazlo tú mismo en Python (y por qué se rompe)
Un scraper ingenuo obtiene una página de resultados de búsqueda e intenta extraer las tarjetas de listing del markup renderizado:
import requests
from bs4 import BeautifulSoup
resp = requests.get(
"https://www.mercari.com/search/?keyword=nike+jacket",
headers={"User-Agent": "Mozilla/5.0 (compatible; research-bot/1.0)"},
)
soup = BeautifulSoup(resp.text, "html.parser")
# Listing cards render from client-side state (React/Next.js), so a plain
# HTML parse mostly returns an empty shell — you end up reverse-engineering
# the app's internal JSON endpoints instead
Funciona una vez en la demo, y después se rompe:
- La política de Prohibited Conduct es explícita. Nombra directamente a robots, spiders, crawlers y scrapers como una infracción, aparte de cualquier bloqueo técnico.
- Defensas anti-bot. Mercari protege su sitio con detección de bots; las IPs de datacenter y las requests headless se limitan o bloquean rápido, sobre todo en la búsqueda.
- Markup renderizado en el cliente. Los resultados de búsqueda y las páginas de artículo se renderizan desde estado de JavaScript, no desde HTML estable del servidor — un cambio de layout rompe el scraping por selectores CSS sin avisar.
- Sin alternativa sancionada. A diferencia de eBay, Mercari directamente no tiene portal para desarrolladores, así que no hay una API oficial-pero-limitada a la que recurrir para leer el catálogo.
Opción 2: Herramientas no-code o ya hechas
Las extensiones de navegador y los scrapers de apuntar y hacer clic pueden exportar una sola página de búsqueda o una foto de un artículo, pero rastrear los precios de reventa de una marca o el volumen de listings de una categoría a lo largo del tiempo significa volver a extraer las mismas páginas de forma programada — un trabajo para un endpoint estable con historial guardado, no para una exportación puntual.
Opción 3: Una API estructurada de Mercari
Para un flujo de trabajo repetible, una Mercari scraping API devuelve JSON normalizado para búsqueda, detalle de artículo, el feed de inicio, autocompletado y taxonomía — sin parsing de páginas, sin depender de una app que no existe. Busca por palabra clave:
curl "https://api.crawlora.net/api/v1/mercari/search?query=nike+jacket" \
-H "x-api-key: $CRAWLORA_API_KEY"
{
"code": 200,
"msg": "OK",
"data": {
"query": "nike jacket",
"total_results": 21523,
"items": [
{
"id": "m31455228584",
"url": "https://www.mercari.com/us/item/m31455228584",
"title": "Nike varsity jacket. New with tags!",
"thumbnail_url": "https://u-mercari-images.mercdn.net/photos/m31455228584_1.jpg?1784911712",
"price_cents": 4873,
"original_price_cents": 5400,
"num_likes": 1931,
"seller_id": "794269920",
"created_at_unix": 1774057908,
"updated_at_unix": 1784911712
}
]
}
}
query es obligatorio. Obtén el detalle completo de un artículo, sugerencias de autocompletado o la taxonomía:
import requests
h = {"x-api-key": "YOUR_API_KEY"}
base = "https://api.crawlora.net/api/v1/mercari"
hits = requests.get(f"{base}/search", headers=h, params={"query": "nike jacket"}).json()["data"]["items"]
item_id = hits[0]["id"]
item = requests.get(f"{base}/item/{item_id}", headers=h).json()["data"]
suggestions = requests.get(f"{base}/autocomplete", headers=h, params={"query": "nik"}).json()["data"]
taxonomy = requests.get(f"{base}/master", headers=h).json()["data"]
El detalle de artículo trae el set completo de fotos, el precio y una lista similar_items que el propio Mercari muestra (campos reales — revisa los docs):
{
"code": 200,
"msg": "OK",
"data": {
"id": "m38581776856",
"url": "https://www.mercari.com/us/item/m38581776856",
"title": "Women's NIKE WNBA Nike Mesh Jacket Size NEW MSRP 120",
"description": "Women's NIKE WNBA Nike Mesh Jacket Size NEW MSRP 120",
"photos": [
"https://u-mercari-images.mercdn.net/photos/m38581776856_1.jpg?1777492193",
"https://u-mercari-images.mercdn.net/photos/m38581776856_2.jpg?1777492193"
],
"price_cents": 4578,
"condition_code": 1,
"category_code": 6,
"shipping_from_state": "New Jersey",
"similar_items": [
{
"id": "m34982910331",
"url": "https://www.mercari.com/us/item/m34982910331",
"title": "Lululemon Every Moment Pant *26\" Black Size 6",
"thumbnail_url": "https://u-mercari-images.mercdn.net/photos/m34982910331_1.jpg?1783333561",
"price_cents": 4000,
"num_likes": 1967,
"seller_id": "790985424",
"created_at_unix": 1783333561
}
]
}
}
/mercari/home devuelve la misma forma normalizada que la búsqueda, pero para el feed de inicio curado de Mercari; /mercari/autocomplete convierte una consulta parcial en términos de búsqueda sugeridos, y /mercari/master devuelve el árbol de categorías completo, la lista de marcas y la lista de tallas en una sola llamada para que puedas enriquecer los valores de category_code y condition_code en vez de adivinar el mapeo interno de Mercari.
Qué puedes recolectar
- Resultados de búsqueda y del feed de inicio: id, título, thumbnail, precio en centavos, precio original cuando hay descuento, conteo de likes, id de vendedor, y marcas de tiempo de creación/actualización
- Detalle de artículo: descripción completa, array de fotos, precio, códigos de condición y categoría, estado de envío, y una lista
similar_items - Autocompletado: términos de búsqueda sugeridos para una palabra clave parcial, reflejando las sugerencias propias del cuadro de búsqueda de Mercari
- Taxonomía: árbol de categorías completo (con ids de padre/hijo), lista de marcas y lista de tallas (con nombres cortos y códigos)
Limitaciones
- No existe una API oficial. Mercari directamente no tiene un portal para desarrolladores — no hay una alternativa limitada pero sancionada a la que recurrir, a diferencia de eBay.
- La política de Prohibited Conduct es explícita. Nombra directamente a robots, spiders y scrapers como una infracción, independientemente de cualquier bloqueo técnico.
- US y Japan son marketplaces separados. Estos endpoints cubren Mercari US (
mercari.com) — los ids de artículo, categorías y precios no se mapean al catálogo separado ni al precio en yenes de Mercari Japan (jp.mercari.com). - Los precios y conteos de likes son una foto de un instante. Los artículos de Mercari cambian de precio, reciben likes, se agrupan o se marcan como vendidos constantemente — pon marca de tiempo a lo que guardes.
- Solo datos públicos. Esto cubre datos públicos de búsqueda, artículo y taxonomía — no mensajes privados, ofertas, ni una forma de hacer un pedido en nombre de un comprador.
Dónde se usa esto
- Investigación de reventa y sourcing — comparar los precios de venta en Mercari de una marca contra el retail u otro marketplace de resale.
- Dimensionamiento por marca y categoría — medir el volumen de listings y las bandas de precio de una marca o categoría usando la taxonomía más la búsqueda.
- Pipelines de pricing y sourcing — alimentar datos normalizados de artículos a un agente que marque listings subvalorados o siga una watchlist.
Fuentes
Empieza a recolectar
Pruébalo primero, gratis: pasa cualquier URL pública por el Free Web Scraper, o comprueba si un sitio bloquea bots con el Anti-Bot Checker — sin registro.
Prueba los endpoints de search, item, home, autocomplete y master en el Playground, revisa el esquema de request y response en los API docs, y consulta los costes en créditos en la página de pricing. Mercari es un marketplace de segunda mano generalista, más cercano a los listings de social-selling de Poshmark y al resale de moda peer-to-peer de Vinted que al pricing tipo order-book de StockX — combina how to scrape StockX con esta guía para tener una imagen más completa del mercado de resale. Consulta también is web scraping legal.
Parte de nuestra serie de guías how-to-scrape — todas las plataformas que cubrimos, en un solo índice.
Preguntas frecuentes
¿Tiene Mercari una API pública para desarrolladores?
No. Mercari no publica una API pública para desarrolladores ni un portal para acceso de lectura de terceros a su catálogo. Una API de scraping estructurada es el camino práctico para obtener datos normalizados de búsqueda, detalle de artículo y taxonomía, en vez de parsear tú mismo las páginas.
¿Es legal scrapear Mercari?
La política de Prohibited Conduct de Mercari prohíbe expresamente el uso de robots, spambots, spiders, crawlers, scrapers u otros medios automatizados para acceder al servicio o extraer datos. Los datos públicos de un listing no tienen derechos de autor, y acceder a datos públicos no viola la CFAA según hiQ Labs v. LinkedIn, pero el scraping sigue infringiendo los propios términos de uso de Mercari — esto no es asesoría legal, revisa la política tú mismo.
¿Qué prohíbe el robots.txt de Mercari?
El robots.txt de Mercari no bloquea de forma general las páginas de búsqueda o de artículo, pero sí prohíbe las rutas de cuenta, transacción y venta (como /mypage/, /transaction/, /sell/, /us/selling/) para todo crawler, y bloquea directamente a PetalBot y YandexBot.
¿Son Mercari US y Mercari Japan el mismo catálogo?
No. Mercari US (mercari.com) y Mercari Japan (jp.mercari.com) son marketplaces separados, con apps, catálogos de artículos y monedas distintos. Un item id de US, un precio en centavos y la taxonomía no se trasladan a los listings de Mercari Japan.
¿Cómo devuelve la API los precios de Mercari?
Los precios vuelven como price_cents, un entero en centavos en vez de dólares — un listing de $40.00 es 4000. El detalle de artículo también puede traer un campo separado original_price_cents cuando el artículo tuvo una rebaja de precio.
¿Qué devuelve el endpoint de taxonomía de Mercari?
El endpoint /mercari/master devuelve el árbol de categorías completo de Mercari (con ids de padre/hijo), la lista completa de marcas y la lista de tallas con nombres cortos y códigos, todo en una sola llamada.
¿Qué tan actuales son los datos de listings de Mercari de una API de scraping?
Trata los precios, conteos de likes y el estado del listing como una foto del momento de la llamada. Los listings de Mercari cambian de precio, reciben likes, se agrupan o se marcan como vendidos constantemente, así que pon marca de tiempo a lo que guardes en vez de tratarlo como vigente de forma indefinida.