Los mejores servidores MCP y skills de web scraping para Claude Code en 2026
Firecrawl, Bright Data, Zyte y Crawlora comparados como MCP servers y Agent Skills de Claude Code — comandos, tool counts y cuál conviene.
El ecosistema de skills y servidores MCP de Claude Code creció lo bastante rápido en 2026 como para que «qué herramienta de web scraping conecto» sea ahora una decisión real con trade-offs reales, no una moneda al aire entre wrappers casi idénticos. Algunos de estos plugins le entregan a tu agente markdown limpio de cualquier URL. Otros están construidos alrededor de un catálogo fijo de plataformas con nombre y devuelven JSON estructurado en su lugar. Uno de ellos te escribe un proyecto Scrapy real y ejecutable. Esta guía compara las opciones que aparecen en el propio marketplace de plugins de Claude Code, con comandos de instalación verificados y para qué está realmente construida cada una.
Servidor MCP vs. Agent Skill — la versión corta
Un skill es un archivo de instrucciones SKILL.md (más scripts opcionales) que Claude lee y sigue — sin conexión persistente, sin overhead de protocolo, se instala con un solo comando. Un servidor MCP es un proceso en ejecución (local u hospedado) que expone tools tipadas sobre el Model Context Protocol; Claude las descubre y las llama durante toda la sesión. Varios proveedores de abajo ofrecen ambos: un skill ligero para uso puntual simple, y un servidor MCP completo cuando quieres las tools siempre disponibles. Consulta Dale a tu agente de IA datos web en vivo con MCP para la mecánica más a fondo.
Qué evaluar
- Crawl genérico (cualquier URL → markdown) vs. datos de plataforma estructurados (sitios con nombre → JSON) — resuelven problemas distintos y la mayoría de los agentes terminan necesitando ambos.
- Cantidad de tools/skills y qué cubren realmente — un número grande no significa nada si las plataformas que necesitas no están incluidas.
- Manejo de anti-bot — ¿falla en silencio en sitios protegidos, o es esa la especialidad real del proveedor?
- Forma del output — markdown para que un agente lo lea, o un registro JSON tipado por esquema para un pipeline.
- Modelo de precios — basado en créditos vs. suscripción, y si una solicitud fallida igual se cobra.
- Ruta de instalación — un solo comando `claude mcp add` / `claude plugin install`, o edición manual de un archivo de configuración.
Los contendientes
| Tool | Formato | Cobertura | Instalación | Mejor para |
|---|---|---|---|---|
| Firecrawl MCP | Servidor MCP | 20 tools — scrape/crawl/search/extract de cualquier URL | claude mcp add firecrawl --env FIRECRAWL_API_KEY=... -- npx -y firecrawl-mcp | Crawl-a-markdown genérico para sitios arbitrarios |
| Bright Data | 21 skills + MCP | 60+ tools MCP, 40+ plataformas con nombre (Amazon, LinkedIn, TikTok...) | curl -fsSL https://cli.brightdata.com/install.sh | bash y luego bdata login | Extracción reforzada contra anti-bot a escala de plataforma |
| Zyte Web Data | 14 skills (plugin de Claude Code) | Genera un proyecto Scrapy completo a partir de un prompt | claude plugin marketplace add zyte-ai/claude-skills | Un spider real, desplegable y testeable — no un fetch puntual |
| Crawlora | 5 skills + MCP | 893 tools MCP / 828 endpoints con skill en 81 grupos de plataformas | claude mcp add --transport http crawlora https://mcp.crawlora.net/mcp --header "Authorization: Bearer $CRAWLORA_API_KEY" | JSON estructurado de plataformas con nombre, pago solo si hay éxito |
Firecrawl MCP — crawl-a-markdown genérico
El servidor MCP oficial de Firecrawl lista 20 tools en su entrada del Claude Code Marketplace (6,5k estrellas en GitHub, insignia de publicador verificado/oficial) y está construido alrededor de su producto principal: convertir cualquier URL en markdown limpio, hacer crawl de un sitio, o correr una extracción estructurada con un esquema JSON. No trabaja a partir de un catálogo fijo de plataformas con nombre — apúntalo a cualquier página pública. Elígelo cuando el trabajo sea «leer este sitio web arbitrario», no «dame los datos estructurados de esta plataforma». Firecrawl también ofrece un tier gratuito sin key (1.000 créditos/mes, sin cuenta) para uso puntual rápido.
Bright Data — escala anti-bot en más de 40 plataformas con nombre
El plugin brightdata/skills de Bright Data es el más grande de los cuatro: 21 skills que cubren search, scrape, más de 40 feeds de datos específicos por plataforma (Amazon, LinkedIn, Instagram, TikTok, YouTube, Zillow, y más), un skill completo de orquestación MCP para su servidor MCP de más de 60 tools, generación de código de proxy en cuatro niveles de red, e incluso un skill de inteligencia competitiva que encadena scrape + search en un reporte estructurado. Su servidor MCP se conecta mediante una URL remota (https://mcp.brightdata.com/mcp?token=...) con filtrado opcional por groups= (ecommerce, social, business, finance...) para que un agente no reciba las más de 60 tools de golpe. Elígelo cuando la fiabilidad anti-bot en objetivos difíciles y con nombre sea la restricción real y te sientas cómodo con precios estilo red de proxies.
Zyte Web Data — un spider de Scrapy real, no un scrape puntual
El plugin de Claude Code de Zyte toma una forma completamente distinta: en lugar de devolver los datos directamente, su skill /scrape ejecuta un pipeline de cinco etapas (definir campos → analizar el sitio → armar un proyecto Scrapy → generar código de extracción → generar el spider) y te entrega un proyecto ejecutable con una suite de tests que pasa (uv run scrapy crawl <spider> && uv run pytest fixtures/), desplegable opcionalmente en Scrapy Cloud para ejecuciones programadas. Son 14 skills en total, empaquetados como un plugin oficial de Claude Code (zyte-ai/claude-skills). Elígelo cuando necesites un spider mantenido, inspeccionable y redesplegable — no una sola respuesta JSON — y te sientas cómodo siendo dueño de un codebase Scrapy después.
Crawlora — JSON estructurado en 81 grupos de plataformas, pago solo si hay éxito
Crawlora ofrece tanto un servidor MCP (893 tools, hospedado en mcp.crawlora.net/mcp, instalación con un solo comando vía claude mcp add) como un paquete de skills más ligero (crawlora-skills, 5 skills: un skill catálogo general más otros enfocados en investigación de productos/precios, YouTube, reseñas de app stores, y búsqueda SERP/keywords) que se instala con npx skills add o como plugin del marketplace de Claude Code (/plugin marketplace add Crawlora-org/crawlora-skills). Cada tool mapea a un endpoint REST documentado y devuelve JSON normalizado — no markdown para volver a parsear — en search, mapas, e-commerce, social, finanzas, viajes, empleos, medios, app stores y reseñas. La facturación es pago solo si hay éxito: una llamada fallida (no-2xx) no se cobra, y el tier gratuito es de 2.000 créditos/mes sin tarjeta. Elígelo cuando el trabajo sea registros estructurados de plataformas con nombre y no quieras escribir ni mantener un parser por fuente.
Cómo elegir, según el trabajo
- Necesitas hacer crawl o leer sitios web arbitrarios como contexto para un agente → Firecrawl MCP.
- Necesitas extracción confiable de más de 40 plataformas de consumo/social específicas a escala → Bright Data.
- Necesitas un codebase de scraper real, mantenible y redesplegable → Zyte Web Data.
- Necesitas JSON estructurado de plataformas con nombre sin mantener un parser, facturado solo si hay éxito → Crawlora MCP o Skills.
- Todavía no estás seguro → la mayoría de los stacks de agentes en producción terminan corriendo un crawler genérico y una herramienta de plataforma estructurada en paralelo — resuelven mitades distintas del mismo problema.
Agrega datos web estructurados a Claude Code
893 tools en 81 grupos de plataformas, una sola API key, facturado solo si hay éxito. 2.000 créditos gratis al mes, sin tarjeta.
Fuentes
Lectura relacionada
- Crawlora vs Firecrawl — APIs de plataforma estructuradas vs. crawl/scrape/map nativo de IA.
- Crawlora vs Bright Data — API catalog developer-first vs. una plataforma amplia de proxy/datasets empresarial.
- Crawlora vs Zyte — endpoints estructurados vs. un stack de crawling basado en Scrapy.
- Dale a tu agente de IA datos web en vivo con MCP — cómo funciona MCP y cómo conectarte en tres minutos.
- Best Web Search APIs for AI Agents in 2026 — la mitad de búsqueda del mismo problema.
- Best AI Web Scraping Tools in 2026 — el panorama de herramientas más amplio, más allá de Claude Code específicamente.
Preguntas frecuentes
¿Cuál es el mejor servidor MCP para hacer web scraping con Claude Code?
Depende del trabajo. Firecrawl MCP es la opción para hacer crawl o leer sitios web arbitrarios. Bright Data está construido para extracción reforzada contra anti-bot en más de 40 plataformas con nombre a escala. El plugin Web Data de Zyte genera un spider de Scrapy real y desplegable en lugar de devolver los datos directamente. Crawlora encaja cuando quieres JSON estructurado de plataformas con nombre (search, mapas, comercio, social, finanzas) sin mantener un parser, facturado solo si hay éxito.
¿Cuál es la diferencia entre un skill de Claude Code y un servidor MCP?
Un skill es un archivo de instrucciones SKILL.md (más scripts opcionales) que Claude lee y sigue bajo demanda — sin conexión persistente. Un servidor MCP es un proceso en ejecución que expone tools tipadas sobre el Model Context Protocol durante toda la sesión. Varios proveedores, incluidos Crawlora, Bright Data y Zyte, ofrecen ambos: un skill ligero para uso puntual rápido y un servidor MCP completo para acceso a tools siempre activo.
¿Cuántas tools expone cada servidor MCP?
Según lo listado en el propio repositorio o la entrada del Claude Code Marketplace de cada proveedor en agosto de 2026: Firecrawl MCP lista 20 tools, el servidor MCP de Bright Data expone más de 60 tools (filtrables por grupo), y el servidor MCP hospedado de Crawlora expone 893 tools en 81 grupos de plataformas. Zyte no expone un conteo fijo de tools de la misma manera — su plugin corre un pipeline de 5 etapas que genera un proyecto Scrapy en lugar de devolver resultados de llamadas a tools directamente.
¿Firecrawl o Crawlora tiene un mejor tier gratuito para hacer pruebas?
Ambos ofrecen tiers gratuitos basados en créditos sin necesidad de tarjeta: Firecrawl Keyless da 1.000 créditos/mes, y Crawlora da 2.000 créditos/mes. El tier gratuito de Firecrawl funciona sin crear una cuenta; el de Crawlora requiere una cuenta gratuita pero factura solo respuestas exitosas (2xx) incluso en planes pagos.
¿Puedo usar más de una de estas a la vez?
Sí, y muchos stacks de agentes en producción lo hacen — un crawler genérico (Firecrawl o Bright Data) para sitios arbitrarios, más una herramienta de plataforma estructurada (Crawlora) para el puñado de fuentes con nombre que un agente consulta constantemente, de modo que no mantengas un parser personalizado para plataformas que ya tienen un endpoint documentado.
¿Cómo instalo el servidor MCP de Crawlora en Claude Code?
Ejecuta claude mcp add --transport http crawlora https://mcp.crawlora.net/mcp --header "Authorization: Bearer $CRAWLORA_API_KEY" con una API key gratuita de crawlora.net (2.000 créditos/mes, sin tarjeta). Una alternativa más ligera es el paquete de skills: npx skills add github.com/Crawlora-org/crawlora-skills --all, o agrégalo como marketplace de plugins de Claude Code con /plugin marketplace add Crawlora-org/crawlora-skills.
