Tony Wang10 min de lecturaBuscamos en 1,9 millones de vacantes un «Web Scraper». Encontramos dos.
Revisamos 1.935.047 vacantes abiertas en busca de web scraping real. Encontramos 280 (0,0145%) — solo 2 se titulan 'Web Scraper'.
Busca «web scraping jobs» y encontrarás páginas de agregadores salariales — Glassdoor, ZipRecruiter, Salary.com — todas reportando un promedio de aspecto saludable de $120-160K. Lo que ninguna muestra es cuántos de esos empleos realmente existen. Así que los contamos directamente, en el propio dataset de Empleos de Crawlora: 1.935.047 vacantes abiertas, extraídas de todos los principales sistemas de seguimiento de candidatos empresariales. El número honesto es sorprendente — 280 vacantes describen genuinamente el scraping como una función del puesto. Dos se titulan literalmente «Web Scraper».
La búsqueda ingenua falla de inmediato
El primer movimiento obvio es buscar «web scraping» en las vacantes y contar los resultados. Lo probamos. Las principales coincidencias por frecuencia: «Multi-Media Account Executive» (54 vacantes), «Merchandising Service Associate» (25), «Senior Software Engineer» (22) y «Janitorial Cleaner» (6).
Ninguno de estos es un puesto de scraping. La explicación probable: muchas plantillas de ATS llevan un aviso estándar de privacidad o manejo de datos — algo como «podemos usar herramientas de web scraping para verificar la información del solicitante» — que se reutiliza textualmente en cada vacante que publica un empleador, sin importar el rol. Una búsqueda de texto completo no tiene manera de distinguir «la empresa menciona el scraping en un párrafo estándar» de «este rol hace scraping». De 2.000 vacantes que coincidieron de esta forma, solo 3 tenían la palabra «scrap» en algún lugar del título del puesto.
Construyendo un conteo honesto en su lugar
Descartamos la búsqueda por palabra clave y construimos en su lugar un clasificador adecuado: exigir la frase exacta (no una coincidencia laxa por relevancia), exigir contexto técnico real a su alrededor, y excluir explícitamente el patrón de texto estándar de privacidad. Ejecutado primero contra un subconjunto acotado — la familia ocupacional «Profesionales de tecnologías de la información y las comunicaciones», unas 20.197 vacantes abiertas — encontró 33 coincidencias genuinas. Es un número real, pero resultó subestimar gravemente: restringirse a vacantes con título técnico pasa por alto por completo roles con funciones de scraping clasificados bajo otras familias de puestos (un Business Intelligence Analyst, un Data Operations Associate).
Así que escaneamos toda la población en su lugar — las 1.935.047 vacantes abiertas, sin restricción de familia de puestos — usando el mismo clasificador de frase más contexto. Eso reveló 314 candidatos; una revisión manual eliminó 37 más (en su mayoría vacantes de Oxylabs, Apify e Infatica — roles de Product Manager, Marketing, SRE, Legal en empresas cuyo propio producto es el web scraping, donde la mención describe el negocio, no el puesto) y agregó de vuelta un puñado encontrado mediante una segunda verificación sobre «ingeniería inversa» como término relacionado (ver más abajo).
Conteo final: 280 vacantes genuinas con funciones de scraping de 1.935.047 — 0,0145%, o 1 de cada 6.911 empleos abiertos.
Qué son en realidad los 280
Mostrar la tabla completa (empresas con 2 o más vacantes coincidentes)
| Empresa | Vacantes | Qué son |
|---|---|---|
| Toloka AI | 59 | 2 títulos, ambos explícitamente «Freelance» |
| LSEG | 10 | Data Scientist (todos los niveles), 7 países |
| WIN Home Inspection | 7 | Senior/Data Engineer |
| PWC | 5 | Data Scientist, consultoría/vía de prácticas |
| Getwingapp | 5 | GTM Automation Engineer |
| NielsenIQ | 4 | Web Scraper (2), Software Engineer (2) |
| Infatica | 4 | Senior Scraping Engineer — tiempo completo, sin calificativo de freelance |
| UNUM | 3 | Data Scientist, CX/People Analytics |
| Microsoft | 3 | Software Engineer, varios |
| Reflectionai | 3 | Data Ingestion / Web Crawl Engineer |
| Oxylabs | 3 | Web Scraping Engineer, Data Analyst, PM (Web Scraper APIs) |
| OpenAI | 3 | Software Engineer, Data Acquisition |
| Contentful | 3 | Senior Product Architect |
| Comtech LLC | 3 | Data Engineer (Java/Scala/Spark) |
Dominan dos patrones. Primero: un puñado de empresas mencionan sistemáticamente el scraping en cada vacante de un mismo equipo — la plantilla de solicitud de Data Scientist de LSEG se repite idénticamente desde Bangalore hasta Beijing y Gdynia, razón por la cual 10 de las 280 son el flujo de contratación de una sola empresa, no 10 señales de mercado independientes. Segundo, y más revelador: solo 2 de las 280 — ambas en NielsenIQ — se titulan literalmente «Web Scraper». Todo lo demás es un rol de Data Scientist, Data Engineer, Data Analyst o Software Engineer donde el scraping es un requisito entre varios, no el título del puesto.
Cuando el scraping es su propio puesto, es freelance
Toloka AI representa 59 de las 280 coincidencias — el 21% de todo lo que encontramos — y cada una de ellas es exactamente uno de dos títulos: «Senior Python Data Scraping Engineer (Freelance)» y «Freelance Data Scraping Engineer (Python)». Ambos dicen «Freelance» en el título mismo, publicados repetidamente en distintas ubicaciones.
Esta es la evidencia más clara del dataset a favor de una explicación simple: cuando una empresa sí separa el «scraping» como un puesto propio y distinto, se estructura abrumadoramente como trabajo por contrato o freelance, no como plantilla permanente. Eso coincide con lo que muestra de forma independiente el mercado freelance abierto — ZipRecruiter lista actualmente vacantes en vivo de «$51-$113/hr Remote Web Scraping Jobs» y «$52-$90/hr Python Web Scraping Jobs» este año, un mercado de tarifas por proyecto que existe en paralelo, y en gran medida en lugar, de la contratación a tiempo completo.
El único contraejemplo claro: Infatica, una empresa de infraestructura de proxies/scraping, tiene 4 vacantes para «Senior Scraping Engineer (Web scraping & Anti-bot)» — sin calificativo de freelance, un título real y permanente. Oxylabs también tiene una («Web Scraping Engineer - Python»). Ambas empresas se dedican a vender infraestructura de scraping. Fuera de ese conjunto reducido — empresas cuyo producto es el scraping — una línea permanente de plantilla como «Scraping Engineer» es prácticamente inexistente.
Comparado con un título de puesto real
Para saber si 280 de 1,9 millones es inusualmente raro o simplemente refleja lo estrechos que son los títulos de puesto en general, pasamos la misma población por un filtro mucho más simple: ¿el título contiene literalmente «software engineer»? Dentro de la misma población de empleos tecnológicos (la familia ocupacional de profesionales de TIC, ~20.138 vacantes escaneadas), eso devolvió 11.823 coincidencias — el 58,7% de toda la familia — con 3.279 divulgando un salario en USD, mediana de $185.000 (p25 $150.262, p75 $215.000), 20,6% remoto.
| Grupo | Vacantes | Divulgado en USD | Mediana (USD) | % Remoto |
|---|---|---|---|---|
| Funciones de scraping (clasificadas) | 280 | 112 (40%) | $93.600 | 47,1% |
| «Software Engineer» (coincidencia de título) | 11.823 | 3.279 (28%) | $185.000 | 20,6% |
Léelo con cuidado — no es una comparación salarial directa (el grupo de funciones de scraping se inclina hacia empleadores más pequeños y no estadounidenses con una tasa de divulgación mucho menor, y las vacantes freelance de Toloka por sí solas son más de una quinta parte de la muestra), y tampoco la mediana es una evaluación de cuánto «vale» el trabajo de scraping. El número que realmente importa es el conteo: 11.823 frente a 280 es una brecha de 42x en la misma población, usando la misma metodología. «Software Engineer» es un título de puesto para el que las empresas contratan de forma rutinaria. «Scraping Engineer» esencialmente no lo es — excepto en el puñado de empresas que se dedican a vender scraping.
También verificamos «ingeniería inversa» — no cambia el panorama
El scraping y la ingeniería inversa de APIs son habilidades estrechamente relacionadas, así que también buscamos en todo el corpus «reverse engineering», «reverse engineer» y «reverse-engineer» — 1.485 candidatos, casi 5 veces más volumen en bruto que la búsqueda por frase de scraping. Casi nada de eso era relevante: 901 trataban claramente sobre firmware, análisis de malware o hardware (chips, PCB, sistemas embebidos) — una disciplina completamente distinta que resulta compartir las mismas dos palabras — y otras 256 no pasaron una verificación de contexto más estricta que exigía la coexistencia con términos específicos de web/API/apps. «Endpoint Engineer», por ejemplo, coincidió con la búsqueda pero significa gestión de dispositivos de TI (laptops, no endpoints de API).
Después de filtrar, exactamente 3 vacantes resultaron ser genuinamente sobre ingeniería inversa de una API o sitio web para acceso a datos, en dos empresas (Belvo, una plataforma de datos de open banking; Adthena, una empresa de inteligencia competitiva) — ambas ya del tipo de empresa que esperarías que necesitara este trabajo internamente. Agregamos las 3 al conteo final anterior. La conclusión: «web scraping» y sus sinónimos directos ya capturan esencialmente toda la señal real. La ingeniería inversa no destapa una población oculta más grande de puestos de scraping escondidos bajo otro nombre.
La conclusión
El scraping es una habilidad técnica real y ampliamente utilizada — el propio negocio de Crawlora depende de ella, y las empresas claramente necesitan el resultado con tanta urgencia que existen proveedores enteros dedicados a venderlo. Lo que muestra el mercado laboral es que casi nadie contrata a una persona para hacerlo como su trabajo. De 1,9 millones de vacantes abiertas, 280 (1 de cada 6.911) lo mencionan genuinamente como una función del puesto, 2 lo usan como el título real del puesto, y la fuente individual más grande de «scraping» como rol propio listado — las 59 vacantes de Toloka — es explícitamente trabajo freelance, no una carrera. Cuando las empresas sí lo necesitan, la respuesta del mercado laboral se parece menos a «contratar a un scraper» y más a «contratar a un data scientist que también pueda hacer esto» o «pagarle a un contratista por proyecto» — o, la opción para la que todo este ejercicio construye un caso inusualmente sólido, comprar los datos en lugar de construir el pipeline.
Cómo hicimos esto (y las salvedades)
Fuente de datos: el dataset de Empleos de Crawlora, que rastrea vacantes abiertas de cada portal de empresa descubierto en Workday, Greenhouse, Lever, Ashby, SmartRecruiters, Workable, Recruitee, Rippling, Personio, Teamtailor, Oracle, UKG, iCIMS, Eightfold, Gem y Pinpoint, más 5 portales de empresas individuales de big tech (Amazon, Apple, Google, Meta, Tesla). Instantánea tomada el 2026-08-04; 1.935.047 vacantes abiertas en ese momento.
El clasificador es una heurística, no la verdad absoluta. Exigir una frase exacta más 2 o más términos técnicos más ningún contexto de texto estándar de privacidad está orientado a la precisión — aún así pasará por alto vacantes reales con funciones de scraping que describen el trabajo sin usar nunca ninguna de nuestras seis frases desencadenantes (una vacante que simplemente dice «recopilar precios de la competencia a diario» sin nombrar la técnica, por ejemplo), y la revisión manual de refinamiento (eliminar las vacantes generales no relacionadas de Oxylabs/Apify/Infatica) es una decisión de criterio, no un algoritmo. Confiamos en el orden de magnitud — unos pocos cientos de casi dos millones, no unos pocos miles ni decenas de miles — más de lo que confiamos en la cifra exacta de 280.
Las cifras salariales son ilustrativas, no estadísticas, con n=111-112 valores divulgados de 280-11.823 vacantes. Las vacantes que divulgan salario tienden a concentrarse en jurisdicciones estadounidenses con leyes de transparencia salarial, lo cual es un sesgo real en quién divulga, no un defecto de la muestra.
Esto mide vacantes a tiempo completo y por contrato en portales de ATS de empresas — no captura listados de mercados freelance (Upwork, Fiverr), que es exactamente donde la evidencia cualitativa anterior sugiere que reside una porción significativa de este trabajo.
Sáltate la contratación para esto — obtén datos scrapeados como una API
Crawlora convierte cientos de sitios y plataformas en JSON normalizado — sin necesidad de un equipo de scraping, rotación de proxies ni mantenimiento anti-bot. 2.000 créditos gratis al mes, sin tarjeta.
Preguntas frecuentes
¿Es «web scraper» un título de puesto real?
Casi nunca. De 1.935.047 vacantes abiertas en el dataset de Empleos de Crawlora (instantánea del 2026-08-04), solo 2 se titulan literalmente «Web Scraper» — ambas en NielsenIQ. Existe un título real y permanente de «Scraping Engineer» en un puñado de empresas, pero casi exclusivamente en aquellas que venden infraestructura de scraping o proxies (Infatica, Oxylabs).
¿Cuántos empleos realmente implican web scraping?
280 de 1.935.047 vacantes abiertas (0,0145%, o 1 de cada 6.911) describen genuinamente el scraping como una función del puesto, tras filtrar una búsqueda ingenua por palabra clave con un clasificador que exige la frase exacta, contexto técnico real y ningún falso positivo de texto estándar de privacidad. La mayoría de esas 280 son roles de Data Scientist, Data Engineer o Software Engineer que listan el scraping como un requisito entre varios — no puestos independientes de scraping.
¿Por qué buscar «web scraping» en vacantes devuelve resultados no relacionados como empleos de retail o ventas?
Muchas plantillas de sistemas de seguimiento de candidatos (ATS) llevan un aviso estándar de privacidad — algo como «podemos usar herramientas de web scraping para verificar la información del solicitante» — que se reutiliza en cada vacante que publica un empleador, sin relación con el rol. Una búsqueda ingenua de texto completo no puede distinguir eso de una función real del puesto; de 2.000 vacantes que coincidieron con una búsqueda simple por palabra clave, solo 3 tenían «scrap» en algún lugar del título del puesto.
¿El trabajo de scraping es mayormente freelance en lugar de tiempo completo?
Los datos apuntan en esa dirección. Toloka AI por sí sola representa 59 de las 280 vacantes genuinas con funciones de scraping que encontramos (21%) — y ambos de sus títulos dicen «Freelance» explícitamente. Los listados en vivo del mercado freelance (ZipRecruiter: $51-$113/hr en trabajo remoto de web scraping) muestran un mercado real de tarifas por proyecto que funciona en paralelo, y en gran medida en lugar, de la contratación a tiempo completo para la misma habilidad.
¿Cómo se compara esto con un título de puesto real como Software Engineer?
En la misma población de empleos tecnológicos, las vacantes tituladas «Software Engineer» sumaron 11.823 — una brecha de 42x frente a las 280 vacantes con funciones de scraping encontradas con la misma metodología. Los roles de Software Engineer también divulgaron el salario con más frecuencia (28% vs 40%, aunque sobre una base mucho mayor) con una mediana más alta ($185.000 vs una cifra ilustrativa de $93.600 entre las vacantes con funciones de scraping, sobre un n mucho menor).
¿La «ingeniería inversa» describe más de estos empleos bajo otro nombre?
No, no de forma significativa. Revisamos 1.485 vacantes que mencionan ingeniería inversa y encontramos que el término describe abrumadoramente trabajo de firmware, análisis de malware o hardware — una disciplina distinta que resulta compartir las mismas palabras. Tras filtrar por contexto específico de web/API/apps, solo 3 vacantes resultaron ser genuinamente sobre ingeniería inversa de una API o sitio web para acceso a datos, confirmando que «web scraping» y sus sinónimos directos ya capturan la señal real.