La forma más segura de obtener datos de LinkedIn en 2026 es recopilar páginas públicas de empresas, productos y showcases a través de una API estructurada — y mantenerte alejado de los perfiles personales y de todo lo que esté detrás de un login. LinkedIn es uno de los sitios más agresivamente defendidos de la web y sus términos prohíben el acceso automatizado, así que la barrera legal y práctica es más alta que en la mayoría de las fuentes. Esta guía cubre qué es realista recopilar, dónde están los límites legales y cómo hacerlo con una API documentada.
Empieza por la realidad legal
El scraping de LinkedIn es legalmente delicado, así que empecemos por las restricciones:
- hiQ contra LinkedIn: los tribunales de EE. UU. determinaron que hacer scraping de datos públicos no viola la Computer Fraud and Abuse Act — pero el litigio fue largo y costoso, y los términos de LinkedIn siguen prohibiendo el acceso automatizado. El acceso público no es lo mismo que el permiso.
- La aplicación de la ley está escalando. LinkedIn ahora demanda activamente a los scrapers: Proxycurl, una popular API de datos de perfiles, cerró en 2026 después de que LinkedIn alegara que había creado cientos de miles de cuentas falsas para hacer scraping de perfiles a gran escala. El patrón que atrae demandas es exactamente ese — cuentas falsas y scraping de perfiles personales estando logueado.
- Los datos personales son de alto riesgo. Los perfiles contienen datos personales regidos por el GDPR y el CCPA; recopilarlos invita a reclamaciones de privacidad. Evítalo.
- Términos y baneos de cuenta. El scraping logueado o que abusa de la tasa de peticiones provoca baneos de cuenta y puede atraer cartas de cese y desista.
Regla general: cíñete a datos públicos, no personales y a nivel de empresa, respeta los límites de tasa, y revisa los términos de LinkedIn y tus propias obligaciones de cumplimiento. Esto no es asesoría legal.
Qué cubre la API de LinkedIn de Crawlora
La API de LinkedIn de Crawlora está deliberadamente limitada a páginas públicas a nivel de empresa, no a perfiles personales:
- Páginas de empresa — consulta
/docs/linkedin/linkedin-company - Páginas de producto
- Páginas de showcase
Esa limitación es intencional: los datos de empresas, productos y showcases son información de negocio pública de menor riesgo — útil para el enriquecimiento B2B sin tocar perfiles personales. Si llegaste aquí buscando datos personales de perfiles, conexiones, seguidores o Sales Navigator, esa es la zona de datos personales protegida por login que ahora se está aplicando activamente (mira Proxycurl más arriba) — esta guía deliberadamente no la cubre.
Ejemplo: obtener una página pública de empresa
curl https://api.crawlora.net/api/v1/linkedin/company/COMPANY_ID \
-H "x-api-key: $CRAWLORA_API_KEY"
La misma llamada en Python:
import requests
resp = requests.get(
"https://api.crawlora.net/api/v1/linkedin/company/COMPANY_ID",
headers={"x-api-key": "YOUR_API_KEY"},
)
company = resp.json()["data"]
print(company.get("name"), company.get("industry"))
La respuesta es JSON normalizado (los campos mostrados son ilustrativos — consulta los docs para el esquema actual):
{
"code": 200,
"msg": "OK",
"data": {
"name": "Example Co",
"industry": "Software",
"website": "https://example.com",
"employee_range": "201-500",
"headquarters": "Austin, TX"
}
}
Producto, showcase, y qué puedes recopilar
Más allá de las páginas de empresa, la misma key obtiene páginas públicas de producto y showcase por id:
h = {"x-api-key": "YOUR_API_KEY"}
base = "https://api.crawlora.net/api/v1/linkedin"
product = requests.get(f"{base}/product/PRODUCT_ID", headers=h).json()["data"]
showcase = requests.get(f"{base}/showcase/SHOWCASE_ID", headers=h).json()["data"]
Cuando la página pública los expone, obtienes:
- Company — nombre, link, logo, industria, sitio web, rango de empleados/tamaño, sede y descripción.
- Product — nombre del producto, link, categoría y la empresa asociada.
- Showcase — nombre del showcase, link, logo y empresa matriz.
Lo que no obtienes — por diseño — son perfiles personales, conexiones, seguidores, ofertas de empleo o datos de Sales Navigator: esa es la zona de datos personales protegida por login de la que esta guía se aleja.
Por qué hacer scraping de LinkedIn por tu cuenta es doloroso
- Anti-bot agresivo — fingerprinting, detección de comportamiento y baneos basados en tasa de peticiones.
- Muros de login — la mayoría de los datos de perfil están detrás de la autenticación, y recopilarlos cruza tanto los términos como los límites de privacidad.
- Riesgo de cuenta — los baneos y las cartas de cese y desista son resultados reales.
Una API estructurada de datos de empresa evita las partes más riesgosas al limitarse a páginas públicas de empresa y gestionar la obtención de datos detrás del endpoint — pero tú sigues siendo responsable de un uso legal y conforme.
Fuentes
Dónde encaja esto
Los datos públicos de empresas impulsan los flujos de trabajo B2B — consulta el caso de uso de generación de leads para construir listas de leads locales y B2B a partir de datos públicos de negocios y empresas (una capa de datos que tú recopilas y enriqueces, no una base de datos de contactos).
Empieza a recopilar
Pruébalo primero, gratis: pasa cualquier URL pública por el Free Web Scraper, o comprueba si un sitio bloquea bots con el Anti-Bot Checker — sin registro.
Prueba el endpoint de empresa en el Playground, revisa el esquema en los docs de la API y consulta los costos de créditos en pricing. Para una comparación completa con otras APIs de datos de LinkedIn, consulta las mejores APIs de scraper de LinkedIn en 2026. Las páginas de empresa te dicen quién es una empresa; sus vacantes abiertas te dicen hacia dónde va — cómo hacer scraping de ofertas de empleo cubre los 14 ATS boards donde esas vacantes realmente viven, sin el muro de login de LinkedIn, y cómo hacer scraping de Indeed cubre el mayor portal de empleo individual donde esas ofertas también aterrizan. Para el panorama más amplio, consulta cómo elegir una API de web scraping, cómo hacer scraping de Google Maps, cómo hacer scraping de Reddit y cómo hacer scraping de Twitter/X; para los límites legales sobre datos personales, lee ¿es legal el web scraping en 2026?.
Parte de nuestra serie de guías how-to-scrape — todas las plataformas que cubrimos, en un solo índice.
Preguntas frecuentes
¿Es legal hacer scraping de LinkedIn?
El acceso a datos públicos es de menor riesgo en EE. UU. tras el caso hiQ, pero los términos de LinkedIn siguen prohibiendo el acceso automatizado, y la aplicación de la ley está escalando — LinkedIn demandó a Proxycurl, que cerró en 2026 por hacer scraping de perfiles personales mediante cuentas falsas. Trata los datos públicos a nivel de empresa como la zona segura, evita los perfiles personales y busca asesoría legal para todo lo demás.
¿Puedo hacer scraping de perfiles personales?
Los endpoints de LinkedIn de Crawlora están pensados para páginas públicas de empresas, productos y showcases — no para perfiles personales. Los perfiles personales, conexiones, seguidores y datos de Sales Navigator son la zona de datos personales protegida por login que atrae demandas y reclamaciones de privacidad; evítala.
¿Puedo hacer scraping de empleos, conexiones o datos de Sales Navigator de LinkedIn?
No — están protegidos por login y llenos de datos personales, la zona de mayor riesgo bajo los términos de LinkedIn y el GDPR/CCPA, y el foco de la aplicación reciente de la ley. Esta guía y los endpoints de Crawlora se ciñen a páginas públicas de empresas, productos y showcases.
¿Qué datos de LinkedIn puedo recopilar?
Campos públicos de empresas, productos y showcases como nombre, link, logo, industria, sitio web, rango de empleados/tamaño, sede y categoría, cuando estén disponibles — no perfiles personales.
¿Se baneará mi cuenta?
Para las páginas públicas de empresa compatibles, Crawlora gestiona la obtención de datos detrás de la API, así que no estás operando un scraper logueado — pero tú sigues siendo responsable de un uso conforme.
¿Es esta la API oficial de LinkedIn?
No. Extrae datos públicos de empresas de LinkedIn y es independiente de las APIs oficiales de LinkedIn.
