Tony Wang8 min de lectura¿Es legal el web scraping en Japón? Guía 2026
Web scraping y ley japonesa en 2026: el permisivo artículo 30-4 de autor, el riesgo penal por obstrucción de negocios y dónde aplica la APPI.
La mayoría de las guías legales sobre web scraping parten de la ley estadounidense: la CFAA, hiQ v. LinkedIn, los Términos de Servicio como contrato. Las reglas de Japón son distintas, y en un aspecto la diferencia es marcada: el derecho de autor japonés es más permisivo con el scraping para análisis de datos que el de EE. UU., mientras que una norma penal separada convierte la frecuencia de las peticiones — no la copia — en lo que realmente lleva a la gente a la cárcel. Si haces scraping de sitios japoneses, o eres una empresa con base en Japón evaluando el scraping, el enfoque estadounidense te va a señalar los riesgos equivocados.
Las dos preguntas que realmente deciden el caso en Japón
Olvídate del modelo mental estadounidense. En Japón, un proyecto de scraping se decide sobre todo por:
| Pregunta | Menor riesgo | Mayor riesgo |
|---|---|---|
| ¿Con qué intensidad y frecuencia golpeas al servidor? | Ritmo controlado, baja frecuencia, respeta la capacidad evidente del objetivo | Peticiones de alta frecuencia contra un servidor pequeño o del sector público |
| ¿Qué haces con el contenido protegido que copias? | Lo analizas; no dejas que la gente lea, vea o escuche la expresión protegida en sí misma | La vuelves a publicar, o dejas que los usuarios finales consuman la expresión original |
El ritmo de las peticiones es el riesgo específico de Japón que la mayoría de las guías legales en inglés nunca mencionan. Se trata en segundo lugar, más abajo — y es, posiblemente, el más práctico de los dos.
Derecho de autor: el artículo 30-4 es inusualmente permisivo
El artículo 30-4 de la Ley de Derechos de Autor de Japón crea una excepción amplia: puedes copiar una obra protegida, por cualquier método, en la medida necesaria, cuando no estés permitiendo que tú u otra persona disfrutéis («kyōju») de los pensamientos o sentimientos expresados en ella. El «jōhō kaiseki» (análisis de información) — extraer datos de lenguaje, sonido o imagen de un gran número de obras y compararlos, clasificarlos o analizarlos de algún otro modo — es el ejemplo estrella del artículo. En la práctica, esto cubre la mayor parte del scraping para análisis de datos y entrenamiento de modelos de ML: estás extrayendo hechos y patrones de las páginas, no distribuyendo el contenido creativo de esas páginas para que la gente lo lea.
Este es un punto de partida genuinamente distinto al del fair use estadounidense, que es una prueba de ponderación de cuatro factores decidida caso por caso. El artículo 30-4 se acerca más a una regla categórica: si el uso es de no-disfrute (análisis, indexación, entrenamiento), se presume que está bien.
El límite de la excepción: el 但書 (la salvedad)
El artículo 30-4 tiene una salvedad: no se aplica si el uso «perjudica injustificadamente los intereses del titular de los derechos de autor», a juzgar por el tipo y el uso de la obra y la forma en que se utiliza. La Agencia de Asuntos Culturales de Japón (文化庁) publicó una guía oficial en marzo de 2024 («IA y Derechos de Autor», 令和6年3月) con tres ejemplos concretos de qué cruza esa línea:
- La similitud solo a nivel de ideas está bien. Si los resultados simplemente se parecen a las ideas de las obras de entrenamiento — no a su expresión creativa protegida —, generar en masa contenido de sensación similar no es «perjuicio injustificado», incluso si compite con los creadores originales.
- Hacer scraping de una base de datos de pago en lugar de pagar por su API es la infracción más clara. El ejemplo de la Agencia: un sitio vende acceso por API a una base de datos curada y lista para análisis de sus artículos. Hacer scraping de esos mismos artículos desde las páginas públicas en lugar de pagar por la API — cuando los datos obtenidos por scraping funcionan como sustituto de la base de datos de pago — queda fuera de la excepción.
- Sortear medidas antiscraping dirigidas a un futuro producto de pago también es una infracción — si un sitio tiene medidas técnicas que bloquean la recolección masiva, y existe una inferencia razonable de que se planea una base de datos licenciable basada en el contenido de ese sitio, burlar esas medidas para recolectar los datos de todos modos puede cerrar ese mercado futuro.
La lectura práctica: analizar datos web públicos es el caso central del artículo 30-4. La excepción se erosiona específicamente cuando existe una alternativa de pago y estructurada y la rodeas, o cuando derrotas protecciones técnicas dirigidas a un producto de datos que el sitio está construyendo.
El riesgo mayor: 偽計業務妨害 (obstrucción de negocios)
El derecho de autor no es donde los casos de scraping en Japón realmente terminan en arrestos. El artículo 233 del Código Penal tipifica la «obstrucción de negocios por medios fraudulentos o engañosos» (偽計業務妨害), y se ha aplicado a rastreos ordinarios.
La lección no es «el rastreo es ilegal en Japón» — es que el propio patrón de peticiones, no la copia ni el uso posterior, es lo que las autoridades japonesas han tratado como potencialmente delictivo, sobre todo contra infraestructura pequeña o del sector público. Un ritmo que en EE. UU. provocaría una educada carta de cese y desista, en Japón provocó un arresto penal. Marca un ritmo conservador, respeta robots.txt y cualquier límite de tasa documentado, y prefiere objetivos construidos para manejar tráfico programático.
Datos personales: la APPI sigue aplicándose a las páginas públicas
La Ley de Protección de Información Personal de Japón (個人情報保護法, APPI) trata la información como «datos personales» siempre que identifique a una persona viva — que sea visible públicamente en una página web no la exime. Hay dos consecuencias prácticas para el scraping:
- 要配慮個人情報 (información personal que requiere especial cuidado — raza, salud, antecedentes penales y categorías similares) generalmente no se puede recopilar sin el consentimiento de la persona, sin excepciones.
- Publicar o revender datos personales que obtuviste por scraping — entregárselos a un tercero tal como se recopilaron — normalmente es una «provisión a terceros» que requiere consentimiento, incluso si la fuente original era pública.
El camino más seguro es el mismo que funciona en cualquier parte: prioriza los datos a nivel de negocio y de producto (precios, listados, valoraciones, datos de empresas) por encima de los registros que identifican a personas, y trata cualquier recopilación de datos personales como una cuestión de cumplimiento en sí misma.
Bases de datos comerciales: la Ley de Prevención de la Competencia Desleal
Una revisión de 2018 a la Ley de Prevención de la Competencia Desleal de Japón (不正競争防止法) creó una categoría protegida llamada «限定提供データ» (datos de suministro limitado): datos que una empresa (1) proporciona a partes específicas mediante transacciones de pago, (2) ha acumulado en un volumen significativo por medios electrónicos, y (3) restringe el acceso (normalmente mediante ID/contraseña o un mecanismo similar). Adquirir o usar indebidamente ese tipo de datos — por ejemplo, hacer scraping de grandes volúmenes desde detrás de sus controles de acceso y reutilizarlos en un servicio competidor — constituye «competencia desleal», y el titular de los datos puede solicitar una medida cautelar.
Esto se suma al derecho de autor, no lo sustituye: un conjunto de datos comercial de pago y con acceso restringido puede estar protegido por la Ley de Prevención de la Competencia Desleal incluso para hechos y compilaciones que el derecho de autor por sí solo no cubriría. Es el mismo instinto que la salvedad del artículo 30-4 — la exposición se concentra en rodear un producto de pago y con acceso restringido — visto desde una norma distinta.
Una lista de verificación práctica para hacer scraping en Japón
Menor riesgo
- Datos públicos, no personales y de tipo fáctico (precios, listados de catálogo, información de empresas).
- Ritmo de peticiones conservador — muy por debajo de cualquier nivel que pudiera degradar al objetivo, sobre todo en sitios pequeños o del sector público.
- Análisis y uso interno de lo que recopilas, sin republicar la expresión protegida en sí misma.
- Páginas gratuitas y de acceso público en lugar de la base de datos subyacente de un nivel de pago.
Mayor riesgo
- Peticiones de alta frecuencia contra infraestructura que evidentemente no puede absorberlas.
- Información personal que requiere especial cuidado, o revender/publicar datos personales que recopilaste.
- Hacer scraping del equivalente en páginas públicas de la API de pago o la base de datos con acceso restringido de un sitio.
- Derrotar medidas técnicas antiscraping dirigidas a un producto de datos que el sitio está construyendo o ya vende.
Cómo encaja Crawlora
Las APIs de plataforma de Crawlora devuelven JSON normalizado de fuentes públicas a través de infraestructura gestionada y con límite de tasa — la disciplina en el ritmo de peticiones de la que depende específicamente la exposición del artículo 233 queda gestionada por nosotros, en lugar de dejarla en manos de un script casero que golpea al objetivo tan rápido como puede. Tú sigues siendo responsable de qué datos recopilas y qué haces con ellos; consulta is web scraping legal in 2026 para el desglose equivalente sobre la ley estadounidense, y cómo comprobar si un sitio prohíbe el scraping antes de empezar.
Construye sobre infraestructura gestionada y con límite de tasa
Endpoints documentados, JSON normalizado y acceso con ritmo controlado por diseño. 2000 créditos gratis al mes, sin tarjeta.
Lecturas relacionadas
- Is Web Scraping Legal in 2026? A Practical Guide — el desglose equivalente sobre la ley estadounidense (CFAA, hiQ, GDPR/CCPA).
- Scraping Sites That Block Bots — el lado técnico de lo que la salvedad del artículo 30-4 llama «medidas técnicas».
- Best Web Scraping APIs in 2026: How to Choose — infraestructura que se encarga del ritmo de peticiones por ti.
Preguntas frecuentes
¿Es legal el scraping en Japón?
Copiar con fines de análisis de información es, en términos generales, lícito según el artículo 30-4 de la Ley de Derechos de Autor — más permisivo que el fair use estadounidense —, siempre que no dejes que la gente experimente la expresión protegida en sí misma. El riesgo práctico mayor es la frecuencia de las peticiones, no la copia: la norma japonesa sobre obstrucción de negocios se ha aplicado a rastreos ordinarios que sobrecargaron un servidor.
¿Qué es el artículo 30-4 de la Ley de Derechos de Autor?
Permite copiar una obra protegida, por cualquier método, en la medida necesaria, cuando el propósito no es que tú u otras personas disfrutéis de los pensamientos o sentimientos que expresa. El análisis de información (extraer y analizar datos de muchas obras) es su ejemplo estrella. Una salvedad elimina la excepción si el uso perjudica injustificadamente los intereses del titular de los derechos de autor.
¿Se puede arrestar a alguien por hacer scraping en Japón?
Ha ocurrido: en el caso Librahack de 2010 arrestaron a un desarrollador bajo la norma de obstrucción de negocios (artículo 233 del Código Penal) por un rastreador que hacía cerca de una petición por segundo contra el catálogo público de una biblioteca, que tenía un defecto no revelado. Estuvo detenido 22 días antes de que el caso se resolviera sin procesamiento. El ritmo de las peticiones es el riesgo específico que refleja este caso.
¿La ley de privacidad de Japón se aplica a datos obtenidos por scraping de una página pública?
Sí. La APPI trata la información como datos personales siempre que identifique a una persona viva, sin importar si la página era pública. Las categorías que requieren especial cuidado (raza, salud, etc.) generalmente no se pueden recopilar sin consentimiento, y publicar o revender datos personales obtenidos por scraping normalmente es una provisión a terceros que requiere consentimiento.
¿Esto es asesoría legal?
No. Esto es información general; consulta a un abogado calificado para tu situación específica, sobre todo en cualquier caso relacionado con la Ley de Prevención de la Competencia Desleal.