2026年にLinkedInのデータを取得する最も安全な方法は、構造化されたAPIを通じて公開されている企業・製品・ショーケースの各ページを収集し、個人プロフィールやログインの背後にあるものには近づかないことです。LinkedInはWeb上で最も厳重に防御されているサイトの一つであり、その利用規約は自動アクセスを禁止しています。そのため、他のほとんどの情報源よりも法的・実務的なハードルが高くなっています。このガイドでは、現実的に収集できるもの、法的な境界線がどこにあるのか、そして文書化されたAPIを使ってどう進めるのかを解説します。
まず法的な現実から
LinkedInのスクレイピングは法的にデリケートなため、まず制約から押さえておきましょう。
- hiQ 対 LinkedIn: 米国の裁判所は、公開データのスクレイピングはコンピュータ詐欺および濫用防止法(CFAA)の違反にあたらないと判断しました。ただし、この訴訟は長期にわたり費用もかさみ、LinkedInの利用規約は今なお自動アクセスを禁止しています。公開されているアクセスできることは、許可されていることと同じではありません。
- 執行は強化されつつあります。 LinkedInは現在、スクレイパーを積極的に提訴しています。人気のプロフィールデータAPIであったProxycurlは、大規模にプロフィールをスクレイピングするために数十万件の偽アカウントを作成したとLinkedInに主張され、2026年に閉鎖しました。訴訟を招くパターンはまさにこれ、つまり偽アカウントとログイン状態での個人プロフィールのスクレイピングです。
- 個人データは高リスクです。 プロフィールにはGDPRやCCPAの規制対象となる個人データが含まれており、その収集はプライバシー上の請求を招きます。避けてください。
- 利用規約とアカウント停止。 ログイン状態での、あるいはレート制限を無視したスクレイピングはアカウント停止を招き、差止請求書(cease-and-desist letter)を引き起こす可能性があります。
大まかな指針として、公開されている、非個人的な、企業レベルのデータにとどめ、レート制限を尊重し、LinkedInの利用規約とご自身のコンプライアンス上の義務を確認してください。これは法的助言ではありません。
CrawloraのLinkedIn APIがカバーする範囲
CrawloraのLinkedIn APIは、個人プロフィールではなく、意図的に公開されている企業レベルのページに範囲を絞っています。
- 企業ページ —
/docs/linkedin/linkedin-companyを参照 - 製品ページ
- ショーケースページ
この範囲設定は意図的なものです。企業・製品・ショーケースのデータは、低リスクの公開ビジネス情報であり、個人プロフィールに触れることなくB2Bエンリッチメントに役立ちます。もし個人のプロフィール、コネクション、フォロワー、あるいはSales Navigatorのデータを求めてここに来られたのであれば、それは現在積極的に執行が行われている、ログインで保護された個人データの領域です(上記のProxycurlを参照)。このガイドは意図的にそれを取り上げません。
例: 公開されている企業ページを取得する
curl https://api.crawlora.net/api/v1/linkedin/company/COMPANY_ID \
-H "x-api-key: $CRAWLORA_API_KEY"
同じ呼び出しをPythonで行う場合:
import requests
resp = requests.get(
"https://api.crawlora.net/api/v1/linkedin/company/COMPANY_ID",
headers={"x-api-key": "YOUR_API_KEY"},
)
company = resp.json()["data"]
print(company.get("name"), company.get("industry"))
レスポンスは正規化されたJSONです(表示されているフィールドは例示であり、現在のスキーマはドキュメントを確認してください):
{
"code": 200,
"msg": "OK",
"data": {
"name": "Example Co",
"industry": "Software",
"website": "https://example.com",
"employee_range": "201-500",
"headquarters": "Austin, TX"
}
}
製品、ショーケース、そして収集できるもの
企業ページに加えて、同じキーでIDを指定して公開されている製品ページとショーケースページを取得できます。
h = {"x-api-key": "YOUR_API_KEY"}
base = "https://api.crawlora.net/api/v1/linkedin"
product = requests.get(f"{base}/product/PRODUCT_ID", headers=h).json()["data"]
showcase = requests.get(f"{base}/showcase/SHOWCASE_ID", headers=h).json()["data"]
公開ページで公開されている範囲において、次の情報が取得できます:
- 企業 — 名称、リンク、ロゴ、業種、Webサイト、従業員数/規模のレンジ、本社所在地、説明。
- 製品 — 製品名、リンク、カテゴリ、および関連する企業。
- ショーケース — ショーケース名、リンク、ロゴ、および親会社。
一方で、設計上取得できないのは、個人プロフィール、コネクション、フォロワー、求人情報、Sales Navigatorのデータです。これらはこのガイドが避けている、ログインで保護された個人データの領域です。
自前でのLinkedInスクレイピングが苦労する理由
- 攻撃的なアンチボット — フィンガープリンティング、行動検知、レートベースのアカウント停止。
- ログインの壁 — ほとんどのプロフィールデータは認証の背後にあり、それを収集することは利用規約とプライバシーの両方の境界を越えます。
- アカウントのリスク — アカウント停止や差止請求書は現実に起こる結果です。
構造化された企業データAPIは、公開されている企業ページに範囲を絞り、取得処理をエンドポイントの背後で扱うことで、最もリスクの高い部分を回避します。ただし、合法的でコンプライアンスに沿った利用の責任は、引き続きあなたにあります。
出典
この記事の位置づけ
公開されている企業データはB2Bのワークフローを支えます。公開されているビジネスおよび企業データからローカルおよびB2Bのリードリストを構築する方法については、リードジェネレーションのユースケースを参照してください(これは連絡先データベースではなく、あなたが収集してエンリッチするデータレイヤーです)。
収集を始める
まずは無料で試す: 任意の公開URLを無料Webスクレイパーに通すか、アンチボットチェッカーでサイトがボットをブロックするかどうかを確認してください。サインアップは不要です。
企業エンドポイントをプレイグラウンドでテストし、APIドキュメントでスキーマを確認し、料金でクレジットコストを確認してください。より大きな全体像については、Webスクレイピングapiの選び方、Googleマップのスクレイピング方法、Redditのスクレイピング方法、Twitter/Xのスクレイピング方法を参照してください。個人データに関する法的な境界線については、2026年、Webスクレイピングは合法か?をお読みください。
よくある質問
LinkedInのスクレイピングは合法ですか?
hiQ訴訟の後、米国では公開データへのアクセスは低リスクとされていますが、LinkedInの利用規約は依然として自動アクセスを禁止しており、執行は強化されつつあります。LinkedInはProxycurlを提訴し、同社は偽アカウントを使って個人プロフィールをスクレイピングしたことをめぐり2026年に閉鎖しました。企業レベルの公開データを安全な領域として扱い、個人プロフィールは避け、それ以上のことについては法的助言を得てください。
個人プロフィールをスクレイピングできますか?
CrawloraのLinkedInエンドポイントは、公開されている企業・製品・ショーケースの各ページ向けであり、個人プロフィール向けではありません。個人プロフィール、コネクション、フォロワー、Sales Navigatorのデータは、訴訟やプライバシー上の請求を招く、ログインで保護された個人データの領域です。避けてください。
LinkedInの求人、コネクション、Sales Navigatorのデータをスクレイピングできますか?
いいえ。それらはログインで保護され、個人データが多く含まれており、LinkedInの利用規約やGDPR/CCPAの下で最も高リスクな領域であり、近年の執行の焦点でもあります。このガイドとCrawloraのエンドポイントは、公開されている企業・製品・ショーケースの各ページにとどまります。
LinkedInのどのようなデータを収集できますか?
公開されている企業・製品・ショーケースのフィールド、たとえば名称、リンク、ロゴ、業種、Webサイト、従業員数/規模のレンジ、本社所在地、カテゴリなどを、公開されている範囲で収集できます。個人プロフィールは対象外です。
私のアカウントは停止されますか?
サポートされている公開企業ページについては、Crawloraが取得処理をAPIの背後で扱うため、あなたがログイン状態のスクレイパーを実行しているわけではありません。ただし、コンプライアンスに沿った利用の責任はあなたにあります。
これは公式のLinkedIn APIですか?
いいえ。これはLinkedInの公開されている企業データを抽出するものであり、LinkedInの公式APIとは独立しています。
