Tony Wang6 分で読めますImportYetiのスクレイピング方法(2026年版) — APIとPython
2026年にImportYetiをスクレイピング — サプライヤーを名前で検索し、米国税関の出荷量レポートを構造化JSONで取得 — DIY、ノーコード、または構造化APIで。
2026年に ImportYeti をスクレイピングする最も手早い方法は、ImportYeti のレンダリング済みページを自分でパースするのではなく、企業・サプライヤー検索と完全な企業レポートに対して正規化された JSON を返す構造化 API を呼び出すことです。ImportYeti は米国税関の Bill of Lading 記録を、米国向けに出荷しているサプライヤーやメーカーを検索できるディレクトリに変換していますが、セルフサービス型の公開 API はなく、その利用規約は自動アクセスについて明確です。このガイドでは、実際に公開されているもの、DIY が破綻する箇所、そして法的な基本を取り上げます。
なぜ ImportYeti をスクレイピングするのか?
ImportYeti の検索と企業レポートのデータは、サプライチェーンとソーシングのワークフロー向けに作られています。
- サプライヤーディスカバリー — 製品カテゴリや企業名で検索し、どの工場やメーカーがその種類の製品を米国向けに出荷しているかを調べます。
- 競合サプライヤーリサーチ — 既知のブランドや競合企業のプロフィールを調べ、そのサプライヤーが誰で輸入量がどう推移しているかを確認します。
- ソーシングのデューデリジェンス — 連絡を取る前に、候補サプライヤーの主要な出荷量指標を取得し、規模や活動状況の簡易チェックとして使います。
- ベンダー・サプライチェーンのモニタリング — スケジュールを組んで企業レポートを再実行し、サプライヤーの米国税関出荷量が増加・横ばい・減少のどれであるかを追跡します。
ImportYeti をスクレイピングするのは合法か?
選択肢1: Python で DIY する(そしてなぜ破綻するか)
DIY のスクレイパーは ImportYeti の検索ページと企業プロフィールページにリクエストを送り、レンダリングされた HTML をパースします。
import requests
from bs4 import BeautifulSoup
resp = requests.get(
"https://www.importyeti.com/company/some-company-slug",
headers={"User-Agent": "Mozilla/5.0 (compatible; research-bot/1.0)"},
)
soup = BeautifulSoup(resp.text, "html.parser")
# Company identity fields and shipment-volume metrics render as
# client-side data, not consistently selectable static markup
デモは動きますが、その後破綻します。
- 利用規約は自動取得を直接名指ししている。 ImportYeti の規約は、サイトの取得・インデックス化・データマイニングに使われるロボット、スパイダー、「あらゆる…手動または自動のデバイスやプロセス」を明確に禁止しています — これは一般的な定型条項ではなく、実際に引用できる具体的な制限です。
- 構築の土台となる公開の検索・企業 API がない。 セルフサービス型の開発者プログラムは存在せず、欲しいフィールドはすべてレンダリング済みページからスクレイピングする必要があり、リデザインをまたいだ安定したスキーマの保証もありません。
- 1つの検索の中に2種類の結果が混在する。 ImportYeti の検索結果は企業とサプライヤーが同じ結果セットに混ざっており、単純なスクレイパーは次にどのページを取得すべきか決める前に、この2つを正しく区別しなければなりません。
- 規約自体が再販を選択肢から外している。 動作するスクレイパーを作れたとしても、より大きな制約は解消されません — ImportYeti の許可される利用は非商用に限られるため、規約の下ではスクレイピングしたデータセットを販売・再配布することはできません。
選択肢2: ノーコードツール
ImportYeti 向けのマーケットプレイスのスクレイパーアクターは存在し、単発の企業ページをスプレッドシートに取り込むことはできますが、DIY と同じ利用規約上のリスクを引き継いでいます — 「あらゆる…手動または自動のデバイスやプロセス」は手書きのコードに限定されません — また、繰り返し使えるソーシングパイプラインに必要な、安定したバージョン管理されたスキーマも提供しません。
選択肢3: 構造化された ImportYeti API
繰り返し実行できるワークフローには、Crawlora の ImportYeti API が企業・サプライヤー検索と完全な企業レポートに対して正規化された JSON を返します — ページのパースも、認証情報も、呼び出し側の ImportYeti アカウントや API キーも不要です。企業名またはサプライヤー名で検索します。
curl "https://api.crawlora.net/api/v1/importyeti/search?query=stanley" \
-H "x-api-key: $CRAWLORA_API_KEY"
{
"code": 200,
"msg": "OK",
"data": {
"results": [
{
"kind": "company",
"slug": "stanley-black-decker-inc",
"name": "Stanley Black & Decker, Inc.",
"country": "United States",
"address": "1000 Stanley Drive, New Britain, CT"
},
{
"kind": "supplier",
"slug": "stanley-industrial-and-automotive-llc",
"name": "Stanley Industrial And Automotive LLC",
"country": "United States",
"address": ""
}
]
}
}
次に、検索結果から企業 slug を Python で企業レポートエンドポイントに渡します。
import requests
h = {"x-api-key": "YOUR_API_KEY"}
base = "https://api.crawlora.net/api/v1/importyeti"
hits = requests.get(f"{base}/search", headers=h, params={"query": "stanley"}).json()["data"]["results"]
slug = hits[0]["slug"]
report = requests.get(f"{base}/company", headers=h, params={"slug": slug}).json()["data"]
企業レポートは正規化された JSON です — 識別情報フィールドに加えて、主要な米国税関の出荷量指標が含まれます(実際のフィールドセットはドキュメントで確認してください)。
{
"code": 200,
"msg": "OK",
"data": {
"slug": "stanley-black-decker-inc",
"name": "Stanley Black & Decker, Inc.",
"address": "1000 Stanley Drive, New Britain, CT",
"phone": "1-8**-***-****",
"website": "stanleyblackanddecker.com",
"shipment_count": 4218,
"supplier_count": 187,
"first_shipment_date": "2015-01-06",
"last_shipment_date": "2026-08-09"
}
}
slug をキーにして企業1件・取得1回につき1行を保存し、スケジュールを組んで再実行すれば、shipment_count と supplier_count の推移を時系列で追跡できます。
収集できるもの
検索結果(kind — company または supplier —、slug、name、country、address)と、完全な企業レポート(識別情報フィールド — name、address、マスクされた phone、website — に加えて、出荷件数、サプライヤー件数、最初と最後の出荷日といった主要な米国税関の出荷量指標)です。あくまで ImportYeti がすでに表示している公開データであり、集約されていない生の Bill of Lading 記録を復元したり、より深い出荷レベルの詳細を扱う ImportYeti 自身の有料サブスクリプションティアを迂回したりする手段ではありません。
制約とよくある課題
- 検索結果には企業とサプライヤーが一緒に返ってくる。 次の処理を決める前に
kindでフィルタしてください — 企業 slug とサプライヤー slug は、パイプラインの他の箇所で相互に入れ替え可能な入力ではありません。 - 主要指標であり、生の出荷記録ではない。 これは企業レベルの集約(出荷件数、サプライヤー件数、日付範囲)であり、すべての Bill of Lading エントリの1件ごとのエクスポートではありません — その部分は ImportYeti 自身の有料ティアがより深く扱っています。
- 電話番号はマスクされた状態で返ってくる。 phone のような連絡先フィールドは、公開レポートにおいて部分的に伏せられています。これは有料アカウントなしで ImportYeti 自身が表示している内容と一致します。
- ImportYeti の規約の下での非商用の再販制限。 正当に収集したものであっても、サイト自身の規約は許可される利用の範囲を非商用目的に限定しており、サイトを通じてアクセスした情報やデータの販売を禁止しています — 商用利用を計画する際はこれを踏まえてください。
- 一括エクスポートがない。 ImportYeti の完全な企業ディレクトリの公式フィードは存在しません — 製品カテゴリ、キーワード、既知の企業・サプライヤー名で検索クエリを繰り返すことでカバレッジを構築してください。
どこで使われるか
- サプライヤーソーシングのパイプライン — 製品カテゴリで検索し、上位候補について企業レポートを取得してからアウトリーチを行います。
- 競合サプライチェーンリサーチ — 競合の既知のサプライヤーと、その出荷量の推移を時系列で追跡します。
- ベンダーリスクのモニタリング — スケジュールを組んで企業レポートを再実行し、出荷量が急落したサプライヤーをフラグします。
出典
収集を始める
まずは無料でお試しください: 任意の公開 URL を無料ウェブスクレイパーに通すか、アンチボットチェッカーでサイトがボットをブロックするかどうかを確認できます。サインアップ不要です。
検索と企業レポートのエンドポイントをプレイグラウンドで試し、API ドキュメントでスキーマを確認し、料金をご覧ください。異なる市場での同様の集約企業インテリジェンスのパターンについてはPitchBook のスクレイピング方法を、別の公開記録ベースのデータソースについてはSEC EDGAR のスクレイピング方法を参照してください。また、サプライヤー・ベンダーリサーチの人材面についてはLinkedIn のスクレイピング方法をご覧ください。ウェブスクレイピング API の選び方とウェブスクレイピングは合法かも参照してください。
よくある質問
APIでImportYetiの企業を検索するにはどうすればよいですか?
企業名またはサプライヤー名をCrawloraの/importyeti/searchエンドポイントに送信すると、kind、slug、country、addressを含む正規化された結果が構造化JSONで返ってきます。
ImportYeti APIの利用にアカウントやAPIキーは必要ですか?
呼び出し側でImportYetiのアカウントやAPIキーは不要です — 必要なのはCrawloraのAPIキーのみです。
企業レポートには何が含まれますか?
識別情報フィールド(名前、住所、マスクされた電話番号、ウェブサイト)に加えて、その企業の主要な米国税関の出荷量指標が含まれます。