Tony Wang6 Min. LesezeitImportYeti scrapen 2026 (API & Python)
ImportYeti 2026 scrapen — Zulieferer per Name suchen, US-Customs-Shipment-Reports als strukturiertes JSON — DIY, No-Code oder API.
Der schnellste Weg, ImportYeti 2026 zu scrapen, ist der Aufruf einer strukturierten API, die normalisiertes JSON für Company- und Supplier-Suche sowie vollständige Company-Reports liefert — statt ImportYetis gerenderte Seiten selbst zu parsen. ImportYeti macht aus US-Customs-Bill-of-Lading-Datensätzen ein durchsuchbares Verzeichnis von Zulieferern und Herstellern, die in die USA liefern, hat aber keine Self-Service-öffentliche API, und seine Terms of Service sind explizit zum Thema automatisierter Zugriff. Dieser Guide zeigt, was wirklich da ist, wo DIY scheitert, und die rechtlichen Grundlagen.
Warum ImportYeti scrapen?
ImportYetis Such- und Company-Report-Daten sind für Supply-Chain- und Sourcing-Workflows gemacht:
- Supplier-Discovery — nach einer Produktkategorie oder einem Firmennamen suchen, um herauszufinden, welche Fabriken und Hersteller diese Art von Produkt in die USA liefern.
- Wettbewerber-Supplier-Recherche — das Company-Profil einer bekannten Marke oder eines Konkurrenten nachschlagen, um zu sehen, wer ihre Zulieferer sind und wie sich ihr Importvolumen entwickelt.
- Sourcing-Due-Diligence — die zentralen Shipment-Volume-Metriken eines Kandidaten-Zulieferers abrufen, bevor du Kontakt aufnimmst, als schnellen Sanity-Check auf Größe und Aktivität.
- Vendor- und Supply-Chain-Monitoring — einen Company-Report nach Zeitplan erneut laufen lassen, um zu verfolgen, ob das US-Customs-Shipment-Volumen eines Zulieferers wächst, stagniert oder abfällt.
Ist es legal, ImportYeti zu scrapen?
Option 1: DIY in Python (und warum das scheitert)
Ein DIY-Scraper ruft ImportYetis Such- und Company-Profilseiten auf und parst das gerenderte HTML:
import requests
from bs4 import BeautifulSoup
resp = requests.get(
"https://www.importyeti.com/company/some-company-slug",
headers={"User-Agent": "Mozilla/5.0 (compatible; research-bot/1.0)"},
)
soup = BeautifulSoup(resp.text, "html.parser")
# Company identity fields and shipment-volume metrics render as
# client-side data, not consistently selectable static markup
Es funktioniert in der Demo und geht dann kaputt:
- Die Terms of Service nennen automatisierten Abruf direkt. ImportYetis Bedingungen verbieten explizit Robots, Spider und „any... manual or automatic device or process“, um die Site abzurufen, zu indexieren oder Data-Mining zu betreiben — das ist eine echte, wörtlich zitierte Einschränkung, keine generische Standardklausel.
- Keine öffentliche Such- oder Company-API zum Aufbauen. Es gibt kein Self-Service-Entwicklerprogramm — jedes Feld, das du willst, muss von einer gerenderten Seite gescrapt werden, ohne stabile Schema-Garantie über ein Redesign hinweg.
- Zwei verschiedene Ergebnisarten unter einer Suche. ImportYetis Suche mischt Companies und Suppliers in denselben Ergebnissen, und ein naiver Scraper muss beide korrekt unterscheiden, bevor er entscheidet, welche Seite als Nächstes abgerufen wird.
- Weiterverkauf ist laut den Bedingungen selbst vom Tisch. Selbst ein funktionierender Scraper löst nicht die größere Einschränkung — ImportYetis autorisierte Nutzung ist nicht-kommerziell, sodass ein gescraptes Datenset unter diesen Bedingungen weiterhin nicht verkauft oder weiterverbreitet werden darf.
Option 2: No-Code-Tools
Marktplatz-Scraper-Actors für ImportYeti gibt es, und sie können eine einmalige Company-Seite in eine Tabelle holen, aber sie erben dieselbe Terms-of-Service-Exponierung wie DIY — „any... manual or automatic device or process“ ist nicht auf handgeschriebenen Code beschränkt — und sie geben dir kein stabiles, versioniertes Schema für eine wiederholbare Sourcing-Pipeline.
Option 3: Eine strukturierte ImportYeti-API
Für einen wiederholbaren Workflow liefert Crawloras ImportYeti-API normalisiertes JSON für Company-/Supplier-Suche und vollständige Company-Reports — kein Seiten-Parsing, keine Zugangsdaten, und kein ImportYeti-Account oder API-Key vom Aufrufer erforderlich. Suche nach Company- oder Supplier-Namen:
curl "https://api.crawlora.net/api/v1/importyeti/search?query=stanley" \
-H "x-api-key: $CRAWLORA_API_KEY"
{
"code": 200,
"msg": "OK",
"data": {
"results": [
{
"kind": "company",
"slug": "stanley-black-decker-inc",
"name": "Stanley Black & Decker, Inc.",
"country": "United States",
"address": "1000 Stanley Drive, New Britain, CT"
},
{
"kind": "supplier",
"slug": "stanley-industrial-and-automotive-llc",
"name": "Stanley Industrial And Automotive LLC",
"country": "United States",
"address": ""
}
]
}
}
Dann übergibst du einen Company-Slug aus den Suchergebnissen an den Company-Report-Endpoint in Python:
import requests
h = {"x-api-key": "YOUR_API_KEY"}
base = "https://api.crawlora.net/api/v1/importyeti"
hits = requests.get(f"{base}/search", headers=h, params={"query": "stanley"}).json()["data"]["results"]
slug = hits[0]["slug"]
report = requests.get(f"{base}/company", headers=h, params={"slug": slug}).json()["data"]
Ein Company-Report ist normalisiertes JSON — Identitätsfelder plus zentrale US-Customs-Shipment-Volume-Metriken (das echte Feldset findest du in den docs):
{
"code": 200,
"msg": "OK",
"data": {
"slug": "stanley-black-decker-inc",
"name": "Stanley Black & Decker, Inc.",
"address": "1000 Stanley Drive, New Britain, CT",
"phone": "1-8**-***-****",
"website": "stanleyblackanddecker.com",
"shipment_count": 4218,
"supplier_count": 187,
"first_shipment_date": "2015-01-06",
"last_shipment_date": "2026-08-09"
}
}
Speichere eine Zeile pro Company pro Abruf, geschlüsselt nach slug, und lauf nach Zeitplan erneut, um shipment_count- und supplier_count-Trends über die Zeit zu verfolgen.
Was du sammeln kannst
Suchergebnisse (kind — Company oder Supplier —, Slug, Name, Land und Adresse) und vollständige Company-Reports (Identitätsfelder — Name, Adresse, maskiertes Telefon, Website — plus zentrale US-Customs-Shipment-Volume-Metriken wie Shipment-Count, Supplier-Count und erstes/letztes Shipment-Datum). Öffentliche Daten, so wie ImportYeti sie ohnehin bereitstellt — kein Weg, um rohe, unaggregierte Bill-of-Lading-Datensätze zu rekonstruieren oder ImportYetis eigene kostenpflichtige Abo-Stufen für tiefere Shipment-Level-Details zu umgehen.
Grenzen und typische Herausforderungen
- Die Suche liefert Companies und Suppliers zusammen. Filtere nach
kind, bevor du entscheidest, was als Nächstes passiert — ein Company-Slug und ein Supplier-Slug sind an anderer Stelle in einer Pipeline keine austauschbaren Eingaben. - Zentrale Metriken, keine rohen Shipment-Datensätze. Das ist Company-Level-Aggregation (Shipment-Counts, Supplier-Counts, Zeiträume) — kein zeilenweiser Export jedes Bill-of-Lading-Eintrags, worauf ImportYetis eigene kostenpflichtige Stufen tiefer gehen.
- Telefonnummern kommen maskiert zurück. Kontaktfelder wie Telefon sind im öffentlichen Report teilweise geschwärzt, passend zu dem, was ImportYeti selbst ohne kostenpflichtigen Account zeigt.
- Nicht-kommerzielle Weiterverkaufsbeschränkung unter ImportYetis Bedingungen. Selbst legitim gesammelt, begrenzen die eigenen Bedingungen der Site die autorisierte Nutzung auf nicht-kommerzielle Zwecke und verbieten den Verkauf von über die Site abgerufenen Informationen oder Daten — plane jede kommerzielle Nutzung entsprechend.
- Kein Bulk-Export. Es gibt keinen offiziellen Feed von ImportYetis vollständigem Company-Verzeichnis — baue Abdeckung auf, indem du Suchanfragen nach Produktkategorie, Keyword oder bekannten Company-/Supplier-Namen iterierst.
Wo das eingesetzt wird
- Supplier-Sourcing-Pipelines — nach Produktkategorie suchen, dann Company-Reports für die Top-Kandidaten abrufen, bevor der Outreach startet.
- Wettbewerber-Supply-Chain-Recherche — die bekannten Zulieferer eines Konkurrenten und deren Shipment-Volume-Trend über die Zeit verfolgen.
- Vendor-Risk-Monitoring — einen Company-Report nach Zeitplan erneut laufen lassen, um einen Zulieferer zu markieren, dessen Shipment-Volumen stark abfällt.
Sources
Leg los mit dem Sammeln
Probier es zuerst kostenlos aus: jage eine beliebige öffentliche URL durch den Free Web Scraper, oder prüfe mit dem Anti-Bot Checker, ob eine Seite Bots blockiert — ohne Anmeldung.
Teste die Such- und Company-Report-Endpoints im Playground, sieh dir das Schema in den API docs an und wirf einen Blick aufs pricing. Für dasselbe aggregierte Company-Intelligence-Muster in einem anderen Markt sieh dir how to scrape PitchBook an; für eine weitere auf öffentlichen Aufzeichnungen basierende Datenquelle sieh dir how to scrape SEC EDGAR an; und für die People-Seite von Supplier- und Vendor-Recherche sieh dir how to scrape LinkedIn an. Siehe auch how to choose a web scraping API und is web scraping legal.
Häufig gestellte Fragen
Wie durchsuche ich ImportYeti-Companies mit einer API?
Sende einen Company- oder Supplier-Namen an Crawloras /importyeti/search-Endpoint und erhalte normalisierte Ergebnisse — kind, slug, country und address — als strukturiertes JSON.
Braucht die ImportYeti-API einen Account oder API-Key?
Vom Aufrufer ist kein ImportYeti-Account oder API-Key erforderlich — nur dein Crawlora-API-Key.
Was enthält der Company-Report?
Identitätsfelder (name, address, masked phone, website) plus zentrale US-Customs-Shipment-Volume-Metriken für dieses Unternehmen.