Tony Wang6 Min. LesezeitProduct Hunt scrapen 2026 (API & Python)
Product-Hunt-Launch-, Produkt- und Maker-Daten 2026 — offizielle GraphQL-API, No-Code-Tools oder eine strukturierte API — mit echten JSON-Beispielen.
Product Hunt ist eine der Plattformen in dieser Serie mit einer echten, kostenlosen, offenen offiziellen API — eine OAuth-App registrieren, einen Token holen und ihr GraphQL-Schema abfragen. Die ehrliche Frage lautet also nicht „hat Product Hunt eine API", sondern „wann willst du trotzdem eine Scraping-API statt selbst GraphQL-Queries zu bauen". Dieser Guide deckt Product Hunts eigene API, No-Code-Optionen und eine strukturierte Multi-Platform-API ab, mit der rechtlichen Realität zu jeder Option gleich vorweg.
Warum Product Hunt scrapen?
Product Hunt ist eines der besten öffentlichen Signale für frühe Produkte — tägliche Launches, Rankings, Kategorien, Makers und Community-Reaktion, alles an einem Ort. Das speist:
- Launch-Monitoring — verfolgen, was täglich oder wöchentlich in einer Kategorie startet, in der du konkurrierst oder investierst.
- Startup- und Wettbewerbsrecherche — eine Company-Datenbank mit Tagline, Kategorie, Maker und Traction-Signalen anreichern, sobald ein Product launcht.
- Alternatives- und Positionierungsrecherche — sehen, was die eigene „Alternatives"-Liste eines Products über sein Wettbewerbsumfeld sagt.
- Customer- und Testimonial-Signal — die „Customers", die ein Product listet, abrufen, um zu sehen, wer es tatsächlich adoptiert.
- Trend- und Kategorie-Tracking — Kategorie-Leaderboards mit Google-Trends-Suchnachfrage kombinieren, um Hype von echtem Interesse zu trennen.
Ist es legal, Product Hunt zu scrapen?
Option 1: Product Hunts eigene GraphQL API (und ihre echte Reibung)
Product Hunts API v2 ist echtes GraphQL, kein REST. Zuerst registrierst du eine OAuth-Application unter api.producthunt.com/v2/oauth/applications, dann tauschst du entweder client_id/client_secret gegen einen Token oder generierst einen nicht ablaufenden Developer-Token auf der Dashboard-Seite deiner App. Jeder Request geht an einen einzigen Endpoint mit einem Query-Body:
curl -X POST "https://api.producthunt.com/v2/api/graphql" \
-H "Authorization: Bearer YOUR_DEVELOPER_TOKEN" \
-H "Content-Type: application/json" \
-d '{"query": "query { posts(first: 5, order: RANKING) { edges { node { id name tagline votesCount url } } } }"}'
Das ist ein legitimer, kostenloser Weg, um Product Hunts eigenen Launch- und Product-Graphen abzufragen — kein Scraping nötig. Wo es für eine echte Pipeline anfängt, Reibung zu erzeugen:
- OAuth-Registrierung, nicht ein einfacher API-Key. Du brauchst eine App-Registrierung und eine Redirect-URI, bevor du einen nutzbaren Token bekommst — auch für Read-only-Zugriff mit einem einzelnen User — mehr Setup als ein Copy-Paste-API-Key.
- Du schreibst GraphQL, nicht benannte Endpoints. Jedes Feld, das du willst, musst du selbst in der Query gegen Product Hunts Schema benennen; es gibt kein
/product/{id}-Shortcut. - Complexity-basiertes Rate-Limiting. Der GraphQL-Endpoint budgetiert rund 6.250 Complexity-Punkte pro 15 Minuten — die Kosten einer Query hängen von den angefragten Feldern und der Verschachtelung ab, nicht nur von der Anzahl der Requests, sodass ein paar tiefe Queries das ganze Fenster aufbrauchen können.
- Kommerzielle Nutzung braucht ein echtes Gespräch mit Product Hunt. Die API-Dokumentation gibt an, dass sie standardmäßig nicht für kommerzielle Nutzung gedacht ist, und bittet Businesses, sich direkt zu melden — das lohnt sich, gegen deinen tatsächlichen Use Case zu prüfen (siehe unseren commercial-use guide), bevor du darauf aufbaust.
Option 2: No-Code-Tools
Marketplace-Scraper-Actors existieren für Product-Hunt-Launch- und Product-Listings. Sie sind für einen einmaligen Pull oder einen Spreadsheet-Export okay, aber für eine geplante Pipeline fügen sie eine Ebene Indirektion hinzu, tragen dieselbe Site-Terms-Exposition wie das direkte Scrapen der Seite und lösen auch nicht das Multi-Platform-Schema-Problem.
Option 3: Eine strukturierte Product-Hunt-API (über Crawlora)
Wenn du Product Hunt neben anderen Plattformen in einer normalisierten Form willst — ein einfacher REST-Call und ein API-Key statt einer GraphQL-Query —, gibt dir eine Product Hunt scraping API genau das. Products suchen:
curl "https://api.crawlora.net/api/v1/producthunt/search?query=cursor" \
-H "x-api-key: $CRAWLORA_API_KEY"
{
"code": 200,
"msg": "OK",
"data": {
"edges": [
{
"node": {
"id": "1050265",
"name": "HeroUI Chat",
"tagline": "Build and ship beautiful UIs with AI and HeroUI",
"slug": "heroui-chat",
"reviewsRating": 4.8,
"reviewsCount": 5
}
}
],
"pageInfo": { "page": 1, "hasPreviousPage": false, "hasNextPage": true },
"pagesCount": 394
}
}
Löse dann die id auf und hole Product-Detail, Leaderboard und Alternatives in Python:
import requests
h = {"x-api-key": "YOUR_API_KEY"}
base = "https://api.crawlora.net/api/v1/producthunt"
hits = requests.get(f"{base}/search", headers=h, params={"query": "cursor"}).json()["data"]["edges"]
product_id = hits[0]["node"]["id"]
product = requests.get(f"{base}/product/{product_id}", headers=h).json()["data"]
alternatives = requests.get(f"{base}/product/{product_id}/alternatives", headers=h).json()["data"]
leaderboard = requests.get(f"{base}/leaderboard", headers=h, params={"scope": "daily"}).json()["data"]
Product-Detail ist normalisiertes JSON (echte Felder — sieh dir die docs an):
{
"code": 200,
"msg": "OK",
"data": {
"id": "chronicle-design",
"name": "Chronicle",
"tagline": "Visual version control for teams",
"description": "Chronicle lets designers and developers review every iteration in one place.",
"rating": 4.8,
"review_count": 152,
"followers_count": 2000,
"daily_rank": 1,
"weekly_rank": 1,
"monthly_rank": 1,
"date_published": "2024-07-21T12:34:56Z",
"categories": ["Design", "Productivity"],
"website": "https://chronicle.design",
"social_links": ["https://twitter.com/chronicle", "https://github.com/chronicle"]
}
}
Das tägliche Leaderboard wird über scope, year/month/day/week und order gescoped und liefert gerankte Items mit vote-nahen Scores:
{
"code": 200,
"msg": "OK",
"data": {
"scope": "daily",
"year": 2026,
"month": 4,
"day": 27,
"items": [
{
"type": "post",
"post": {
"id": "1101061",
"name": "Kitty Points Leaderboard",
"slug": "kitty-points-leaderboard",
"tagline": "Find interesting community members and see how you stack up",
"latest_score": 140,
"daily_rank": 3,
"weekly_rank": 9,
"comments_count": 18
}
}
]
}
}
Category, Category-Products, Makers, Launches, Customers und Reviews folgen alle derselben id-in-JSON-out-Form — speichere eine Zeile pro Product (oder pro Launch) und lauf das Ganze nach Zeitplan erneut.
Was du sammeln kannst
Öffentliche Product-Hunt-Daten: Suche über Products (id, name, tagline, slug, rating, review count); Product-Detail (rating, follower count, daily/weekly/monthly rank, date published, categories, website, social links); Leaderboards nach Tag/Woche/Monat mit rank und comment counts; Category-Detail und kategorie-gescopte Product-Listings mit einer KI-Summary und Tag-Counts; Makers pro Product; Launch-Historie pro Product; Alternatives mit Tag-Counts; und Customers, die ein Product listet. Beachte: Der Comments-Endpoint von Product Hunt wurde von der Upstream-Quelle im Mai 2026 wegen instabiler Zuverlässigkeit deprecatet und liefert jetzt eine 410 Gone-Response — Comment-Threads sind über diesen Weg aktuell nicht abrufbar.
Grenzen und typische Herausforderungen
- Wisse, welche Tür du benutzt. Product Hunts eigene GraphQL-API ist kostenlos und legitim für nicht-kommerzielle, plattformspezifische Arbeit; das direkte Scrapen von producthunt.com-Seiten verstößt so oder so ausdrücklich gegen Product Hunts Site-Terms.
- Kommerzielle Nutzung braucht ein echtes Gespräch mit Product Hunt. Die Bedingungen der offiziellen API flaggen kommerzielle Nutzung für direkten Kontakt mit Product Hunt, egal welches Tool am Ende aufruft.
- Manche Upstream-Endpoints verschlechtern sich mit der Zeit. Der Comments-Endpoint hier liefert nach einer Upstream-Deprecation
410 Gone— bau mit der Annahme, dass jeder einzelne Endpoint Abdeckung verlieren kann, und prüfe aktuelle Responses, bevor du dich auf ein Feld verlässt. - Fan-out pro Product. Ein vollständiger Record (Product plus Makers, Launches, Alternatives, Reviews) sind mehrere Calls pro id, nicht einer.
- Nur öffentliche Daten. Das sammelt, was Product Hunt bereits öffentlich zeigt — nie ein Weg, um Product Hunts Site-Restriktionen oder seine kommerziellen API-Bedingungen zu umgehen.
Wo das eingesetzt wird
- Launch-Monitoring — tägliche und wöchentliche Launches in einer Kategorie verfolgen, der du folgst.
- Startup-Datenbank-Anreicherung — Tagline, Kategorie, Rating und Maker-Daten an einen Company-Record anhängen, sobald er launcht.
- Wettbewerbs- und Positionierungsrecherche — die eigene Alternatives-Liste und das Customer-Roster eines Products lesen.
- Trend-Tracking — Kategorie-Leaderboards mit Suchnachfrage-Daten kombinieren, um echte Traction von Launch-Day-Rauschen zu trennen.
Sources
Leg los mit dem Sammeln
Probier es zuerst kostenlos aus: jage eine beliebige öffentliche URL durch den Free Web Scraper, oder prüfe mit dem Anti-Bot Checker, ob eine Seite Bots blockiert — ohne Anmeldung.
Teste die Search-, Product- und Leaderboard-Endpoints im Playground, sieh dir das Schema in den API docs an und wirf einen Blick aufs pricing. Product Hunt zeigt dir, was heute gelauncht ist und wer dahintersteckt; kombiniere es mit GitHub für die Developer- und Repo-Aktivität hinter einem Launch, oder mit PitchBook für die Funding-Historie hinter dem Unternehmen — Launch-Traction und Funding-Daten sind die zwei Hälften einer Early-Stage-Startup-Recherche-Pipeline. Siehe auch how to choose a web scraping API und is web scraping legal.
Häufig gestellte Fragen
Hat Product Hunt eine offizielle API?
Ja. Product Hunts GraphQL-API v2 unter api.producthunt.com/v2/api/graphql ist echt und kostenlos registrierbar — erfordert aber eine OAuth-App-Registrierung und das Bauen von GraphQL-Queries gegen Product Hunts Schema, und die Docs besagen, dass die API standardmäßig nicht für kommerzielle Nutzung ist.
Ist es legal, Product Hunt zu scrapen?
Product Hunts Site-Bedingungen verbieten das direkte Crawlen oder Scrapen von producthunt.com-Seiten. Der sanktionierte Weg für automatisierten Zugriff ist Product Hunts eigene GraphQL-API, und deren Bedingungen zur kommerziellen Nutzung sind separat von dieser Scraping-Einschränkung — siehe unseren Commercial-Use-Guide für die Checkliste.
Wie hoch sind Product Hunts offizielle API-Rate-Limits?
Der GraphQL-Endpoint ist komplexitätsbasiert: etwa 6.250 Komplexitätspunkte pro 15 Minuten, wobei die Kosten von Feldern und Verschachtelung in deiner Query abhängen statt von einer festen Request-Zahl. Andere v2-REST-artige Endpoints erlauben bis zu 450 Requests pro 15 Minuten.
Kann ich Product-Hunt-Kommentare über die API bekommen?
Aktuell nicht über diesen Weg — der Product-Comments-Endpoint wurde upstream im Mai 2026 wegen instabiler Zuverlässigkeit deprecated und gibt jetzt eine 410-Gone-Response zurück.
Kann ich Product-Hunt-Daten kommerziell nutzen?
Product Hunts eigene API-Dokumentation besagt, dass die API standardmäßig nicht für kommerzielle Zwecke genutzt werden darf, und bittet Unternehmen, Product Hunt direkt zu kontaktieren. Prüfe das zusammen mit den Site-Bedingungen und den eigenen Bedingungen jedes Tools, bevor du ein kommerzielles Produkt ausliefertst.
Wie bekomme ich die Alternatives oder Customers eines Product-Hunt-Produkts?
Beide sind id-begrenzte Endpoints — hol dir die Alternatives-Liste eines Produkts (mit Tag-Zählungen) oder seine Customers-Liste per Produkt-id, gleiche Form wie Produktdetail und Makers.
Was ist der schnellste Weg, Product-Hunt-Daten über viele Produkte hinweg zu sammeln?
Eine strukturierte REST-API mit einem Auth-Header und konsistentem JSON, statt GraphQL-Queries pro Feldset von Hand zu bauen, ist schneller, um über Suchergebnisse zu iterieren und regelmäßig zu Detail-, Maker- und Leaderboard-Endpoints zu verzweigen.